全球AI动态精选(2026年8月5日)
今日AI行业呈现出技术开源加速、模型迭代提速、应用场景多元化的发展态势。从大模型开源到全模态技术突破,从评测基准建立到垂直领域应用落地,AI技术正以前所未有的速度向各行业渗透。资本层面,头部企业持续加码AI基础设施,同时新兴技术公司通过开源策略快速提升行业影响力,全球AI生态呈现出更加开放与协作的竞争格局。
商汤科技发布SenseNova U1.5-Lite-Preview开源模型
商汤科技于8月5日正式发布原生统一多模态模型SenseNova U1.5-Lite-Preview,该模型采用8B参数规模,专为轻量化部署设计。此次开源标志着商汤在多模态AI技术领域的进一步开放,开发者可通过官方渠道获取模型权重及完整训练代码,支持图像、文本和语音的跨模态理解与生成。
此举将加速多模态AI技术在边缘设备和资源受限场景的应用落地。SenseNova系列作为商汤的核心技术栈,其开源策略有助于构建更广泛的开发者生态,同时为行业提供轻量级多模态解决方案的参考标准。未来商汤计划基于该模型推出更多垂直领域优化版本,满足医疗、教育等行业的特定需求。
MiniMax发布全模态模型H3并排除美国地区使用
AI创新公司MiniMax于今日正式发布全模态大模型H3,该模型实现了文本、图像、音频和视频的统一处理能力。值得注意的是,MiniMax在发布声明中明确表示H3模型将排除美国地区用户使用,这一决定反映了公司在全球AI竞争格局下的战略考量。
H3模型的发布将进一步推动全模态AI技术的发展与应用边界拓展。排除美国市场的策略可能是MiniMax应对地缘政治竞争和监管环境差异的应对措施,同时也为公司聚焦亚太市场提供了机会。此举可能引发全球AI开源社区关于技术共享与区域限制的讨论,未来或将影响跨国AI技术合作模式。
阿里云推出Qwen3.8-Max旗舰大模型
阿里巴巴于8月5日发布新一代旗舰大模型Qwen3.8-Max,作为通义千问系列的最新迭代。该模型在多语言理解、复杂推理和长文本处理方面有显著提升,参数规模达到业界领先水平。Qwen3.8-Max已通过阿里云向企业客户开放,支持定制化训练和部署方案。
此次升级强化了阿里在AI基础设施领域的竞争力,Qwen3.8-Max将重点服务于金融、医疗、制造等行业的数字化转型需求。阿里计划在未来三个月内将该模型集成到其全线云服务产品中,构建从底层算力到上层应用的完整AI解决方案生态,进一步巩固其在中国AI市场的领先地位。
腾讯混元推出智能体评测基准E-Bench
腾讯AI实验室于今日正式发布智能体评测基准E-Bench(Entity-Benchmark),该基准涵盖知识问答、工具使用、多步推理和决策制定等多个维度,旨在为AI智能体提供标准化的评估体系。E-Bench包含超过10,000个测试用例,覆盖日常生活、专业工作和创新场景。
这一评测基准的推出将有助于规范AI智能体的发展方向,推动行业从单一模型能力向综合智能体能力的转变。腾讯表示将定期更新E-Bench内容,并邀请学术界和产业界共同参与完善。未来,腾讯计划基于E-Bench举办智能体竞赛,促进技术创新与最佳实践的分享,加速AI智能体在各行业的应用落地。
DeepSeek-V4-Flash正式版上线并开启API公测
深度求索公司于8月5日宣布其大模型DeepSeek-V4-Flash正式版全面上线,同时开放API公测服务。该模型在保持高性能的同时优化了推理效率,响应速度较上一代提升40%,成本降低30%。开发者可通过DeepSeek官方平台申请API接入,支持多种编程语言和框架。
DeepSeek-V4-Flash的正式发布将进一步降低企业应用大模型的门槛,特别是在实时对话、内容生成和数据分析等场景。深度求索计划在未来三个月内扩展API服务能力,增加多模态支持和行业定制选项,同时与多家云服务商合作推出更灵活的部署方案,满足不同规模企业的AI应用需求。
京东发布外卖AI智能头盔
京东物流于今日正式推出外卖配送专用AI智能头盔,该设备集成了语音交互、导航指引、安全预警和健康监测等多重功能。头盔采用轻量化设计,配备高清摄像头和骨传导耳机,支持与京东外卖平台的实时数据交互,可优化配送路线并提供骑手安全保障。
这一创新产品展示了AI技术在物流配送领域的深度应用,有望提升外卖配送效率并改善骑手工作体验。京东计划在未来半年内将该智能头盔推广至全国主要城市的配送团队,并逐步增加AR导航、环境感知等高级功能。此举不仅是对物流行业的技术升级,也为AI硬件与垂直场景结合提供了新的商业模式参考。
火山引擎上线豆包搜索开放服务
字节跳动旗下火山引擎于8月5日宣布正式上线豆包搜索开放服务,将大语言模型技术与搜索引擎深度融合。该服务支持自然语言查询理解、多轮对话交互和个性化结果推荐,企业客户可基于此构建垂直领域的智能搜索解决方案。
豆包搜索的开放标志着字节跳动在AI基础设施领域的战略布局进一步深化,通过将内部技术能力对外输出,拓展B端服务市场。火山引擎计划在未来六个月内持续优化搜索算法的准确性和实时性,并增加多模态内容理解能力,同时与更多行业合作伙伴共同探索搜索技术在电商、教育、医疗等领域的创新应用场景。
Seedance发布2.5版本实现30秒一镜到底视频生成
AI视频生成公司Seedance于今日发布2.5版本更新,实现了30秒一镜到底的长视频生成能力,解决了传统AI视频生成中场景切换不连贯的技术难题。新版本支持4K分辨率输出,并优化了人物动作和表情的自然度,可应用于广告制作、影视前期制作和内容创作等领域。
这一技术突破将显著提升AI在视频创作领域的实用性,降低专业视频制作的门槛。Seedance计划在未来三个月内推出更多行业定制模板,并与多家影视制作公司合作探索AI辅助创作的商业模式。随着生成式AI技术的不断成熟,Seedance的更新反映了行业从短片段生成向完整叙事能力发展的趋势,将进一步推动内容创作行业的数字化转型。
WorkBuddy上线人机双写协作平台
协作AI平台WorkBuddy于8月5日正式上线人机双写功能,该系统可实现人类创作者与AI模型的实时协同写作。平台支持多种文档类型,能够智能识别写作风格并提供内容建议,同时保持创作者的最终决策权。WorkBuddy已集成主流办公软件生态,支持实时同步和版本管理。
这一平台的推出反映了AI辅助创作工具向更深层次协作模式发展的趋势。WorkBuddy团队表示,未来将重点提升对专业领域写作的支持,包括学术论文、法律文书和技术文档等场景,并计划引入多语言协作功能。随着远程工作和混合办公模式的普及,这种人机协作平台有望成为知识工作者的标准工具,重塑内容创作的工作流程。
OpenAI推出GPT-5.6模型家族
OpenAI于8月5日宣布推出GPT-5.6模型家族,作为其大语言模型系列的最新迭代。新版本在逻辑推理、代码生成和多语言理解方面有显著提升,同时引入了更强大的工具使用能力,可调用外部API和执行复杂任务。GPT-5.6系列包括多个规格版本,满足不同应用场景的需求。
此次升级进一步巩固了OpenAI在AI大模型领域的领先地位,GPT-5.6的增强能力将推动AI在专业服务、软件开发和科学研究等高价值领域的应用深度。OpenAI计划在未来六个月内逐步扩大模型的应用范围,并加强安全与伦理保障措施。随着AI能力的持续提升,GPT-5.6的发布也引发了关于AI发展速度与安全边界的行业讨论,促使各方更加关注AI技术的负责任创新。
Fish Audio发布S2.1Pro实时对话语音模型
语音AI公司Fish Audio于今日发布S2.1Pro实时对话语音模型,该模型在低延迟、高自然度和多语言支持方面实现突破。S2.1Pro响应时间缩短至80毫秒,支持超过30种语言的实时对话,并具备情感识别和语音风格转换能力,可应用于智能客服、虚拟助手和实时翻译等场景。
这一技术进步将显著提升人机交互的自然流畅度,特别是在需要实时响应的应用场景中。Fish Audio计划在未来三个月内推出针对客服和医疗等垂直行业的优化版本,并探索与硬件厂商的合作机会。随着元宇宙和虚拟交互场景的兴起,高质量的实时语音技术将成为连接数字世界与物理世界的关键桥梁,推动人机交互体验的革命性变革。
面壁智能开源Stencil全自动研究部署系统
面壁智能于8月5日正式开源Stencil全自动研究部署系统,该系统集成了从数据处理、模型训练到部署监控的全流程自动化能力。Stencil支持多种AI框架和硬件平台,可大幅降低AI模型开发和部署的技术门槛,特别适合研究机构和中小企业使用。
这一开源系统的推出反映了AI开发工具向自动化和普惠化发展的趋势。面壁智能表示将持续更新Stencil功能,并计划建立开发者社区共同完善系统。随着AI技术的快速迭代,自动化部署工具将成为推动AI创新的关键基础设施,帮助更多组织高效地将AI研究成果转化为实际应用,加速AI技术在各行业的普及和落地。
阿里推出多角色Agent协作工作台「万有无界」
阿里巴巴于8月5日发布多角色Agent协作工作台「万有无界」,该平台支持多个AI智能体之间的协同工作,可实现复杂任务的分解与执行。万有无界内置角色定义、任务分配和结果整合机制,企业可基于此构建定制化的多智能体系统,应用于客户服务、供应链管理和创意协作等场景。
这一工作台的推出标志着AI应用从单一智能体向多智能体协作系统的演进,将显著提升AI处理复杂任务的能力。阿里计划在未来半年内扩展万有无界的行业解决方案,并开放API接口支持第三方开发者构建更多元化的智能体应用。随着企业数字化转型的深入,多智能体协作系统有望成为下一代AI应用的基础架构,重塑人机协作和组织运营模式。




