全球AI动态精选(2026年7月23日)
今日AI领域呈现多线并进发展态势,大模型持续迭代升级,多模态能力显著增强,同时开源生态与商业应用同步繁荣。谷歌、腾讯、阿里等科技巨头纷纷发布新一代AI产品,开源社区也不乏创新突破,具身智能与长内容生成成为新热点。AI技术在垂直行业的应用进一步深化,从创意设计到科研辅助,展现出广泛赋能潜力。
谷歌发布Gemini 3.6 Flash系列模型
谷歌于7月23日正式推出Gemini 3.6 Flash、3.5 Flash Cyber和3.5 Flash-Lite三款新AI模型,主打轻量级高效能特点。其中Gemini 3.6 Flash在保持强大性能的同时,将推理速度提升了40%,而3.5 Flash Cyber则专注于网络安全领域,3.5 Flash-Lite则针对移动端和边缘计算场景进行了优化。
此次发布标志着谷歌在轻量化AI模型领域的战略布局进一步深化,三款模型分别针对不同应用场景,旨在扩大AI技术在各类设备和环境中的覆盖面。特别是3.5 Flash-Lite的推出,将有助于谷歌在移动端AI市场的竞争,为未来智能手机、物联网设备等提供更强大的本地AI能力支持。
腾讯Miora AI创意平台全量上线
腾讯于7月23日正式宣布其Miora AI创意平台全量上线,该平台整合了腾讯最新的多模态AI技术,能够提供从文本生成、图像创作到视频制作的全流程AI辅助创意服务。平台支持超过20种创意场景,包括广告设计、内容创作、游戏美术等多个领域。
Miora平台的推出标志着腾讯在AI创意产业领域的重要布局,将帮助中小企业和独立创作者降低创意门槛,提高生产效率。平台采用订阅制商业模式,基础功能免费,高级功能按需付费,预计将成为腾讯AI商业化的重要增长点,同时也将进一步推动创意产业的数字化转型。
腾讯混元发布科研智能体Hyra-1.0
腾讯混元团队于7月23日发布科研智能体Hyra-1.0,这是一款专门面向科研工作者的AI助手,能够辅助文献分析、实验设计、数据处理和论文撰写等科研全流程。Hyra-1.0整合了腾讯最新的多模态理解能力和专业领域知识库,支持超过50个学科领域的科研需求。
Hyra-1.0的推出反映了AI技术在专业垂直领域的深度应用趋势,有望显著提升科研效率,加速创新发现。腾讯表示,该产品已与国内多家顶尖科研机构达成合作,将在生物医药、材料科学、人工智能等领域进行深度应用验证,未来计划进一步扩展至更多学科领域。
阿里发布Qwen-Image-3.0图像生成模型
阿里巴巴于7月23日发布通义千问图像生成模型Qwen-Image-3.0,该模型在图像质量、生成速度和可控性方面均有显著提升。新模型支持更高分辨率(8192×8192)的图像生成,并引入了更精细的风格控制和局部编辑功能,能够更好地理解和执行复杂的视觉创作指令。
Qwen-Image-3.0的发布将进一步强化阿里在AI视觉创作领域的技术优势,预计将在电商设计、广告创意、游戏美术等场景中广泛应用。阿里表示,该模型将逐步集成到阿里云的AI服务平台上,为企业和开发者提供更强大的视觉生成能力,同时探索与电商、娱乐等业务的深度融合。
马斯克将Grok集成至Excel
马斯克旗下的xAI公司于7月23日宣布,将其AI助手Grok成功集成至Microsoft Excel,为电子表格软件带来强大的数据分析与处理能力。此次集成允许用户通过自然语言指令直接操作Excel数据,执行复杂的数据分析、可视化生成和报告制作任务,无需编写公式或宏。
此次合作标志着AI技术与传统办公软件的深度融合,有望大幅提升工作效率。Grok在Excel中的应用将改变用户与电子表格的交互方式,降低数据分析的技术门槛,使更多非专业用户能够轻松完成复杂的数据处理任务。这一整合也可能引发其他办公软件厂商的跟进,加速AI在办公自动化领域的普及。
千问3.8模型即将发布
百度于7月23日宣布,其新一代大模型千问3.8将于下月正式发布。据悉,千问3.8在多语言理解、知识更新和推理能力方面均有显著提升,特别是在中文处理和专业领域知识方面表现突出。新模型采用了更高效的训练架构,参数规模较前代产品减少30%,但性能提升了25%。
千问3.8的发布将进一步巩固百度在中文大模型领域的领先地位,同时也反映了AI模型向更高效、更专业化发展的趋势。百度表示,新模型将重点强化在医疗、法律、金融等垂直领域的应用能力,并计划推出面向企业和开发者的定制化服务,推动AI技术在各行业的深度应用。
字节发布Seed Audio 1.0音频生成模型
字节跳动于7月23日发布Seed Audio 1.0音频生成模型,这是一款专注于高质量音频内容创作的AI工具。Seed Audio 1.0支持多种音频类型的生成,包括音乐、音效、语音合成等,特别在音乐创作方面引入了风格迁移和情感控制功能,能够生成具有特定风格和情感表达的原创音乐。
Seed Audio 1.0的推出反映了字节跳动在AI创意内容领域的战略布局,将进一步丰富其内容创作生态系统。该模型预计将应用于字节旗下的短视频平台、音乐流媒体服务等多个业务场景,同时也计划通过API形式向第三方开发者开放,拓展AI音频技术的应用边界。
面壁智能开源MiniCPM-Robot具身智能模型
面壁智能于7月23日开源了首个具身智能系列模型MiniCPM-Robot,该系列模型专注于机器人在物理世界中的感知、决策和执行能力。MiniCPM-Robot包含多个子模型,分别针对视觉导航、物体操作、人机交互等不同场景进行了优化,支持多种机器人和智能设备平台。
MiniCPM-Robot的开源标志着具身智能领域的重要进展,将加速AI技术在机器人领域的应用落地。面壁智能表示,该系列模型采用模块化设计,便于开发者根据具体需求进行定制和扩展,未来计划进一步扩展模型的能力范围,并加强与产业界的合作,推动具身智能技术在工业、服务、医疗等领域的实际应用。
昆仑万维开源Matrix-Game 3.5可交互世界模型
昆仑万维于7月23日开源新一代可交互世界模型Matrix-Game 3.5,该模型能够生成具有高度交互性的虚拟环境,支持复杂的物理模拟和多智能体协作。Matrix-Game 3.5在场景理解、物体交互和角色行为等方面表现出色,可用于游戏开发、虚拟训练、数字孪生等多种应用场景。
Matrix-Game 3.5的开源将进一步推动AI生成内容(AIGC)在游戏和虚拟现实领域的发展。昆仑万维表示,该模型采用了创新的训练方法,显著降低了高质量交互内容生成的门槛,未来计划通过社区合作不断完善模型能力,并探索与元宇宙、数字人等新兴技术的结合,创造更丰富的虚拟体验。
元石科技推出问小白5 Pro长内容生成引擎
元石科技于7月23日推出新一代长内容生成引擎问小白5 Pro,该引擎在长文本生成、逻辑连贯性和知识准确性方面有显著提升。问小白5 Pro支持超过10万字的连续内容生成,特别适合小说创作、剧本编写、技术文档撰写等长内容创作场景,并引入了多角色对话和情节控制功能。
问小白5 Pro的推出反映了AI技术在内容创作领域的专业化发展趋势,将进一步满足创作者对高质量长内容生成的需求。元石科技表示,该引擎已与多家内容平台和出版机构达成合作,将应用于网络文学、剧本创作、教育内容等多个领域,同时计划推出面向个人创作者的定制化服务,助力内容产业的创新发展。
阿里通义千问Qwen-Audio-3.0-TTS语音合成模型发布
阿里巴巴于7月23日发布通义千问语音合成大模型Qwen-Audio-3.0-TTS,该模型在语音自然度、情感表达和音色多样性方面达到新高度。Qwen-Audio-3.0-TTS支持超过100种音色,包括多种方言和外语口音,并引入了情感控制和韵律调节功能,能够生成更加自然、富有表现力的语音。
Qwen-Audio-3.0-TTS的发布将进一步推动AI语音技术在各行业的应用落地。阿里表示,该模型将集成到阿里云的语音服务中,为智能客服、有声读物、虚拟主播等场景提供更高质量的语音支持,同时计划探索与电商、教育、娱乐等业务的深度融合,创造更丰富的语音交互体验。
美团推出LoHoSearch下一代搜索智能体评测基准
美团于7月23日推出下一代搜索智能体评测基准LoHoSearch,该基准专注于评估AI系统在复杂搜索任务中的表现。LoHoSearch包含超过10万个测试用例,覆盖电商、本地生活、餐饮外卖等多个场景,评估指标包括相关性、时效性、准确性和用户体验等多个维度。
LoHoSearch的推出反映了AI搜索技术向更专业化、更场景化发展的趋势,将为搜索AI的研发提供重要参考。美团表示,该基准将向行业开放,希望通过建立统一的评测标准,推动搜索AI技术的进步,同时提升用户体验。未来,美团计划进一步扩展LoHoSearch的覆盖范围,并探索与更多垂直行业的合作,打造更加精准、高效的搜索解决方案。




