2026年8月30日智能科技纵览
今日AI领域呈现多模态技术加速迭代、大模型轻量化与专业化并行发展的态势。科技巨头纷纷推出新一代旗舰模型,开源社区持续活跃,AI芯片与专用硬件创新不断。同时,AI应用场景向办公、影视、工业等领域深度渗透,人形机器人技术取得突破性进展,人工智能正加速从实验室走向产业落地,重塑各行各业的生产与交互方式。
腾讯发布开源旗舰模型Hy4preview
腾讯正式发布新一代开源旗舰模型Hy4preview,该模型在多语言理解、逻辑推理和代码生成能力上实现显著提升。作为混元大模型家族的最新成员,Hy4preview采用了创新的混合专家架构,支持128K上下文窗口,并在多个权威基准测试中达到行业领先水平。腾讯表示,该模型将面向研究机构和开发者社区开放,推动AI技术的普惠应用。
此次发布标志着腾讯在大模型开源战略上的进一步深化。Hy4preview的推出有望降低企业级AI应用的开发门槛,特别是在跨语言服务和复杂任务处理领域。腾讯计划在未来三个月内推出配套的开发工具和API服务,构建完整的AI开发生态,进一步巩固其在开源AI领域的领先地位。
谷歌推出AI视频生成模型Gemini Omni 1.1 Flash
谷歌正式发布新一代AI视频生成模型Gemini Omni 1.1 Flash,该模型能够以高分辨率生成长达60秒的视频内容,并支持文本到视频、图像到视频和视频风格迁移等多种功能。Gemini Omni 1.1 Flash在动作连贯性和细节表现上较前代产品提升40%,生成速度提高3倍,已面向部分创作者开放测试。
这一发布将加速AI内容创作工具的普及,为影视制作、广告创意和数字内容产业带来变革。谷歌计划在第四季度将该模型整合至YouTube创作平台,并推出面向专业用户的定制化服务。随着生成式AI技术的成熟,视频内容生产正从专业领域向大众创作者扩展,预计将催生全新的内容创作生态和商业模式。
智谱开源原生多模态模型GLM-5.3-Flash
智谱AI宣布开源原生多模态大模型GLM-5.3-Flash,该模型统一处理文本、图像、音频和视频等多种模态数据,参数规模达50亿。GLM-5.3-Flash在多模态理解任务上达到业界领先水平,特别在跨模态检索和视频内容分析方面表现出色。模型采用高效训练方法,在保持高性能的同时显著降低了计算资源需求。
GLM-5.3-Flash的开源将促进多模态AI技术的普及和应用创新。智谱AI表示,该模型特别适合智能客服、多媒体内容审核和跨语言信息检索等场景。未来三个月,智谱计划推出针对医疗、教育等垂直领域的微调版本,并建立开发者社区,推动多模态AI技术在各行业的落地应用。
阿里通义推出多模态MoE模型Qwen3.8-Flash
阿里巴巴通义团队发布多模态混合专家模型Qwen3.8-Flash,该模型采用创新的稀疏激活机制,在保持高性能的同时大幅降低计算成本。Qwen3.8-Flash支持文本、图像、语音等多种模态输入,在多语言理解和知识问答任务上表现优异,特别适合企业级应用场景。阿里云已将该模型集成至通义千问办公平台。
Qwen3.8-Flash的推出反映了AI模型向高效、专业化发展的趋势。阿里巴巴计划将该模型应用于电商智能推荐、企业知识管理和智能客服等领域,提升用户体验和运营效率。通义团队表示,未来将持续优化模型性能,并计划推出面向特定行业的定制化版本,满足不同企业的AI应用需求。
腾讯推出端侧翻译大模型Hy-MT2-1.8B
腾讯发布端侧翻译大模型Hy-MT2-1.8B,该模型专为移动设备和边缘计算场景优化,参数规模仅1.8亿,却能支持100多种语言之间的互译。Hy-MT2-1.8B在保持翻译质量的同时,将推理速度提升5倍,功耗降低70%,已集成至腾讯翻译君等应用产品。该模型特别适合低延迟、高隐私要求的翻译场景。
这一突破标志着AI大模型向轻量化、端侧化方向发展的重要进展。腾讯计划在未来将Hy-MT2-1.8B扩展至更多语言对,并支持离线翻译功能。随着全球化进程加速,高效、低耗的端侧翻译技术将在跨境沟通、国际商务和旅游服务等领域发挥关键作用,促进跨文化交流与合作。
字节发布AI办公智能体豆包工作
字节跳动正式发布AI办公智能体"豆包工作",该产品整合了大语言模型、多模态理解和自动化流程处理能力,能够智能处理文档、会议纪要、邮件回复等办公任务。豆包工作支持自然语言交互,可根据用户需求自动生成报告、总结会议内容、安排日程,目前已接入飞书平台,面向企业用户开放测试。
豆包工作的推出反映了AI技术在办公自动化领域的深入应用。字节跳动计划在未来六个月内扩展该智能体的功能范围,包括数据分析、项目管理等场景。随着AI办公助手功能的不断完善,企业工作效率有望得到显著提升,同时将改变传统的工作流程和协作模式,推动办公方式的数字化转型。
小米发布玄戒O3等AI芯片
小米正式发布新一代AI芯片"玄戒O3",该芯片采用7nm制程工艺,专为边缘AI计算设计,算力达40 TOPS。玄戒O3支持低精度计算和稀疏化推理,能效比提升3倍,已应用于小米智能家居设备和自动驾驶原型系统。同时,小米还发布了面向云端AI服务的"天穹V2"芯片,算力达到1000 TFLOPS。
小米AI芯片的推出标志着其在自研AI硬件领域的进一步突破。玄戒O3和天穹V2芯片将支撑小米在智能家居、自动驾驶和云计算等领域的AI应用发展。小米计划在未来三年内投入100亿元用于AI芯片研发,构建从端到云的完整AI计算平台,提升其在智能硬件市场的竞争力。
即梦AI推出影视厂牌即梦片场
即梦AI正式推出影视创作平台"即梦片场",该平台整合了AI剧本创作、虚拟拍摄、后期制作等功能,可一站式完成影视内容生产。即梦片场采用自研的多模态生成模型,能够根据文本描述生成高质量视频素材,并支持虚拟场景构建和角色动画生成。目前已有20余家影视制作机构接入该平台。
即梦片场的推出将加速AI技术在影视制作领域的应用,降低内容创作门槛。即梦AI计划在未来一年内扩展平台功能,包括AI配音、虚拟演员和互动叙事等特性,打造全新的影视创作生态。随着生成式AI技术的成熟,影视产业正迎来生产方式的变革,有望催生更多创新的内容形态和商业模式。
ChatGPT上线自定义贴纸功能
OpenAI宣布为ChatGPT平台上线自定义贴纸功能,用户可通过文本描述或简单草图生成个性化贴纸,并直接集成至对话界面。该功能采用先进的图像生成技术,支持多种风格和主题,用户可调整贴纸的大小、颜色和动画效果。目前该功能已面向Plus用户开放,预计下月扩展至所有用户。
自定义贴纸功能的推出丰富了ChatGPT的交互体验,增强了用户个性化表达。OpenAI表示,未来将扩展该功能的应用场景,包括虚拟形象定制和界面主题设计。随着AI生成内容的普及,个性化定制将成为AI产品的重要发展方向,满足用户日益增长的自我表达和社交互动需求。
谷歌测试Gemini新界面
谷歌开始测试Gemini AI助手的新界面,该界面采用更直观的交互设计,支持多模态内容展示和无缝任务切换。新界面整合了搜索、创作和助手功能,用户可通过自然语言指令完成信息查询、内容创作和任务管理。谷歌表示,新界面将逐步向全球用户推出,预计年底前完成全面更新。
Gemini新界面的测试反映了AI助手向更自然、更高效交互体验发展的趋势。谷歌计划在未来版本中增强上下文理解和多任务处理能力,打造真正的"数字伙伴"。随着AI助手功能的不断完善,人机交互方式正从命令式向对话式、从单一任务向多任务协同转变,将进一步改变人们获取信息和使用服务的方式。
第二届世界人形机器人运动会开幕
第二届世界人形机器运动会在上海开幕,来自全球20多个国家的50支队伍参赛,展示人形机器人在运动、救援和家庭服务等领域的最新进展。本届运动会设置了田径、体操、足球和障碍赛等多个项目,参赛机器人在灵活性、稳定性和自主决策能力上较上一届显著提升。
人形机器人运动会的举办反映了AI与机器人技术融合发展的最新成果。随着AI算法和硬件技术的进步,人形机器人在复杂环境中的适应能力和任务执行能力不断提升。未来三年,人形机器人有望在工业制造、医疗护理和家庭服务等领域实现规模化应用,成为推动社会智能化转型的重要力量。
DeepSeek前7月营收4.75亿元
AI企业DeepSeek公布2026年前7月营收达4.75亿元,同比增长210%,其中企业级AI解决方案贡献了75%的收入。DeepSeek专注于垂直行业AI应用,其金融风控、智能制造和医疗诊断等产品已获得多家头部企业采用。公司预计全年营收将突破8亿元,同比增长超过200%。
DeepSeek的快速增长反映了AI技术在垂直行业的深入应用和商业化落地加速。随着企业数字化转型需求的增加,专注于特定行业的AI解决方案正迎来快速发展期。DeepSeek计划在未来一年内扩大研发团队规模,并拓展至更多垂直领域,巩固其在行业AI应用领域的领先地位。
万相Wan3.0模型上线
万相科技正式发布新一代多模态大模型Wan3.0,该模型在图像生成、视频理解和跨模态检索任务上实现重大突破。Wan3.0支持高分辨率图像生成和复杂场景理解,在多个权威基准测试中达到行业领先水平。模型采用创新的注意力机制,大幅提升了计算效率和生成质量。
Wan3.0模型的推出将进一步推动多模态AI技术在创意设计、数字内容生产和虚拟现实等领域的应用。万相科技计划在未来六个月内推出面向设计、影视和教育等行业的定制化解决方案,并建立开发者社区,促进AI技术的创新应用。随着多模态AI技术的成熟,创意产业正迎来生产方式的变革,有望催生更多创新的内容形态和商业模式。




