2026年8月7日智能科技纵览
今日AI行业呈现技术迭代加速与商业应用深化双重趋势。大模型价格调整与开源生态竞争并存,多模态技术突破推动应用场景拓展,科技巨头持续加码AI原生工具开发,同时终端智能设备与行业解决方案深度融合,标志着人工智能正从单点技术突破向全场景智能化转型。
DeepSeek上调API价格,大模型商业化进程提速
DeepSeek宣布将于8月15日起上调其API服务价格,部分模型价格涨幅达15%。此次调价主要针对高性能模型,包括DeepSeek-V4系列,而基础模型价格保持稳定。DeepSeek表示,调价旨在应对日益增长的计算资源需求和研发投入压力,同时保证服务质量。
此次价格调整反映了大模型商业化的必然趋势。随着AI应用规模化落地,模型训练和推理成本持续攀升,厂商不得不通过价格优化实现可持续发展。预计未来半年内,更多AI大模型提供商将跟进调整价格策略,推动行业从"烧钱换市场"向"价值驱动"转变,加速AI技术的商业闭环形成。
美图发布AI创作平台MeituHub,赋能内容创作者
美图公司正式上线AI创作平台MeituHub,整合了图像生成、视频编辑、智能修图等多项AI功能。该平台支持一键生成高质量创意内容,并提供专业级编辑工具,面向个人创作者、设计师和内容营销团队。美图CEO表示,MeituHub将每月更新功能,持续提升创作效率。
美图此举标志着传统影像软件厂商向AI原生工具转型的重要一步。随着AIGC技术成熟,内容创作门槛大幅降低,专业创作者面临新的竞争格局。MeituHub的推出有望在创意产业形成"AI辅助+人类创意"的新模式,推动内容生产效率革命,同时也为美图开辟了新的增长曲线,减少对传统滤镜业务的依赖。
小红书全面加码AI战略,构建内容生态新范式
小红书宣布将全面加码AI战略,推出"AI内容创作助手"和"智能推荐升级"两大核心功能。AI内容创作助手能帮助用户快速生成图文、视频内容,而智能推荐系统则基于用户行为和内容特征提供更精准的个性化推荐。小红书计划在未来一年内投入10亿元用于AI技术研发。
小红书的AI战略反映了社交平台在内容过载时代的应对之道。通过AI辅助创作,平台可以提升内容生产效率,缓解创作者压力;而智能推荐则能增强用户体验,提高用户粘性。这一战略或将重塑社交媒体的内容生态,从"人找内容"向"内容找人"转变,同时也为广告营销提供更精准的触达渠道,有望成为小红书商业化的重要突破口。
京东开源视频实时编辑模型,推动媒体行业智能化
京东正式开源视频实时编辑模型"VREdit",该模型支持4K分辨率视频的实时处理,具备智能剪辑、色彩校正、场景识别等功能。VREdit基于京东自研的时空注意力机制,在保持高质量输出的同时,将处理效率提升了3倍。京东表示,该模型已在其内部内容生产系统中广泛应用。
京东开源VREdit模型反映了科技巨头推动AI技术普惠化的趋势。视频内容创作门槛高、成本大,实时编辑模型的开放将显著降低专业视频制作的技术门槛,尤其对中小型内容创作者和媒体机构具有重大价值。此举也将促进视频编辑领域的创新生态形成,预计未来将涌现更多基于VREdit的垂直应用,推动整个媒体行业向智能化、高效化方向发展。
Qwen-Image-3.0上线,阿里云图像识别能力再升级
阿里云正式推出Qwen-Image-3.0图像识别模型,新模型在物体检测、图像分类、场景理解等任务上的准确率较上一代提升12%,支持超过1000种图像标签的识别。Qwen-Image-3.0还新增了细粒度图像分割功能,能够精确识别图像中的微小对象。该模型现已接入阿里云视觉智能开放平台。
Qwen-Image-3.0的发布展现了阿里云在计算机视觉领域的持续投入。随着图像识别技术在安防、医疗、零售等行业的深度应用,对模型精度和功能多样性的要求不断提高。新模型的推出将进一步拓展AI在图像分析领域的应用边界,特别是在医疗影像分析、工业质检等高精度要求场景,有望推动相关行业智能化水平的显著提升。
腾讯混元发布Hy ASR 3.0 preview,语音识别准确率达98.7%
腾讯混元团队发布新一代语音识别模型Hy ASR 3.0 preview,在普通话识别任务上准确率达到98.7%,较上一代提升2.3个百分点。新模型支持12种语言的实时语音转写,并新增了方言识别和口语化表达理解功能。腾讯表示,Hy ASR 3.0已在其会议系统、智能客服等产品中落地应用。
Hy ASR 3.0的发布标志着语音识别技术在实用化道路上又迈进一步。随着人机交互需求的增长,语音作为最自然的信息交互方式,其识别准确率和多语言支持能力成为关键竞争点。腾讯此次升级不仅提升了基础识别能力,还增强了模型对口语化表达的理解,这将显著改善智能助手、会议系统等产品的用户体验,推动语音交互在更多场景中的普及应用。
商汤推出8B小钢炮U1.5-Lite-Preview,轻量化模型受关注
商汤科技发布8B参数轻量级大模型U1.5-Lite-Preview,该模型在保持高性能的同时,大幅降低了计算资源需求,可在消费级GPU上高效运行。U1.5-Lite-Preview在多项基准测试中表现优异,特别是在推理速度上比同类模型快40%。商汤表示,该模型主要面向移动端和边缘计算场景。
商汤推出轻量化模型反映了AI大模型"瘦身"的行业趋势。随着大模型参数规模不断扩大,部署成本和能耗问题日益突出。轻量化模型能够在性能和效率之间取得平衡,特别适合资源受限的移动设备和边缘场景。这一趋势将推动AI技术从云端向终端下沉,加速AI在消费电子、物联网等领域的普及,同时也为中小企业提供了使用大模型的可行路径。
MiniMax H3开源排除美国,开源生态呈现区域化特征
AI创企MiniMax宣布开源其全模态大模型H3,但明确表示该模型不向美国用户提供访问权限。H3支持文本、图像、音频等多种模态的处理,参数规模达到70B。MiniMax表示,此举是基于数据安全和合规考虑,未来将根据不同地区的监管政策调整开源策略。
MiniMax H3开源排除美国的做法反映了AI开源生态的区域化趋势。随着各国数据主权意识增强和技术竞争加剧,开源AI模型开始面临地缘政治因素的影响。这一趋势可能导致全球AI开源生态分化形成不同阵营,增加技术交流壁垒。同时,这也促使各国加速发展本土AI开源生态,推动AI技术更加多元化发展,长期来看或将形成多中心化的全球AI技术格局。
微软自研全双工AI语音模型曝光,实时交互体验革新
微软内部文档显示,其正在研发全双工AI语音模型"FullDuplex",该模型能够实现真正的实时语音交互,支持自然打断和上下文理解。FullDuplex采用创新的声学处理架构,将语音识别和生成的延迟降低至50毫秒以下,接近人类对话的自然节奏。预计该模型将于今年第四季度集成到微软Teams产品中。
微软全双工语音模型的研发代表了人机交互领域的重要突破。当前语音助手大多采用半双工模式,一次只能处理单方向交流,而全双工技术将彻底改变这一局限。这不仅将提升语音助手的使用体验,还将为远程会议、虚拟助手、智能客服等领域带来革命性变化,推动人机交互向更自然、更高效的方向发展,同时也为微软在AI语音领域的技术领先地位奠定基础。
Qwen3.8-Max上线,阿里云大模型家族再添新成员
阿里云正式发布Qwen3.8-Max大模型,该模型参数规模达到380B,在逻辑推理、代码生成、多语言翻译等任务上表现优异。Qwen3.8-Max采用了创新的混合专家架构,在保持高性能的同时,推理效率提升了35%。阿里云表示,该模型已向企业客户开放使用,支持定制化训练。
Qwen3.8-Max的发布展现了阿里云在大模型领域的持续投入和野心。随着企业级AI应用需求增长,大模型正从通用能力向行业专用方向发展。阿里云通过不断推出更大规模、更高性能的模型,巩固其在企业AI市场的领先地位。同时,混合专家架构的应用也反映了大模型发展的重要趋势——在追求规模化的同时,更加注重效率和实用性,这将是未来大模型竞争的关键方向。
DeepSeek-V4-Flash API开启公测,高性能模型普惠化
DeepSeek宣布其高性能大模型DeepSeek-V4-Flash API开启公测,开发者可通过API接口访问该模型的推理能力。DeepSeek-V4-Flash在保持高性能的同时,将推理成本降低了40%,特别适合需要高频调用的应用场景。公测期间,开发者可享受每月100万次免费调用额度。
DeepSeek-V4-Flash API的公测反映了大模型服务化的重要趋势。随着AI应用普及,开发者对高性能、低成本的大模型API需求日益增长。通过API形式提供服务,可以降低企业使用大模型的门槛,加速AI技术在各行业的落地应用。这一趋势将推动大模型从"产品"向"服务"转变,形成更加开放、多元的AI应用生态,同时也为AI厂商提供了持续稳定的收入来源。
京东外卖发布AI智能头盔,配送安全与效率双提升
京东外卖正式推出AI智能头盔,该设备集成了语音识别、路径规划、环境感知等多种AI功能。智能头盔可实时分析配送路线,自动规避拥堵路段,并通过语音助手与骑手交互。据测试,使用该头盔后,配送效率提升15%,安全事故率下降30%。京东计划年内将该设备推广至全国10万名外卖骑手。
京东外卖AI智能头盔的发布展示了AI技术在传统行业的创新应用。随着外卖行业竞争加剧,配送效率和安全性成为关键竞争力。AI智能头盔通过整合多种技术,为骑手提供全方位支持,不仅提升了工作效率,还增强了安全保障。这一案例表明,AI技术正深度融入传统行业,从单一功能向综合解决方案发展,未来将看到更多针对特定场景的AI智能设备出现,推动各行业向智能化、高效化转型。
兔展智能推出一站式AI设计生产工具RabbitVis
兔展智能发布一站式AI设计生产工具RabbitVis,该工具整合了图像生成、排版设计、内容创作等功能,支持一键生成营销素材。RabbitVis基于自研的多模态理解引擎,能够根据用户需求自动匹配设计风格和内容元素。兔展智能表示,该工具可将设计效率提升80%,已服务超过5000家企业客户。
兔展智能推出RabbitVis反映了AI在设计领域的深度渗透。随着AIGC技术成熟,设计行业正经历从专业工具向普惠工具的转变。一站式AI设计工具不仅降低了设计门槛,还大幅提升了生产效率,特别适合营销、广告等需要快速产出内容的场景。这一趋势将重塑设计行业的价值链,设计师的角色将从执行者转向创意指导,推动设计行业向更加高效、个性化的方向发展。
Meta推出终端编程AI智能体Muse Code
Meta正式发布终端编程




