深圳商报·读创客户端首席记者 袁静娴
7 月 23 日腾讯发布公告,宣布将混元多模态模型部门与大语言模型部门两者合并,组建成为基础模型部。此举旨在整合资源,由腾讯首席 AI 科学家姚顺雨统一负责,借此提升模型研发的效率,并探索全模态模型所能达到的智能新高度。
腾讯混元以大语言模型为核心,逐步构建起包含图像、视频、语音以及 3D 生成模型在内的一整套模型矩阵。自 2026 年起,腾讯混元模型的更新迭代步伐明显加快,并且与公司内部各项业务的配合也越来越紧密。
新近于 7 月正式推出的大语言模型 Hy3,其性能表现远超同尺寸模型,并且其在参数规模上则达到了一般旗舰模型的 2 至 5 倍。这款模型目前已经服务于 WorkBuddy/CodeBuddy、元宝、Marvis、ima 等多个业务领域,其 API 服务也在腾讯云 TokenHub 以及数个海外平台上架。Hy3 发布的首周内,总调用量便较上一代模型 Hy2 实现了超过 68 倍的飞跃,同时 WorkBuddy 自选模型用户中,选择 Hy3 的比例高达 60%。
混元多模态模型同样在不断进步。4 月份,腾讯发布了开源的混元 3D 世界模型 2.0(Hy World 2.0),这款模型能够接收文字、图片、视频等多种类型的数据输入,依据这些输入自动生成、重建和模拟 3D 世界,而且它支持多种 3D 资产格式导出,可以和当前的游戏开发流程实现无缝对接,从而迅速地制作出游戏地图和关卡的原型。混元 3D 系列模型在相关社区中的下载量已经超过 300 万次,是国际上备受推崇的 3D 开源模型。而混元图像模型3.0,则在 LMArena 的排行榜上位列国内开源模型的榜首。








