时间:2025-07-27 17:30 作者:任九天
腾讯混元亮相WAIC 2025,发布3D世界模型及系列开源模型
除3D模型外,腾讯混元还披露了包括端侧混合推理语言模型、多模态理解模型、游戏视觉模型等在内的一系列开源计划。
混元世界模型1.0应用概览(VR,游戏开发,场景编辑,物理仿真等)
(生成界面演示:生成3D场景资产可二次编辑)
对于无建模经验的普通用户,混元3D世界模型同样友好易用,通过混元 3D 创作引擎,仅需一句话或者一张图即可快速生成360°沉浸式视觉空间,生成的场景可无缝导入Vision Pro等虚拟头显,带来沉浸式体验。
混元3D世界模型1.0的核心还在于其创新的“语意层次化3D场景表征及生成算法”。该算法将复杂3D世界解构为不同语意层级,实现前景与背景、地面与天空的智能分离,不仅生成视觉效果逼真的整体场景,还能输出标准化的3D Mesh资产,兼容Unity、Unreal Engine、Blender等主流工具。用户可对场景内元素进行独立编辑或物理仿真,无缝衔接AIGC技术与传统CG工作流。
(游戏开发应用展示)
(物理仿真应用展示)
与全球领先的开源模型相比,混元3D世界模型1.0在文生世界、图生世界的美学质量和指令遵循能力等关键维度均全面超越当前SOTA的开源模型。目前,混元3D世界模型1.0已全面开源。从秒级生成单个3D资产,到一键打造可漫游的3D世界,腾讯混元正逐步构建完善的3D内容生成生态。
混元基座模型持续进化,综合能力全球领先
腾讯混元的模型迭代正在悄悄加速。
混元旗舰模型TurboS自年初发布后,保持着每月一个版本的快速迭代,在代码、理科能力和复杂指令遵循方面都有明显提升,在全球大模型权威排行榜上稳居前列。混元TurboS创新采用了前沿的混合线性注意力机制与MoE模型架构,是大模型研发前沿分支的重要代表,这也是业界首个基于混合线性注意力机制落地的超大规模MoE模型。
基于TurboS基座,混元T1进一步提升了推理能力,凭借架构创新和扎实的工程能力,混元T1综合能力国内领先,在项目级代码生成、高难度数学推理、文本写作等方面都展现出不错的效果。
全面拥抱开源,共建社区生态
在会上,腾讯混元进一步明确了其全面拥抱开源的路线。
前不久腾讯开源的企业级混合推理大语言模型混元-A13B,在总参数80B、激活参数仅13B的情况下,效果比肩同等架构的领先开源模型,同时推理速度更快,性价比更高。该模型因其在效率和性能上的平衡,发布后在Hugging Face社区获得了较高的关注度,开源仅 3 天,就拿下模型趋势榜的第二名。
混元还开放了完整多模态生成能力及工具集插件,陆续开源了业界领先的文生图、视频生成和 3D 生成能力,提供接近商业模型性能的开源基座,方便社区基于业务和使用场景定制,图像、视频衍生模型数量分别达到 1400 和 1600 个,混元3D系列模型社区下载量超过 230 万,已成为全球最受欢迎的3D开源模型。
腾讯混元 3D 世界模型 1.0:
l Github 项目地址:https://github.com/Tencent-Hunyuan/HunyuanWorld-1.0
l 项目主页:https://3d-models.hunyuan.tencent.com/world/
l 体验地址:https://3d.hunyuan.tencent.com/sceneTo3D
l Hugging Face 模型地址:https://huggingface.co/tencent/HunyuanWorld-1
1、辉煌60载 魅力新西藏丨从“黄沙窝”到“绿长城” 世界最大人工沙棘林在雪域高原上书写生态奇迹
2、周波:一味强调中美合作恐怕是徒劳,但双方理应达成一个共识,周波百科
3、意媒:国米签莱奥尼受阻 卢克曼经纪人正撮合国米亚特兰大达协议