时间:2025-07-27 17:25 作者:继续倔强
腾讯混元亮相WAIC 2025,发布3D世界模型及系列开源模型
7月27日,2025世界人工智能大会腾讯论坛上,腾讯正式发布混元3D世界模型1.0,并宣布全面开源。这是业界首个开源可沉浸漫游、可交互、可仿真的世界生成模型,为游戏开发、VR、数字内容创作等领域带来了全新的可能性。
混元3D世界模型 1.0:一句话创造可漫游的3D世界
作为此次发布的亮点之一,腾讯混元3D世界模型1.0融合了全景图像合成与分层3D重建技术,同时支持文字和图片输入,实现了高质量、风格多样的可漫游3D场景生成。过去需要专业建模团队数周才能搭建的3D虚拟世界,现在只需一句文字或一张图片,几分钟内即可生成。
混元世界模型1.0应用概览(VR,游戏开发,场景编辑,物理仿真等)
对游戏开发者而言,混元3D世界模型极大简化了3D场景构建流程,只需输入“一座中世纪城堡,城堡塔楼宏伟壮阔,城堡周围是一座石头雕像,石头铺成的路以及美丽的花朵,卡通风格”等简单指令,模型即可快速生成包含建筑、地形、植被的完整3D场景。输出的Mesh文件可用于游戏原型搭建或关卡设计,还能灵活调整前景物体、更换天空背景,满足个性化创作需求。
(文生 3D 漫游场景效果展示:炽热的岩浆形成河流,在黑色熔岩的地表上流动,蒸汽雾霭)
对于无建模经验的普通用户,混元3D世界模型同样友好易用,通过混元 3D 创作引擎,仅需一句话或者一张图即可快速生成360°沉浸式视觉空间,生成的场景可无缝导入Vision Pro等虚拟头显,带来沉浸式体验。
(VR应用场景效果展示)
(游戏开发应用展示)
(物理仿真应用展示)
混元基座模型持续进化,综合能力全球领先
混元旗舰模型TurboS自年初发布后,保持着每月一个版本的快速迭代,在代码、理科能力和复杂指令遵循方面都有明显提升,在全球大模型权威排行榜上稳居前列。混元TurboS创新采用了前沿的混合线性注意力机制与MoE模型架构,是大模型研发前沿分支的重要代表,这也是业界首个基于混合线性注意力机制落地的超大规模MoE模型。
据介绍,除本次发布即开源的混元 3D 世界模型 1.0,混元还将在月底开源一系列小尺寸模型,包含0.5B、1.8B、4B、7B混合推理模型,更轻量、好部署。在LMArena Vision榜单拿下国内第一的多模态理解模型混元-large-vision,以及专为游戏场景优化的交互式游戏视频生成框架混元GameCraft等也将于近期对外开源。
前不久腾讯开源的企业级混合推理大语言模型混元-A13B,在总参数80B、激活参数仅13B的情况下,效果比肩同等架构的领先开源模型,同时推理速度更快,性价比更高。该模型因其在效率和性能上的平衡,发布后在Hugging Face社区获得了较高的关注度,开源仅 3 天,就拿下模型趋势榜的第二名。
混元还开放了完整多模态生成能力及工具集插件,陆续开源了业界领先的文生图、视频生成和 3D 生成能力,提供接近商业模型性能的开源基座,方便社区基于业务和使用场景定制,图像、视频衍生模型数量分别达到 1400 和 1600 个,混元3D系列模型社区下载量超过 230 万,已成为全球最受欢迎的3D开源模型。
腾讯混元 3D 世界模型 1.0:
l Github 项目地址:https://github.com/Tencent-Hunyuan/HunyuanWorld-1.0
l 项目主页:https://3d-models.hunyuan.tencent.com/world/
l Hugging Face 模型地址:https://huggingface.co/tencent/HunyuanWorld-1
1、大方公开!中兵集团官方宣传片展示全套无人作战体系,激光反无人机装备一同亮相!
2、毕业季就业指南!观网陪你避坑突围,解锁职场新可能!,观网文化传媒发展(北京)有限公司
3、东西问丨宋海涛:国际合作为何是人工智能时代“鲜明底色”?