前言
之前写过一篇混元世界 2.0 的介绍文章,讲了它是什么、能做什么。今天这篇是实操教程——手把手教你从注册到生成第一个 3D 世界。
不管你是游戏开发者、设计师、还是单纯好奇的 AI 爱好者,这篇文章都能让你真正跑通一遍。
第一步:注册并访问平台
混元世界 2.0 有两个使用途径:
- 在线平台(推荐新手):访问 3d-models.hunyuan.tencent.com/world
- 本地部署(高级用户):从 GitHub 仓库 克隆代码自行运行
对于第一次接触的用户,建议先用在线平台。打开网站后:
- 点击「注册」或使用微信扫码登录
- 首次使用需要勾选同意服务条款
- ⚠️ 注意:部分地区的用户可能需要使用 VPN 才能正常访问该平台
第二步:准备输入素材
混元世界 2.0 支持多种输入方式:
| 输入类型 | 说明 | 推荐质量 | | --- | --- | --- | | 文字提示 | 直接描述你想要的场景 | 尽量详细,包含光线、风格、元素 | | 单张图片 | 上传一张照片,AI 自动补全其余三面 | 高分辨率、清晰、主体明确 | | 多张图片 | 从不同角度拍摄同一场景 | 每张图片之间重叠 50%+ | | 视频 | 一段短视频,AI 提取多帧重建 | 稳定拍摄、光线充足 |
新手建议从单张图片开始。 找一张高质量的照片(建议 1080p 以上),主体清晰、背景不要太杂乱,效果会更好。
第三步:上传图片并生成
- 登录后,在主页找到「上传图片」按钮
- 选择你的图片并上传
- 点击「开始生成」
生成过程需要等待 20 分钟左右(在线平台)。这是因为模型需要:
- 分析输入图片的空间结构
- 预测四个方向(前、后、左、右)的场景延展
- 用 3D 高斯泼溅(3DGS)技术生成点云数据
- 构建可漫游的完整环境
生成完成后你会收到通知。
第四步:探索生成的 3D 世界
生成完成后,你可以直接在浏览器中探索:
- 鼠标拖动:旋转视角
- WASD 键:前后左右移动
- Shift + 移动:加速奔跑
- 滚轮:缩放远近
界面上有几个实用功能:
- 角色切换:按 Tab 键可以选择不同角色(人物、动物、机器人等),放入场景中漫游
- 画质调节:可以在「高清」和「流畅」之间切换。流畅模式帧数更高但细节稍差
- 人物缩放:默认按人眼高度(约 150-170cm)生成,可按需调整
- 光影开关:可以开启/关闭阴影效果
第五步:导出 3D 资产
生成的世界可以导出为以下格式:
| 格式 | 用途 | 导入工具 | | --- | --- | --- | | .splat (3DGS) | 高保真点云渲染 | Blender、Unity、专用播放器 | | .glb / .obj (Mesh) | 标准 3D 网格模型 | Blender、Unreal Engine、Three.js | | 深度图 + 法线图 | 后期处理和材质贴图 | 任意 3D 软件 |
导出步骤:
- 在探索界面找到「下载」按钮
- 选择想要的格式(3DGS 或 Mesh)
- 下载完成后可以拖入 Blender 预览
进阶:本地部署(可选)
如果你想在本地运行 HY-World 2.0,以下是基本流程:
环境要求
| 项目 | 最低配置 | 推荐配置 | | --- | --- | --- | | GPU | RTX 4080 (16GB VRAM) | RTX 4090 (24GB VRAM) | | 系统内存 | 32 GB | 64 GB | | 磁盘空间 | 80 GB | 200 GB | | CUDA | 12.1 | 12.4+ | | Python | 3.10 | 3.10 | | PyTorch | 2.4.0 | 2.4.0+ |
安装步骤
# 1. 克隆仓库
git clone https://github.com/Tencent-Hunyuan/HY-World-2.0
cd HY-World-2.0
# 2. 创建虚拟环境
conda create -n hyworld2 python=3.10 -y
conda activate hyworld2
# 3. 安装 PyTorch (CUDA 12.4)
pip install torch==2.4.0 torchvision==0.19.0 \
--index-url https://download.pytorch.org/whl/cu124
# 4. 安装依赖
pip install -r requirements.txt
pip install flash-attn --no-build-isolation
# 5. 启动 Gradio 演示界面
python -m hyworld2.worldrecon.gradio_app
启动后访问 http://localhost:7860 即可使用。
Python API 方式
from hyworld2.worldrecon.pipeline import WorldMirrorPipeline
# 加载模型(约 1.2B 参数,BF16)
pipeline = WorldMirrorPipeline.from_pretrained('tencent/HY-World-2.0')
# 从图片文件夹重建 3D 场景
result = pipeline('path/to/images')
# 或者从视频重建
result = pipeline('path/to/video.mp4')
常见问题
生成的质量不够好怎么办?
- 确保输入图片分辨率足够高(建议 1080p+)
- 主体不要太靠近图片边缘
- 光线均匀、没有严重阴影的图片效果更好
- 背景越简单,生成结果越清晰
为什么我的账号无法访问?
部分地区的 IP 可能被限制。尝试:
- 使用 VPN 连接至中国大陆节点
- 确认已接受服务条款(首次使用需要)
- 等待几天后再试(平台有时会对新用户有限制)
生成的世界能直接用于游戏吗?
目前阶段,HY-World 2.0 生成的场景适合作为**原型和灰盒(greybox)**使用,还达不到 AAA 游戏的品质。但对于独立游戏、概念验证、快速原型设计来说已经完全够用。
本地运行显存不够怎么办?
- 降低输入分辨率(最低支持 50K 像素)
- 启用
--enable_bf16减少显存占用 - 如果是 16GB 显卡,考虑使用 RTX 4090(24GB)
总结
混元世界 2.0 是目前最接近「一句话生成可漫游 3D 世界」的工具。对新手来说,最简单的路径就是:
- 在线平台注册 → 上传图片 → 等待 20 分钟 → 探索导出
- 觉得不够用 → 再考虑本地部署
如果你想了解它背后的技术原理、适合哪些人群、以及为什么对小团队很重要,可以去看我之前写的介绍文章。




