斜杠中年斜杠中年AI × 沟通 × 商业 × 人生
AI 实战指南

混元世界 2.0 手把手教程:从注册到生成第一个 3D 世界

这篇教程带你从零开始使用腾讯混元世界 2.0 —— 注册账号、上传图片、等待生成、下载导出,每一步都有详细说明。不需要任何 3D 经验。

2026-07-20更新: 2026-07-2010 分钟阅读Wesley Chong
#3D 生成#世界模型#混元#教程#腾讯#AI 工具#新手指南
混元世界 2.0 手把手教程:从注册到生成第一个 3D 世界|AI 实战指南 封面图

摘要

腾讯混元世界 2.0 的完整新手教程。从注册到生成再到导出,一步步教你把一张照片变成一个可漫游的 3D 世界。

前言

之前写过一篇混元世界 2.0 的介绍文章,讲了它是什么、能做什么。今天这篇是实操教程——手把手教你从注册到生成第一个 3D 世界。

不管你是游戏开发者、设计师、还是单纯好奇的 AI 爱好者,这篇文章都能让你真正跑通一遍。

第一步:注册并访问平台

混元世界 2.0 有两个使用途径:

  1. 在线平台(推荐新手):访问 3d-models.hunyuan.tencent.com/world
  2. 本地部署(高级用户):从 GitHub 仓库 克隆代码自行运行

对于第一次接触的用户,建议先用在线平台。打开网站后:

  • 点击「注册」或使用微信扫码登录
  • 首次使用需要勾选同意服务条款
  • ⚠️ 注意:部分地区的用户可能需要使用 VPN 才能正常访问该平台

第二步:准备输入素材

混元世界 2.0 支持多种输入方式:

| 输入类型 | 说明 | 推荐质量 | | --- | --- | --- | | 文字提示 | 直接描述你想要的场景 | 尽量详细,包含光线、风格、元素 | | 单张图片 | 上传一张照片,AI 自动补全其余三面 | 高分辨率、清晰、主体明确 | | 多张图片 | 从不同角度拍摄同一场景 | 每张图片之间重叠 50%+ | | 视频 | 一段短视频,AI 提取多帧重建 | 稳定拍摄、光线充足 |

新手建议从单张图片开始。 找一张高质量的照片(建议 1080p 以上),主体清晰、背景不要太杂乱,效果会更好。

第三步:上传图片并生成

  1. 登录后,在主页找到「上传图片」按钮
  2. 选择你的图片并上传
  3. 点击「开始生成」

生成过程需要等待 20 分钟左右(在线平台)。这是因为模型需要:

  • 分析输入图片的空间结构
  • 预测四个方向(前、后、左、右)的场景延展
  • 用 3D 高斯泼溅(3DGS)技术生成点云数据
  • 构建可漫游的完整环境

生成完成后你会收到通知。

第四步:探索生成的 3D 世界

生成完成后,你可以直接在浏览器中探索:

  • 鼠标拖动:旋转视角
  • WASD 键:前后左右移动
  • Shift + 移动:加速奔跑
  • 滚轮:缩放远近

界面上有几个实用功能:

  1. 角色切换:按 Tab 键可以选择不同角色(人物、动物、机器人等),放入场景中漫游
  2. 画质调节:可以在「高清」和「流畅」之间切换。流畅模式帧数更高但细节稍差
  3. 人物缩放:默认按人眼高度(约 150-170cm)生成,可按需调整
  4. 光影开关:可以开启/关闭阴影效果

第五步:导出 3D 资产

生成的世界可以导出为以下格式:

| 格式 | 用途 | 导入工具 | | --- | --- | --- | | .splat (3DGS) | 高保真点云渲染 | Blender、Unity、专用播放器 | | .glb / .obj (Mesh) | 标准 3D 网格模型 | Blender、Unreal Engine、Three.js | | 深度图 + 法线图 | 后期处理和材质贴图 | 任意 3D 软件 |

导出步骤:

  1. 在探索界面找到「下载」按钮
  2. 选择想要的格式(3DGS 或 Mesh)
  3. 下载完成后可以拖入 Blender 预览

进阶:本地部署(可选)

如果你想在本地运行 HY-World 2.0,以下是基本流程:

环境要求

| 项目 | 最低配置 | 推荐配置 | | --- | --- | --- | | GPU | RTX 4080 (16GB VRAM) | RTX 4090 (24GB VRAM) | | 系统内存 | 32 GB | 64 GB | | 磁盘空间 | 80 GB | 200 GB | | CUDA | 12.1 | 12.4+ | | Python | 3.10 | 3.10 | | PyTorch | 2.4.0 | 2.4.0+ |

安装步骤

# 1. 克隆仓库
git clone https://github.com/Tencent-Hunyuan/HY-World-2.0
cd HY-World-2.0

# 2. 创建虚拟环境
conda create -n hyworld2 python=3.10 -y
conda activate hyworld2

# 3. 安装 PyTorch (CUDA 12.4)
pip install torch==2.4.0 torchvision==0.19.0 \
  --index-url https://download.pytorch.org/whl/cu124

# 4. 安装依赖
pip install -r requirements.txt
pip install flash-attn --no-build-isolation

# 5. 启动 Gradio 演示界面
python -m hyworld2.worldrecon.gradio_app

启动后访问 http://localhost:7860 即可使用。

Python API 方式

from hyworld2.worldrecon.pipeline import WorldMirrorPipeline

# 加载模型(约 1.2B 参数,BF16)
pipeline = WorldMirrorPipeline.from_pretrained('tencent/HY-World-2.0')

# 从图片文件夹重建 3D 场景
result = pipeline('path/to/images')

# 或者从视频重建
result = pipeline('path/to/video.mp4')

常见问题

生成的质量不够好怎么办?

  • 确保输入图片分辨率足够高(建议 1080p+)
  • 主体不要太靠近图片边缘
  • 光线均匀、没有严重阴影的图片效果更好
  • 背景越简单,生成结果越清晰

为什么我的账号无法访问?

部分地区的 IP 可能被限制。尝试:

  • 使用 VPN 连接至中国大陆节点
  • 确认已接受服务条款(首次使用需要)
  • 等待几天后再试(平台有时会对新用户有限制)

生成的世界能直接用于游戏吗?

目前阶段,HY-World 2.0 生成的场景适合作为**原型和灰盒(greybox)**使用,还达不到 AAA 游戏的品质。但对于独立游戏、概念验证、快速原型设计来说已经完全够用。

本地运行显存不够怎么办?

  • 降低输入分辨率(最低支持 50K 像素)
  • 启用 --enable_bf16 减少显存占用
  • 如果是 16GB 显卡,考虑使用 RTX 4090(24GB)

总结

混元世界 2.0 是目前最接近「一句话生成可漫游 3D 世界」的工具。对新手来说,最简单的路径就是:

  1. 在线平台注册 → 上传图片 → 等待 20 分钟 → 探索导出
  2. 觉得不够用 → 再考虑本地部署

如果你想了解它背后的技术原理、适合哪些人群、以及为什么对小团队很重要,可以去看我之前写的介绍文章


参考来源:Tencent HY-World 2.0 GitHubHuggingFace 模型页官方文档

常见问题

我需要什么样的电脑才能运行?

如果只是在线使用(通过腾讯网页端),不需要特殊硬件。如果想本地部署,建议至少 16GB VRAM 的 NVIDIA 显卡(RTX 4080 或以上),推荐 24GB(RTX 4090)。

生成一个世界要等多久?

在线平台通常需要 20 分钟以上,具体取决于输入图像的分辨率和复杂度。本地运行时间会更长。

生成的 3D 世界能商用吗?

HY-World 2.0 使用的是自定义社区许可证(tencent-hy-world-2.0-community),不是标准的 Apache 2.0 或 MIT。商业用途需要仔细阅读 License.txt 中的条款。

分享这篇文章 / Share Article
Wesley Chong

作者

Wesley Chong

来自马来西亚居銮的软件开发者、数字顾问、Toastmasters 讲员。

专注帮助普通人用 AI 升级沟通、表达、商业与人生。

相关阅读