从 腾讯混元视频 官方 GitHub README 翻译整理的快速上手指南。
腾讯混元视频(HunyuanVideo)是腾讯开源的大规模视频生成模型框架,基于 PyTorch 实现。它能够根据文本描述直接生成高质量视频,是当前业界领先的开源视频生成方案之一。项目提供了完整的模型权重、推理代码和采样工具,支持在本地部署运行。
# 1. 克隆仓库
git clone https://github.com/Tencent-Hunyuan/HunyuanVideo.git
cd HunyuanVideo
# 2. 创建虚拟环境(推荐)
conda create -n hunyuan python=3.10
conda activate hunyuan
# 3. 安装依赖
pip install -r requirements.txt
# 4. 下载模型权重
# 从 HuggingFace 下载:https://huggingface.co/tencent/HunyuanVideo
# 或使用国内镜像加速下载
# 使用默认参数生成视频
python sample_video.py \
--model-path ./ckpts \
--prompt "一只可爱的橘猫在草地上打滚" \
--output-path ./outputs
| 参数 | 说明 | 默认值 |
|---|---|---|
--prompt |
视频描述文本 | 必填 |
--model-path |
模型权重路径 | ./ckpts |
--output-path |
输出目录 | ./outputs |
--video-length |
视频帧数 | 129 |
--video-size |
视频分辨率 | 720x1280 |
--seed |
随机种子 | 0 |
# 下载 FP8 权重后
python sample_video.py \
--model-path ./ckpts \
--prompt "一只可爱的橘猫在草地上打滚" \
--fp8
社区已为混元视频开发了丰富的生态工具:
翻译整理自 GitHub README,原文:https://github.com/Tencent-Hunyuan/HunyuanVideo