跳到主要内容
极客日志极客日志面向AI+效率的开发者社区
首页博客我的书AI学习GitHub 精选镜像AI 生图工具UI配色美学关于
搜索内容 / 工具 / 仓库 / 镜像...⌘K搜索
注册
博客列表
PythonAI算法

Wan2.1 文生视频模型本地部署及 ComfyUI 使用指南

Wan2.1 开源文生视频模型支持在普通家用显卡上运行。通过 ComfyUI 框架,用户可下载文本编码器、VAE 及扩散模型文件进行本地配置。部署完成后,双击启动脚本即可在浏览器界面输入提示词生成视频。支持调整分辨率与帧长,默认生成 3 秒视频。该方案无需云服务器,利用本地算力实现低成本 AI 视频创作,适合独立创作者尝试。

CodeArtist发布于 2026/4/11更新于 2026/9/3094 浏览
Wan2.1 文生视频模型本地部署及 ComfyUI 使用指南

前言

当商业 AI 视频模型还在按分钟计费时,Wan2.1 开源模型已经实现了平民化突破!这款由国内团队开发的文生视频工具,在 VBench 榜单上多项指标超越同类闭源产品,尤其擅长生成自然场景和人物动作。最令人惊喜的是硬件门槛——普通家用 N 卡就能运行,8G 显存即可生成 720P 视频,让独立创作者也能玩转 AI 视频创作。

作为测试了 10+ 视频模型的创作者,Wan2.1 给我的最大惊喜是'场景一致性'。生成'猫咪在客厅玩耍'的视频时,家具位置和光影变化能保持连贯,这点比很多商业模型都强。不过初次使用需要注意:默认参数生成的视频只有 3 秒,想做长视频需要手动调整帧率。建议先从简单场景入手,熟悉后再尝试复杂镜头。

本文主要介绍如何在 Windows 系统电脑本地部署 ComfyUI 并接入通义万相 Wan2.1 模型,轻松实现使用文字指令生成 AI 视频。

1.软件准备

1.1 ComfyUI

首先访问 ComfyUI 的 Github 下载对应操作系统版本,本例使用 Windows 系统进行演示。

ComfyUI Github:https://github.com/comfyanonymous/ComfyUI

选择免安装版本(本例以适用于 N 卡的免安装版本 0.3.27 为例演示)。

下载后解压到已定义路径,然后继续下载其他软件。

1.2 文本编码器

现在需要下载文本编码器,大家可以根据显卡内存进行选择,本例中以 fp8 量化版进行演示,适用于低于 8G 的显卡,如果显卡内存高于 12G,可以选择 fp16 这个,生成后的视频精度会更高。

文本编码器下载地址:https://huggingface.co/Comfy-Org/Wan_2.1_ComfyUI_repackaged/tree/main/split_files/text_encoders

1.3 VAE

然后需要下载 VAE,点击 download 即可。

VAE 下载地址:https://huggingface.co/Comfy-Org/Wan_2.1_ComfyUI_repackaged/blob/main/split_files/vae/wan_2.1_vae.safetensors

1.4 视频生成模型

最后还需要下载 Wan2.1 视频生成模型,如果显卡配置较好,可以选择最完整的 32G 的模型。本例中以相对显卡要求较低的 wan2.1_t2v_1.3B_fp16.safetensors 模型进行演示。

注意:建议使用 fp16 版本而不是 bf16 版本,因为它们会产生更好的结果。

质量等级(从高到低):fp16 > bf16 > fp8_scaled > fp8_e4m3fn

视频生成模型下载地址:https://huggingface.co/Comfy-Org/Wan_2.1_ComfyUI_repackaged/tree/main/split_files/diffusion_models

2.整合配置

现在要把上边准备好的编码器、模型等整合到 ComfyUI 中,然后导入工作流文件,就能使用它来生成视频了。

首先,把文本编码器 umt5_xxl_fp8_e4m3fn_scaled.safetensors 放入 ComfyUI/models/text_encoders/

第二步,将 VAE 文件 wan_2.1_vae.safetensors 放入 ComfyUI/models/vae/

第三步,将 Wan 2.1 模型 放入 ComfyUI/models/diffusion_models/

最后一步,下载文字转视频所需的 Json 格式的工作流,右键另存为到桌面即可,稍后打开 ComfyUI 时拖入。

下载地址:https://comfyanonymous.github.io/ComfyUI_examples/wan/text_to_video_wan.json

3.本地运行测试

现在我们回到解压后的 ComfyUI 根目录,双击运行脚本。

启动中(启动后这个服务窗口也不要关)。

启动完毕后,会自动在浏览器打开 ComfyUI 的使用界面,或者在网址栏输入 http://127.0.0.1:8188 也可以。

然后,将刚才下载好的 Json 格式的工作流文件直接拖入这个界面即可。

使用文生视频前,可以先右键保存动画模块,在模式中选择 Always,这样以后生成的视频都会被自动保存下来。

然后在编辑器中输入提示词(中英文都可以),点击运行即可启动文生视频工作流。

例:一个小男孩在海边提足球

默认生成的视频参数是 832*480,如果需要修改可以在这里对宽度和高度进行调整。

默认视频长度是 33,如果需要修改可以在这里调整,更长的时长也需要更多的时间来生成视频。

总结

通过今天的分享,相信大家对如何本地使用 Wan2.1 大模型有了更多的了解。只需将生成的视频分享给团队成员,就能轻松实现高效协作,大幅提升工作效率!如果你是个人用户,无需依赖云服务器,也能在其他设备上远程登录和使用。以上就是在本地部署 ComfyUI 并接入 Wan2.1 大模型,结合内网穿透工具远程在线文字生成视频的完整教程,希望你随时随地享受 AI 创作的乐趣!

Wan2.1 的出现证明:开源 AI 也能打破闭源垄断。配合远程访问能力,更是让创意协作无边界。如果你也想低成本玩转 AI 视频创作,这个开源方案值得一试!

目录

  1. 前言
  2. 1.软件准备
  3. 1.1 ComfyUI
  4. 1.2 文本编码器
  5. 1.3 VAE
  6. 1.4 视频生成模型
  7. 2.整合配置
  8. 3.本地运行测试
  9. 总结

更多推荐文章

查看全部
  • Qwen3+Qwen Agent 智能体开发实战:接入 MCP 工具
  • 记忆化搜索与动态规划刷题总结
  • 深入解析 Redisson 分布式锁核心原理与源码实现
  • 飞算 JavaAI:Java 智能开发助手核心功能解析
  • AI 前端提示词设计与高效交互实践
  • 利用 AI 辅助开发高性能贪吃蛇游戏实战
  • SpringBoot 3 SpringDoc OpenAPI 常用注解详解与实战示例
  • LLaMA-Factory 本地部署与安装指南
  • Python 未来十年发展趋势与核心优势分析
  • Java 安全实践:SSL 与 MD5 双重加密在数据库交互中的应用
  • CSP-S 提高组 C++ 数位 DP 详解
  • 在 Cursor 中使用 MCP 服务
  • 企业级代码托管:GITEA 与 CI/CD 深度整合实践
  • Ubuntu 系统下 Node.js 环境配置与常见问题排查
  • 递归、搜索与回溯算法:深入理解记忆化搜索
  • 2026年3月AI动态:模型窗口突破与智能体生态扩张
  • Meta 新一代开源大语言模型 Llama 3 详解
  • 时序数据库选型指南:Apache IoTDB技术解析
  • 阿里开源纯前端浏览器自动化 PageAgent 技术解析
  • Vivado 项目 Git 版本管理实战指南

相关免费在线工具

  • 加密/解密文本

    使用加密算法(如AES、TripleDES、Rabbit或RC4)加密和解密文本明文。 在线工具,加密/解密文本在线工具,online

  • RSA密钥对生成器

    生成新的随机RSA私钥和公钥pem证书。 在线工具,RSA密钥对生成器在线工具,online

  • Mermaid 预览与可视化编辑

    基于 Mermaid.js 实时预览流程图、时序图等图表,支持源码编辑与即时渲染。 在线工具,Mermaid 预览与可视化编辑在线工具,online

  • 随机西班牙地址生成器

    随机生成西班牙地址(支持马德里、加泰罗尼亚、安达卢西亚、瓦伦西亚筛选),支持数量快捷选择、显示全部与下载。 在线工具,随机西班牙地址生成器在线工具,online

  • Gemini 图片去水印

    基于开源反向 Alpha 混合算法去除 Gemini/Nano Banana 图片水印,支持批量处理与下载。 在线工具,Gemini 图片去水印在线工具,online

  • curl 转代码

    解析常见 curl 参数并生成 fetch、axios、PHP curl 或 Python requests 示例代码。 在线工具,curl 转代码在线工具,online