万相(Wan)是阿里达摩院推出的开源 AI 视频生成模型系列,与通义万相商业版共用底层技术,聚焦文生视频和图生视频。2024 年 8 月首次开源 14B 参数 Wan-Video,后续迭代多个版本,在开源社区 VBench 排行榜曾登顶榜首,是国产开源视频模型中国际影响力最强的项目之一。核心定位是提供私有化部署的视频生成能力,开发者下载模型在自有 GPU 运行,无需 API 付费。开源协议 Apache 2.0,支持商用、微调和二次分发。短板是本地部署算力要求高(推荐 24GB 以上显存),普通用户无法直接使用。
核心功能详解
- 文生视频:输入中文或英文文本生成短视频,支持写实、动画、国风水墨、赛博朋克等风格标签,已接入 ComfyUI
- 图生视频:上传静态图生成动态视频,支持原图保持+微动或大幅度运动两种模式
- 物理世界理解:物体运动、光影变化、流体效果优于多数开源竞品,视频物理合理性较好
- 多版本迭代:社区活跃,v2.1 提升分辨率和帧率,支持 720P 以上输出
- ComfyUI 集成:社区提供完整工作流节点,串联 AI 工具完成文生图→图生视频→后期增强管线
- Apache 2.0 商用:允许商用、微调、模型合并和二次分发,无额外授权费
- 社区平替:无法本地部署可通过魔搭社区(modelscope.cn)在线体验或租用云端 GPU
适合谁
- AI 视频开发者与研究者:私有化部署视频模型,微调定制、集成到产品管线,开源商用协议有保障
- ComfyUI 深度用户:已有 ComfyUI 图像管线,无缝接入万相节点扩展视频生成能力
- 开源社区贡献者:参与模型优化、LoRA 训练和社区插件开发,国内最活跃的开源视频模型社区之一
- 不适合:想点两下就生成大片的普通用户和追求 1080P 以上商业级画质的内容制作公司
价格与访问
| 项目 | 内容 |
|---|---|
| 免费额度 | 模型权重完全开源免费,魔搭社区提供有限免费在线体验额度 |
| 付费档位 | 本地部署无费用(需自有 GPU);云端部署需自行采购 GPU 算力(阿里云 PAI、AutoDL 等),具体以服务商定价为准 |
| 访问条件 | 代码和模型权重在 Hugging Face、ModelScope 等平台直接下载;国内用户推荐魔搭社区 |
使用建议
万相是"下载后整合"的模型,非"下载即用"。先确认 GPU 显存 ≥24GB,低配置易失败。优先走 ComfyUI 工作流——社区 WAN 节点封装了参数调优,省去踩坑成本。图生视频比文生视频可控性高很多,建议用高质量静态图作为起点。关注 Hugging Face 和魔搭上的社区 LoRA,微调版往往比官方通用版更出彩。

评论
加载中…