开源视频模型(ComfyUI 免费可用)

背景

2026-09-01 调研:用户想做修仙题材漫剧,问 ComfyUI 里还有哪些不花钱的视频模型、各擅长什么风格。以下是当时仍在维护的主力开源模型。老一代(AnimateDiff / SVD / CogVideoX / Mochi)已被下面几个全面超越,新项目不建议再用。

主力模型对比

模型出品方擅长风格短板资源要求
Wan 2.2阿里通义万相(14B,Apache 2.0)开源里写实最强(人脸/人体/毛发织物 9/10);社区 LoRA 生态最大,国风/水墨/动漫现成 LoRA 最多;支持首尾帧速度最慢量化版 + 加速 LoRA 最低约 12GB;Mac 有适配教程
HunyuanVideo 1.5腾讯混元(8.3B)动作/物理最自然(水流、烟雾、火焰、布料);自带超分,可出 1080p风格化不如 LTX;偏写实官方最低 14GB(分层加载)
LTX-Video 13BLightricks(LTX 2 系列)风格化/动画/艺术类最强(8.5/10);速度最快(约为其他家 2-3 倍);原生竖屏 9:16写实最弱;视频里的文字渲染差最低 16GB 级,Mac 上最友好
MiniMax H3MiniMax(33B,社区许可免费商用)电影质感、物理还原;自带原声 + 口型同步;视频编辑榜第一;9 张参考图保角色有「AI 厚涂感、偏糊」;人物表情偏僵;动漫 LoRA 生态刚起步用户 M4 64GB Mac mini 实测能跑(768p)

注:「最低显存」各家按量化/优化方式口径不同,以实测为准。社区还流传「H3 量化版 8GB 显存可跑」的说法。

和漫剧(修仙题材)的关系

  • 漫剧成败的关键不是模型写实与否,而是角色一致性:先做出固定形象的角色设定图,再逐镜头「图生视频」让图动起来——角色一变,全剧作废
  • H3 的 Ref2VA(最多 9 张参考图)+ 首尾帧控制就是为这类需求设计的;MiniMax H3 用户已在本地跑,是零成本首选
  • 国内漫剧创作者的常见组合:Midjourney Niji / 即梦等先出角色图(画风由这一步决定),视频模型只负责让画面「动」起来
  • 想白嫖现成的国风/水墨/动漫 LoRA,Wan 2.2 生态最成熟
  • 注意:Wan 2.5 / 2.7 / 3.0 已不开源(只走 API),Wan 2.2 是最后一版免费的万相权重;HappyHorse(欢乐马)1.0 承诺过开源但一直没兑现

相关笔记

相关日记

  • 2026-09-01 - 修仙漫剧选型调研:H3 风格定位 + 免费模型对比