直接回答:本地短剧工作流最适合采用“资产层—镜头层—声音层—后期层”四层结构,而不是把所有节点塞进一个超级ComfyUI工作流。ComfyUI官方将workflow定义为节点组成的图,并支持本地运行、模板、Custom Nodes和Local API,因此很适合把不同生成任务模块化。[1][2][3]

第一层:先锁人物和场景资产
角色母图、三视图、服装阶段、场景参考图、道具图先独立生成并版本化。资产文件名必须稳定,例如 character_lujingzhe_v03_front.png,不要只靠提示词记忆。
第二层:镜头工作流只做一件事
镜头工作流输入角色参考、场景参考、起止帧或姿态条件,输出一个短镜头。每条工作流都保留随机种子、模型、LoRA、分辨率和节点版本,失败才能复现。
| 模块 | 建议 |
|---|---|
| 图像资产 | 角色/场景固定后再进入视频 |
| 视频生成 | 一镜一工作流或一类镜头一模板 |
| 放大修复 | 放在生成后独立处理 |
| 批处理 | 通过队列或Local API调度 |
第三层:配音不要绑死在视频节点里
对白先按角色分轨,配音生成后再进入口型、字幕和混音。这样更换声线、修一句台词时,不必重新生成整段视频。
第四层:用后期解决“生成模型不该解决的问题”
- 镜头衔接、节奏、转场放到剪辑软件。
- 对白、BGM、环境声分轨处理。
- 字幕统一在后期生成,避免视频模型直接画字。
- 最后统一做清晰度、色彩和响度。
显存不够时怎么拆
优先缩短单镜头长度、降低并发、把放大和插帧拆成后处理;不同模型不要常驻显存。对于批量镜头,可通过ComfyUI本地API提交workflow JSON并监控队列。
注意:Custom Nodes来自第三方生态,更新后可能出现依赖冲突。正式生产前固定版本,并保存可回滚的环境清单。
资料核验日期:2026-08-09。产品功能、套餐、API、平台规则与地区可用性会变化,正式使用前请再次查看官方页面。
参考来源
- ComfyUI Official Documentation(official,核验于 2026-08-09)
- ComfyUI:Workflow(official,核验于 2026-08-09)
- ComfyUI:Developer Overview(official,核验于 2026-08-09)
更新记录
- 2026-08-09:完成官方/一手来源核验、结构化撰写与发布边界检查。
如果你想系统比较AI配音、声音克隆、实时语音和多语言配音工具,可以继续查看:AI语音与配音专题 →
© 版权声明
文章版权归作者所有,未经允许请勿转载。