☰
如何用ComfyUI_MiniMaxH3_Director编辑已有视频:v2v / rv2v源视频时间轴实战
2026/10/7 16:59:50 网站建设 项目流程

如何用ComfyUI_MiniMaxH3_Director编辑已有视频:v2v / rv2v源视频时间轴实战

【免费下载链接】ComfyUI_MiniMaxH3_DirectorMulti-segment MiniMax H3 Director for official ComfyUI MiniMax-H3项目地址: https://gitcode.com/gh_mirrors/com/ComfyUI_MiniMaxH3_Director

ComfyUI_MiniMaxH3_Director是基于 ComfyUI 官方 MiniMax-H3 的多段音视频导演台插件。它的v2v(视频转视频)和rv2v(参考素材改视频)模式专为「编辑已有视频」而生:把源视频拖进导演台时间轴,分段、写提示词,AI 逐段重绘,还能保留原声或让模型生成新声音。本文带你走完 v2v / rv2v 源视频时间轴的完整实战流程。

一、v2v 与 rv2v:两个「改视频」模式怎么选?

导演台支持 6 种任务,其中与「编辑已有视频」直接相关的是这两个:

模式一句话说明需要素材适用场景
v2v源视频时间轴剪辑,每段源画面自动绑定为<Video 1>只需源视频重绘/风格迁移/局部改写已有片段
rv2v在 v2v 基础上额外挂载参考图(图片1–9)与参考音频(音频1–3)源视频 + 参考图/音频换人、换角色、注入参考主体的视频编辑

💡 模式定义可见 lib/task_modes.py:v2v 即 "source timeline clip as<Video 1>reference",rv2v 即 "source<Video 1>+<Picture N>"。

两者都使用ref2vaUNET(与 t2v/i2v/fl2v 用的fl2va不同),且都需要audio_vae。

二、准备工作:模型与安装清单

1. 安装插件

cd ComfyUI/custom_nodes git clone https://gitcode.com/gh_mirrors/com/ComfyUI_MiniMaxH3_Director pip install -r ComfyUI_MiniMaxH3_Director/requirements.txt

重启 ComfyUI 即可。智能分镜分割(PySceneDetect)、源视频解码等依赖也写在 requirements.txt 中。

2. 模型文件清单

用途文件名放置目录
UNET(v2v / rv2v 专用)minimax_h3_ref2va_pruned_int8_convrot.safetensorsmodels/diffusion_models/
CLIP(type 选minimax)qwen3vl_32b_minimax_h3_nvfp4_awq.safetensorsmodels/text_encoders/
视频 VAEminimax_h3_video_vae_fp16.safetensorsmodels/vae/
音频 VAEminimax_h3_audio_vae_fp32.safetensorsmodels/vae/

⚠️ 常见坑:CLIP Loader 的type 必须选minimax,否则无法正确编码提示词。

3. 加载示例工作流

仓库自带两份可直接拖入画布的示例:

  • minimax_h3_director_v2v.json — 源视频时间轴编辑
  • minimax_h3_director_rv2v.json — 源视频 + 参考图/音频

工作流说明详见 example_workflows/README.md。

三、v2v 快速上手:三步编辑源视频

第 1 步:上传源视频并分段

在导演台节点内选择任务类型v2v,上传你的源视频。分段有三种方式:

分段方式说明适合场景
切分手动指定分割点,选中后可删除精确控制每个镜头
均分按段数平均切分素材均匀、无明确镜头
智能分割基于 PySceneDetect 自动识别镜头切换已剪好的多镜头视频

时间轴会实时预览每段范围与缩略图,方便确认切分位置。

第 2 步:每段写提示词

每一段独立写提示词,描述你希望这段画面变成什么样。系统会自动把该段源画面绑定为<Video 1>,你无需手动引用——提示词中直接描述运动、镜头、风格变化即可。

导演台还提供一个global_prompt全局提示词输入口,用于补充整体氛围描述。

第 3 步:Queue 生成

默认采样参数(与官方 MiniMax H3 模板一致):

  • 画布864×480(0.4MP 16:9),124 帧 @ 24fps ≈ 5 秒
  • 25steps,res_multistep+simple,CFG1.0
  • Sigma shift:video12/ audio3

多段时可用「选择运行」只跑勾选的片段,未勾选段用缓存或源画面填充——改一段、重跑一段,不用整片重来。

四、rv2v 进阶:给源视频注入参考主体

rv2v 在 v2v 的源时间轴之上,额外支持两类参考素材:

素材数量上限提示词引用
参考图(人物/角色/物体)图片 1–9<Picture N>
参考音频(声音/配音)音频 1–3<Audio J>

典型用法:视频换人。上传原视频并分段 → 在参考图槽位上传目标人物的照片 → 某段提示词写「<Picture 1>中的人物在源画面中做同样的动作」。参考图只在需要它的组生效,不挂参考素材的组等同纯 v2v。

提示词中也支持输入@快速引用素材,写作更顺手。

五、声音三模式:生成 / 原声 / 静音

v2v / rv2v 的输出音频有三种模式(逻辑见 director/audio_export.py):

模式行为适合场景
生成声音模型与画面同次采样生成新音频风格迁移、需要新氛围音
使用原声从源视频提取音轨直接拼接保留原片台词/音效
静音不输出音频后期自己配乐

细节注意:选「使用原声」时,如果某段源画面没有音轨,该段会自动回退为静音,且运行报告中会明确说明,不会出错崩溃。

六、参数与文件速查

项目值 / 路径
主节点MiniMax H3 Director,定义见 nodes/director.py
输入model→video_vae→audio_vae→clip
输出images/audio/fps/frame_count/source_images/report
v2v 示例minimax_h3_director_v2v.json
rv2v 示例minimax_h3_director_rv2v.json
任务模式定义lib/task_modes.py
任务提示词模板lib/task_prompts.py
完整文档README.md(中文)/ README_EN.md

report输出口会给出分段计划和每段任务摘要,排查"这一段为什么没按提示词走"时先看它。

七、常见问题 FAQ

Q:v2v 和 r2v 有什么区别?r2v 是「纯参考素材生成」,没有源视频;v2v / rv2v 才有源视频时间轴。要做「改已有视频」就选 v2v / rv2v。

Q:为什么选了 rv2v 却报缺 audio_vae?v2v / rv2v / r2v 都需要音频 VAE 参与 AV 分离链路,请务必把minimax_h3_audio_vae接到导演台的audio_vae口。

Q:只改其中一段,其余段会不会重新生成?不会。开启「选择运行」并只勾选目标段,其余段用缓存或源画面填充,仅勾选段参与采样。

Q:想要更高清的成片怎么办?导演台另支持外接Refine 二采/放大(refine口)与SelfLift 渐进一采(selflift口),在低分辨率验证时间轴后再接上提画质,示例见 minimax_h3_director_二采_加速.json。

写在最后

v2v / rv2v 把「编辑已有视频」变成了一条可复用的时间轴流水线:上传 → 分段 → 提示词 → 选择运行。配合智能分镜与段级缓存,长片编辑也能逐段迭代。先从 v2v 示例工作流 跑通一段 5 秒的片段,再逐步叠加参考素材与二采,是最稳的上手路径。

【免费下载链接】ComfyUI_MiniMaxH3_DirectorMulti-segment MiniMax H3 Director for official ComfyUI MiniMax-H3项目地址: https://gitcode.com/gh_mirrors/com/ComfyUI_MiniMaxH3_Director

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询