如何将 ComfyUI 变身功能完整的 LTX Video 视频编辑器
在 ComfyUI 中通过扩散模型进行视频生成,通常感觉就像在组装一个由数百条连线组成的复杂乐高积木。如果需要拼接多个帧、添加音频、同步角色对话,或者只是剪掉一个糟糕的镜头,图结构就会瞬间膨胀到难以阅读的程度。你最终只能不断在 Premiere Pro 和浏览器之间来回切换,反复导出中间结果。
我最近偶然发现了 WhatDreamsCost-ComfyUI 仓库。作者厌倦了不断在数十个互不关联的节点之间切换,于是在一个用于 LTX Video 生成器的单一节点内构建了一个完整的编辑面板。该项目已获得近 20,000 颗星,其中包含几个真正巧妙的界面解决方案,可以节省大量时间。
为什么要将时间线内置于节点中
该套件的核心是 LTX Director 节点。与其在文本字段中调整时间或在计算器上计算帧数,你获得的是一个带有轨道的大众化时间线。
你可以在这里拖放视频文件、设置关键帧(首帧、中间帧、末帧)、剪切轨道并组合文本提示。它内置了 Prompt Relay 机制,能够随着时间线推进平滑地将控制权从一个文本描述过渡到另一个。
生成 talking head 时另一个常见的痛点是计算场景长度以匹配画外音。作者创建了一个独立的 Speech Length Calculator 节点。它实时分析引用的对话,并根据语速输出推荐的剪辑时长(秒)。这可以避免生成在单词中途被截断或视频在多余的几秒钟内停留在静音中的情况。
节点套件能做什么
除了基本编辑功能外,版本二还为流水线引入了几个实用的新增功能:
- IC-LoRA 支持。你可以将参考视频或图像拖放到单独的轨道上(支持 LTX Ingredients)来传输动作或风格,而无需手动预处理链工作。
- 内置音频处理。你可以导入自己的音频文件,直接在界面中裁剪,并应用音频修复,将原始音轨与生成的声音混合。
- Retake 模式(仍处于测试阶段)。你可以在时间线上选择一个片段,直接在项目内重新生成仅失败的部分。
- 内存优化和缓存。修补后的模型在运行之间被缓存,因此 ComfyUI 不会在每次对提示进行小幅调整时都将权重重新加载到 VRAM 中。此外,作者还添加了正确的 SageAttention 和 Triton 支持。
- 状态持久化。时间线以及所有设置、导入的媒体文件和剪切点都可以导出为标准 JSON 文件。
|
简单控制
|
全新裁剪模式!
|
该包包含改进的视频和音频加载节点(Load Video UI / Load Audio UI)。与标准 ComfyUI 组件不同,它们支持拖放、可以裁剪到不同的宽高比,并且不会在超过 100 MB 的文件上崩溃。
对于批量帧处理,有 Multi Image Loader 节点。它集成了预处理、分辨率调整和内置迷你图库。
安装和注意事项
你可以通过标准 ComfyUI Manager 安装该包(搜索 WhatDreamsCost-ComfyUI),或者通过终端手动安装:
cd ComfyUI/custom_nodes/
git clone https://github.com/WhatDreamsCost/WhatDreamsCost-ComfyUI.git
启动前,请确保将依赖项 ComfyUI-LTXVideo 和 ComfyUI-KJNodes 更新到最新版本,否则时间线节点会在图初始化期间抛出错误。作者直接在仓库内的 example_workflows 文件夹中发布了可直接使用的工作流示例。
不利的一面是:作者在 README 中坦诚警告 Retake 模式仍然粗糙且不稳定。此外,由于 ComfyUI 引擎限制,处理非常长的视频仍然会因系统 RAM 而碰壁,所以你无法在一个节点内组装长达一小时的影片。
适用对象
如果你正在尝试 LTX Video 2.3 模型,并且厌倦了数十个小节点之间混乱的连接,这个项目绝对值得添加到你的工具箱中。它用干净的可视化时间线取代了繁琐的辅助工具链,在生成复杂场景时显著加快迭代速度。
相关项目