视频生成

了解如何使用视频生成节点,根据文本、图像、画面、音频和视频参考素材创建视频。

更新于 2026年9月10日 · 8 分钟阅读

视频生成 节点可根据文本提示词和媒体参考素材创建新的视频片段。请根据已有的输入选择生成模式,选择兼容的模型,配置输出,然后单击 [Run] 。生成完成的视频会传递到 Video 输出端口,以便连接到工作流中的其他节点。

1. 生成模式

节点面板 顶部的选项卡中选择一种模式。节点的输入端口和快速添加控件会随所选模式发生变化。

1.1 文本生成视频

如果您想仅通过文字描述创建完整场景,而不提供视觉参考,请使用 [Text to Video]

已选择“文本生成视频”的视频生成节点和节点面板。
  • 提示词输入: 将文本节点连接到 Prompt 端口,或直接在提示词框中输入描述。
  • 最适合: 探索新概念、建立镜头、风格化场景,以及构图可完全通过文本描述的视频片段。

1.2 图像生成视频

使用 [Image to Video] 为静态图像添加动画,或通过视觉参考引导生成的视频片段。

已选择“图像生成视频”的视频生成节点和节点面板。
  • 提示词输入: 描述主体运动、镜头运动、场景变化,以及需要保持一致的细节。
  • 图像输入: 通过 Image 端口最多连接九张图像,或使用节点面板中的 [Image] 添加参考图像。
  • 最适合: 为艺术作品或产品图像添加动画、保持主体外观,并为现有构图加入可控运动。

1.3 首尾帧生成视频

当视频片段必须从特定图像开始,并可选择以另一张图像结束时,请使用 [First/Last Frame to Video]

已选择“首尾帧生成视频”的视频生成节点和节点面板。
  • **首帧\*:** 连接必需的起始图像,以定义开场构图。
  • 尾帧: 连接可选的结束图像,引导运动、镜头或转场最终到达的位置。
  • 提示词输入: 描述主体和镜头应如何在所提供的画面之间移动。
  • 最适合: 预先设计的转场、前后对比镜头、可控镜头运动,以及必须到达指定最终构图的序列。

1.4 全能视频生成

使用 [Omni to Video] 在一个多模态请求中组合多种媒体类型。

已选择“全能视频生成”的视频生成节点和节点面板。
  • 提示词输入: 说明已连接的参考素材应如何影响生成结果。
  • 图像输入: 最多连接九张图像,用作主体、角色、风格或构图参考。
  • 视频输入: 最多连接三个视频,用作运动、表演或场景参考。
  • 音频输入: 最多连接三个音频文件,用于引导时间、节奏、语音或声音。
  • 快速添加控件: 使用节点面板中的 [Image][Video][Audio] 直接添加参考素材。
  • 最适合: 需要协调视觉、运动、时间和音频的参考素材丰富的场景。

2. 节点设置

节点面板底部的控件决定视频的生成方式。切换模型或生成模式时,可用值可能会发生变化,因为每个模型支持的输入和输出选项不同。

2.1 选择模型

选择模型菜单以选择生成引擎。可以使用下表作为起点:Fast、Mini、Standard 和 Turbo 版本适合迭代,而完整版和 Pro 版本通常更注重最终质量和控制能力。

模型最适合
Seedance 2.5需要精准多模态参考控制和针对性视频编辑的 30 秒视听叙事。
Seedance 2.0结合强烈运动、参考媒体和同步音频的多模态电影感场景。
Seedance 2.0 Fast希望在不离开 Seedance 工作流的情况下更快测试场景时进行多模态迭代。
Seedance 2.0 Mini在投入最终生成前制作快速草稿和进行低成本提示词测试。
Kling 3.0 Pro高细节电影感片段、更长或更复杂的动作、出色的提示词遵循能力和精致音频。
Kling 3.0 Standard在质量、速度和积分消耗之间取得平衡的通用视频生成。
Kling 3.0 Turbo Pro在加快生成速度的同时,仍注重细节和可用于制作的视觉质量。
Kling 3.0 Turbo Standard用于测试运动、取景和提示词方向的快速经济型草稿。
Veo 3.1电影级真实感、出色的提示词遵循能力和精致的视听场景。
Veo 3.1 Fast当生成速度比最高输出质量更重要时,进行更快的 Veo 迭代。

2.2 模型规格

模型时长宽高比分辨率生成音频提示词长度最大参考输入数量
Seedance 2.54–30 秒Auto、16:9、9:16、1:1、21:9、4:3、3:4480P、720P3–20,000 个字符30 张图像;10 个视频;10 个音频文件
Seedance 2.04–15 秒Auto、16:9、9:16、1:1、21:9、4:3、3:4480P、720P、1080P、4K最多 20,000 个字符9 张图像;3 个视频;3 个音频文件
Seedance 2.0 Fast/Mini4–15 秒Auto、16:9、9:16、1:1、21:9、4:3、3:4480P、720P3–20,000 个字符9 张图像;3 个视频;3 个音频文件
Kling 3.0 Pro/Standard3–15 秒16:9、9:16、1:1不可选择3–2,500 个字符4 张图像;2 个首尾帧
Kling 3.0 Turbo Pro/Standard3–15 秒16:9、9:16、1:1不可选择最多 3,072 个字符1 张图像
Veo 3.1/3.1 Fast4、6 或 8 秒16:9、9:16720P、1080P最多 10,000 个字符1 张图像

2.3 不同生成模式支持的模型

模型文本生成视频图像生成视频首尾帧全能视频生成
Seedance 2.0/2.5
Kling 3.0 Pro/Standard
Kling 3.0 Turbo Pro/Standard
Veo 3.1/3.1 Fast

2.4 输出设置

选择模型后配置输出控件。如果某个值不可用,则说明该模型在当前生成模式下不支持此值。

设置作用使用方法
时长设置生成片段的长度。拖动滑块或输入可用时长。较长的视频通常需要更多生成时间和积分。
比例设置视频画面的形状。在可用时选择 [Auto][16:9][9:16][1:1][21:9][4:3][3:4][Auto] 会让模型沿用参考素材的画面比例或默认取景。
分辨率设置输出尺寸和可见细节程度。在支持时选择 [480P][720P][1080P][4K] 。更高的分辨率可能需要更长时间并消耗更多积分。
生成音频控制模型是否创建配套音轨。切换为 [On] 以生成声音,或切换为 [Off] 以生成静音片段。只有受支持的模型才能生成音频。
高级设置 > 种子设置生成所使用的随机起始值。保持提示词、参考输入、模型、输出设置和种子不变,以获得更相似的变体。输入不同的值或使用刷新控件来探索新结果。
积分预估显示下一次生成预计需要的积分。查看积分图标旁的数字。更改模型或输出设置后,该数字会随之更新。
运行使用当前输入和设置开始生成视频。检查提示词、参考素材和积分预估,然后单击 [Run]

相关文章

常见问题

查找有关视频生成模式、模型和输出设置的解答。

每个模型支持的输入组合不同。请先选择生成模式,再从模型菜单中显示的兼容模型里进行选择。

使用 Fast、Mini、Standard 或 Turbo 选项可以更快地测试提示词和运动效果。构图达到预期后,再切换到更高质量的模型或版本进行最终生成。

可用设置取决于所选模型和生成模式。CawCut 只会显示或启用该模型支持的组合。

种子为模型提供一个可重复使用的随机起点。重复使用相同的提示词、模型、设置和种子,可以生成更相似的结果;更改种子则有助于创建新的变体。