支持的模型

了解 CawCut 支持的视频、图像和文本 AI 模型。

更新于 2026年8月20日 · 6 分钟阅读

CawCut 提供持续扩展的图像、视频和文本模型库。你可以使用这些模型进行生成、编辑、提示词开发、工作流逻辑处理和其他创作任务。

你可以在一个工作流中组合不同提供商的模型,也可以根据需要替换模型节点。

1. 视频模型

如需在工作流中生成视频片段或连接视频输入和输出,请参阅视频生成

AI 模型核心优势与适用场景
Seedance 2.5ByteDance 的新一代音视频生成模型,可生成最长 30 秒的连贯叙事,并具备精准的多模态参考控制和高级编辑能力。
适合: 长叙事视频、参考驱动创作和专业视频制作。
Seedance 2.0ByteDance 的多模态强大模型,支持 4K 输出 。它提供文本、图像和音频等多模态参考输入,并具备导演级镜头控制,可生成电影感动态。
适合: 电影感场景、广告视频和专业视频制作。
Seedance 2.0 Fast速度更快的 Seedance 2.0 选项,在保持出色动态和视觉质量的同时缩短生成时间。
适合: 快速迭代、预览和社交内容。
Seedance 2.0 Mini轻量 Seedance 选项,适用于高效视频生成和工作流测试。
适合: 快速草稿、简单动态和早期概念。
Kling 3.0 Turbo速度优化的 Kling 3.0 模型,在出色动态、提示词遵循和生成效率之间取得平衡。
适合: 快速迭代、社交视频和概念开发。
Kling 3.0 Turbo Pro更高质量的 Turbo 选项,在保持快速生成的同时提供更丰富的细节、更强的一致性和更复杂的动态表现。
适合: 精致广告、电影感镜头和制作级内容。
Kling 3.0 Turbo Standard高效的 Turbo 选项,适用于稳定的日常文生视频和图生视频。
适合: 常规内容创作、预览和批量迭代。
Kling 3.0 Pro面向电影化叙事的高性能模型,擅长角色动画、精准动作迁移和连贯的多镜头生成。
适合: 广告、短片、音乐视频和品牌内容。
Kling 3.0 Standard提供高度稳定的文生视频和图生视频,并具备可靠的音频同步。
适合: 通用创作任务和日常视频内容制作。
Google Veo 3.1Google 的旗舰视频模型,以高度真实的物理效果、自然的视觉质感和深厚的电影感著称。
适合: 高端商业视觉和概念叙事。
Google Veo 3.1 FastVeo 的加速版本,在保持出色核心视觉质量的同时显著缩短生成时间。
适合: 快速内容迭代、批量处理和社交媒体短片。
Hailuo 2.3Hailuo AI 的视频模型,可生成富有表现力的动作和完成度高的短视频视觉。
适合: 角色动作、创意片段和社交视频概念。

2. 图像模型

如需在节点之间生成、编辑或传递图像,请参阅图像生成节点

AI 模型核心优势与适用场景
GPT Image 2OpenAI 的强大模型,具备出色的提示词理解能力和视觉保真度。
适合: 创意视觉、海报设计和概念艺术。
GPT Image 1适用于可靠文生图和精细图像编辑的多功能核心模型。
适合: 日常设计任务、插画和营销素材。
GPT Image 1 miniOpenAI 的轻量图像模型,可实现更快速、低成本的视觉生成和迭代。
适合: 快速概念、简单素材和工作流测试。
Nano Banana 2 (Gemini 3.1 Flash)针对轻量任务和快速生成深度优化的高速模型。
适合: 社交媒体素材和高速视觉构思。
Nano Banana Pro (Gemini 3 Pro)旗舰级模型,具备深入的语义理解和精细细节呈现能力。
适合: 复杂场景构建和商业级视觉输出。
Nano BananaGoogle 的多功能图像模型,支持基于提示词的生成和图像编辑。
适合: 日常创作、视觉探索和图像变体。
Flux 2 ProBlack Forest Labs 的专业图像模型,可生成细节丰富、完成度高的视觉内容。
适合: 高质量宣传视觉、概念艺术和商业素材。
Seedream 5.0 ProByteDance 的高级 Seedream 模型,适用于高质量图像生成和要求较高的创作工作。
适合: 精细构图、制作级视觉和商业设计。
Seedream 4.5ByteDance 的高端模型,贴合亚洲审美,并能深入理解中文语境。
适合: 电商视觉、人像摄影和海报。
Seedream 5.0 lite轻量的新一代模型,在角色一致性和空间布局推理方面有所提升。
适合: 快速迭代、电商图形和版式探索。
Ideogram 4.0Ideogram 的图像模型,适用于设计导向的生成和富文本构图。
适合: 海报、品牌图形、字体设计和广告概念。
Reve ImageReve 的图像生成模型,可根据自然语言提示词创建完成度高的视觉内容。
适合: 创意构思、插画和营销图像。
Z Image Turbo通义的高速图像模型,适用于快速视觉生成和实验。
适合: 快速草稿、批量概念和高速迭代。
Recraft V3Recraft 的设计型模型,可生成一致且便于后续编辑的视觉素材。
适合: 品牌图形、插画、图标和设计系统。
Wan 2.6通义的视觉引擎,具有强大的艺术风格表现和准确的语言理解能力。
适合: 概念设计和风格化艺术插画。

3. 文本模型

文本模型可帮助开发提示词、组织想法、分析输入,并支持工作流中的文本处理步骤。

如需添加和配置基于文本的工作流步骤,请参阅文本生成节点

提供商可用模型
OpenAIGPT 5.5, GPT 5.4, GPT 5.4 mini, GPT 5.4 nano, GPT 5.2, GPT 5.1, GPT 5 mini, GPT 5 nano
AnthropicOpus 4.8, Opus 4.7, Opus 4.6, Sonnet 4.6, Haiku 4.5
DeepSeekDeepSeek V4 Pro, DeepSeek V4 Flash

相关文章

常见问题

参考以下提示,为工作流选择合适的模型。

当细节、一致性或复杂指令最重要时,请使用旗舰版或 Pro 模型。制作草稿和快速迭代时,可使用 Fast、Turbo、Mini、lite、nano、Flash 或其他轻量版本;如有需要,再切换到质量更高的模型生成最终结果。

叙事或参考驱动的创作可先尝试 Seedance;角色动作和精致创意视频可选择 Kling;写实效果和电影感可选择 Veo;富有表现力的短视频可选择 Hailuo。如果生成速度比最高质量更重要,可选择 Fast、Turbo、Standard 或 Mini 版本。

文字丰富的图形可尝试 Ideogram;品牌素材和设计系统可选择 Recraft;快速探索可选择 Nano Banana 2、Z Image Turbo 或 GPT Image 1 mini。制作细节丰富的商业视觉内容时,可先尝试 GPT Image 2、Nano Banana Pro、Flux 2 Pro 或 Seedream 5.0 Pro。

复杂规划、分析和详细提示词开发可使用较大的模型或 Pro 模型。简单转换、批量步骤和快速迭代可使用 mini、nano、Haiku 或 Flash 模型。重要提示词建议使用多个模型测试,因为它们的写作风格和指令遵循能力可能不同。

可以。你可以在一个工作流中连接来自不同提供商的兼容图像、视频、文本和处理节点,并随着项目变化替换或调整单个节点。