CawCut 提供持续扩展的图像、视频和文本模型库。你可以使用这些模型进行生成、编辑、提示词开发、工作流逻辑处理和其他创作任务。
你可以在一个工作流中组合不同提供商的模型,也可以根据需要替换模型节点。
1. 视频模型
如需在工作流中生成视频片段或连接视频输入和输出,请参阅视频生成。
| AI 模型 | 核心优势与适用场景 |
|---|---|
| Seedance 2.5 | ByteDance 的新一代音视频生成模型,可生成最长 30 秒的连贯叙事,并具备精准的多模态参考控制和高级编辑能力。 适合: 长叙事视频、参考驱动创作和专业视频制作。 |
| Seedance 2.0 | ByteDance 的多模态强大模型,支持 4K 输出 。它提供文本、图像和音频等多模态参考输入,并具备导演级镜头控制,可生成电影感动态。 适合: 电影感场景、广告视频和专业视频制作。 |
| Seedance 2.0 Fast | 速度更快的 Seedance 2.0 选项,在保持出色动态和视觉质量的同时缩短生成时间。 适合: 快速迭代、预览和社交内容。 |
| Seedance 2.0 Mini | 轻量 Seedance 选项,适用于高效视频生成和工作流测试。 适合: 快速草稿、简单动态和早期概念。 |
| Kling 3.0 Turbo | 速度优化的 Kling 3.0 模型,在出色动态、提示词遵循和生成效率之间取得平衡。 适合: 快速迭代、社交视频和概念开发。 |
| Kling 3.0 Turbo Pro | 更高质量的 Turbo 选项,在保持快速生成的同时提供更丰富的细节、更强的一致性和更复杂的动态表现。 适合: 精致广告、电影感镜头和制作级内容。 |
| Kling 3.0 Turbo Standard | 高效的 Turbo 选项,适用于稳定的日常文生视频和图生视频。 适合: 常规内容创作、预览和批量迭代。 |
| Kling 3.0 Pro | 面向电影化叙事的高性能模型,擅长角色动画、精准动作迁移和连贯的多镜头生成。 适合: 广告、短片、音乐视频和品牌内容。 |
| Kling 3.0 Standard | 提供高度稳定的文生视频和图生视频,并具备可靠的音频同步。 适合: 通用创作任务和日常视频内容制作。 |
| Google Veo 3.1 | Google 的旗舰视频模型,以高度真实的物理效果、自然的视觉质感和深厚的电影感著称。 适合: 高端商业视觉和概念叙事。 |
| Google Veo 3.1 Fast | Veo 的加速版本,在保持出色核心视觉质量的同时显著缩短生成时间。 适合: 快速内容迭代、批量处理和社交媒体短片。 |
| Hailuo 2.3 | Hailuo AI 的视频模型,可生成富有表现力的动作和完成度高的短视频视觉。 适合: 角色动作、创意片段和社交视频概念。 |
2. 图像模型
如需在节点之间生成、编辑或传递图像,请参阅图像生成节点。
| AI 模型 | 核心优势与适用场景 |
|---|---|
| GPT Image 2 | OpenAI 的强大模型,具备出色的提示词理解能力和视觉保真度。 适合: 创意视觉、海报设计和概念艺术。 |
| GPT Image 1 | 适用于可靠文生图和精细图像编辑的多功能核心模型。 适合: 日常设计任务、插画和营销素材。 |
| GPT Image 1 mini | OpenAI 的轻量图像模型,可实现更快速、低成本的视觉生成和迭代。 适合: 快速概念、简单素材和工作流测试。 |
| Nano Banana 2 (Gemini 3.1 Flash) | 针对轻量任务和快速生成深度优化的高速模型。 适合: 社交媒体素材和高速视觉构思。 |
| Nano Banana Pro (Gemini 3 Pro) | 旗舰级模型,具备深入的语义理解和精细细节呈现能力。 适合: 复杂场景构建和商业级视觉输出。 |
| Nano Banana | Google 的多功能图像模型,支持基于提示词的生成和图像编辑。 适合: 日常创作、视觉探索和图像变体。 |
| Flux 2 Pro | Black Forest Labs 的专业图像模型,可生成细节丰富、完成度高的视觉内容。 适合: 高质量宣传视觉、概念艺术和商业素材。 |
| Seedream 5.0 Pro | ByteDance 的高级 Seedream 模型,适用于高质量图像生成和要求较高的创作工作。 适合: 精细构图、制作级视觉和商业设计。 |
| Seedream 4.5 | ByteDance 的高端模型,贴合亚洲审美,并能深入理解中文语境。 适合: 电商视觉、人像摄影和海报。 |
| Seedream 5.0 lite | 轻量的新一代模型,在角色一致性和空间布局推理方面有所提升。 适合: 快速迭代、电商图形和版式探索。 |
| Ideogram 4.0 | Ideogram 的图像模型,适用于设计导向的生成和富文本构图。 适合: 海报、品牌图形、字体设计和广告概念。 |
| Reve Image | Reve 的图像生成模型,可根据自然语言提示词创建完成度高的视觉内容。 适合: 创意构思、插画和营销图像。 |
| Z Image Turbo | 通义的高速图像模型,适用于快速视觉生成和实验。 适合: 快速草稿、批量概念和高速迭代。 |
| Recraft V3 | Recraft 的设计型模型,可生成一致且便于后续编辑的视觉素材。 适合: 品牌图形、插画、图标和设计系统。 |
| Wan 2.6 | 通义的视觉引擎,具有强大的艺术风格表现和准确的语言理解能力。 适合: 概念设计和风格化艺术插画。 |
3. 文本模型
文本模型可帮助开发提示词、组织想法、分析输入,并支持工作流中的文本处理步骤。
如需添加和配置基于文本的工作流步骤,请参阅文本生成节点。
| 提供商 | 可用模型 |
|---|---|
| OpenAI | GPT 5.5, GPT 5.4, GPT 5.4 mini, GPT 5.4 nano, GPT 5.2, GPT 5.1, GPT 5 mini, GPT 5 nano |
| Anthropic | Opus 4.8, Opus 4.7, Opus 4.6, Sonnet 4.6, Haiku 4.5 |
| DeepSeek | DeepSeek V4 Pro, DeepSeek V4 Flash |