CawCut 提供持續擴充套件的影象、影片和文字模型庫。你可以使用這些模型進行生成、編輯、提示詞開發、工作流邏輯處理和其他創作任務。
你可以在一個工作流中組合不同提供商的模型,也可以根據需要替換模型節點。
1. 影片模型
如需在工作流中生成影片片段或連線影片輸入和輸出,請參閱影片生成。
| AI 模型 | 核心優勢與適用場景 |
|---|---|
| Seedance 2.5 | ByteDance 的新一代音影片生成模型,可生成最長 30 秒的連貫敘事,並具備精準的多模態參考控制和進階編輯能力。 適合: 長敘事影片、參考驅動創作和專業影片製作。 |
| Seedance 2.0 | ByteDance 的多模態強大模型,支援 4K 輸出 。它提供文字、影象和音訊等多模態參考輸入,並具備導演級鏡頭控制,可生成電影感動態。 適合: 電影感場景、廣告影片和專業影片製作。 |
| Seedance 2.0 Fast | 速度更快的 Seedance 2.0 選項,在保持出色動態和視覺質量的同時縮短生成時間。 適合: 快速迭代、預覽和社交內容。 |
| Seedance 2.0 Mini | 輕量 Seedance 選項,適用於高效影片生成和工作流測試。 適合: 快速草稿、簡單動態和早期概念。 |
| Kling 3.0 Turbo | 速度最佳化的 Kling 3.0 模型,在出色動態、提示詞遵循和生成效率之間取得平衡。 適合: 快速迭代、社交影片和概念開發。 |
| Kling 3.0 Turbo Pro | 更高品質的 Turbo 選項,在保持快速生成的同時提供更豐富的細節、更強的一致性和更複雜的動態表現。 適合: 精緻廣告、電影感鏡頭和製作級內容。 |
| Kling 3.0 Turbo Standard | 高效的 Turbo 選項,適用於穩定的日常文生影片和圖生影片。 適合: 常規內容創作、預覽和批次迭代。 |
| Kling 3.0 Pro | 面向電影化敘事的高效能模型,擅長角色動畫、精準動作遷移和連貫的多鏡頭生成。 適合: 廣告、短片、音樂影片和品牌內容。 |
| Kling 3.0 Standard | 提供高度穩定的文生影片和圖生影片,並具備可靠的音訊同步。 適合: 通用創作任務和日常影片內容製作。 |
| Google Veo 3.1 | Google 的旗艦影片模型,以高度真實的物理效果、自然的視覺質感和深厚的電影感著稱。 適合: 高階商業視覺和概念敘事。 |
| Google Veo 3.1 Fast | Veo 的加速版本,在保持出色核心視覺質量的同時顯著縮短生成時間。 適合: 快速內容迭代、批次處理和社交媒體短片。 |
| Hailuo 2.3 | Hailuo AI 的影片模型,可生成富有表現力的動作和完成度高的短影片視覺。 適合: 角色動作、創意片段和社交影片概念。 |
2. 影像模型
如需在節點之間生成、編輯或傳遞影像,請參閱影像生成節點。
| AI 模型 | 核心優勢與適用場景 |
|---|---|
| GPT Image 2 | OpenAI 的強大模型,具備出色的提示詞理解能力和視覺保真度。 適合: 創意視覺、海報設計和概念藝術。 |
| GPT Image 1 | 適用於可靠文生圖和精細影象編輯的多功能核心模型。 適合: 日常設計任務、插畫和營銷素材。 |
| GPT Image 1 mini | OpenAI 的輕量影象模型,可實現更快速、低成本的視覺生成和迭代。 適合: 快速概念、簡單素材和工作流測試。 |
| Nano Banana 2 (Gemini 3.1 Flash) | 針對輕量任務和快速生成深度最佳化的高速模型。 適合: 社交媒體素材和高速視覺構思。 |
| Nano Banana Pro (Gemini 3 Pro) | 旗艦級模型,具備深入的語義理解和精細細節呈現能力。 適合: 複雜場景構建和商業級視覺輸出。 |
| Nano Banana | Google 的多功能影象模型,支援基於提示詞的生成和影象編輯。 適合: 日常創作、視覺探索和影象變體。 |
| Flux 2 Pro | Black Forest Labs 的專業影象模型,可生成細節豐富、完成度高的視覺內容。 適合: 高質量宣傳視覺、概念藝術和商業素材。 |
| Seedream 5.0 Pro | ByteDance 的高階 Seedream 模型,適用於高質量影象生成和要求較高的創作工作。 適合: 精細構圖、製作級視覺和商業設計。 |
| Seedream 4.5 | ByteDance 的高階模型,貼合亞洲審美,並能深入理解中文語境。 適合: 電商視覺、人像攝影和海報。 |
| Seedream 5.0 lite | 輕量的新一代模型,在角色一致性和空間佈局推理方面有所提升。 適合: 快速迭代、電商圖形和版式探索。 |
| Ideogram 4.0 | Ideogram 的影象模型,適用於設計導向的生成和富文字構圖。 適合: 海報、品牌圖形、字型設計和廣告概念。 |
| Reve Image | Reve 的影象生成模型,可根據自然語言提示詞建立完成度高的視覺內容。 適合: 創意構思、插畫和營銷影象。 |
| Z Image Turbo | 通義的高速影象模型,適用於快速視覺生成和實驗。 適合: 快速草稿、批次概念和高速迭代。 |
| Recraft V3 | Recraft 的設計型模型,可生成一致且便於後續編輯的視覺素材。 適合: 品牌圖形、插畫、圖示和設計系統。 |
| Wan 2.6 | 通義的視覺引擎,具有強大的藝術風格表現和準確的語言理解能力。 適合: 概念設計和風格化藝術插畫。 |
3. 文字模型
文字模型可幫助開發提示詞、組織想法、分析輸入,並支援工作流中的文字處理步驟。
如需新增和設定文字型工作流步驟,請參閱文字生成節點。
| 提供商 | 可用模型 |
|---|---|
| OpenAI | GPT 5.5, GPT 5.4, GPT 5.4 mini, GPT 5.4 nano, GPT 5.2, GPT 5.1, GPT 5 mini, GPT 5 nano |
| Anthropic | Opus 4.8, Opus 4.7, Opus 4.6, Sonnet 4.6, Haiku 4.5 |
| DeepSeek | DeepSeek V4 Pro, DeepSeek V4 Flash |