支援的模型

瞭解 CawCut 支援的影片、影像和文字 AI 模型。

更新於 2026年8月20日 · 6 分鐘閱讀

CawCut 提供持續擴充套件的影象、影片和文字模型庫。你可以使用這些模型進行生成、編輯、提示詞開發、工作流邏輯處理和其他創作任務。

你可以在一個工作流中組合不同提供商的模型,也可以根據需要替換模型節點。

1. 影片模型

如需在工作流中生成影片片段或連線影片輸入和輸出,請參閱影片生成

AI 模型核心優勢與適用場景
Seedance 2.5ByteDance 的新一代音影片生成模型,可生成最長 30 秒的連貫敘事,並具備精準的多模態參考控制和進階編輯能力。
適合: 長敘事影片、參考驅動創作和專業影片製作。
Seedance 2.0ByteDance 的多模態強大模型,支援 4K 輸出 。它提供文字、影象和音訊等多模態參考輸入,並具備導演級鏡頭控制,可生成電影感動態。
適合: 電影感場景、廣告影片和專業影片製作。
Seedance 2.0 Fast速度更快的 Seedance 2.0 選項,在保持出色動態和視覺質量的同時縮短生成時間。
適合: 快速迭代、預覽和社交內容。
Seedance 2.0 Mini輕量 Seedance 選項,適用於高效影片生成和工作流測試。
適合: 快速草稿、簡單動態和早期概念。
Kling 3.0 Turbo速度最佳化的 Kling 3.0 模型,在出色動態、提示詞遵循和生成效率之間取得平衡。
適合: 快速迭代、社交影片和概念開發。
Kling 3.0 Turbo Pro更高品質的 Turbo 選項,在保持快速生成的同時提供更豐富的細節、更強的一致性和更複雜的動態表現。
適合: 精緻廣告、電影感鏡頭和製作級內容。
Kling 3.0 Turbo Standard高效的 Turbo 選項,適用於穩定的日常文生影片和圖生影片。
適合: 常規內容創作、預覽和批次迭代。
Kling 3.0 Pro面向電影化敘事的高效能模型,擅長角色動畫、精準動作遷移和連貫的多鏡頭生成。
適合: 廣告、短片、音樂影片和品牌內容。
Kling 3.0 Standard提供高度穩定的文生影片和圖生影片,並具備可靠的音訊同步。
適合: 通用創作任務和日常影片內容製作。
Google Veo 3.1Google 的旗艦影片模型,以高度真實的物理效果、自然的視覺質感和深厚的電影感著稱。
適合: 高階商業視覺和概念敘事。
Google Veo 3.1 FastVeo 的加速版本,在保持出色核心視覺質量的同時顯著縮短生成時間。
適合: 快速內容迭代、批次處理和社交媒體短片。
Hailuo 2.3Hailuo AI 的影片模型,可生成富有表現力的動作和完成度高的短影片視覺。
適合: 角色動作、創意片段和社交影片概念。

2. 影像模型

如需在節點之間生成、編輯或傳遞影像,請參閱影像生成節點

AI 模型核心優勢與適用場景
GPT Image 2OpenAI 的強大模型,具備出色的提示詞理解能力和視覺保真度。
適合: 創意視覺、海報設計和概念藝術。
GPT Image 1適用於可靠文生圖和精細影象編輯的多功能核心模型。
適合: 日常設計任務、插畫和營銷素材。
GPT Image 1 miniOpenAI 的輕量影象模型,可實現更快速、低成本的視覺生成和迭代。
適合: 快速概念、簡單素材和工作流測試。
Nano Banana 2 (Gemini 3.1 Flash)針對輕量任務和快速生成深度最佳化的高速模型。
適合: 社交媒體素材和高速視覺構思。
Nano Banana Pro (Gemini 3 Pro)旗艦級模型,具備深入的語義理解和精細細節呈現能力。
適合: 複雜場景構建和商業級視覺輸出。
Nano BananaGoogle 的多功能影象模型,支援基於提示詞的生成和影象編輯。
適合: 日常創作、視覺探索和影象變體。
Flux 2 ProBlack Forest Labs 的專業影象模型,可生成細節豐富、完成度高的視覺內容。
適合: 高質量宣傳視覺、概念藝術和商業素材。
Seedream 5.0 ProByteDance 的高階 Seedream 模型,適用於高質量影象生成和要求較高的創作工作。
適合: 精細構圖、製作級視覺和商業設計。
Seedream 4.5ByteDance 的高階模型,貼合亞洲審美,並能深入理解中文語境。
適合: 電商視覺、人像攝影和海報。
Seedream 5.0 lite輕量的新一代模型,在角色一致性和空間佈局推理方面有所提升。
適合: 快速迭代、電商圖形和版式探索。
Ideogram 4.0Ideogram 的影象模型,適用於設計導向的生成和富文字構圖。
適合: 海報、品牌圖形、字型設計和廣告概念。
Reve ImageReve 的影象生成模型,可根據自然語言提示詞建立完成度高的視覺內容。
適合: 創意構思、插畫和營銷影象。
Z Image Turbo通義的高速影象模型,適用於快速視覺生成和實驗。
適合: 快速草稿、批次概念和高速迭代。
Recraft V3Recraft 的設計型模型,可生成一致且便於後續編輯的視覺素材。
適合: 品牌圖形、插畫、圖示和設計系統。
Wan 2.6通義的視覺引擎,具有強大的藝術風格表現和準確的語言理解能力。
適合: 概念設計和風格化藝術插畫。

3. 文字模型

文字模型可幫助開發提示詞、組織想法、分析輸入,並支援工作流中的文字處理步驟。

如需新增和設定文字型工作流步驟,請參閱文字生成節點

提供商可用模型
OpenAIGPT 5.5, GPT 5.4, GPT 5.4 mini, GPT 5.4 nano, GPT 5.2, GPT 5.1, GPT 5 mini, GPT 5 nano
AnthropicOpus 4.8, Opus 4.7, Opus 4.6, Sonnet 4.6, Haiku 4.5
DeepSeekDeepSeek V4 Pro, DeepSeek V4 Flash

相關文章

常見問題

參考以下提示,為工作流選擇合適的模型。

當細節、一致性或複雜指令最重要時,請使用旗艦版或 Pro 模型。製作草稿和快速迭代時,可使用 Fast、Turbo、Mini、lite、nano、Flash 或其他輕量版本;如有需要,再切換到品質更高的模型生成最終結果。

敘事或參考驅動的創作可先嘗試 Seedance;角色動作和精緻創意影片可選擇 Kling;寫實效果和電影感可選擇 Veo;富有表現力的短影片可選擇 Hailuo。如果生成速度比最高品質更重要,可選擇 Fast、Turbo、Standard 或 Mini 版本。

文字豐富的圖形可嘗試 Ideogram;品牌素材和設計系統可選擇 Recraft;快速探索可選擇 Nano Banana 2、Z Image Turbo 或 GPT Image 1 mini。製作細節豐富的商業視覺內容時,可先嘗試 GPT Image 2、Nano Banana Pro、Flux 2 Pro 或 Seedream 5.0 Pro。

複雜規劃、分析和詳細提示詞開發可使用較大的模型或 Pro 模型。簡單轉換、批次步驟和快速迭代可使用 mini、nano、Haiku 或 Flash 模型。重要提示詞建議使用多個模型測試,因為它們的寫作風格和指令遵循能力可能不同。

可以。你可以在一個工作流中連線來自不同提供商的相容影象、影片、文字和處理節點,並隨著專案變化替換或調整單個節點。