AI 模型 — 影片、圖片、音訊與數位人生成
在單一平台上使用 18 款頂尖 AI 模型進行生成——包含 Seedance、Veo 3.1、Kling、Nano Banana、Seedream、ElevenLabs 等。比較各模型功能並免費試用。
免費開始創作影片 9 個模型
Seedance 2.5 單次任務可生成長達 30 秒的影片,支援多達 50 個參考素材、可控影片編輯、高保真時間軸延展、0.4 至 2.5 的任意長寬比,以及 10 種以上語言的原生提示詞。現已於 Popcraft 上線。
使用阿里巴巴影片模型 Wan 3.0 單次生成 2 至 30 秒的 AI 影片:1080p、30 fps,內建對白與音樂,支援多達 4 張圖片、5 段影片及 5 個聲音作為參考素材。Popcraft 每秒 11 點起。
Gemini Omni 1.1 Flash 是 Google 的影片模型,可從任何輸入建立和編輯影片。透過場景延伸最長可達 40 秒,支援 1080p 及 4K 輸出、首尾影格插值、最多 10 張參考圖片,並能隨畫面同步生成語音、音樂和音效。現已在 Popcraft 上線。
MiniMax H3 可生成 24fps 的 2K 影片並同步立體聲配樂,一次搞定特效、氛圍與對白。支援單一提示詞多鏡頭、5 至 15 秒、首末幀控制。現已在 Popcraft 上線。
在 Popcraft 上使用 Seedance 2.0,從文字、圖片或片段生成電影級 4K 影片。原生同步音訊、多鏡頭序列,以及最高 4K (2160p) 的極致清晰細節。

Seedance 2.0 Mini 是字節跳動最輕量的影片方案——比標準版 Seedance 2.0 便宜最多 50%,速度約為 Fast 的 2 倍,支援文字、影像、影片及音訊提示詞。現已在 Popcraft 上線。

在 Popcraft 上使用 Seedance 2.0 將影像與提示詞轉化為電影級影片。支援參考素材轉影片、首末影格控制及多比例輸出,解析度最高可達 4K。

在 Popcraft 上使用 Google Veo 3.1 生成帶內建音訊的電影級 1080p 影片。支援參考圖生成影片、首尾幀控制和單提示詞同步音訊。

在 Popcraft 上使用 Kling 3.0 Omni 生成多鏡頭 AI 影片。可將多達 7 張參考圖融合為連貫場景,並以 1080p 同步原生音訊。
圖片 4 個模型
OpenAI GPT Image 2.5,提供 Fast 與標準版本:草圖轉渲染、參考圖保真度、情境編輯、16 張參考圖、4K 畫質。在 Popcraft 上每張影像最低 10 點數起。

在 Popcraft 上使用 Google Nano Banana 2 生成圖片。角色一致性、14 種寬高比、4K 解析度、網路知識增強 —— 免費試用。

在 Popcraft 上使用字節跳動 Seedream 5 Lite 生成圖片。即時網路搜尋、視覺推理、2K 輸出 —— 免費試用。

在 Popcraft 上使用 Google Nano Banana Pro 生成專業級圖片。複雜多元素構圖、4K 輸出、專業排版和風格轉換 —— 免費試用。
音訊 3 個模型
Popcraft 上的 Eleven v4 與 Eleven v4 Turbo:ElevenLabs 迄今最具情感的文字轉語音。支援內嵌音訊標籤、超過 90 種語言、單次生成可達 10,000 字元,以及專為即時語音代理程式打造的 Turbo 版本。
在 Popcraft 上使用 Music V2.5 秒速為影片配樂。生成 AI 背景音樂、器樂 BGM 和情緒匹配的音軌,時長 3 到 200 秒。
在 Popcraft 上使用 ElevenLabs SFX 從文字生成自訂音效。0.5-22 秒片段、可調節提示詞影響力、48 kHz 錄音室品質音訊。
角色 2 個模型
如何選擇 AI 模型
不同模型各有所長。若要最長的不中斷鏡頭,Seedance 2.5 單次生成可達 30 秒;若要最高解析度,Seedance 2.0 支援原生 4K 渲染;若要內建音訊的對話場景,可選 Veo 3.1 或 MiniMax H3;若要從多個參考素材生成多鏡頭序列,則推薦 Kling 3.0 Omni。影像處理方面,Nano Banana 2 主打速度,Seedream 5 則著重保真度;虛擬人像則由 OmniHuman 1.5 與 Kling Avatar 負責。請使用下方表格,為您的使用情境挑選合適的模型。
模型比較
| 模型 | 類型 | 適用情境 | 最高輸出 | 提供方 |
|---|---|---|---|---|
| Seedance 2.0 4K | 影片 | 電影級高解析度 | 4K | ByteDance |
| Veo 3.1 | 影片 | 對白 + 音訊 | 1080p | |
| Kling 3.0 Omni | 影片 | 多鏡頭 | 1080p | Kuaishou |
| Nano Banana 2 | 圖片 | 快速迭代 | 4K | |
| Seedream 5 Lite | 圖片 | 高保真靜態圖 | — | ByteDance |
| ElevenLabs TTS | 音訊 | 配音 | — | ElevenLabs |
| OmniHuman 1.5 | 數位人 | 會說話的數位人 | — | ByteDance |
常見問題
這取決於工作——解析度優先選 Seedance 2.0 4K,需要同步音訊選 Veo 3.1,多鏡頭選 Kling 3.0 Omni。上方的比較表已為每個模型標註了優勢。
所有模型都可在免費版中使用,並附贈新手點數——無需綁定信用卡。
Seedance 2.0 專注於參考圖驅動的高解析度影片;Veo 3.1 產生 1080p 影片並原生同步音訊。開啟任一模型頁面即可試用。