AIモデル — 動画・画像・オーディオ・アバター生成
業界最高峰の18種類のAIモデルを1つのプラットフォームで生成。Seedance、Veo 3.1、Kling、Nano Banana、Seedream、ElevenLabsなど。各モデルの機能を比較して無料でお試しください。
無料で始める動画 9個のモデル
Seedance 2.5は、1回のジョブで最大30秒の動画を生成できます。最大50個のアセットを参照でき、動画編集の制御、高忠実度の時間軸拡張、0.4から2.5までの任意のアスペクト比、10以上の言語でのネイティブプロンプトに対応しています。Popcraftで公開中。
Alibabaの動画モデル「Wan 3.0」で、2〜30秒のAI動画を一度の生成で作成。1080p/30fps、セリフや音楽も同時出力。最大4枚の画像、5つのクリップ、5つの音声をリファレンスとして使用可能。Popcraftで1秒11クレジットから。
Gemini Omni 1.1 Flashは、あらゆる入力から動画を作成・編集するGoogleの動画モデルです。シーン拡張で最大40秒、1080pおよび4K出力、最初と最後のフレームの補間、最大10枚の参照画像、そして映像に合わせて音声、音楽、効果音を生成します。Popcraftで利用可能です。
MiniMax H3は、24fpsの2K動画と同期したステレオ音源(効果音、環境音、台詞)を一度に生成。1つのプロンプトからマルチショット生成、5〜15秒、最初と最後のフレーム制御に対応。Popcraftで公開中。
Popcraft で Seedance 2.0 を使い、テキスト・画像・クリップから映画品質の 4K 動画を生成。ネイティブ同期音声、マルチショットシーケンス、最大 4K (2160p) の極めて精細なディテール。

Seedance 2.0 MiniはByteDanceの最も軽量な動画生成ティアです。標準のSeedance 2.0より最大50%安く、Fastより約2倍高速で、テキスト、画像、動画、音声のプロンプトに対応。Popcraftで公開中。

PopcraftのSeedance 2.0で、画像とプロンプトからシネマティック動画を生成。参照から動画生成、最初/最後のフレーム指定、最大4Kのマルチアスペクト出力に対応。

PopcraftでGoogle Veo 3.1を使って、ビルトインオーディオ付きのシネマティック1080p動画を生成。リファレンスから動画、最初/最後のフレーム、単一プロンプトからの同期サウンドに対応。

PopcraftでKling 3.0 Omniを使ってマルチショットAI動画を生成。最大7枚のリファレンス画像を、1080pの同期ネイティブオーディオ付き連続シーンに融合。
画像 4個のモデル
OpenAI GPT Image 2.5、Fastおよび標準ビルド:スケッチからレンダリング、参照への忠実性、コンテキスト内編集、16枚の参照、4K対応。Popcraftなら1画像10クレジットから。

PopcraftでGoogle Nano Banana 2を使って画像を生成。キャラクター一貫性、14種のアスペクト比、4K解像度、ウェブ基盤の知識 — 無料でお試しいただけます。

PopcraftでByteDance Seedream 5 Liteを使って画像を生成。ライブウェブ検索、ビジュアル推論、数秒で2K出力 — 無料でお試しいただけます。

PopcraftでGoogle Nano Banana Proを使ってプレミアム画像を生成。複雑なマルチエレメント構図、4K出力、プロ品質のタイポグラフィとスタイル転送 — 無料でお試しいただけます。
オーディオ 3個のモデル
PopcraftのEleven v4およびEleven v4 Turbo:ElevenLabs史上最も感情豊かなテキスト読み上げ。インラインオーディオタグ、90以上の言語、最大10,000文字のテイク、そしてリアルタイム音声エージェント向けに構築されたTurboカットを搭載。
PopcraftのMusic V2.5で数秒で動画にスコアを付けましょう。3秒から200秒までのAI BGM、インストゥルメンタルBGM、ムードマッチングトラックを生成。
PopcraftでElevenLabs SFXを使ってテキストからカスタムサウンドエフェクトを生成。0.5~22秒のクリップ、調整可能なプロンプト影響度、48kHzスタジオ対応オーディオ。
キャラクター 2個のモデル
AI モデルの選び方
モデルごとに得意分野は異なります。最長の連続ショットならSeedance 2.5が1回の生成で30秒に対応。最高解像度ならSeedance 2.0がネイティブ4Kをレンダリング。音声内蔵のセリフ中心シーンならVeo 3.1またはMiniMax H3。複数の参照からのマルチショットシーケンスならKling 3.0 Omni。画像生成はNano Banana 2の速度とSeedream 5の忠実度に二分され、アバターはOmniHuman 1.5とKling Avatarが担当します。以下の表で用途に合ったモデルをお選びください。
モデル比較
| モデル | 種類 | おすすめ用途 | 最大出力 | 提供元 |
|---|---|---|---|---|
| Seedance 2.0 4K | 動画 | 映画的・高解像度 | 4K | ByteDance |
| Veo 3.1 | 動画 | 対話 + 音声 | 1080p | |
| Kling 3.0 Omni | 動画 | マルチショット | 1080p | Kuaishou |
| Nano Banana 2 | 画像 | 高速イテレーション | 4K | |
| Seedream 5 Lite | 画像 | 高精細な静止画 | — | ByteDance |
| ElevenLabs TTS | オーディオ | ナレーション | — | ElevenLabs |
| OmniHuman 1.5 | アバター | 話すアバター | — | ByteDance |
よくある質問
用途によります——解像度なら Seedance 2.0 4K、同期音声なら Veo 3.1、マルチショットなら Kling 3.0 Omni です。上の比較表で各モデルの強みを確認できます。
すべてのモデルが無料プランで利用でき、スタータークレジットも付きます——カード登録は不要です。
Seedance 2.0 は参照画像ベースの高解像度動画に特化し、Veo 3.1 は同期音声付きの 1080p 動画を生成します。どちらのモデルページからでも試せます。