モデル一覧

作りたい結果から、AI画像・動画生成モデルを選ぶ。

各モデルページでは、ImageStyleで現在使える入力方法、出力設定、実用的な手順を確認できます。必要な結果が分かったら、対応するモデルを開いて生成前に設定を確認しましょう。

AI画像生成モデル

テキストから画像、参照画像を使う生成、画角、出力オプションを比較します。

AI画像モデル

Nano Banana 2

手動で 1K、2K、または 4K を選択し、ブロード フレーミングを使用したリファレンスガイド付き画像。

モデルの詳細を見る
AI画像モデル

Nano Banana 2 Lite

幅広いフレーミングを選べ、出力が自動で決まる参照画像ガイド付きの画像生成。

モデルの詳細を見る
AI画像モデル

Nano Banana Pro

最大 8 つの承認された参照と手動の 1K、2K、または 4K 選択を使用した画像作業。

モデルの詳細を見る
AI画像モデル

Nano Banana

柔軟なフレーミングを選べ、出力が自動で決まるテキストのみの画像生成。

モデルの詳細を見る
Seedream 5 Pro logo
AI画像モデル

Seedream 5 Pro

集中的なテキストまたはリファレンスガイド付き画像は、1K または 2K 出力の選択肢で動作します。

モデルの詳細を見る
AI画像モデル

GPT Image 2

1K、2K、または 4K フレームのトレードオフに関する詳細な概要とリファレンス。

モデルの詳細を見る
Grok logo
AI画像モデル

Grok Imagine

標準または高モードを選択したテキストまたは単一参照画像の方向。

モデルの詳細を見る
Grok logo
AI画像モデル

Grok Imagine Image 2.0

最大5,000文字のプロンプトと、公開されている5種類の画角を使うテキスト画像生成です。

モデルの詳細を見る
Z
AI画像モデル

Z Image

5 つの固定フレームを使い、出力が自動で決まるシンプルなテキストから画像への生成。

モデルの詳細を見る
Qwen logo
AI画像モデル

Wan 2.7 Image

1K または 2K 出力と 8 つの固定フレームを備えたリファレンスガイド付き画像。

モデルの詳細を見る
Qwen logo
AI画像モデル

Wan 2.7 Image Pro

1K、2K、または 4K のテキスト主導の画像出力。 4K はリファレンスでは利用できません。

モデルの詳細を見る
Qwen logo
AI画像モデル

Qwen Image 3.0

1K または 2K 出力と 8 種類の固定フレームで、テキストからの画像生成と参照画像による編集に対応します。

モデルの詳細を見る
Qwen logo
AI画像モデル

Qwen Image 3.0 Pro

1K または 2K 出力で、より高精細なテキストからの画像生成と参照画像による編集に対応します。

モデルの詳細を見る

AI動画生成モデル

テキスト、画像、音声、動きの参照を使う動画生成と、尺、画角、出力設定を比較します。

AI動画モデル

Seedance 2 Mini

テキスト、メディア参照、オーディオ生成、Web 検索を含む短いマルチモーダル クリップ。

モデルの詳細を見る
AI動画モデル

Seedance 2 Fast

15 秒のデフォルト クリップを使用した Fast-labeled マルチモーダル ワークフロー。

モデルの詳細を見る
AI動画モデル

Seedance 2

明示的な 480p ~ 4K 出力の選択肢を備えたマルチモーダル ビデオ作業。

モデルの詳細を見る
AI動画モデル

Seedance 2.5

480pまたは720p、順序付きフレーム、参照素材に対応する長めのマルチモーダル動画。

モデルの詳細を見る
AI動画モデル

HappyHorse 1.1

現在の 9 つのテキストからビデオへのフレームを含むテキストまたは 1 つの開始イメージ クリップ。

モデルの詳細を見る
AI動画モデル

HappyHorse

5 つの標準フレームを使用した簡潔なテキストまたは最初の 1 フレームのワークフロー。

モデルの詳細を見る
AI動画モデル

Kling 2.6

固定 720p とオーディオ生成を備えたプロンプト主導の 5 秒または 10 秒のクリップ。

モデルの詳細を見る
AI動画モデル

Kling V3 Turbo

720p または 1080p、3 ~ 15 秒のプロンプト付きテキストまたはイメージ ビデオ。

モデルの詳細を見る
AI動画モデル

Kling 3.0 Video

1 つの画像、マルチショット、オーディオ、品質レベルを備えたプロンプト主導の短いシーケンス。

モデルの詳細を見る
AI動画モデル

Kling O3

720pから4K出力と任意のネイティブ音声に対応する、テキストまたは順序付きフレームからのシングルショット動画生成です。

モデルの詳細を見る
AI動画モデル

Wan 2.6 Video

5 秒または 10 秒の出力、720p または 1080p、およびマルチショット制御による、提供されたソースビデオのプロンプトガイド付き変換。

モデルの詳細を見る
AI動画モデル

Kling 2.6 Motion Control

720p または 1080p および向きに依存するソース継続時間による参照画像と運転ビデオのモーション コントロール。

モデルの詳細を見る
AI動画モデル

Kling 3.0 Motion Control

720p または 1080p および向きに依存するソース継続時間による参照画像と運転ビデオのモーション コントロール。

モデルの詳細を見る
AI動画モデル

Wan 2.7 Video

フレーム、モーション クリップ、運転音、否定的なプロンプトを使用したプロンプト主導のビデオ ディレクション。

モデルの詳細を見る
AI動画モデル

Grok Imagine Video

6 ~ 30 秒のテキストまたは単一画像ビデオと画像主導のフレーミング。

モデルの詳細を見る
AI動画モデル

Grok Imagine Video 1.5 Preview

1 ~ 15 秒のテキストまたは複数画像のビデオ ワークフローとアダプティブ フレーミングをプレビューします。

モデルの詳細を見る
AI動画モデル

Gemini Omni Video

オプションの画像と 4、6、8、または 10 秒の固定長のプロンプト主導ビデオ ブリーフ。

モデルの詳細を見る
AI動画モデル

MiniMax H3

テキスト、開始・終了フレーム、参照素材から、768Pまたは2K、4〜15秒の動画を生成。

モデルの詳細を見る
AI動画モデル

Veo 3.1 Quality

4、6、または 8 秒間の品質ラベル付きテキストまたは最初と最後のフレームのワークフロー。

モデルの詳細を見る
AI動画モデル

Veo 3.1 Fast

4、6、または 8 秒間の高速ラベル付きテキストまたは最初と最後のフレームのワークフロー。

モデルの詳細を見る
AI動画モデル

Veo 3.1 Lite

4、6、または 8 秒間の Lite ラベル付きテキストまたは最初と最後のフレームのワークフロー。

モデルの詳細を見る
AI動画モデル

OmniHuman 1.5

提供された画像と提供された音声を組み合わせたポートレート主導ビデオ。

モデルの詳細を見る

モデルの提供状況と設定は変わることがあります。生成前にワークスペースに表示される現在の設定を確認してください。

機能情報: 現在のImageStyleモデル設定。