モデル一覧
作りたい結果から、AI画像・動画生成モデルを選ぶ。
各モデルページでは、ImageStyleで現在使える入力方法、出力設定、実用的な手順を確認できます。必要な結果が分かったら、対応するモデルを開いて生成前に設定を確認しましょう。
AI画像生成モデル
テキストから画像、参照画像を使う生成、画角、出力オプションを比較します。
Nano Banana 2
手動で 1K、2K、または 4K を選択し、ブロード フレーミングを使用したリファレンスガイド付き画像。
モデルの詳細を見るNano Banana 2 Lite
幅広いフレーミングを選べ、出力が自動で決まる参照画像ガイド付きの画像生成。
モデルの詳細を見るNano Banana Pro
最大 8 つの承認された参照と手動の 1K、2K、または 4K 選択を使用した画像作業。
モデルの詳細を見るNano Banana
柔軟なフレーミングを選べ、出力が自動で決まるテキストのみの画像生成。
モデルの詳細を見るSeedream 5 Pro
集中的なテキストまたはリファレンスガイド付き画像は、1K または 2K 出力の選択肢で動作します。
モデルの詳細を見るGPT Image 2
1K、2K、または 4K フレームのトレードオフに関する詳細な概要とリファレンス。
モデルの詳細を見るGrok Imagine
標準または高モードを選択したテキストまたは単一参照画像の方向。
モデルの詳細を見るGrok Imagine Image 2.0
最大5,000文字のプロンプトと、公開されている5種類の画角を使うテキスト画像生成です。
モデルの詳細を見るZ Image
5 つの固定フレームを使い、出力が自動で決まるシンプルなテキストから画像への生成。
モデルの詳細を見るWan 2.7 Image
1K または 2K 出力と 8 つの固定フレームを備えたリファレンスガイド付き画像。
モデルの詳細を見るWan 2.7 Image Pro
1K、2K、または 4K のテキスト主導の画像出力。 4K はリファレンスでは利用できません。
モデルの詳細を見るQwen Image 3.0
1K または 2K 出力と 8 種類の固定フレームで、テキストからの画像生成と参照画像による編集に対応します。
モデルの詳細を見るQwen Image 3.0 Pro
1K または 2K 出力で、より高精細なテキストからの画像生成と参照画像による編集に対応します。
モデルの詳細を見るAI動画生成モデル
テキスト、画像、音声、動きの参照を使う動画生成と、尺、画角、出力設定を比較します。
Seedance 2 Mini
テキスト、メディア参照、オーディオ生成、Web 検索を含む短いマルチモーダル クリップ。
モデルの詳細を見るSeedance 2 Fast
15 秒のデフォルト クリップを使用した Fast-labeled マルチモーダル ワークフロー。
モデルの詳細を見るSeedance 2
明示的な 480p ~ 4K 出力の選択肢を備えたマルチモーダル ビデオ作業。
モデルの詳細を見るSeedance 2.5
480pまたは720p、順序付きフレーム、参照素材に対応する長めのマルチモーダル動画。
モデルの詳細を見るHappyHorse 1.1
現在の 9 つのテキストからビデオへのフレームを含むテキストまたは 1 つの開始イメージ クリップ。
モデルの詳細を見るHappyHorse
5 つの標準フレームを使用した簡潔なテキストまたは最初の 1 フレームのワークフロー。
モデルの詳細を見るKling 2.6
固定 720p とオーディオ生成を備えたプロンプト主導の 5 秒または 10 秒のクリップ。
モデルの詳細を見るKling V3 Turbo
720p または 1080p、3 ~ 15 秒のプロンプト付きテキストまたはイメージ ビデオ。
モデルの詳細を見るKling 3.0 Video
1 つの画像、マルチショット、オーディオ、品質レベルを備えたプロンプト主導の短いシーケンス。
モデルの詳細を見るKling O3
720pから4K出力と任意のネイティブ音声に対応する、テキストまたは順序付きフレームからのシングルショット動画生成です。
モデルの詳細を見るWan 2.6 Video
5 秒または 10 秒の出力、720p または 1080p、およびマルチショット制御による、提供されたソースビデオのプロンプトガイド付き変換。
モデルの詳細を見るKling 2.6 Motion Control
720p または 1080p および向きに依存するソース継続時間による参照画像と運転ビデオのモーション コントロール。
モデルの詳細を見るKling 3.0 Motion Control
720p または 1080p および向きに依存するソース継続時間による参照画像と運転ビデオのモーション コントロール。
モデルの詳細を見るWan 2.7 Video
フレーム、モーション クリップ、運転音、否定的なプロンプトを使用したプロンプト主導のビデオ ディレクション。
モデルの詳細を見るGrok Imagine Video
6 ~ 30 秒のテキストまたは単一画像ビデオと画像主導のフレーミング。
モデルの詳細を見るGrok Imagine Video 1.5 Preview
1 ~ 15 秒のテキストまたは複数画像のビデオ ワークフローとアダプティブ フレーミングをプレビューします。
モデルの詳細を見るGemini Omni Video
オプションの画像と 4、6、8、または 10 秒の固定長のプロンプト主導ビデオ ブリーフ。
モデルの詳細を見るMiniMax H3
テキスト、開始・終了フレーム、参照素材から、768Pまたは2K、4〜15秒の動画を生成。
モデルの詳細を見るVeo 3.1 Quality
4、6、または 8 秒間の品質ラベル付きテキストまたは最初と最後のフレームのワークフロー。
モデルの詳細を見るVeo 3.1 Fast
4、6、または 8 秒間の高速ラベル付きテキストまたは最初と最後のフレームのワークフロー。
モデルの詳細を見るVeo 3.1 Lite
4、6、または 8 秒間の Lite ラベル付きテキストまたは最初と最後のフレームのワークフロー。
モデルの詳細を見るOmniHuman 1.5
提供された画像と提供された音声を組み合わせたポートレート主導ビデオ。
モデルの詳細を見るモデルの提供状況と設定は変わることがあります。生成前にワークスペースに表示される現在の設定を確認してください。
機能情報: 現在のImageStyleモデル設定。