AI動画モデル
OmniHuman 1.5 AI動画生成
プロジェクトが 1 つの使用可能なポートレート画像と 1 つの駆動音声ファイルから始まり、クリップがテキストからビデオへのワークフローではなく、これらの提供されたメディアに従う必要がある場合は、OmniHuman 1.5 を選択してください。
OmniHuman 1.5 のタスク例
これらのローカル参照は、現在の OmniHuman 1.5 の入力・設定条件を具体的なタスクの方向性に置き換えるためのものです。このモデルが生成した出力としては表示していません。
各カードには、検証済みのモデルファミリー例か視覚的な参照かを表示します。参照カードはモデル比較や生成前後の主張ではありません。
- 入力条件
- 画像 1 枚と音声ファイル 1 件が必要です
- 現在の設定
- プロンプトの長さ: 最大 1,000 文字 · 動画の長さ: アップロードした音声に従います(時間セレクターなし) · 出力解像度: 720P / 1080P · フレーミング: フレーミングはアップロードしたメディアに従います
- 選定の境界
- 音声のないテキストまたは画像のみがある場合は、このワークフローを使用しないでください。リップシンク、アイデンティティの保持、またはパフォーマンスについて約束するものではありません。必要なソース ファイルが使用できない場合は、テキスト主導モデルまたはイメージ主導モデルを比較します。
動きの要点
1 つの主題のアクションとクリップが開始される瞬間を述べます。
- タスクの方向性
- 1 つの主題のアクションとクリップが開始される瞬間を述べます。
視覚的な参照であり、このモデルの出力ではありません
ImageStyle内のローカル視覚リファレンスです。特定モデルの生成結果としては表示していません。
カメラの方向性
カメラの動作と、時間の経過とともに明らかになる視覚的な変化に名前を付けます。
- タスクの方向性
- カメラの動作と、時間の経過とともに明らかになる視覚的な変化に名前を付けます。
視覚的な参照であり、このモデルの出力ではありません
ImageStyle内のローカル視覚リファレンスです。特定モデルの生成結果としては表示していません。
終了時の状態
この参照を現在のモデルの結果として扱わずに、最終的な視覚的状態を定義します。
- タスクの方向性
- この参照を現在のモデルの結果として扱わずに、最終的な視覚的状態を定義します。
視覚的な参照であり、このモデルの出力ではありません
ImageStyle内のローカル視覚リファレンスです。特定モデルの生成結果としては表示していません。
- 作成
- AI動画
- 入力
- 画像 1 枚と音声ファイル 1 件が必要です
- 動画の長さ
- アップロードした音声に従います(時間セレクターなし)
関連モデルと現在利用できる設定を比較
ワークスペースを開く前に、入力・出力・フレーミングの操作がタスクに合うか確認します。この表では、例のメディアをモデル間の性能比較として扱いません。
OmniHuman 1.5
現在のページ
提供された画像と提供された音声を組み合わせたポートレート主導ビデオ。
- 入力
- 画像 1 枚と音声ファイル 1 件が必要です
- プロンプトの長さ
- 最大 1,000 文字
- 動画の長さ
- アップロードした音声に従います(時間セレクターなし)
Seedance 2 Mini
テキスト、メディア参照、オーディオ生成、Web 検索を含む短いマルチモーダル クリップ。
- 入力
- テキストプロンプトまたは互換性のある参照メディア(最大 3 件の画像、最大 3 件の動画、最大 3 件の音声)
- プロンプトの長さ
- 最大 20,000 文字
- 動画の長さ
- 4〜15 秒
Seedance 2 Fast
15 秒のデフォルト クリップを使用した Fast-labeled マルチモーダル ワークフロー。
- 入力
- テキストプロンプトまたは互換性のある参照メディア(最大 5 件の画像、最大 3 件の動画、最大 3 件の音声)
- プロンプトの長さ
- 最大 20,000 文字
- 動画の長さ
- 4〜15 秒
Seedance 2
明示的な 480p ~ 4K 出力の選択肢を備えたマルチモーダル ビデオ作業。
- 入力
- テキストプロンプトまたは互換性のある参照メディア(最大 5 件の画像、最大 3 件の動画、最大 3 件の音声)
- プロンプトの長さ
- 最大 20,000 文字
- 動画の長さ
- 4〜15 秒
OmniHuman 1.5で操作できること
ポートレートとオーディオを組み合わせて構築する
OmniHuman 1.5 には現在、1 つのポートレート画像と 1 つの音声ファイルが必要です。提供されたオーディオによって長さが決まり、提供されたメディアによってフレーミングが決まり、ワークスペースは 720p、1080p、および高速モードを公開します。
必要なメディアをアップロード
画像 1 枚と音声ファイル 1 件が必要です。現在のプロジェクトで使用する権利のあるメディアのみをアップロードしてください。
クリップ設定を確認
現在のクリップ設定には アップロードした音声に従います(時間セレクターなし)、720P / 1080P、フレーミングはアップロードしたメディアに従います が含まれます。
OmniHuman 1.5 の現在の設定
これらの設定は現在の ImageStyle モデル設定に基づいており、ワークフローがタスクに合うか判断するのに役立ちます。
| 設定 | 現在利用可能な内容 |
|---|---|
| 入力 | 画像 1 枚と音声ファイル 1 件が必要です |
| プロンプトの長さ | 最大 1,000 文字 |
| 動画の長さ | アップロードした音声に従います(時間セレクターなし) |
| 出力解像度 | 720P / 1080P |
| フレーミング | フレーミングはアップロードしたメディアに従います |
| 追加の操作 | 現在の基本設定 |
AI動画モデル
OmniHuman 1.5 を選ぶとき
提供された画像と提供された音声を組み合わせたポートレート主導ビデオ。
現在のワークフローとの適合性
プロジェクトが 1 つの使用可能なポートレート画像と 1 つの駆動音声ファイルから始まり、クリップがテキストからビデオへのワークフローではなく、これらの提供されたメディアに従う必要がある場合は、OmniHuman 1.5 を選択してください。
他のモデルと比較する場合
音声のないテキストまたは画像のみがある場合は、このワークフローを使用しないでください。リップシンク、アイデンティティの保持、またはパフォーマンスについて約束するものではありません。必要なソース ファイルが使用できない場合は、テキスト主導モデルまたはイメージ主導モデルを比較します。
OmniHuman 1.5で動画を作成する方法
ポートレートとオーディオを 2 つの信頼できる情報源として準備し、オプションのプロンプトは、これらの提供されたメディアに関して要求された処理を明確にするためにのみ使用します。
- 1
2 つの必要なソースを確認する
出力オプションを設定する前に、ポートレートの被写体と運転音声がプロジェクトに対して許可されており、一緒に属していることを確認してください。
- 2
画像と音声の整合性を確認
アップロードした被写体を、音声内の言語、タイミング、または演技に合わせてください。結果を明確にするのに役立つ場合のみ、テキストによる指示を追加します。
- 3
長さと出力設定を確認
生成前に、ワークスペースで現在の アップロードした音声に従います(時間セレクターなし)、720P / 1080P、フレーミングはアップロードしたメディアに従います を確認してください。
- 4
生成して連続性を確認
公開利用前に、被写体の動き、カメラの変化、表示テキスト、音、最後のフレームを確認してください。
作成前と公開前の確認事項
- ワークスペースを最新情報として扱う
- モデルの提供状況と設定は変わることがあります。送信前に現在のワークスペースに表示される選択肢を使用してください。
- 許可済みの元メディアのみを使用
- 画像、動画、音声をアップロードする際は、現在のプロジェクトで使用・公開する権利があることを確認してください。
- 生成した動画を確認
- 公開前に、動きの連続性、テキスト、音、人物、商品詳細、マークを手動で確認してください。
OmniHuman 1.5 に関するよくある質問
- OmniHuman 1.5 をテキストのみまたは画像のみで使用できますか?
- いいえ。現在のワークフローには、1 つのポートレート画像と 1 つの音声ファイルが必要です。いずれかのソースが利用できない場合は、テキスト主導または画像主導のビデオ モデルを使用します。
- OmniHuman 1.5 は参照メディアから始められますか?
- 画像 1 枚と音声ファイル 1 件が必要です。生成前に現在のメディアの種類と数量制限を確認し、許可済みの元素材のみをアップロードしてください。
- OmniHuman 1.5 では動画をどのくらいの長さで作成できますか?
- 現在の動画の長さ設定は アップロードした音声に従います(時間セレクターなし) です。
- OmniHuman 1.5 で現在利用できる出力コントロールは何ですか?
- 現在利用できる出力オプションには 720P / 1080P と フレーミングはアップロードしたメディアに従います が含まれます。その他の利用可能な操作には 現在の基本設定 があります。
- 生成結果を確認せずに公開できますか?
- いいえ。公開利用前に、動きの連続性、テキスト、音、商品詳細など、正確である必要があるすべての要素を手動で確認してください。
更新日:
機能の情報源: 現在の ImageStyle 動画モデル設定。