AI動画モデル

OmniHuman 1.5 AI動画生成

プロジェクトが 1 つの使用可能なポートレート画像と 1 つの駆動音声ファイルから始まり、クリップがテキストからビデオへのワークフローではなく、これらの提供されたメディアに従う必要がある場合は、OmniHuman 1.5 を選択してください。

OmniHuman 1.5 のタスク例

これらのローカル参照は、現在の OmniHuman 1.5 の入力・設定条件を具体的なタスクの方向性に置き換えるためのものです。このモデルが生成した出力としては表示していません。

各カードには、検証済みのモデルファミリー例か視覚的な参照かを表示します。参照カードはモデル比較や生成前後の主張ではありません。

入力条件
画像 1 枚と音声ファイル 1 件が必要です
現在の設定
プロンプトの長さ: 最大 1,000 文字 · 動画の長さ: アップロードした音声に従います(時間セレクターなし) · 出力解像度: 720P / 1080P · フレーミング: フレーミングはアップロードしたメディアに従います
選定の境界
音声のないテキストまたは画像のみがある場合は、このワークフローを使用しないでください。リップシンク、アイデンティティの保持、またはパフォーマンスについて約束するものではありません。必要なソース ファイルが使用できない場合は、テキスト主導モデルまたはイメージ主導モデルを比較します。

動きの要点

1 つの主題のアクションとクリップが開始される瞬間を述べます。

タスクの方向性
1 つの主題のアクションとクリップが開始される瞬間を述べます。

視覚的な参照であり、このモデルの出力ではありません

ImageStyle内のローカル視覚リファレンスです。特定モデルの生成結果としては表示していません。

OmniHuman 1.5で動画を作成

カメラの方向性

カメラの動作と、時間の経過とともに明らかになる視覚的な変化に名前を付けます。

タスクの方向性
カメラの動作と、時間の経過とともに明らかになる視覚的な変化に名前を付けます。

視覚的な参照であり、このモデルの出力ではありません

ImageStyle内のローカル視覚リファレンスです。特定モデルの生成結果としては表示していません。

OmniHuman 1.5で動画を作成

終了時の状態

この参照を現在のモデルの結果として扱わずに、最終的な視覚的状態を定義します。

タスクの方向性
この参照を現在のモデルの結果として扱わずに、最終的な視覚的状態を定義します。

視覚的な参照であり、このモデルの出力ではありません

ImageStyle内のローカル視覚リファレンスです。特定モデルの生成結果としては表示していません。

OmniHuman 1.5で動画を作成
作成
AI動画
入力
画像 1 枚と音声ファイル 1 件が必要です
動画の長さ
アップロードした音声に従います(時間セレクターなし)

関連モデルと現在利用できる設定を比較

ワークスペースを開く前に、入力・出力・フレーミングの操作がタスクに合うか確認します。この表では、例のメディアをモデル間の性能比較として扱いません。

OmniHuman 1.5で操作できること

ポートレートとオーディオを組み合わせて構築する

OmniHuman 1.5 には現在、1 つのポートレート画像と 1 つの音声ファイルが必要です。提供されたオーディオによって長さが決まり、提供されたメディアによってフレーミングが決まり、ワークスペースは 720p、1080p、および高速モードを公開します。

必要なメディアをアップロード

画像 1 枚と音声ファイル 1 件が必要です。現在のプロジェクトで使用する権利のあるメディアのみをアップロードしてください。

クリップ設定を確認

現在のクリップ設定には アップロードした音声に従います(時間セレクターなし)、720P / 1080P、フレーミングはアップロードしたメディアに従います が含まれます。

OmniHuman 1.5 の現在の設定

これらの設定は現在の ImageStyle モデル設定に基づいており、ワークフローがタスクに合うか判断するのに役立ちます。

設定現在利用可能な内容
入力画像 1 枚と音声ファイル 1 件が必要です
プロンプトの長さ最大 1,000 文字
動画の長さアップロードした音声に従います(時間セレクターなし)
出力解像度720P / 1080P
フレーミングフレーミングはアップロードしたメディアに従います
追加の操作現在の基本設定

AI動画モデル

OmniHuman 1.5 を選ぶとき

提供された画像と提供された音声を組み合わせたポートレート主導ビデオ。

現在のワークフローとの適合性

プロジェクトが 1 つの使用可能なポートレート画像と 1 つの駆動音声ファイルから始まり、クリップがテキストからビデオへのワークフローではなく、これらの提供されたメディアに従う必要がある場合は、OmniHuman 1.5 を選択してください。

他のモデルと比較する場合

音声のないテキストまたは画像のみがある場合は、このワークフローを使用しないでください。リップシンク、アイデンティティの保持、またはパフォーマンスについて約束するものではありません。必要なソース ファイルが使用できない場合は、テキスト主導モデルまたはイメージ主導モデルを比較します。

OmniHuman 1.5で動画を作成する方法

ポートレートとオーディオを 2 つの信頼できる情報源として準備し、オプションのプロンプトは、これらの提供されたメディアに関して要求された処理を明確にするためにのみ使用します。

  1. 1

    2 つの必要なソースを確認する

    出力オプションを設定する前に、ポートレートの被写体と運転音声がプロジェクトに対して許可されており、一緒に属していることを確認してください。

  2. 2

    画像と音声の整合性を確認

    アップロードした被写体を、音声内の言語、タイミング、または演技に合わせてください。結果を明確にするのに役立つ場合のみ、テキストによる指示を追加します。

  3. 3

    長さと出力設定を確認

    生成前に、ワークスペースで現在の アップロードした音声に従います(時間セレクターなし)、720P / 1080P、フレーミングはアップロードしたメディアに従います を確認してください。

  4. 4

    生成して連続性を確認

    公開利用前に、被写体の動き、カメラの変化、表示テキスト、音、最後のフレームを確認してください。

作成前と公開前の確認事項

ワークスペースを最新情報として扱う
モデルの提供状況と設定は変わることがあります。送信前に現在のワークスペースに表示される選択肢を使用してください。
許可済みの元メディアのみを使用
画像、動画、音声をアップロードする際は、現在のプロジェクトで使用・公開する権利があることを確認してください。
生成した動画を確認
公開前に、動きの連続性、テキスト、音、人物、商品詳細、マークを手動で確認してください。

OmniHuman 1.5 に関するよくある質問

OmniHuman 1.5 をテキストのみまたは画像のみで使用できますか?
いいえ。現在のワークフローには、1 つのポートレート画像と 1 つの音声ファイルが必要です。いずれかのソースが利用できない場合は、テキスト主導または画像主導のビデオ モデルを使用します。
OmniHuman 1.5 は参照メディアから始められますか?
画像 1 枚と音声ファイル 1 件が必要です。生成前に現在のメディアの種類と数量制限を確認し、許可済みの元素材のみをアップロードしてください。
OmniHuman 1.5 では動画をどのくらいの長さで作成できますか?
現在の動画の長さ設定は アップロードした音声に従います(時間セレクターなし) です。
OmniHuman 1.5 で現在利用できる出力コントロールは何ですか?
現在利用できる出力オプションには 720P / 1080P と フレーミングはアップロードしたメディアに従います が含まれます。その他の利用可能な操作には 現在の基本設定 があります。
生成結果を確認せずに公開できますか?
いいえ。公開利用前に、動きの連続性、テキスト、音、商品詳細など、正確である必要があるすべての要素を手動で確認してください。

更新日:

機能の情報源: 現在の ImageStyle 動画モデル設定。

OmniHuman 1.5で動画を作成