The short version
TL;DR: 同じ文字、オブジェクト、製品、または新しいアクションや環境でのアートディレクションを望むときに参照ツービデオを使用します。 提供されたイメージがリテラルオープニングコンポジションであるべきときに、image-to-videoを使用してください。 エンドポイントコンポジションのどちらでも、スタートアンドエンドモードを使用します。 ロゴ、UIスクリーンショット、ラベル、価格、および承認されたコピーについては、生成された再構成に依存するのではなく、編集中の元のアセットを保持してください。
Video AI への参照は、テキストから新しいビデオを生成するプロンプト一方、視覚アンカーとして1つ以上の画像やクリップを使用して. 参照は通常、対象のアイデンティティをガイドします, 製品外観, ワードローブ, シーン言語, モーション, スタイル. 彼らは必ずしも文字通り最初のフレームではありません. その区別は、画像からビデオから参照にビデオを分離し、開始とエンドフレーム生成から, それは何を決定しますプロンプト言うべき。
01
60秒で正しいモードを選択します
| 制御しなければならないものは? | まずは | おすすめの理由 |
|---|---|---|
| アップロードされた画像は、文字の開口部でなければなりません | 動画画像 | 入力は最初の構成を確立します |
| 同じ被写体や製品が新しいシーンに現れなければならない | ビデオへの参照 | 参照は開始を固定しないでアイデンティティか出現を導きます |
| 開口部と着陸構成の両方の問題 | スタートフレームとエンドフレーム | 2つのエンドポイント画像は、ルートを制約します |
| ロゴ、UIスクリーン、価格、適量、モデル番号、または法的ラインは、正確でなければなりません | オリジナルのアセットと編集またはコンパイル | 文献情報は、生成された再構築に依存しない |
| アイデンティティと正確なエンドポイントが必要です | ショットを分離したり、両方をサポートするプロバイダ | どちらの入力モードもジョブを保護しない |
2列が等しく重要である場合は、機能名で選択しないでください。 制御が安全に失敗できる決定。 コンセプトショットは、緩い背景を許容することができます。 間違ったラベル、モデル番号、または製品イメージの対応を許容することはできません。
02
ビデオAIの参考文献とは
リファレンスツービデオは、一貫性のあるファースト生成タスクです。モデルは、プロンプト参照媒体およびそれら参照から選択された視覚特徴を維持している間要求された行為に従うべきフレームを作り出して下さい。2026 CVPRのペーパー、「ゼロ打撃の参照にビデオ ジェネレーションをスケーリング」は、統合として研究の仕事を定義しますプロンプト- 参照画像から対象のアイデンティティを保存しながら、ビデオを調整しました。 ペーパーのサバーシステムは、すべての商用ツールの定義ではなく、すべての商用ツールの定性境界を提供します。
商用実装は、アイデアを広げます。ImagineArtの公式ドキュメントは、文字、プロップ、シーンの4つの参照画像までを可能にし、ソース構成にマッチしない新しいシナリオを記述します。ヴェネツィアの文書のキャラクター要素、シーンの参照、およびマルチショット制御。Viduは、キャラクター、オブジェクト、シーン、スタイル、構成、カメラの動き、および効果のための複数の参照ワークフローを販売しています。異なるプロバイダによって制限とサポートされた役割は、したがって、「参照ツービデオ」は、入力関係を記述します。ユニバーサルは、設定機能は設定されません。
重要な精神モデルは抽出し、再作成します。参照は、新しい生成されたフレームで認識し、再エクスポートするモデルの機能を提供します。すべてのピクセル、文字、または幾何学的エッジがコピーされることを保証するものではありません。そのため、モードは文字のアイデンティティと芸術の方向に有用であるが、文字製品情報に対する危険性は、その理由です。
03
動画AIと映像への映像の参考

映像には通常1つのイメージをリットルの入り口フレームとして扱います。プロンプトそのフレームの後に動くものについて説明します。 リファレンスツービデオは、機能ソースとして1つ以上の画像やクリップを使用しており、完全に新しい構成を作成することができます。 同じ製品は、白い背景のパックショットから新しいスタジオシーンに移動することができます。 出力はアップロードされたパックショットから始める必要はありません。
| 質問 | ビデオへの参照 | 動画画像 |
|---|---|---|
| 入力制御とは何ですか? | アイデンティティ、外観、オブジェクト、シーン、モーション、またはスタイル機能 | 文字の開口部構成、プラスビジュアル機能 |
| 何をすべきかプロンプト説明? | 新しいシナリオ、アクション、環境、カメラ、参照ロール | 主にモーション、カメラ、継続、保護された細部 |
| 最高の使用 | 一貫したキャラクター、商品、アートの方向性を兼ね備えた新しいシーン | 開口部を再構築することなく、既存の静止画をアニメーション化 |
| 主なリスク | 参照の競合や重要な詳細は、緩く再作成されます | 開始イメージは動きが増加するように変形します |
今回のドキュメントでは、この境界線の明示的なものを作ります。image-to-video は、参照ツービデオ抽出物ビジュアル機能と新しいシナリオでそれらを再作成しながら、文字を最初とオプション最後のフレームを定義します。これは、任意のイメージガイドされた生成のためのキャッチオールとして「参照ビデオ」を使用するツールページよりもより正確です。
有料のイメージガイドテストが実際に保存されていること
境界を可視化するために、2026年8月8日に完了した有料のSeedance 2.5画像ガイド実行を再利用しました。 これは画像から動画へのテストであり、直接的な参照から動画へのベンチマークではありませんでした。 区別は重要です:アップロードされた創設者画像がオープニング構成を定義し、プロンプトは同じオフィスで短いシークエンスを要求しました。 テストでは、入力画像1枚、16:9フレーム、720p出力、10秒、ネイティブオーディオオフ、シード18473を使用しました。


生成されたフレームは、ソース組成物の近くで保持され、創設者、ダークシャツ、デスク、シルバーノートパソコン、印刷された簡単な、マグカップ、植物、および暖かいオフィスパレットを認識可能。それは、リテラルスクリーンコンテンツを保存していませんでした。着色された編集ウィンドウは、開口部から近似して、ショットが続けたように再び変更されました。

中間点では、広いアイデンティティとオフィスは安定して残っていますが、創設者の表現、ノートパソコンの角度、画面のレイアウト、紙の位置、背景の詳細はドリフトしました。最終的なフレームでは、ノートパソコンは閉鎖され、印刷された簡略化は、まだ近似のみでした。それらの変更は物語の動きのビートのために許容されていましたが、それらは正確なUI、文書の内容、製品ラベル、または承認されたコピーのための受諾テストに失敗します。


実用的な評論:画像ガイダンスは、それが保存されたリテラル情報よりも、シーンと人より良い保存しました。 参照ツービデオは、モデルをより柔軟なアイデンティティやスタイルのガイダンスを与えることができますが、それはこの再描画リスクを取り除きません。 スクリーン、ラベル、価格、モデル番号、または法的ラインが正確であるならば、モデルを再作成するのではなく、承認されたアセットを編集に入れる。
04
ビデオAI対の開始およびエンド フレームへの参照
開始と終了生成はエンドポイントファーストです。モデルが移行を発明しながら、クリップが開始し、どこに到着するかを2つの画像が指定します。参照ツービデオは、アイデンティティファーストまたはスタイルファーストです。参照は、対象、製品、または世界がいつか見えるかを確立します。プロンプトリクエスト構成を全体で新規にリクエストできます。
前後の変換のためのスタート・アンド・エンド・フレームを選択し、ロゴフリー・プロダクトは2つの承認された構成、知られている着陸が付いているカメラ・パス、または問題に終止符を付けるループの間で動きます。複数の設定、新しい環境に置かれるプロダクトまたは複数の打撃を渡る1つの芸術の方向を必要とする視覚キャンペーンで出現する特性のための参照ツー・ビデオを選んで下さい。
モードは重複できます。 プロバイダーは、開始フレームと別のアイデンティティ参照、またはより広い参照スタック内の開始および終了フレームを許可することができます。 インターフェイスラベルと現在のドキュメントを真理のソースとして扱います。 実用的な質問は、マーケティング用語がより高度に聞こえるわけではありません。 これは、モデルがリテラルフレームとして扱われ、それが特徴的なガイダンスとして扱われるものです。
05
参照媒体が制御できるもの
キャラクターアイデンティティ: 顔の構造、髪、衣服、比率、および再発付属品。 複数のビューは、曖昧さを減らすことができますが、年齢、照明、ヘアスタイル、またはワードローブの信号が漂流を作成することができます。
製品外観: シルエット、材料、色、パッケージ形状、キャップまたはハンドルジオメトリ、および広範なラベル配置。 小さなタイポグラフィ、反射詳細、正確なコネクタ、および規制マークは壊れやすいまま。
シーン言語:アーキテクチャ、家具、パレット、照明、天気、空間的な気分。シーンリファレンスは、別のサブジェクトリファレンスが誰が表示されているかを定義しながら、世界を定義することができます。
モーションとカメラ: いくつかのツールは、身体の動き、カメラのパス、パッシング、または効果をガイドする参照クリップを受け入れます。すべてのプロバイダは、ビデオ参照を同じ方法に解釈してはいけません。クリップは、モーションを制御し、任意の俳優または設定を無視すべきである状態。
美術の方向:イラストラインの品質、質感、レンズ感、コントラスト、パレット、アニメーションスタイル。 被写体参照の幾何学的および照明と衝突しないときの気分ボードは最も強いです。
06
リファレンス・ロールプロンプト仕様
書き込むプロンプト2つの層で。最初の層は、何が安定しているかを言います。第二は、変化を言う。実用的な式は次のとおりです。
@Reference 1 defines [subject or product identity]. Preserve [three inspectable features] and ignore [unwanted original environment]. @Reference 2 defines [scene or art direction]. Preserve [lighting, palette, material, or layout] and ignore [unwanted subject]. Create a new scene where [one action] happens in [environment]. The camera performs [one move]. Keep [continuity constraints]. End on [final composition]. No generated readable text, invented logos, duplicated subjects, random cuts, or unsupported claims.「Keep it一貫した」はあまりにも漠然としています。 “円筒形のボトル、マットブラックキャップ、アンバーガラス、フロントラベルの位置を保存します。” チェックリストを見直します。 “ダイナミックカメラ” 漠然としています。 “時計回りの20度アークを一定のメディア距離でゆっくりと” 動きを定義します。 “Premium” 漠然としています。 “Soft top light, black Acrylic Surface, amber rim light” は、一見を定義します。.
参照ロールは、生成前の競合も明らかにします。 1つのイメージが白いキャップを定義し、別のイメージが黒いキャップを定義する場合、プロンプト資産の不一致を確実に解決することはできません。 参照が勝つ承認されたソースまたは状態を選択してください。 モーションクリップには異なる俳優が含まれている場合は、明示的に俳優を無視し、運動だけを使用します。
07
最小限の実行可能な参照パケットを作成する
リスクの高い機能が見える最小パケットから始めましょう。次の3項目のパケットは、ユニバーサルプロバイダーの要件ではなく、編集開始点です。プロバイダのアップロード制限は異なります。

| コンテンツ | 第一次選考 | 保存しなければならない | 変更する5月 | いがり |
|---|---|---|---|---|
| ヒーローフロントまたは3つの本社イメージ | 製品のアイデンティティ | シルエット、色、素材、キャップ、または形状のハンドル | 背景と影の治療 | 後で合成されなければ読みやすいラベルのテキスト |
| 側面または難易度画像 | 隠された幾何学 | 港、制御、パッケージの端、コネクター、またはプロフィール | フラミングとクロップ | 関係のないプロップ |
| シーンやスタイルイメージ | 環境・芸術の方向 | パレット、ライト方向、表面、空間的な気分 | 演題配置 | 気分のイメージのプロダクトか人 |
アップロードする前に、ソースの終点線を1つ追加します。 「現在の承認された製品バージョンは [バージョン/日付/ファイル所有者] です。 参照が不一致の場合、 [ファイル] が勝つ」。 これは、資産管理の問題がとして誤って診断されるのを防ぎます。プロンプト問題。
その後、各ファイルに属する出力チェックを記録します。 ヒーローリファレンスは、開口部、中間点、終了時に見直しられます。 カメラが角度を露出したときにサイドリファレンスが確認されます。 シーンリファレンスは、ライト、パレット、連絡先の影、および製品ジオメトリではなくスケールで確認されます。
08
作業例:新しいスタジオシーンの商品
チームには、マットブラックキャップとショルダープロファイルを示すサイドイメージ、およびブラックアクリル、ソフトトップライト、アンバーリムを備えたスタジオボードが承認されたアンバーボトルのフロントイメージ、および。 目標は、承認されたコピーのための明確なスペースで明らかなスロー製品です。
ウェッジプロンプト: 「これらの画像を使用して、プレミアムシネマティック製品ビデオを作成します。 一貫性を保ち、ロゴを表示してください。」 参照ロールを割り当て、移動を定義したり、生成された外観をリテラルブランド情報から分離しません。
産品展示プロンプト: : : :
@Image 1 defines the bottle's amber glass, cylindrical silhouette, shoulder profile, matte-black cap, and front-label position. Ignore its white background and do not reconstruct readable label text. @Image 2 defines the cap and side geometry only. @Image 3 defines the black acrylic surface, soft top light, narrow amber rim light, and dark studio palette. Ignore any object in the style image. Create one continuous studio shot in which the bottle remains upright while the camera makes a slow 20-degree clockwise arc at constant distance. Keep one bottle in frame. Preserve silhouette, cap size, amber material, and front-label position. Keep the left third quiet for the approved logo and copy added later. No cuts, extra props, duplicate bottles, readable text, invented logos, or packaging claims.受諾計画: シルエットとキャップを3つのタイムスタンプで比較し、アークの内側の幾何学を検査し、左の安全ゾーンが使用可能であることを確認し、承認されたアートワークで再構築されたラベルを交換します。 ボトルがアーク中にミュートすると、より記述的な言語を追加する前に、ビューポイントの変更を減らします。
09
製品のロゴ、UI、テキストが漂流する理由

生成ビデオは、フレームを時間とともに再構築します。モデルが製品を認識する場合でも、各フレームはエッジ形状、ラベルの間隔、文字のフォーム、ポート位置、ボタン数、または反射で変化することができます。 モーション、閉塞、視点の変更、および圧縮は、保存する小さな詳細を困難にします。 参照は視覚的制約を増加させます。 生成されたフレームを決定的な複合体に変えません。
マーケティングのために、精度を3つのレイヤーに分割します。 アセット忠実度は、提供された製品、ロゴ、スクリーンショット、または映像が承認されたアセットのままであるかどうかを尋ねます。 情報忠実度は、言葉、数字、モデル名、価格、および法的フレーズがリテラルにとどまるかどうかを尋ねます。 対応は、製品Aのナレーションが製品Aと相まっているかどうかを尋ねます。 生成されたクリップは、これらのレイヤーの1つ以上を失敗しながら、一貫性を見ることができます。
TapVid供給されたアセットを配置し、承認されたコピーを編集可能な説明ワークフローに直接配置することにより境界アドレス。このシステムは、説明ビデオエンジンピクセル生成がすべての製品事実を再現する約束としてではなく、生成ショットは、文字通りの製品イメージ、スクリーンショット、ロゴ、テキストが再描画パスの外に残っている間、まだ雰囲気や動きを追加することができます。
10
参照の選択と準備方法
参照・ステップの選択と準備方法
- 1
承認されたソースから始めましょう。
現在の製品イメージ、最終文字シート、正しいブランドボードを使用してください。モデルは、古い真実を認めることはできません。
- 2
各ファイル1つのメインジョブを付与します。
アイデンティティ、製品ジオメトリ、環境、スタイル、モーション、または音は明示的である必要があります。
- 3
回避可能な競合を削除します。
ワードローブ、製品バージョン、色、照明方向、およびアスペクト比を可能な限り合わせます。
- 4
難易度の高い機能が明確に表示します。
キャップ、ハンドル、プロファイル、包装エッジ、または生き残る必要がありますキャラクターアクセサリーを含みます。
- 5
アクションを第一テストに控えてください。
複雑な動きが騒音を加える前に、スロープッシュインまたは1つの物理的作用はベースラインの忠実度を明らかにします。
- 6
無視するものを文書化します。
背景、俳優、テキスト、カメラの動き、または参照からのプロップは、ターゲットシーンに所属していない場合があります。
デフォルトでは参照数を増やす必要はありません。より多くのファイルはカバレッジを追加することができますが、矛盾を追加することもできます。スクリーンショットに必要な対象、設定、およびモーション言語を明確に確立する最小のセットを選択します。
11
商品到着受付シート
| レイヤー | トピックス | パス条件 | 公開ブロッカー |
|---|---|---|---|
| 資産の忠実性 | シルエット、材料、帽子、港、ボタン、包装の端 | 保護された特徴は、開口部、中間点、終了および閉塞で安定しています | 製品定義機能の変更 |
| 情報発信 | ロゴ、ラベル、番号、UI、価格、承認されたコピー | 認定されたソースアセットから、Litalコンテンツが来ます | 生成された読みやすいコンテンツは、実際のものとして提示されます |
| 対応する | 製品の展示は、対のナレーションやキャプション | あらゆるクレームは正しい製品と状態と組み合わせています | 製品 A は、製品 B のクレームの下に表示されます。 |
| オブジェクトの完全性 | カウント、アクセサリー、手、反射 | 重複、除去、マージ、またはサポートされていないプロップなし | 購入関連オブジェクトの変更 |
| サポートを見る | カメラで露出した角度 | 重要なビューは、参照または発明の承認によってサポートされています。 | モデルは、統一された製品面を発明します |
移動ファイル、ポスターフレームだけでなく、レビュー。 製品は、回転中に最初と変異で正しい外観を見ることができます。 変形と高速の動きで、幾何学とテキストのエラーが頻繁に表示されます。 購入、法的レビュー、または製品使用に影響を与えるクレームについては、視覚から別に文字のコピーを確認します。
12
一般的な参照ツービデオ障害モード
| シンプトム | 原因は、 | 再実行前の変更 |
|---|---|---|
| アイデンティティや製品バージョンの変更 | 参照の競合 | 未処理のファイルを削除します。 受賞した認証されたソースを宣言します |
| モーションクリップの俳優や部屋が現れます | ロール漏れ | 無視ルールを追加し、クリーナーモーションリファレンスを使用する |
| 複雑なショット中に変異する | 過負荷アクションとカメラ | 1つのアクションビートと1つのカメラシステムに削減 |
| 可逆的だが間違ったロゴ、UI、または番号が現れます | 文学コンテンツは世代に委任されました | 安全なゾーンを予約し、承認された材料を合成 |
| 舞台に貼り付けられた主題 | 照明、視点、または誤ったマッチを接触させる | 照明方向とカメラの高さを一直線に並べ、接触の影とスケールを指定 |
| 正面の正しい眺め、発明された側面図 | ジオメトリ参照を欠く | 必要な承認された角度を加えて下さいまたはカメラ アークを減らすため |
13
ビデオAIへの参照が正しい選択であるとき
新しいシーンが、正確なソース構成を保存し、認識可能なアイデンティティやアートの方向が純粋な探査よりも重要であるよりも重要である場合に使用します。良い例には、承認されたアセットの周りのさまざまなショット、ストーリーボード、プレビズ、および生成されたトランジションを横断するいくつかの環境で、再発された文字、製品コンセプト、製品コンセプトが含まれます。
出力が実際のインターフェイス、価格、投与量、ラベル、法的ステートメント、測定、または正確な製品の詳細を再現しなければならない唯一の忠実なメカニズムとして使用しないでください。 これらのケースでは、生成されたモーションを元のアセットと組み合わせたり、リテラル素材の編集と検査を可能とする説明ワークフローを使用します。
14
最終的な評決
リファレンスツービデオは、視覚的なアンチャルワークフローとして最もよく理解されます。 キャラクター、製品、シーン、スタイルを生成された動きに合わせ、より一貫性のあるものにすることができますが、それは文字通りピクセルや実際のテキストを保証するものではありません。 最も重要な決定は、入力がアイデンティティとスタイル、実際の最初のフレーム、または両方のエンドポイントを定義すべきかどうかです。
各参照に1つのロールを割り当て、動きから安定した特性を分け、第一のモードのアクションから始め、重要なタイムスタンプでフルクリップを見直します。製品マーケティングのために、提供されたアセットを保ち、異なる精度が重要である場合は、再描画パスから承認された情報を保持します。
15
よくある質問
映像と同じ映像をビデオに参照しますか?
いいえ。通常、アップロードされたイメージからリテラルフレームとして画像から始まります。 参照ツービデオ抽出外観やスタイルの機能と新しい組成とシナリオを作成することができます。
ロゴやラベルを正確に保つためにビデオを参照できますか?
幅広い配置と外観を維持することができますが、正確な文字と幾何学は漂流することができます。 承認されたロゴ、ラベル、またはリットルの忠実度が必要な場合のアートワークを包装する合成。
利用する基準はいくつですか?
必要なアイデンティティ、製品、環境、およびモーションを確立する最小セットを使用します。 プロバイダーは異なります。 矛盾することなくカバレッジを追加する場合にのみ、より多くの参照が役立ちます。
一番のは?プロンプト注文?
ステート参照ロールと保護された特性は、最初に、新しいアクションと環境、カメラの移動、1つのカメラ、最終構成、および制約。 必要に応じて、各参照から無視するモデルを教えてください。
Turn them into a clear, publishable video
Keep reading
Related stories

プロダクトデモ動画の事例10選と、それぞれの証明パターン
買い手に何を証明するかという視点で、公開プロダクトデモ10本の共通パターンを分析します。
Aug 5, 2026

2026年ベスト製品デモ動画メーカー(カテゴリ別に検証)
2026年のベスト製品デモ動画メーカーを、画面録画・アバター・アニメーションのカテゴリ別に検証。率直な長所と短所、あなたのデモに合う選び方を紹介します。
Jul 17, 2026

AIで製品デモ動画を作る方法(ステップバイステップ・2026年版)
AIで製品デモ動画を作る手順を解説。画面を録画するか台本からアニメ化するかを決め、生成・編集・公開まで進めましょう。
Jul 9, 2026

