垂直型 AI ビデオ プロンプトは、多くの場合、最後に `9:16` が追加された水平型プロンプトとして扱われます。私たちのデータは、より有用な区別を示唆しています。 13 が厳選した縦型ブリーフでは、視覚的な方向が 84.6% に表示されましたが、プロンプトにアスペクト比を明示的に書き込んだブリーフは 1 つだけでした。確定した事実はどれにも現れなかった。ソース資産は 2 つ表示され、明示的な CTA は 2 つ表示されます。
これは、ビデオに垂直方向の設定や製品入力が欠けていたという意味ではありません。アスペクト比は構造化されたコントロールで選択でき、アセットはアップロードを通じて到着できます。この発見は、プロンプト アーキテクチャに関するものです。縦型ブリーフでは、フォーマットやソース素材については周囲のワークフローに依存しながら、創造的なアイデアにプロンプト テキストを使用することがよくあります。
最も安全なアプローチは、1 画面契約 を設計することです。エクスポート設定を構造化コントロールに保持し、プロンプトを使用して、最初に表示されるフレーム、メッセージ階層、保護された製品の証拠、および 1 つの電話画面に収まる必要があるアクションを定義します。
01
縦型AIビデオプロンプト調査手法
TapVid の Good Case ライブラリは、2026 年 9 月 1 日に凍結されました。厳密なコーパスには、完全なプロンプト、公開共有 URL、生成 URL、および MP4 添付ファイルを含む 64 レコードが含まれています。この記事では、出力比率が 9:16 であった 13 レコードを分析します。比較グループには、同じ厳密なコーパスからの 51 水平レコードが含まれています。
決定論的なキーワード辞書は、視聴者、再生時間、ソースアセット、シーン構造、固定事実、ビジュアルシステム、オーディオ、CTA、アスペクト比、およびインタラクションの 10 個のフィールドがプロンプトテキスト内で明示的であるかどうかをコード化しました。
このコードは、すべての製品設定、アップロードされたファイル、またはプロンプト以外の会話を検査するわけではありません。ここではその区別が特に重要です。比率を明示的に書き込んだ垂直プロンプトは 1 つだけでしたが、すべてのレコードは構造化メタデータによって垂直として分類されました。結果を `creators forgot 9:16` と言い換えることはできません。
サンプルには、ランダムな生成ではなく、厳選されたケースが含まれているため、どのプロンプト スタイルがパフォーマンスを向上させるかを特定できません。集計フィールドと、すでに公開されている 1 件のケースを報告します。プライベート プロンプトは再現されません。
02
13 垂直 AI ビデオ プロンプトに含まれるもの
| 明示的なフィールド | 13 ブリーフのシェア | カウント |
|---|---|---|
| 視覚系 | 84.6% | 11 |
| オーディオ | 46.2% | 6 |
| シーンの構成 | 38.5% | 5 |
| 期間 | 23.1% | 3 |
| ソースアセット | 15.4% | 2 |
| CTA | 15.4% | 2 |
| 観客 | 7.7% | 1 |
| プロンプトテキストのアスペクト比 | 7.7% | 1 |
| インタラクション | 7.7% | 1 |
| 確定した事実 | 0.0% | 0 |
中央値のプロンプトには、384 文字が含まれていました。同じ厳密なコーパス内の水平ブリーフには、中央値の 3,557 文字がありました。また、垂直グループでは、明示的なソース アセット、ファクト、シーン、およびインタラクションの指示の使用が少なくなりました。
これらの違いは仕事を反映している可能性があります。縦型ソーシャル ビデオは、多くの場合、1 つの視覚的なアイデア、1 つの発言の瞬間、または 1 つの変化に焦点を当てています。水平的な説明は、より長いシーケンス、いくつかの製品資産、および事実を重視した説明を伝える可能性が高くなります。コンテンツ カテゴリは管理された実験ではないため、データは形式だけが違いを引き起こしたことを証明していません。
それでも、このコントラストは制作チームに有益な警告を与えます。コンパクトなプロンプトは、自己完結型のビジュアルとして機能します。縦型動画に、正確さを保つ必要がある製品名、価格、仕様、UI、または複数の SKU の主張が含まれている場合、リスクが高まります。
03
フォーマット設定をクリエイティブブリーフの外に置く
一般的なプロンプト ライブラリでは、プロンプト内にプラットフォーム、期間、比率を記述することが定期的に推奨されています。モデルに個別の設定がない場合、これは合理的です。運用システムがすでにこれらのフィールドを公開している場合、重複した命令が競合する可能性があります。
構造化レイヤーは次の目的で使用します。
- アスペクト比と出力サイズ
- 持続時間の範囲
- 言語と音声の選択
- キャプションのオンまたはオフ
- エクスポート形式
- 製品または SKU 識別子
プロンプト レイヤーは次の目的で使用します。
- 最初のフレームと最初のセリフ
- 目に見える行動や変化
- どのソース資産をそのままにしておく必要があるか
- テキストの階層と安全な配置
- ビジュアルとオーディオのディレクション
- 最後のアクション
- ネガティブ制約とレビューチェック
この分離により、13 に 1 つのアスペクト比の結果がベスト プラクティスにならずに説明されます。プロンプトは、システムがすでに確実に制御している情報を繰り返してはいけません。
04
1 画面契約を構築する
電話の画面では、複数の決定が同じフレーム内に強制されます。視聴者は、数秒以内に製品を認識し、説明を読み、動きを追い、次のアクションを理解する必要がある場合があります。 1 画面契約では、これらの要素が競合した場合にどちらが勝つかを指定します。
| 優先順位 | 契約に関する質問 | 解答例 |
|---|---|---|
| 1. 製品のアイデンティティ | 何が認識され続けなければなりませんか? | 提供された製品パックのショットと正確なロゴ |
| 2. メッセージ | 文字通りのステートメントは何ですか? | `Three sizes available` |
| 3. 証拠 | その主張を裏付けるビジュアルは何でしょうか? | 3 つの承認済み製品バリエーションを並べて表示 |
| 4. 安全な設置 | 証拠を隠さずにテキストをどこに表示できますか? | 上 3 分の 1、最大 2 行 |
| 5. モーション | 撮影中に何が変化するのか? | 商品が1つずつ入ってホールド |
| 6. アクション | 視聴者は次に何をすべきでしょうか? | `Compare sizes` |
2 番目の主張に 2 番目の証明が必要な場合は、おそらく 2 番目の場面が必要です。文字を縮小しても注目度は高まりません。
05
縦型 AI ビデオ プロンプトの作成方法
最初に表示されているフレームから開始します
最初のフレームでは、問題、製品、または次の秒を注目に値する驚くべき状態のいずれかを明らかにする必要があります。動画が商品説明の場合は、抽象的な設定は避けてください。
最初のフレーム: 付属の赤いボトルが中央下部を占めています。上 3 分の 1 に正確なオーバーレイ: `Refill, do not replace.` ブランド マークを遮らないようにしてください。
この方向性は、一般的な `strong hook` を要求することなく、構成、製品の忠実度、およびテキスト階層に答えます。
目に見えるアクションを 1 つ使用する
短い垂直方向の生成では、シーンごとに 1 つの主要な動きが利点となります。開始状態、アクション、および終了状態に名前を付けます。
承認された 3 つのパッケージ サイズをすべて揃えて開始します。他の 2 つのサイズは固定されたままで、最小サイズを前方に移動します。 1 秒間のクリーンな比較フレームで終了します。
命令はテスト可能です。 `Create dynamic motion` ではありません。
動画にコマースが含まれる場合は事実をロックする
13 の垂直プロンプトはどれも、固定事実辞書と明示的に一致しませんでした。それは雰囲気のあるソーシャルクリップにとっては無害かもしれません。広告、商品説明、または複数の SKU 動画にとっては、重大なギャップです。
製品名、価格、サイズ、日付、プロモーション条件、仕様、法律上の文言を表すリテラル テキスト ブロックを作成します。各行を正しいアセットに接続します。どの数値がどのバリアントに属するかを視覚的なモデルに推測させないでください。
スタイルを追加する前に安全ゾーンを予約する
セーフ ゾーンは配置とインターフェイスによって異なるため、エクスポートする前に現在のプラットフォーム テンプレートを確認してください。制作概要内では、ユニバーサル ピクセル値をハードコーディングするのではなく、機能ごとに領域を予約します。
- 製品証拠ゾーン
- プライマリ オーバーレイ ゾーン
- キャプションゾーン
- プラットフォームとインターフェースのクリアランス
- CTA ホールドフレーム
同じアセットが複数のプレースメントにまたがって実行される場合は、プレースメント固有のクロップを作成し、それぞれを確認します。 1 つの作物がどこでも自動的に安全になるわけではありません。
最終フレームを検査可能にする
13 ブリーフのうち 2 つは、明示的に CTA と名付けられています。縦型ビデオには必ずしも商業的なアクションが必要というわけではありませんが、最終フレームは視聴者が結果を理解できる程度に十分な長さを持つ必要があります。製品ビデオの場合、正確な CTA、宛先コンテキスト、および表示されたままの製品状態を指定します。
06
コピー可能な縦型 AI ビデオ プロンプト
構成された 9:16 出力設定を使用して、1 つの垂直ビデオ シーンを作成します。
対象読者と仕事:
[1 人の視聴者] は [1 つの製品の事実またはアクション] を理解する必要があります。
真実の情報源:
- 商品やロゴを再描画せずに[承認された商品画像/動画]を使用してください
- このテキストはリテラルのままにしてください: [名前、番号、価格、サイズ、モデル、日付、または承認された語句]
- この声明は[承認された情報源]によってサポートされています
ワンスクリーン契約:
- 最初のフレーム: [製品/問題/証拠と正確な構成]
- 主要メッセージ: [リテラル 1 行、最大 2 行]
- 証拠: [メッセージを証明または実証するビジュアル]
- 安全な配置: [オーバーレイ ゾーン、キャプション ゾーン、インターフェイス クリアランス]
- モーション: [状態] で開始、[1 つのアクション] を実行、[状態] で終了
- 最終アクション: [1 つの CTA または完了した状態]
クリエイティブディレクション:
- [ビジュアルスタイル、照明、カメラ、ペース、オーディオ]
- 生成されたコンテンツは、[背景またはトランジション] にのみ使用できます。
- 製品のバリエーション、画面、主張、価格、ラベル、または結果を発明しないでください。
レビュー:
- 製品のアイデンティティが損なわれず、障害物がないこと
- リテラルテキストは正確であり、正しい製品と組み合わせられています
- 重要なメッセージは携帯電話サイズのプレビューで読むことができます
- エクスポート前に最終フレームを検査できます最初の文は、意図的に構成された設定について言及しています。ツールに比率制御がない場合は、プロンプトに出力要件を追加し、レンダリングされた寸法を確認します。
07
事例: 1 つの視覚システムを通じて語られる垂直プロセス
公開されている ピクセル アート ガイド: ネクターからハニーへ ケースは、コンパクトなプロンプトと一貫したピクセル アート システムを備えた 9:16 出力です。これは、1 つの変換と 1 つの視覚言語でシーンを伝える場合に、縦方向のブリーフが簡潔になる理由を示しています。

公開 TapVid ケースを開く または 生成されたビデオを開く。
この事例は、コンパクトなビジュアルストーリーテリングの一例です。製品、科学、または変換に関する主張を検証するものではありません。
08
垂直方向と水平方向の比較が意味するもの
同じコーパス内の最大のギャップは比率フィールドではありません。生産範囲です。垂直ブリーフの中央値は 384 文字でしたが、水平ブリーフの中央値は 3,557 でした。明示的なソース アセットは、垂直プロンプトの 15.4% と水平プロンプトの 60.8% に表示されます。修正された事実はそれぞれ 0% と 45.1% に表示されました。シーン構造は 38.5% および 76.5% に表示されます。
これらの観察を、縦型ビデオは曖昧であるべきだというルールにしないでください。それらをルーティングの決定として使用します。
- 製品に関する事実を含まない 1 つの視覚的なアイデアについては、プロンプトをコンパクトに保ちます。
- 製品説明の場合は、ビデオが短い場合でも、実際の資産や文字通りの事実を添付してください。
- 複数の請求または SKU の場合は、混雑した 1 つの画面ではなく、検査可能な複数のシーンを使用します。
- 信頼できるエクスポート設定をクリエイティブな散文の外側に保ちます。
チャンネルプランニングには、ソーシャル メディア ビデオ ガイド を使用してください。垂直型アセットが有料の TikTok クリエイティブである場合、AI TikTok 広告ワークフロー では、バリエーション全体で商品の証拠を一定に保つ方法について説明しています。
09
よくある質問
プロンプトには常に 9:16 と記述する必要がありますか?
ツールに個別のアスペクト比制御がない場合、またはプロンプトが唯一の仕様である場合にこれを記述します。構造化設定によって出力が制御される場合は、その設定を使用して、レンダリングされた寸法を確認します。コーパス内の 13 垂直ブリーフのうち 1 つだけがプロンプト テキストで比率を記述していましたが、構造化メタデータはすべての 13 を垂直であると識別しました。
縦型 AI ビデオ プロンプトの長さはどれくらいであるべきですか?
このデータセットには品質目標はありません。選択されたケースの中央値は、384 文字でした。ソース、文字通りの事実、レイアウト、動きを追加し、商用ジョブに必要な詳細を確認してから停止します。
1 画面契約を使用する理由
これにより、チームは装飾的なスタイルよりも、製品のアイデンティティ、メッセージ、証拠、テキストの配置、動き、アクションを優先する必要があります。これにより混雑が軽減され、ビデオが視聴されるデバイスでのレビューが可能になります。
このベンチマークを引用してもいいですか?
はい。次のように引用します: TapVid プロンプト ラボ、64 レコードから厳選された Good Case コーパスからの 13 垂直ブリーフの分析、2026 年 9 月 1 日に凍結されました。調査では明示的なプロンプト テキストを測定し、構造化された出力メタデータを使用して識別していると述べています。 9:16 レコード。




