竖屏 AI视频提示通常被视为横屏 Prompt,并在末尾添加`9:16`。我们的数据表明了一个更有用的区别。在 13 策划的竖屏 Brief中,视觉方向出现在 84.6% 中,但只有一篇简报明确地将长宽比写入提示中。固定的事实没有出现。源素材出现了两个,显式的CTA出现了两个。
这并不意味着视频缺乏垂直设置或产品输入。可以在结构化控件中选择宽高比,并且资产可以通过上传到达。这一发现与提示架构有关:竖屏 Brief通常使用提示文本来表达创意,同时依赖周围的工作流程来确定格式和源材料。
最安全的方法是设计单屏合约。将导出设置保留在结构化控件中,然后使用提示定义第一个可见框架、消息层次结构、受保护的产品证据以及必须适合一个手机屏幕的操作。
01
竖屏 AI视频提示研究方法
我们于 2026 年 9 月 1 日冻结了 TapVid 的 Good Case 库。严格的语料库包括带有完整提示、公共共享 URL、生成 URL 和 MP4 附件的 64 记录。本文分析了输出比例为9:16的13记录。比较组包含来自同一严格语料库的 51 横屏记录。
确定性关键字字典对提示文本中是否明确的十个字段进行编码:受众、持续时间、源素材、场景结构、固定事实、视觉系统、音频、CTA、宽高比和交互。
该代码不会检查提示之外的每个产品设置、上传的文件或对话。这种区别在这里尤其重要。只有一个竖屏 Prompt明确地写出了比率,但每条记录都通过结构化元数据分类为垂直记录。结果不应解释为 `creators forgot 9:16`。
该样本包含精选案例,而不是随机生成,因此无法确定哪种提示样式会带来更好的性能。我们报告聚合字段和一个已经公开的案例。私人提示不复现。
02
13竖屏 AI视频提示包含哪些内容
| 显式字段 | 13 份 Brief 中占比 | 计数 |
|---|---|---|
| 视觉系统 | 84.6% | 11 |
| 音频 | 46.2% | 6 |
| 场景结构 | 38.5% | 5 |
| 持续时间 | 23.1% | 3 |
| 源素材 | 15.4% | 2 |
| CTA | 15.4% | 2 |
| 观众 | 7.7% | 1 |
| 提示文本的长宽比 | 7.7% | 1 |
| 互动 | 7.7% | 1 |
| 固定事实 | 0.0% | 0 |
Prompt 中位数包含 384 字符。同一严格语料库中的水平Brief的中位数为 3,557 个字符。垂直组还使用较少的明确源素材、事实、场景和交互指令。
这些差异可能反映了工作。垂直社交视频通常集中于一个视觉想法、一个演讲时刻或一个转变。横向解释器更有可能包含更长的序列、多个产品资产和以事实为重的叙述。数据并不能证明格式本身造成了差异,因为内容类别不是受控实验。
尽管如此,这种对比还是给了制作团队一个有用的警告。紧凑的提示可以实现独立的视觉效果。当竖屏视频带有必须保持准确的产品名称、价格、规格、UI 或多 SKU 声明时,它们就会变得有风险。
03
将格式设置保留在创意概要之外
一般提示库会定期推荐提示中的写作平台、持续时间和比例。当模型没有单独的设置时,这是合理的。当生产系统已经公开这些字段时,重复的指令可能会发生冲突。
将结构化层用于:
- 长宽比和输出尺寸
- 持续时间范围
- 语言和语音选择
- 字幕打开或关闭
- 导出格式
- 产品或 SKU 标识符
使用提示层:
- 第一帧和第一句台词
- 可见的行动或转变
- 哪些源素材必须保持完整
- 文本层次结构和安全放置
- 视觉和音频方向
- 最后的行动
- 负面约束和审查检查
这种分离解释了 13 中的一的纵横比结果,但没有将其转化为最佳实践。提示不应重复系统已经可靠控制的信息。
04
构建单屏约束
手机屏幕迫使多个决策集中到同一个框架中。观看者可能需要在几秒钟内识别产品、阅读声明、跟随动作并理解下一步动作。单屏约束指定了当这些元素竞争时什么会获胜。
| 优先级 | 合同问题 | 示例答案 |
|---|---|---|
| 1. 产品标识 | 什么必须保持可识别性? | 提供的产品包装照片和准确的徽标 |
| 2. 留言 | 一字面的说法是什么? | `Three sizes available` |
| 3. 证据 | 什么视觉效果支持这一说法? | 三个已批准的产品变体并排 |
| 4. 安全放置 | 文字可以出现在哪里而不遮盖证据? | 上三分之一,最多两行 |
| 5. 运动 | 拍摄过程中有什么变化? | 产品一次进入一个,然后保留 |
| 6. 行动 | 观众接下来应该做什么? | `Compare sizes` |
如果第二个主张需要第二个证据,那么它可能需要第二个场景。缩小字体并不会引起更多关注。
05
如何写立式AI视频提示
从第一个可见帧开始
第一帧应该揭示问题、产品或使下一秒值得观看的令人惊讶的状态。当视频是产品说明时,避免抽象设置。
第一帧:提供的红色瓶子占据下部中心。精确覆盖在上三分之一处:`Refill, do not replace.` 保持品牌标记畅通无阻。
该方向回答了构图、产品保真度和文本层次结构,而不要求通用的 `strong hook`。
使用一个可见的动作
短垂直生成受益于每个场景的一个主要运动。命名开始状态、操作和结束状态。
首先将所有三种批准的包装尺寸对齐。向前移动最小的尺寸,同时其他两个保持固定。在干净的比较框架上结束一秒钟。
该指令是可测试的。 `Create dynamic motion` 不是。
当视频承载商业内容时锁定事实
13 竖屏 Prompt均未与我们的固定事实字典明确匹配。这对于大气的社交剪辑来说可能是无害的。对于广告、产品说明或多 SKU 视频来说,这是一个严重的差距。
创建产品名称、价格、尺寸、日期、促销条款、规格和法律措辞的文字文本块。将每条线附加到正确的资产。不要让视觉模型推断哪个数字属于哪个变体。
添加风格之前保留安全区域
安全区域因位置和界面而异,因此在导出之前请验证当前平台模板。在制作简介中,按功能保留区域,而不是硬编码通用像素值:
- 产品证据区
- 主要覆盖区域
- 字幕区
- 平台接口间隙
- CTA 保持架
如果同一资产将在多个展示位置运行,请创建特定于展示位置的裁剪并检查每一个。一种作物并不一定在所有地方都是安全的。
使最终框架可检查
两份 13 制作 Brief明确命名为 CTA。竖屏视频并不总是需要商业动作,但最终帧应该保持足够长的时间,以便观众了解结果。对于产品视频,请指定确切的 CTA、目标上下文和保持可见的产品状态。
06
可复制竖屏 AI视频提示
使用配置的 9:16 输出设置创建一个竖屏视频场景。
受众和工作:
[一位受众]应该了解[一项产品事实或行动]。
事实来源:
- 使用[批准的产品图片/视频],无需重新绘制产品或徽标
- 保持此文本的字面意思:[名称、编号、价格、尺寸、型号、日期或批准的短语]
- 此声明得到[批准来源]的支持
一屏合约:
- 第一帧:[产品/问题/证明和精确组成]
- 主要消息:[一行文字,最多两行]
- 证据:[证明或展示信息的视觉效果]
- 安全放置:【叠加区、字幕区、界面间隙】
- 动作:从[状态]开始,执行[一个动作],在[状态]结束
- 最终动作:[一个CTA或完成状态]
创作方向:
- [视觉风格、灯光、摄像机、节奏、音频]
- 生成的内容只能用于[背景或过渡]
- 不得发明产品变体、屏幕、声明、价格、标签或结果
评论:
- 产品标识完整无遮挡
- 文字准确并与正确的产品配对
- 关键信息可在手机大小的预览中读取
- 导出前可以检查最终帧第一句是指有意配置的设置。如果您的工具没有比例控制,请将输出要求添加到提示中并验证渲染的尺寸。
07
案例:通过一个视觉系统讲述一个垂直过程
公共 像素艺术指南:从花蜜到蜂蜜 案例是 9:16 输出,具有紧凑的提示和一致的像素艺术系统。它说明了为什么当一种变换和一种视觉语言承载场景时,竖屏 Brief可以变得简洁。

该案例是紧凑的视觉叙事的一个例子。它不验证产品、科学或转换声明。
08
纵向和横向比较是什么意思
同一个语料库中最大的差距并不是比率字段。是生产范围。垂直制作 Brief的字符中位数为 384,而水平制作 Brief的字符中位数为 3,557。显式源素材出现在竖屏 Prompt的 15.4% 和横屏 Prompt的 60.8% 中。固定事实分别出现在 0% 和 45.1% 中。场景结构出现在38.5%和76.5%中。
不要将这些观察结果变成竖屏视频应该模糊的规则。使用它们作为路由决策:
- 对于没有产品事实的视觉创意,请保持提示紧凑。
- 对于产品说明,即使视频很短,也请附上真实资产和文字事实。
- 对于多个索赔或 SKU,请使用多个可检查的场景,而不是一个拥挤的屏幕。
- 将可靠的导出设置保留在创意散文之外。
对于渠道规划,请使用社交媒体视频指南。如果垂直资产是付费 TikTok 广告素材,AI TikTok 广告工作流程 解释了如何在变体中保持产品证据不变。
09
常见问题
我应该总是在提示中写 9:16 吗?
当工具没有单独的纵横比控制或提示是唯一规范时编写它。如果结构化设置控制输出,请使用该设置并验证渲染的尺寸。我们的语料库中只有一个 13 竖屏 Brief在提示文本中写下了该比例,而结构化元数据将所有 13 标识为垂直。
竖屏 AI视频提示应该多长?
该数据集中没有质量目标。所选案例中的中位数为 384 字符。添加来源、字面事实、布局、动作,并审查商业工作所需的细节,然后停止。
为什么要使用单屏约束?
它迫使团队在装饰风格之前优先考虑产品标识、信息、证据、文本放置、运动和动作。这样可以减少拥挤,并可以在观看视频的设备上进行查看。
我可以引用这个基准吗?
是的。引用为:TapVid Prompt Lab,对 64 记录策划的 Good Case 语料库中的 13 竖屏 Brief进行分析,冻结于 2026 年 9 月 1 日。说明该研究测量明确的提示文本并使用结构化输出元数据来识别9:16 记录。




