教程视频提示的作用与普通视频提示不同。当电影剪辑能够传达一种动作或情绪时,它就能成功。仅当查看者可以识别操作、查看结果状态并在预期状态未出现时恢复时,教程才会成功。
我们分析了 TapVid 策划的 Good Case 库中的 16 教程Brief。Prompt 中位数仅包含 242 字符,远短于同一语料库中的解释器和长格式切片。视觉方向出现在简报的62.5%中,场景结构出现在56.3%中。源素材出现在25%中,固定事实出现在25%中,显式交互指令出现在25%中。
这一发现并不意味着简短的提示是不好的。它表明许多教程提示的行为类似于主题请求而不是教学规范。对于客户教育、入职或功能培训,缺少的单元通常不是另一种风格的形容词。这是行动-观察-恢复循环。
01
我们如何分析教程视频提示
TapVid 的 Good Case 库于 2026 年 9 月 1 日被冻结。我们通过要求完整提示、公共共享 URL、生成 URL 和 MP4 附件创建了严格的 64 记录语料库。本文涵盖标记为教程的 16 记录。标签是多标签的,因此切片可以与解释者、社交视频和较长的作品重叠。
我们使用确定性关键字字典对提示文本中的十个字段进行编码:受众、持续时间、源素材、场景结构、固定事实、视觉系统、音频、CTA、宽高比以及场景或屏幕元素之间的交互。
这是明确性分析,而不是输出质量得分。创建者可以在界面中选择宽高比,在单独的字段中上传屏幕截图,或者在提示之外讨论观众。策划的样本也无法告诉我们所有教程一代成功的百分比。它展示了选定的简报如何表达制作决策。
我们仅报告总量。文章后面的案例已经公开,不再转载私人用户提示。
02
教程视频提示基准测试结果
| 显式字段 | 16 份 Brief 中占比 | 计数 |
|---|---|---|
| 视觉系统 | 62.5% | 10 |
| 场景结构 | 56.3% | 9 |
| 持续时间 | 43.8% | 7 |
| 音频 | 43.8% | 7 |
| CTA | 31.3% | 5 |
| 源素材 | 25.0% | 4 |
| 固定事实 | 25.0% | 4 |
| 互动 | 25.0% | 4 |
| 观众 | 18.8% | 3 |
| 纵横比 | 12.5% | 2 |
242字符的中位数是语料库描述,而不是推荐。一些简报可能很短,因为主题很熟悉,或者因为结构化的设置存在于其他地方。当希望通过简短的提示来教授真实的产品工作流程时,就会出现风险。像 `make a tutorial about exporting reports` 这样的主题留下了未解答的问题:
- 当前的产品版本和屏幕状态是什么?
- 谁在出口?为什么?
- 观众应该采取什么具体行动?
- 点击后应该出现什么?
- 如果该选项被禁用或丢失会发生什么?
- 哪些标签、值或警告必须保持字面意思?
如果没有这些答案,生成的教程可能看起来很有指导意义,但教授的路径并不存在。
03
教程提示需要一个动作-观察-恢复单元
公共提示指南通常会教授主题、动作、背景、相机、灯光和风格。该结构对于单个生成的镜头有效。这对于软件入门或产品教育来说是不够的,因为查看者需要状态更改。
将这个由三部分组成的单元用于每个教学步骤:
- 操作: 用户使用精确的可见控件执行的操作。
- 观察:屏幕上发生了什么变化以及用户如何知道该步骤有效。
- 恢复:当没有出现预期状态时要检查什么。
对于虚构的报告工具:
| 单位 | 教程指导 |
|---|---|
| 行动 | 打开报告,选择 `Export`,然后选择 `CSV`。 |
| 观察 | 下载开始,报告名称出现在文件名中。 |
| 恢复 | 如果 `Export` 不可用,请验证查看者是否具有导出权限以及报告是否已完成加载。 |
这种结构将视频从叙述的点击路径更改为可用的指令。恢复不需要很长的故障排除部分。一个诚实的分支通常足以防止观众假设他们犯了错误。
04
将演示证据与生成的装饰分开
16 教程Brief中只有四个明确指定了源素材。这个数字值得仔细解释,因为上传可能会在提示之外到达。尽管如此,教程制作简介应该清楚地区分证据通道和装饰通道。
演示证据包括当前的屏幕录制、屏幕截图、物理产品镜头、图表、标签、按钮、设置、错误状态和批准的文档。这些资产教导工作流程,不应将其重新绘制为合理的替代品。
生成的装饰可以包括中性开口、抽象过渡、连接运动图形、背景纹理或非产品隐喻。这些视觉效果可以使课程更容易理解,但它们不应该假装是界面或产品状态。
对于资产主导的教程,为每个脚本步骤分配一个演示源:
| 步骤 | 脚本行 | 证据资产 | 允许编辑 | 通过条件 |
|---|---|---|---|---|
| 1 | `Open Settings` | `settings-entry.mp4` | 裁剪和光标突出显示 | 当前标签可读 |
| 2 | `Choose Team Access` | `team-access-panel.png` | 缩放和注释 | 出现正确的面板和权限 |
| 3 | `Invite a teammate` | `invite-flow.mp4` | 修剪死区时间 | 电子邮件字段和确认状态匹配 |
| 恢复 | `If Invite is disabled...` | `permission-warning.png` | 突出显示警告 | 确切的警告和所需的角色是可见的 |
源表还使得更新成本更低。当产品 UI 发生变化时,团队可以识别受影响的步骤,而无需审查每条抽象指令。
05
如何编写教程视频提示
定义查看器的起始状态
观众标签是不够的。 `New users` 可能意味着已创建帐户的人、已导入数据的人或从未打开过产品的人。说明先决条件和期望的最终状态。
查看者从一个已批准的帐户、一份现有报告和导出权限开始。最后,查看者已将当前筛选的视图下载为 CSV 格式,并且可以识别该文件。
示例中只有三个提示明确指定了受众。明确起始状态可以防止跳过先决条件和无法解释的屏幕。
将任务分解为可验证的步骤
场景的变化应该对应于教学的变化。每个步骤使用一个主要操作。如果一个步骤包含五次单击,请将其拆分,除非所有五次单击都发生在一个稳定的屏幕状态下。
每个场景记录可以包含:
- 步骤编号和目的
- 准确的叙述
- 所需的源素材
- 屏幕上的动作
- 预期观察
- 一种恢复路径
- 文本必须保持字面意思
- 大概时间
结果类似于一个轻量级测试用例。那是故意的。当观看者可以重现某个状态时,而不是每次过渡都感觉不同时,教程就成功了。
保护标签和值不被重写
固定事实明确出现在四个 16 教程简介中。对于产品教育来说,界面标签和价值观就是事实。当大小写、标点符号、数字、单位、计划名称、模型名称和警告文本影响任务时,将其锁定。
请勿要求型号为 `clean up` 认可的 UI 副本。旁白中更优雅的标签可以将观看者引向不存在的控件。
使用音频来减少而不是重复认知负荷
音频出现在七个简报中。当屏幕显示动作时,旁白应该解释目的和结果。当观看者已经可以看到每个可见标签时,避免大声朗读它。
一个有用的模式是:
- 旁白:为什么这一步很重要。
- 屏幕上的操作:单击或执行什么操作。
- 标题:精确的控件或值。
- 暂停:有足够的时间观察变化的状态。
以完成状态结束
五份简报包括 CTA。对于教程,最佳关闭操作通常会继续学习的工作流程:`Export your own report`、`Invite one teammate` 或 `Try the recovery check with a test account`。通用的 `learn more` 关闭会浪费观看者刚刚达到的状态。
06
可复制的教程视频提示模板
为[观看者和开始状态]创建一个[持续时间]的教程视频。
学习成果:
最后,查看者可以[可观察的任务]并验证[已完成的状态]。
使用这些提供的来源作为产品真相:
- [屏幕录制或图像] 步骤 1
- [屏幕录制或图像] 步骤 2
- [文件或批准的措辞]用于恢复条件
保留这些标签和值的字面意思:
- [按钮、菜单、字段、编号、计划、型号、警告]
教学场景:
1. 操作:[一个用户操作]
观察:【可见成功状态】
恢复:【一检查是否出现该状态】
来源:[资产名称]
2. 操作:[一个用户操作]
观察:【可见成功状态】
恢复:[一项检查]
来源:[资产名称]
3. 完成状态:[观看者现在应该看到或拥有的内容]
视觉和听觉规则:
- 保持提供的产品屏幕完好无损;仅裁剪、缩放和注释
- 仅将生成的视觉效果用于[开场、过渡或上下文]
- 叙述解释目的;标题保留精确的控件和值
- 不要发明屏幕、步骤、标签、权限或结果
发货前审核:
- 每个操作都存在于提供的产品证据中
- 每个观察都遵循显示的动作
- 当前文档支持恢复建议
- 观看者可以识别完成的状态如果产品单独控制运行时间、宽高比或语音,请将这些选择存储在其结构化字段中。该模板侧重于课程的真相和顺序。
07
案例:按可见阶段组织的流程教程
公开的TapVid案例像素艺术指南:从花蜜到蜂蜜使用清晰的阶段进行过程解释。它在这里很有用,因为观看者可以通过可见的步骤来跟踪转换,而不是听到主题的一般描述。

该案例说明了阶段结构。并不能证明所描述的过程是完整的科学或操作教程。领域指导仍然需要权威来源。
08
教程质量检查只需五分钟
交付前,将视频静音并询问操作和结果状态是否仍然可见。然后隐藏视觉效果并只阅读旁白。叙述应该解释目的,而不是发明步骤。最后,根据最新的产品证据审查行动-观察-恢复表。
当满足以下任一条件时拒绝场景:
- 光标单击不可读或不存在的控件。
- 旁白命名了屏幕未显示的状态。
- 生成的模型将取代当前的产品屏幕。
- 警告、编号、许可或标签已被重写。
- 教程在观看者验证完成之前就结束了。
09
常见问题
教程视频提示应该多详细?
足够详细,可以识别查看者的起始状态、每个操作、预期观察、一个恢复路径、正确的源素材和文字标签。基准测试的中位数是 242 字符,但语料库无法确定短提示更好。
教程应该使用生成的 UI 吗?
当视频声称教授真实的产品工作流程时,情况并非如此。使用当前的屏幕截图或录音作为产品证据。如果生成的视觉效果不作为界面呈现,则它们可以支持上下文和转换。
教程和解释器有什么区别?
解释者帮助观众理解概念、产品或机制。教程可帮助观看者执行和验证任务。格式可以重叠,但教程需要可操作的状态更改和恢复指导。
我可以引用这个基准吗?
是的。引用为:TapVid Prompt Lab,对来自 64 记录策划的 Good Case 语料库的 16 教程Brief的分析,于 2026 年 9 月 1 日冻结。声明它测量选定输出中的显式提示字段,并且不估计总体成功。




