我为自己的YouTube频道和TikTok做了300多条视频,而转向AI辅助制作彻底改变了我的产出速度。不是因为AI替代了创意工作——它没有——而是因为它消除了拖慢我进度的瓶颈。下面就是我实际使用的完整流程,一步一步来。
01
第 1 步:使用任何工具前先写脚本
我知道这听起来是废话,但我见过太多创作者先用AI工具跑出来的素材来搭视频,再围着这些素材写脚本。这样每次都会做出很弱的内容。脚本是脊梁,其他一切都挂在它上面。
做YouTube视频时,在生成任何一张图或一个视频片段之前,我会写一份完整的脚本——不是要点提纲,而是真正的脚本。做TikTok时,我至少会写出清晰的三段式结构:钩子、核心洞见、行动号召。这个结构会准确告诉我需要哪些画面、以什么顺序排列。
一条10分钟的YouTube视频通常有8到12个独立的画面段落。我会在打开任何AI工具之前,就在脚本里把它们全部标出来。这样能避免那个陷阱:生成了一堆漂亮的片段,却和你最后写出来的叙事对不上。
02
第 2 步:生成基础视觉素材
脚本梳理好后,我会根据内容类型进入Runway或Pika。对于带b-roll的口播类内容,Runway的图生视频功能是我的主力工具——我把自己拍的静态图片喂进去,让它生成动态。这样视觉风格就能和我的品牌保持一致。
对于视频里的动画讲解段落,我会用Midjourney生成基础图形、再用Runway把它们动起来的组合。工作流程是:脚本段落 → 用Midjourney提示词生成关键帧 → 用Runway加入动态。一旦熟悉了工具,这每一步大概只要五分钟。
- 让AI工具匹配你的内容类型——别所有东西都用同一个工具
- 每个关键画面生成3到5个版本,从中挑最好的
- 记录提示词——一个项目里好用的提示词能迁移到其他项目
- 按脚本顺序生成画面——这样更容易保持一致性
- 预算是您需要的1.5倍的剪辑——有些剪辑无法成功
03
第 3 步:编辑时考虑 AI 生成内容的特点
AI生成的视频有一些特定的剪辑考量。这些片段往往没有实拍素材那样自然的进出点。我几乎每个AI片段都晚几帧开始、早几帧切掉——这样能藏住大多数生成工具都会产生的、略显不自然的开头和结尾状态。
对AI内容来说,转场处理更为重要。AI生成片段之间的硬切可能显得突兀,因为即便提示词一致,视觉风格也可能有轻微变化。我会用非常快的叠化,或者用过渡镜头——一个特写、一个纹理镜头、一张标题卡——来处理这些转场。
04
第 4 步:用声音设计把所有内容连起来
AI视频本身没有声音。这话听起来是废话,但创作者往往低估了声音设计对于AI视频显得精致还是显得假的影响有多大。音乐、环境音和音效都在让AI画面显得扎实、真实这件事上承担着重活。
做YouTube时,我会把Epidemic Sound的授权音乐和我用Suno生成的自定义环境音底层结合起来用。做TikTok时,在相关的情况下我会把音乐往当下的热门声音上靠,并战略性地使用静音来做强调——静音在TikTok上能穿透人心,这是它在YouTube上做不到的。
05
第 5 步:审核、调整并持续发布
大多数教程跳过的最后一步:建立一个一致的审查流程。在发布之前,我以1.5倍的速度观看每个视频,特别是寻找AI剪辑中的时间伪影,任何拖动的节奏部分,以及缩略图时刻是否强大。如果我发现一个带有人工制品的AI剪辑,我会重新生成它——我从不发布我知道有明显AI错误的剪辑。
对任何单条视频来说,稳定比完美更重要。我按计划发布,而这个计划雷打不动。工具让我得以维持一个没有帮助就绝无可能的发布频率,而这种稳定性会随时间复利累积,其效果是偶尔几条完美视频所无法企及的。




