AI教程网

每天一篇AI教程

用AI自动生成短视频脚本的完整流程

2026-09-25

用AI自动生成短视频脚本的完整流程

做短视频最痛苦的不是剪辑,是面对空白文档的那一刻。我上个月帮一个做美食账号的朋友代运营,前三天憋出两个脚本,效率低得自己想撞墙。后来我把AI拉进工作流,现在从选题到分镜脚本,整个流程压缩到40分钟左右。下面就是我现在实际在用的完整方法,不是理论,是踩过坑之后跑通的流程。

第一步:让AI帮你找选题,而不是自己想

第一步:让AI帮你找选题,而不是自己想

很多人用AI写脚本,上来就说"帮我写一个美食视频脚本",出来的东西空洞得像说明书。问题出在选题阶段就偷懒了。

我现在的做法是:先给AI喂真实的参考信息,再让它做选题分析。具体操作是把最近一周同赛道播放量高的5-10条视频标题整理出来,丢给ChatGPT或Claude,加上一句提示词:

以下是最近一周美食赛道播放量较高的视频标题,请分析它们的共同选题规律,并给我10个类似方向但角度不同的选题,要求每个选题能用一句话说清核心看点。

这样出来的选题,比我拍脑袋想的强太多。因为AI是在已有数据上做归纳和迁移,不是凭空编。

拿美食赛道举例,我最近跑出来的一组选题是这样的:

选题方向 核心看点 预估时长
10元 vs 100元炒饭对比 价格反差+口感实测 60秒
凌晨4点菜市场跟拍 场景稀缺+人物故事 90秒
一道菜翻车3次实录 真实失败+情绪共鸣 45秒
外卖 vs 自己做成本拆解 数据对比+实用价值 60秒

这张表本身就是AI生成的,我只做了一轮筛选。选题定得准,后面脚本才不会白写。

第二步:用结构化提示词生成脚本初稿

选题定了之后,别直接让AI"写脚本"。我试过,出来的东西要么太书面,要么节奏不对。

有效的做法是给它一个脚本模板框架,让它往里填。我常用的提示词结构是这样的:

你是一个短视频编剧。请为选题"XXX"写一条60秒短视频脚本。 要求: - 前3秒必须有钩子(冲突/悬念/反常识) - 每15秒设置一个情绪或信息转折点 - 语言口语化,像跟朋友聊天 - 输出格式:时间段 | 画面描述 | 口播文案 | 备注

这个格式的关键在于把画面和文案分开。很多AI生成的脚本把两者混在一起,后期根本没法用。

实际跑出来的效果大概是这样的:

0-3秒 | 特写:锅里焦黑的炒饭 | "这是我第三次炒饭翻车,但这次我找到了原因" | 钩子:失败+悬念

3-15秒 | 中景:厨房全景,人物出镜 | "先说结论:炒饭粘锅不是火候问题,是米饭的问题" | 信息密度高,直接给价值

15-30秒 | 分镜:三种米饭对比 | "隔夜饭、新煮饭、冷冻饭,我各炒了一锅" | 视觉对比强

这样出来的初稿,大概有70%可以直接用,剩下30%自己改改口播的语感就行。

第三步:分镜脚本的AI细化

第三步:分镜脚本的AI细化

脚本初稿有了,但离能拍还差一步——分镜。这一步很多人忽略,结果拍摄现场手忙脚乱。

我的做法是把上一步的脚本再丢回AI,追加一个指令:

请把以上脚本拆解为分镜表,每个镜头标注:镜号、景别(远/中/近/特)、拍摄角度、时长、所需道具、备注。

这一步AI做得比我好,因为它不会漏掉道具。上次拍炒饭视频,AI提醒我需要准备"厨房秤"和"三种不同米饭的标记碗",我自己想的话肯定会忘。

分镜表出来之后,我一般会做一件事:把分镜表打印出来,用红笔划掉那些"拍起来太麻烦但效果一般"的镜头。AI不懂你的拍摄条件,它会给一些理想化建议,比如"航拍厨房全景"——我家厨房三平米,航拍个啥。

几个实际踩过的坑

坑一:AI写的口播太"顺"了。 它喜欢用完整的书面句子,但短视频口播需要短句、停顿、甚至一点语病。我的解决办法是最后一遍自己读出来,读着别扭的地方就改掉。

坑二:不要一次性让AI写完所有东西。 选题、脚本、分镜分三步走,每步确认后再进行下一步。一次性生成的结果往往哪哪都差点意思。

坑三:AI不知道你的账号调性。 我一开始没给参考,AI写的脚本像电视购物。后来我每次都会附上自己账号最近3条视频的文案,让它模仿语气,效果好很多。

我现在的完整工作流

把上面几步串起来,实际的时间分配是这样的:

总共40分钟左右出一条60秒视频的完整拍摄脚本。以前我自己憋,一条至少两小时,还经常写到一半推翻重来。

这套流程跑通之后,我最大的感受是:AI不是替你创作,是替你完成那些"必须做但不需要灵感"的部分。选题分析、格式整理、分镜拆解,这些事它做得又快又稳。但钩子怎么设、情绪怎么给、哪句话该留白,还是得你自己判断。

工具就那几个,ChatGPT、Claude、Kimi都行,关键是提示词里要带上你自己的真实信息和约束条件。你给它的上下文越具体,它吐出来的东西越能直接用。