本指南从 Prompt 工程视角回答 AI 视频脚本怎么写这件事。文字脚本只是 AI 创作脚本的第一段,真正的全链路是:5 要素结构 Prompt → 加入镜头与运镜术语 → 输出含分镜的脚本 → 衔接到 AI 视频生成(文生视频 / 图生视频)。每一步都给到具体公式和真实技能调用案例。
写不好 AI 视频脚本,不是 AI 不行,是你给 AI 的指令缺东西。
你说"写一个海边的视频脚本",AI 不知道是远景全景还是人物特写,输出全是文学化描述:温柔的海风、柔和的光线……一句都拍不出来。必须给 AI 镜头语言。
很多人让 AI 写完脚本,就直接拿去拍。其实脚本是口播逻辑,分镜是镜头清单,两层信息不能合并。AI 要分两轮做:先输出脚本,再让 AI 把脚本拆成分镜。
如果你想用文生视频 / 图生视频做素材,AI 视频脚本的每段画面描述要按视频生成模型的口味写——景别词、运镜词、光线词缺一不可。否则模型给你的素材完全不像你想要的。
把这 5 个要素填齐,再丢给 AI——产出立刻不一样。
5 要素一行一个,写完贴到 AI 工具就能跑。下面是好坏 Prompt 对照:
| 要素 | 反面(AI 容易跑偏) | 正面(AI 准确产出) |
|---|---|---|
| 主题 | 理财 | 三十岁前应该攒下多少钱才不焦虑 |
| 平台 | (缺) | 视频号 |
| 时长 | 短一点 | 90 秒 |
| 受众 | 年轻人 | 28-35 岁一线城市白领,月收入 1.5-3 万 |
| 情绪 | (缺) | 温暖 + 干货,不能说教 |
第 1 步出来的"画面建议"通常很模糊,第 2 步要让 AI 把画面建议升级成具体分镜。在 Prompt 里追加一句:
把"景别"和"运镜"限定为有限词表,AI 就不会再写"温柔的镜头""柔和的运镜"这种没法拍的描述。
同样的 Prompt 喂不同大模型,输出风格差异很明显。EasyClaw 的「短视频脚本创作」技能内置了多模型调度,可以一次输入对比多个版本。下面是常见的偏向:
| 模型偏向 | 擅长场景 | 适合内容类型 |
|---|---|---|
| Kimi 系 | 长上下文、信息密度高 | 知识干货、深度评测、行业分析 |
| DeepSeek 系 | 逻辑严谨、推理强 | 科普、技术教程、避坑指南 |
| 豆包系(Doubao) | 本土化语感好、口语化 | 剧情、情感、生活向 |
| Qwen 系 | 结构化输出稳 | 带货、测评、固定模板内容 |
| GLM 系 | 创意度高 | 品牌故事、个人 IP、文案派 |
如果你打算用 AI 生成视频素材(替代部分实拍),AI 视频脚本的每段画面描述要写成视频生成模型能懂的英文 Prompt。结构如下:
EasyClaw 内置「视频生成(video-gen)」技能调用火山引擎 Seedance 模型,支持文生视频和图生视频。你把上面的 Prompt 喂进去,它会按景别 / 运镜 / 光线一一执行,得到的素材一致性远高于直接说"一段海边的视频"。
同一份 AI 视频脚本要发抖音 / 快手 / 视频号 / 小红书 / B 站,至少要做 2 件事:
① 口播节奏微调——抖音前 3 秒抓住,快手缓 2 秒,视频号更生活化;
② 标题各平台一版——同一主题用各平台的爆款公式重写。
EasyClaw 的「自媒体爆款标题生成器」技能就是为这个场景设计:输入 1 个主题,一次输出小红书/抖音/快手/知乎/B站/微博等多平台标题,每个平台按本平台的爆款规律和字数上限自动调整。
把这些术语写进 Prompt,AI 才知道你想要什么。中英双语对照方便文生视频时直接用英文版。
「短视频脚本创作」负责文字脚本与分镜,「视频生成」负责 AI 视频素材,「自媒体爆款标题生成器」负责多平台标题分发——三个技能在同一个客户端按顺序调用,从 Prompt 到可发布素材一站式完成。基础版永久免费,先把工作流跑通。
免费下载体验 →