本文由 莫潇羽@源码七号站(www.fuyuan7.com)撰写,转载请注明出处。
快速摘要
一句话给到位:一部能发布的 AI 短剧,本质是把"剧本 → 分镜脚本 → 静态画面 → 动态视频 → 配音对口型 → 后期剪辑"这六道工序拆开,每一道都交给最合适的 AI 工具去做,最后在剪辑软件里拼起来。 整个链条里最值钱的不是某个工具,而是提示词的结构化能力——你能不能把脑子里那个画面,翻译成机器听得懂的"景别 + 视角 + 人物动作 + 环境 + 风格 + 光影 + 画质"。剧本和分镜脚本可以用豆包、DeepSeek 这类国内免费大模型生成;生图主流选即梦、通义万相、海螺、可灵;图生视频同样是这几家加首尾帧/多帧控制;配音用剪映朗读或在线音色克隆,要对口型就上数字人;最后回到剪映做初剪、精剪、加音乐音效导出。
我自己从一窍不通到能独立出片,前后折腾了不少回,踩过的最大的坑就是一上来死磕"一次生成完美画面",结果全是废卡。后面想明白了:AI 出片是个"先拿到能用的、再反复修"的过程,抽卡心态比完美主义重要得多。
这篇我把全流程一道工序一道工序讲透,每个环节该用什么工具、提示词怎么写、参数怎么选、卡住了怎么救,都写成了能照着做的步骤。想看完整拆解,往下翻。
一、先把全局搞清楚:AI 短剧到底是怎么"攒"出来的
很多人第一次接触 AI 短剧,脑子里是懵的:明明刷到的成片有人物、有剧情、有运镜、有配音,看起来跟正经影视没差多少,怎么可能一个人在电脑前就搞出来?我刚开始也是这个反应。后来真正上手才发现,所谓"AI 做短剧"并不是某个神仙软件一键生成,而是一条分工明确的流水线——你要做的,是当这条流水线的总调度。
1.1 整条生产管线长什么样
我习惯把它画成一条线来理解,先有个全局观,后面每一节就知道自己站在哪了:
flowchart LR
A[剧本/故事] --> B[分镜脚本]
B --> C[文生图提示词]
C --> D[静态分镜画面]
D --> E[图生视频提示词]
E --> F[动态视频片段]
F --> G[配音 + 对口型]
G --> H[后期剪辑成片]
style A fill:#f9e0c3
style H fill:#c3e8f9
这条线最关键的认知是:它是串行的,但每一节又是可以独立打磨的。 前一道工序的产物,是后一道工序的"原料"。剧本不行,分镜就乱;分镜画面没定好,生出来的视频就跳戏;视频节奏拖沓,后期再怎么剪也救不回来。所以新手最容易犯的错,是把注意力全压在某一个环节(比如死磕生图),而忽略了上下游的衔接。我后来的做法是:每完成一道工序,先确认它"能用"再往下走,不追求单点完美,追求整条链路顺。
1.2 这套玩法到底解决了什么问题
传统影视短剧,光是分镜、置景、拍摄、灯光就得一个团队忙活好多天。AI 这套流程把它压缩到了什么程度呢?我自己实测,一个五秒左右的镜头,从想画面到出成片,熟练之后大概十几分钟;一条一两分钟的完整小片段,一个人一两天能磕出来。行业里也有类似反馈,有的工具把传统需要半个月的周期压到一两天,对个人创作者来说,门槛确实是被砸下来了。
但我必须先泼盆冷水:门槛低 ≠ 容易出好东西。 AI 把"执行"的成本降下来了,可"判断力"这块它替不了你——哪个画面好看、哪段节奏对、哪句台词出戏,全靠你这个人的审美和经验。所以这篇文章我会反复强调原理和判断,而不是只教你点哪个按钮。把原理吃透了,工具换一茬你照样玩得转,这也是我莫潇羽一直坚持的学习思路:先懂"为什么",再练"怎么做"。
1.3 开工前先备齐什么
正式动手之前,我建议你先把这几样准备好,省得做到一半到处找:
- 一个能写剧本的大模型:豆包、DeepSeek 任选,都是国内可以直接用的免费工具,写中文剧本足够了。
- 一个生图平台:即梦、通义万相、海螺、可灵,先注册一个练手,后面会详细对比。
- 一个图生视频的入口:上面这几家基本都能生视频,新手我推荐先用即梦,性价比高、上手快。
- 一个剪辑软件:剪映就行,配音、字幕、音乐、音效它都能一站搞定。
- 一个装素材的文件夹:相信我,你会生出一大堆图和视频,没个清晰的命名和归档,后期能把自己绕晕。
1.4 开拍之前先想清楚:做什么题材、什么节奏
工具备齐之后,先别急着冲。我自己吃过的一个亏是:上来就生图,做到一半才发现题材压根撑不起来,前面全白干。所以这里插一段"动手前的想清楚"。
题材上,新手优先挑"画面驱动"而不是"对话驱动"的故事。 原因很现实——AI 现阶段最擅长的是出画面、出氛围,对长段对话、复杂表演还比较吃力。所以像古风、仙侠、悬疑这种靠场景和氛围推进的题材,比一屋子人坐着聊天的都市对话剧好做太多。我第一部能看的片子就是仙侠开场,靠云海、山门这种宏大画面撑起来的,对表演要求低,容错率高。
节奏上,记住短剧是"快"字当头。 竖屏短剧的观众耐心是以秒计的,开头三秒抓不住人就划走了。所以我规划分镜时,会刻意把最有冲击力的画面往前放,而不是慢慢铺垫。一条一两分钟的片子,分镜数量我一般控制在十几到二十几个,每个镜头一件事、彼此能接上,节奏才不会拖。
还有一点是预期管理。 别拿院线电影的标准要求第一部作品。AI 短剧现在的状态是"能用、在快速变好,但还没到无敌",接受它的局限、在局限里把能做好的做到位,比一味追求完美更能让你坚持下去。把心态放平,这条路才走得长。
工具齐了、题材也想清楚了,咱们就从第一道工序——剧本和脚本——开始拆。
二、第一步:剧本与脚本,用 AI 搭出故事的骨架
整条流水线的源头是文字。文字这关没过好,后面画面再精美也是空中楼阁。这一节我拆成三块:怎么选大模型、怎么让它写剧本、怎么把剧本变成能直接用来生图的分镜脚本。
2.1 大模型怎么选:先把"免费且好用"的拿到手
写剧本、写脚本,本质是让大语言模型帮你做文字创作。我自己常用的就两类:
|
模型 |
归属 |
是否免费 |
我的使用场景 |
|
豆包 |
国内 |
免费可用 |
写剧情、出分镜表、反推提示词,综合够用 |
|
DeepSeek |
国内 |
免费可用 |
逻辑性强,写有冲突的剧情、长对白不错 |
|
海外模型 |
国外 |
部分收费 |
偶尔对比文笔,但日常用国内的完全够 |
我的建议很直接:新手就用国内的豆包或 DeepSeek,免费、中文理解好、注册即用。 海外那些模型当然也有人吹,但对咱们做中文短剧来说,多一道折腾不如把时间花在打磨内容上。术语先解释一下——这里说的"大模型",你就理解成一个特别能写、特别能聊的 AI 助手,你给它角色和要求,它就按你说的产出文字。
2.2 让 AI 写剧本:给角色、提要求、定主题
让大模型写出能用的剧本,核心就一句话:把它当成一个真人编剧来"使唤"。 我一般是这么发指令的,分三层:
第一层,给它一个身份(角色设定)。 比如开头就告诉它"你是一名资深影视编剧,精通故事结构、镜头语言和剧情节奏"。别小看这一句,给了身份之后,它的输出会明显往专业方向靠。
第二层,提你的具体要求。 比如我会说"请以常见的剧本格式呈现,包含场景、镜头和台词"。如果你脑子里还没成型的故事,完全可以先让它给个"故事梗概",看顺眼了再让它展开成完整剧本。这一步不用一次到位,跟它对话、来回改就行。
第三层,定主题或者干脆让它发挥。 有想法就告诉它主题(比如"古风、复仇、反转");实在没思路,直接甩一句"帮我创作一个有爆点的剧情",它也能给你整出来。
实操起来大概是这个样子——我打开 DeepSeek,发一段把上面三层揉在一起的话,点发送,它就会吐出一段带开场镜头、场景描述的剧情。我会先通读一遍:这个故事是不是我想要的?不是就让它重写,或者退一步先要个梗概再细化。记住,这一步你是在跟它"聊",不是一锤子买卖。
下面这个指令模板是我自己用顺手的,你可以直接复制改改用:
你是一名资深影视编剧,精通故事结构、镜头语言和短剧节奏。
请帮我创作一个【古风复仇 / 都市反转 / 仙侠虐恋(任选其一)】题材的短剧剧情,要求:
1. 开场三秒要有强钩子,直接抛冲突,不要慢慢铺垫;
2. 总时长控制在 1—2 分钟,分镜在 15—25 个之间;
3. 用剧本格式呈现:场景、镜头、人物动作、台词分开写