AI短剧制作完整指南:从零开始打造高质量短视频
本教程由源码七号站整理,全面解析AI短剧的制作流程与技术要点
目录
- 项目原理与工作流程
- 第一步:剧本创作
- 第二步:脚本分镜设计
- 第三步:角色形象设计
- 第四步:场景与画面生成
- 第五步:角色配音制作
- 第六步:图片转视频
- 第七步:对口型处理
- 第八步:后期剪辑
- 进阶技巧:本地部署工具
项目原理与工作流程
AI短剧制作是将传统影视制作流程与人工智能技术深度结合的创新方式。整个制作流程可以拆解为以下核心环节:
核心技术原理
- AI文本生成:利用大语言模型(如DeepSeek、通义千问、豆包等)进行剧本创作和优化
- AI图像生成:使用Stable Diffusion、DALL-E等模型生成角色和场景图像
- 语音克隆:基于TTS(文本转语音)和声纹克隆技术实现角色配音
- 视频生成:将静态图像通过AI模型转换为动态视频片段
- 口型同步:使用深度学习模型实现音频与人物口型的精准匹配
完整工作流程
剧本创作 → 脚本分镜 → 角色设计 → 场景生成 → 配音制作 → 视频生成 → 对口型 → 后期剪辑 → 成品输出
源码七号站提示:每个环节都需要精细打磨,特别是剧本和角色设计阶段,这直接决定了最终作品的质量。
第一步:剧本创作
使用AI辅助创作剧本
剧本是短剧的灵魂,决定了作品的核心价值。在AI辅助下,我们可以大幅提升创作效率。
推荐工具
- DeepSeek:基于先进的语言模型,擅长创意写作
- 豆包:字节跳动推出的AI助手,免费且功能强大
- 通义千问:阿里云的大模型,特别是Qwen 3.0版本表现优异
- 腾讯元宝:同样基于优秀的底层模型
创作流程
步骤1:确定主题和背景
以历史人物李白为例,我们可以这样向AI提问:
问题1:李白一生写了多少诗?
问题2:根据李白的一生,从第一次远游开始,按照时间线的顺序,他都写了哪些诗?
问题3:李白最著名的诗篇有哪些?
问题4:课本上著名的诗篇有哪些?
问题5:把原文也列出来,并写出创作背景
通过这种层层递进的提问方式,我们可以收集到丰富的创作素材。
步骤2:细化创作需求
在获得基础信息后,进一步细化:
提示词示例:
"早发白帝城的创作背景、时间是什么?当时李白穿什么衣服?李白当时的心理状态如何?周围有哪些人物?"
步骤3:生成完整剧本
使用详细的提示词让AI生成剧本框架:
"结合上面的信息,以第一人称的视角,把这首诗改编成一个从入狱以前到为什么入狱、到入狱后的情景、再到释放之后的连续剧情。
要求:
- 有场景描述
- 有人物设定
- 有分镜设计
- 有旁白
- 有独白
- 有角色对白
- 写出作者当时的心理活动"
步骤4:多轮优化
AI生成的初稿往往需要反复打磨。可以采用以下策略:
- 跨平台优化:将同一剧本在不同AI平台(豆包、通义千问、腾讯元宝)之间反复润色
- 针对性修改:对不满意的台词单独提出修改要求,如"这句台词写得不好,修改一下,应该悲伤一些"
- 细节补充:不断补充场景细节、人物情感、动作描写
源码七号站建议:宁愿花三天打磨一个剧本,也不要一天做三个视频。短视频平台不缺内容,缺的是好内容。剧本质量直接决定作品的成败。
第二步:脚本分镜设计
分镜是将文字剧本转化为视觉画面的桥梁。
使用AI生成分镜表
提示词模板:
"请根据以下旁白,设计详细的分镜脚本,并以表格形式给出:
[旁白内容]
要求:
1. 每个分镜包含:场景描述、时间(白天/夜晚)、天气、主要道具、人物动作、人物表情、内心活动
2. 提供AI绘图提示词
3. 分镜数量合理,节奏紧凑"
分镜表示例
以"天宝十四载,安史之乱骤起,天下动荡"这句旁白为例:
|
分镜编号 |
场景描述 |
时间/天气 |
主要元素 |
AI绘图提示词 |
|
1 |
中国古代战场全景 |
白天/阴云密布 |
战火、逃难人群、烽火台 |
电影写真风格,中国古代战场,天宝年间,战火纷飞,乌云滚滚,烽火连天,战场废墟,倒塌城墙,燃烧村庄 |
|
2 |
李白骑马奔驰 |
白天/阴沉 |
马匹、道路、远山 |
电影写真风格,全景,一个男人骑着马在飞奔,[角色描述],背景是战火连天的荒野 |
|
3 |
李府大门 |
白天/晴 |
豪华府邸大门 |
电影写真风格,中景,古代豪华府邸,大门敞开,门前有石狮,匾额上书"李府" |
源码七号站提醒:分镜设计要考虑到后续的制作难度,场景不宜过于复杂,人物数量要控制在可操作范围内。
第三步:角色形象设计
角色形象的一致性是AI短剧制作的最大挑战之一。
角色设计流程
1. 确定角色基础信息
首先向AI询问角色的基本信息:
"李白58岁时是什么形象?应该穿什么样的服装?"
"永王李璘当时是什么官职?应该穿什么样的服装?服装上的图案有什么讲究?"
2. 生成初始形象
使用豆包等工具的AI绘图功能:
提示词:
"以电影写真风格设计一个58岁李白入狱前的形象,全身像,面对镜头"
如果对生成结果不满意,可以点击"重新生成"多次尝试。
3. 提取详细的服装描述
关键步骤:使用AI反向解析图片
在豆包中上传生成的角色图片,然后输入:
"反推这张图片的AI绘图提示词,要求详细描述:
- 帽子样式和材质
- 面部特征
- 服装款式和颜色
- 图案细节
- 腰带配饰
- 鞋子样式"
AI会返回类似这样的描述:
一位58岁左右的男子,留着白色的胡须,头戴一顶黑色的帽子,帽子采用丝绸材质,造型微微隆起,脑后的两个角自然下垂。身穿白色的传统唐代长袍,长袍面料为轻盈的麻布,领口为交领右衽设计,领口和袖口处有黑色的镶边滚边,做工精细。腰间系着一条黑色腰带,宽度适中,材质紧实,腰带上没有多余的配饰,简洁大方。长袍的下摆左侧有蓝色云纹图案,金色线条勾边。下身穿黑色长靴。
4. 精简提示词
删除所有修饰性语言,只保留核心特征:
优化后:
一位58岁男子,白色胡须,黑色帽子(丝绸材质,微隆起,脑后两角下垂),白色唐代长袍(交领右衽,黑色镶边),黑色腰带,长袍下摆左侧蓝色云纹图案(金线勾边),黑色长靴
这个精简后的描述词将成为后续生成该角色所有图片的基础模板。
5. 设计多种情绪和角度
为同一角色生成不同表情和角度的图片:
- 正面微笑
- 侧面严肃
- 仰头看天
- 低头沉思
- 悲伤表情
- 愤怒表情
这些素材在后续的图片编辑和换脸中会非常有用。
服装和道具设计
对于特殊服装(如战场盔甲、囚服、便服),可以从网络搜索相关图片,然后用AI反推:
步骤:
1. 百度搜索"唐朝将军盔甲"
2. 保存合适的图片
3. 上传到豆包,要求"反推出这个图片的AI绘图提示词,重点详细描述服装"
4. 提取服装描述部分
源码七号站技巧:建立一个角色形象库,为每个角色准备至少4-6种表情和3-4个角度的图片,这样在后期制作时会更加灵活。
第四步:场景与画面生成
在线平台生成
推荐平台
- 即梦(Jimeng)
- 优势:图像质量高,支持3.0模型
- 建议:使用多个账号(可用朋友家人手机号注册)来获取更多积分
- 可灵
- 优势:视频生成能力强
- 微度
- 优势:界面友好,适合新手
- 海螺
- 优势:免费额度充足
生成技巧
基础提示词结构:
[风格] + [景别] + [场景描述] + [角色描述] + [动作] + [氛围]
示例:
电影写真风格,中景,古代中国战场,天宝年间,战火纷飞,乌云滚滚,烽火连天,战场废墟,倒塌的城墙,燃烧的村庄,大量逃难人群
重要原则:
- 必须包含"电影写真风格":这能显著提升画面质感
- 明确景别:全景、中景、近景、特写
- 角色描述要完整:使用之前设计好的角色提示词
- 添加运镜描述:航拍、跟随、推进、环绕等
航拍镜头示例:
航拍,电影写真风格,中国古代战场,战火燃烧,烟雾滚滚,旗帜飘扬,人群逃难
然后可以将生成的图片直接转视频,提示词:
航拍前行,战火燃烧,烟雾滚滚,旗帜飘扬,人群逃难
使用参考图保持角色一致性
在即梦等平台中:
- 点击"导入参考图"
- 上传之前设计好的角色定妆照
- 选择"人像写真"模式
- 调整相似度滑块(建议80-90%)
这样生成的图片中,人物面部会与参考图保持高度一致。
多模态编辑技巧
即梦4.0支持多模态编辑,可以实现:
场景融合:
提示词:
"把图一和图二中的人物放到同一个场景中,图一的人站在左侧,图二的人站在右侧,背景是古代书房"
角度转换:
提示词:
"保持图片中角色特征不变,把这张图的视角改变成高空俯拍的角度"
道具替换:
提示词:
"保持图一中人物特征不变,让他穿上图二的衣服"
无中生有:
提示词:
"保持男人的特征不变,让他怀中抱着一个中国古代的婴儿"
源码七号站强调:使用在线平台时要充分利用"超清"功能,通常点击2-3次超清可以得到满意的分辨率。下载时建议使用"猫爪"等浏览器插件避免水印。
第五步:角色配音制作
配音是赋予角色生命力的关键环节。
配音方案选择
方案一:在线配音平台
适合没有高性能显卡的用户。
推荐平台:各类在线TTS平台(文档中提到的配音网站)
操作步骤:
- 准备音频素材
- 从电视剧、电影中截取干净的人声片段
- 使用UVR5等工具进行音频分离(去除背景音乐和噪音)
- 准备不同情绪的声音样本:正常、感叹、紧张、愤怒等
- 创建声音模型
- 上传处理好的音频样本
- 为每个角色创建独立的声音模型
- 命名规范:角色名-情绪(如"李白-感叹"、"李白-正常")
- 生成配音
- 将台词输入到配音平台
- 选择对应的声音模型
- 点击生成
- 试听效果,不满意可重新生成(抽卡)
- 配音技巧
- 如果整段配音不理想,可以分段处理
- 保留满意的部分,重新