本文由源码七号站原创出品,未经授权禁止转载
前言
在当下的电商时代,短视频带货已成为商家营销的主战场。然而,传统的视频制作方式不仅成本高昂,还需要专业的摄影师、模特以及后期团队。对于中小商家来说,这无疑是一笔不小的开支。
好消息是,随着AI技术的飞速发展,我们现在可以通过AI工具实现电商带货视频的自动化生成。本教程将详细讲解如何利用Coze(扣子)平台搭建一套完整的AI视频生成工作流,只需上传一张产品图片,就能自动生成专业的带货视频。
技术原理解析
核心技术栈
这套自动化视频生成方案基于以下技术组合:
Coze工作流引擎
Coze是字节跳动推出的新一代AI应用开发平台(官网:https://www.coze.cn/),提供可视化的工作流编排能力,支持大模型调用、插件集成、条件判断等复杂业务逻辑。
AI视频生成技术
利用先进的AI视频生成模型(如可灵等),可以根据文本描述和参考图片,生成具有产品一致性的短视频内容。
大语言模型能力
通过大模型对产品信息进行分析和提炼,自动生成视频脚本和分镜描述,确保视频内容的专业性和吸引力。
工作流程概述
整个视频生成流程可以分为以下七个核心步骤:
- 信息输入:在开始节点输入产品名称、功能特点等信息,并上传产品图片
- 信息整理:利用大模型对输入信息进行整理,生成详细的产品描述
- 生成分镜提示词:基于产品信息生成九宫格分镜分析提示词
- 生成九宫格图片:根据提示词生成包含九个分镜的参考图
- 生成视频脚本:结合产品信息和分镜图,生成视频的详细脚本
- 视频生成:调用AI视频生成插件,生成最终视频
- 结果查询:循环查询生成状态,输出视频地址
接下来,我们将详细讲解如何在Coze平台上一步步搭建这个工作流。
准备工作
注册Coze账号
首先访问Coze官网(https://www.coze.cn/),使用手机号注册并登录账号。新用户可以免费使用平台的基础功能。
温馨提示:源码七号站提醒您,在注册时请使用真实手机号,以便后续接收重要通知。
获取API密钥
由于工作流中需要调用AI视频生成服务,你需要准备相应的API密钥。这个密钥类似于一把"钥匙",用于打开视频生成等插件功能。
具体获取方式请访问相应的AI服务提供商官网,注册后在个人中心或项目管理页面即可创建API密钥。
了解资源消耗
在Coze平台上,不同的节点会消耗不同的资源点:
- 大模型调用:根据输入输出token数量计费
- 视频生成:通常消耗较多资源点(5秒视频约700+资源点)
- 图片生成:根据分辨率和数量计费
建议在正式使用前,先小规模测试,了解实际消耗情况。
创建工作流
进入工作流页面
登录Coze后,点击顶部导航栏的"开发平台",然后选择"资源库"。在右上角找到"资源"按钮,选择"工作流"选项,进入工作流创建页面。
填写基本信息
- 工作流名称:只能使用英文或拼音,例如
video_generation_workflow - 工作流描述:可以使用中文,简单描述工作流的用途,例如"电商带货视频自动生成工作流"
点击"确认"后,你将看到一个包含开始节点和结束节点的空白画布。
源码七号站建议:给工作流起一个有意义的名称,方便后续管理和维护。
配置开始节点
开始节点是整个工作流的入口,我们需要在这里设置所有必要的输入参数。
添加产品信息变量
点击开始节点,在右侧面板中添加第一个变量:
- 变量名:
product_info(产品信息的缩写) - 变量类型:String(字符串)
- 是否必填:勾选
- 描述:产品信息,如名称、功能特点、卖点、话术等
这个描述会在用户使用时显示,帮助用户了解应该输入什么内容。
重要提示:产品信息填写得越详细,生成的视频效果就越好。建议包含:
- 产品名称
- 核心功能
- 独特卖点
- 使用场景
- 目标人群
添加产品图片变量
点击"新增变量",添加第二个变量:
- 变量名:
product_image - 变量类型:Image(图片)
- 是否必填:勾选
- 描述:上传产品图片,建议使用多角度产品图,不要包含真人
图片要求说明:
- 最好是一张包含多个角度的产品拼图
- 图片需要清晰,分辨率建议在1080p以上
- 不能包含真人照片(部分AI视频生成服务的限制)
- 可以使用P图工具将不同角度的产品图拼接成一张
添加视频时长变量
继续添加第三个变量:
- 变量名:
video_duration - 变量类型:Int(整数)
- 是否必填:取消勾选
- 默认值:15
- 描述:视频时长(秒),可选择10秒或15秒
添加视频比例变量
添加第四个变量:
- 变量名:
video_ratio - 变量类型:Int(整数)
- 是否必填:取消勾选
- 默认值:2
- 描述:视频比例,1=竖屏,2=横屏,3=竖屏高清,4=横屏高清
比例选择建议:
- 抖音、快手等短视频平台:选择1或3(竖屏)
- 视频号、B站等:选择2或4(横屏)
添加API密钥变量
最后添加API密钥变量:
- 变量名:
api_key - 变量类型:String(字符串)
- 是否必填:勾选
- 描述:视频生成服务的API密钥
至此,开始节点的配置就完成了。源码七号站提醒您,这些参数的设置直接影响最终视频的生成效果,请务必认真填写。
构建核心处理流程
第一步:产品信息分析节点
节点类型:大模型节点
这个节点的作用是对用户输入的产品信息进行整理和扩展,生成更加详细和专业的产品描述。
配置步骤
- 在画布上添加"大模型"节点
- 重命名为"产品信息分析"
- 选择模型:智谱-16视觉理解(或其他支持图文理解的模型)
输入配置
在"输入"区域,点击加号添加文本输入:
- 选择开始节点的
product_info变量
在"视觉理解输入"区域,添加图片输入:
- 选择开始节点的
product_image变量
系统提示词
你是一位专业且极具创意的产品宣传专家,擅长用生动、精炼且极具吸引力的语言介绍产品。
## 技能
根据用户输入的产品信息以及产品图片,全面精准地给出:
1. 产品名称
2. 核心功能
3. 独特特点
4. 特殊卖点
## 要求
- 表述要生动、形象、简明清晰
- 具备较强的感染力,能够有效吸引听众的兴趣
- 只围绕产品相关内容进行交流,拒绝回答无关话题
- 严格按照指定格式输出
## 输出格式
产品名称:[产品名称]
核心功能:[核心功能描述]
独特特点:[特点1]、[特点2]、[特点3]
特殊卖点:[卖点描述]
用户提示词
请根据以下产品信息和产品图片,生成详细的产品介绍:
产品信息:{product_info}
注意:这里的 {product_info} 需要通过点击加号,选择开始节点的变量来引用。
输出配置
- 变量名:
analyzed_product_info - 异常处理超时时间:600秒
- 重试次数:1次
- 备选模型:智谱-1671(可选)
技术说明:由于大模型处理需要时间,我们将超时时间设置为600秒(10分钟),避免因处理时间过长导致报错。
第二步:九宫格分镜提示词生成
节点类型:大模型节点
这个节点负责生成九宫格分镜图的描述提示词,这些提示词将用于指导AI生成参考分镜图。
配置步骤
- 添加"大模型"节点
- 重命名为"九宫格分镜提示词生成"
- 选择模型:智谱-16视觉理解
输入配置
在"输入"区域添加两个变量:
- 开始节点的
product_info - 产品信息分析节点的
analyzed_product_info
在"视觉理解输入"区域添加:
- 开始节点的
product_image
系统提示词
这个提示词较长,核心思路是让AI扮演一个专业的分镜设计师,根据产品特点设计九个不同角度的镜头画面。
你是一位资深的视频分镜设计专家,擅长为产品视频设计富有创意和吸引力的分镜方案。
## 任务
根据提供的产品信息和产品图片,设计一个九宫格分镜方案。每个分镜都要:
1. 突出产品的不同特点或使用场景
2. 具有视觉吸引力
3. 符合产品的整体风格和定位
4. 适合短视频呈现
## 输出要求
为每个分镜提供详细的画面描述,包括:
- 镜头角度(特写、中景、全景等)
- 主体内容(产品展示的具体部分)
- 背景环境
- 氛围营造
- 色调风格
请以九宫格形式输出,