本文由 莫潇羽@源码七号站 撰写,转载请注明出处:www.fuyuan7.com
快速摘要
本文核心结论(适合只想快速了解的读者):
扣子(Coze)是字节跳动旗下的零代码 AI 智能体开发平台,官网地址为 https://www.coze.cn,无需编程基础即可在上面搭建功能强大的 AI 智能体。平台的核心逻辑是:大模型(LLM)= 智能体的大脑,插件 = 智能体的工具,工作流 = 智能体完成某件事的完整流程。
三大技能特训要点:
- 文案创作:通过"人设提示词 + 工作流"可搭建支持抖音、小红书、微信公众号、今日头条的全平台文案助手,自动生成文案、封面图并归档到飞书表格;
- 图片识别:OCR 识别方案有插件和大模型两种路线,但最优方案是使用支持视觉理解的大模型(如豆包视觉),识别准确度远超传统插件,并能同步纠正错别字、整理格式;
- 思维导图:通过工作流中的大模型节点,可将任意文本内容自动提炼成结构化的 Markdown 思维导图格式,配合前端卡片展示效果极佳。
往下看有更详细的每一步操作拆解,包括提示词模板、工作流节点配置逻辑以及调试技巧。
一、认识扣子:不只是一个聊天机器人平台
很多人第一次听说扣子(Coze),以为它只是一个"套壳 ChatGPT"的工具,用来做对话机器人的。这个认知是极度低估它的。
扣子真正的定位,是一个低代码/零代码的 AI 应用开发平台。你可以把它理解成"AI 界的积木工厂"——工厂里提供了各种标准化的积木模块(大模型节点、插件、工作流、知识库、数据库),你只需要把这些积木按照自己的业务需求组合起来,就能搭建出一个完整的 AI 应用或智能体,而完全不需要懂任何代码。
平台于 2024 年 2 月正式上线国内版(www.coze.cn),由字节跳动旗下火山引擎提供底层支撑,背靠豆包大模型,同时也支持接入 DeepSeek、智谱、讯飞等主流大模型。经过一年多的迭代,如今扣子平台已发展成为国内功能最全面、插件生态最丰富的 AI 智能体开发平台之一。
整个平台的架构从大到小可以这样理解:
- 工作空间(Space):所有项目和资源的容器,个人版有个人空间,团队可以创建团队空间;
- 项目(Project):分为「智能体」和「AI 应用」两种类型,前者是对话式的,后者有完整的可视化界面;
- 资源库(Resource):每个工作空间都有一个资源库,里面存放工作流、知识库、图片库、数据库等可复用资源;
- 商店(Store):平台提供了海量由官方和其他用户搭建好的智能体和应用模板,可直接复制使用,大幅降低搭建成本。
莫潇羽@源码七号站 在研究这个平台时发现,很多初学者进来后往往直接去看官方文档,结果被一大堆专业术语绕晕,最终放弃。官方文档固然专业,但它更适合作为"字典"来查阅,而不是入门的首选路径。
本文的定位就是帮助零基础读者,用最直白的语言,把扣子平台的核心逻辑讲清楚,并通过文案创作、图片识别、思维导图三个最常用的实战场景,手把手拆解每一步的操作细节。
二、扣子平台三大核心概念厘清
在开始动手之前,必须把三个核心概念搞清楚,否则后面的操作容易产生混乱。
2.1 大语言模型(LLM):智能体的大脑
大语言模型就是智能体的"脑子"。它决定了这个智能体能不能理解你的问题、会不会思考、能不能给出合理的回答。在扣子里,你可以给每个智能体选配不同的大模型,不同模型在速度、质量、擅长领域上各有侧重:
- 豆包系列:字节自研,速度快,服务稳定,是国内日常使用的首选;
- DeepSeek 系列:文案质量出色,但服务器压力大时响应较慢,适合对文案质量要求高的场景;
- 讯飞星火/智谱 GLM 系列:特定专业场景下有一定优势;
- 豆包视觉理解(Vision):专门用于处理图像输入,是图片识别场景的核心组件。
大模型只有"思考"能力,它本身不会去执行外部操作,比如查天气、存数据、调用 API 等。这些事情需要借助"工具",也就是下面要说的插件。
2.2 插件(Plugin):智能体的工具箱
插件就是扩展智能体能力的"工具"。扣子的插件商店里有数百个现成的插件,覆盖天气查询、地图搜索、联网搜索、图片生成、飞书操作、抖音数据、小红书数据等各种场景。你只需要在智能体配置界面点击添加,插件就能自动与大模型协作工作。
举个例子:当用户问智能体"今天武汉的天气怎么样"时,纯大模型是回答不了的,因为它的知识存在截止日期,无法获取实时数据。但如果给智能体加上"墨迹天气"这个插件,大模型就会自动调用该插件查询实时天气,再把结果整合成自然语言回复给用户。
这就是插件最核心的价值:让智能体从"只会思考"变成"能够行动"。
2.3 工作流(Workflow):完成一件事的完整流程
如果说插件是单个工具,工作流就是一套完整的流水线。你可以把它想象成工厂里的生产线——每道工序由一个模块(节点)负责,模块之间通过数据管道连接,原材料从"开始"节点进入,经过一系列加工,最终从"结束"节点输出成品。
工作流适合处理需要多个步骤才能完成的复杂任务,比如:输入一个文案主题 → 自动生成文案 → 自动配图 → 自动写入飞书表格,这整套流程就是一个典型的工作流。
工作流里的每个节点都有明确的输入和输出,节点类型包括:大模型节点(处理文字任务)、图像生成节点(生成图片)、代码节点(执行 Python/JavaScript 逻辑)、知识库检索节点(从知识库中搜索内容)、问答节点(向用户提问并收集回答)等。
工作流与插件最大的区别在于稳定性和可控性。插件是"大模型觉得该用就用",不可控;工作流是"按照你设定的流程一步步走",稳定、可预期、可调试。因此在实际项目中,莫潇羽@源码七号站 更推荐用工作流来处理核心业务逻辑。
三、从零搭建第一个智能体
理论明白了,直接上手。这一节以"全平台新媒体运营助手"为例,一步步教你把第一个智能体建起来。
3.1 创建智能体
登录 https://www.coze.cn,点击左上角的"+"号,选择"创建智能体"。在弹出的对话框里,需要填写以下几项:
智能体名称:这一步极其关键,因为后面平台的"自动优化提示词"功能会根据这个名称来生成人设内容。名称越具体,自动生成的内容就越准确。比如不要写"新媒体助手",而是写"全平台新媒体运营助手",两者生成的提示词质量差距显著。
功能介绍:如果你已经想好了这个智能体的具体功能,建议用数字列表的形式写出来,例如:
- 制定社交媒体内容策略
- 规划活动方案
- 撰写各平台文案
- 根据链接提取并改写文案
- 自动生成封面图
功能介绍写得越完整,后续自动生成的提示词就越贴合你的需求。当然,如果暂时没想好,也可以先空着,后面再补充。
图标:点击图标旁边的按钮可以上传自定义图片,也可以点击"自动生成"让平台基于智能体名称生成一个 AI 图标。图标不影响功能,但能让你的智能体更专业好看。
3.2 配置人设与回复逻辑
创建好智能体后,你会进入编辑界面,整个界面分三栏:左侧是"人设与回复逻辑"(提示词区域),中间是"技能"(插件、工作流等),右侧是"预览与调试"(实时测试对话)。
人设与回复逻辑这个区域,本质上就是给这个智能体写一份"工作说明书",告诉它:它是谁、它能做什么、它在什么情况下应该怎么反应。一份完整的人设提示词,至少需要包含两个核心部分:
一是角色定义,明确告诉大模型这个智能体的身份。例如:"你是一名专业的全平台新媒体运营助手,擅长根据不同平台(抖音、小红书、微信公众号、今日头条)的内容风格与平台规则,创作高质量的原创文案。"
二是技能列表,列出这个智能体具体能做的每一件事,以及每件事的处理逻辑。例如:"当用户需要生成文案时,主动询问:目标平台是哪个?内容主题是什么?偏好的文案风格是什么?获取以上信息后,生成一篇符合该平台调性的文案。"
如果你不会写提示词怎么办? 扣子平台提供了"自动优化"功能,点击人设与回复逻辑框右上角的"优化"按钮,选择"自动优化",平台会根据你填写的智能体名称和功能介绍,自动生成一套完整的提示词,然后点击"替换"应用即可。
自动生成的提示词质量通常不错,但你会发现有时候它给的技能描述不够精准,或者缺少你想要的某些技能。这时候可以先在"功能介绍"框里把你想要的技能写清楚,再点一次"自动优化",系统会重新根据你补充的内容生成更贴合需求的版本。
写好提示词后,你随时可以在右侧的调试区发消息测试效果。比如发一句"帮我写一篇关于小红书护肤的文案,600字,幽默风格",看看智能体的回复是否符合预期。如果不满意,调整提示词后继续测试,这