如果你看过本中心《零基础用 Dify 搭第一个 AI 应用》,已经会用聊天助手 + 知识库了。但聊天助手本质是「一问一答」,遇到「先查资料、再写方案、最后检查」这种多步骤任务就会力不从心。2026 年 Dify 推出的 Agent 模式(Agent Beta)正是为此而生:它在画布上让你不写代码就能定义工具、单个 Agent、以及多智能体协作工作流,并在 GAIA 基准上取得了不错的开源成绩。本教程带你从「聊天助手」进阶到「多 Agent 协作」。
先搞懂:Agent 模式和聊天助手有什么区别?
用一句话理解:聊天助手像「一个随时待命的同事」,Agent 模式像「你组建的一支小队」——有人负责规划、有人负责干活、有人负责检查,还能调用外部工具。关键差异:
| 维度 | 聊天助手 | Agent 模式 |
|---|---|---|
| 能否调用工具 | 有限(主要靠提示词) | 原生挂工具 / API / MCP |
| 复杂任务 | 容易跑偏、漏步骤 | 可拆给多个 Agent 接力 |
| 可控性 | 靠人写长提示词 | 画布上编排节点,看得见 |
| 适用场景 | 客服问答、陪聊 | 调研、写作、审批等多步骤流程 |
新手别一上来就堆五六个 Agent。先用「单个 Agent + 1~2 个工具」跑顺,再按需拆分。多 Agent 协作威力大,但调试成本也高——这是新手最容易过度设计的地方。
Step 1:切到 Agent 模式创建应用
1. 进入 Dify 工作室,点「创建应用」
2. 这次选「Agent」类型(不是聊天助手 / 文本生成)
3. 起名,例如「小龙虾调研小队」,创建
4. 进去后界面多了「工具」「变量」「工作流」几个面板
Step 2:给 Agent 挂第一个工具
Agent 的灵魂是工具。没有工具,它只能凭记忆编;挂了工具,它就能查实时信息、调你的系统:
1. 左侧点「工具 → 添加」,先选内置的「Web Search」试水
2. 想接自己的系统?选「自定义工具」,填 API 地址和参数
3. 保存后,在 Agent 的「工具列表」里勾选启用
4. 调试框里问「今天 AI 圈有什么新闻」,它会真的去搜
工具权限越大越要谨慎。能「只读查询」就别给「写入 / 删除」。给 Agent 接写操作类 API 前,务必在后端加白名单和限额。
Step 3:用变量和知识库喂上下文
1. 在「变量」里定义输入项,如「行业 / 目标读者 / 字数」
2. 在「上下文」里关联你之前建的知识库(RAG)
3. 提示词里用 {{变量名}} 占位,运行时自动替换
例:请针对 {{行业}} 写一份面向 {{目标读者}} 的简报
Step 4:搭一个多 Agent 协作(Planner + Worker + Reviewer)
进入「工作流」画布,拖出三个 Agent 节点,用线连起来:
Planner(规划者):把大任务拆成步骤清单
↓
Worker(执行者):按清单逐步查资料、写初稿
↓
Reviewer(审查者):挑错、补漏、给改进建议
每个节点都是独立 Agent,可单独设提示词和工具。
节点之间要传对「交接物」。Planner 的输出格式如果 Worker 看不懂,整条链路就断。新手先在提示词里约定「上一步必须输出结构化清单」,再连线。
Step 5:用 Supervisor 编排流转与兜底
1. 加一个 Supervisor(监督者)节点放最前面
2. 它负责:判断任务类型 → 派给对应专家 → 汇总结果
3. 设置「兜底规则」:专家都失败时才回退到通用回答
4. 在画布上把 Supervisor 连到各个专家的输入端
Step 6:调试与观测每一步
1. 点「调试预览」,跑一个真实任务
2. 展开「运行轨迹」,看每个节点的输入 / 输出 / 调用了哪个工具
3. 发现某节点答非所问 → 回去改它的提示词或工具
4. 反复跑 2~3 次,直到链路稳定
别只看最终结果对不对。多 Agent 最怕「结果碰巧对、过程全靠蒙」。逐节点看轨迹,才能定位是哪个专家在瞎编。
Step 7:发布为多 Agent 工作流
1. 右上角「发布 → 更新发布」
2. 选「运行」拿到公开链接,或选「API」拿到接口
3. 想嵌网站?选「嵌入」,复制代码贴到网页
4. 团队用?在「成员」里邀请同事,共享这套工作流
常见问题速查
| 你遇到的现象 | 大概率原因 & 解决 |
|---|---|
| Agent 不调用工具 | 工具未勾选启用,或提示词没说「需要时调用 XX」 |
| 多 Agent 链路断在中间 | 节点间交接格式没约定,补结构化输出要求 |
| 结果对但过程瞎编 | 逐节点看轨迹,给对应专家加知识库约束 |
| 自定义工具一直报错 | API 地址 / 参数 / 鉴权填错,先用内置工具验证 |