AI Agent 工程 · 09
09.2 实战:单 Agent 与多 Agent 客服对比
针对相同客服需求,比较单 Agent 加工具与多 Agent 分工的架构条件。
相同问题的两种设计
A:一个客服 Agent 使用 order_lookup 与政策检索,统一维护一次上下文。B:Supervisor 把订单事实交给订单 Agent、把政策问题交给政策 Agent,再合成答案;退款仍交给独立人工审批 Workflow。
A 单 Agent + 两工具:少一跳、少一次上下文复制
B Supervisor → 专员:适合专长/权限/团队边界真的不同
运行 npm run test:agent-course。architecture restraint 使用相同的“需订单、需政策、无独立专长”输入,明确选择 single-agent。这是规则化的架构判断演示,不是比较真实模型准确率的实验;因此不伪造成本、延迟或效果数据。
验收与失败排查
验收是能写出自己的测试集:普通查单、跨商家政策、退款申请、敏感争议,并记录两种架构的真实调用次数、失败率和人工处理率。若 B 的工具权限比 A 更宽,说明拆分反而变差;若两个 Agent 重复查询同一订单,检查共享的受控状态与交接协议。
主动回忆:在什么可测量结果改善前,你不会把 A 升级为 B?
- 必须记:先证实分工价值,再增加 Agent。
- 建议记:比较必须使用相同测试集与相同安全边界。
- 不用记:示例中的函数名称。