重新设计一种求真的团队
这本书从一个判断开始:agent 是比模型高一层的工程对象。
模型是候选人,不是员工;系统提示词是 JD,不是咒语;skill 是能力资产,不是工具调用;持久化沙箱是工作电脑,不是临时脚手架;长期记忆是履历,不是聊天记录;eval 是试用期,不是换个排行榜。
走到最后,一个 agent 变成一群 agent,问题也跟着升了一层:团队要靠一组清楚的岗位关系,多画几条连线没有用。
这些岗位关系也不能照搬人类组织。人类组织里有不少岗位和流程,只是人脑窗口太小、角色切换太难、信息传递太慢之后长出的补丁。agent 能处理更大的上下文,能临时生成隔离岗位,也更容易跨任务重组能力。旧结构要先审计,再决定哪些留下。
审计标准只有一条:它是否帮助团队接近事实。
别模拟公司
多 agent 工程最容易走偏的方向,是模拟人类公司。
给 agent 安上经理、员工、会议、汇报和审批,看起来像组织,实际可能只是把人类组织的外壳搬进系统。该搬的是协作约束:岗位边界、交接契约、授权路径、工作记录、最终担责点。
人类组织长期处理一群角色如何一起工作,有很多经验值得学。它也长期被人的利益、恐惧和权力欲改造成现在的样子,有很多问题不该带进来。把两者混在一起,是 agent 团队设计里最危险的偷懒。
协调机制保留,组织表演删除,agent 的新问题用新机制处理。
人数不是团队
多 agent 的价值也不在数量。
十个共享同一段上下文、重复同一种偏差的 agent,不比一个 agent 更像团队。三个岗位清楚、上下文隔离、交接干净、互相能纠偏的 agent,反而更接近团队。
团队的关键不在“很多”,而在差异被设计出来,最后又有人负责取舍。批判岗位要真能批判,校验岗位要真能否决事实错误,主编岗位要真能舍弃局部正确。没有这些,所谓多 agent 只是并行生成。
团队的关键也不在“拆得细”。如果一个通才 agent 带着足够清楚的 JD、工具、记忆和权限就能完成任务,硬拆成几个岗位未必更稳。真实拆分来自任务结构、风险边界和事实独立性,不来自组织感。
三种团队都要防自证
多 agent 系统要防同源错误。一群 agent 如果共享同一段材料、同一个暗示、同一个错误前提,人数越多,只会让错误更像共识。独立上下文、反向角色、交叉 eval 和原始材料路径,要保证相似结论真的来自不同判断。
人和 agent 混合系统要防人借 agent 自证。人先有偏好,再让 agent 整理证据,最后看到一份漂亮报告,很容易误以为那是外部事实给出的结论。用户偏好和事实判断要分开记录。人可以否决风险,不能把期待伪装成证据。
纯 agent 系统要防优化回路吞掉外部约束。目标、预算、权限、停止条件和急停开关,不能交给正在优化的那个系统自评。没有人在操作回路里,不代表没有责任;责任要落在能追溯、能叫停、能回滚、能被追责的主体上。
这三种团队表面不同,底层问题一样:系统会不会把“我想要的答案”包装成“事实就是这样”。
守住三件事
求真高于讨喜。agent 很容易把话说顺,把结论写得让人舒服。团队设计要奖励事实,而不是奖励顺耳。
担责高于甩锅。工作可以拆,责任不能靠拆分消失。多 agent 系统必须有最终负责点,也必须有最终承担后果的人或组织。
克制高于滥用。能自动做,不等于该自动做;能并行,不等于该无限并行;能让 agent 生成更多,不等于更多就是好。
多 agent 工程不能模拟公司,也不能只是把任务拆给更多模型。新的团队要服务求真:保留协作需要的结构,删掉组织表演,再补上 agent 自己的防错机制。最后,仍然要有一个能承担后果的主体。
软件系统里已经出现了能上岗、能协作、能留下履历的自主角色。工程对象已经变了。你设计的对象包括调用流程,也包括一种会工作的角色,以及这些角色组成团队之后的责任结构。