Skip to content

Agent 工程哲学

当软件系统里出现自主角色,软件工程要重新理解什么。

这本书在回答什么

agent 的定义这两年换得很快。最早它接近"会用工具的动物":一个模型,能调几个 function,能跑个 loop。这个定义不算错,但太单薄。它只说明 agent 能做什么,没说明 agent 是谁。

当 skill、持久化沙箱、长期记忆、模型分级这些东西凑齐之后,一个更稳定的抽象浮现出来:agent 不像一只会拿工具的动物,更像一个完整的打工人。它有岗位,有技能,有履历,也有自己的工作环境。

这本书沿着这个抽象,走一遍 agent 的一生:

  • 候选人不是员工——模型训练公司交付的是候选人,不是已经上岗的 agent。预训练、后训练和模型分级,只说明它大概是什么学历。
  • 岗位定义即工程——系统提示词不再只是 prompt,而是 JD。岗位职责、权限边界、不该做什么,都是关键的工程问题。
  • skill 必须可验证、可迁移——skill 先是简历上的技能条目。要跨 agent、跨环境复用,就得像证书一样可验证。
  • 从"做完就走"到"长期在岗"——带持久化卷的沙箱,是 agent 的工作电脑;长期记忆是它的职业履历。
  • 从个体到团队——单个 agent 的岗位讲清楚之后,接下来的问题就是交接、授权、上下文隔离与最终责任。agent 的信息窗口和角色生成方式会改变组织形态,多 agent 工程不做公司仿真,而是重新设计一种求真的团队。

这些问题想清楚,agent 工程就不再只是调工具、写 loop。更要紧的问题变成:这个 agent 到底是谁,负责什么,靠什么把活干完。

与第一本书的关系

《大模型应用工程哲学》从概率性的模型出发。工程对象是建在模型之上的应用。这一本从 agent 这个自主角色出发。工程对象是 agent 本身。这是比模型高一层的抽象,不是同一层的更深一刀。

凡是能在模型层讲清的(不确定性、声明式提示、类型契约),这本书引用前一本,不重讲。