上来就搞了个「规划 agent + 执行 agent + 审查 agent」的三件套,结果一言难尽。规划 agent 给的步骤太抽象,执行 agent 干到一半发现缺信息,审查 agent 又只会说「基本没问题」。
来回改了几轮都不行,最后我把三个合成一个,用结构化的「思考-动作-观察」循环写在一个 prompt 里,反而稳了。

我的教训:agent 数量不是越多越好,拆得太碎,中间传话就丢信息。先一个 agent 跑通,实在拆不动了再加第二个。别学我上来就上架构。
最终方案:
思考:分析当前状态和任务目标
动作:选择下一步操作
观察:记录执行结果
循环:重复以上步骤
简单粗暴,但有效。