Previously 文档
洁净室思考
一个看过同样语境的第二意见,不是第二意见——它只是同一个偏见的回声。所以当主 Agent 真的需要另一个脑子时,它把事情送进一间洁净室。
隔离是功能本身
thinkDeep 是主 Agent 的一个只负责思考的副本,在完全隔离中推理:没有工具,没有记忆,看不到这场对话的实时上下文。它能使用的每一个事实,都必须由主 Agent 亲手写进问题本身。
这听起来像缺陷,其实是整个设计的核心。正因为里面什么都没有,里面的判断才不可能被对话里的立场、语气、刚刚说过的结论污染。送进去什么问题,决定权在主 Agent;但在洁净室里,那个副本只跟问题独处。
思考的强度可以调
effort 参数有三档——low / medium / high——主 Agent 按问题的分量选。超时不作废:洁净室边想边写,runner 会把已积累的部分答案连同推理过程一起交回来。
主 Agent 什么时候敲门
洁净室不是每一轮的默认步骤。主 Agent 是刻意地、有理由地才派它出场:
- 不带偏见的第二遍——主 Agent 已经有了倾向,想要一个真正没被自己的语境污染过的判断。
- 语境会污染判断的问题——对话里情绪或立场太强,当局者容易迷。
- 深的结构性问题——值得多花推理预算、慢慢想透的那一类。
留下记录,也会长进
每次洁净室思考的报告都会写进当前切片的 agent.md 认知日志——事后你能看到它想过什么、结论是什么。它和其他同事一样,有自己的 fitness 桶和自己的 playbook:想得好不好会被记分,分数会驱动它进化(见进化回路)。
一句话:主 Agent 征询第二意见的方式,是造一个从没听过这场对话的脑子。