Agent Lab

Agent 实验室

我怎样构建自己的 Agent,让它们逐步具备完成复杂业务目标的能力?这里记录构建中的判断、实验、失败与真实工作结果。

最新实验

问题、运行、反证和能力边界
EXP 004

外部实践案例:并行研究的分工、预算与停止条件

多 Agent 不是多开几个窗口:Anthropic 为并行研究付过的学费

并行把搜索能力放大的同时,也把模糊分工和资源浪费一起放大。Anthropic 的生产复盘里,最值钱的不是 90.2%,而是他们写下的失败和“不适用”。

阅读实验 →

实验归档

2 篇
  1. #003AI 客服真正难的,不是回答,而是把人接回来
  2. #002Agent 说“做完了”,怎么知道它真做完了?