Agent 一次都没闭环过,别先给大目标
一句话:评估和优化仓库 Harness,要从能验收的小需求开始;Agent 一次都没成功闭环过,工作上下文就不健全,必须人带着干完一次,再谈抽象的长程目标。 原文:/posts/agent-first-closed-loop/
主张
- Agent 一次都没成功闭环过,工作的上下文 Harness 就不健全。必须人带着干完一次,再谈抽象的长程目标。
- 评估入口是三类能当场看见结果的小需求:总结架构、做一个小需求、查一个问题。对比优化前后的耗时和 token。
- 长程任务要能渐进观测、Fast fail、允许分布式。设一个 goal 然后走开,账单先落在等待上。
- 顶级 Harness 仍需要工程师定质量和边界;测试层的目的是让开发更快。
- 复杂项目的顺序:数据层、可观测层、可回滚失败;先看结果,再优化过程效率,再打通任务系统。
来自哪篇
- [[agent-first-closed-loop]]