Agent 真正缺的不是自主,而是终点
“继续优化”不是工作流。没有检查标准和停止条件的自主,只是在更快地消耗时间与信任。
罗文宇 ·
大家谈 Agent 时,常把“能连续做很多步”当成进步。它能搜索、写代码、调用工具、再根据结果继续行动,看上去越来越像一个独立同事。但真正把 Agent 放进产品,我首先担心的不是它会不会行动,而是它凭什么知道自己做对了。
一句“把网站继续优化”可以产生无数动作。Agent 能不停修改颜色、结构和文案,每一步都能给出理由,却没有任何证据说明结果更好。自主程度越高,错误方向上的执行速度也越快。
闭环至少需要四件事
一个可靠的循环需要清楚回答:目标是什么;这一轮怎样检查;根据检查结果如何选择下一步;何时停止或把判断交还给人。检查必须尽量来自外部证据,例如构建是否通过、任务完成率是否提升、用户能否完成核心动作,而不是 Agent 对自己结果的主观评价。
Agent 的价值不是永远运行,而是在有限轮次里,把不确定性变小。
停止条件同样重要。达到指标就停,连续一轮没有显著改善就停,触及权限或成本边界就停。结束并不代表能力不足,而是产品对代价有清醒认识。
Workflow 是产品表达
我希望把 Workflow 可视化,不是为了炫耀图里有多少节点。它能让访客看到,一次回复经过了意图判断、安全边界、知识选择和回答生成。对团队而言,这张图也让产品、算法和工程能讨论同一个对象:哪个节点在负责判断,哪个节点需要数据,哪里必须兜底。
当模型越来越强,产品经理反而更需要设计边界。真正可用的 Agent,不是一个什么都敢做的数字员工,而是一套目标清楚、证据可见、懂得停下来的工作系统。