← 回到输出

候选草稿根据 2026-03-09 的 Obsidian 想法记录与对话整理 · 暂未发布

N—03 / AI NOTE

Agent 为什么
会越装越笨?

能力越来越多,不代表所有能力都要一直塞在同一个 AI 里。

一个 Agent 刚做出来的时候往往很清醒:目标清楚,工具很少,出了错也容易定位。等到它开始"有用"了,我们就忍不住往里装东西:再加一个搜索,再加一个读网页,再加一个写文件,再加一个能调用其他模型的技能。装到后来,它反而变笨了。

这种笨不一定是模型本身变差了,而是它要同时理解的东西变多了。每多一个技能,就多一份说明、多几个参数、多一些成功和失败的例子。它们一起挤在有限的上下文里,像一个人同时背着二十种工具赶路:每一样都有用,可全背在身上,就迈不开腿了。

注意力和上下文都是稀缺的。技能越多,Agent 越难判断眼下该用哪一个,也越容易把 A 的规则套到 B 上。我们嘴上说的是"能力变强了",实际发生的却是:决策变难了,错误变隐蔽了,排查变复杂了。

我越来越倾向另一种结构:主 Agent 只做三件事——理解用户要什么、判断该调用什么、把结果带回来。具体能力放在外面,按需加载。像一个调度台,而不是一台把所有工具焊死在身上的机器人。

外面的技能得能独立干活。它要能说清楚自己适合解决什么问题,需要什么输入,会产出什么,什么情况下不该用,失败了怎么体面地退出。一个含糊的技能,装进再强的 Agent 里,也只是多一个含糊的选项。

测试也要跟着结构走。单个技能先单独测,再放进常见组合里测;每加一个新技能,不能只测新功能,还要回头看看旧任务有没有被干扰。否则我们只知道自己装了多少东西,却不知道因此失去了什么。

对用户来说,这些都不该被看见。用户不应该去管理一堆插件,也不该去学"先点这个再点那个"。系统应该把路由和重试藏在背后,只把结果,以及那些拿不准的地方,交还给用户。

所以我现在更警惕"多装一个能力"的冲动。能力当然重要,但一个 Agent 的价值不在于它知道多少,而在于需要的时候,它能不能用对东西,并且清楚地知道自己什么时候该停下来。