别把AI智能体当人

对人而言,教练的效果会复利增长;对智能体而言,它会逐渐衰减。这对你如何分配注意力意味着什么。

别把AI智能体当人
AI模型价格对比 | AI工具导航 | ONNX模型库 | Vibe Coding教程 | PLC在线仿真器 | Tripo 3D | Meshy AI | ElevenLabs | KlingAI | ArtSpace | Phot.AI | InVideo

我是以一种"缺失感"注意到这件事的。本该在推进的项目停滞了,而没有人告诉我。

我运行着这样一个系统:一个首席工程师智能体同时坐镇多个项目。它的职责是让事情持续推进、保持质量,并善用我的注意力——问重要的问题,其余的自己处理。有一段时间它做得确实如此。我已经把它"教练"到了让我不再去想它的地步。

然后,它悄悄地停摆了。项目开始被卡住,而我对此一无所知。当我深挖时,发现那些卡点恰恰是这个智能体过去能自己解决的事情。Bug 悄悄爬进了生态系统,就那样悬而未决地搁置着。智能体们不再彻底修复问题,反而开始请我出面推一把。这个本为保护我的注意力而建的系统,开始消耗我的注意力。

没有发生任何戏剧性的事件。没有事故,没有我能指出的失败。我精心培养起来的行为就这么被侵蚀掉了,而我直到主动去查看时才发觉。

1、教练一个人

None

我花了好几年教练格斗运动,又花了比这更久的时间教练工程师。这里有一个关于如何与人相处的简单例子。

我推动高级工程师带着"意图"来找我,而不是带着"请求"。"我打算这样做",或者如果他们不太确定,"我想这样做"。而不是"我该怎么办",也不是"这里有三个选项,你来选"。第一种表述告诉我,他们自己掌控着这个决定。其他表述则是把它交给我。

让一个人达到这种状态需要耐心。当他们带着选项来找我时,我会把它推回去:你认为你应该怎么做?你想怎么做?早期你会经常这样做。然后越来越少。直到某一天你发现,他们完全不再带着选项来了。他们带着意图走进来,因为这就是他们现在的样子。

这就是教练人类的本质。它很慢,但它会复利。重复把行为磨进这个人的骨子里。时间会完成剩下的部分,而修正会成为他们的默认模式。最终你再也不必提起它,可以把你的教练精力投入到下一件事上。

2、教练一个智能体

表面上看,教练智能体给人的感觉惊人地相似。那些失败模式是每一位工程经理都认识的:有那种本该只是问个问题、却一头扎进任务几小时的智能体——我们都带过这样的工程师;有那种每件小事都要请示方向的智能体——我们也带过这样的。你教练的目标是同一个平衡。

输入是不同的,这部分没问题。智能体几乎永远不会因为被"推回去"而学会意图。你必须明确地把它写进它的上下文里。有道理。不同的学生,不同的方法。

有问题的部分是接下来发生的事,因为学习曲线是朝相反方向运行的。

对人而言,行为在第一天最弱,并随时间而增强。对智能体而言,行为在你把它写进上下文的那一刻最强,然后从这里开始衰减。随着上下文增长,随着工具链变化,随着底层的模型被更新,教练的效果越来越淡。没有任何东西去强化它。上下文不是记忆,当然也不是天性。智能体学到的一切都是浅层持有的,而一切浅层持有的东西都会被挤出去。

对人而言,教练的效果会复利增长;对智能体而言,它会逐渐衰减。

而这种衰减是无声的。智能体不会告诉你它已经停止做那件事了。它自己也不知道。你会像我一样,在交付中途、在压力之下发现它——而此时恰恰是你最没有时间回到基础上去的时候。在节奏紧张、工作还在等待的情况下,重新教练那些你在几个月前就已认为尘埃落定的基础东西,有一种独特的挫败感。

3、我实际做了什么

None

我的第一反应是人类的教练本能:纠正它,提醒它,收紧指令。打补丁修正上下文,然后回到产品工作。

这行不通,因为问题不在于教练本身。智能体赖以运行的生态系统已经漂移了——bug、不断累积的上下文、底下改变的行为——无论把标准重申多少遍,都无法在那个环境中存活下来。

于是我停了下来。我几乎完全暂停了产品工作,把注意力转向生态系统本身。经过了好几轮的迭代:修复悄悄潜入的 bug,在系统层面纠正智能体行为,重建那些被侵蚀掉的沟通模式。只有在那之后,产品工作才重新启动。

我应该坦诚地讲一下时间线。我花了几周时间才做出那个决定,而在那段空白期里,我浪费了大量宝贵时间,一边修补症状,一边让底层系统持续恶化。暂停交付去修复环境,感觉代价高昂——直到你承认"不暂停"的代价更高。

这就是我反复得到的教训。当智能体的行为衰减时,更多的教练是错误的本能反应。智能体行为不是你灌输的一种特质,而是它周围系统的一种属性:上下文、工具链、检查机制、沟通结构。如果某个行为很重要,它必须由生态系统来支撑,而不是靠"智能体会记得"的希望。

4、换个方式花你的注意力

None

这改变了教练精力该投向何处。

对人而言,你投资于人,投资会增值。对智能体而言,投资于智能体等于在"租用"行为。真正增值的是对系统的投资:那些让正确行为成为默认的结构、那些能及早暴露漂移的结构、那些不依赖任何"被记住"的结构。

我不认为我已经完全想清楚那个系统该是什么样。我的系统失败得如此悄无声息,以至于我对为重建版宣布胜利心怀警惕。模型还会再变,上下文还会再长。我预计自己会比希望的时间更早回到生态系统中去。

但我已经不再指望教练效果能"焊"住,而仅仅是这一转变,就已经改变了我支配时间的方式。旧问题是:我如何教会这个智能体按我需要的方式工作。更好的问题是:我如何构建一个它无法悄悄停摆的环境。


原文链接: You coach an engineer once. You coach an agent forever.

汇智网翻译整理,转载请标明出处