
大约在 2025 年圣诞节前后,AI 工程师注意到智能体发生了变化。它们开始真正工作了!很难准确指出原因。也许我们终于有了假期闲暇,可以用最新的模型尝试最新的智能体。也许模型已经跨过了某个能力阈值。也许模型周围的封装层已经趋于成熟。
我在本文中想提出的观点是,真正起作用的是后两者的共同作用:模型和运行框架同步改进,随后两者的改进曲线在恰当的时刻交汇。而这种动态有助于解释接下来会发生什么:模型不断将运行框架吸收到自身权重中,工程师不断删除那些已经被吸收的部分,最终剩下的是服务于人类注意力的运行框架,而不再是服务于模型的运行框架。
Transformer 的发明者之一卢卡斯·凯泽(Lukasz Kaiser)在 6 月的节目《无监督学习》(Unsupervised Learning)中说:
“去年冬天、去年圣诞节发生的变化——很难准确说清楚。我是说,运行框架发生了变化,后训练也有了一些变化,接着新的预训练模型出现了……但那感觉像是一次巨大的跃升,很难确切指出究竟是什么导致了它。”
“发生了什么?”这个问题的答案并不只存在于模型权重中,也存在于围绕这些权重发展起来的整个系统中。
答案就在智能体运行框架(agent harness)中。
回想一下 2022 年 11 月,当时 ChatGPT 是最先进的 AI 工具。它所拥有的唯一能力是下一词元预测,以及一些能够让它表现得像一个有用助手的基于人类反馈的强化学习(Reinforcement Learning from Human Feedback,RLHF)。它没有工具、没有搜索,也没有推理能力。
最初的 ChatGPT 被限制在训练数据和你发送给它的提示词之内,不多不少。它就像一个缸中之脑。
智能体运行框架能够让大语言模型(LLM)摆脱这种限制,并与真实的数字信息空间进行交互。
运行框架究竟是什么
**智能体运行框架是指除模型权重之外,使智能体能够运作的一切。**它包括围绕模型的环境、工具、上下文和护栏。没有运行框架,模型就是一个缸中之脑。它可以采取认知行动,但需要借助运行框架,才能将这一决策付诸真实的数字空间。
**运行框架就像是为模型的心智赋予身体。**有了运行框架,模型就能够感知信息(上下文)、采取行动(工具)、持久化信息(记忆与压缩),并约束自身边界(权限与护栏)。