跳到文章正文
模型框架 编辑推荐

谷歌的 WikiSkill:让 AI 记住“上次错在哪”,却不用把教训塞进提示词

AI 智能体有个老大难:同一个错误会反复犯。原因很简单,它每次都在“从零开始”思考。谷歌的新工作…

AI 智能体有个老大难:同一个错误会反复犯。原因很简单,它每次都在“从零开始”思考。谷歌的新工作 WikiSkill 想解决这件事——让智能体把过去的经验沉淀成可复用的“技能”,而不是每次把教训硬塞进提示词里。

一分钟速览

  • 谷歌提出 WikiSkill,让 AI 智能体记住过去的失败与经验。
  • 经验以“技能”形式复用,而非全部写进 prompt。
  • 测试中,9B 的 Qwen 模型借助该方法超过了 27B 模型。
  • 核心是把“记忆”外置化、结构化,减少上下文浪费。
  • 这为 Agent 的持续学习提供了一条实用路径。

“把教训塞进提示词”为什么不灵

常见做法是把过往错误总结成几句话,塞进系统提示词,希望模型别再犯。问题是,上下文窗口有限且昂贵;教训越攒越多,提示词越来越长,反而稀释了真正重要的信息。这不是记忆,更像“把便签贴满屏幕”。

WikiSkill 的思路是把经验抽出来,组织成可检索、可复用的“技能条目”。需要时再调用,而不是常驻上下文。这样既省 token,又能随经验增长而扩展。

9B 超过 27B 说明了什么

测试里,一个 9B 的 Qwen 在接入 WikiSkill 后,成绩超过了 27B 模型。这个结果很有说服力:它说明在很多任务上,决定表现的未必是参数规模,而是有没有好的“经验外挂”。小模型配上好的技能库,可能比大模型硬扛更划算。

对企业而言,这意味着不必一味堆最大最强的模型,而是可以在工程侧下功夫,用技能库、工具、记忆机制把效果拉起来。成本与效果的平衡点,可能比想象中更靠前。

趋势洞察:Agent 的竞争转向“记忆与技能”

当基础模型能力趋于接近,Agent 之间的差距就落在“能不能积累经验”上。会复盘的 Agent 会越用越好,不会复盘的永远在原地打转。WikiSkill 指向的,正是这条从“一次性工具”到“持续成长助手”的路径。

未来评价一个 Agent,或许不只看它这次答得对不对,还要看它比上次进步了多少。

对开发者来说,这套思路还有一个隐含好处:技能库是可以被共享和复用的。一个团队踩过的坑,可以沉淀成条目,让其他成员甚至其他任务直接受益。智能体不再是“一个人”“一台机器”,而更像一个会积累团队经验的成员。

本文地址:https://www.163264.com/16113