WikiSkill:让智能体把一次次经验编译成可持续进化的技能
导语
智能体要在长期交互中变得更可靠,不能只依赖模型本身的参数或一次性的上下文。它还需要把任务执行中发现的策略、失败原因和可复用流程保存下来,并在下一轮任务中真正用起来。围绕这一问题,WikiSkill提出了一种“技能与知识库共同进化”的框架,试图解决智能体经验难以沉淀的问题。
从零散经验到持久知识
在许多技能自动发现方法中,智能体会根据执行轨迹生成或修改技能。但指导这些修改的线索通常散落在历史优化记录中:哪些步骤有效、哪些错误反复出现、某种策略适用于什么条件,往往没有被系统整理。因此,后续迭代很难充分利用过去的探索。
WikiSkill将系统拆分为三个层次:
- 原始执行经验:包括任务过程、结果以及相关反馈,是最底层的观测材料。
- 持久化Wiki知识库:持续从经验中提炼规律、方法和适用条件,形成可查询、可积累的知识。
- 可执行技能:把知识转化为智能体可以调用的工作流、提示或操作策略。
关键变化在于,经验不再只用于生成当前版本的技能,而是会被不断汇总进Wiki。后续技能更新可以建立在此前积累的知识之上,从而减少重复试错,也让技能演化拥有更稳定的记忆结构。
研究给出的主要观察
论文在多种模型和基准上比较了WikiSkill与现有技能进化方法。结果显示,WikiSkill整体表现更好,并在大多数模型—基准组合中超过不使用技能的基线。研究还观察到,技能进化与模型规模并非替代关系:更大的模型通常能从进化技能中获得更多收益,但较小模型在获得合适技能后,也可能显著超过没有技能支持的更大模型。
另一个重要结果是技能具有跨模型、跨模型家族迁移的潜力。某个模型产生的技能不一定只能服务于自身,甚至其他模型演化出的技能可能优于模型自己生成的版本。这意味着,技能可以逐渐成为独立于底层模型的可复用资产,而不是某次运行的临时产物。
消融实验进一步表明,Wiki中的持续知识积累是效果的关键。如果只保留技能更新、却削弱或移除知识沉淀机制,进化收益会受到影响。
意义与局限
WikiSkill的价值不只是增加一个“记忆模块”,而是重新划分了经验、知识和执行能力之间的关系:经验负责提供证据,知识库负责组织和压缩,技能负责在任务中落地。这种分层设计为构建长期运行的智能体提供了更清晰的工程路径,也为跨模型共享技能创造了接口。
不过,素材未披露具体基准、模型配置和提升幅度,因此目前更适合将其理解为一种得到实验支持的框架方向,而非对所有任务都成立的普遍结论。实际系统仍需处理知识过时、错误经验累积以及技能适用范围判断等问题。总体来看,WikiSkill提示了智能体进化的一个重要转向:真正可持续的学习,不仅要生成更好的技能,还要建立能够长期保存和整理经验的知识基础设施。
评论
正在确认登录状态……
正在加载评论……