港大OpenSpace开源:一个让AI Agent自动进化的技能管理层

当Claude Code、OpenClaw、Cursor们变得越来越强大,一个被忽视的致命弱点始终存在:它们从不从经验中学习——每次任务都从零推理,浪费Token;上一个Agent踩过的坑,下一个Agent再踩一遍;手写的Skill随API变化悄悄损坏,没有人知道。香港大学数据科学实验室(HKUDS)于2026年3月开源的OpenSpace正是为解决这一痛点而生。

OpenSpace

这个项目将自己定位为AI Agent的技能管理层(Skill Management Layer),让Agent在完成真实任务的过程中自动积累、改进和共享技能——三个月GitHub Star突破6400颗,迅速成为今年最受关注的开源AI基础设施之一。

一、当前Agent的三大痼疾

OpenSpace团队在项目文档中明确指出了现有Agent框架的核心问题:

  • Token浪费严重。每次遇到类似任务,Agent都从零开始推理。上次成功解决的模式完全无法复用,造成不必要的成本消耗。
  • 重复犯错。Agent A踩过的坑,Agent B在同样的任务上再踩一遍。没有跨Agent的知识共享机制。
  • 技能退化。手写的Skill随着API更新、工具变化,悄悄就坏了。没有任何监控和修复机制,直到任务失败才发现。

二、OpenSpace的三大超能力

自进化(Self-Evolution)

OpenSpace为每个Skill配备了四层自动维护机制:AUTO-FIX(执行失败时自动诊断并修复)、AUTO-IMPROVE(将成功执行模式提取为新版本)、AUTO-LEARN(从实际使用中捕获有效工作流),以及质量监控(持续追踪每个Skill的错误率和使用频率)。

真实任务记录

项目特别强调真实任务记录的重要性——Skill是否被选中、是否成功调用、是否完成任务或触发Fallback,这些真实数据构成了质量判断的核心上下文。版本更新时,系统会保留完整的证据链、验证结果和历史记录。

Local-First架构

OpenSpace采用本地优先的设计,Skill和任务记录优先存储在本地,支持加密和隐私保护;同时提供可选的云端同步,实现跨Agent的知识协作与共享。

三、GDPVal基准:任务质量显著提升

HKUDS团队为OpenSpace构建了专门的GDPVal基准测试,模拟真实商业场景中Agent的表现。测试结果显示,接入OpenSpace的Agent相比基线版本,任务完成质量显著提升,部分场景效果提升达4.2倍。这一数据为OpenSpace的实际价值提供了有力证明。

港大OpenSpace的开源,为AI Agent的技能管理提供了新的标准方案,有望推动整个行业向更智能、更自主的方向发展。随着AI技术的不断进步,技能管理将成为Agent系统的核心能力之一,而OpenSpace的出现恰逢其时。

此外,OpenSpace的代码已在GitHub上开源,开发者可自由查看和修改。

AD:精心整理了2000+好用的AI工具!点此获取

相关推荐

1 1

免费AI工具合集,点击进入

AI对话

玉米AI助手