嗨,我是小华同学,专注解锁高效工作与前沿AI工具!每日精选开源技术、实战技巧,助你省时50%、领先他人一步。👉免费订阅,与10万+技术人共享升级秘籍!
OpenSpace 最值得看的,不是又多了一个 Agent 框架,而是它在解决一个更扎心的问题:Agent 做完任务后,经验到底有没有留下来?
如果你用过 Claude Code、Codex、Cursor、OpenClaw 或 MCP 工具链,大概率见过这种情况:同一个坑,今天踩一次,明天换个会话继续踩。
这篇先用 3 分钟讲清:OpenSpace 想怎么让 Agent 越做越会、越做越省,以及它适不适合放进你的项目里。
这个项目为什么值得看
OpenSpace 是 HKUDS 开源的一个 Agent 技能进化项目。我今天抓到的数据是:6,660 Star、822 Fork、Python、MIT 协议。
README 里的定位非常直接:
让 Agent 更聪明、更低成本、自我进化。
它不是单纯让 Agent 多接几个工具,而是围绕 Skill 做一套生命周期:执行、记录、监控、分析、修复、派生、沉淀、共享。
说人话就是:
不要让 Agent 每次都从零开干,而是把成功经验变成下一次能复用的 Skill。

它解决的不是“会不会调用工具”
现在很多 Agent 已经能调用工具、写代码、查资料、跑脚本。
但真正做复杂任务时,问题往往不是“没有工具”,而是:
| 常见痛点 | 真实表现 | OpenSpace 的方向 |
|---|---|---|
| token 白烧 | 每次都重新推理、重新试错 | 复用成功流程,减少重复探索 |
| 技能会过期 | API、页面、依赖一变,旧 Skill 静默失效 | 监控质量,触发修复 |
| 经验困在单个 Agent | 一个 Agent 学会了,另一个还要重来 | 通过 Skill 社区共享演化结果 |
| 复杂任务难稳定 | 工具链很长,中间一步错就崩 | 把可靠执行模式沉淀成 Skill |
这就是 OpenSpace 的切入点:Agent 不该只是一次性执行器,而应该有经验积累。

三个关键词:FIX、DERIVED、CAPTURED
OpenSpace 里最容易被技术读者记住的,是三种 Skill 演化模式。
FIX:修坏掉的 Skill。
当工具、依赖、接口变化导致原来的 Skill 不稳定时,它不是简单报错结束,而是尝试定位问题并修复。
DERIVED:从旧 Skill 派生更强版本。
如果一个任务场景需要更细分的能力,它可以从已有 Skill 演化出更适合的新 Skill,而不是把所有能力都塞进一个大而全文件。
CAPTURED:把成功经验捕获成新 Skill。
如果某次执行里出现了可复用的工作流,它可以被沉淀出来,下次类似任务就不用重新摸索。
这三个词放在一起,OpenSpace 的思路就清楚了:
让 Skill 不再是静态说明书,而是会被真实任务不断打磨的工程资产。

README 里最硬的数字
OpenSpace 的 README 里给了一组很适合传播的 benchmark 数字。
它在 GDPVal 上做评估:这个数据集包含真实世界专业任务,覆盖多个职业场景。README 里写到,OpenSpace 使用和 ClawWork 基线相同的骨干 LLM:Qwen 3.5-Plus。
关键数字包括:
- 50 个专业任务
- 收入提升 4.2 倍
- Phase 2 token 用量约为 Phase 1 的 45.9%
- 50 个 Phase 1 任务中自主进化出 165 项 Skill
我不会把这些数字理解成“所有场景都能 4.2 倍”。更合理的理解是:
当任务有重复模式、工具链较长、交付质量需要验证时,Skill 演化才更容易释放价值。
这也是为什么它对文档生成、合规表单、表格、工程项目、多文件工作流这类任务更有想象力。
工作流可以这样理解
OpenSpace 的接入方式有两条线:
1. 作为 Agent 的 Skill / MCP 能力接入,比如给 Claude Code、Codex、OpenClaw、nanobot 等使用。 2. 直接把 OpenSpace 当成 AI co-worker,用它执行编码、搜索、工具调用等任务。
但从产品逻辑看,真正重要的是这条闭环:
任务执行不是终点,执行记录会反过来喂给 Skill 演化系统。

这就像给 Agent 加了一个“复盘系统”。
不是今天做完就散,而是把过程、问题、修复、成功路径都变成下一次能用的东西。
程序员为什么该关注
如果你正在做 Agent 产品、自动化工具、MCP 服务、内部研发助手,这个项目值得先收藏。
| 你的场景 | 可能获得的启发 |
|---|---|
| 做 Agent 平台 | Skill 生命周期不能只靠人工维护 |
| 做企业自动化 | 成功流程可以沉淀成可审计、可复用资产 |
| 做 Coding Agent | 修复工具链、验证输出、复用工作流很关键 |
| 做知识/工作流系统 | 经验共享比单次问答更有长期价值 |
| 研究成本优化 | 降 token 不一定只靠模型路由,也可以靠少重复试错 |
我最看重的一点是:
OpenSpace 把“Agent 经验如何沉淀”这个问题,从玄学变成了可设计的工程系统。
但它不是万能药
这类项目很容易被标题吹过头,所以边界也要说清楚。
OpenSpace 不是装上就让所有 Agent 自动封神。它更适合有复杂任务、长期使用、重复流程、Skill 维护成本的场景。
如果你的任务本来就是一次性问答,或者流程很短、几乎没有复用价值,那 Skill 演化的收益就没那么明显。
另外,Skill 共享也一定要考虑安全边界:权限、凭证、提示注入、危险操作、团队可见性,都不能靠热情解决。
Agent 越会学习,越需要治理。
我的判断
OpenSpace 的价值,不是告诉我们“Agent 又强了”,而是提醒我们:
下一阶段的 Agent 工程化,可能不只是拼模型、拼工具,而是拼 经验复用能力。
模型负责思考,工具负责执行,而 Skill 负责把成功经验留下来。
这篇先作为项目速览。后面如果大家感兴趣,我会继续把它的 MCP 接入方式、host_skills 设计、Skill 演化源码、以及 GDPVal benchmark 怎么看的问题拆开讲。
如果你也关注 AI Agent、MCP、开源项目和 LLM 工程化,可以继续关注我的后续更新。
项目地址
https://github.com/HKUDS/OpenSpace