HugAgentOS — 浙大三引擎一体自进化 Agent 操作系统¶
Ch01.817 HugAgentOS — 浙大三引擎一体自进化 Agent 操作系统¶
📊 Level ⭐⭐ | 7.8KB |
entities/hugagentos-zju-self-evolution-agent-os-2026.md
HugAgentOS — 浙大三引擎一体自进化 Agent 操作系统¶
摘要¶
HugAgentOS 是浙江大学人工智能省部共建协同创新中心开源的自进化 Agent 操作系统:把 Harness 拆成记忆、技能、编排三个可自我成长的引擎,再为这种成长加上归因与本体两道关卡。它要解决的不是「让 Agent 记住」,而是经验如何长成能力、能力如何自行组队,以及这一切如何在可归因、可回放、可回滚的受控前提下发生——把「蒙对的偶然」变成「复制的必然」。
核心要点¶
- 四环节诊断:长期记忆不足以解决问题——经验沉淀不成能力、单点能力形不成协同、自我迭代缺少仲裁、进化不可审计,四缺口须同时补上。
- 三引擎一体:记忆引擎留存执行痕迹,技能引擎把反复奏效的做法蒸馏为可复用 Skill,编排引擎把多 Skill/工具/子智能体的稳定配合固化成默认打法,三级接力构成越用越强的飞轮。
- 归因关卡:一次失败最多只允许一个责任层,且有权判定任何一层都不需要改;责任不可区分、证据不足、根因不在自身三种情形一律不更新。
- 双闸生效:新能力须先隔离回放同一批历史任务、冻结其余版本比对效果,经用户确认才生效;进化控制台全程可见改动来源、依据与证据量,可随时撤回。
- 本体关卡:领域本体以四类可执行规范划定边界,确定性门禁不经 LLM、毫秒响应、零 Token 消耗,且同样校验三引擎的进化产物。
- 对照实验:产业链调研任务仅开关自沉淀能力:关闭时凭模型印象成文,开启时先检索再逐家核验,并自动挂载自蒸馏的「产业链调研手册」。
- 开源生态:AgentSkills、MCP 工具、Plugins 三大可扩展能力市场,配合子智能体、知识库、计划模式与安全沙箱,覆盖规划到交付全链路。
深度分析¶
三引擎一体:从经验到能力的三级接力¶
三引擎不是并列模块而是一条接力链:记忆引擎留存痕迹,技能引擎把经验蒸馏成单项能力,编排引擎把多项能力固化成一套打法。蒸馏由记忆与技能两引擎接力完成——记忆引擎识别出同类调研请求出现过 8 次、用了 6 种做法,技能引擎把反复奏效的 2 条路径提炼成带检查点、附失败记录的三步流程。蒸馏出的「产业链调研作业手册」含三条判断规则:未核验企业不得进入正文表格、舆情全正面不等于无风险(需标注数据盲区)、专利数量不等于技术实力——皆非通用写作建议,而是从用户失败案例归纳出的约束。编排引擎把检索、可视化、文档生成技能与评审子智能体的配合验证有效后,整体封装为默认流程。
归因关卡:一次失败只允许一个责任层¶
三个引擎都有权修改自身,一次失败会同时向三方发出信号:报告混入已退市公司,记忆引擎倾向记录其状态,技能引擎倾向追加核验步骤,编排引擎倾向更换数据源工具——三方同时动手,得到三处互相冲突的修改。归因模块被置于三引擎之前,职责不是找出该改哪里,而是先行裁定该不该改、由哪一层负责。它甚至有权判定任何一层都不需要改:知识库缺资料、模型无法产出要求格式、外部接口变更返回结构——根因不在三引擎的失败,强行修改只会产出永远无法修复的方案并污染统计数据。据此设定三条不更新规则:责任不可区分、证据强度不足、根因不在自身。
回放、确认与回滚:把软件工程的变更管理搬进进化流程¶
确认需要修改后,新能力先在隔离环境回放验证:同一批历史任务重跑一遍,只替换这一处、冻结其余资产版本,比对结果是否变好;通过后还需用户确认才正式生效。进化控制台全程可见每条改动建议的来源、依据的历史任务与证据量,生效后随时可撤回。这套「隔离回放 + 版本冻结 + 人工确认 + 可回滚」机制,实质是把软件工程的 diff review、A/B 验证与回滚纪律移植到 Agent 进化过程。
本体关卡与设计哲学:LLM 之外的确定性边界¶
自进化的另一半是约束。团队把行业知识写成机器可执行的领域本体库,含四类内容:概念(六个概念,带别名与继承)、关系(高风险结论至少一个可追溯来源,最小基数为 1)、约束(查询企业风险须先取企业 ID 再核验基本信息)、工作流(决定任务进入哪一档审查,高风险流程由多评审角色共同裁决)。智能体若跳过核验直接查询风险,一道确定性门禁会当场拦截——它不经 LLM,命中哪条规范即返回哪条编号,毫秒级响应、零 Token 消耗,给出的不是拒绝而是可执行的整改路径。这条边界不只约束日常任务,同样约束进化本身:三引擎新沉淀的记忆、技能与打法在正式启用前,须逐项通过概念对应、必需工具齐备、输出契约合规的本体校验。设计哲学由此清晰:LLM 负责生成,本体负责仲裁,归因负责裁定责任,用户保留最终确认权。
实践启示¶
- 自进化要成环而非单点补丁:四环节缺一不可,只加长期记忆会在下游暴露「记住了却用不上」。
- 多模块自迭代必须前置仲裁:一次失败只允许一个责任层,并保留「任何一层都不需要改」的判定权,避免根因在系统外时污染统计。
- 进化产物过「隔离回放 + 用户确认」双闸:新 Skill/流程先在冻结版本的历史任务集上回放比对,经用户确认生效,并为每条改动留存证据链。
- 把行业硬约束做成不经 LLM 的确定性门禁:四类规范可执行化,毫秒级拦截违规并给出整改路径,同样约束进化本身。
- 系统蒸馏的技能与人工 Skill 共用一套体系:可编辑、可启停、可分享,让自产能力与手写能力在同一市场竞争复用。
- 用对照实验证明自进化价值:同一任务仅开关自沉淀能力,对比执行路径与产出差异,是「越用越强」最直观的证据。
相关实体¶
- Agent 记忆架构 — 记忆引擎经验留存机制对应
- openJiuwen 自进化记忆 — 同命题参照实现
- EverMind Raven 自进化 Harness — 另一条自进化 Harness 路线
- 轨迹蒸馏为技能 — 技能蒸馏机制同源
- 技能自进化三条路径 — 技能层自进化对照
- Agent 自我改进回路 — 自进化闭环通用框架
→ 原文存档