Skip to content

Repository files navigation

Skill Cortex:已安装 Skill 的经验引导式熟练化

本项目研究两个相互连接、但职责分离的问题:

  1. 不把全部 Skill metadata 常驻上下文时,Agent 如何发现相关的已安装 Skill。
  2. Agent 如何在真实使用一个已安装 Skill 的过程中,把其中稳定、可验证的部分逐渐固化为程序快路径。

项目当前不研究“从自由任务轨迹自动创造全新 Skill”。核心对象始终是用户已经安装的 Skill;程序化产物是它的派生执行表示。

权威阅读顺序

  1. AGENTS.md:所有 Agent 必须遵守的 project-local、安全和协作规则。
  2. 当前研究规范:当前范围、研究问题和验收原则。
  3. ADR-0006:双记忆架构:当前总体架构决定。
  4. ADR-0007:Prompt 外 Discovery:当前发现机制决定。
  5. ADR-0008:证据与 Procedure 晋升:当前学习、验证、失效和回退契约。
  6. 双记忆数据合同:规范字段、不变量、状态机和数据所有权。
  7. 多 Agent 实施计划:Phase 0~7、所有权、gate、验证和停止条件。
  8. Phase 0:Pi 宿主 API 核验:当前安装版本允许与不可用的宿主接口。
  9. Phase 0:Project-local 基线与 Pilot:技术栈、身份算法、数据政策和首个 pilot 决策。
  10. Phase 1 Gate P1 验收报告:Registry、静态 discovery、shadow adapter、测试和限制。
  11. ADR-0009:Practice Store 事件文件与显式删除:以不可变事件文件、claim 与 tombstone 落实原子身份和物理删除。
  12. Phase 2 Gate P2 验收报告:Practice Store、policy、删除、回放、测试与风险边界。
  13. ADR-0005:Benchmark 数据边界:仍有效的评测数据完整性规则,适用范围由 ADR-0007/0008 澄清。
  14. 相关工作与新颖性边界:哪些机制已有先行工作,哪些仍只是待验证假设。
  15. 对抗性架构审查:安全、归因、版本、回退和评测风险;其中 routing-only 阶段决定已经失效。

旧版“从轨迹学习新技能”讨论稿仅用于追溯项目纠偏过程,不再定义当前范围。

双记忆架构

flowchart TD
    T["用户任务"] --> D["External Discovery<br/>本地、自动、无 Router LLM"]
    SR["SkillRecord<br/>作者 metadata + 版本"] --> D
    AM["Activation Memory<br/>何时应该使用"] --> D
    D --> C["Top-K Skill Cards"]
    C --> S["主 Agent 选择 Skill / Multi-Skill / No-Skill"]
    S --> R["ExecutionResolver"]
    PM["Procedural Memory<br/>如何低成本执行"] --> R
    R -->|"守卫满足"| F["CompiledProcedure 快路径"]
    R -->|"无程序、失效或越界"| L["读取 SKILL.md 的慢路径"]
    F --> V["独立 verifier / 后置条件"]
    L --> V
    V --> P["PracticeStore<br/>不可变、可归因、隔离的证据"]
    P --> U1["更新 ActivationProfile 提案"]
    P --> U2["编译或修订 Procedure 提案"]
    U1 --> AM
    U2 --> PM
    F -->|"守卫或不变量失败"| L
Loading

两种记忆不能混为一个分数:

  • Activation Memory 改善“什么时候应当选择父 Skill”。
  • Procedural Memory 改善“父 Skill 被选中后,哪些步骤可以少用 LLM”。
  • 使用频率、成熟度和 procedure 数量不得直接提高 Skill 的 discovery 相关性。
  • CompiledProcedure 不注册为独立 Skill,避免候选爆炸和父子语义漂移。

当前阶段

Phase 2 已于 2026-08-14 通过 Gate P2;当前可启动 Phase 3:已有 Skill 的离线部分编译与晋升。 Practice Store、数据 policy、隔离、物理删除和 docx evaluation replay 已实现;真实宿主 observer、docx verifier 与用户环境写入仍未启用,证据见 Phase 2 Gate 报告。

Phase 0 已冻结:

  • SkillRecordActivationProfilePracticeEventCompiledProcedureExecutionDecision 的最小合同;
  • prompt 外、自动、无额外 LLM 的本地 discovery 边界;
  • 版本失效、权限继承、独立验证和安全回退规则;
  • Phase 3 pilot 已由 ADR-0010 改为 supabase-postgres-best-practices 的只读 SQL pagination 静态检测;installed Skill 保持只读,仓库只保存 provenance、完整哈希和项目原创评测案例。Phase 2 的 synthetic docx replay 仅保留为历史 Practice Store 证据。

Phase 2 只建立 append-only、脱敏、隔离且可删除的 Practice Store;没有可信 Practice Store 之前,不允许自动编译、调权或进入程序快路径。

ADR 状态

ADR 当前地位 仍可复用的内容
ADR-0006 当前有效 Installed Skill 语义来源、双记忆、Practice Store、ExecutionResolver
ADR-0007 当前有效 prompt 外自动 Top-K、无 Router LLM、候选卡、补搜与安全隔离
ADR-0008 当前有效 Practice Evidence、双记忆更新、Procedure 晋升、失效和回退
ADR-0005 Accepted,scope 由 ADR-0007/0008 澄清 人工 Gold、真实 shadow observation 与 synthetic stress 的证据隔离
ADR-0001 历史,已被 ADR-0006 替代 routing-only 方案演化记录
ADR-0002 历史,已被 ADR-0006/0007 替代 通用核心、adapter 和 shadow 思路的来源记录
ADR-0003 历史,已被 ADR-0007 替代 本地检索方案与替代项分析的来源记录
ADR-0004 历史,相关 scope 已被 ADR-0007/0008 替代 成本与质量硬门槛的来源记录

范围说明以当前研究规范为准;具体架构决策以 ADR-0006~0008 为准。

不可突破的约束

  • 作者提供的原始 Skill 文件与 metadata 保持不可变;学习结果只写入派生层。
  • 熟练度不得扩大权限。删除、发送、付款、凭据等动作始终经过独立 authorization gate。
  • Skill source、工具 schema、权限或相关环境变化后,受影响的 procedure 必须失效。
  • 守卫、前置条件或结果不变量失败时,立即停止快路径并回退原始 SKILL.md 慢路径。
  • 评测轨迹、秘密和未经归因的成功不得进入学习数据。
  • 任何新颖性表述都必须先经过完整文献、产品、专利检索和逐项 claim chart。

About

Skill Cortex research prototype for activation and procedural memory

Resources

Stars

0 stars

Watchers

0 watching

Forks

Releases

Packages

Contributors

Languages