本项目研究两个相互连接、但职责分离的问题:
- 不把全部 Skill metadata 常驻上下文时,Agent 如何发现相关的已安装 Skill。
- Agent 如何在真实使用一个已安装 Skill 的过程中,把其中稳定、可验证的部分逐渐固化为程序快路径。
项目当前不研究“从自由任务轨迹自动创造全新 Skill”。核心对象始终是用户已经安装的 Skill;程序化产物是它的派生执行表示。
- AGENTS.md:所有 Agent 必须遵守的 project-local、安全和协作规则。
- 当前研究规范:当前范围、研究问题和验收原则。
- ADR-0006:双记忆架构:当前总体架构决定。
- ADR-0007:Prompt 外 Discovery:当前发现机制决定。
- ADR-0008:证据与 Procedure 晋升:当前学习、验证、失效和回退契约。
- 双记忆数据合同:规范字段、不变量、状态机和数据所有权。
- 多 Agent 实施计划:Phase 0~7、所有权、gate、验证和停止条件。
- Phase 0:Pi 宿主 API 核验:当前安装版本允许与不可用的宿主接口。
- Phase 0:Project-local 基线与 Pilot:技术栈、身份算法、数据政策和首个 pilot 决策。
- Phase 1 Gate P1 验收报告:Registry、静态 discovery、shadow adapter、测试和限制。
- ADR-0009:Practice Store 事件文件与显式删除:以不可变事件文件、claim 与 tombstone 落实原子身份和物理删除。
- Phase 2 Gate P2 验收报告:Practice Store、policy、删除、回放、测试与风险边界。
- ADR-0005:Benchmark 数据边界:仍有效的评测数据完整性规则,适用范围由 ADR-0007/0008 澄清。
- 相关工作与新颖性边界:哪些机制已有先行工作,哪些仍只是待验证假设。
- 对抗性架构审查:安全、归因、版本、回退和评测风险;其中 routing-only 阶段决定已经失效。
旧版“从轨迹学习新技能”讨论稿仅用于追溯项目纠偏过程,不再定义当前范围。
flowchart TD
T["用户任务"] --> D["External Discovery<br/>本地、自动、无 Router LLM"]
SR["SkillRecord<br/>作者 metadata + 版本"] --> D
AM["Activation Memory<br/>何时应该使用"] --> D
D --> C["Top-K Skill Cards"]
C --> S["主 Agent 选择 Skill / Multi-Skill / No-Skill"]
S --> R["ExecutionResolver"]
PM["Procedural Memory<br/>如何低成本执行"] --> R
R -->|"守卫满足"| F["CompiledProcedure 快路径"]
R -->|"无程序、失效或越界"| L["读取 SKILL.md 的慢路径"]
F --> V["独立 verifier / 后置条件"]
L --> V
V --> P["PracticeStore<br/>不可变、可归因、隔离的证据"]
P --> U1["更新 ActivationProfile 提案"]
P --> U2["编译或修订 Procedure 提案"]
U1 --> AM
U2 --> PM
F -->|"守卫或不变量失败"| L
两种记忆不能混为一个分数:
- Activation Memory 改善“什么时候应当选择父 Skill”。
- Procedural Memory 改善“父 Skill 被选中后,哪些步骤可以少用 LLM”。
- 使用频率、成熟度和 procedure 数量不得直接提高 Skill 的 discovery 相关性。
CompiledProcedure不注册为独立 Skill,避免候选爆炸和父子语义漂移。
Phase 2 已于 2026-08-14 通过 Gate P2;当前可启动 Phase 3:已有 Skill 的离线部分编译与晋升。 Practice Store、数据 policy、隔离、物理删除和 docx evaluation replay 已实现;真实宿主 observer、docx verifier 与用户环境写入仍未启用,证据见 Phase 2 Gate 报告。
Phase 0 已冻结:
SkillRecord、ActivationProfile、PracticeEvent、CompiledProcedure和ExecutionDecision的最小合同;- prompt 外、自动、无额外 LLM 的本地 discovery 边界;
- 版本失效、权限继承、独立验证和安全回退规则;
- Phase 3 pilot 已由 ADR-0010 改为
supabase-postgres-best-practices的只读 SQL pagination 静态检测;installed Skill 保持只读,仓库只保存 provenance、完整哈希和项目原创评测案例。Phase 2 的 syntheticdocxreplay 仅保留为历史 Practice Store 证据。
Phase 2 只建立 append-only、脱敏、隔离且可删除的 Practice Store;没有可信 Practice Store 之前,不允许自动编译、调权或进入程序快路径。
| ADR | 当前地位 | 仍可复用的内容 |
|---|---|---|
| ADR-0006 | 当前有效 | Installed Skill 语义来源、双记忆、Practice Store、ExecutionResolver |
| ADR-0007 | 当前有效 | prompt 外自动 Top-K、无 Router LLM、候选卡、补搜与安全隔离 |
| ADR-0008 | 当前有效 | Practice Evidence、双记忆更新、Procedure 晋升、失效和回退 |
| ADR-0005 | Accepted,scope 由 ADR-0007/0008 澄清 | 人工 Gold、真实 shadow observation 与 synthetic stress 的证据隔离 |
| ADR-0001 | 历史,已被 ADR-0006 替代 | routing-only 方案演化记录 |
| ADR-0002 | 历史,已被 ADR-0006/0007 替代 | 通用核心、adapter 和 shadow 思路的来源记录 |
| ADR-0003 | 历史,已被 ADR-0007 替代 | 本地检索方案与替代项分析的来源记录 |
| ADR-0004 | 历史,相关 scope 已被 ADR-0007/0008 替代 | 成本与质量硬门槛的来源记录 |
范围说明以当前研究规范为准;具体架构决策以 ADR-0006~0008 为准。
- 作者提供的原始 Skill 文件与 metadata 保持不可变;学习结果只写入派生层。
- 熟练度不得扩大权限。删除、发送、付款、凭据等动作始终经过独立 authorization gate。
- Skill source、工具 schema、权限或相关环境变化后,受影响的 procedure 必须失效。
- 守卫、前置条件或结果不变量失败时,立即停止快路径并回退原始
SKILL.md慢路径。 - 评测轨迹、秘密和未经归因的成功不得进入学习数据。
- 任何新颖性表述都必须先经过完整文献、产品、专利检索和逐项 claim chart。