3.8 KiB
3.8 KiB
标准并行 v0.2 路线图(方案B:分两期升级)
版本:v0.2-B
日期:2026-03-09
状态:待执行
0. 目标
在保持 v0.1 稳定的基础上,优先提升:
- 任务策略分流能力(避免全链路过度启动)
- 长期记忆与经验复用能力
- 系统可靠性与自恢复能力
1. 架构策略(保留/新增/后置)
保留(继续沿用)
- Val(总控)
- Helix(规划)
- Sentinel(审计)
- Anvil(执行)
- 现有状态机与双签门禁规则
本期新增(Phase 1)
- Oracle(Strategy):任务复杂度评估 + 执行策略选择
- Atlas(Memory/Knowledge):任务历史、决策记录、失败模式、偏好知识
- Prism 升级为 Reliability Engine:从“失败诊断”升级为“诊断+重试+回滚+自愈建议”
后置(Phase 2)
- Lab(Simulation):高风险任务模拟运行
- Forge(Tools):工具调用独立治理(从 Anvil 中拆分)
- Echo 精细化门控(默认后置到 Verify→Report)
2. Phase 1(推荐先做,3~5天)
2.1 Oracle 最小可用职责
- 输入:新任务 + 历史上下文
- 输出:策略决策
simple→ 轻链路(Val/Helix直出)medium→ Helix + Sentinel + Anvilcomplex→ 全链路 + 强审计
- 控制项:并发级别、预算等级、是否需要上报预警
2.2 Atlas 最小数据模型
建议先以 JSON/Markdown 双轨:
task_history:任务摘要、耗时、成本、结果decision_log:关键决策、理由、拍板人failure_patterns:失败特征、根因、修复方案、有效性user_prefs:用户偏好与边界条件
建议目录:
org/knowledge/atlas/task_history/org/knowledge/atlas/decision_log/org/knowledge/atlas/failure_patterns/org/knowledge/atlas/user_prefs/
2.3 Prism 升级项
- 失败分类:输入问题/工具问题/环境问题/策略问题
- 重试策略:立即重试/延迟重试/策略切换重试
- 回滚策略:软回滚/硬回滚/人工确认回滚
- 自愈建议:给出下次规避规则并写入 Atlas
3. Phase 2(稳定后,3~7天)
3.1 Lab(Simulation)
- 触发条件:高风险、高成本、跨边界任务
- 输出:风险估计、成本估计、失败预测
- 流程:Lab run → Sentinel 审批 → Real execution
3.2 Forge(Tools)
- 从 Anvil 拆出工具适配与执行统一层
- 管理对象:API / Shell / Web / DB / MCP
- 价值:减少 Anvil 超载,增强工具可靠性监控
4. 路由升级规则(v0.2-B)
新链路:
Intake → Oracle → (simple|medium|complex) → Helix → Sentinel → Execute → Verify → Report
路由建议:
- simple:Val+Helix(必要时 Sentinel 快审)
- medium:Helix→Sentinel→Anvil
- complex:Helix→Sentinel→(Lab 可选)→Anvil→Prism强化跟踪
5. 验收指标(v0.2-B)
质量
- 审计误放行率下降
- 失败后平均恢复时间(MTTR)下降
成本
- simple 任务平均 token 下降
- 全链路启动比例下降(但结果质量不降)
稳定性
- 连续失败次数下降
- 回滚成功率上升
记忆复用
- 任务引用历史案例比例上升
- 同类错误复发率下降
6. 实施顺序(执行建议)
- 先接入 Oracle 决策字段(不改旧链路)
- Atlas 目录与写入规范上线
- Prism 升级并绑定 Atlas 回写
- 跑 20 条样本任务做 A/B 对比(v0.1 vs v0.2-B)
- 指标达标后再进入 Phase 2
7. 风险与控制
-
风险:新增组件导致调试面扩大
-
控制:坚持“最小可用职责”,每次只新增一个控制变量
-
风险:策略误判导致过度简化
-
控制:Sentinel 对复杂度判定拥有复核权
-
风险:记忆污染
-
控制:Atlas 仅写入审计通过的结构化记录