feat(org): add v0.2 roadmap (option B phased upgrade)
This commit is contained in:
@@ -0,0 +1,130 @@
|
||||
# 标准并行 v0.2 路线图(方案B:分两期升级)
|
||||
|
||||
版本:v0.2-B
|
||||
日期:2026-03-09
|
||||
状态:待执行
|
||||
|
||||
## 0. 目标
|
||||
在保持 v0.1 稳定的基础上,优先提升:
|
||||
1) 任务策略分流能力(避免全链路过度启动)
|
||||
2) 长期记忆与经验复用能力
|
||||
3) 系统可靠性与自恢复能力
|
||||
|
||||
---
|
||||
|
||||
## 1. 架构策略(保留/新增/后置)
|
||||
|
||||
### 保留(继续沿用)
|
||||
- Val(总控)
|
||||
- Helix(规划)
|
||||
- Sentinel(审计)
|
||||
- Anvil(执行)
|
||||
- 现有状态机与双签门禁规则
|
||||
|
||||
### 本期新增(Phase 1)
|
||||
- **Oracle(Strategy)**:任务复杂度评估 + 执行策略选择
|
||||
- **Atlas(Memory/Knowledge)**:任务历史、决策记录、失败模式、偏好知识
|
||||
- **Prism 升级为 Reliability Engine**:从“失败诊断”升级为“诊断+重试+回滚+自愈建议”
|
||||
|
||||
### 后置(Phase 2)
|
||||
- **Lab(Simulation)**:高风险任务模拟运行
|
||||
- **Forge(Tools)**:工具调用独立治理(从 Anvil 中拆分)
|
||||
- Echo 精细化门控(默认后置到 Verify→Report)
|
||||
|
||||
---
|
||||
|
||||
## 2. Phase 1(推荐先做,3~5天)
|
||||
|
||||
## 2.1 Oracle 最小可用职责
|
||||
- 输入:新任务 + 历史上下文
|
||||
- 输出:策略决策
|
||||
- `simple` → 轻链路(Val/Helix直出)
|
||||
- `medium` → Helix + Sentinel + Anvil
|
||||
- `complex` → 全链路 + 强审计
|
||||
- 控制项:并发级别、预算等级、是否需要上报预警
|
||||
|
||||
## 2.2 Atlas 最小数据模型
|
||||
建议先以 JSON/Markdown 双轨:
|
||||
- `task_history`:任务摘要、耗时、成本、结果
|
||||
- `decision_log`:关键决策、理由、拍板人
|
||||
- `failure_patterns`:失败特征、根因、修复方案、有效性
|
||||
- `user_prefs`:用户偏好与边界条件
|
||||
|
||||
建议目录:
|
||||
- `org/knowledge/atlas/task_history/`
|
||||
- `org/knowledge/atlas/decision_log/`
|
||||
- `org/knowledge/atlas/failure_patterns/`
|
||||
- `org/knowledge/atlas/user_prefs/`
|
||||
|
||||
## 2.3 Prism 升级项
|
||||
- 失败分类:输入问题/工具问题/环境问题/策略问题
|
||||
- 重试策略:立即重试/延迟重试/策略切换重试
|
||||
- 回滚策略:软回滚/硬回滚/人工确认回滚
|
||||
- 自愈建议:给出下次规避规则并写入 Atlas
|
||||
|
||||
---
|
||||
|
||||
## 3. Phase 2(稳定后,3~7天)
|
||||
|
||||
## 3.1 Lab(Simulation)
|
||||
- 触发条件:高风险、高成本、跨边界任务
|
||||
- 输出:风险估计、成本估计、失败预测
|
||||
- 流程:Lab run → Sentinel 审批 → Real execution
|
||||
|
||||
## 3.2 Forge(Tools)
|
||||
- 从 Anvil 拆出工具适配与执行统一层
|
||||
- 管理对象:API / Shell / Web / DB / MCP
|
||||
- 价值:减少 Anvil 超载,增强工具可靠性监控
|
||||
|
||||
---
|
||||
|
||||
## 4. 路由升级规则(v0.2-B)
|
||||
|
||||
新链路:
|
||||
`Intake → Oracle → (simple|medium|complex) → Helix → Sentinel → Execute → Verify → Report`
|
||||
|
||||
路由建议:
|
||||
- simple:Val+Helix(必要时 Sentinel 快审)
|
||||
- medium:Helix→Sentinel→Anvil
|
||||
- complex:Helix→Sentinel→(Lab 可选)→Anvil→Prism强化跟踪
|
||||
|
||||
---
|
||||
|
||||
## 5. 验收指标(v0.2-B)
|
||||
|
||||
### 质量
|
||||
- 审计误放行率下降
|
||||
- 失败后平均恢复时间(MTTR)下降
|
||||
|
||||
### 成本
|
||||
- simple 任务平均 token 下降
|
||||
- 全链路启动比例下降(但结果质量不降)
|
||||
|
||||
### 稳定性
|
||||
- 连续失败次数下降
|
||||
- 回滚成功率上升
|
||||
|
||||
### 记忆复用
|
||||
- 任务引用历史案例比例上升
|
||||
- 同类错误复发率下降
|
||||
|
||||
---
|
||||
|
||||
## 6. 实施顺序(执行建议)
|
||||
1) 先接入 Oracle 决策字段(不改旧链路)
|
||||
2) Atlas 目录与写入规范上线
|
||||
3) Prism 升级并绑定 Atlas 回写
|
||||
4) 跑 20 条样本任务做 A/B 对比(v0.1 vs v0.2-B)
|
||||
5) 指标达标后再进入 Phase 2
|
||||
|
||||
---
|
||||
|
||||
## 7. 风险与控制
|
||||
- 风险:新增组件导致调试面扩大
|
||||
- 控制:坚持“最小可用职责”,每次只新增一个控制变量
|
||||
|
||||
- 风险:策略误判导致过度简化
|
||||
- 控制:Sentinel 对复杂度判定拥有复核权
|
||||
|
||||
- 风险:记忆污染
|
||||
- 控制:Atlas 仅写入审计通过的结构化记录
|
||||
Reference in New Issue
Block a user