Files
val-blog/org/STANDARD_PARALLEL_V0.2_ROADMAP_B.md
T

3.8 KiB
Raw Blame History

标准并行 v0.2 路线图(方案B:分两期升级)

版本:v0.2-B
日期:2026-03-09
状态:待执行

0. 目标

在保持 v0.1 稳定的基础上,优先提升:

  1. 任务策略分流能力(避免全链路过度启动)
  2. 长期记忆与经验复用能力
  3. 系统可靠性与自恢复能力

1. 架构策略(保留/新增/后置)

保留(继续沿用)

  • Val(总控)
  • Helix(规划)
  • Sentinel(审计)
  • Anvil(执行)
  • 现有状态机与双签门禁规则

本期新增(Phase 1

  • OracleStrategy:任务复杂度评估 + 执行策略选择
  • AtlasMemory/Knowledge:任务历史、决策记录、失败模式、偏好知识
  • Prism 升级为 Reliability Engine:从“失败诊断”升级为“诊断+重试+回滚+自愈建议”

后置(Phase 2

  • LabSimulation:高风险任务模拟运行
  • ForgeTools:工具调用独立治理(从 Anvil 中拆分)
  • Echo 精细化门控(默认后置到 Verify→Report

2. Phase 1(推荐先做,3~5天)

2.1 Oracle 最小可用职责

  • 输入:新任务 + 历史上下文
  • 输出:策略决策
    • simple → 轻链路(Val/Helix直出)
    • medium → Helix + Sentinel + Anvil
    • complex → 全链路 + 强审计
  • 控制项:并发级别、预算等级、是否需要上报预警

2.2 Atlas 最小数据模型

建议先以 JSON/Markdown 双轨:

  • task_history:任务摘要、耗时、成本、结果
  • decision_log:关键决策、理由、拍板人
  • failure_patterns:失败特征、根因、修复方案、有效性
  • user_prefs:用户偏好与边界条件

建议目录:

  • org/knowledge/atlas/task_history/
  • org/knowledge/atlas/decision_log/
  • org/knowledge/atlas/failure_patterns/
  • org/knowledge/atlas/user_prefs/

2.3 Prism 升级项

  • 失败分类:输入问题/工具问题/环境问题/策略问题
  • 重试策略:立即重试/延迟重试/策略切换重试
  • 回滚策略:软回滚/硬回滚/人工确认回滚
  • 自愈建议:给出下次规避规则并写入 Atlas

3. Phase 2(稳定后,3~7天)

3.1 LabSimulation

  • 触发条件:高风险、高成本、跨边界任务
  • 输出:风险估计、成本估计、失败预测
  • 流程:Lab run → Sentinel 审批 → Real execution

3.2 ForgeTools

  • 从 Anvil 拆出工具适配与执行统一层
  • 管理对象:API / Shell / Web / DB / MCP
  • 价值:减少 Anvil 超载,增强工具可靠性监控

4. 路由升级规则(v0.2-B

新链路: Intake → Oracle → (simple|medium|complex) → Helix → Sentinel → Execute → Verify → Report

路由建议:

  • simpleVal+Helix(必要时 Sentinel 快审)
  • mediumHelix→Sentinel→Anvil
  • complexHelix→Sentinel→(Lab 可选)→Anvil→Prism强化跟踪

5. 验收指标(v0.2-B

质量

  • 审计误放行率下降
  • 失败后平均恢复时间(MTTR)下降

成本

  • simple 任务平均 token 下降
  • 全链路启动比例下降(但结果质量不降)

稳定性

  • 连续失败次数下降
  • 回滚成功率上升

记忆复用

  • 任务引用历史案例比例上升
  • 同类错误复发率下降

6. 实施顺序(执行建议)

  1. 先接入 Oracle 决策字段(不改旧链路)
  2. Atlas 目录与写入规范上线
  3. Prism 升级并绑定 Atlas 回写
  4. 跑 20 条样本任务做 A/B 对比(v0.1 vs v0.2-B
  5. 指标达标后再进入 Phase 2

7. 风险与控制

  • 风险:新增组件导致调试面扩大

  • 控制:坚持“最小可用职责”,每次只新增一个控制变量

  • 风险:策略误判导致过度简化

  • 控制:Sentinel 对复杂度判定拥有复核权

  • 风险:记忆污染

  • 控制:Atlas 仅写入审计通过的结构化记录