Council of High Intelligence路线图解读:Session Metadata的Phase 2/3要做什么
【免费下载链接】council-of-high-intelligenceStructured multi-perspective deliberation for hard decisions. Run full councils, focused triads, or duo debates across Claude Code, Codex, Gemini CLI, and OpenCode.项目地址: https://gitcode.com/GitHub_Trending/co/council-of-high-intelligence
Council of High Intelligence 是一个面向Claude Code、Codex、Gemini CLI 和 OpenCode的多视角 AI 决策工具:它让 18 个不同人格的"AI 议会议员"围绕一个难题进行结构化辩论,最终输出一份保留分歧的判决。而在每份判决的末尾,项目都会悄悄追加一块叫Session Metadata(会话元数据)的遥测数据——这正是官方路线图 issue #7 的三个 Phase 的起点。本文带你解读 Phase 1 已经落地了什么、Phase 2(基准测试框架)和 Phase 3(成本/质量最优解)接下来要做什么。
Phase 1 已落地:Session Metadata 记录了什么
从 v1.1.0 开始,每次/council运行结束后,协调者都会自动在判决下方追加一个schema_version: 1的元数据块(见 SKILL.md 的 STEP 8,完整字段模板见 SKILL.md):
| 字段 | 含义 |
|---|---|
mode/panel_size/rounds_run | 会议模式、议员人数、实际轮次 |
tools_used | 议员是否调用了读文件、搜索等工具 |
provider_count | 本次动用了几个模型供应商 |
fallbacks_triggered | 哪些议员因超时/失败触发了回退路由 |
input/output_tokens_estimate、duration_seconds | 尽力而为的 Token 与耗时估算 |
这块遥测故意不是判决的组成部分——它被---分隔线隔在判决之外,原因有三:方便grep检索、方便重定向到日志文件、不污染可审计的决策产物本身。这个"形状固定、版本可控"的设计,就是 Phase 2 和 Phase 3 的地基。
Phase 2 路线图:搭建基准测试框架(Benchmarking Harness)
Phase 2 的目标,是用同一套 Schema 批量比较"不同的议会配置"。具体来说:
- 跑标准题库:项目已内置 Demo A–L 共 10 个标准决策场景(如"要不要开源我们的 agent 框架"、"该先上线德国还是法国"),见 demos/session-pack.md。
- 自动打分:每个场景配 0–2 分的快速评分细则(视角分散度、决策清晰度、反事实深度、证据纪律、执行质量,满分 10 分)。
- 聚合遥测:每次运行产出的 Session Metadata 被统一收集后,就能回答"full 模式 vs quick 模式、18 人全会 vs 3 人 triad、不同供应商路由,哪种组合的判决质量最高"。
换句话说,Phase 2 把现在靠人工肉眼评估的"这轮议会表现如何",变成一个可重复、可量化的评测流水线。
Phase 3 路线图:找到成本/质量的甜蜜点(Cost/Quality Sweet Spots)
Phase 3 建立在 Phase 2 的评测数据之上:既然每次会话都留下了Token 消耗、耗时、供应商数量、回退次数,项目就能计算"每一分判决质量花了多少钱",从而给出类似这样的结论——
- 高风险决策:
--full+ 多供应商路由值回票价; - 日常小决策:
--duo或--quick+ 单一本地模型即可,成本降一个数量级。
官方明确设定了启动门槛:先真实收集 5–10 个会话,让 Schema 稳定后再做统计(原文见 SKILL.opencode.md)。
这和判决模板中内置的Follow-Up 复查机制一脉相承:判决被当作"带复核日期的假设",执行后回填结果,正是 Phase 3 质量数据的来源之一。
多端一致性:四份协议同步镜像
Session Metadata 的 Phase 1 实现被同步到了所有宿主端,CI 会做协议一致性校验:
- Claude Code:SKILL.md(权威版本,功能先改这里)
- Codex:SKILL.codex.md
- Gemini CLI:SKILL.gemini.md
- OpenCode:SKILL.opencode.md
该功能于 v1.1.0 发布,见 CHANGELOG.md 中的 "Session Metadata block (schema_version: 1)" 条目。
上手体验:先攒数据,再等路线图
想亲自感受 Session Metadata 的产出?按 README.md 的指引安装即可(clone 后执行 install.sh 对应宿主端参数),然后任选一个模式开会:
/council --quick Should we add caching here? /council --duo Should we use microservices or a monolith?运行结束后,翻到输出最下方的Session Metadata块——你看到的那十几行,就是未来基准测试与成本优化的原始燃料。🔍
(完)
【免费下载链接】council-of-high-intelligenceStructured multi-perspective deliberation for hard decisions. Run full councils, focused triads, or duo debates across Claude Code, Codex, Gemini CLI, and OpenCode.项目地址: https://gitcode.com/GitHub_Trending/co/council-of-high-intelligence
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考