craft-agents-oss 0.11.1 更新解读:GPT-5.6 全连接支持与 Max 思考级别原生下发
【免费下载链接】craft-agents-oss项目地址: https://gitcode.com/GitHub_Trending/cr/craft-agents-oss
本篇文章围绕 craft-agents-oss(Craft Agents)桌面应用 0.11.1 版本的 发布说明 展开,系统讲解该版本引入的三项核心变更:OpenAI GPT-5.6(Luna / Terra / Sol)三条模型线的接入方式、Max 思考级别从"上限封顶 XHigh"到"原生下发"的机制升级,以及 Pi SDK 0.80.6 带来的请求级输入 Token 定价层级。读完本文,你将理解这些更新在源码中的落点,知道如何切换默认模型与思考级别,并能准确评估长上下文会话的成本核算逻辑。
一、版本概览:0.11.1 更新了什么
0.11.1 的发布说明只有三个条目,但每一项都指向模型接入与成本核算的关键路径:
| 类别 | 内容 |
|---|---|
| Features | 通过 OpenAI API Key、ChatGPT 账号、Azure OpenAI 连接支持 GPT-5.6(Luna、Terra、Sol) |
| Features | Max 思考级别现在原生下发给支持它的模型(GPT-5.6、adaptive Claude 模型),不再封顶于 XHigh |
| Improvements | 新的 OpenAI 连接默认使用 GPT-5.6 Sol |
| Improvements | Pi SDK 升级至 0.80.6:引入请求级输入 Token 定价层级,为 GPT-5.4 / 5.5 / 5.6 提供准确的长上下文成本核算 |
下文依次深入这三块内容,并结合 packages/shared/src/config/llm-connections.ts 与 packages/shared/src/agent/thinking-levels.ts 的源码说明其底层实现。
二、GPT-5.6 三款模型与三种接入方式
2.1 模型命名:Luna / Terra / Sol
GPT-5.6 并非单一模型,而是按规格分为三款:
- GPT-5.6 Luna:对应模型 ID
gpt-5.6-luna - GPT-5.6 Terra:对应模型 ID
gpt-5.6-terra - GPT-5.6 Sol:对应模型 ID
gpt-5.6-sol
这一命名可以在连接配置的默认模型列表中直接印证。在 llm-connections.ts 中,PI_PREFERRED_DEFAULTS对 OpenAI 与 OpenAI Codex 两类提供方都给出了按优先级排列的模型清单,GPT-5.6 三款全部位居最前:
openai: ['gpt-5.6-sol', 'gpt-5.6-terra', 'gpt-5.6-luna', 'gpt-5.5', 'gpt-5.2', 'gpt-5.1', 'gpt-5', 'o4-mini', 'o3', 'gpt-4o'], 'openai-codex': ['gpt-5.6-sol', 'gpt-5.6-terra', 'gpt-5.6-luna', 'gpt-5.5', 'gpt-5.2', 'gpt-5.1', 'gpt-5', 'o4-mini', 'o3', 'gpt-4o'],从这份列表可以看出,GPT-5.6 是当前 OpenAI 模型族中的旗舰系列,向下依次兼容 GPT-5.5、GPT-5.2、GPT-5.1 等既有模型,旧模型依然保留在可选范围内。
2.2 三种接入方式
发布说明明确 GPT-5.6 可通过三类连接建立:
- OpenAI API Key:标准 API 直连方式,在应用设置中创建 OpenAI 类型连接并填入 API Key;
- ChatGPT 账号:通过 OAuth 登录 ChatGPT 账号接入(仓库 packages/shared/src/auth/ 下有完整的 OAuth 实现,如
chatgpt-oauth.ts、oauth-flow-store.ts),无需单独申请 API Key; - Azure OpenAI 连接:面向企业用户,通过 Azure 托管的 OpenAI 服务接入,密钥与端点由 Azure 门户提供。
这三种方式统一收敛到连接(Connection)配置模型中,由 llm-connections.ts 管理连接的提供商类型(openai、openai-codex、pi等)与默认模型选择,因此创建任意一类连接后即可在会话中选用 GPT-5.6。
三、Max 思考级别:从"封顶 XHigh"到"原生下发"
3.1 六层思考级别体系
craft-agents-oss 的思考级别(Thinking Level)是一套六级体系,其定义集中在 thinking-levels.ts:
export const THINKING_LEVEL_IDS = [ 'off', 'low', 'medium', 'high', 'xhigh', 'max', ] as const;off:关闭扩展思考low:轻度推理,响应更快medium:速度与推理的平衡点(新会话默认值)high:面向复杂任务的深度推理xhigh:超高推理,是 Anthropic 为 Opus 智能体/编码场景推荐的级别max:最大努力推理
这是会话级设置,同时支持工作区级默认值(见 storage.ts 中的defaultThinkingLevel字段)。
3.2 0.11.1 之前的限制
在 0.11.1 之前,max级别对多数模型不可达——即便你在界面上选择了max,实际下发给模型的上限仍被钳制在xhigh。这相当于浪费了模型本身具备的更深推理能力。
3.3 0.11.1 之后:按模型能力原生下发
0.11.1 改变了这一行为:只要目标模型原生支持max,应用就会把max原样传给模型。依据 thinking-levels.ts 中的 provider 映射说明:
- Anthropic 路径:使用 adaptive thinking(
thinking: { type: 'adaptive' })+ effort 参数控制深度,级别到xhigh/max均逐级透传(THINKING_TO_EFFORT映射见 thinking-levels.ts);在不接受xhigh的旧模型上,SDK 会静默回退到high; - Pi / OpenAI 路径:通过 Pi SDK 的
reasoning_effort参数 1:1 传递,最高可到max。Pi 会在模型内部做钳制——除 GPT-5.6 与 adaptive Claude 之外的模型,如果没有原生max支持,会自动降级到各自的上限。
这段逻辑同时说明了"为什么是 GPT-5.6 和 adaptive Claude":它们是当前明确具备原生max推理能力的两类模型,因此也是该版本升级后最先受益的对象。
3.4 思考 Token 预算兜底
对于不支持 adaptive thinking 的模型(如经 OpenRouter / Ollama 接入的非 Claude 模型),系统使用 Token 预算表兜底。在 thinking-levels.ts 中定义了按模型家族区分的预算:
const TOKEN_BUDGETS = { haiku: { off: 0, low: 2_000, medium: 4_000, high: 6_000, xhigh: 7_000, max: 8_000 }, default: { off: 0, low: 4_000, medium: 10_000, high: 20_000, xhigh: 26_000, max: 32_000 }, } as const;可以看到max在默认家族下对应 32k Token 的思考预算(Anthropic 对实时使用推荐的 32k 上限),Haiku 家族则封顶 8k。级别越高,分配的思考 Token 越多,这正是max能带来更深入推理的资源基础。
四、新 OpenAI 连接默认模型:GPT-5.6 Sol
0.11.1 将新创建 OpenAI 连接的默认模型设为GPT-5.6 Sol。这在 llm-connections.ts 的PI_PREFERRED_DEFAULTS中体现为排序优先级:openai与openai-codex两个提供方的首选默认列表都以gpt-5.6-sol开头。
源码注释解释了这一设计动机:Pi SDK 返回的模型列表按 ID 字母序排列,导致claude-3-5-haiku-20241022这类已废弃模型可能排在首位。为此,getDefaultModelsForConnection()会依据PI_PREFERRED_DEFAULTS对模型重排,把现代化、能力更强的模型排到最前,从而保证getDefaultModelForConnection()选中的永远是列表头部的高质量模型(见 llm-connections.ts 的排序实现与 llm-connections.test.ts 中对默认模型归属的断言)。
五、Pi SDK 0.80.6:请求级输入 Token 定价层级
5.1 更新内容
Pi SDK 从 0.80.5 升至0.80.6,核心变化是引入请求级(request-wide)输入 Token 定价层级。此前长上下文会话的成本核算依赖单一输入价格;现在 SDK 会按请求粒度应用定价层级,从而对GPT-5.4 / 5.5 / 5.6这类输入越长价格层级越复杂的模型给出准确的长上下文成本核算。
5.2 为什么重要
大模型输入定价通常分段:前若干 Token 属于低价格档,超出部分进入更高价格档。请求级定价层级意味着:
- 成本按实际消耗的 Token 段分别计价,不再用平均值近似;
- 长上下文会话(如大仓库代码分析、长文档处理)的账单更贴近真实;
- 对 GPT-5.6 这类支持原生
max思考的模型,思考 Token 的消耗也能被更精确地纳入成本统计。
六、发布说明在应用中的加载机制
顺带说明这些更新内容是如何进入应用的:发布说明源文件位于 apps/electron/resources/release-notes/,在运行时由 packages/shared/src/release-notes/index.ts 读取,并同步到用户目录下的~/.craft-agent/release-notes/。该模块支持从打包资源(CRAFT_BUNDLED_ASSETS_ROOT)读取,回退到process.cwd()/resources/release-notes,因此桌面端与 Docker/远程服务端都能展示同一份更新日志。
七、升级后如何使用新能力
升级到 0.11.1 后,可按以下路径使用新特性:
- 创建 OpenAI 连接:在设置中添加 OpenAI API Key、ChatGPT 账号或 Azure OpenAI 连接,新连接默认即为 GPT-5.6 Sol;如需调整,可在连接配置中选择
gpt-5.6-luna/gpt-5.6-terra/gpt-5.6-sol; - 开启 Max 思考:在会话设置或工作区默认值中把思考级别设为
Max(配置字段thinkingLevel,见 storage.ts)。若当前模型支持原生max(GPT-5.6、adaptive Claude),该级别会被原样下发;否则由模型侧自动降级,无需手动干预; - 观察成本:长上下文会话的成本统计将基于请求级输入 Token 定价层级,可在长会话中验证 GPT-5.4 / 5.5 / 5.6 的计费精度。
八、小结
0.11.1 是一版聚焦"模型能力上限"的增量更新:接入 GPT-5.6 三款旗舰模型并默认选用 Sol,将思考级别上限从 XHigh 释放到 Max 并只对支持原生max的模型生效,再借 Pi SDK 0.80.6 的请求级定价层级补齐长上下文成本核算。三处改动在源码中的落点清晰可查,用户侧只需创建 OpenAI 连接并将思考级别调到 Max,即可完整享受本次升级带来的能力提升。
【免费下载链接】craft-agents-oss项目地址: https://gitcode.com/GitHub_Trending/cr/craft-agents-oss
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考