绝版回放:Claude Code 直连 V4 Pro 0813 的最后一套可用配置
【免费下载链接】DeepSeek-V4-Pro-0813项目地址: https://ai.gitcode.com/hf_mirrors/deepseek-ai/DeepSeek-V4-Pro-0813
当 DeepSeek 官方宣布 V4.1 Flash 上线的同时,把 V4 Pro 服务的下线日期推迟到 9 月 14 日,围绕deepseek-v4-pro的整套接入配置就正式进入了"倒计时"状态。再叠加 7 月 24 日deepseek-chat、deepseek-reasoner旧模型名的退役,以及 Claude Code 4.8 悄然收紧的第三方模型参数校验,三重时间戳叠加在一起,让"Claude Code 直连 V4 Pro"这件事从常规教程变成了需要回放存档的绝版操作。本文基于社区实战情报与 DeepSeek-V4-Pro-0813 仓库源码,把最后这套可用配置完整回放一遍,并说明它对迁移 V4.1 Flash 的实际参考价值。
为什么说是"最后一套配置":三重时间戳
先厘清绝版的原因,这决定了整套配置的"保质期"。
第一重:模型服务下线。官方在发布 V4.1 Flash 时宣布 V4 Pro 服务推迟到 9 月 14 日下线。也就是说,所有指向deepseek-v4-pro的 API 请求都会在某个时间点后失效,配置本身不复存在,"直连步骤"由此成为历史回放。
第二重:旧模型名退役。早在 5 月,DeepSeek 就预告deepseek-chat、deepseek-reasoner将于 7 月 24 日退役,V4 体系重构为deepseek-v4-pro与deepseek-v4-flash两个注册名。从社区反馈看,大量存量 Claude Code 配置正是死在这一步——settings.json 里还写着旧名,请求直接 404/400。
第三重:客户端校验收紧。Claude Code 4.8 对第三方模型接入做了参数白名单前置化处理:过去写--model deepseek旧客户端会自动补全,新版本则在命令解析阶段直接拦截,报{"code":"invalid_parameter","message":"The supported API model names are deepseek-v4-pro or deepseek"}。问题不在服务端,而在 CLI 自身维护的模型名清单——必须一字不差地写deepseek-v4-pro。
三件事叠加,社区里流传的那批"能用就行"的模糊配置全部失效,能用的只剩一套:精确到模型标识符的显式直连。
直连回放:从 API Key 到 settings.json
Claude Code 直连 DeepSeek 的本质,是把 Anthropic 协议端点替换为 DeepSeek 的 OpenAI 兼容网关。整个链路分三步,全部有社区文章反复验证过。
第一步:准备 API Key。在 DeepSeek 开放平台创建 API Key 并完成充值。Key 的作用是填充ANTHROPIC_AUTH_TOKEN这个环境变量——Claude Code 只认这个字段,不会自己去 DeepSeek 拿凭证。
第二步:通过 CLI 或环境变量指路。关键是把三个参数同时写对:
export ANTHROPIC_BASE_URL="https://api.deepseek.com/anthropic" export ANTHROPIC_AUTH_TOKEN="sk-你的APIKey" export ANTHROPIC_MODEL="deepseek-v4-pro"其中ANTHROPIC_MODEL是社区踩坑最密集的字段:写成deepseek、deepseek-v4、deepseek-pro都会在 4.8 的 CLI 校验层被拦下,必须精确到deepseek-v4-pro。这对应 DeepSeek 服务端model_name字段的精确值,也是网关侧路由、计费、版本管理的唯一锚点。
第三步:持久化到 settings.json。临时环境变量容易在重启后丢失,社区普遍的做法是把上述三个变量固化到 Claude Code 的 settings.json(macOS 位于~/.claude/settings.json),并配合 cc-switch 这类工具做多模型切换。参考社区整理的结构如下:
{ "env": { "ANTHROPIC_BASE_URL": "https://api.deepseek.com/anthropic", "ANTHROPIC_AUTH_TOKEN": "sk-你的APIKey", "ANTHROPIC_MODEL": "deepseek-v4-pro" }, "model": "deepseek-v4-pro" }配好后在终端敲一句claude "写一个快速排序"即可验证:能正常流式返回,说明直连成功;返回 400invalid_parameter,第一优先级检查ANTHROPIC_MODEL是否精确匹配;返回 404,检查服务是否已下线或模型名是否已被新版本替换。
关键细节:模型标识符之外的三件事
配置能跑通只是第一步。回放整套直连方案时,有三个仓库级细节值得单独记录,它们决定了"可用"的上限。
细节一:thinking 模式与 reasoning_effort 三级控制。DeepSeek-V4-Pro-0813 没有随权重发布 Jinja 格式的 chat template,而是提供了专用的编码方案(见 encoding/README.md 与 encoding/encoding_dsv4.py)。encode_messages是核心入口,支持chat与thinking两种模式,其中 thinking 模式下的reasoning_effort参数支持low、high、max三档。值得注意的实现细节:reasoning_effort 不是服务端参数,而是一个文本前缀——在 encoding/encoding_dsv4.py 的REASONING_EFFORT_PROMPTS中,high档会向提示词头部注入 "Reasoning Effort: Absolute maximum...",max档注入 "Reasoning Effort: Beyond maximum...",其余编码完全不变。也就是说,Claude Code 这类客户端若想精细控制思考强度,本质上是往请求前缀里拼文本,这决定了你在 settings.json 里看到的"思考开关"与官方reasoning_effort是两层不同的机制。
细节二:工具调用走 DSML 格式,不是 OpenAI 的 function calling 语法。V4 的工具调用使用|DSML|标记语言,`
【免费下载链接】DeepSeek-V4-Pro-0813项目地址: https://ai.gitcode.com/hf_mirrors/deepseek-ai/DeepSeek-V4-Pro-0813
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考