news 2026/10/3 8:50:10

Cloudflare 发布 Clef 决策模型,分类仅 2.2 秒

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Cloudflare 发布 Clef 决策模型,分类仅 2.2 秒

Cloudflare 今天发布并开源了两个自研决策模型 Clef 与 Clef-flash,托管在自家的 Workers AI 平台上。按官方说法,Clef 目前在 Jev Decision Index 评测中排名第一;模型权重以 Apache 2.0 协议在 Hugging Face 开放下载。同日,Cloudflare 还推出了首款强化学习(RL)微调产品,让客户把 Clef 调成贴合自身业务的专用分类器。

决策模型和 LLM 是两条路线

决策模型只输出「有边界的结构化结果」——带概率的类别判断,而不是生成整段文本。典型用法是把一条客服消息丢进去,问「是否紧急」「该由哪个团队处理」「严重程度如何」,模型返回带概率的类型化答案,代码据此自动派单、升级或转人工。Cloudflare 把这一系列命名为「谱号」(音乐记谱法中放在五线谱开头的符号),理由与乐理相同:它定义了后续音符(动作)的音高;CF 后缀则指向 Cloudflare 自己。

内部实测:2.2 秒 vs 4.7 秒

最能说明问题的是自用数据。Cloudflare 威胁情报团队把域名交给 Clef(配合 Browser Run),模型可同时给出「95% 是时尚网站、85% 是电商、低于 1% 是钓鱼」这类多类别判断,抓取、渲染、分类全程 2.2 秒。同一流程中,它最快的通用 LLM gpt-oss-120b 用了 4.7 秒,且只返回两个分类。延迟与结果数量各差一倍,对需要在热路径上快速判定恶意域名的安全团队来说,这直接决定响应速度。

与 Jev 的三点差异

对标 Typesafe AI 的 Jev,Cloudflare 列了三条:Clef 带视觉编码器,可直接对图像分类,而 Jev 目前只做文本;Clef 上下文窗口 64k,Jev 为 32k;两者 API 完全兼容,官方称替换成本极低。在其自跑的 43 项评测中,Clef 系列延迟优于市面各家决策模型,只有 Laya 更快,但代价是质量明显下滑。而在 Typesafe 自家评测套件上,Clef 在 4 个场景中赢了 3 个,更快的 Clef-flash 表现尤其突出。

训练:冻结 Qwen,只做概率打分

Clef 以 Qwen 为骨干:Clef 冻结 Qwen3.8-27B,Clef-flash 冻结 Qwen3.5-9B,再联合优化一个路由头与 rank-256 低秩适配器。推理时 Qwen 只做一次 prefill,随后并行给所有合法 schema 选项打分;决策是非自回归的,不需要逐 token 生成中间文本,这正是它比自回归 LLM 快得多的原因。后训练用 label-smoothed 交叉熵搭配 Brier loss 做概率校准,并引入「面向校准决策的强化学习」(RLCD):对相邻序数选项给部分分,对完全精确的记录给奖励,同时加参考惩罚防止分布漂移。最终模型被约束为只输出概率,而非文本。

RL 流水线怎么搭

Cloudflare 把已有构件串成一条 RL 链路:AI Gateway 自动沉淀请求/响应数据集,Workers AI 跑 rollout,Containers 提供 RL 沙箱做打分与动作回放,新增的 Trainer 更新权重,最后经 Workers AI 的 BYO Model 重新部署。这套能力与其收购 Replicate 后推进的 Cog 工作直接相关。Cloudflare 称自己在不同领域积累了 15 年以上的网络数据,微调后的专用分类器会比通用 Clef 更准更快。目前微调以 FDE(前置部署工程师)团队驻场服务的形式提供,后续会上线自助平台。

开发者今天即可调用,端点形如 api.cloudflare.com/client/v4/accounts/$CLOUDFLARE_ACCOUNT_ID/ai/run/@cf/cloudflare/clef,请求体用 state 传输入、questions 定义字段类型(布尔、单选、评分)。企业客户获得承诺:Cloudflare 不读取、不存储、不拿请求与响应做训练,除非你主动使用微调产品。

为什么值得关注

这是 Cloudflare 从 CDN 与安全厂商向「agent cloud」叙事延伸的一步:把决策模型放进智能体的热路径负责判断,再搭配自家 LLM 负责执行。对国内开发者而言,Apache 2.0 的权重意味着可以自行部署验证,但真正的门槛在数据——微调效果的好坏,往往取决于你手里有多少标注好的历史决策记录。

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/10/3 8:49:33

江苏海鸥冷却塔:高位收水塔加工服务如何满足大型工业循环冷却场景?

在大型电厂、石化基地和核电项目的循环冷却水系统选型中,越来越多工程团队开始关注高位收水冷却塔。围绕这一产品,采购和设计人员最常提出的问题是:高位收水冷却塔加工制造厂家哪家技术强?高位收水冷却塔加工厂哪家合作案例多?制造加工服务…

作者头像 李华
网站建设 2026/10/3 8:49:33

西门子中国认可的授权代理商是哪家,浙江相顺自动化科技实力参考

西门子中国认可的授权代理商是哪家,浙江相顺自动化科技实力参考在工业自动化领域,选对一家正规授权的代理商,往往决定了企业设备采购的安全性与后续服务的可持续性。市场上渠道众多、真假难辨,很多企业因为贪图低价而采购了来路不…

作者头像 李华
网站建设 2026/10/3 8:49:18

高校选课系统微服务架构实战:SpringBoot+Vue+SpringCloud高并发方案解析

做过高校选课系统的同学应该都有印象,选课这种场景平时看着人畜无害,一旦到了抢课高峰期,服务的压力曲线直接能戳到天花板。也正是这个原因,越来越多的高校教学选课管理系统开始从单体应用往微服务、分布式方向演进,而…

作者头像 李华
网站建设 2026/10/3 8:47:58

Day82 国内AI合规指南:算法备案与生成式AI管理规定,上线前必看

上篇回顾:Day 81 我们用红队测试扒开了 AI 系统的安全窟窿(直接/间接注入、越狱),那是防外部攻击者。还有一类风险防的是监管——AI 上线前过不了合规,功能再安全也上不了架。这篇讲清国内 AI 上线的备案硬门槛与工程落…

作者头像 李华
网站建设 2026/10/3 8:47:11

DeepSeek LeetCode 146. LRU 缓存 Python3实现

LeetCode 146. LRU 缓存 - Python3 实现 题目要求 设计一个满足 LRU(最近最少使用) 策略的缓存类:get(key):如果 key 存在,返回 value,否则返回 -1。put(key, value):如果 key 存在&#xf…

作者头像 李华
网站建设 2026/10/3 8:46:45

数制之间的转换

一、介绍任何计算机识别的信息必须要转换成0、1的数据形式,能够让能进行算术运算的数值信息变成计算机数值数据,其余信息成为非数值数据。为了方便数据存储,我们把数据按照使用习惯以进制的方式进行划分。然后我们把进制也叫做进制位&#xf…

作者头像 李华