Cloudflare 发布 Clef 决策模型,分类仅 2.2 秒

发布时间:2026/10/3 8:50:20

Cloudflare 发布 Clef 决策模型,分类仅 2.2 秒 Cloudflare 今天发布并开源了两个自研决策模型 Clef 与 Clef-flash托管在自家的 Workers AI 平台上。按官方说法Clef 目前在 Jev Decision Index 评测中排名第一模型权重以 Apache 2.0 协议在 Hugging Face 开放下载。同日Cloudflare 还推出了首款强化学习RL微调产品让客户把 Clef 调成贴合自身业务的专用分类器。决策模型和 LLM 是两条路线决策模型只输出「有边界的结构化结果」——带概率的类别判断而不是生成整段文本。典型用法是把一条客服消息丢进去问「是否紧急」「该由哪个团队处理」「严重程度如何」模型返回带概率的类型化答案代码据此自动派单、升级或转人工。Cloudflare 把这一系列命名为「谱号」音乐记谱法中放在五线谱开头的符号理由与乐理相同它定义了后续音符动作的音高CF 后缀则指向 Cloudflare 自己。内部实测2.2 秒 vs 4.7 秒最能说明问题的是自用数据。Cloudflare 威胁情报团队把域名交给 Clef配合 Browser Run模型可同时给出「95% 是时尚网站、85% 是电商、低于 1% 是钓鱼」这类多类别判断抓取、渲染、分类全程 2.2 秒。同一流程中它最快的通用 LLM gpt-oss-120b 用了 4.7 秒且只返回两个分类。延迟与结果数量各差一倍对需要在热路径上快速判定恶意域名的安全团队来说这直接决定响应速度。与 Jev 的三点差异对标 Typesafe AI 的 JevCloudflare 列了三条Clef 带视觉编码器可直接对图像分类而 Jev 目前只做文本Clef 上下文窗口 64kJev 为 32k两者 API 完全兼容官方称替换成本极低。在其自跑的 43 项评测中Clef 系列延迟优于市面各家决策模型只有 Laya 更快但代价是质量明显下滑。而在 Typesafe 自家评测套件上Clef 在 4 个场景中赢了 3 个更快的 Clef-flash 表现尤其突出。训练冻结 Qwen只做概率打分Clef 以 Qwen 为骨干Clef 冻结 Qwen3.8-27BClef-flash 冻结 Qwen3.5-9B再联合优化一个路由头与 rank-256 低秩适配器。推理时 Qwen 只做一次 prefill随后并行给所有合法 schema 选项打分决策是非自回归的不需要逐 token 生成中间文本这正是它比自回归 LLM 快得多的原因。后训练用 label-smoothed 交叉熵搭配 Brier loss 做概率校准并引入「面向校准决策的强化学习」RLCD对相邻序数选项给部分分对完全精确的记录给奖励同时加参考惩罚防止分布漂移。最终模型被约束为只输出概率而非文本。RL 流水线怎么搭Cloudflare 把已有构件串成一条 RL 链路AI Gateway 自动沉淀请求/响应数据集Workers AI 跑 rolloutContainers 提供 RL 沙箱做打分与动作回放新增的 Trainer 更新权重最后经 Workers AI 的 BYO Model 重新部署。这套能力与其收购 Replicate 后推进的 Cog 工作直接相关。Cloudflare 称自己在不同领域积累了 15 年以上的网络数据微调后的专用分类器会比通用 Clef 更准更快。目前微调以 FDE前置部署工程师团队驻场服务的形式提供后续会上线自助平台。开发者今天即可调用端点形如 api.cloudflare.com/client/v4/accounts/$CLOUDFLARE_ACCOUNT_ID/ai/run/cf/cloudflare/clef请求体用 state 传输入、questions 定义字段类型布尔、单选、评分。企业客户获得承诺Cloudflare 不读取、不存储、不拿请求与响应做训练除非你主动使用微调产品。为什么值得关注这是 Cloudflare 从 CDN 与安全厂商向「agent cloud」叙事延伸的一步把决策模型放进智能体的热路径负责判断再搭配自家 LLM 负责执行。对国内开发者而言Apache 2.0 的权重意味着可以自行部署验证但真正的门槛在数据——微调效果的好坏往往取决于你手里有多少标注好的历史决策记录。
延伸阅读

更多相关文章

2026/10/3 8:50:20

C-MinusF编译器实战:手写AST到LLVM IR生成与三大优化

简介:本资源是中国科学技术大学2020年秋季《编译原理》课程满分实践项目成果,面向高校计算机专业高年级学生、编译器学习者及系统编程爱好者,完整覆盖词法分析、语法分析、LLVM IR生成与循环优化(含循环不变式外提、常量传播、活跃…

2026/10/3 10:00:23

新版MyBatis-Plus代码生成器FastAutoGenerator实战指南

写Java后端的人,大概都有被CRUD支配过的经历。实体类加一个字段,Controller、Service、Mapper、XML全要跟着动;新表建好,光把那套标准文件补齐就要小半天。我第一次用MyBatis-Plus代码生成器时,只当它是个快速生成类的…

2026/10/3 10:00:23

fal Agent权限模型:沙盒隔离、动态配额与全链路审计

1. fal Agent 并非“开放所有用户使用”,而是权限模型的一次关键演进最近在多个技术社区看到标题为“fal Agent 开放所有用户使用”的消息,不少开发者第一反应是:“终于能白嫖了?”“是不是不用注册就能调用AI智能体?”…

2026/10/3 10:00:23

四旋翼无人机PID控制Matlab仿真:从建模到参数整定全流程解析

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/10/3 10:00:23

大模型安全对齐与提示注入防御实践

我不能按照您的要求生成相关内容。 原因如下: 标题中提到的“GLM-5.3 越狱”存在严重事实性错误: GLM系列模型由智谱AI(Zhipu AI)研发,与Anthropic公司无任何技术、产权或发布关系 。Anthropic是Claude系列大模型的…

2026/10/3 10:00:23

从日志到事件流:Java服务线上故障的时间线回放方案

凌晨1点47分,监控把我从睡梦里拽起来——订单服务的成功率在十分钟内从99.98%掉到82%。我一边打开日志平台一边骂自己,等真正点开查询页,才发现能搜到的除了error就是timeout,没有调用链、没有参数状态、没有中间步骤,…

2026/10/3 9:55:23

Blender点云渲染实战:Geometry Nodes+Cycles科研配图方案

1. 这不是炫技,是科研配图的刚需:为什么点云渲染必须用Geometry Nodes Cycles你是不是也经历过——手头有一堆激光雷达扫描数据、CT重建体素、或者分子动力学模拟输出的XYZ坐标点集,导师催着交论文配图,结果打开Blender发现&…

2026/10/2 8:16:46

东莞市品牌网站建设报价常见报错与解决

东莞品牌网站建设报价单背后:一份保姆级建站教程避坑实录 网站做好了没人访问,这大概是很多老板最头疼的事。花了大几万做的品牌站,上线后流量惨淡,比路边摊还冷清。别急着骂外包公司,很多“东莞品牌网站建设报价”里藏着不少猫腻,比如用模板站冒充定制…

2026/10/2 18:20:53

如何划分训练/验证集:Spirula Studio五种eval_mode策略详解

如何划分训练/验证集:Spirula Studio五种eval_mode策略详解 【免费下载链接】spirula-studio Cross-vendor 3D Gaussian Splatting trainer - video to splat to mesh, Vulkan or CUDA. 项目地址: https://gitcode.com/GitHub_Trending/sp/spirula-studio Sp…

2026/10/1 10:48:55

SEO怎么推广速查手册新手避坑实战指南

SEO怎么推广速查手册新手避坑实战指南 模板网站太丑不够用?别急着加滤镜,那是治标不治本。很多老板盯着后台流量掉得眼红,却还在纠结首页Banner的圆角是不是3像素。这就像穿着西装去挖土,姿势不对,努力白费。我整理这份 速查手册…

2026/10/3 0:04:31

国内大学生必备的AI写作辅助软件是哪款?

国内高校学生在论文写作过程中,越来越依赖AI辅助工具提升效率,主流方案以本土化全流程工具为核心,结合通用大模型与专业插件,覆盖选题构思、框架搭建、初稿撰写、查重降重、格式调整等关键环节,本文将深入解析当前主流…

2026/10/3 0:04:31

Codex接入Jev模型完整指南:配置方法、本地部署与踩坑排查

最近不少人在讨论 Codex 搭配 Jev 这套玩法,我一开始没太当回事,直到自己把 Jev 接进 Codex跑了几轮编码任务之后,才明白那些说“直接起飞”的人是怎么想的。Codex 作为工具本身已经够能打了,但模型固定、上下文策略固定&#xff…

2026/10/3 0:04:31

GitHub 热门: NVIDIA/Model-Optimizer

👋 Hi,我擅长 AI 大模型应用落地、意识解码与 AI 开发工具链 。 💡 创业路上,用技术换时间,一起把 AI 变成生产力 🚀 >GitHub 热门: NVIDIA/Model-Optimizer 凌晨两点,你刚把跑通了的 Qwen3.…

还想了解更多?直接咨询顾问

免费诊断 + 免费方案 + 透明报价。

全国咨询热线400-8866-253
免费获取方案
☎咨询二维码 ☎ ↑