Cloudflare开源Clef:智能体决策模型

继OpenAI和亚马逊之后,Cloudflare也加入了"决策模型"这条新赛道,而且一上来就把权重全部公开。10月1日,Cloudflare发布了两款自研决策模型Clef和Clef-flash,参数规模分别为270亿和90亿,以Apache 2.0协议在Hugging Face开放下载,同时托管在自家Workers AI上,与TypeSafe的Jev API完全兼容。
决策模型是近几周冒出来的新品类:它不写文章,只在智能体需要"做选择"的瞬间返回一个带概率的结构化答案。比如把一封客服消息递进去,它会回答"是否紧急、该转给哪个团队"以及各自的置信度,代码拿到结果就能直接路由工单、触发升级或者转人工。名字取自乐谱里的谱号(clef)——先定调域,后面的音符(动作)才有了基准。
性能是这次发布的主打。按Cloudflare自己跑的基准,Clef中位延迟209.3毫秒,对Jev的524.1毫秒快了约2.5倍;更小的Clef-flash的95分位延迟只有122.4毫秒,快13倍。质量上,Clef在BANKING77分类基准拿到94.20的宏F1,明显高于Jev的79.74,并在Jev决策指数上暂列第一。一个实战例子:在威胁情报场景里给网站域名分类,Clef从抓取、渲染到分类用2.2秒,而Cloudflare最快的通用大模型gpt-oss-120b要4.7秒,且只给出两条分类结果。
细节上,两款模型基于Qwen底座,上下文窗口64K,自带视觉编码器,能对图片分类——这一点Jev还做不到。托管版本的定价是每百万输入token Clef收0.24美元、Clef-flash收0.09美元,因为没有文字输出,也就没有输出费用。Cloudflare还同步推出了强化学习微调平台,客户可以用自己的数据把Clef调校成专有版本。
这条赛道两天内已经挤进三家:OpenAI在DevDay上推出基于Luna模型的Decisions API,亚马逊当天开源了20亿参数的Strands Decider 2B,Cloudflare则是三者中唯一把完整权重放出来的。起因是TypeSafe AI上个月发布的Jev,用一个黑客松演示证明了"专用决策模型比通用大模型便宜数百倍"。当智能体的大规模落地撞上推理成本,谁能让机器又快又便宜地"拍板",谁就拿到下一张入场券。
编译自 Cloudflare官方博客,原标题:"Introducing Clef: our open-source decision models, and new RL fine-tuning platform"