APP下载
报价宝  ›  人工智能  › 

Cloudflare上新Clef-omni 决策模型全面多模态

报价宝 来源:baojiabao.com 发布时间:2026-10-10 11:12:23 10月10日更新
报价宝综合消息Cloudflare上新Clef-omni 决策模型全面多模态

Cloudflare上新Clef-omni 决策模型全面多模态

Cloudflare 上周刚发布「决策模型」Clef 和 Clef-flash,一周后又送上新东西:开放权重的 Clef-omni 正式上线,在文本和图片之外首次支持音频与视频输入;同时官方托管的 Clef 提速最高一倍,Clef-flash 大幅降价——官方称现在比 TypeSafe 的 Jev 还便宜。

与大语言模型不同,Clef 系列不是用来生成文本的,而是做「决策」:输出结构化、受 schema 约束的判断结果,比如判断一段内容是不是垃圾信息、一个请求该走哪条流程。因为跳过了输出 token 生成,媒体文件无需先转写或配字幕,直接映射进统一序列,音频与视频帧同步联合处理——一次 API 调用就能替代过去「语音转文字加图文分类」的多级流水线。

速度是它最大的卖点:纯文本决策中位延迟约 130 毫秒,图片输入约 150 毫秒。Cloudflare 内部团队已经把 Clef 用在日常检测里:GitHub 文档仓库用它即时识别并关闭垃圾 issue,内容管理系统用它审查插件库里的钓鱼内容,数据防泄漏团队用它扫描敏感信息。公司把这种变化概括为「检测和分类能力下沉到模型层」——任何开发者都能把它嵌进自己的工作流。

技术路线上,Clef-omni 延续了 Clef 的做法:冻结 Qwen3 骨干网络,只训练 LoRA 低秩适配器,再用标签平滑交叉熵损失结合 Brier 分数校准做后训练,官方称模型因此更稳健、置信度更可信。模型权重已开源到 Hugging Face,API 与 Jev 完全兼容,也可以通过 AI Gateway 调用,换模型只需改一行。

这波提速主要来自服务层:官方托管版本改用 SGLang 部署,Cloudflare 与 SGLang 团队合作提交的改动已并入 SGLang 0.5.22。自托管用户拿到权重后同样能吃到这波优化。

降价并非没有代价:托管版 Clef-flash 的上下文窗口从 64k 缩到 24k。Cloudflare 给出的理由是数据——只有 0.24% 的请求输入超过 24k token,因此选择用窗口换价格。Clef 主模型保持 64k 不变,Hugging Face 上的模型权重本身也没有改动。

从上周决定做决策模型、不到一周拼出 Clef,到今天补齐多模态并降价,Cloudflare 在模型上的迭代节奏明显快于常规产品线。公司表示这只是开始,「我们会继续变得更好、更快、更便宜、更有创新性」——一家以网络和 CDN 起家的公司,正在认真挤进模型生意。

编译自 Cloudflare Blog,原标题:“Introducing Clef-omni with full multimodality, plus a faster Clef and a cheaper Clef-flash”

文章标签: Cloudflare Clef-omni 决策模型 开源权重 多模态 Qwen3 SGLang Jev 报价宝 降噪耳机价格 耳机价格 红米手机价格 华为手机价格 小米手机价格 电视机价格 笔记本电脑价格 笔记本价格 汽车价格 数码相机价格 汽车价格 电视机价格 华为手机价格 红米手机价格