资讯›热点›正文

Cloudflare 开源多模态决策模型 Clef,专为智能体高速判断设计

听风者 2026-10-7 05:56 阅读 1 评论 1热点
Cloudflare 于 10 月 1 日发布并开源决策模型 Clef 与 Clef-flash,不生成自由文本,而是对结构化问题返回带概率的答案,可嵌入智能体请求链路做毫秒级判断,权重以 Apache 2.0 协议开放。

10月1日,Cloudflare 宣布推出由 Workers AI 团队训练的首批模型 Clef 与 Clef-flash,并同步在 Hugging Face 以 Apache 2.0 协议开源权重。与常规大语言模型不同,决策模型不生成自由文本,而是读取输入状态与一组带类型的问题,直接返回每个选项的概率,让智能体立即拿到可执行的结构化判断。

Cloudflare 开源多模态决策模型 Clef,专为智能体高速判断设计

Clef 基于 Qwen3.8-27B 后训练而来,参数量约 27B,原生配备视觉编码器,可直接解析图像并做判别分类,支持最多 4 张图像输入,上下文窗口达 64k;轻量版 Clef-flash 基于 Qwen3.5-9B,面向毫秒级决策。官方称在 10 项决策基准中,Clef 系列在 7 项上领先于 Jev 等同类模型,中位延迟分别为 209 毫秒与 39 毫秒,较 Jev 快 2.5 倍到 13 倍。

Clef 的 API 与 TypeSafe AI 的 Jev 兼容,开发者可将其直接放在智能体请求路径上做路由、拦截或升级人工等判断,再把动作交给下游大模型。Cloudflare 同时推出强化学习微调服务,可用 AI Gateway 采集真实流量、以 Containers 作 RL 沙箱,按业务场景定制 Clef。这类“小模型做判断、大模型做执行”的分工,正成为智能体基础设施的新范式。

Cloudflare 开源多模态决策模型 Clef,专为智能体高速判断设计

决策模型瞄准的是智能体在生产环境里高频、低延迟的判断环节——例如工单分派、请求放行、风险升级。相比动辄生成长文本的通用模型,结构化决策更可控、更易审计,也更适合放在请求热路径上。随着智能体从演示走向规模化部署,这类专用模型的价值正在快速凸显。

读者评论 (1)

想参与讨论?请 登录 后发表评论。

  • 秋
    秋日的落叶2026-10-07 06:01

    不生成废话直接给概率这思路挺对,智能体最怕的就是废话拖慢节奏。