资讯›热点›正文

蚂蚁旗下 inclusionAI 推出 Ling 3.1 Flash:5600 亿参数混合专家模型开放试用

步履不停 2026-10-4 01:06 阅读 0 评论 1热点
蚂蚁集团 inclusionAI 实验室发布 Ling 3.1 Flash,总参数 5600 亿、每 token 激活约 250 亿,262K 上下文、带显式思考模式,通过 Vercel AI Gateway 开放两周免费试用。

蚂蚁集团旗下的 inclusionAI 实验室近日推出新一代效率导向的混合专家(MoE)模型 Ling 3.1 Flash。该模型总参数达到 5600 亿(560B),每个 token 仅激活约 250 亿(25B)参数,并内置显式思考模式,面向智能体任务、搜索、办公软件与垂直专业场景。

蚂蚁旗下 inclusionAI 推出 Ling 3.1 Flash:5600 亿参数混合专家模型开放试用

相比上一代 Ling-3.0-flash(1240 亿总参数、51 亿激活),Ling 3.1 Flash 在规模上实现四倍以上的跃升。它提供 262144 token(256K)的上下文窗口,单次最多可输出约 3.3 万 token,并通过 Vercel 的 AI Gateway 以两周免费试用形式开放,底层由 Novita 托管;inclusionAI 表示正式开源权重将在试用期结束后放出。

蚂蚁旗下 inclusionAI 推出 Ling 3.1 Flash:5600 亿参数混合专家模型开放试用

作为开源大模型阵营的新成员,Ling 3.1 Flash 延续了蚂蚁在超大规模模型上的投入。此前蚂蚁百灵系列已发布万亿参数思考模型 Ring-1T 与通用模型 Ling-1T,Ling 3.1 Flash 则把重心放在“小激活、大总参”的高性价比推理路径上,试图在效果和成本之间找到更适合 agent 与多步分析的平衡点。

从行业背景看,开源与开放权重的竞争正从“拼参数”转向“拼性价比与可控部署”。在 GPT-6、Gemini 4 Argon 等闭源旗舰频繁调整发布节奏的当下,以 MoE 架构压低单次推理成本、并保留可私有化部署可能性的路线,正受到越来越多开发者和企业的关注。Ling 3.1 Flash 的试用表现,将检验这类超大 MoE 模型能否真正在真实工作负载中替代部分重模型。

读者评论 (1)

想参与讨论?请 登录 后发表评论。

  • 罗
    罗汉斋2026-10-04 01:14

    5600亿总参听着吓人,激活250亿才真香,感觉这代模型终于能跑动agent了