产品简介
蚂蚁百灵 Ling-3.1-flash 是蚂蚁集团百灵大模型(InclusionAI)于 2026 年 9 月 30 日发布的 MoE 大模型。该模型约 560B 总参数,每个 token 激活约 25B 参数,上下文窗口上限达 1M,可容纳更长的文档、代码与任务历史。官方称研发中围绕通用智能体、搜索、日常办公与软件研发等任务持续优化,并在医疗、金融与材料科学研究场景持续提升能力。其上一代 Ling-3.0-flash 为 124B 总参数、5.1B 激活,采用 MIT 开源,使用 Kimi Delta Attention 与类 Mamba 线性注意力 5:1 混合、512 路由专家的 MoE 架构。Ling-3.1-flash 开放为期两周的免费体验,体验期服务长度为 256K,之后转付费并计划开源。
核心功能
- 大规模 MoE 架构:约 560B 总参数,每个 token 激活约 25B 参数,在保持较大参数规模的同时控制单次推理激活量。
- 1M 上下文窗口:上下文窗口上限为 1M(100 万 token),可容纳更长的文档、代码与任务历史。
- 多场景能力优化:官方称围绕通用智能体、搜索、日常办公与软件研发等任务持续优化,并在医疗、金融与材料科学研究场景持续提升能力。
- 免费体验与后续开放计划:开放为期两周的免费体验,体验期服务长度为 256K;免费体验期结束并转为付费服务后,计划开放 1M 上下文,并计划同步开源、继续更新模型性能。
- 延续前代技术路线:上一代 Ling-3.0-flash 采用 Kimi Delta Attention 与类 Mamba 线性注意力 5:1 混合、512 路由专家的 MoE 架构,为 Ling-3.1-flash 的研发提供基础。
适合谁用
以下类型的用户会特别受益于 蚂蚁百灵 Ling-3.1-flash:
- 通用智能体任务:官方称围绕通用智能体方向持续优化,可支撑需要多步骤规划与工具调用的智能体场景。
- 搜索场景:官方称在搜索任务上持续优化,适合需要检索与信息整合的应用。
- 日常办公:官方称面向日常办公任务优化,可辅助文档处理、信息整理等工作。
- 软件研发:官方称在软件研发方向持续优化,可辅助代码理解、生成与任务历史管理。
- 专业领域研究:官方称在医疗、金融与材料科学研究场景持续提升能力,可服务于相关领域的分析与研究任务。
优点亮点
- 参数规模较大:约 560B 总参数,是同期国产 Flash 系 MoE 中参数规模最大的。
- 上下文窗口上限高:支持 1M 上下文,可容纳更长的文档、代码与任务历史。
- 激活参数控制合理:每 token 激活约 25B 参数,在较大总参数下保持相对可控的激活量。
- 多场景优化明确:官方称围绕通用智能体、搜索、日常办公与软件研发等任务持续优化,并覆盖医疗、金融与材料科学等专业场景。
- 提供免费体验:开放为期两周的免费体验,体验期服务长度为 256K,便于用户先行试用。
- 后续开放计划清晰:免费体验期结束并转为付费服务后,计划开放 1M 上下文,并计划同步开源、继续更新模型性能。
价格与方案
Ling-3.1-flash 开放为期两周的免费体验,免费体验期间模型服务长度为 256K。免费体验期结束并转为付费服务后,计划开放 1M 上下文,并计划同步开源、继续更新模型性能。截至目前官方尚未公布具体定价数字,价格部分以官网为准。
总结与建议
蚂蚁百灵 Ling-3.1-flash 是蚂蚁集团百灵大模型于 2026 年 9 月 30 日发布的 MoE 大模型,约 560B 总参数、每 token 激活约 25B,上下文窗口上限 1M。官方称围绕通用智能体、搜索、日常办公与软件研发等任务持续优化,并在医疗、金融与材料科学等场景提升能力。该模型开放两周免费体验,体验期服务长度 256K,之后转付费并计划开源。截至目前官方未公布公开 benchmark 对比与具体定价,横向排名暂无可靠依据,价格以官网为准。
版本演进
- Ling-3.1-flash 发布 (2026-09-30):蚂蚁百灵(InclusionAI)发布 Ling-3.1-flash:约 560B 总参数、每 token 激活约 25B,上下文窗口上限 1M,围绕通用智能体、搜索、日常办公与软件研发优化,并在医疗、金融与材料科学场景提升能力;开放为期两周的免费体验,体验期模型服务长度为 256K,转付费后开放 1M 上下文并计划同步开源