时间:2026年9月30日
地点:杭州(中国)
人物:蚂蚁集团InclusionAI实验室
事件详情:蚂蚁集团旗下百灵(Ling)系列今日正式发布Ling-3.1-flash模型。该模型采用稀疏激活MoE架构,总参数约560B,每个Token实际激活约25B参数(激活比约4.5%),最大支持1M Token上下文窗口,可容纳超长文档、代码仓库和多轮Agent任务历史。官方介绍,研发过程中重点围绕通用智能体、信息搜索、日常办公与软件研发等高频场景优化,并同步在医疗、金融、材料科学研究等专业场景持续提升能力。模型即日起开放为期两周的免费体验,免费期内上下文长度256K;过渡到付费服务后计划开放至1M上下文,并将同步开源权重。Vercel AI Gateway已同步上架该模型,免费档(ling-3.1-flash-free)与付费档并列提供。
背景:这是Ling系列继今年7月发布的Ling-3.0-flash(124B/5.1B)之后的又一次显著升级,总参数规模从此前的124B跃升至560B,激活参数由5.1B提升至25B,对标目前国内主流超大MoE规模。蚂蚁百灵自今年起在Flash系列产品线上持续加码性价比路径——OpenRouter近两代真实Agent会话成本排名中Ling 2.6 Flash与Ling 3.0 Flash连续位列前二。同期阿里Qwen3.8-Flash、智谱GLM-5.3-Flash、DeepSeek V4-Flash等国产同类Flash模型也竞相将总参数控制在100B–400B区间,激活参数控制在5B–20B,行业整体走向"小激活、大容量、长上下文"的Flash工程化路线。
影响:1)Ling-3.1-flash以560B总参+25B激活+1M窗口的组合,把国产Flash类模型的参数上限与上下文能力同时拉至新台阶,为Agent类应用开发提供更具性价比的中文底座选择;2)两周免费+后续开源的策略延续了蚂蚁百灵一贯的开放路线,有助于扩大开发者生态与社区反馈积累;3)蚂蚁在金融、医疗等垂直场景长期积累的数据与工程经验,有望在Flash模型中以"行业增强"形式变现,与阿里、DeepSeek形成差异化竞争;4)海外Vercel AI Gateway等平台同步首发,意味着国产模型在出海分发渠道上进一步打通,开发者无需自建推理基础设施即可调用。
总结:蚂蚁百灵Ling-3.1-flash以560B总参数+25B激活+1M上下文的组合延续了国产Flash大模型的"高性价比+长上下文"路线,两周免费试用+未来开源策略叠加Vercel AI Gateway同步分发,将进一步加剧国内大模型在Agent开发与企业级场景的角逐,国产开源Flash阵营进入新一轮规格升级。
参考来源:
1. IT之家:蚂蚁百灵发布 Ling-3.1-flash 模型:约 560B 总参数、25B 激活参数 https://www.ithome.com/1/008/907.htm
2. Vercel AI Gateway - Ling 3.1 Flash API, Pricing & Playground https://vercel.com/ai-gateway/models/ling-3.1-flash
3. models.dev - Ling 3.1 Flash pricing, providers, and specs http://models.dev/models/inclusionai/ling-3.1-flash
4. 同花顺财经(转IT之家):蚂蚁百灵发布 Ling-3.1-flash https://news.10jqka.com.cn/20260930/c680423346.shtml
5. 新浪新闻:蚂蚁百灵发布Ling-3.1-flash模型 560B总参数25B激活参数 https://k.sina.com.cn/article_1826017320_6cd6d02804001xcg8.html
6. 腾讯搜一搜(IT时代网):蚂蚁百灵发布Ling-3.1-flash模型 总参数560B https://so.html5.qq.com/page/real/search_news?docid=70000021_1296abd0e3c02652
7. CoinMeta:Ant Bird releases Ling-3.1-flash model https://www.coinmeta.com/en/news/1248969
8. iadecider.com - Ant Ling Review 2026 https://iadecider.com/articles/ant-ling-review







