时间:2026年9月10日
地点:2026 Inclusion·外滩大会(上海)
人物:蚂蚁集团基础智能技术部负责人、百灵大模型负责人西亭;百灵金融模型负责人月引;阿福技术负责人进捷;百灵语言基座负责人零幺
事件详情:9月10日外滩大会期间,蚂蚁百灵团队四位技术负责人罕见同框接受媒体专访,集体阐释百灵大模型的战略路线。同期,蚂蚁通过inclusionAI开源组织在Hugging Face与ModelScope上线百灵系列首个原生多模态大模型Ling-3.0-flash-VL,采用MoE架构,总参数124B、单次推理激活5.5B参数,原生支持图像、文本、视频输入,上下文窗口达256K Token。模型引入视觉反馈闭环机制,把任务从一次性"生成"推进为"观察→行动→验证→修正"的持续闭环,在GUI自动化、前端代码生成、医疗报告解读等场景可基于渲染结果对比进行自我修正。Image-to-WebDev Arena评测中以linthium代号得分高于GPT-5.4,Artificial Analysis Intelligence Index v4.1.1上较纯文本版本提升4分。几天前百灵已开源首个金融增强模型Ling-3.0-flash-Fin,在金融投研多项能力测评中超越前沿通用模型。
背景:百灵已成为少有的支撑起国民级AI应用的基模。蚂蚁阿福同期披露最新数据,用户突破1.5亿、日咨询量2000万,按规模看应已成为全球第一大健康AI App;AI版支付宝"阿宝"、AI原生助手"灵光"同步增长。外滩大会现场围绕"好模型定义、智效比、金融医疗反哺、模型边界"等议题展开十问十答。西亭明确表态:"我们不认为Coding是实现AGI唯一的路线。"
影响:蚂蚁把"高智效比"作为核心战略:提出计算Efficiency、参数Efficiency、Token Efficiency三大理念,早在2025年9-10月与友商同步发布全球首个万亿模型后即转向小尺寸高密度路线,通过MoE Scaling law、混合线性注意力(KDA+MLA)等架构把大尺寸智能压缩到小尺寸。Ling-3.0-flash-VL的MIT协议开源(BF16/FP8已上线,FP4/INT4即将发布)使中小开发者可在4-8张141GB/H100级GPU上部署256K上下文版本。百灵主张Scaling从Coding扩展到高经济价值、高难度领域尤其是金融与医疗,借助真实场景反哺模型,押注"端到端任务成功率"而非单纯生成质量,与当前主流厂商All-in Coding形成鲜明对照。
总结:蚂蚁百灵团队罕见集体亮相,是国产大模型从"刷榜+卷参数"转向"场景驱动+应用反哺"的标志性节点;同步开源的Ling-3.0-flash-VL以视觉反馈闭环切入Agent工作流,给具身智能、自动驾驶等需要实时视觉纠错的领域提供低成本路径。百灵"AGI不止Coding"的宣言直指当前行业焦点,也为国产基模走出差异化道路提供了可参照的样本。
参考来源:
1. 智东西:https://zhidx.com/p/592846.html
2. 腾讯新闻:https://news.qq.com/rain/a/20260910A06SZS00
3. IT之家:https://www.ithome.com/0/999/997.htm
4. 新浪财经:https://k.sina.com.cn/article_5115326071_130e5ae77020030sz0.html
5. 腾讯新闻深度:https://new.qq.com/rain/a/20260910A05W7P00
6. Pandaily:https://pandaily.com/ant-group-ling-3-0-flash-vl-open-source-vision-feedback
7. AIBase:https://news.aibase.cn/news/30924









