## 时间
2026年9月22日杭州云栖大会披露,相关报道于9月23日—24日持续发酵。
## 地点
中国杭州(2026云栖大会主论坛)+ 北京(DeepSeek 投资者会议)+ 北京/上海(多家媒体跟进报道)。
## 人物
阿里巴巴集团 CEO 吴泳铭(云栖大会主旨演讲);阿里 ATH 事业群 Token Foundry Qwen LLM 项目负责人刘大一恒;DeepSeek 创始人梁文锋(投资者会议披露下一步规划);字节跳动 Seed Foundation 负责人项亮(主导 10T 模型训练)。
## 事件详情
2026 杭州云栖大会上,阿里巴巴集团 CEO 吴泳铭现场披露,公司正准备训练参数规模介于 5 万亿至 10 万亿之间的新一代人工智能模型。阿里 ATH 事业群 Token Foundry Qwen LLM 项目负责人刘大一恒进一步表示,Scaling(缩放定律)是迈向超级人工智能(ASI)的关键路径,未来 Qwen 4.5、Qwen 5 的参数规模计划迈向 5 万亿到 10 万亿。同日,The Information 报道 DeepSeek 正在训练一个约 2 万亿参数的新模型;DeepSeek 创始人梁文锋在投资者会议上明确,公司下一步计划继续把模型推到 8 万亿参数。今年 8 月,英国《金融时报》援引知情人士称,字节跳动正在训练最高可达 10 万亿参数的大模型,由 Seed Foundation 负责人项亮主导。三家头部国产大模型公司至此全部下场,10 万亿参数军备竞赛正式开打。
## 背景
当前国产阵营已发布模型的参数顶点仍由月之暗面 7 月推出的 Kimi K3 占据,总参数 2.8 万亿(激活约 1040 亿),是全球首个开源的 3 万亿级别模型;阿里现役旗舰 Qwen 3.8-Max 约 2.4 万亿,DeepSeek V4-Pro 为 1.6 万亿。海外闭源阵营更高,业内估计 Anthropic 的 Mythos 5 约 8 万亿、Fable 5 约 5 万亿。也就是说,国产现役旗舰距离海外头部还有 1—2 倍身位;若以 10 万亿为靶心,各家普遍还要再放大约 5 倍。值得一提的是,三家均采用 MoE(混合专家)架构,把总参数和实际调用参数解耦,Kimi K3 总参数 2.8 万亿但每次仅激活约 1040 亿(约 3.7%),这让"参数可以继续膨胀,单次计算量却被按住"成为可能,也为本轮超大参数军备竞赛提供了工程基础。
## 影响
资本市场与产业链层面:阿里港股 9988.HK 在消息披露当日涨近 4%,市场重新押注国产大模型上限;芯片、服务器、电力、IDC 配套需求被进一步推高,吴泳铭同步承诺到 2032 年阿里云全球数据中心规模将超过 20GW(高盛估阿里目前已上线容量约 3—4GW,未来六年新增 16—17GW,建设投入可能达 8000 亿—1 万亿美元量级)。现金流层面:阿里 2026 Q2 单季资本开支 677 亿元(同比 +75%),自由现金流由 +738 亿元骤转为 -466 亿元;字节 2026 年资本开支上限最高可达 700 亿美元(约上一年三倍),2027 年还可能再冲 1000 亿美元;字节近期完成约 300 亿美元银团贷款(科技公司史上最大),部分资金用于 AI 基础设施。技术路线层面:MoE + Agent 把"参数容量"重新变成竞争中心——长链路 Agent 任务对模型覆盖面和稳定性提出"木桶效应"要求,更大的总参数容量有了新的价值;行业从"卷效率"阶段(Flash 类小激活模型)走向"效率+规模"双线并行。
## 总结
阿里、字节、DeepSeek 同日/同周期披露的 5T—10T 参数规划,标志着国产大模型公司重新把"参数越大越好"摆上牌桌;但这一轮竞赛的关键变量已不是参数本身,而是 MoE 架构对总参数与单次激活参数的解耦、Agent 长链路对模型覆盖面与稳定性的新要求,以及万亿美元级算力投入下各家现金流的承受极限。10 万亿仍只是"PPT 上的数字",但入场券争夺已经白热化,下一代 ASI 的起跑线正在被抬到 5T—10T 这一档。
## 参考来源
- 钛媒体:阿里、字节、DeepSeek豪赌10万亿参数模型:一场停不下来的烧钱游戏
https://www.tmtpost.com/8151500.html
- 36氪:阿里、DeepSeek、字节下场豪赌10万亿参数
https://www.36kr.com/p/3995936178229120
- 投中网(ChinaVenture):阿里、DeepSeek、字节下场豪赌10万亿参数
https://www.chinaventure.com.cn/news/78-20260924-393436.html
- 新浪财经/界面新闻:阿里吴泳铭:未来机器将承担99.9%的思考工作 总量将达人类1000倍
https://finance.sina.cn/stock/jdts/2026-09-22/detail-inisspzi5672889.d.html
- 东方财富:阿里CEO吴泳铭:计划训练5万亿至10万亿参数新模型 2032年全球数据中心规模超20GW
https://wap.eastmoney.com/a/202609223881069718.html
- 奇客 Solidot:阿里巴巴下一代模型参数将扩大到5-10万亿规模
https://www.solidot.org/story?sid=85450
- 人人都是产品经理/字母榜:DeepSeek卷8万亿参数:走效率路线的它 怎么也开始拼规模了
https://www.woshipm.com/ai/6468775.html
- Financial Times:ByteDance targets mega AI model nearing Anthropic's Mythos
https://www.ft.com/content/9b8383b1-a28d-4940-8c4e-2f0cd21556ef
- 路透社 Reuters:ByteDance targets mega AI model that could match Mythos
https://www.reuters.com/technology/bytedance-targets-mega-ai-model-nearing-anthropics-mythos-ft-reports-2026-08-07/
- Reuters:Alibaba plans AI model with 5 trillion-10 trillion parameters, unveils new chip
https://www.reuters.com/business/retail-consumer/alibaba-plans-ai-model-with-5-trillion-10-trillion-parameters-unveils-new-chip-2026-09-22/







