热门AI工具推荐

焚书AI多模型聚合平台
AI多模型聚合平台( Claude 系列、GPT 系列)支持聊天、搜索、图片、视频、音乐等多种功能;聚合了 Claude 系列(如 Sonnet 5、Opus 5 等)、Gemini 系列、GPT 系列、DeepSeek(搜索模式默认调用 DeepSeek V4 Pro)以及通义千问、Kimi 等数十款国内外主流模型。
AI编程订阅服务,支持多款国产主流编程模型自由切换。
Seedance 2.0AI视频生成
具备卓越的物理真实性和角色一致性,可生成电影级视频内容。
方舟 Agent PlanAI智能体订阅
火山引擎推出的全场景AI智能体订阅服务,通过一个订阅整合5大主流模型和10+AI工具
SpeedAIAI内容检测降重
AI内容检测与降重工具,能有效帮助用户通过论文AI率检测
秒哒AI工具
不懂代码也能开发应用?百度秒哒:无需编程,快速搭建小程序与网站
有戏AIAI漫剧生成工具
全流程AI短剧创作工具,实现从剧本到成片的自动化生产,让“一人即剧组”成为现实。
沁言学术智能科研平台
一站式文献管理与科研写作工具,支持边写作边搜索文献,高效阅读,文献管理,

阿里字节DeepSeek豪赌10万亿参数模型

## 时间 2026年9月22日杭州云栖大会披露,相关报道于9月23日—24日持续发酵。 ## 地点 中国杭州(2026云栖大会主论坛)+ 北京(DeepSeek 投资者会议)+ 北京/上海(多家媒体跟进报道)。 ## 人物 阿里巴巴集团 CEO 吴泳铭(云栖大会主旨演讲);阿里 ATH 事业群 Token Foundry Qwen LLM 项目负责人刘大一恒;DeepSeek 创始人梁文锋(投资者会议披露下一步规划);字节跳动 Seed Foundation 负责人项亮(主导 10T 模型训练)。 ## 事件详情 2026 杭州云栖大会上,阿里巴巴集团 CEO 吴泳铭现场披露,公司正准备训练参数规模介于 5 万亿至 10 万亿之间的新一代人工智能模型。阿里 ATH 事业群 Token Foundry Qwen LLM 项目负责人刘大一恒进一步表示,Scaling(缩放定律)是迈向超级人工智能(ASI)的关键路径,未来 Qwen 4.5、Qwen 5 的参数规模计划迈向 5 万亿到 10 万亿。同日,The Information 报道 DeepSeek 正在训练一个约 2 万亿参数的新模型;DeepSeek 创始人梁文锋在投资者会议上明确,公司下一步计划继续把模型推到 8 万亿参数。今年 8 月,英国《金融时报》援引知情人士称,字节跳动正在训练最高可达 10 万亿参数的大模型,由 Seed Foundation 负责人项亮主导。三家头部国产大模型公司至此全部下场,10 万亿参数军备竞赛正式开打。 ## 背景 当前国产阵营已发布模型的参数顶点仍由月之暗面 7 月推出的 Kimi K3 占据,总参数 2.8 万亿(激活约 1040 亿),是全球首个开源的 3 万亿级别模型;阿里现役旗舰 Qwen 3.8-Max 约 2.4 万亿,DeepSeek V4-Pro 为 1.6 万亿。海外闭源阵营更高,业内估计 Anthropic 的 Mythos 5 约 8 万亿、Fable 5 约 5 万亿。也就是说,国产现役旗舰距离海外头部还有 1—2 倍身位;若以 10 万亿为靶心,各家普遍还要再放大约 5 倍。值得一提的是,三家均采用 MoE(混合专家)架构,把总参数和实际调用参数解耦,Kimi K3 总参数 2.8 万亿但每次仅激活约 1040 亿(约 3.7%),这让"参数可以继续膨胀,单次计算量却被按住"成为可能,也为本轮超大参数军备竞赛提供了工程基础。 ## 影响 资本市场与产业链层面:阿里港股 9988.HK 在消息披露当日涨近 4%,市场重新押注国产大模型上限;芯片、服务器、电力、IDC 配套需求被进一步推高,吴泳铭同步承诺到 2032 年阿里云全球数据中心规模将超过 20GW(高盛估阿里目前已上线容量约 3—4GW,未来六年新增 16—17GW,建设投入可能达 8000 亿—1 万亿美元量级)。现金流层面:阿里 2026 Q2 单季资本开支 677 亿元(同比 +75%),自由现金流由 +738 亿元骤转为 -466 亿元;字节 2026 年资本开支上限最高可达 700 亿美元(约上一年三倍),2027 年还可能再冲 1000 亿美元;字节近期完成约 300 亿美元银团贷款(科技公司史上最大),部分资金用于 AI 基础设施。技术路线层面:MoE + Agent 把"参数容量"重新变成竞争中心——长链路 Agent 任务对模型覆盖面和稳定性提出"木桶效应"要求,更大的总参数容量有了新的价值;行业从"卷效率"阶段(Flash 类小激活模型)走向"效率+规模"双线并行。 ## 总结 阿里、字节、DeepSeek 同日/同周期披露的 5T—10T 参数规划,标志着国产大模型公司重新把"参数越大越好"摆上牌桌;但这一轮竞赛的关键变量已不是参数本身,而是 MoE 架构对总参数与单次激活参数的解耦、Agent 长链路对模型覆盖面与稳定性的新要求,以及万亿美元级算力投入下各家现金流的承受极限。10 万亿仍只是"PPT 上的数字",但入场券争夺已经白热化,下一代 ASI 的起跑线正在被抬到 5T—10T 这一档。 ## 参考来源 - 钛媒体:阿里、字节、DeepSeek豪赌10万亿参数模型:一场停不下来的烧钱游戏 https://www.tmtpost.com/8151500.html - 36氪:阿里、DeepSeek、字节下场豪赌10万亿参数 https://www.36kr.com/p/3995936178229120 - 投中网(ChinaVenture):阿里、DeepSeek、字节下场豪赌10万亿参数 https://www.chinaventure.com.cn/news/78-20260924-393436.html - 新浪财经/界面新闻:阿里吴泳铭:未来机器将承担99.9%的思考工作 总量将达人类1000倍 https://finance.sina.cn/stock/jdts/2026-09-22/detail-inisspzi5672889.d.html - 东方财富:阿里CEO吴泳铭:计划训练5万亿至10万亿参数新模型 2032年全球数据中心规模超20GW https://wap.eastmoney.com/a/202609223881069718.html - 奇客 Solidot:阿里巴巴下一代模型参数将扩大到5-10万亿规模 https://www.solidot.org/story?sid=85450 - 人人都是产品经理/字母榜:DeepSeek卷8万亿参数:走效率路线的它 怎么也开始拼规模了 https://www.woshipm.com/ai/6468775.html - Financial Times:ByteDance targets mega AI model nearing Anthropic's Mythos https://www.ft.com/content/9b8383b1-a28d-4940-8c4e-2f0cd21556ef - 路透社 Reuters:ByteDance targets mega AI model that could match Mythos https://www.reuters.com/technology/bytedance-targets-mega-ai-model-nearing-anthropics-mythos-ft-reports-2026-08-07/ - Reuters:Alibaba plans AI model with 5 trillion-10 trillion parameters, unveils new chip https://www.reuters.com/business/retail-consumer/alibaba-plans-ai-model-with-5-trillion-10-trillion-parameters-unveils-new-chip-2026-09-22/