字节跳动训练10万亿参数AI模型

时间:2026年8月7日 地点:中国北京(字节跳动总部) 人物:字节跳动创始人张一鸣;字节跳动 CEO 梁汝波;Seed Foundation 负责人项亮;大语言模型预训练数据负责人沈科;Seed 团队负责人吴永辉 事件详情: 据英国《金融时报》8月7日报道,字节跳动正在训练一个参数量最高可达10万亿的AI模型,这一数字远高于国内已发布的最大模型月之暗面 Kimi K3(约 2.8 万亿参数),规模将逼近 Anthropic 旗舰模型 Mythos 5(业内估约 8 万亿参数)。三位知情人士透露,该模型目前处于早期预训练阶段,训练周期通常需要3到6个月,之后将进入微调并发布,具体参数规模将在后期才能确定。8月6日字节年度全员会上,CEO 梁汝波坦承豆包大模型在 AI Coding 方面并不算突出,并以 Anthropic Claude Code 为例。8月5日创始人张一鸣在与 Seed 负责人吴永辉召开的全员会上明确表示,反对模型蒸馏路线,即便短期技术落后国内竞争对手也坚持走原始训练路径,并强调将持续加大对 AI 方向的投入。该模型由 Seed Foundation 负责人项亮主导,与大语言模型预训练数据负责人沈科共同推进,目前 Seed 团队正重新划分组织职责、调配研发资源。 背景: 国内大模型竞争已从"快而小"转向"大而稳"。阿里 Qwen 3.8-Max 约 2.4 万亿参数,月之暗面 Kimi K3 约 2.8 万亿参数,Anthropic Fable 5 约 5 万亿参数,Mythos 5 业内估计约 8 万亿参数。字节曾凭借豆包大模型积累超 2 亿日活用户,但 2 月推出的 Seed 2.0 语言模型反响平平,视频生成模型 Seedance 2.0 表现亮眼却难撑语言模型短板。同期 Anthropic Opus 系列凭 Coding 能力打开程序员和 B 端市场,ARR 反超 OpenAI。 影响: - 国内大模型竞争进入"超万亿"军备竞赛阶段,规模门槛从 5 万亿直接拉到 10 万亿,倒逼阿里、腾讯、月之暗面、智谱等加速跟进。 - 字节将火山引擎、飞书、豆包三线资源整合到 Seed 体系,模型蒸馏路线被否,国内 AI 厂商短期可能面临"不蒸馏就落后"的算力与人才双重压力。 - 张一鸣亲自站台反对蒸馏、强调长期智能上限,为国内 AGI 路线之争定下基调,可能影响投资人对"快迭代但靠蒸馏"的初创公司的估值判断。 - 若 10 万亿模型顺利推出,国产闭源模型将与 Mythos 5 同台竞技,全球超大模型第一梯队格局或被改写。 总结: 字节跳动此次 10 万亿参数大模型训练计划,是国内 AI 公司首次正面挑战全球旗舰模型规模。不同于此前的"快迭代+蒸馏"路线,张一鸣亲自站台强调原始训练与长期智能上限,明确把 AI Coding 作为豆包短板要补的方向,并整合火山引擎、飞书、豆包三线资源集中到 Seed。在 Anthropic、OpenAI 接连暴雷、国内大模型窗口期打开的背景下,字节这一"大力出奇迹"的押注,既是对 AGI 路径之争的回应,也是国内大模型竞争进入"超大参数时代"的标志。 参考来源: - https://zhidx.com/p/583239.html - https://the-decoder.com/chinas-largest-ai-model-is-being-developed-at-bytedance/ - http://m.itbear.com.cn/html/2026-08/1486043.html - https://www.163.com/dy/article/L3NISA9A0519U3I5.html - http://m.toutiao.com/group/7671174507213619763/?upstream_biz=VolcEngine - https://m.sohu.com/a/1059783294_362225/ - http://www.100ec.cn/detail--6662494.html - https://k.sina.cn/article_7857201856_1d45362c001908ij5q.html