字节开训10万亿参数模型 追平Mythos

时间:2026年8月7日 地点:中国北京(字节跳动总部)/ 美国(旧金山,Anthropic 总部) 人物:字节跳动 Seed Foundation 负责人项亮;字节跳动大语言模型预训练数据负责人沈科;Anthropic(对标对象) 事件详情: 英国《金融时报》8 月 7 日援引三名知情人士报道,字节跳动正在训练一款最高 10 万亿参数的超大模型,目前处于预训练早期阶段,最终规模尚未确定。如果按上限训练,该模型参数量将达到月之暗面 Kimi K3(2.8 万亿)的三倍以上,成为目前已知中国团队中参数规模最大的模型,并接近 Anthropic 最先进 Mythos 5 约 8 万亿参数水平。项目由字节 Seed Foundation 负责人项亮主导,与大语言模型预训练数据负责人沈科合作,知情人士称字节仍在评估最终是否达到该规模。 背景: 字节此次加码超大模型路线是 2025 年 Q4 全员会确立大模型自研战略后的延续。2026 年 4 月字节梁汝波承认大语言模型暂时落后海外,资源集中豆包与抖音双主干,但内部仍保留对前沿大模型的长线投入。Mythos 5 是 Anthropic 4 月发布的预览模型,9 月因网络安全与生化武器风险过强主动撤回公开访问,仅向亚马逊、苹果、微软等受控客户开放。10 万亿参数规模意味着单次训练算力消耗将超过 100 万张 H100 当量,字节需调度张家口与内蒙古算力中心支持。 影响: - 中美前沿模型差距进一步缩小:10 万亿对标 Mythos 5(约 8 万亿),中国头部公司首次在参数规模上超越美国前沿 - 字节重返自研超大模型路线:与同期阿里 Qwen3.8-Max、月之暗面 K3 形成中国超大模型三足鼎立格局 - 算力与数据压力陡增:10 万亿预训练对算力调度、数据清洗、稳定性提出更高要求,失败成本可能达数亿美元 - AGI 竞赛升温:参数规模逼近十万亿俱乐部,全球仅 OpenAI、Anthropic、字节三家公开触及此区间 总结: 字节 10 万亿参数超大模型开训是中国大模型产业首次在公开参数规模上明确对标美国前沿 Mythos 5,体现字节在承认短期落后之后仍押注长线 AGI 路线。该项目若成功训练并发布,将使中国拥有全球第三家进入 10 万亿参数俱乐部的实验室;但若中途降配或下马,亦将再度引发对中国大模型可持续性的质疑。 参考来源: - https://www.ft.com/content/9b8383b1-a28d-4940-8c4e-2f0cd21556ef - https://www.world-today-news.com/bytedance-develops-mega-ai-model-to-rival-anthropics-mythos/ - https://tech.ifeng.com/c/8vOWIhxIpAV - https://linux.do/t/topic/2718123 - http://m.toutiao.com/group/7671164943563932194/?upstream_biz=VolcEngine - http://fund.cfi.cn/p20260807000389.html - http://m.toutiao.com/group/7671174887972831788/?upstream_biz=VolcEngine - https://m.sohu.com/a/1059963175_362225/