时间:2026年10月10日(Business Insider 报道发布,谷歌内部测试于近日进行)
地点:美国(谷歌总部),测试部署在谷歌内部编码平台 Jetski 上
人物:谷歌 DeepMind 内部员工、Business Insider 记者 Hugh Langley、谷歌 DeepMind 研究员 Vedant Misra、Anthropic
事件详情:Business Insider 引用其获得的谷歌内部文件、员工聊天记录及截图报道称,谷歌正在内部密集测试多款 Gemini 4 衍生版本,代号分别为 Argon、Barium 和 Carbon。其中 Carbon 于近几日被部署到谷歌内部编程平台 Jetski 供员工试用,有员工反馈其在编程任务上的表现已接近 Anthropic 最强编程模型 Claude Opus 5.5,另有员工在内部聊天频道直接留言称 Carbon is really good。报道指出,Carbon 很可能是 Argon 家族内的检查点更新而非独立档位,内部员工称其为 Gemini pro next model,而已经官宣的 Argon 此前内部代号为 Barium-B,说明谷歌内部代号与最终产品名并非一一对应。此外还有开发者从 Google SDK 中挖出 gemini-4-flash-preview 模型标识,Gemini 4 旗舰、内部测试版与 Flash 线索一并凑齐。
背景:Gemini 4 Argon 是谷歌当前的旗舰推理模型,官方公布其在 DeepSWE v1.1 上得分 77.9%,高于 Claude Opus 5.5 的 74.2% 和 GPT-6 Astra 的 74.1%,但在 Terminal-Bench 4.0 上 Argon 仅得 57.4%,明显落后于 Opus 5.5 的 66.4%,终端操作类任务仍是短板。Argon 至今尚未全面开放,谷歌已在同步改造应用层,Gemini 应用新增 Automatic 模式与推理强度调节,Google AI Studio 出现 Ultra 模式。与此同时,自 10 月 9 日起谷歌收紧免费层,免费用户只能使用 Flash Lite,标准 Flash 需订阅每月 4.99 美元的 Google AI Plus。
影响:谷歌 DeepMind 研究员 Vedant Misra 在 X 上针对该报道回应了一句 Have you heard of recursive self improvement,暗示模型迭代速度的加快来自 AI 参与 AI 研发,OpenAI 与 Anthropic 此前也披露过类似进展。若 Carbon 确实补齐 Argon 在终端操作与长时程编程上的短板,谷歌将在编程赛道上对 Anthropic Opus 5.5 与 OpenAI Astra 形成直接压力,前沿模型的更新节奏也会进一步压缩。业内普遍认为,内部代号密集出现意味着 Gemini 4 系列将按旗舰、内部迭代、Flash 多线并行的方式推进。
总结:Business Insider 曝光的谷歌内部文件显示,Gemini 4 在已公布的 Argon 之外还有 Barium、Carbon 等多个内部版本正在测试,Carbon 已进入内部编程平台 Jetski,员工评价其编程能力接近 Anthropic Claude Opus 5.5。这既印证了谷歌用 AI 加速模型迭代的 RSI 路线,也预示 Gemini 4 正式发布后前沿模型在编程能力上的差距将进一步收窄,谷歌同时借免费层收紧为新模型商业化铺路。
参考来源:
1. https://www.businessinsider.com/google-employees-test-new-gemini-4-model-argon-barium-carbon-2026-10
2. https://the-decoder.com/googles-gemini-4-carbon-model-is-reportedly-matching-anthropics-opus-5-5-coding-performance/
3. https://eu.36kr.com/zh/p/4019400286621831
4. https://zhidx.com/p/599720.html
5. https://www.ithome.com/1/011/162.htm
6. https://news.pedaily.cn/202610/570047.shtml
7. https://m.sohu.com/a/1085811328_122004016
8. https://today.line.me/tw/v3/article/yzGoakB







