GitHub 启动有史以来最大规模的 Git 底层架构重建,把数据持久层与读算力层彻底解耦,以应对 AI 智能体编码将月度 commit 数量推高到 5 倍、推送请求堆至 4.9 倍的局面。内部基准显示,新架构写入吞吐最高可达旧 Spokes 设计的 35 倍。
【关键数据 2026 年 9 月】
- Git 事件总量:473.3 亿次/月(同比翻倍以上)
- 月度 commit:73.8 亿次(同比 5×)
- 月度 push:33.5 亿次(同比 4.9×)
- Pull Request 合并:接近 4×
- GitHub Actions 运行次数:32.6 亿次(同比 4×)
- 最繁忙单仓库:单月约 10 亿次请求
【旧架构为何撑不住】
旧 Spokes 设计把仓库完整副本保存在 5 台 fileserver 的本地磁盘上,采用三阶段提交协议保证一致性。加副本才能加读,但每个副本都要参与每次写;写性能被最慢副本拖累;智能体在 tight loop 里几乎每个动作都 commit,单次 push 的延迟直接卡住吞吐;compaction 与 GC 与在线请求跑在同一批主机上。
【新架构核心思路】
1. 数据存算分离:权威仓库数据下沉到 Azure Blob Storage;
2. 读算力独立扩展:轻量化 compute workers 缓存数据,独立扩缩容;
3. 维护任务离场:compaction 和 GC 由独立 worker 对接持久层完成;
4. 关键路径最小化:push 中真正需要协调的只有引用更新本身。
【约束与保障】
- 不停机迁移:无维护窗口,迁移期间服务持续在线;
- 保留既有控制:分支保护、必填评审、审计日志、仓库可见性全部保留;
- 不破坏既有工作流:branching、review、merge 语义不变。
【行业意义】
智能体编码把 GitHub 从开发者工具逼成了智能体运行时。此次重构是 GitHub 17 年来首次对存储与协调层动大手术,直接回应了 COO Kyle Daigle 此前披露的 275 million commits/week 压力。新架构把仓库能力提升到智能体规模,也为 GitHub Actions、Copilot 智能体等下游功能打开了继续扩量的天花板。
【参考来源】
1. https://github.blog/engineering/architecture-optimization/building-git-infrastructure-for-agent-scale-development
2. https://news.lavx.hu/article/github-rebuilds-git-infrastructure-to-handle-agent-scale-development
3. https://deniz.in/github-rebuilds-its-git-infrastructure-live-as-agent-commits-jump-fivefold-in-a
4. https://aiinsiders.net/article/githubs-infrastructure-wasnt-built-for-a-1400percent-spike
5. https://techlogstack.com/explore/github-ai-agents-outage-2026







