2026 年 8 月 17 日,周一,中国时间晚上 9:40 左右,GitHub 开始大面积宕机。
这次宕机持续了超过 7 个小时,直到 8 月 18 日凌晨 5:15(北京时间)才宣告完全恢复。受影响的服务覆盖了 GitHub 几乎全部核心功能:网站、API、Pull Request、Actions、Webhooks、Issues、Git Operations,以及 GitHub Copilot。
这是 GitHub 今年以来最严重的一次中断。

时间线:从 20% 到全面恢复
根据 GitHub Status 页面的记录,故障从 Aug 17, 2026 13:40 UTC 开始。一小时内,灾难蔓延到几乎所有服务——API Requests、Webhooks、Actions、Pull Requests、Git Operations、Issues、Pages 相继亮起红灯。
官方在 14:58 UTC 给出了第一个关键数据:Web 体验和 API 流量的错误率约 20%,而归档下载和原始仓库内容下载的错误率高达 50%。SAML/OIDC 认证、SCIM 和 Team Sync 也受到影响。

这意味着什么?
简单说:你 push 不了代码,CI/CD 跑不起来,PR 合并不了,连下载 zip 包都有 50% 的概率失败。
16:36 UTC,GitHub 定位到了「问题组件」并采取了纠正措施,出现了「强烈的恢复信号」。但事情没那么简单——认证系统出现间歇性故障,Copilot 登录也出了问题。
直到 21:15 UTC,GitHub 才宣布事件完全解决,并表示将发布详细的根因分析(RCA)。
不是第一次,也不是意外
这次宕机并非孤立事件。相关报道指出,GitHub 已经为 AI 驱动的编码狂潮挣扎了数月。
GitHub CTO Vladimir Fedorov 在今年 4 月的博客中写道:公司去年秋天开始着手将基础设施容量扩展 10 倍,到 2 月又得出结论——需要为当前规模的 30 倍做准备。
6 月,微软发言人向 Business Insider 承认,AI 智能体开发(AI agent development)的激增已经触及 GitHub 基础设施的极限。微软正在加速将 GitHub 迁移到 Azure,同时采取多云策略——包括从 AWS 租用容量。没错,微软旗下的代码托管平台,要从竞争对手 AWS 租服务器。

GitHub 目前有 2.25 亿用户。AI 编码工具 GitHub Copilot 和 AI agent 的开发工作流正在以远超预期的速度消耗基础设施资源。因为每个 agent 都是一个持续运行的推理循环,涉及大量 API 调用和代码生成。
人话总结
一个周一早上,全球开发者发现自己的代码推不上去、PR 合并不了、CI 不跑、Copilot 也挂了。
七个半小时后,好了。
GitHub 的 RCA 还在路上,但根因方向已经很清楚:AI 编码工具的爆发式增长正在以一种前所未有的方式吞噬基础设施。你可以把容量扩 10 倍,但需求可能已经涨了 30 倍。
参考来源: