前言
GitHub 遭遇持续近 8 小时的严重故障,API 与 Webhook 错误率飙升至 20%,甚至导致半数归档文件无法下载,连 Copilot 助手也随之瘫痪。在开发者集体“带薪发呆”的同时,这已是微软旗下平台近期第二次大规模宕机。面对如此脆弱的基建,官方究竟在哪个组件上栽了跟头?
本周一,GitHub 上演了一场持续近 8 小时的“大型在线失踪事件”,从美东时间上午 9:40 开始,平台就陆续出现各种报错,直到下午 5:15 才勉强恢复元气。对于大量依赖它托管代码、自动构建和部署的开发者来说,这一天简直像是被拔了网线。

官方的状态页一度显示,API 请求、拉取请求和 Webhook 的错误率飙到了 20% 左右,而更惨的是归档文件和原始仓库内容的下载,居然有一半都直接扑空。连 GitHub 主推的 AI 编程助手 Copilot 也跟着躺枪,那些习惯了“动动嘴就能生成代码”的程序员,今天不得不老老实实自己敲键盘。
GitHub 在上午 11 点前发公告说正在紧急“抢救”,到了下午 1:34 终于锁定了“捣乱的组件”并采取了措施,随后宣称 Webhook 和 API 等基本功能重新上线。但 Copilot 和官网页面依然时好时坏,直到傍晚 5:15 才彻底确认所有服务恢复正常。
至于事故的罪魁祸首是谁,官方还没给说法,只说会尽快公布详细的根源分析。有意思的是,这已经是微软旗下平台最近几周里的第二次大规模 outage 了——上个月底 Xbox 服务也瘫了好几个小时。只能说,大厂的日子也不好过,只是苦了那些 deadline 紧挨着的打工人。
