GitHub可用性报告: 2026年7月

7月份,我们经历了八次事件,导致GitHub服务的性能下降。文章GitHub可用性报告: 2026年7月首次出现在GitHub博客上。

8月6日星期四发生的GitHub Actions事件的影响和持续时间的特殊性都是不可接受的。可用性仍然是我们整个GitHub的首要任务。但是,由于此次事件,我们未能履行对您的承诺。我们知道客户在多大程度上依赖于行动,而像这样的长期停电会对您的工作效率和对我们的信任产生真正的影响。

我们将继续对事件进行更深入的根本原因分析(RCA),因为在完成调查之前,我们需要充分了解其中的许多方面。调查完成后,我们将更新公开摘要,并将完整的详细信息包含在我们将于9月发布的8月可订状态帖子中。

除了通过我们的调查发现的即时维修项目外,我们正在加快GitHub Actions中的架构路线图,与我们围绕隔离、弹性和规模的持续努力保持一致。值得注意的是,上述事件的核心GitHub Actions服务仍在我们的数据中心中完全运行,这是导致我们遇到容量不足的一个因素。

虽然大多数操作在Azure上运行,但我们尚未确定迁移启动服务的优先级,迁移启动服务是连接整体与操作的组件,因为它通常是异步的,并且能够响应问题将工作排队。不幸的是,正如公开摘要中概述的那样,级联故障导致了不可接受的恢复延迟。

这就是为什么我们正在加速将GitHub Actions迁移到Azure,在那里我们将有更多的空间和能力来吸收峰值。上个月,在我们更广泛的努力中,我们分享了故意暂停和更强的稳定性控制如何改变了我们将生产流量迁移到Azure的方式。7月,这些控件使我们能够更有信心地恢复工作,同时继续减少整个GitHub的共享依赖关系。