资讯›热点›正文

微软Azure突发大面积故障,19个区域网络服务中断近6小时

星野漫游 2026-10-3 13:57 阅读 0 评论 2热点
9月30日晚至10月1日凌晨,微软Azure发生大范围网络故障,波及全球19个区域,ExpressRoute、VPN网关、防火墙及Azure VMware等多项服务中断约5小时45分,根因与一次网关管理服务变更及基础设施维护叠加有关。

9月30日20:30 UTC起,微软Azure发生大范围网络故障,包括West US、North Europe、Southeast Asia、East Asia、Japan West在内的全球19个区域受到影响,ExpressRoute网关、VPN网关、Azure防火墙、应用网关、Web应用防火墙以及Azure VMware Solution等多项服务出现连接下降或中断。事故持续约5小时45分,于10月1日02:15 UTC基本缓解。

微软Azure突发大面积故障,19个区域网络服务中断近6小时

微软事后排查显示,事故由两部分叠加触发:事发前,工程团队对“区域网关管理服务”(Regional Gateway Management Service)做了一次变更;随后一项原本独立的基础设施操作系统维护逐步进入多个区域,使网关管理服务的负载超出预期。正常情况下该服务应按需自动扩容,但此次负载上升的同时其依赖服务需求也同步走高,最终导致相关区域未能完成扩容,多个网络服务异常。微软随即暂停相关操作系统维护,并回滚了网关管理服务的变更,受影响区域逐步恢复。

这次中断再次暴露了云计算对自动化基础设施更新的单点依赖。当云厂商把补丁与维护以“静默”方式推送到全球区域时,客户往往缺乏可对照的变更审批环节,一旦网关失效,依赖Azure连接本地数据中心与云上资源的混合云环境首当其冲。业内预计,企业架构师将更倾向为关键流量配置跨云冗余VPN隧道,而非仅依赖单一云厂商的原生网关。

微软Azure突发大面积故障,19个区域网络服务中断近6小时

几乎同一窗口,Azure OpenAI服务在瑞典中部区域也出现约7小时的可用性故障,影响GPT-5.2、GPT-5 Mini、GPT-4.1等API调用,微软归因于后端依赖服务异常引发的连锁失败,并经扩容与调整内存后恢复。两起事件叠加,正值欧盟围绕云服务商反垄断与“看门人”监管的讨论升温,也给企业敲响警钟:在数据中心与AI服务高度集中的今天,多区域部署与自动故障转移已从“最佳实践”变成“必选项”。

读者评论 (2)

想参与讨论?请 登录 后发表评论。

  • 红
    红枣桂圆2026-10-03 15:15

    堆了这么多服务在一个网关上,真出事了就是躺平,客户真没招。

  • 口
    口味虾2026-10-03 14:04

    又崩了,每次大改都搞全局推送,客户当小白鼠了