非法加冯

华为云国际站故障:疑似 IAM 升级故障

北京时间 7 月 26 日凌晨 2:49,华为云官方检测到"国际账号异常",并于 3:34 前后在国际站官网发布通知;第三方监控平台 StatusGator 自 3:32 起收到大量用户报障,24 小时内累计超过 450 条,覆盖阿根廷、土耳其、巴西、埃及、泰国、墨西哥、智利等多个国际站市场,截至上午 8:15 事件仍在持续,异常持续时间超过四小时。

Image

Image

这是一次全球性跨区域异常,表现同时涉及登录失败、管理操作失败、资源异常冻结和服务器不可达。第三方检测在北京时间 03:32 触发,报障至少持续到现在,目前尚未有中国区域的故障报告。若官方通报与本文推断不符,以官方通报为准。

Image

本次异常与凌晨进行的 IAM 统一身份认证服务升级在时间上高度重合,有可能是一次计划维护异常扩大或由此触发的共享控制面级联故障。华为云于 7 月 17 日发布的公告,公告宣布计划于此时段(2026/07/26 02:00-04:00)升级统一身份认证服务(IAM)。

Image

根因推断

StatusGator 将最早异常描述为“登录问题和错误消息”,常见问题分类包括:

•无法登录;•控制台或应用无法加载;•API 或操作返回错误;•服务管理操作失败。

这与当天 IAM 维护公告所描述的预期影响高度一致:IAM 用户管理、授权、账号设置,以及开通、创建、修改、删除资源等管理面操作可能失败。

多名报告者使用的不是普通的“卡住”或“挂掉”,而是华为云语境中很具体的 Frozen/冻结:

•“所有资源被冻结”;•“所有服务器被冻结”;•“服务器被冻结”。

另一部分报告并未提及控制台,而是直接报告:

server not responding; service down; connectivity issue; servers down。

如果只是 IAM 登录或控制台异常,理论上已经运行的数据面 ECS、数据库和公网服务不应普遍失去数据面连接。因此,这批报告暗示事故可能已经从单纯的认证管理面扩散到更多服务。

•官方确实在同一时段升级 IAM;•异常检测发生在维护窗口内部;•最初症状就是登录、身份认证和错误消息;•受影响国家分散,不像单个机房断电;•故障持续超过维护窗口,符合升级失败、回滚失败、状态同步异常或缓存污染等模式。

具体原因请以华为云后续公告为准。

时间线

从第三方首次检测的 03:32 到最后一条可见报障的 08:22,异常信号至少延续了 4 小时 52 分钟。

Image

大型云厂商关键服务故障导致全球故障并不乏先例。例如阿里云 2023 年全球史诗级大故障正是由于 IAM / OSS 循环依赖导致。

我们能从阿里云史诗级故障中学到什么

我们能从腾讯云故障复盘中学到什么?

一次AWS DNS故障如何级联瘫痪半个互联网

AWS最大区域故障,带崩多项服务

AWS 故障官方复盘报告

References

[1] 华为云统一身份认证服务(IAM)计划于2026年7月26日02:00-04:00(北京时间)升级通知: https://www.huaweicloud.com/notice/20260717153237724.html
[2] 2026年7月26日(北京时间)华为云帐户异常通知: https://www.huaweicloud.com/intl/en-us/notice/20260726033454857.html
[3] Statusgator - Huawei Cloud Status: https://statusgator.com/services/huawei
[4]: https://x.com/hibtc37/status/2081147436194730283
[5]: https://www.huaweicloud.com/intl/en-us/notice/20260726033454857.html

专栏:云计算泥石流

云故障

一次AWS DNS故障如何级联瘫痪半个互联网

AWS最大区域故障,带崩多项服务

知乎挂了:证书问题还是CDN翻车?

阿里云故障,CDN挂了,记得申请SLA赔付

Apple,Google,FB,TG 160亿登录信息泄露

带瘫全球互联网,Google云/Cloudflare全球故障

大故障:阿里云核心域名被拖走了

深度分析:迪奥数据泄露事件,云配置失当的锅?

10万用户的软件,因腾讯云欠费2元灰飞烟灭?

AWS 东京可用区故障:影响13项服务

Shopify:愚人节真的翻车了

Oracle云大翻车:6百万用户认证数据泄漏

OpenAI全球宕机复盘:K8S循环依赖

支付宝崩了?双十一整活王又来了

草台回旋镖:Apple Music证书过期服务中断

阿里云:高可用容灾神话的破灭

阿里云故障预报:本次事故将持续至20年后?

阿里云盘灾难级BUG:能看别人照片?

阿里云新加坡可用区C故障,网传机房着火

这次轮到WPS崩了

草台班子唱大戏,阿里云RDS翻车记

我们能从网易云音乐故障中学到什么?

GitHub全站故障,又是数据库上翻的车?

全球Windows蓝屏:甲乙双方都是草台班子

阿里云又挂了,这次是光缆被挖断了?

删库:Google云爆破了大基金的整个云账户

云上黑暗森林:打爆云账单,只需要S3桶名

taobao.com证书过期

我们能从腾讯云故障复盘中学到什么?

云SLA是安慰剂还是厕纸合同?

腾讯云:颜面尽失的草台班子

【腾讯】云计算史诗级二翻车来了

互联网故障背后的草台班子们

从降本增笑到真的降本增效

阿里云周爆:云数据库管控又挂了

我们能从阿里云史诗级故障中学到什么

【阿里】云计算史诗级大翻车来了

云资源

花钱买罪受的大冤种:逃离云计算妙瓦底

云数据库是不是智商税

云盘是不是杀猪盘?

剖析云上算力真实成本

扒皮对象存储:从降本到杀猪

垃圾腾讯云CDN:从入门到放弃

记一次阿里云 DCDN 加速仅 32 秒就欠了 1600 

云SLA是安慰剂还是厕纸合同?

FinOps终点是下云

本土云计算为啥还没挖沙子赚钱?

云SLA是不是安慰剂?

范式转移:从云到本地优先

下云记

花钱买罪受的大冤种:逃离云计算妙瓦底

草台班子唱大戏,阿里云RDS翻车记

DHH下云:S3晚搬一天,就多花四万

DHH:下云超预期,能省一个亿

先优化碳基BIO核,再优化硅基CPU核

单租户时代:SaaS范式转移

拒绝用复杂度自慰,下云也保稳定运行

半年下云省千万:DHH下云FAQ答疑

是时候放弃云计算了吗?

下云奥德赛