安全攻防
morning
深夜4小时,ChatGPT、Claude、Grok集体停机:AI的根基正在动摇
摘要
ChatGPT、Claude、Grok等主流AI模型集体宕机近4小时,矛头直指云基础设施,AI时代脆弱性第一次暴露在聚光灯下。 深夜的手机震个不停,群里全是同一句话:”你那边AI挂了吗?”9月3日晚间这场事故,不是某个小厂的服务抖动,而是ChatGPT、Claude、Grok、Copilot集体”失联”。从业这么多年,我头一回看到全球主流AI服务在同一时间瘫痪,持续了近4个小时。作为天天靠AI干活...
Claude
ChatGPT
Grok等主流AI模型集体宕机近4小时
矛头直指云基础设施
AI时代脆弱性第一次暴露在聚光灯下
深夜的手机震个不停
群里全是同一句话
你那边AI挂了吗
9月3日晚间这场事故
不是某个小厂的服务抖动
2026-09-07
1 阅读
约5分钟阅读
安全客
字号:
ChatGPT、Claude、Grok等主流AI模型集体宕机近4小时,矛头直指云基础设施,AI时代脆弱性第一次暴露在聚光灯下。 深夜的手机震个不停,群里全是同一句话:”你那边AI挂了吗?”9月3日晚间这场事故,不是某个小厂的服务抖动,而是ChatGPT、Claude、Grok、Copilot集体”失联”。从业这么多年,我头一回看到全球主流AI服务在同一时间瘫痪,持续了近4个小时。作为天天靠AI干活的人,那夜我盯着故障面板后背发凉:我们是不是把太多东西,押在了一条随时会断的线上。 一、一场”有报告以来最大规模”的AI宕机 故障从9月3日上午9点半(美东时间)的ChatGPT开始爆发。全球最大服务监测网站Downdetector在20分钟内收到超过12000份用户报告,页面加载失败、对话中断、API调用超时接连出现。几乎同一时刻,Anthropic的Claude、xAI的Grok、微软Copilot、谷歌Gemini相继异常,整个北美的故障地图一片飘红。 波及面远超聊天应用。用Cursor写代码的开发者最先抓狂,底层模型一瘫,代码补全和智能建议直接失效,团队当晚集体”手动加班”。推特热搜#AIdown上,用户自嘲”ChatGPT宕机了、Grok宕机了、我也宕机了”。这场事故累计持续约3小时40分钟,被业界称为”有报告以来最大规模的AI宕机事件”。 二、真正的震中在云端:Azure还是Cloudflare? 这才是安全人该盯住的地方。AI模型不是故障源头,底层基础设施才是。业界把矛头指向两个”元凶”。 一是微软Azure。OpenAI、Anthropic、xAI都深度依赖Azure的算力,而AI大面积瘫痪的同时,Azure自身的故障报告也出现异常激增,时间线高度重合。 二是Cloudflare。事发时段其状态页显示两项异常:影响R2自定义域名的HTTP/3连接问题、部分WARP用户的IP地理位置识别错误。大量AI平台的流量都走Cloudflare中转,这很可能引发的正是”蝴蝶效应”。2024年11月,正是Cloudflare一次故障让Grok栽过跟头。 目前两家都还没给出官方说明。但不管真相是谁,结论已经很明显:主流AI服务的命脉,高度集中在屈指可数的几家云厂商手里。 三、单点失效,是AI时代最危险的安全命题 作为安全从业者,这次事故让我想起一句话:Downtime is the new breach,宕机就是新时代的”事件”。传统安全关注”谁入侵了我”,AI时代更该问的是”我依赖谁活”。 想一想:当你的招标文件、售前方案、核心代码、客户话术全都跑在大模型API上,当你的工具链建立在”上游AI必须在线”的假设上,上游某个机房的抖动,就能让你的整个业务链瞬间停摆。这不是科幻,就是9月3日晚真实发生的事。 更麻烦的是,这种依赖还在加速加深,而我们连故障根因都还在猜。多云容灾成本高,数据合规又绑定了云区域,很多企业明知单点风险,却无路可退。 四、给运维和安全的四个立即行动 别等下次再慌了,现在就能做。 第一,梳理AI供应链清单。哪些业务跑了GPT、Claude还是Gemini,底层落在哪朵云、哪条链路,画清楚依赖地图。灾难恢复的前提,是知道自己在依赖什么。 第二,给关键业务留”降级预案”。AI挂了用什么兜底?人工流程、本地小模型、还是备用API?预案不能只写在PPT里。 第三,盯紧Azure、Cloudflare这类基础设施的状态页,接上心跳告警,别等用户在群里炸了才知道。 第四,把”模型路由+多供应商”纳入架构设计。核心生产链路尽量做多供应商切换,哪怕多付点钱,也比一次集体宕机拖垮全公司划算。 五、写在最后:AI的新基建,需要新的安全观 那夜宕机恢复后,有个AI平台在X平台发文”我们还活着”,成了全网梗图。可笑过之后,每个做安全的同行心里都有数:这次是”断联”,下一次可能就是”失控”。 AI是新时代的水电,但水管很细,电网也不够硬。真正负责的安全团队,不该只盯着模型输出有没有偏见、提示词有没有注入,更要盯住托着AI的那块地基稳不稳。地基一旦塌了,上层的智能再强大,也只是精致而无处安放的废墟。 下个凌晨,当你的告警面板又开始飘红,先问一句:这次断的,是模型,还是命脉?
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱