技术热点透视20260904:三家对手,共用一块地基
9 月 3 日,OpenAI(ChatGPT+Codex)、Anthropic(Claude)、xAI(Grok)在几分钟内相继熄火,连带 Gemini、Copilot、Cursor 异常,持续约 3 小时 40 分,是有记录以来最大规模 AI 集体宕机。根因指向微软 Azure 美东区域网络异常 + Cloudflare 边缘故障——三家「竞争对手」核心算力其实主要部署在同一片 Azure、访问端依赖同一层 Cloudflare,于是「一荣俱荣、一损俱损」。对 AI coding 而言,coding agent 已成生产依赖,一次全局宕机等于研发产线停摆;市场用 Palantir +7.7% 给「可靠性」定了价。结论:把 LLM 当成一个会半夜罢工的依赖来设计——多供应商路由、本地/自托管兜底、断路器、SLO 监控。