三家模型商90分鐘內接連出包,谷歌正常

北京時間9月3日晚間,Anthropic、xAI、OpenAI的模型服務在一個半小時內先後進入故障狀態。Anthropic的狀態頁於北京時間21時26分(UTC 13:26)掛出第一條公告,xAI的Grok全系在21時41分被下游平台標記為服務降級,OpenAI則在22時56分前後開始通報ChatGPT與Codex錯誤率上升。截至23時15分,三家的事件都還處於「調查中」或「修復中」,沒有一家宣布恢復。

同一時段,谷歌的Gemini與Vertex AI沒有事件記錄,第三方狀態彙整看板上谷歌那一格顯示綠色的「All services operational」。

第三方狀態彙整看板:OpenAI與Anthropic顯示降級,xAI顯示當機,谷歌AI正常
第三方狀態彙整看板:OpenAI與Anthropic顯示降級,xAI顯示當機,谷歌AI正常

時間線:三家先後登場

Anthropic最早。21時26分,狀態頁寫著「正在調查Claude Mythos 5.1、Fable 5.1、Opus 5的請求錯誤率上升」,15分鐘後改為「已定位原因,正在修復」。21時50分補上完整清單:Mythos與Fable的5.1和5兩個世代、Opus 5、Opus 4.8、Opus 4.6全部受影響,Haiku與Sonnet不在名單裡。22時49分的更新只有一句「仍在修復中」。

xAI緊接在後。xAI自家的狀態頁存取時回傳403,無法直接查看。可以確認的是Cursor在21時41分發布「調查服務降級」,寫明受影響的是「全部Grok模型、Automations、Cloud Agents、Grok Bot和Review Agents」。彙整看板上xAI是四家裡唯一標示紅色「Down」的一家。

OpenAI最晚,但使用者感受最明顯。22時56分前後,狀態頁出現「Elevated errors across ChatGPT and Codex」,說明只有一句「正在調查」。部分使用者此時打開chatgpt.com拿到的是HTTP 404,這個錯誤碼通常來自邊緣節點找不到路由,跟模型端的5xx錯誤是兩種性質。

OpenAI狀態頁:ChatGPT與Codex錯誤率上升,事件持續5分鐘時的截圖
OpenAI狀態頁:ChatGPT與Codex錯誤率上升,事件持續5分鐘時的截圖
部分使用者存取chatgpt.com時拿到HTTP 404
部分使用者存取chatgpt.com時拿到HTTP 404

下游先感知到

Cursor的狀態頁在這一晚同時掛著兩條事件。一條是21時41分的Grok降級,一條是22時17分的「Anthropic模型錯誤率上升」,後者寫明是「上游Anthropic問題」導致Fable 5.1、Fable 5、Opus 5、Opus 4.8、Opus 4.6的請求出錯,「部分使用者會遇到錯誤或Agent回合失敗」。

Cursor狀態頁同時掛著Grok全系降級與Anthropic上游錯誤兩條事件
Cursor狀態頁同時掛著Grok全系降級與Anthropic上游錯誤兩條事件

這份清單跟Anthropic自己給出的一致,只少了Cursor本來就沒接的Mythos。對AI編程工具而言,一晚上兩家上游同時出問題,「多模型備援」這個賣點的兜底能力一次被考掉一半。

中國大陸開發者更被動一些。多數人走中轉API或聚合平台,故障資訊要經一層轉述才到手,中轉商通常只顯示「上游異常」,不區分是哪一家、哪個型號。這一晚Claude的Haiku與Sonnet沒有出現在受影響清單裡,Gemini全程可用,知道這一點的人可以直接切換模型,不知道的人只能重新整理頁面等待。

谷歌沒事,是線索還是巧合

中文技術社群裡最先冒出來的猜測是「上游線路或DNS出了問題」。這個猜測目前無法核實。反面證據有兩條:谷歌雲的事件列表當天沒有任何新增,Gemini全天正常;Anthropic的措辭是「已定位原因」,指向自家內部,共享基礎設施故障通常會寫成「上游供應商」。

正面證據也有。Anthropic受影響的全是大型模型,小型模型倖免;xAI被標記的是「全部Grok模型」;OpenAI只列了ChatGPT和Codex,API那一欄是綠色的。三家的受災範圍都集中在推論端的大型模型,這比較像算力供應商某個區域出問題,不像DNS那種「全部打不開」。

另一處可以對照的資料來自第三方可用性監控。截至北京時間23時37分(UTC 15:37),它標記了9個故障服務,除Cursor、Claude、OpenAI之外,Cloudflare、Supabase、GitHub、Notion、SendGrid、Twilio也各有部分降級。這份名單看起來支持「上游出事」的猜測,但Cloudflare官方狀態頁當晚沒有新增事件,掛著的是8月底遺留的R2與WARP兩條,其餘幾家的降級是否與本次相關也沒有依據。同一頁面上Grok在23時37分已顯示正常運作。

第三方可用性監控頁北京時間23時37分的快照:9個服務處於故障狀態,Cursor為重大故障
截圖來自 ip.net.coffee 服務狀態頁,北京時間23時37分

能從這些線索得出的只是「三家各自的大型模型推論在同一時段出了問題」,再往前一步就是推測。三家都沒有發布事故報告,公開更新裡也沒有提到任何第三方。哪種解釋成立,要等各家的事後覆盤,通常需要三到五個工作天。

參考來源:Anthropic狀態頁、OpenAI狀態頁、Cursor狀態頁、谷歌雲事件列表、CocoLoop社群使用者截圖;各家受影響模型清單與事件階段按狀態頁原文核對,xAI狀態頁無法存取(回傳403),其受影響範圍以Cursor狀態頁與第三方彙整看板為準。