ChatGPT、Codex 同 OpenAI API 同時出錯,官方套用修復後仲監察緊
3C 產品

ChatGPT、Codex 同 OpenAI API 同時出錯,官方套用修復後仲監察緊

圖片:via Android Authority — https://www.androidauthority.com/chatgpt-july-23-outage-3690900/
TechLab 編輯部(譯)·

事故影響多項服務,香港暫時冇特別嚴重嘅跡象

OpenAI 多項服務喺 7 月 23 日一齊出錯,受影響範圍包括 ChatGPT、Codex 同 OpenAI API。官方狀態頁顯示,跨產品事故由香港時間 7 月 23 日晚上 11:36 開始,期間用戶遇到較高錯誤率。OpenAI 已套用修復方案,不過截至出稿一刻,狀態仍然係「Monitoring」同「Degraded performance」,即係服務開始回復,但未可以當全面正常。

其實有兩宗事故重疊

官方紀錄顯示,當晚有兩宗相關事故。第一宗由香港時間 7 月 24 日凌晨 1:56 開始,涵蓋 ChatGPT 全部 15 個分類元件;另一宗開始得早啲,牽涉 12 個 API 元件、4 個 ChatGPT 元件同 4 個 Codex 元件。後者喺凌晨 2:50 一度進入監察階段,但官方到 3:37 又再調查,去到 4:22 先話已重新套用修復。換言之,服務唔係一次過就回復正常。

OpenAI 曾提到正同「下游基建供應商」處理問題,但暫時冇公開供應商身份、詳細成因或者受影響地區。ChatGPT、Codex 同 API 雖然係唔同產品,但今次同時出錯,反映佢哋可能受同一個下游基建問題影響。如果幾項服務同一時間報錯,公司團隊逐部電腦重裝 app 或改設定,多數都只係白忙一輪。香港用戶同樣可能受影響,但官方冇資料顯示香港特別嚴重,仲唔足以話全港用戶都斷線。

ChatGPT、Codex 同 OpenAI API 同時出錯,官方套用修復後仲監察緊

圖片:Wikimedia Commons — Phlsph7(CC BY-SA 4.0)

點分平台故障定自己連線出事

最直接係先睇 OpenAI 狀態頁。如果官方同一時段列出 ChatGPT、Codex 或 API 錯誤率上升,而你換瀏覽器、換裝置仍然出錯,平台事故嘅可能性就相當高。相反,狀態頁正常,而 ChatGPT 只喺公司 Wi-Fi、VPN 或某個瀏覽器出問題,可以試無痕視窗、暫停私隱或內容攔截外掛,再用手機數據測一次。OpenAI 自己嘅排錯指引都建議用呢幾步分辨瀏覽器設定、VPN、secure DNS 同連線問題。

API 團隊就要睇清楚錯誤率同時間,唔好淨係數有幾多個失敗 request。流量突然增加,錯誤總數自然會升;較有用嘅做法係按 project、model 同 service tier 拆開睇,再保存 HTTP 狀態碼、時間、受影響 endpoint 同 request ID。亦要避免無限重試,否則平台開始回復嗰陣,大量積壓 request 一齊湧返去,自己套系統反而會再塞一次。

用 AI 做正式工序要預留後備路線

今次事故未有完整技術報告,但已經示範咗一個幾實際嘅風險:同一間公司嘅聊天工具、寫 code 工具同 API 可以一齊受基建問題拖累。用 ChatGPT 寫內容、靠 Codex 改 code,或者將 OpenAI API 接入客服同內部流程嘅團隊,最好保留草稿、本機開發狀態同可暫停嘅工作隊列。出稿時官方仍然監察緊回復情況,急住交付嘅團隊應繼續留意狀態頁更新。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook