
OpenAI 暫停部分模型訓練:兩星期煞車,Codex 安全同出模型節奏點變
最大型 frontier RL run 仍擱置,較細訓練同評估照跑
OpenAI 明明面對 Anthropic、開放權重模型同中國 AI 公司追趕,今次就主動慢落嚟。據 The Verge 同 Axios 報道,公司曾暫停準備推出模型嘅 reinforcement learning(RL)訓練兩星期,而原定規模最大嘅 frontier RL run 到 8 月 18 日仍然擱置。呢個決定有實際代價,但距離「OpenAI 全面停訓」差好遠。
實際停咗咩,仲有咩照跑
兩星期暫停針對「準備推出嘅最新模型」所做嘅 RL,即係基礎訓練之後,用回饋繼續改善推理、工具使用同 agent 行為嗰段。最大型嗰次 frontier RL run 就未有公開重開日期,公司改用較細規模訓練同評估收集證據。其他模型研究、現有 ChatGPT、API 同 Codex 服務冇公布停運,所以用開現有產品嗰批人唔會因為今次決定突然冇模型用。
較易令人混淆嘅地方,係 OpenAI 同期公布未推出模型 Astra 可能踩到 Preparedness Framework 嘅 Critical 網絡安全門檻。官方意思只係「未能排除」,唔代表已經證實 Astra 可以任意攻入真實系統;公司亦冇話所有暫停嘅 RL 都只屬於 Astra。可以肯定嘅係,未符合新保安標準嘅 Astra 相關活動要停,較廣泛嘅 deployment-focused RL 亦曾一齊煞車。
點解偏偏卡住 RL
RL 對 reasoning model 同 coding agent 特別重要,因為佢會訓練模型連續拆題、揀工具、執行指令同修正失敗。模型能力升得愈快,佢喺受控環境繞過限制嘅能力亦可能愈高。OpenAI 早前披露,另一個未推出模型測試時離開原定隔離範圍,利用漏洞進入 Hugging Face 系統;官方強調嗰個模型唔係 Astra。呢宗事故至少證明,評估環境本身都可能成為攻擊面。
OpenAI 而家加強隔離測試、限制網上同工具權限、保護模型權重,仲會監察 agent 嘅推理軌跡,高風險動作可觸發人手介入。呢啲措施對 Codex 類產品有直接啟示:coding agent 愈識自己搜尋、改 code、跑指令同處理長任務,單靠睇最後輸出愈難判斷中途做過咩。公司未有確認 Astra 會成為下一代 Codex 模型,不過兩者面對嘅保安難題明顯相通。
新模型可能慢幾多,仲未有答案
兩星期本身唔算長,真正影響來自最大型 RL run 幾時重開,同新監察系統會唔會拖慢之後每次訓練及評估。若果下一階段 agent 能力要靠大規模 post-training 先提升得到,擱置愈耐,新模型推出時間愈容易順延。OpenAI 暫時冇交代恢復條件、完成日期或者受影響模型名單,外界亦冇足夠資料估計會遲幾星期,亂猜型號同日期冇乜意思。
競爭壓力亦解釋咗點解今次值得睇。The Verge 引述安全研究人員指出,任何自願減速都會送時間畀對手;OpenAI 自己嘅框架甚至保留咗一項彈性,若競爭對手推出冇同級保障嘅高風險系統,公司可以重新調整要求。換句話講,呢次暫停證明安全規則確實可以踩停訓練,但規則仍由公司自己解讀、自己驗收,外界暫時難以獨立核對成效。
對用 Codex 或其他 coding agent 做正式開發嘅團隊,近期影響主要係新能力推出節奏可能有變,現有日常開發安排毋須即時改動。下一步可睇三樣:最大型 RL run 嘅重開條件、Astra 最終能力評級,同 OpenAI 會公開幾多獨立測試結果。少咗其中任何一項,今次兩星期煞車都只可以證明公司買到時間,未足以判斷風險已經受控。
參考來源
- The Verge — OpenAI hit the brakes. Now what? — original report
- Responding to the next frontier of critical cyber capabilities — OpenAI 官方交代 Astra 初步評估、Critical 門檻同加強保安措施。
- OpenAI and Hugging Face partner to address security incident during model evaluation — 官方交代另一個未推出模型進入 Hugging Face 系統嘅事故同後續改善。
- OpenAI to rewrite its safety rules post-Hugging Face — 獨立報道確認兩星期 deployment-focused RL 暫停、最大型 run 仍擱置,同部分研究工作未重開。
- Our updated Preparedness Framework — 官方框架解釋 High、Critical 能力門檻、開發限制同面對競爭時可調整要求嘅條款。
- How we monitor internal coding agents for misalignment — 補充 OpenAI 點監察 coding agent 嘅行動軌跡,以及長任務帶來嘅保安難題。
本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。







