
OpenAI 據報拆散 Preparedness team:分流風險評估會削弱把關嗎?
框架仍然有效,跨領域審核同公開交代值得追住睇
OpenAI 據報喺 7 月底拆散 Preparedness team。《金融時報》消息經 The Verge 轉述,原本由呢隊人負責嘅嚴重風險評估同緩解工作,會按 bio、cyber 等範疇分拆,再交畀既有團隊。原主管 Dylan Scandinaro 就轉去研究 AI 遞歸式自我改進可能帶嚟嘅影響。OpenAI 截至報道刊出,未見有直接公告交代新架構,所以人手點分、邊隊接手,同埋匯報線點改,暫時都未完全清楚。
框架未消失,執行架構就真係變咗
單睇「解散」兩個字,好容易以為 OpenAI 連 Preparedness Framework 都一併收起。現有證據未支持呢個講法。OpenAI 2025 年更新嘅框架仍然列出生物及化學、網安、AI 自我改進三個主要追蹤範疇;長時間自主運作、刻意收埋能力、繞過防護等問題,就放喺研究範疇。達到 High 能力嘅系統,要先有足夠防護先可以推出;去到 Critical,連繼續開發都要受限制。
呢套框架亦冇將發布決定全交畀 Preparedness team。官方寫法係由跨部門 Safety Advisory Group 審閱能力同防護報告,再向 OpenAI 管理層提出建議,最後決定權一直喺管理層手上。中央團隊過往較似負責拉齊評估方法、威脅模型、內部 red team 同不同風險之間嘅尺度。團隊拆開之後,呢層協調會由邊個接住,先係制度上最大嘅問號。

圖片:OpenAI Deployment Safety Hub
按 bio、cyber 分流,其實有實務理由
分流本身唔一定代表安全工作縮水。Bio 測試牽涉實驗室流程、病原體知識同專家判斷;網安就要識漏洞研究、攻擊鏈、權限提升、避過偵測同長時間 agent 操作。兩邊用嘅數據、測試環境同外部專家都差好遠。將評估人員放近各自範疇,理論上可以快啲更新 benchmark,亦容易將測試結果直接變成模型訓練、監察器同存取限制。
官方 GPT‑5.3‑Codex system card 已經見到呢種走向。OpenAI 首次按 High 網安能力級別處理一個模型,而呢個模型就係 GPT‑5.3‑Codex。雖然公司話未能斷言佢已正式踩線,但三組預警測試都過咗門檻,所以採取較保守做法,啟動相應防護。文件同時把佢當成 High 生物及化學風險處理。即係話,風險評估早已愈做愈專門,今次重編好可能係將呢個方向正式寫入組織架構;呢點係根據現有官方文件作嘅推斷。
中央角色淡出,最怕測試之間出現罅隙
問題係,coding agent 嘅風險未必會乖乖留喺單一分類。Codex 可以讀 code、上網搵資料、執行工具,再連續做幾個鐘;一個涉及自我複製、偷取憑證同改動防護設定嘅情境,可以同時踩入網安、長時間自主運作同繞過防護。如果各隊只睇自己嗰截,跨領域攻擊鏈就有機會喺交界位走甩。中央 Preparedness team 原本較適合追呢類「邊個都只負責一半」嘅問題。
另一個風險係獨立性。如果承接職責嘅既有團隊同產品發布時間綁得太近,負責提升模型能力嗰邊亦要評估自己有冇踩線,內部拉扯自然會多。呢個安排都可以做得好,前提係測試標準、升級機制同 SAG 審閱權限夠清楚。OpenAI 近年先後重組多隊安全及 alignment 團隊,加上正向上市方向推進,外界對呢種內部制衡有疑問,唔算無的放矢。
下一份 system card 會交代幾多
對用 Codex、ChatGPT 或 API 嘅人,組織圖改動唔會即時令 sandbox、權限審批、網絡限制同自動安全檢查消失。真正影響會喺下一批模型發布先浮面:評估有冇縮窄、High 門檻點判、外部 red team 仲有冇參與、Safeguards Report 有冇照出。舊官方網頁同招聘頁繼續寫住 Preparedness team,只能證明內容未更新,唔足以推翻今次據報嘅重組。
OpenAI 曾承諾每次 frontier model 發布都公開 Preparedness 結果。下一次 GPT 或 Codex 更新時,可以睇 OpenAI 有冇完整交代網安、bio、AI 自我改進同跨領域風險,仲有 SAG 點評估剩餘風險;到時就較容易判斷今次重編有冇削弱把關。
參考來源
- The Verge — OpenAI reportedly disbanded its preparedness team — original report
- Financial Times:OpenAI preparedness team restructuring — The Verge 所引述嘅首發報道;原文可能受付費牆限制,核心消息仍要當作據報處理。
- Our updated Preparedness Framework — OpenAI 官方交代 High、Critical 門檻、追蹤範疇、SAG 審閱安排同發布承諾。
- GPT-5.3-Codex System Card — 官方最新 Codex 安全評估,顯示 Preparedness Framework 仍用於發布把關,亦交代 High 網安能力判斷。
- Frontier risk and preparedness — OpenAI 2023 年成立 Preparedness team 時公布嘅原始職責,包括跨風險評估、內部 red team 同威脅預測。
- OpenAI sheds senior execs in pre-IPO refresh — 補充上市前管理層、安全及 alignment 人員變動嘅背景。
本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。







