
OpenAI 新模型放行咗,但政府點樣判斷安全仲係唔透明
自願審查唔等於安全保證,企業用 AI agent 要睇清楚
事件唔止係模型推出
OpenAI 喺 7 月 9 日公開推出 GPT-5.6 系列,主角係 Sol,另外有 Terra 同 Luna。表面睇係又一輪大模型推出,但今次卡位唔同:Sol 之前只畀一小批可信合作伙伴預覽,OpenAI 話係按美國政府要求,先向政府交代計劃同模型能力,再慢慢放開。白宮之後補充,政府冇批核、冇發放行紙,公司幾時推出仍然自己決定。法律上係自願,但實際上政府已經早咗入場睇。
政府審查到底查咩?
白宮 6 月 2 日嘅行政命令講得幾清楚:相關部門要整一套機密 benchmark,判斷邊啲模型算 covered frontier model,再設計自願框架,畀政府喺公開推出前最多 30 日接觸模型;同一段又寫明,呢套嘢唔構成強制牌照、預先批核或者發牌。NIST 旗下 CAISI 嘅公開說法,就係佢會做國安風險相關評估,焦點放喺網安、生物安全同化學武器風險。麻煩位係,OpenAI 今次到底畀邊批專家試、試到咩深度、點樣由測試結果變成可以放開,外面仲係睇唔到。
Anthropic 嗰次就係警號
Anthropic 6 月踩過一次坑。美國政府用出口管制指令,要求停晒外國籍人士接觸 Claude Fable 5 同 Mythos 5;Anthropic 話因為冇辦法即時核實用戶國籍,結果要直接關掉所有客戶存取。到 6 月 30 日,出口限制先解除,Fable 5 7 月 1 日重新開畀全球用戶,Mythos 5 就先恢復畀部分美國組織。Anthropic 嘅講法係,政府關注嘅 jailbreak 只觸及已知、較細嘅漏洞,其他已公開模型都做到相近結果。呢單事唔代表 Anthropic 一定啱晒,但示範得好清楚:政府一出手,企業客戶嘅 API、Claude Code、Claude Cowork 日常任務可以一晚之間斷線。
安全卡資料多,但答唔晒政府點判斷
OpenAI 嘅 GPT-5.6 system card 算係交功課交得多:Sol、Terra、Luna 喺 OpenAI Preparedness Framework 入面,網安同生物 / 化學風險評為 High,AI 自我改進未到 High;OpenAI 亦話未到 Cyber Critical,Sol 同 Terra 可以搵漏洞同 exploit 零件,但測試下未做到自主完成針對硬化目標嘅 end-to-end 攻擊。佢仲列出 UK AISI、SecureBio、Irregular、METR 等外部評估。不過 system card 始終係供應商文件,唔等於政府評估報告;佢講到模型點樣過到 OpenAI 自己嘅門檻,但冇交代政府點樣定門檻。
開發者要當供應鏈風險睇
如果你只係喺 ChatGPT 問資料,最多係功能遲開幾日。但對用 API、Codex、Claude Code 或者內部 AI agent 做開發、資安 triage、文件生成嘅團隊,呢件事係供應鏈風險。模型安全聲明要睇,外部 eval 要睇,政府有冇透明標準都要睇;同時要準備 fallback model、權限分層、人工確認高風險動作、日誌同審計。尤其係 agent 可以改 repo、開 ticket、掂 CRM 或雲端資源嗰種場景,安全問題已經唔止係答錯咁簡單,仲包括佢有冇權做錯事。
下一步睇標準點樣公開
接住值得睇嘅位,係 8 月初前美國幾個部門交出嚟嘅 frontier model 流程有冇一套可以比較嘅標準:邊啲能力觸發審查、測試者有幾多 access、外部研究員點參與、出事嗰陣點樣通知客戶同恢復服務。美國政府想避開 AI 牌照制,AI 公司又唔想每次推出都逐單傾判;所以中間嗰套流程要講清楚,企業先會信得過。做企業採購或者內部開發嘅人,唔好淨係睇模型頁寫到好安全,要問得實際啲:安全係邊個試、用咩標準試、失手嗰陣你嘅系統點退場。
參考來源
- TechCrunch — How did the government decide OpenAI’s frontier model was safe to release? — original report
- GPT-5.6 System Card | OpenAI Deployment Safety Hub — OpenAI 官方 system card,核對 GPT-5.6 風險分類、外部評估同 safeguards。
- Previewing GPT-5.6 Sol: a next-generation model | OpenAI — OpenAI 官方預覽文,核對限量預覽、政府要求、API/Codex 存取安排。
- Promoting Advanced Artificial Intelligence Innovation and Security | The White House — 白宮行政命令,核對自願框架、30 日早期接觸同非強制批核條文。
- Center for AI Standards and Innovation (CAISI) | NIST — NIST/CAISI 官方頁,核對 CAISI 喺模型評估同國安風險範圍入面嘅角色。
- Statement on the US government directive to suspend access to Fable 5 and Mythos 5 | Anthropic — Anthropic 官方聲明,核對 Fable 5 / Mythos 5 因出口管制停用嘅時間線。
- Redeploying Fable 5 | Anthropic — Anthropic 官方更新,核對出口管制解除、Fable 5 重新開放同 Mythos 5 限定恢復。
- Scoop: Trump administration lifts restrictions on OpenAI's GPT 5.6 | Axios — 背景報道,補充 CAISI 測試、會面同白宮否認批核嘅說法。
本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。







