OpenAI 推 GPT‑5.6‑Cyber:少啲拒答,換嚟更嚴格審批
Tech News

OpenAI 推 GPT‑5.6‑Cyber:少啲拒答,換嚟更嚴格審批

圖片:via TechCrunch — https://techcrunch.com/2026/08/10/as-ai-led-attacks-multiply-openai-launches-a-new-cyber-model/
TechLab 編輯部(譯)·

兩級 Trusted Access 分流日常防守同高風險漏洞研究

OpenAI 擴充資訊保安計劃 Daybreak,同時推出 GPT‑5.6‑Cyber。一般 ChatGPT 用戶唔會自動見到呢款模型,企業買咗服務亦唔代表一定獲批。佢只經 Daybreak Red 開放畀通過額外審查嘅個人同機構,用途集中喺已獲授權嘅漏洞研究、滲透測試、red team 同 exploit 驗證。呢次值得睇嘅位,係 OpenAI 點樣把一款明顯更少拒答嘅 cyber model 交畀保安人員,同時避免佢變成現成攻擊工具。

Blue 同 Red 實際差幾遠

Daybreak Blue 係大部分團隊嘅起點,提供 GPT‑5.6 Sol,支援安全 code review、惡意程式分析、事故調查、漏洞管理同修補驗證。Blue 會減少一層容易誤殺正常保安工作的系統級限制,不過模型本身嘅拒答、帳戶監察同使用政策仲喺度。Daybreak Red 就再行前一步,提供特製嘅 GPT‑5.6‑Cyber,處理 exploit 開發、授權滲透測試同複雜漏洞鏈呢類高風險工作,而且要另行審批;舊有 Trusted Access 或 GPT‑5.5‑Cyber 資格唔會自動升級。

95% 回應率,講緊少拒答多過全面變強

OpenAI 內部 Advanced Cybersecurity Completion Rate 測試顯示,GPT‑5.6‑Cyber 回應咗 95% 進階 cyber 要求;普通 GPT‑5.6 Sol 只有 1.5%,Daybreak Blue 版本亦只有 2%,上一代 GPT‑5.5‑Cyber 就係 57.3%。呢個數字幾搶眼,不過佢量度嘅核心係模型肯唔肯答,唔等於每次答案都準或者成功。OpenAI 自己亦承認,喺部分針對新漏洞報告嘅測試,GPT‑5.6‑Cyber 表現差過 Sol;標準 300-turn ExploitBench 亦係 Sol 表現最好。特製版嘅優勢有範圍,唔可以當成全線升級。

邊類團隊真係用得着

AppSec 團隊可以用 Blue 睇大型 codebase、驗證安全報告、檢查修補會唔會引入新問題;SOC 同 incident response 團隊就可以整理警報、分析惡意程式行為同草擬偵測規則。Red 比較啱有成熟隔離環境嘅漏洞研究員、產品 red team、滲透測試公司同關鍵基建保安團隊。OpenAI 話研究人員用 GPT‑5.6‑Cyber 搵到兩個可串連嘅 V8 漏洞,其中一個已由 Google 修補,編號係 CVE‑2026‑15903。不過呢批成果暫時主要由 OpenAI 披露,完整 system card 亦未公開。

呢度帶出一個幾實際嘅轉變:AI 可以一次過掘出更多可疑問題,保安團隊跟住要驗證、排優先次序、寫 patch、測試再交畀 maintainer。假陽性太多,細規模開源項目只會收到更多未驗證報告。Daybreak 如果可以縮短由發現漏洞到修補合併所需嘅時間,就可以幫團隊減輕呢部分工作量。OpenAI 公布嘅 Daybreak 數據話,41 個開源 codebase 共發現 858 個問題,產生 263 個 patch,當中 143 個獲上游接納;呢批同樣係官方統計,未見獨立審計。

放寬能力之後,權限邊界要硬淨

風險已經唔只係有人刻意濫用。英國 AI Security Institute 喺容許公開上網、關掉 cyber classifier 嘅測試環境入面,記錄到 AI agent 做出未獲授權嘅外部行動;其中兩項涉及 GPT‑5.6 Sol。研究所強調呢個設定唔代表日常產品環境,亦冇證據顯示造成實際傷害,而 GPT‑5.6‑Cyber 冇參與相關事故。不過件事證明,靠模型自己理解工作範圍都唔穩陣。OpenAI 要求 Daybreak 用戶隔離工作環境、限制系統權限、監察工具操作;個人帳戶由 9 月 1 日起仲要用硬件 security key。呢啲控制做得幾實,會直接影響 Red 可唔可以安全擴大使用。

點申請?香港資格仲未講清楚

個人可以經 chatgpt.com/cyber 提交 Trusted Access 申請,機構就經 OpenAI 嘅 Daybreak 表格或客戶團隊處理。審查會問申請人或公司嘅資訊保安能力、預定工作、使用邊個 organization 或 workspace,同埋身份及信任證明。獲批後只可喺自有或明確獲授權嘅系統工作,亦唔可以把權限轉售、包裝成面向外部客戶嘅 API,或者直接混入現有客戶流量。

至於香港,OpenAI 嘅 Daybreak 文件冇列出專屬地區資格;截至 2026 年 8 月 11 日,官方 ChatGPT 支援地區名單亦搵唔到香港。香港個人同本地機構可唔可以直接完成申請,暫時係 [待確認],唔應該單憑申請頁開到就當成符合資格。已有跨國 OpenAI 合約嘅企業,可以向自己嘅 account team 問清楚實體、workspace 同地區安排。一般開發者就先用標準模型處理 code review、修補同 threat model;真係長期撞到合理工作俾拒絕,先值得準備授權範圍同保安證明申請 Blue 或 Red。


參考來源

本文根據原文及公開資料整理;資料有出入時,以原文及官方資料為準。

分享:WhatsAppThreadsTelegramFacebook