技術

OpenAI發佈攻擊型AI:漏洞利用鏈完成率95%,遠超標準模型的1.5%

Susan Hill

GPT-5.6-Cyber 在內部測試中發現 Chrome 的 V8 JavaScript 引擎存在一個高嚴重性漏洞——該漏洞此前從未被公開揭露。它還發現了行動作業系統、資料庫及核心軟體中的漏洞,這些全都是先前未知的。OpenAI 的新模型並非防禦性工具,而是專為駭入而打造。

該模型基於 OpenAI 現有通用模型 GPT-5.6-Sol 進行訓練,再經專門針對攻擊性安全任務的重新訓練。在 OpenAI 內部的 Cyber Capability Evaluation 基準測試中,GPT-5.6-Cyber 完成了 95% 的漏洞利用鏈請求——這些任務涉及權限提升、身分驗證繞過與任意程式碼執行。標準版 GPT-5.6 僅完成 1.5% 的相同請求,而前一專門模型 GPT-5.5-Cyber 則獲得 57.3% 的分數。

從 57.3% 躍升至 95%——這一代的跳升正是此次發佈的關鍵數字。這意味著,AI 所能做到的事與熟練人類攻擊者之間的差距,在不到一年內縮小了約 40 個百分點。

GPT-5.6-Cyber 的具體能力包括辨識已知漏洞、從頭建構漏洞利用鏈,以及尋找零時差漏洞:那些尚未有人記錄或修補的缺陷。最後一項能力是與以往任何 AI 安全工具最顯著的突破。尋找零時差漏洞需要專業知識與大量時間,而 GPT-5.6-Cyber 現在可以按需完成。

OpenAI 並未公開發佈此模型。存取權限透過 Daybreak Red 提供,這是該公司 Daybreak 網路安全計畫中的較高層級。初期合作夥伴包括 Accenture、IBM、CrowdStrike、Cloudflare、Palo Alto Networks、Sophos、Capgemini、EY、KPMG 與 PwC——這些大型顧問與安全公司將使用此模型掃描客戶的基礎設施,在攻擊者發現相同漏洞之前先行防護。

但存取控管並未回答更棘手的問題:OpenAI 現在決定誰能使用能夠在任何軟體中尋找漏洞的 AI。審核名單上僅有大型企業與頂級顧問公司。個別安全研究人員、小型團隊及學術機構並未納入初期部署。測試期間發現的 Chrome V8 漏洞正與 Google 進行協調揭露——該公司並未透露該模型在發佈前還找到了多少其他漏洞。

OpenAI 表示,計劃在未來幾個月內將 Daybreak Red 計畫擴展至更多經過審核的合作夥伴。

對軟體產業而言,數字是赤裸的:如果 AI 能以 95% 的完成率掃描程式碼庫尋找零時差漏洞,每個安全團隊最終都將需要一個——或者必須假設對手已經擁有了一個。

標籤: , , , , ,

討論

共有 0 則留言。