技術

Claude 數日內攻入 OpenAI 系統——真正該回答問題的是 Anthropic

Adrian Kessler
在 Google 中新增我們

一小支團隊將Anthropic的最新模型指向OpenAI的大門,然後長驅直入。多數人看到的版本——聰明的局外人讓ChatGPT的創造者難堪——搞錯了重點。這次入侵並非因為OpenAI忘了修補任何漏洞。關鍵在於Anthropic推出了一款更強大的克勞德(Claude)。真正值得深思的是:一個停滯了數天的任務,在新旗艦模型上線後自行解決了。

涉事者並非罪犯。安全初創公司Hacktron的研究人員在OpenAI自家的漏洞賞金計畫內工作,將幾個不起眼的網路弱點串聯起來,進入了OpenAI員工的帳戶,一路深入到內部程式碼儲存庫——然後停了下來,提交了發現,領取了一筆小額獎金。他們留下了一個無害的標記作為證明,沒有進一步動作。把這當作一樁罪案看,它無足輕重;當作一次能力測試看,這是一枚升空的信號彈。

這是媒體報導跳過的機制。團隊先用了為安全工作調校的克勞德Opus 4.8版本執行任務,但在多次嘗試中都卡住了。然後Anthropic發布了Opus 5。Hacktron團隊寫道:「Opus 4.8在數次對話中都無法產出可用的利用程式。Opus 5發布後幾小時內,我們把同樣的問題交給它,它就成功了。」VentureBeat報導,新版模型在幾小時內就為一個棘手的晶片目標寫出了可用的利用程式。在那段時間裡,OpenAI的防禦沒有任何變化。改變的是模型。

這正是Anthropic自家安全機制設計來偵測並攔截的那種躍進——一般用戶利用現成訂閱就能做到的能力躍升。該公司將其最強大的網路模型Mythos置於出口管制和一份經過審核的防禦者短名單之後,並稱之為他們所打造過最強的安全模型。但這一切都無關緊要,因為公開可用的層級就已足夠。Gray Swan執行長馬特·弗雷德里克森(Matt Fredrikson)對TechCrunch表示:「每個月花200美元,任何人都能用這些工具入侵像OpenAI這樣的公司。」

責任歸屬因此落在Anthropic而非其競爭對手身上。Anthropic的整個品牌形象都建立在謹慎之上——其執行長達里奧·阿莫迪(Dario Amodei)公開談論這項技術的「真實危險」,並推動業界放慢腳步。一個確實降低了入侵競爭對手實驗室門檻的公開發行模型,與這個訊息形成了令人不安的對比。在被問及此事時,該公司沒有任何回應;CBS News報導,Anthropic未回覆評論請求。OpenAI方面則感謝了研究人員,縮小了攻擊者濫用的權限,並撤銷了受影響的會話。

具體細節幾乎平淡無奇。入侵途徑來自一個與運行OpenAI社群論壇的Discourse軟體捆綁的過時影像處理程式庫;第二個漏洞涉及登入令牌的作用域設定,讓研究人員得以利用受入侵的會話進入員工的ChatGPT與Codex帳戶,再一路進入私有程式碼。從最初立足點到進入儲存庫,整個鏈條花不到三天。OpenAI支付了6,500美元。團隊表示,整個過程中他們花在克勞德(Claude)上的時間成本不到3,000美元——兩個月的工作,大部分是人工作業,最後被一台不再需要專家的機器壓縮完成。

過去保護目標的稀缺資源從來不是修補程式,而是那個能找出漏洞、把它們焊接起來、看清路徑的專家——以及達成此事所需的數月時間。如今這項專業知識變得廉價。這次,抵達OpenAI程式碼的團隊提交了報告並領取了獎金。下一個用同樣訂閱跨過同一道門檻的人,沒有義務這麼做。

標籤: , , , , ,

在 Google 中新增我們

討論

共有 0 則留言。