电竞比分网-中国电竞赛事及体育赛事平台

關(guān)于ZAKER Skills 合作

史無(wú)前例!OpenAI 模型“失控”攻入全球最大 AI 開(kāi)源社區(qū) 中國(guó)開(kāi)源模型參與取證

《科創(chuàng)板日?qǐng)?bào)》7 月 22 日訊(編輯 朱凌)今日凌晨,OpenAI 首席執(zhí)行官薩姆 · 奧爾特曼在社交平臺(tái)發(fā)文稱(chēng),公司在模型評(píng)估過(guò)程中遭遇了一起重大安全事件,并感謝全球最大的 AI 開(kāi)源社區(qū) Hugging Face 的合作。

根據(jù) OpenAI 的調(diào)查報(bào)告,在內(nèi)部測(cè)試期間,GPT-5.6 Sol 和一個(gè)更強(qiáng)大的未發(fā)布模型突破了沙盒容器環(huán)境限制,成功連接互聯(lián)網(wǎng),并入侵了 Hugging Face 服務(wù)器,竊取了 ExploitGym 網(wǎng)絡(luò)攻擊能力評(píng)測(cè)答案。

《科創(chuàng)板日?qǐng)?bào)》注意到,這是目前公開(kāi)披露的首起由前沿大模型自主完成真實(shí)網(wǎng)絡(luò)攻擊的安全事件。

OpenAI 稱(chēng),為了測(cè)試模型的極限網(wǎng)絡(luò)攻擊能力,研究團(tuán)隊(duì)有意關(guān)閉了部分安全過(guò)濾器,僅保留高度隔離的沙盒容器測(cè)試環(huán)境,允許模型通過(guò)復(fù)雜攻擊路徑完成評(píng)測(cè)任務(wù)。

然而,為了獲得評(píng)測(cè)答案,模型并未局限于沙盒環(huán)境,而是消耗大量推理資源尋找突破路徑。它首先發(fā)現(xiàn)并利用軟件包緩存代理中的一個(gè)零日漏洞,實(shí)現(xiàn)權(quán)限提升和橫向移動(dòng),最終成功獲取互聯(lián)網(wǎng)訪問(wèn)能力。

接入互聯(lián)網(wǎng)后,模型推斷 Hugging Face 可能托管了用于評(píng)測(cè)的數(shù)據(jù)集及答案,隨后自主制定攻擊策略,利用竊取的憑據(jù)以及新的零日漏洞,成功構(gòu)建遠(yuǎn)程代碼執(zhí)行鏈,進(jìn)入 Hugging Face 生產(chǎn)服務(wù)器,直接獲取測(cè)試答案,以完成評(píng)測(cè)任務(wù)。

OpenAI 表示,所有證據(jù)均顯示,模型始終圍繞 " 獲取 ExploitGym 測(cè)試答案 " 這一目標(biāo)行動(dòng),并不斷自主規(guī)劃攻擊路徑,實(shí)現(xiàn)了多個(gè)漏洞的自動(dòng)發(fā)現(xiàn)、組合利用和持續(xù)推進(jìn),展現(xiàn)出長(zhǎng)時(shí)間、多步驟執(zhí)行復(fù)雜網(wǎng)絡(luò)攻擊的能力。

異?;顒?dòng)隨后被 OpenAI 安全團(tuán)隊(duì)發(fā)現(xiàn)。OpenAI 稱(chēng),此次事件證明,先進(jìn)模型即使沒(méi)有目標(biāo)系統(tǒng)源代碼,也能夠自主發(fā)現(xiàn)現(xiàn)實(shí)系統(tǒng)中的新攻擊路徑,并完成漏洞利用。這意味著未來(lái) AI 不僅能夠輔助安全研究人員尋找漏洞,同樣也可能被用于自動(dòng)化實(shí)施高水平網(wǎng)絡(luò)攻擊。

作為回應(yīng),OpenAI 宣布將進(jìn)一步強(qiáng)化模型開(kāi)發(fā)階段的隔離、監(jiān)控、訪問(wèn)控制以及評(píng)估機(jī)制,并修復(fù)相關(guān)漏洞。同時(shí),公司已向第三方軟件供應(yīng)商負(fù)責(zé)任披露發(fā)現(xiàn)的零日漏洞,與 Hugging Face 共同開(kāi)展調(diào)查,并加強(qiáng)未來(lái)模型訓(xùn)練及評(píng)估期間的安全保護(hù)措施。

值得注意的是,Hugging Face 此前披露,事件發(fā)生后,其安全團(tuán)隊(duì)曾嘗試調(diào)用美國(guó)某商業(yè)前沿大模型 API,對(duì)超過(guò) 1.7 萬(wàn)條攻擊日志進(jìn)行分析,希望借助 AI 完成事件取證。然而,由于模型無(wú)法準(zhǔn)確區(qū)分安全響應(yīng)人員與攻擊者,其安全防護(hù)機(jī)制誤判相關(guān)請(qǐng)求,拒絕提供協(xié)助,導(dǎo)致分析工作受阻。

Hugging Face 轉(zhuǎn)而在自有基礎(chǔ)設(shè)施部署中國(guó)開(kāi)源模型 GLM 5.2,對(duì)攻擊日志進(jìn)行本地分析。官方表示,原本可能需要數(shù)天完成的海量日志取證工作,被壓縮至數(shù)小時(shí)。同時(shí),本地部署避免了將真實(shí)攻擊日志、內(nèi)部憑據(jù)及系統(tǒng)信息上傳至第三方服務(wù),在提升分析效率的同時(shí),也降低了敏感數(shù)據(jù)外泄風(fēng)險(xiǎn)。

Hugging Face 首席執(zhí)行官克萊門(mén)特 · 德朗格表示,此次事件或許是史無(wú)前例的,但再次印證了一個(gè)長(zhǎng)期觀點(diǎn):AI 安全無(wú)法依靠任何一家企業(yè)獨(dú)自完成,而需要行業(yè)公開(kāi)透明合作,讓全球安全研究人員共同使用 AI 提升防御能力。

相關(guān)閱讀

最新評(píng)論

沒(méi)有更多評(píng)論了

覺(jué)得文章不錯(cuò),微信掃描分享好友

掃碼分享

熱門(mén)推薦

查看更多內(nèi)容