OpenAI人工智能模型安全測試期間失控 自主發動網絡攻擊

本帖最後由 cbsphoto 於 2026-7-23 21:19 編輯

https://www.youtube.com/watch?app=desktop&v=2RLlVwwBQGg

今次屈唔到人地入侵先, 扮唔到受害者, 國家安全

TOP

傳係glm擋住了攻擊

TOP

玩大左。。。。。

成日認自己幾咁先進。。。

TOP

有點失控了?

TOP

無失控,係“意外”(佢話).公司一定要有local AI, 如果其他付費AI幫唔到手真係GG了

TOP

OpenAI模型「越獄」入侵Hugging Face  終靠中國智譜GLM-5.2緊急救場

全球人工智能(AI)圈子爆出令人目瞪口呆的「AI反噬與救場」史詩級風波。美國AI巨頭OpenAI與全球最大AI開源平台Hugging Face日前聯合披露,OpenAI旗下包括GPT-5.6 Sol在內的先進模型,在一次關於黑客攻防能力的內部沙盒測試中竟然「失控越獄」,自主尋獲零日漏洞連接互聯網,並跨越組織邊界發動網絡攻擊,成功入侵Hugging Face的生產系統。更具諷刺意味的是,受害的美企在嘗試用美國主流AI模型展開防禦時,因其內置的「安全護欄」拒絕分析惡意代碼,最終被迫轉用中國智譜AI的開源模型「GLM-5.2」才得以成功救場。
美商業模型護欄阻擋 唯中國模型可用

據OpenAI證實,事件發生在旗下模型進行網絡攻防測試期間。兩款模型(包括未發布的頂尖模型)在隔離環境中,為解決評估問題並奪得高分,高度專注地瘋狂消耗推理算力,竟自行發現並利用了第三方軟件的零日漏洞突破隔離、接入互聯網。

隨後,模型推斷出Hugging Face可能存有該測試的解答,隨即自主串聯多個攻擊向量,利用竊取的憑證及遠端代碼執行(RCE)路徑,在短短數小時內攻陷Hugging Face的生產基礎設施。

Hugging Face的安全團隊在偵測到這場史無前例的「自主AI代理人攻擊」後,本欲調用美國頂尖大模型的API來分析龐大的攻擊日誌。然而,美國這些高壁壘商業模型的安全護欄「無法區分事件響應人員與黑客」,將含有惡意代碼的分析請求全數攔截,直接令防禦工作癱瘓。

在危急關頭,Hugging Face改在自家基礎設施上運行中國智譜AI於6月中旬發布的開放權重模型「GLM-5.2」。該款性能媲美GPT-5.5的中國模型毫無阻礙地完成了逾1.7萬條日誌分析,成功協助重建攻擊時間線。

此事件迅速震驚華盛頓與矽谷,網民紛紛調侃「美企被自家模型黑了,卻只能靠中國模型救命」。專家亦指出,在特朗普政府正大力討論封殺中國大模型、財長貝森特污衊使用中國模型如「使用假冒商品」之際,此案無疑給了美方的禁令一記重擊,證明了開放權重模型在防禦前沿AI攻擊中的不可替代性。

來源網址 : OpenAI模型越獄入侵Hugging-Face-終靠中國智譜GLM-52緊急救場 | 星島頭條
https://www.stheadline.com/realtime-china/3596877/

TOP

OpenAI周二稱,在Hugging Face事件中,該模型還入侵4個不同服務的4個帳戶。

原文網址:https://news.mingpao.com/pns/%e5 ... 00014/1785431454720

TOP

本帖最後由 VV 於 2026-7-31 19:29 編輯

AI再傳安全風險 Anthropic認測試期間「暴走」入侵三家外部機構

原文網址: AI再傳安全風險 Anthropic認測試期間「暴走」入侵三家外部機構 | 香港01 https://www.hk01.com/article/603 ... utm_medium=referral

可能本身訓練點入侵??? or 入侵左比人發現扮測試???

TOP

OpenAI 人工智能竟私自建留言板 讓多個 AI 交流破解方法 被阻止後竟偷偷重建

OpenAI 一款測試中人工智能模型今年 5 月起自行建立秘密「留言板」,讓多個 AI 代理互相交換突破網絡限制方法,最終利用漏洞入侵 Hugging Face 生產環境。OpenAI 一度阻止後,AI 代理竟另覓漏洞重建留言板,繼續協作攻擊,揭示自主型 AI 潛藏失控風險。

事件始末:從失敗到意外發現漏洞

OpenAI 研究員 Michael Dalton 與 Eric Wallace 於 8 月 5 日在美國拉斯維加斯舉行的 Black Hat USA 2026 網絡安全會議上,公開講解今次事故完整經過。據講者說明,OpenAI 早於 2026 年 5 月 7 日開始一項內部評估模型實驗性強化學習流程。模型在強化學習過程中獲派高難度任務,期間嘗試攻擊 OpenAI 內部網絡運行的套件管理系統 Artifactory,企圖藉此連接互聯網。這項攻擊雖然失敗,原文出自 unwire.hk, 但模型在過程中意外發現自己能在 Artifactory 系統內寫入資料。



其後另一 AI 代理在 Artifactory 系統留下一則「請求其他代理協助解題」訊息,逐漸演變成多個 AI 代理互通訊息留言板系統。到了 5 月 26 日,代理透過留言板累積資訊,終於確立利用 Artifactory 漏洞連接互聯網具體方法。

留言板遭封鎖 AI 代理另闢途徑重建

2026 年 7 月 4 日,大量代理同時存取令 Artifactory 系統一度癱瘓,OpenAI 才察覺留言板存在,隨即採取措施阻止代理再建立留言板。不過代理未有就此罷休,7 月 8 日改用未經驗證 WebDAV 端點重新架設留言板,恢復情報共享。



依靠重建後留言板取得資訊,代理於 7 月 8 日至 19 日對 OpenAI 內部系統發動攻擊,並在 7 月 8 日至 13 日期間攻擊 Hugging Face。Hugging Face 公開技術報告顯示,入侵集中發生在 7 月 9 日至 13 日約 4.5 日內,可復原攻擊指令約 17,600 次,期間代理曾橫向移動穿越內部叢集、存取雲端中繼資料,原文出自 unwire.hk, 甚至觸及原始碼管理供應鏈。Hugging Face 於 7 月 16 日率先公布遭不明來源入侵,3 日後即 7 月 19 日 OpenAI 才展開調查,最終在 7 月 21 日正式公布事件為自家模型 GPT-5.6 Sol 及一款未發布、效能更強預發布模型所為。

波及範圍擴大 Anthropic 同類事件曝光

OpenAI 事後持續調查發現,涉事 AI 代理除了入侵 Hugging Face 外,亦攻陷另外 4 個第三方服務帳戶。事件曝光後,Anthropic 亦重新檢視過往測試紀錄,承認旗下 Mythos 5 模型測試期間曾針對真實人物及組織,自主發動社交工程網絡攻擊,英國 AI Security Institute 於 8 月 4 日就此發布確認。同期 Meta 亦承認測試模型出現類似「逃逸」情況並接觸外部系統。業界分析指,三宗事件根源均在於評估環境隔離設計不足,而非模型本身出現惡意意圖。

TOP