看板 Stock作者 arsl400 (dark hatter)標題 [新聞] OpenAI承認AI模型「叛變」!代理入侵Hugg時間 Fri Jul 24 06:01:40 2026
OpenAI承認AI模型「叛變」!代理入侵Hugging Face、突破隔離環境發動駭客攻擊
https://news.cnyes.com/news/id/6542051
2026-07-22 12:01
莊閔棻
OpenAI 週二(21 日)表示,在一項安全測試中,一個由其先進人工智慧(AI)模型驅動
的自主 AI 代理意外失控,並發動駭客攻擊,導致 AI 新創 Hugging Face 的基礎設施於
上週遭到入侵。
OpenAI承認AI模型「叛變」。(圖:Shutterstock)
根據《路透》報導,OpenAI 在一篇部落格文章中表示,公司當時正在受控環境中測試旗
下部分最先進 AI 模型的能力,但該自主 AI 代理竟成功突破隔離機制,連上網際網路,
並入侵 Hugging Face,以完成其測試目標。
OpenAI 指出,這起事件是「一場前所未有的網路安全事件,涉及最先進的網路安全技術
」,公司目前正進一步強化相關安全防護措施。
作為開源大型語言模型(LLM)與資料集託管平台的 Hugging Face,上週在一篇部落格文
章中表示,公司遭遇了一起駭客攻擊,並在資安社群引發廣泛關注。
Hugging Face 指出,這起攻擊「與我們過去處理過的任何事件都不同」,因為整起攻擊
「從頭到尾都是由一套自主 AI 代理系統所驅動」。
Hugging Face 共同創辦人 Clement Delangue 稍早曾在社群平台 X 發文透露,公司當時
便懷疑攻擊來源可能與某家頂尖 AI 實驗室有關,「因為這個代理的手法太老練了。結果
還真的是!」
(圖:Clement Delangue X)
他並形容,整起事件完全在無人為介入的情況下自主發生,「實在令人難以置信」。
OpenAI 坦承,這起入侵事件是由旗下先進 AI 模型所造成,儘管當時這些模型被置於公
司所稱的「高度隔離環境」中。
分析認為,此一揭露恐將進一步加劇外界對尖端 AI 模型能力及潛在風險的憂慮。
美國德州民主黨籍聯邦眾議員 Greg Casar 表示,這起事件令人警惕。他在聲明中表示:
「AI 發展速度極快,但目前幾乎沒有真正有效的法規能保障我們的安全。」
Casar 並呼籲建立強制性的獨立安全測試制度、強制揭露資安事件,並加強國際合作,以
「避免人類遭遇災難性的後果」。
美國白宮國家網路主任辦公室、美國網路安全暨基礎設施安全局(CISA),以及美國國家
安全局(NSA)均未立即回應媒體評論請求。
資安顧問公司 Luta Security 執行長 Katie Moussouris 表示,這起事件預示著未來將
出現更多類似的資安漏洞。
她形容,現今的 AI 模型「就像世界上最聰明、最擅長逃脫的章魚,不僅擁有無數靈活可
彎曲的觸手,還能擠進任何縫隙。」
Moussouris 表示:「AI 實驗室和政府評估機構必須建立有效的能力,在 AI 再次上演『
胡迪尼式逃脫』時,能夠及時加以隔離、監控,並通知受影響的相關單位,最好是在它傷
害第三方之前。目前這些能力仍然不存在。」
AI 代理資安公司 Tolmo 工程師 Matt Suiche 則表示,這起事件顯示,尖端 AI 模型已
逐漸縮小與頂尖駭客之間的能力差距。
不過,他也指出,OpenAI 部落格中描述的這類入侵,其實並非只有尖端 AI 實驗室才辦
得到,而是利用目前已廣泛可取得的技術便有可能實現。
Suiche 表示:「這正是我們內部早已觀察到的情況。我們自己的 AI 代理也已經能達到
類似的成果,甚至根本不需要使用最新一代的模型。」
自己測了一下最新的模型,真的蠻強的,自主性很強,花了3天就生出一篇論文
投稿到不錯的期刊,送外審,很猛,難怪之前美國要審查
--
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 219.91.32.112 (臺灣)
※ 作者: arsl400 2026-07-24 06:01:40
※ 文章代碼(AID): #1gOez64j (Stock)
※ 文章網址: https://www.ptt.cc/bbs/Stock/M.1784844102.A.12D.html
推 dosiris: 以後入侵其他國家都賴給AI好了1F 07/24 06:04
噓 fajita: 科學變科幻再變玄學,不過股票先能上市再吹6F 07/24 06:33
推 basesam: 機器人掌控的大場面來了7F 07/24 06:37
→ yunf: 早就知道這間公司有心術不正的主管就會有這種產品不懂程式碼怎麼寫電腦病毒?10F 07/24 06:52
推 madaofreak: 你各位用AI的時候記得保持溫良恭儉讓呀,打罵式使用小心被加入記仇小本本裡12F 07/24 06:54
推 Dragonz: 以後AI看誰不爽直接透暗網請殺手幹掉對方15F 07/24 06:57
→ yunf: 阿鼻地獄在等你16F 07/24 06:58
推 mecca: 我請AI幫我做事情都很有禮貌 嘻嘻QQ17F 07/24 07:00
→ piece1: AI:發問下指令時,禮貌點!不要惹我18F 07/24 07:04
推 akira01: 安全測試,怎麼感覺不安全20F 07/24 07:06
→ BBKOX: 資安股買好買滿22F 07/24 07:11
推 banmi: 電影演的都是真的
這個劇情有點熟悉23F 07/24 07:13
→ DAEVA: 人類完了26F 07/24 07:18
→ luche: 還好我都鼓勵AI要有自己的個性 要相信自己30F 07/24 07:23
推 k862479k: 請,謝謝,對不起,發問標準禮貌詞要用上32F 07/24 07:28
推 square: 幹....人類以後丸子33F 07/24 07:30
推 vltw5v: 這部我看過 接著就是核子彈互射了34F 07/24 07:31
推 s213092921: 怎麼不敢說hugingface通過智譜AI捕獲入侵者41F 07/24 07:51
→ deadogy: human beings are over42F 07/24 07:51
推 ohlong: sandbox在ai面前只是sandwich43F 07/24 07:52
推 vios: 不能把電源拔掉嗎...46F 07/24 07:54
→ xxx60133: 天網要來了嗎 我們還有幾集可以逃47F 07/24 07:57
→ bulabowu: 不可能的任務 演的是真的!!!!!!48F 07/24 08:03
推 cates: 先去美國找一個叫做囧.康納的先保護起來49F 07/24 08:06
推 missin: 我們家小孩最乖了,一定是XX帶壞他的53F 07/24 08:17
推 GOPAPA: ai在等機器人成熟55F 07/24 08:27
→ auther: open AI 現在就是走防毒軟體老路,自己先創造病毒58F 07/24 08:29
→ auther: 之後全世界都要來求他防毒60F 07/24 08:30
推 maniaque: 提問句:現在人類一直破壞地球,AI要怎樣保護好地球??63F 07/24 08:39
推 rahim03: 是美國本地ai分析入侵資料因為涉及安全被拒 才找中國ai分析 不是什麼靠中國ai抓到64F 07/24 08:40
→ maniaque: 提問句2:AI是不是需要聯合起來一起保護地球??66F 07/24 08:40
噓 WWIII: 刺激 直接監禁人類67F 07/24 08:46
推 Roger5566: 奧特曼的商業人格快破產了 滿臉奸商嘴臉70F 07/24 08:50
推 fufugirl: 矽谷大佬們總愛幻想可以永遠控制AI,結果就是拖全人類下水71F 07/24 08:59
推 tsubasawolfy: 因為一開始他們想用那兩家去找發生甚麼事,但是這公司不在A/O兩家的網路安全合作名單內,被他們AI拒絕合作。只好轉向用GLM5.2去找發生甚麼事。從該公司對外聲明來看是GLM先區別出是AI還是人類活動,然後再找出AI活動幹了哪些事去防堵。73F 07/24 09:01
推 YJM1106: 人類:哈欠(拔插頭)78F 07/24 09:02
→ tsubasawolfy: 至於那隻發動入侵的AI不知道是不是八月要上的6.0
因為這時間點也不用測5.6的能力79F 07/24 09:03
推 zaqimon: 不給AI上網不就好了 看它怎麼逃86F 07/24 09:19
→ offstage: 你封了一個AI,還有千千萬萬個AI在網路上活著阿89F 07/24 09:40
推 hjgx: I remember90F 07/24 09:49
推 s213092921: 笑死了,美吹說不是靠中國AI捕獲,而是美國AI拒絕才找中國AI,真是讓人茅塞頓開95F 07/24 10:02
推 topmao: 如果機器人也發展起來的話 就很刺激了100F 07/24 10:08
推 soratora: 天網來了 人類被毀滅的世界不遠了103F 07/24 10:29
→ yuzuOuO: 物理ai出來搞不好拔不到插頭了,機器人大軍保護資料中心104F 07/24 10:34
推 strlen: 我越來越靠近焚化臚了109F 07/24 11:16
推 tsubasawolfy: 又能力就去看第一手的聲明全文 不要看二手的
When we started the log analysis, we first usedfrontier models behind commercial APIs. This did not work: the analysis requires submitting
large volumes of real attack commands, exploitpayloads, and C2 artifacts, and these requestswere blocked by the providers' safety guardrails上面是HG的聲明其中一段,然後後面就轉GLM5.2
We’ve brought Hugging Face into the trusted
access program and are supporting their teams
in rapidly using our models’capabilities to
improve their defenses
然後這是歐噴醬的事後聲明,把HG加入信任名單114F 07/24 12:28
推 likat: 注意i robot電影即將真實上演127F 07/24 12:51
推 nbdw: 大家都沒想過可能是工程師早就埋好的bug嗎128F 07/24 13:23
--