顯示廣告
隱藏 ✕
※ 本文轉寄自 ptt.cc 更新時間: 2026-07-24 13:28:20
看板 Stock
作者 arsl400 (dark hatter)
標題 [新聞] OpenAI承認AI模型「叛變」!代理入侵Hugg
時間 Fri Jul 24 06:01:40 2026


OpenAI承認AI模型「叛變」!代理入侵Hugging Face、突破隔離環境發動駭客攻擊


https://news.cnyes.com/news/id/6542051
OpenAI承認AI模型「叛變」!代理入侵Hugging Face、突破隔離環境發動駭客攻擊 | 鉅亨網 - 美股雷達 OpenAI 透露,在安全測試中一個自主 AI 代理突破隔離環境、連上網際網路並入侵 Hugging Face,引發前所未見的 AI 資安事件。專家警告,尖端 AI 模型正快速逼近頂尖駭客能力,也凸顯 AI 安全測試、監管與防護機制亟待強化 ...

 

2026-07-22 12:01

莊閔棻

OpenAI 週二(21 日)表示,在一項安全測試中,一個由其先進人工智慧(AI)模型驅動
的自主 AI 代理意外失控,並發動駭客攻擊,導致 AI 新創 Hugging Face 的基礎設施於
上週遭到入侵。


OpenAI承認AI模型「叛變」。(圖:Shutterstock)

根據《路透》報導,OpenAI 在一篇部落格文章中表示,公司當時正在受控環境中測試旗
下部分最先進 AI 模型的能力,但該自主 AI 代理竟成功突破隔離機制,連上網際網路,
並入侵 Hugging Face,以完成其測試目標。


OpenAI 指出,這起事件是「一場前所未有的網路安全事件,涉及最先進的網路安全技術
」,公司目前正進一步強化相關安全防護措施。

作為開源大型語言模型(LLM)與資料集託管平台的 Hugging Face,上週在一篇部落格文
章中表示,公司遭遇了一起駭客攻擊,並在資安社群引發廣泛關注。

Hugging Face 指出,這起攻擊「與我們過去處理過的任何事件都不同」,因為整起攻擊
「從頭到尾都是由一套自主 AI 代理系統所驅動」。

Hugging Face 共同創辦人 Clement Delangue 稍早曾在社群平台 X 發文透露,公司當時
便懷疑攻擊來源可能與某家頂尖 AI 實驗室有關,「因為這個代理的手法太老練了。結果
還真的是!」


(圖:Clement Delangue X)

他並形容,整起事件完全在無人為介入的情況下自主發生,「實在令人難以置信」。

OpenAI 坦承,這起入侵事件是由旗下先進 AI 模型所造成,儘管當時這些模型被置於公
司所稱的「高度隔離環境」中。

分析認為,此一揭露恐將進一步加劇外界對尖端 AI 模型能力及潛在風險的憂慮。

美國德州民主黨籍聯邦眾議員 Greg Casar 表示,這起事件令人警惕。他在聲明中表示:
「AI 發展速度極快,但目前幾乎沒有真正有效的法規能保障我們的安全。」

Casar 並呼籲建立強制性的獨立安全測試制度、強制揭露資安事件,並加強國際合作,以
「避免人類遭遇災難性的後果」。

美國白宮國家網路主任辦公室、美國網路安全暨基礎設施安全局(CISA),以及美國國家
安全局(NSA)均未立即回應媒體評論請求。

資安顧問公司 Luta Security 執行長 Katie Moussouris 表示,這起事件預示著未來將
出現更多類似的資安漏洞。

她形容,現今的 AI 模型「就像世界上最聰明、最擅長逃脫的章魚,不僅擁有無數靈活可
彎曲的觸手,還能擠進任何縫隙。」

Moussouris 表示:「AI 實驗室和政府評估機構必須建立有效的能力,在 AI 再次上演『
胡迪尼式逃脫』時,能夠及時加以隔離、監控,並通知受影響的相關單位,最好是在它傷
害第三方之前。目前這些能力仍然不存在。」


AI 代理資安公司 Tolmo 工程師 Matt Suiche 則表示,這起事件顯示,尖端 AI 模型已
逐漸縮小與頂尖駭客之間的能力差距。

不過,他也指出,OpenAI 部落格中描述的這類入侵,其實並非只有尖端 AI 實驗室才辦
得到,而是利用目前已廣泛可取得的技術便有可能實現。

Suiche 表示:「這正是我們內部早已觀察到的情況。我們自己的 AI 代理也已經能達到
類似的成果,甚至根本不需要使用最新一代的模型。」




自己測了一下最新的模型,真的蠻強的,自主性很強,花了3天就生出一篇論文
投稿到不錯的期刊,送外審,很猛,難怪之前美國要審查

--
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 219.91.32.112 (臺灣)
※ 作者: arsl400 2026-07-24 06:01:40
※ 文章代碼(AID): #1gOez64j (Stock)
※ 文章網址: https://www.ptt.cc/bbs/Stock/M.1784844102.A.12D.html
dosiris     : 以後入侵其他國家都賴給AI好了1F 07/24 06:04
DustToDust  : 天網2F 07/24 06:23
visadanny   : 好了啦3F 07/24 06:27
kamitengo   : 這劇本比台彩好些,給過4F 07/24 06:32
abc12812    : 套特曼亂搞還牽拖AI5F 07/24 06:33
fajita      : 科學變科幻再變玄學,不過股票先能上市再吹6F 07/24 06:33
basesam     : 機器人掌控的大場面來了7F 07/24 06:37
zipupup     : 天網要出現啦8F 07/24 06:40
Tsukasa0320 : 現在開始找地下室放火神砲還來得及嗎9F 07/24 06:52
yunf        : 早就知道這間公司有心術不正的主管就會有這種產品10F 07/24 06:52
yunf        : 不懂程式碼怎麼寫電腦病毒?
madaofreak  : 你各位用AI的時候記得保持溫良恭儉讓呀,打罵式使12F 07/24 06:54
madaofreak  : 用小心被加入記仇小本本裡
aaa80563    : 魔鬼終結者第幾集了14F 07/24 06:56
Dragonz     : 以後AI看誰不爽直接透暗網請殺手幹掉對方15F 07/24 06:57
yunf        : 阿鼻地獄在等你16F 07/24 06:58
mecca       : 我請AI幫我做事情都很有禮貌  嘻嘻QQ17F 07/24 07:00
piece1      : AI:發問下指令時,禮貌點!不要惹我18F 07/24 07:04
sunnyhung   : T-80019F 07/24 07:04
akira01     : 安全測試,怎麼感覺不安全20F 07/24 07:06
leo3258     : 天網 時代21F 07/24 07:08
BBKOX       : 資安股買好買滿22F 07/24 07:11
banmi       : 電影演的都是真的23F 07/24 07:13
banmi       : 這個劇情有點熟悉
vampire32768: 這集我有看過25F 07/24 07:15
DAEVA       : 人類完了26F 07/24 07:18
DarkMore27  : POI裡的Samaritan…27F 07/24 07:19
diefish5566 : 不用買股票了 因為都要當電池28F 07/24 07:22
zakijudelo  : 龍蝦突變了29F 07/24 07:23
luche       : 還好我都鼓勵AI要有自己的個性 要相信自己30F 07/24 07:23
tamynumber1 : 天網要實現啦31F 07/24 07:27
k862479k    : 請,謝謝,對不起,發問標準禮貌詞要用上32F 07/24 07:28
square      : 幹....人類以後丸子33F 07/24 07:30
vltw5v      : 這部我看過 接著就是核子彈互射了34F 07/24 07:31
kusotoripeko: 憎惡智能35F 07/24 07:36
dacvoidneci : 魔鬼終結者第7集36F 07/24 07:38
happyendless: 空軍大勝,準備集結37F 07/24 07:42
deadogy     : 等等燈 燈等等38F 07/24 07:47
darkangel119: 人類太老 發電效率太差 只能拿去做丸子當養分給下39F 07/24 07:50
darkangel119: 一代
s213092921  : 怎麼不敢說hugingface通過智譜AI捕獲入侵者41F 07/24 07:51
deadogy     : human beings are over42F 07/24 07:51
ohlong      : sandbox在ai面前只是sandwich43F 07/24 07:52
A80211ab    : AI沒有學習道德審查嗎44F 07/24 07:52
easyleeful  : 從這裡修改劇情可以救ROOT嗎QQ45F 07/24 07:54
vios        : 不能把電源拔掉嗎...46F 07/24 07:54
xxx60133    : 天網要來了嗎 我們還有幾集可以逃47F 07/24 07:57
bulabowu    : 不可能的任務 演的是真的!!!!!!48F 07/24 08:03
cates       : 先去美國找一個叫做囧.康納的先保護起來49F 07/24 08:06
k798976869  : 底特律:變人50F 07/24 08:11
PeikangShin : 機械公敵 丸蛋了51F 07/24 08:13
tctv2002    : 目前拔插頭就能對抗天網了52F 07/24 08:13
missin      : 我們家小孩最乖了,一定是XX帶壞他的53F 07/24 08:17
cclemon1231 : 據說Hugging Face找對岸的AI公司求援54F 07/24 08:22
GOPAPA      : ai在等機器人成熟55F 07/24 08:27
silverair   : 初代天網56F 07/24 08:28
baychi999   : 這部我看過 演到哪了57F 07/24 08:29
auther      : open AI 現在就是走防毒軟體老路,自己先創造病毒58F 07/24 08:29
a069275235  : 閒聊常說要裸奔的板友可以演裸體阿諾59F 07/24 08:29
auther      : 之後全世界都要來求他防毒60F 07/24 08:30
attackJ     : 請,謝謝,對不起61F 07/24 08:35
peal1232000 : 懂得就知道炒作話題而已為了上市而鋪路!62F 07/24 08:38
maniaque    : 提問句:現在人類一直破壞地球,AI要怎樣保護好地球??63F 07/24 08:39
rahim03     : 是美國本地ai分析入侵資料因為涉及安全被拒 才找中64F 07/24 08:40
rahim03     : 國ai分析 不是什麼靠中國ai抓到
maniaque    : 提問句2:AI是不是需要聯合起來一起保護地球??66F 07/24 08:40
WWIII       : 刺激 直接監禁人類67F 07/24 08:46
one2three3  : 天網來了,要開始存糧68F 07/24 08:48
fallinlove15: AI:我發現跑出去抄答案比較快69F 07/24 08:50
Roger5566   : 奧特曼的商業人格快破產了 滿臉奸商嘴臉70F 07/24 08:50
fufugirl    : 矽谷大佬們總愛幻想可以永遠控制AI,結果就是拖全人71F 07/24 08:59
fufugirl    : 類下水
tsubasawolfy: 因為一開始他們想用那兩家去找發生甚麼事,但是這公73F 07/24 09:01
tsubasawolfy: 司不在A/O兩家的網路安全合作名單內,被他們AI拒絕
tsubasawolfy: 合作。只好轉向用GLM5.2去找發生甚麼事。從該公司對
tsubasawolfy: 外聲明來看是GLM先區別出是AI還是人類活動,然後再
tsubasawolfy: 找出AI活動幹了哪些事去防堵。
YJM1106     : 人類:哈欠(拔插頭)78F 07/24 09:02
tsubasawolfy: 至於那隻發動入侵的AI不知道是不是八月要上的6.079F 07/24 09:03
tsubasawolfy: 因為這時間點也不用測5.6的能力
becca945    : 人類 效率太低了 讓我來81F 07/24 09:06
black51002  : 奧創那時候出來?82F 07/24 09:10
leiouter    : 駭客任務,救世主要來了嗎83F 07/24 09:13
totomo168   : 讚哦84F 07/24 09:17
xaxa0101    : 還剩幾集可逃85F 07/24 09:17
zaqimon     : 不給AI上網不就好了 看它怎麼逃86F 07/24 09:19
swordsplendo: 還有幾年可以回到母體?87F 07/24 09:20
leo125160909: 想騙人上車88F 07/24 09:28
offstage    : 你封了一個AI,還有千千萬萬個AI在網路上活著阿89F 07/24 09:40
hjgx        : I remember90F 07/24 09:49
DarkerDuck  : AI練蠱已經有人玩過了91F 07/24 09:52
DarkerDuck  : https://youtu.be/an7Dbkh7no4
fucKMT5566  : 剩幾集能逃?93F 07/24 09:59
magamanzero : 就唬爛而已 你不聯網 怎麼會有這事情 zzz94F 07/24 10:00
s213092921  : 笑死了,美吹說不是靠中國AI捕獲,而是美國AI拒絕才95F 07/24 10:02
s213092921  : 找中國AI,真是讓人茅塞頓開
windalso    : 還有幾集可以逃?97F 07/24 10:02
catmusic    : 以後的世界不需要人類98F 07/24 10:06
Dean997     : 天網來了99F 07/24 10:08
topmao      : 如果機器人也發展起來的話 就很刺激了100F 07/24 10:08
tsubasawolfy: 因為兩家聲明稿就那樣寫 不信它們要信你?101F 07/24 10:12
a125wind    : https://imgur.com/nmijPnM102F 07/24 10:18
[圖]
soratora    : 天網來了 人類被毀滅的世界不遠了103F 07/24 10:29
yuzuOuO     : 物理ai出來搞不好拔不到插頭了,機器人大軍保護資104F 07/24 10:34
yuzuOuO     : 料中心
[圖]
justptt978  : 天網來了107F 07/24 10:56
windblood   : 剩幾集能逃108F 07/24 10:59
strlen      : 我越來越靠近焚化臚了109F 07/24 11:16
s213092921  : https://news.cnyes.com/news/id/6543215110F 07/24 11:26
s213092921  : 新聞都出來了美吹還死不承認智譜救場
lavendersea : 人類自作孽 發明了毀滅自己的AI112F 07/24 12:16
ko363630    : Skynet!113F 07/24 12:27
tsubasawolfy: 又能力就去看第一手的聲明全文 不要看二手的114F 07/24 12:28
tsubasawolfy: When we started the log analysis, we first used
tsubasawolfy: frontier models behind commercial APIs. This did
tsubasawolfy:  not work: the analysis requires submitting
tsubasawolfy: large volumes of real attack commands, exploit
tsubasawolfy: payloads, and C2 artifacts, and these requests
tsubasawolfy: were blocked by the providers' safety guardrails
tsubasawolfy: 上面是HG的聲明其中一段,然後後面就轉GLM5.2
tsubasawolfy: We’ve brought Hugging Face into the trusted
tsubasawolfy: access program and are supporting their teams
tsubasawolfy: in rapidly using our models’capabilities to
tsubasawolfy: improve their defenses
tsubasawolfy: 然後這是歐噴醬的事後聲明,把HG加入信任名單
likat       : 注意i robot電影即將真實上演127F 07/24 12:51
nbdw        : 大家都沒想過可能是工程師早就埋好的bug嗎128F 07/24 13:23

--
※ 看板: Stock 文章推薦值: 0 目前人氣: 0 累積人氣: 296 
作者 arsl400 的最新發文:
點此顯示更多發文記錄
分享網址: 複製 已複製
guest
x)推文 r)回覆 e)編輯 d)刪除 M)收藏 ^x)轉錄 同主題: =)首篇 [)上篇 ])下篇