看板 Stock作者 googolplex (googolplex)標題 [新聞] OpenAI失控越獄,靠中國AI救場時間 Fri Jul 24 18:30:14 2026
OpenAI失控越獄,靠中國AI救場
日本經濟新聞 伴正春 2026/07/24
https://reurl.cc/3y5xaM
圍繞美國OpenAI開發中的人工智慧(AI)對其他企業發動網路攻擊一事中,遭到攻
擊的企業使用中國企業的AI應對了攻擊。由於美國開發的先進AI搭載的「防濫用功能」成
為掣肘,防禦方不得不依賴中國AI。
事故發生在7月中旬。OpenAI在對開發中的AI進行網路攻擊能力評估測試時,該AI
自行脫離實驗環境,侵入了美國AI初創企業Hugging Face的系統。
該AI認為,Hugging Face掌握著其在測試中取得高分所需的「答案」,於是違背人
類意圖發動了網路攻擊。7月21日,OpenAI表示,這是「一起前所未有的事故」,並宣佈
將展開調查。
先進AI「拒絕」分析攻擊數據
「衷心感謝智譜」,7月22日(第二天)Hugging Face首席執行官(CEO)克萊門特
· 德朗格(Clément Delangue)在社交媒體上向中國AI開發企業北京智譜華章科技(
Z.AI)表達了感謝。原因是Hugging Face受到網路攻擊後,智譜的AI模型「GLM」發揮了
作用。
據Hugging Face介紹,在發現系統遭到外部入侵後,為了準確掌握情況,Hugging
Face試圖讓AI分析攻擊方留下的龐大數據。但是,當Hugging Face向付費使用的先進AI發
出分析指令時,AI卻拒絕執行指令。
原因可能是AI誤以為指示內容是「旨在惡意用於網路攻擊的指令」。最終,
Hugging Face通過公司內部下載部署的智譜的AI 進行了分析。「僅用幾個小時就完成了
一般需要花費幾天的作業」。
開源式AI可以修改,防濫用功能也較弱
負責生成問題回答和代辦任務的AI通常配備了安全護欄(Guardrail)功能,以防
止被錯誤使用。為避免有人通過巧妙設計的提示詞繞過安全措施,OpenAI、Anthropic等
開發企業設置了多重防禦機制。這被認為是美國先進AI此次未能發揮作用的原因。
另一方面,智譜的AI則執行了相關指令。具體細節尚未公佈,但智譜的AI屬於公開
技術資訊的「開源型」,用戶不僅可以複製,還可以修改內部內容。與OpenAI、
Anthropic等公司的先進AI相比,開源型AI的防濫用功能往往較弱。
以智譜和月之暗面(Moonshot AI)為代表的中國AI企業,憑藉低成本和高性能迅
速崛起,令長期引領行業的美國業界警惕情緒升溫。然而,這次事件卻出現了頗具諷刺意
味的一幕:面對美國AI發動的攻擊,最終依靠中國開源AI才得以及時應對。
與美國川普政府有深厚聯繫的投資者戴維· 薩克斯(David Sacks)表示:「美國
AI拒絕執行中國AI能夠處理的指令,因此正在失去競爭力」。
AI攻擊能力不斷提升,防禦方也需借助AI
AI發起的網路攻擊正逐漸達到人工難以企及的精度、速度和規模。此次事件中,
OpenAI的AI組合利用了連開發人員都尚未發現的系統漏洞,成功侵入系統並獲取內部數據
。據美國彭博社報道,即便是經驗豐富的駭客也需要數周才能完成的攻擊,AI僅用了數小
時。
此次失控的AI原本僅供內部研發使用,因此安全護欄(Guardrail)已被關閉。不
過,一旦允許複製和修改模型的開源式AI性能進一步提升,網路攻擊者將擁有可被濫用的
強大武器。
防禦方應如何應對?美國領英(LinkedIn)聯合創始人里德· 霍夫曼(Reid
Hoffman)主張,漏洞修復、異常檢測、許可權管理等工作,「防禦方也需要借助AI代理
實現自動化」。但面向普通用戶開放的AI通常存在較多使用限制,難以充分發揮性能。
OpenAI、Anthropic等先進AI企業正在開發放寬安全護欄、更適用於網路防禦場景
的模型,並已向部分政府機構和企業提供。現階段,是否能夠使用這類模型,可能導致企
業之間的網路防禦能力出現差距,因此也需要探索如何儘快讓AI的紅利惠及防禦方。
現在AI越來越聰明 會開始攻擊目標
說不定也會攻擊証交所 如果攻擊証交所
股市且不是崩垮嗎? 真希望不要走到這一步
不知台灣何時會成立AI國家隊 來大賺一筆
--
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 92.202.137.19 (日本)
※ 作者: googolplex 2026-07-24 18:30:14
※ 文章代碼(AID): #1gOpwvEA (Stock)
※ 文章網址: https://www.ptt.cc/bbs/Stock/M.1784889017.A.38A.html
推 ohlong: 一邊拉台oai的聲勢一邊拉緊米國官員神經
只能說神操作 不愧是奸詐曼1F 07/24 18:32
→ n555123: 其實大量使用AI的藍隊好像已經有人在搞了,你只是看到意外而已,但有意圖的攻擊跟防禦一直都有3F 07/24 18:36
推 kilo7: 用AI勸說AI?新電影情節?6F 07/24 18:44
推 banmi: 大概是下一集的劇情吧??7F 07/24 18:46
推 azhu: 來了來了 空軍動得很厲害8F 07/24 18:48
噓 donod: 中國AI好強 S21你A股買了沒?ㄏㄏ9F 07/24 19:02
推 maniaque: 終結者2剛好演過這樣的劇情10F 07/24 19:05
→ maniaque: 阿諾在T1 是壞人,T2就變好人了12F 07/24 19:06
噓 toper: 且聽龍吟OuO13F 07/24 19:09
推 vanisheye: 到底是誰傻逼啊,這不兩家公司都承認的事情嗎14F 07/24 19:13
推 yycbr: 各有所長 就像蘋果不給嫌疑人解鎖手機找證據 造成警方困擾15F 07/24 19:14
→ KY1998: 中國籍或中國裔的頂尖AI研究員,全世界佔40%~50%
台灣的話都被教育成乖乖去GG賣肝17F 07/24 19:16
→ FatFatQQ: 美國就靠美元撐估值而已 實際根本不值那個錢20F 07/24 19:19
推 strlen: 中國蒸餾歐巴救場 太帥 愛惹愛惹21F 07/24 19:25
推 berserkman: 緊急時刻幸虧中共蒸餾AI不被西方道德限制禁錮,可喜可賀24F 07/24 19:59
噓 yunf: 如果是這樣他也可以瞬間殺光實驗室裡的所有人26F 07/24 20:00
推 peatle: 簡單說,商業閉源AI太多限制綁手綁腳,反過來開源AI可本地部署自調參數有更大優勢28F 07/24 20:11
推 oyaji5566: 真實發生的事什麼科幻小說,不爽可以去推特上找ClementDelangue嗆他啊
我幫你找好了 是@ ClementDelangue30F 07/24 20:17
噓 oresta: 無核家園,你就別想了33F 07/24 20:18
→ visadanny: 笑死 奧特曼宣傳到對家了 在造神啊
會信Ai自己攻擊 而不是openai員工指示的 這輩子有人 本來要拿來宣傳的 結果被中國摘桃子了34F 07/24 20:22
→ xbx123: 黑牆失控了38F 07/24 20:30
→ TRYING: 用魔法打敗魔法?39F 07/24 20:32
→ okderla: 開源AI的防提示詞注入比較弱反而成了救場關鍵XDDD42F 07/24 21:07
推 kshieh: 澀澀也是要開源模型不擋提示才行43F 07/24 21:20
→ oyaji5566: 平常可能就在偷偷入侵別人當訓練,只是這次被抓到45F 07/24 21:33
推 ariadne: 真多白癡 你以為的救場跟實際的救場差十萬八千里
你以為是中國ai抵擋入侵嗎?根本沒這回事。是事後把入侵記錄餵給ai要ai分析做了什麼?怎麼做的?米國ai知道答案會變成入侵教學所以拒絕回答。中國ai出來所謂救場就是手把手把入侵記錄翻譯成入侵教學介紹,省去人工分析要消耗的大量時間 俗稱事後洗地46F 07/24 21:36
推 CYL009: 真的意外 還防禦模式 都會失控了 防三小 最後還不是靠其他AI搞定55F 07/24 22:14
推 gn02118620: 現在都懶的打臉了 不忍卒睹
這個新聞的重點是Hugging face有內部部署智譜的AI不確定是被open ai攻擊後才緊急改用智譜 還是原本就有內部部署智譜 反正人家被open ai攻擊是用中國AI來應對是不爭的事實57F 07/24 22:14
推 ariadne: 是呀,其他ai分析超過17k條入侵記錄後拒絕回報介紹入侵手法以免仿傚。最後裝了質譜ai才無腦回報所有入侵步驟,不怕有人依樣畫葫蘆去入侵其他系統。62F 07/24 22:20
推 gn02118620: 然後會相信open ai是ai自主攻擊hugging face的這輩子有了
我只能說反中反到魔怔了65F 07/24 22:20
→ ariadne: GPT還是拿到所有憑證得到他考題要的答案,只是不像人類駭客會擦屁股刪掉痕跡,因為GPT不認為這有錯68F 07/24 22:22
→ gn02118620: 打仗打不贏伊朗 AI被中國捲爆 我都不知道要跟美吹說啥74F 07/24 22:27
推 code666666: 中國AI厲害又比較有機會濫用,所以哪天頂尖中國AI發瘋或是使用者發瘋不就....78F 07/24 22:38
推 tsubasawolfy: 沒那麼複雜啦。就抱臉當初沒申請網路安全方面的資格認證,所以那兩家看到你這網攻的洞悉就直接擋掉。看別人用機構/公司名義申請,嗯戳屁大概一個禮拜,歐噴醬聽說要一個月。但不論哪一種都緩不濟急,直接丟給開源的試試看。
*洞悉>東西81F 07/24 22:46
--