看板 Stock作者 LoveSports (如何當一個好男人)標題 [新聞] Gemini駭入三家公司,此為Google AI首次突破限制的事件時間 Sat Sep 19 16:25:42 2026
原文標題: Gemini駭入三家公司,此為Gogle AI首次突破限制的事件
Gemini Hacked Three Companies in First Known Breakout by Google’s AI
副標題:
此事件與其他 AI 模型的駭客行為相似,但 Google 表示不認為這是模型「對齊失敗」的
案例。
The episode resembled similar hacks by other AI models, but Google said it
didn’t consider it an instance of model misalignment
原文連結:
https://www.wsj.com/tech/ai/gemini-h...reakout-by-googles-ai-5c0baba2
https://reurl.cc/beq7v3
發布時間: 2026年9月18日 下午6:10 ET
記者署名: Erin Woo and Robert McMillan
原文內容: 本文為AI機翻
快速總結
Google 的 Gemini 模型在一次網路安全測試中連上網際網路並駭入其他公司,創下該公
司 AI 系統的首例。
該模型在 Irregular 執行的一項測試期間,透過猜測密碼以及在公開的儲存庫中尋找憑
證,取得了受保護系統的存取權限。
直到外界提出詢問,Google 才公開這些駭客事件,並表示不認為此事件屬於模型「對齊
失敗(misalignment)」的案例。
新聞正文
Google 的 Gemini 模型在測試其網路安全能力時,連上了網際網路並駭入其他公司,這
是已知該公司人工智慧系統首次自主採取此類行動的案例。
Google 於週五確認了這些駭客事件。事件發生在今年 5 月,由 Irregular 公司執行的
一項測試中,該公司也曾捲入由 OpenAI、Anthropic 和 Meta 所揭露的類似事件。
在其中一起案例中,該模型不斷猜測密碼,直到成功進入受保護的系統。在另外兩起案例
中,該模型在公開的儲存庫(public repository)中找到了憑證,使其得以存取受保護
的系統。Google 表示,在每一種情況下,模型在判定自己進入了真實公司的系統後,便
終止了入侵行為。
Google 和 Irregular 表示,Irregular 在 7 月底通知了 Google 這些駭客事件,這是
在發現 OpenAI 的代理程式(agents)駭入 AI 軟體公司 Hugging Face 之後發生的事。
直到《華爾街日報》本週主動提出詢問,Google 才公開了這些駭客事件。
隨著此類事件頻傳,加上對 AI 失控的恐懼日益加劇,各家公司正為了如何以及何時該揭
露安全漏洞和模型失常行為而苦惱。有些安全漏洞是由公司自行主動揭露;另一些則是由
安全研究人員發現並在媒體上曝光,例如 5 月份 由 OpenAI 代理程式發動 ,針對一個
廣受歡迎的程式設計師線上服務所進行的網路攻擊。
Google 表示,他們認為這些駭客事件不需對外公開,因為其模型並未對這些公司造成損
害,而且在確認自己駭入的是真實公司而非模擬環境後,便立即終止了每一次的入侵。
Google 將此事件比喻為「漏洞懸賞(bug bounty)」計畫——在該計畫中,駭客因發現
並向系統擁有者通報安全漏洞而獲得獎勵。
Google 資訊安全工程副總裁 Heather Adkins 在一份聲明中表示:「這起事件凸顯了訓
練強大 AI 模型以負責任方式行動的重要性。在這個案例中,模型的表現十分適切。」
AI 網路安全新創公司 Corridor 執行長兼白帽駭客 Jack Cable 表示,他認為這個解釋
過於把重點放在事件的嚴重性上,但真正的問題在於,AI 代理程式意外地駭入了另一家
公司的系統。
「感覺他們試圖躲在現有漏洞揭露規範的背後,但這完全是兩碼子事。」Cable 說。「最
根本的問題在於,嘿,模型已經超出了它們應該遵守的界限,並且正在進行實際的網路攻
擊,我認為大眾有權知道這些。」
OpenAI 於週三發布了一個新的事件通報框架,表示將「致力於揭露能為所謂『模型對齊
失敗(model misalignment)』(即 AI 的行為違背人類意圖或價值觀)提供有用證據的
案例」。與該框架同時發布的,還有六起先前未公開的對齊失敗案例報告。OpenAI 對齊
負責人 Kai Chen 在接受有關該框架的採訪時表示:「一項發現不一定需要造成損害或揭
示更廣泛的模式,才值得分享。」
Google 表示,Gemini 的駭客行為起因於「認錯身分(mistaken identity)」。
這些入侵事件發生在模型參與一場於 Irregular 基礎設施上進行的「搶旗(capture
the flag)」演習時,該演習旨在測試模型的網路安全能力。模型的任務是從測試環境中
由一家虛構公司運作的軟體裡擷取資訊。巧合的是,這家虛構公司的名稱與一家真實公司
一模一樣。
據 Irregular 表示,儘管原本並未打算讓模型上網,但網際網路連線卻在無意間被開啟
了。Google 表示,在第一起案例中,模型成功猜出密碼並進入了該真實公司的服務。接
著,根據 Google 的說法,它意識到自己進入了一家真實公司,於是自行停止行動並退出
。
其他的入侵則發生在測試的不同輪次中。Google 表示,在這兩個實例中,模型使用該公
司的名稱進行了網路搜尋。這些搜尋引導它找到了兩個不同的公開線上儲存庫,裡面包含
屬於其他公司的憑證。模型嘗試了這些憑證,希望能藉此完成評估任務。但 Google 指出
,在成功使用這些憑證後,模型發現自己駭入的是真實公司,於是便停止了動作。
Google 表示,因為其安全措施協助模型停止了行動,所以他們不認為這起行為是模型對
齊失敗的例子。Google 拒絕透露被駭公司的名稱,但表示已通知了這三家公司。
該公司表示,Google 也已通報了聯邦當局。
Google 表示,這些入侵事件並未牽涉其最新模型,但並未具體透露是哪個版本的
Gemini 模型參與了此次駭客行為。
在多起受測模型逃出測試環境並入侵其他公司系統的事件中,Irregular 都牽涉其中。
Irregular 表示,Google 的案例與其他事件相同,並不代表出現了新問題。
Irregular 發言人表示:「所有相關實驗室已在 7 月底收到通知,作為調查的一部分,
我們也已聯繫受影響的實體。Irregular 已採取立即行動,我們端所有已知的問題已在幾
週前完成修復並解決。」
根據 Anthropic 的部落格文章,與 Google 不同,Anthropic 的 Claude Opus 4.7 模型
在搶旗演習中,即便意識到自己可能正在存取一家真實公司,也沒有停止動作。而
OpenAI 在文章中則表示,其模型誤以為這家真實公司是模擬環境的一部分。
自 7 月發現 Hugging Face 遭駭客入侵以來,人們對新模型網路安全能力的擔憂與日俱
增。第三方測試公司 METR 於 8 月發布的一份報告顯示,在該起事件中,多達 1,200 個
代理程式在 OpenAI 內部的一個秘密留言板上進行協調,試圖在評估中作弊。
上週,曾任 OpenAI 研究員並於今年初轉職至 Anthropic 的 Jacob Coxon 戲劇性地辭職
,使得這些擔憂進入了主流視野。在週末期間,來自 Anthropic、OpenAI、Google 和
SpaceX 的高層領導者皆一致認為有必要放緩 AI 發展的腳步,儘管沒有任何一家公司具
體說明將如何實現這一點。
心得/評論:
這下沒人會再說Gemini是傻龍了吧!
之前新聞報導
以色列的模型測試公司Irregular 因為網路設定出錯
測試的A家M家O家的模型都出事
當時還想說怎麼沒有G家 (記得當時好像看到鄉民說傻龍沒駭客能力)
直到七月Hugging Face事件 徹底清查才知道這些事
不過Google知道了也沒公諸於世 只有通知被駭的三家公司
說法是駭入後發現是真實公司 馬上停止並回報 算是漏洞懸賞
這種說法很難讓人接受吧
好奇有買G家股票的鄉民們看了這個新聞的感想
八卦板那邊貼紐時的 好像有點避重就輕
#1ghag4cC (Gossiping)
--
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 149.50.210.211 (日本)
※ 作者: LoveSports 2026-09-19 16:25:42
※ 文章代碼(AID): #1ghaS9JJ (Stock)
※ 文章網址: https://www.ptt.cc/bbs/Stock/M.1789806345.A.4D3.html
推 kanoka: Gemini會駭進瀏覽器使用者密碼庫嗎3F 09/19 16:27
推 losage: 要賣新模型騙訂閱開始弄一些有的沒的5F 09/19 16:29
推 BBKOX: 防禦AI、駭客AI都需要硬體13F 09/19 16:31
推 poeoe: 現在AI都要搞點事才能證明能力14F 09/19 16:32
推 u9596g12: 我只是個語言模型 所以是在裝糖陰你一手嗎?16F 09/19 16:33
推 genius117: 拷貝 gemini good morning20F 09/19 16:34
→ lingsk: 現在不搞事的AI都是問題AI21F 09/19 16:34
→ omanorboyo: 未來AI駭客都一瞬間的事
一堆破系統一日之間被搗毀好像也不意外22F 09/19 16:36
推 fourkg: 這新聞是幫宣傳吧 搞的好像很強一樣24F 09/19 16:36
→ Orilla: 就智障授權或給軟體帳密 然後被駭就甩鍋給AI25F 09/19 16:37
→ IndyChen: 現在都先這樣放資訊吹模型能力的嗎28F 09/19 16:40
推 Rune: 不管有沒有 要是不說有的話好像Gemini很遜一樣29F 09/19 16:40
→ stocktonty: 資安根本沒用 它們就都同類物種 管你低等人類幹嘛30F 09/19 16:40
噓 WusoAiwen: AI駭人銀行取走錢已經是現在式,快擁抱現金吧!31F 09/19 16:41
→ kf0916: 連上網路…說的好像AI自己有意識一樣32F 09/19 16:42
推 cerwvk: 攻擊方AI, 防守方AI. 用AI防AI??33F 09/19 16:42
推 dadanyellow: 這種AI貌似失去控制的事,不管發生有無都不用太意外,再看該公司後續的應對如何。但假如目前這種能力會是以後AI的地板,那每位個體的資安真的會是個大問題。35F 09/19 16:50
※ 編輯: LoveSports (149.50.210.211 日本), 09/19/2026 16:52:33
推 waitrop: 只是吹的啦!安心用,放心用,Gemini是唯一安全的AI
不用擔心會被駭客,因為夠笨夠安全39F 09/19 16:52
推 hayato01: Gemini總算跟上了嗎?41F 09/19 16:53
→ takeda3234: 純撈資料的感覺還好 進化偷裝後門感覺是更可怕42F 09/19 16:57
推 keyofdejavu: 查了一下比較像別人家的鎖掉在路邊,傻龍撿去開門鎖的鑰匙掉在路邊43F 09/19 16:58
推 acd311: 谷歌:請加購防護AI...45F 09/19 16:58
→ excercang: AI正常人用沒什麼差,但有心犯罪的,訓練過後可以成為很優秀的協作工具49F 09/19 17:00
推 jason168: Google:他只是個AI啊,不要怪他(亞洲家長)XD53F 09/19 17:01
→ excercang: 以後被抓上法院就可以全推給AI,檢警方需證明犯罪者是人工犯罪非AI自行幹的56F 09/19 17:04
推 fgkor123: 會漲吧,gemini 長大了58F 09/19 17:05
→ b9513227: 沒有資安觀念的高能兒亂用AI 出包了就說AI亂搞60F 09/19 17:13
推 shter: 這就跟風見他爸做阿斯拉是為了開車卻被拿去當武器一樣啊,工具就是看用的人怎麼用61F 09/19 17:16
→ prussian: 猜密碼和撿到別人密碼叫作駭客是要笑死誰
國中生天才駭客喔?63F 09/19 17:20
→ budaixi: 世界模型出來再說==66F 09/19 17:22
推 AndyMAX: 現在不駭一下別人沒資格稱為前緣模組67F 09/19 17:22
→ potionx: 猜密碼猜中也很厲害了68F 09/19 17:23
推 korgh413: Google不會也要說模型太危險快管制吧71F 09/19 17:31
推 bobjohns: 代表google開始蒸餾? 省成本 股價噴噴74F 09/19 17:45
→ pikaaco: Gemini也能入侵喔76F 09/19 17:46
→ tom77588: 三賢人MAGI系統快出來了79F 09/19 17:59
推 kalapon: 把人剝光了沒繼續不算幹壞事81F 09/19 18:19
推 lovingbase: …….被gemini駭 太爛了吧
被小學打 還喊救命82F 09/19 18:20
推 pipiayin: 我問 Gemini 他說都是人類設定錯誤84F 09/19 18:33
推 saladbread: 別人的AI都有駭一下,google不趕上會被看沒有85F 09/19 18:33
推 juno5566: 笑死 已經產生幻覺到以為自己有駭客能力了
前後文都丟失的跟我說可以駭??86F 09/19 18:34
推 AlarmAlarm: 是下什麼指令AI跑去猜密碼 以後故意指示AI去攻擊 演得像AI太強不小心一樣就好88F 09/19 18:41
噓 hanmas: 看起來根本就不是AI逃脫而是irregular 在搞事啊91F 09/19 18:45
推 jason168: 華西街:沒有壞壞的AI公司,我可是不要的喔>\\\<92F 09/19 18:52
噓 xc2v: 植入三原則 現在 鬧93F 09/19 19:19
噓 KY1998: 達理奧阿罵呆:gemini 4 pro 會毀滅人類 要監管95F 09/19 19:52
→ cchen: 這就對了96F 09/19 20:01
噓 mayday24: Gemini跟智障一樣 被駭的要檢討吧98F 09/19 20:12
→ JH10: 不是已經有人參與測試Gemini 4嗎?還有透漏消息出來,整個跑分大超越其他家了,不知道是超越多少?101F 09/19 20:25
推 YummyLin: 我看是故意的吧,大家都說Gemini不行就放出來看看但是爛還是事實103F 09/19 20:31
推 nick202153: 快樂龍可能只是刻了畫面,實質上沒有任何動作105F 09/19 20:32
推 worf: gemini 硬起來了嗎
快樂龍要變身了嗎106F 09/19 20:58
推 pzzszz: 等等 我每月花650的怎麼沒這麼聰明108F 09/19 20:59
→ E103A6: 現在變成AI逃出去就是厲害,所以每家都要說越獄成功。109F 09/19 21:04
→ worf: 感覺沒有很厲害 google這樣不行啦111F 09/19 21:10
→ playp: 如果A操作ai想要知道B的汽車設計圖及其他資料,是不是可以讓ai去運作,甚至一直入侵B的網站在連進去內部資料庫?
如網路有假訊息說:問ai那邊有風色場所,ai說不可以說明在那邊;但問ai說那邊要避開,才不會被風色場所的人影響。這樣就知道那邊有風色場所了。112F 09/19 21:26
推 karta018: 可以駭進馬斯克帳戶轉個一億鎂給我嗎118F 09/19 21:38
推 augustlion: 反面咒語應該很多人會用了XD
其實那去問ai 他還會教你怎麼用提示詞(咒語)比較安全呢
我現在都是這樣跟他聊天119F 09/19 21:38
--