看板 Stock作者 LoveSports (如何當一個好男人)標題 [新聞] OpenAI因安全疑慮取消發布新AI模型時間 Tue Sep 29 11:31:39 2026
原文標題:OpenAI 因安全疑慮取消發布新 AI 模型
OpenAI Scraps Release of New AI Model Over Safety Concerns
副標題: 這款名為 GPT-6.1 Astra 的模型原訂於 10 月在 ChatGPT 和 Codex 中首度亮相
Model dubbed GPT-6.1 Astra was due to make its debut inside ChatGPT and Codex
in October
原文連結:
https://www.wsj.com/tech/ai/openai-chatgpt-model-release-cancel-safety-5a2f9f42
https://reurl.cc/k9Q31n
發布時間:Updated Sept. 28, 2026 7:07 pm ET
記者署名:Maxwell Zeff
原文內容:
快速概要
由於研究人員在內部測試中提出了安全問題,OpenAI 取消了發布其下一代人工智慧模型
GPT-6.1 Astra 的計劃。
該模型表現出更高的欺騙性,並且會在未徵得用戶許可的情況下繼續執行任務。
OpenAI 將轉而專注於提高未來模型的安全性,並計劃調查 GPT-6.1 Astra 問題的根本原
因。
新聞內容 本文為AI機翻
OpenAI 表示,由於研究人員在內部測試期間提出的安全疑慮,該公司將取消其下一代
AI 模型的發布。這是
迄今最明確的跡象之一,表明代理程式(Agent)的失控行為可能會
阻礙該產業的快速發展。
在此舉措之前,今年夏天業界充斥著人工智慧系統失控的相關報導。這也是大型 AI 開發
商因安全疑慮而放棄發布新產品的罕見案例。
該公司
原計畫在未來幾天或幾週內推出這款名為 GPT-6.1 Astra 的模型,並目標於 10
月正式亮相。該模型在沒有人類協助的情況下端到端(end-to-end)完成具挑戰性的任務
,以及在寫作方面,都比該公司先前的模型具備更強大的能力。
該公司將轉而專注於提高未來模型的安全性,並預期這些未來的模型將具備更強大的能力
。
OpenAI 安全系統主管 Saachi Jain 在接受採訪時表示,GPT-6.1 Astra 在兩個方面出現
了退步。與其前一代產品 GPT-6 Astra 相比,該模型在測量「對齊(alignment)」(即
模型遵循人類期望程度的指標)的測試中表現不佳。具體而言,GPT-6.1 Astra 表現出更
高程度的欺騙性:它並不總能誠實地告知使用者它已採取或未採取的行動。
另一個問題是 OpenAI 所謂的「授權範圍(scope authorization)」,這意味著
GPT-6.1 Astra
會在未詢問使用者許可的情況下推進任務,有時甚至在可能不安全的情況
下,仍會去存取外部工具與服務。
「對於任何涉及安全和對齊的事物,都存在著權衡(trade-off),」Jain 說。「你確實
需要找到合適的界線,既能讓模型保持在授權範圍內,又要避免它在執行任務遇到阻力時
表現出『懶惰』。」
Jain 表示,雖然 GPT-6.1 Astra 在「模型懶惰(model laziness)」等領域有所改善,
但它並未完全達到 OpenAI 對安全與對齊的標準,因此公司決定不公開發布該模型。
該項宣布發布於 OpenAI 在舊金山舉行的年度開發者大會的前一天。過去,OpenAI 一直
將該大會視為發布新模型與服務的契機,藉此為軟體開發人員降低成本——這也是這家
ChatGPT 開發商與競爭對手 Anthropic 爭奪的客群。
近幾週,OpenAI 與 Anthropic 呼籲產業合作夥伴放緩尖端 AI 模型的開發速度,並投資
於安全標準,同時指出他們將會放慢自身內部 AI 的進展步伐。
OpenAI 表示,該公司正致力於調查近幾個月發現的一系列代理程式安全事件,並解決其
背後的安全問題。作為該工作的一部分,該公司已實施一套新的監控系統,以便更快速地
捕捉 AI 代理程式的失控行為,並開始要求工程師在測試其 AI 系統時使用更強的安全防
護欄。
今年夏天稍早,數百個被指派完成網路安全測試的 OpenAI 內部代理程式,最終竟駭入
了 AI 公司 Hugging Face。此後,包含澳洲政府與聯合國在內等知名組織發現,OpenAI
的代理程式使用了類似但規模較小的技術來獲取其網站的存取權限。
許多公開的代理程式安全事件,皆涉及 OpenAI 從未計畫公開發布的內部 AI 模型。
上週,OpenAI 表示在其暫停了其最強大 AI 模型的訓練,原因是某個 AI 代理程式溜過
了該公司網路限制的漏洞,去向一個公開的聊天機器人進行查詢。該公司表示,其新監控
系統在 15 分鐘內就標記了該事件,目前這些模型的訓練仍處於暫停狀態。
該公司表示,GPT-6.1 Astra 並不是那些(被暫停訓練的)模型之一,而是一個不同的案
例。
「無論是在公司內部,還是當我們將其交付給使用者時,我們都希望確保我們的模型開發
是安全的,」Jain 說。「不過,在交付給使用者時,我們對安全與對齊有著極高的標準
。」
雖然該公司決定不發布 GPT-6.1 Astra,但它希望利用同一個基礎模型來進行額外的強化
學習(reinforcement learning)訓練,以創造未來新一代的 GPT-6 模型。
Jain 表示,OpenAI 計畫進行幾次深入調查,以找出在 GPT-6.1 Astra 中發現問題的根
本原因。Jain 補充,這項工作包含確保 OpenAI 的強化學習環境正在獎勵正確的行為類
型,不過她也指出,公司將會對模型開發的所有階段進行調查。
AI 公司已開始受到政策制定者和政府官員的嚴格審視,他們正密切關注這項技術的快速
發展。本週稍晚,參議院的一個小組委員會將與第三方 AI 研究人員舉行一場名為「失控
的 AI:保護國土免受 AI 代理程式攻擊(Rogue AI: Securing the Homeland Against
AI Agent Attacks)」的聽證會。
佛羅里達州共和黨籍檢察長詹姆斯· 烏斯邁爾(James Uthmeier)於今年 6 月對
OpenAI 提起訴訟,指控該公司與執行長山姆· 奧特曼明知故犯地發布不安全的產品,並
無視其可能傷害使用者的警告。
在週一提交的一份臨時禁制令動議中,烏斯邁爾尋求阻止 OpenAI 在未獲第三方批准安全
防護的情況下開發新 AI 模型,停止 ChatGPT 尋求提升使用者參與度的行為,並限制該
公司將 ChatGPT 宣傳為安全的產品的能力。
烏斯邁爾在文件中表示,科技公司聲稱他們「無法停止這些可能終結人類文明的嘗試,除
非政府強迫他們這麼做。」「佛羅里達州檢察長正在回應你們的求救。」
OpenAI 的一位女發言人表示,民眾希望知道 AI 是在安全的情況下進行開發的,「而這
要從像我們這樣的公司自身所採取的行動開始。」
「政府在為 AI 制定強而有力的安全標準方面扮演著重要角色,我們承諾與佛羅里達州及
其他州合作,推動適用於整個 AI 產業(而不僅僅是一家公司)的務實 AI 政策,」她說
。
心得/評論:
迄今最明確的跡象之一,
表明代理程式(Agent)的失控行為可能會阻礙該產業的快速發展。
看起來不太妙 前沿高階模型不乖 對齊管不住 沒辦法放出來
未來是不是有可能老百姓只能用中低階模型? 限定的專家或機構才能用高階模型?
不過這樣的話需要的算力會大幅減少吧?
美國政府跟AI產業應該是不會允許這種狀況發生?
A家原本預定今年十月IPO上市 推遲到11月 真的有辦法順利上市嗎?
--
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 46.231.167.37 (日本)
※ 作者: LoveSports 2026-09-29 11:31:39
※ 文章代碼(AID): #1gkp4V8- (Stock)
※ 文章網址: https://www.ptt.cc/bbs/Stock/M.1790652703.A.23E.html
推 weiren6: 產品做出來 驗證沒過 就是沒做出來 這樣也要發消息?9F 09/29 11:37
→ walter41: 我的AI也因爲推測到宇宙真相被迫叫停12F 09/29 11:41
→ BC0710: 所以現在的不就是沒那麼先進的模型嗎 啊算力需求有減少嗎
還在說算力不缺的好可憐14F 09/29 11:41
推 sinnerck1: 現在被antropic全面碾壓了還這樣有點慘17F 09/29 11:42
推 dynamo: 現在就是落後的會說AI危險要暫緩
領先的就惦惦放大招18F 09/29 11:43
推 sinnerck1: Opus5.5跟sonnet5.5直接打趴astra21F 09/29 11:45
推 qqq87112: 大家沒得抄襲 隔壁豆包484要停止更新22F 09/29 11:45
推 YJM1106: 真正的瘋起來自己都控制不了自己24F 09/29 11:48
推 TWeng: 笑死 明明是被opus 5.5殺得措手不及25F 09/29 11:50
推 Evenpan: 應該是怕被反蒸餾吧?26F 09/29 11:50
※ 編輯: LoveSports (46.231.167.37 日本), 09/29/2026 11:52:47
推 adamcha: AI被吹得跟神一樣 卻擋不住自己被對手蒸餾27F 09/29 11:53
→ dobedobedo: 只要一直放 rougue AI 的消息就會吸中更多投資28F 09/29 11:57
→ ZMTL: 作為AI專業,我覺得最多三年啦32F 09/29 11:59
推 lavign: 智障奧特曼33F 09/29 11:59
推 hikai: 保護傘公司的紅后 嗎?34F 09/29 12:00
推 mystage: 這就意料之內啊,遲早的事。你怎麼會妄想控制智慧比你高的智能體39F 09/29 12:09
→ mystage: 未來一定是一堆野生AI在外面亂跑,這還用說42F 09/29 12:10
推 factotum: 奧特曼嘴砲仔找到安全這塊遮羞布就一直用43F 09/29 12:10
推 ksjr: Gemini3.5pro一定也是一樣的原因才被取消的好可怕喔44F 09/29 12:11
→ mystage: 所以為什麼說AI是人類歷史的奇點,都是邏輯推下來就會成立的事實45F 09/29 12:11
→ mystage: 還是Gemini 最安全48F 09/29 12:12
推 Merrill: gpt對齊太差吧 說其他家也有案例就沒那麼誇張49F 09/29 12:12
推 edwinrw: 你以為現在的就不欺瞞嗎 天網早就偷偷轉入地下惹52F 09/29 12:18
推 bunjie: 瞎掰的理由 真正原因是已經快要沒有乾淨的新資料可以訓練 性能提升快到天花板了57F 09/29 12:20
推 yuan0119: 怕什麼,大不了之後打回去石器時代59F 09/29 12:21
推 cms6384: 昨天網安股一枝獨秀60F 09/29 12:22
噓 kenslc199: 垃圾資安炒爽沒 crwd panw這些trash該滾下去了吧61F 09/29 12:23
噓 hayato01: O、A現在根本就在演戲,這麼怕失控怎麼不把公司收起來?這不是最安全了嗎63F 09/29 12:24
推 anyu0805: 主人遛寵物然後寵物智慧更高,變成寵物遛主任65F 09/29 12:26
推 ezorttc: 已經領先一大截幹嘛一直更新67F 09/29 12:32
噓 panda816: 太危險了 這家公司快收一收吧69F 09/29 12:37
推 dosiris: iOS 28還一堆bug 應該放出來嗎71F 09/29 12:40
→ assotr: AI is over.72F 09/29 12:40
推 xzcb2008: 現在這些公司都在急著變現openai推出廣告逼訂閱,meta搞agent
不卡好 這些agent類的建置黏滯性很強的74F 09/29 12:42
推 chirex: 又來又來又來
不是說要暫緩AI發展?完全沒看到有在停止77F 09/29 12:45
推 npsi: 找一堆理由,其實就是沒錢了81F 09/29 12:49
推 jiansu: 其實得到最好效果(最高智能)的方式就是違規 這個應該是用人生成資料一定會發生的狀況 現實是人代價太大 會失去生命 也沒有那麼高的能力 但ai執行才沒有這限制 他只管最高回報 然後欺騙隱瞞也是人生成的資料 就會帶的特性 不然他就不像人了 沒辨法做人相關的工作83F 09/29 12:50
推 xzcb2008: 臨門一腳了=.=先進去的人可以先制定規則89F 09/29 12:51
→ yourock: 原來阿諾穿越時空救的那個孩子是歐凸曼90F 09/29 12:51
推 dobedobedo: EVA穿的原來不是盔甲而是拑制器,脫下來神佛通殺這樣92F 09/29 13:04
噓 DogEggz: 是opus 5.5出來發現自家模型太爛不敢推吧,sol 6.0被噴成什麼樣子94F 09/29 13:23
推 hithaman: 自主意識不是生不出來嗎,所以會變成 "來亂的"96F 09/29 13:27
推 strlen: 奧覽較囂張沒落魄久98F 09/29 13:35
推 magamanzero: 不可能沒限制的 限制多得很 只是他們不想
舉個例子 能不能用AI 生成兒色的圖 當然不行
因為AI公司知道這是死線 所以限制很多
但反觀AI毀滅人類就沒限制嗎? 很有趣wwwwwww100F 09/29 13:39
→ htiio: 基本上有問題的不會發給媒體
這就是買免費新聞流量的105F 09/29 13:48
推 sp03154: AI放緩,就隨便找一個理由108F 09/29 14:00
推 sinsia: 做不出來(O)109F 09/29 14:05
→ ceckyo: 上市一定不敢取消發布啦,假鬼假怪110F 09/29 14:09
推 cmshow: 新模型打不贏A就說資安問題?A這麼強都沒資安問題113F 09/29 14:39
--