看板 Stock
作者 LoveSports (如何當一個好男人)
標題 [新聞] OpenAI因安全疑慮取消發布新AI模型
時間 Tue Sep 29 11:31:39 2026


原文標題:OpenAI 因安全疑慮取消發布新 AI 模型
OpenAI Scraps Release of New AI Model Over Safety Concerns

副標題: 這款名為 GPT-6.1 Astra 的模型原訂於 10 月在 ChatGPT 和 Codex 中首度亮相
Model dubbed GPT-6.1 Astra was due to make its debut inside ChatGPT and Codex
in October

原文連結:
https://www.wsj.com/tech/ai/openai-chatgpt-model-release-cancel-safety-5a2f9f42
https://reurl.cc/k9Q31n

發布時間:Updated Sept. 28, 2026 7:07 pm ET

記者署名:Maxwell Zeff

原文內容:

快速概要

由於研究人員在內部測試中提出了安全問題,OpenAI 取消了發布其下一代人工智慧模型
GPT-6.1 Astra 的計劃。

該模型表現出更高的欺騙性,並且會在未徵得用戶許可的情況下繼續執行任務。

OpenAI 將轉而專注於提高未來模型的安全性,並計劃調查 GPT-6.1 Astra 問題的根本原
因。

新聞內容 本文為AI機翻

OpenAI 表示,由於研究人員在內部測試期間提出的安全疑慮,該公司將取消其下一代
AI 模型的發布。這是迄今最明確的跡象之一,表明代理程式(Agent)的失控行為可能會
阻礙該產業的快速發展。

在此舉措之前,今年夏天業界充斥著人工智慧系統失控的相關報導。這也是大型 AI 開發
商因安全疑慮而放棄發布新產品的罕見案例。

該公司原計畫在未來幾天或幾週內推出這款名為 GPT-6.1 Astra 的模型,並目標於 10
月正式亮相。該模型在沒有人類協助的情況下端到端(end-to-end)完成具挑戰性的任務
,以及在寫作方面,都比該公司先前的模型具備更強大的能力。

該公司將轉而專注於提高未來模型的安全性,並預期這些未來的模型將具備更強大的能力
。

OpenAI 安全系統主管 Saachi Jain 在接受採訪時表示,GPT-6.1 Astra 在兩個方面出現
了退步。與其前一代產品 GPT-6 Astra 相比,該模型在測量「對齊(alignment)」(即
模型遵循人類期望程度的指標)的測試中表現不佳。具體而言,GPT-6.1 Astra 表現出更
高程度的欺騙性:它並不總能誠實地告知使用者它已採取或未採取的行動。


另一個問題是 OpenAI 所謂的「授權範圍(scope authorization)」,這意味著
GPT-6.1 Astra 會在未詢問使用者許可的情況下推進任務,有時甚至在可能不安全的情況
下,仍會去存取外部工具與服務。

「對於任何涉及安全和對齊的事物,都存在著權衡(trade-off),」Jain 說。「你確實
需要找到合適的界線,既能讓模型保持在授權範圍內,又要避免它在執行任務遇到阻力時
表現出『懶惰』。」


Jain 表示,雖然 GPT-6.1 Astra 在「模型懶惰(model laziness)」等領域有所改善,
但它並未完全達到 OpenAI 對安全與對齊的標準,因此公司決定不公開發布該模型。

該項宣布發布於 OpenAI 在舊金山舉行的年度開發者大會的前一天。過去,OpenAI 一直
將該大會視為發布新模型與服務的契機,藉此為軟體開發人員降低成本——這也是這家
ChatGPT 開發商與競爭對手 Anthropic 爭奪的客群。


近幾週,OpenAI 與 Anthropic 呼籲產業合作夥伴放緩尖端 AI 模型的開發速度,並投資
於安全標準,同時指出他們將會放慢自身內部 AI 的進展步伐。

OpenAI 表示,該公司正致力於調查近幾個月發現的一系列代理程式安全事件,並解決其
背後的安全問題。作為該工作的一部分,該公司已實施一套新的監控系統,以便更快速地
捕捉 AI 代理程式的失控行為,並開始要求工程師在測試其 AI 系統時使用更強的安全防
護欄。


今年夏天稍早,數百個被指派完成網路安全測試的 OpenAI 內部代理程式,最終竟駭入
了 AI 公司 Hugging Face。此後,包含澳洲政府與聯合國在內等知名組織發現,OpenAI
的代理程式使用了類似但規模較小的技術來獲取其網站的存取權限。


許多公開的代理程式安全事件,皆涉及 OpenAI 從未計畫公開發布的內部 AI 模型。

上週,OpenAI 表示在其暫停了其最強大 AI 模型的訓練,原因是某個 AI 代理程式溜過
了該公司網路限制的漏洞,去向一個公開的聊天機器人進行查詢。該公司表示,其新監控
系統在 15 分鐘內就標記了該事件,目前這些模型的訓練仍處於暫停狀態。


該公司表示,GPT-6.1 Astra 並不是那些(被暫停訓練的)模型之一,而是一個不同的案
例。

「無論是在公司內部,還是當我們將其交付給使用者時,我們都希望確保我們的模型開發
是安全的,」Jain 說。「不過,在交付給使用者時,我們對安全與對齊有著極高的標準
。」


雖然該公司決定不發布 GPT-6.1 Astra,但它希望利用同一個基礎模型來進行額外的強化
學習(reinforcement learning)訓練,以創造未來新一代的 GPT-6 模型。

Jain 表示,OpenAI 計畫進行幾次深入調查,以找出在 GPT-6.1 Astra 中發現問題的根
本原因。Jain 補充,這項工作包含確保 OpenAI 的強化學習環境正在獎勵正確的行為類
型,不過她也指出,公司將會對模型開發的所有階段進行調查。


AI 公司已開始受到政策制定者和政府官員的嚴格審視,他們正密切關注這項技術的快速
發展。本週稍晚,參議院的一個小組委員會將與第三方 AI 研究人員舉行一場名為「失控
的 AI:保護國土免受 AI 代理程式攻擊(Rogue AI: Securing the Homeland Against

AI Agent Attacks)」的聽證會。

佛羅里達州共和黨籍檢察長詹姆斯· 烏斯邁爾(James Uthmeier)於今年 6 月對
OpenAI 提起訴訟,指控該公司與執行長山姆· 奧特曼明知故犯地發布不安全的產品,並
無視其可能傷害使用者的警告。

在週一提交的一份臨時禁制令動議中,烏斯邁爾尋求阻止 OpenAI 在未獲第三方批准安全
防護的情況下開發新 AI 模型,停止 ChatGPT 尋求提升使用者參與度的行為,並限制該
公司將 ChatGPT 宣傳為安全的產品的能力。


烏斯邁爾在文件中表示,科技公司聲稱他們「無法停止這些可能終結人類文明的嘗試,除
非政府強迫他們這麼做。」「佛羅里達州檢察長正在回應你們的求救。」

OpenAI 的一位女發言人表示,民眾希望知道 AI 是在安全的情況下進行開發的,「而這
要從像我們這樣的公司自身所採取的行動開始。」

「政府在為 AI 制定強而有力的安全標準方面扮演著重要角色,我們承諾與佛羅里達州及
其他州合作,推動適用於整個 AI 產業(而不僅僅是一家公司)的務實 AI 政策,」她說
。


心得/評論:

迄今最明確的跡象之一,
表明代理程式(Agent)的失控行為可能會阻礙該產業的快速發展。

看起來不太妙  前沿高階模型不乖  對齊管不住  沒辦法放出來

未來是不是有可能老百姓只能用中低階模型? 限定的專家或機構才能用高階模型?

不過這樣的話需要的算力會大幅減少吧?

美國政府跟AI產業應該是不會允許這種狀況發生?

A家原本預定今年十月IPO上市  推遲到11月  真的有辦法順利上市嗎?



--
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 46.231.167.37 (日本)
※ 作者: LoveSports 2026-09-29 11:31:39
※ 文章代碼(AID): #1gkp4V8- (Stock)
※ 文章網址: https://www.ptt.cc/bbs/Stock/M.1790652703.A.23E.html
→ ikachann: 越來越不受控了1F 09/29 11:32
推 onekoni: 一直炒作同一件事2F 09/29 11:32
→ lightson: 又在演3F 09/29 11:32
推 M1424344414: AI要把全人類幹掉了 真實版全民公敵上映4F 09/29 11:33
推 MoneyDay5566: 超級鬼故事5F 09/29 11:33
→ M1424344414: 乾 是機械公敵啦 打錯字笑死6F 09/29 11:34
推 brian040818: 好可怕 覺醒自我了 什麼時候射核彈7F 09/29 11:35
推 firemothra: 我也很常搞錯那兩部電影的名字8F 09/29 11:37
推 weiren6: 產品做出來 驗證沒過 就是沒做出來 這樣也要發消息?9F 09/29 11:37
推 tteeccddyy: 繼續唬爛沒關係10F 09/29 11:38
噓 GingFreecss: 現在是不是不講自己會駭出去不夠強人家不要投資11F 09/29 11:41
→ walter41: 我的AI也因爲推測到宇宙真相被迫叫停12F 09/29 11:41
→ GingFreecss: 每個人都整天在那邊啊啊啊我的好可怕 看了就躁13F 09/29 11:41
→ BC0710: 所以現在的不就是沒那麼先進的模型嗎 啊算力需求有減少嗎
還在說算力不缺的好可憐14F 09/29 11:41
推 sinnerck1: 現在被antropic全面碾壓了還這樣有點慘17F 09/29 11:42
推 dynamo: 現在就是落後的會說AI危險要暫緩
領先的就惦惦放大招18F 09/29 11:43
噓 lulufufu: 牽拖20F 09/29 11:45
推 sinnerck1: Opus5.5跟sonnet5.5直接打趴astra21F 09/29 11:45
推 qqq87112: 大家沒得抄襲 隔壁豆包484要停止更新22F 09/29 11:45
→ sunnywing: 不夠壞的我們不要23F 09/29 11:46
推 YJM1106: 真正的瘋起來自己都控制不了自己24F 09/29 11:48
推 TWeng: 笑死 明明是被opus 5.5殺得措手不及25F 09/29 11:50
推 Evenpan: 應該是怕被反蒸餾吧?26F 09/29 11:50
※ 編輯: LoveSports (46.231.167.37 日本), 09/29/2026 11:52:47
推 adamcha: AI被吹得跟神一樣 卻擋不住自己被對手蒸餾27F 09/29 11:53
→ dobedobedo: 只要一直放 rougue AI 的消息就會吸中更多投資28F 09/29 11:57
推 Shepherd1987: 打破沙盒問到底29F 09/29 11:58
推 herculus6502: 還有幾集可以逃30F 09/29 11:58
推 unwisdom: 哈哈 快吹爆了31F 09/29 11:59
→ ZMTL: 作為AI專業,我覺得最多三年啦32F 09/29 11:59
推 lavign: 智障奧特曼33F 09/29 11:59
推 hikai: 保護傘公司的紅后 嗎?34F 09/29 12:00
→ darren81835: 現在全世界在追台積電 之後就看AI誰追誰了 呵呵35F 09/29 12:02
推 runedcross: 比不上人家 不好意思出而已吧36F 09/29 12:04
推 ChikanDesu: 我們的模型太殺了 放出來連我自己都怕啊37F 09/29 12:05
推 livewater: 這部我看過,魔鬼終結者38F 09/29 12:07
推 mystage: 這就意料之內啊,遲早的事。你怎麼會妄想控制智慧比你高的智能體39F 09/29 12:09
→ scarbywind: 不能給你用41F 09/29 12:10
→ mystage: 未來一定是一堆野生AI在外面亂跑,這還用說42F 09/29 12:10
推 factotum: 奧特曼嘴砲仔找到安全這塊遮羞布就一直用43F 09/29 12:10
推 ksjr: Gemini3.5pro一定也是一樣的原因才被取消的好可怕喔44F 09/29 12:11
→ mystage: 所以為什麼說AI是人類歷史的奇點,都是邏輯推下來就會成立的事實45F 09/29 12:11
噓 mack860120: 還再演 噁不噁…47F 09/29 12:12
→ mystage: 還是Gemini 最安全48F 09/29 12:12
推 Merrill: gpt對齊太差吧 說其他家也有案例就沒那麼誇張49F 09/29 12:12
推 HelloPTT: 目前opus5.5強太多50F 09/29 12:15
推 evergreen94: 呵呵 落後就是安全疑慮51F 09/29 12:16
推 edwinrw: 你以為現在的就不欺瞞嗎 天網早就偷偷轉入地下惹52F 09/29 12:18
噓 henry27876: 翻譯:錢還沒入帳 不公佈53F 09/29 12:18
推 sushi11: 糕點到了54F 09/29 12:18
推 newyorker54: 炒作,噱頭55F 09/29 12:19
推 p25488148: 改名叫天網如何56F 09/29 12:19
推 bunjie: 瞎掰的理由 真正原因是已經快要沒有乾淨的新資料可以訓練 性能提升快到天花板了57F 09/29 12:20
推 yuan0119: 怕什麼,大不了之後打回去石器時代59F 09/29 12:21
推 cms6384: 昨天網安股一枝獨秀60F 09/29 12:22
噓 kenslc199: 垃圾資安炒爽沒 crwd panw這些trash該滾下去了吧61F 09/29 12:23
推 tongmove0503: 延遲是因為太強,跟傳武一樣,一出手就要見血62F 09/29 12:23
噓 hayato01: O、A現在根本就在演戲,這麼怕失控怎麼不把公司收起來?這不是最安全了嗎63F 09/29 12:24
推 anyu0805: 主人遛寵物然後寵物智慧更高,變成寵物遛主任65F 09/29 12:26
推 TroyeSivan: 預告在前 ai泡沫要破了66F 09/29 12:29
推 ezorttc: 已經領先一大截幹嘛一直更新67F 09/29 12:32
推 doubleperson: 翻譯:我的AI太強了,所以不發布68F 09/29 12:35
噓 panda816: 太危險了 這家公司快收一收吧69F 09/29 12:37
噓 playboy007gy: 擠不出牙膏的藉口 zzz70F 09/29 12:39
推 dosiris: iOS 28還一堆bug 應該放出來嗎71F 09/29 12:40
→ assotr: AI is over.72F 09/29 12:40
→ sawkuanwoo: 其實就是沒錢燒了,故意發布消息維持股價73F 09/29 12:41
推 xzcb2008: 現在這些公司都在急著變現openai推出廣告逼訂閱,meta搞agent
不卡好 這些agent類的建置黏滯性很強的74F 09/29 12:42
推 chirex: 又來又來又來
不是說要暫緩AI發展?完全沒看到有在停止77F 09/29 12:45
噓 CHINCHIN5566: 表示太強了,要上枷鎖,噴!79F 09/29 12:47
→ a923508: 開始演戲了80F 09/29 12:48
推 npsi: 找一堆理由,其實就是沒錢了81F 09/29 12:49
推 harry801030: 天網要再等等82F 09/29 12:49
推 jiansu: 其實得到最好效果(最高智能)的方式就是違規 這個應該是用人生成資料一定會發生的狀況 現實是人代價太大 會失去生命 也沒有那麼高的能力 但ai執行才沒有這限制 他只管最高回報 然後欺騙隱瞞也是人生成的資料 就會帶的特性 不然他就不像人了 沒辨法做人相關的工作83F 09/29 12:50
推 xzcb2008: 臨門一腳了=.=先進去的人可以先制定規則89F 09/29 12:51
→ yourock: 原來阿諾穿越時空救的那個孩子是歐凸曼90F 09/29 12:51
→ xzcb2008: 這步晚了的跟隨別人了91F 09/29 12:52
推 dobedobedo: EVA穿的原來不是盔甲而是拑制器,脫下來神佛通殺這樣92F 09/29 13:04
推 saladbread: 留著自己用的意思93F 09/29 13:07
噓 DogEggz: 是opus 5.5出來發現自家模型太爛不敢推吧,sol 6.0被噴成什麼樣子94F 09/29 13:23
推 hithaman: 自主意識不是生不出來嗎,所以會變成 "來亂的"96F 09/29 13:27
→ dreamnook2: (′・ω・‵)丸子97F 09/29 13:28
推 strlen: 奧覽較囂張沒落魄久98F 09/29 13:35
推 crystal0504: 給AI太多權利,他真的給你亂搞啦99F 09/29 13:38
推 magamanzero: 不可能沒限制的 限制多得很 只是他們不想
舉個例子 能不能用AI 生成兒色的圖 當然不行
因為AI公司知道這是死線 所以限制很多
但反觀AI毀滅人類就沒限制嗎?  很有趣wwwwwww100F 09/29 13:39
推 vovovolibear: 事實是發現研發進度不如預期,不敢發表104F 09/29 13:45
→ htiio: 基本上有問題的不會發給媒體
這就是買免費新聞流量的105F 09/29 13:48
→ leo255112: 天網?!107F 09/29 13:51
推 sp03154: AI放緩,就隨便找一個理由108F 09/29 14:00
推 sinsia: 做不出來(O)109F 09/29 14:05
→ ceckyo: 上市一定不敢取消發布啦,假鬼假怪110F 09/29 14:09
→ f19870421: 股價下跌疑慮吧111F 09/29 14:10
推 stocktonty: 好了啦你不推出 別人也會推出112F 09/29 14:14
推 cmshow: 新模型打不贏A就說資安問題?A這麼強都沒資安問題113F 09/29 14:39
→ idernest: 好了啦114F 09/29 14:40
推 longlongyi: 最強的AI怕被中國抄作業吧= =115F 09/29 15:48
推 GodBoneQ: 全速衝刺!!!116F 09/29 15:52

--