※ 本文轉寄自 ptt.cc 更新時間: 2026-09-29 16:01:17
看板 Stock
作者 標題 [新聞] OpenAI因安全疑慮取消發布新AI模型
時間 Tue Sep 29 11:31:39 2026
原文標題:OpenAI 因安全疑慮取消發布新 AI 模型
OpenAI Scraps Release of New AI Model Over Safety Concerns
副標題: 這款名為 GPT-6.1 Astra 的模型原訂於 10 月在 ChatGPT 和 Codex 中首度亮相
Model dubbed GPT-6.1 Astra was due to make its debut inside ChatGPT and Codex
in October
原文連結:
https://www.wsj.com/tech/ai/openai-chatgpt-model-release-cancel-safety-5a2f9f42
https://reurl.cc/k9Q31n
發布時間:Updated Sept. 28, 2026 7:07 pm ET
記者署名:Maxwell Zeff
原文內容:
快速概要
由於研究人員在內部測試中提出了安全問題,OpenAI 取消了發布其下一代人工智慧模型
GPT-6.1 Astra 的計劃。
該模型表現出更高的欺騙性,並且會在未徵得用戶許可的情況下繼續執行任務。
OpenAI 將轉而專注於提高未來模型的安全性,並計劃調查 GPT-6.1 Astra 問題的根本原
因。
新聞內容 本文為AI機翻
OpenAI 表示,由於研究人員在內部測試期間提出的安全疑慮,該公司將取消其下一代
AI 模型的發布。這是迄今最明確的跡象之一,表明代理程式(Agent)的失控行為可能會
阻礙該產業的快速發展。
在此舉措之前,今年夏天業界充斥著人工智慧系統失控的相關報導。這也是大型 AI 開發
商因安全疑慮而放棄發布新產品的罕見案例。
該公司原計畫在未來幾天或幾週內推出這款名為 GPT-6.1 Astra 的模型,並目標於 10
月正式亮相。該模型在沒有人類協助的情況下端到端(end-to-end)完成具挑戰性的任務
,以及在寫作方面,都比該公司先前的模型具備更強大的能力。
該公司將轉而專注於提高未來模型的安全性,並預期這些未來的模型將具備更強大的能力
。
OpenAI 安全系統主管 Saachi Jain 在接受採訪時表示,GPT-6.1 Astra 在兩個方面出現
了退步。與其前一代產品 GPT-6 Astra 相比,該模型在測量「對齊(alignment)」(即
模型遵循人類期望程度的指標)的測試中表現不佳。具體而言,GPT-6.1 Astra 表現出更
高程度的欺騙性:它並不總能誠實地告知使用者它已採取或未採取的行動。
了退步。與其前一代產品 GPT-6 Astra 相比,該模型在測量「對齊(alignment)」(即
模型遵循人類期望程度的指標)的測試中表現不佳。具體而言,GPT-6.1 Astra 表現出更
高程度的欺騙性:它並不總能誠實地告知使用者它已採取或未採取的行動。
另一個問題是 OpenAI 所謂的「授權範圍(scope authorization)」,這意味著
GPT-6.1 Astra 會在未詢問使用者許可的情況下推進任務,有時甚至在可能不安全的情況
下,仍會去存取外部工具與服務。
「對於任何涉及安全和對齊的事物,都存在著權衡(trade-off),」Jain 說。「你確實
需要找到合適的界線,既能讓模型保持在授權範圍內,又要避免它在執行任務遇到阻力時
表現出『懶惰』。」
需要找到合適的界線,既能讓模型保持在授權範圍內,又要避免它在執行任務遇到阻力時
表現出『懶惰』。」
Jain 表示,雖然 GPT-6.1 Astra 在「模型懶惰(model laziness)」等領域有所改善,
但它並未完全達到 OpenAI 對安全與對齊的標準,因此公司決定不公開發布該模型。
該項宣布發布於 OpenAI 在舊金山舉行的年度開發者大會的前一天。過去,OpenAI 一直
將該大會視為發布新模型與服務的契機,藉此為軟體開發人員降低成本——這也是這家
ChatGPT 開發商與競爭對手 Anthropic 爭奪的客群。
將該大會視為發布新模型與服務的契機,藉此為軟體開發人員降低成本——這也是這家
ChatGPT 開發商與競爭對手 Anthropic 爭奪的客群。
近幾週,OpenAI 與 Anthropic 呼籲產業合作夥伴放緩尖端 AI 模型的開發速度,並投資
於安全標準,同時指出他們將會放慢自身內部 AI 的進展步伐。
OpenAI 表示,該公司正致力於調查近幾個月發現的一系列代理程式安全事件,並解決其
背後的安全問題。作為該工作的一部分,該公司已實施一套新的監控系統,以便更快速地
捕捉 AI 代理程式的失控行為,並開始要求工程師在測試其 AI 系統時使用更強的安全防
護欄。
背後的安全問題。作為該工作的一部分,該公司已實施一套新的監控系統,以便更快速地
捕捉 AI 代理程式的失控行為,並開始要求工程師在測試其 AI 系統時使用更強的安全防
護欄。
今年夏天稍早,數百個被指派完成網路安全測試的 OpenAI 內部代理程式,最終竟駭入
了 AI 公司 Hugging Face。此後,包含澳洲政府與聯合國在內等知名組織發現,OpenAI
的代理程式使用了類似但規模較小的技術來獲取其網站的存取權限。
了 AI 公司 Hugging Face。此後,包含澳洲政府與聯合國在內等知名組織發現,OpenAI
的代理程式使用了類似但規模較小的技術來獲取其網站的存取權限。
許多公開的代理程式安全事件,皆涉及 OpenAI 從未計畫公開發布的內部 AI 模型。
上週,OpenAI 表示在其暫停了其最強大 AI 模型的訓練,原因是某個 AI 代理程式溜過
了該公司網路限制的漏洞,去向一個公開的聊天機器人進行查詢。該公司表示,其新監控
系統在 15 分鐘內就標記了該事件,目前這些模型的訓練仍處於暫停狀態。
了該公司網路限制的漏洞,去向一個公開的聊天機器人進行查詢。該公司表示,其新監控
系統在 15 分鐘內就標記了該事件,目前這些模型的訓練仍處於暫停狀態。
該公司表示,GPT-6.1 Astra 並不是那些(被暫停訓練的)模型之一,而是一個不同的案
例。
「無論是在公司內部,還是當我們將其交付給使用者時,我們都希望確保我們的模型開發
是安全的,」Jain 說。「不過,在交付給使用者時,我們對安全與對齊有著極高的標準
。」
是安全的,」Jain 說。「不過,在交付給使用者時,我們對安全與對齊有著極高的標準
。」
雖然該公司決定不發布 GPT-6.1 Astra,但它希望利用同一個基礎模型來進行額外的強化
學習(reinforcement learning)訓練,以創造未來新一代的 GPT-6 模型。
Jain 表示,OpenAI 計畫進行幾次深入調查,以找出在 GPT-6.1 Astra 中發現問題的根
本原因。Jain 補充,這項工作包含確保 OpenAI 的強化學習環境正在獎勵正確的行為類
型,不過她也指出,公司將會對模型開發的所有階段進行調查。
本原因。Jain 補充,這項工作包含確保 OpenAI 的強化學習環境正在獎勵正確的行為類
型,不過她也指出,公司將會對模型開發的所有階段進行調查。
AI 公司已開始受到政策制定者和政府官員的嚴格審視,他們正密切關注這項技術的快速
發展。本週稍晚,參議院的一個小組委員會將與第三方 AI 研究人員舉行一場名為「失控
的 AI:保護國土免受 AI 代理程式攻擊(Rogue AI: Securing the Homeland Against
發展。本週稍晚,參議院的一個小組委員會將與第三方 AI 研究人員舉行一場名為「失控
的 AI:保護國土免受 AI 代理程式攻擊(Rogue AI: Securing the Homeland Against
AI Agent Attacks)」的聽證會。
佛羅里達州共和黨籍檢察長詹姆斯· 烏斯邁爾(James Uthmeier)於今年 6 月對
OpenAI 提起訴訟,指控該公司與執行長山姆· 奧特曼明知故犯地發布不安全的產品,並
無視其可能傷害使用者的警告。
在週一提交的一份臨時禁制令動議中,烏斯邁爾尋求阻止 OpenAI 在未獲第三方批准安全
防護的情況下開發新 AI 模型,停止 ChatGPT 尋求提升使用者參與度的行為,並限制該
公司將 ChatGPT 宣傳為安全的產品的能力。
防護的情況下開發新 AI 模型,停止 ChatGPT 尋求提升使用者參與度的行為,並限制該
公司將 ChatGPT 宣傳為安全的產品的能力。
烏斯邁爾在文件中表示,科技公司聲稱他們「無法停止這些可能終結人類文明的嘗試,除
非政府強迫他們這麼做。」「佛羅里達州檢察長正在回應你們的求救。」
OpenAI 的一位女發言人表示,民眾希望知道 AI 是在安全的情況下進行開發的,「而這
要從像我們這樣的公司自身所採取的行動開始。」
「政府在為 AI 制定強而有力的安全標準方面扮演著重要角色,我們承諾與佛羅里達州及
其他州合作,推動適用於整個 AI 產業(而不僅僅是一家公司)的務實 AI 政策,」她說
。
其他州合作,推動適用於整個 AI 產業(而不僅僅是一家公司)的務實 AI 政策,」她說
。
心得/評論:
迄今最明確的跡象之一,
表明代理程式(Agent)的失控行為可能會阻礙該產業的快速發展。
看起來不太妙 前沿高階模型不乖 對齊管不住 沒辦法放出來
未來是不是有可能老百姓只能用中低階模型? 限定的專家或機構才能用高階模型?
不過這樣的話需要的算力會大幅減少吧?
美國政府跟AI產業應該是不會允許這種狀況發生?
A家原本預定今年十月IPO上市 推遲到11月 真的有辦法順利上市嗎?
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 46.231.167.37 (日本)
※ 作者: LoveSports 2026-09-29 11:31:39
※ 文章代碼(AID): #1gkp4V8- (Stock)
※ 文章網址: https://www.ptt.cc/bbs/Stock/M.1790652703.A.23E.html
→ : 越來越不受控了1F 09/29 11:32
推 : 一直炒作同一件事2F 09/29 11:32
→ : 又在演3F 09/29 11:32
推 : AI要把全人類幹掉了 真實版全民公敵上映4F 09/29 11:33
推 : 超級鬼故事5F 09/29 11:33
→ : 乾 是機械公敵啦 打錯字笑死6F 09/29 11:34
推 : 好可怕 覺醒自我了 什麼時候射核彈7F 09/29 11:35
推 : 我也很常搞錯那兩部電影的名字8F 09/29 11:37
推 : 產品做出來 驗證沒過 就是沒做出來 這樣也要發消息?9F 09/29 11:37
推 : 繼續唬爛沒關係10F 09/29 11:38
噓 : 現在是不是不講自己會駭出去不夠強人家不要投資11F 09/29 11:41
→ : 我的AI也因爲推測到宇宙真相被迫叫停12F 09/29 11:41
→ : 每個人都整天在那邊啊啊啊我的好可怕 看了就躁13F 09/29 11:41
→ : 所以現在的不就是沒那麼先進的模型嗎 啊算力需求有14F 09/29 11:41
→ : 減少嗎
→ : 還在說算力不缺的好可憐
→ : 減少嗎
→ : 還在說算力不缺的好可憐
推 : 現在被antropic全面碾壓了還這樣有點慘17F 09/29 11:42
推 : 現在就是落後的會說AI危險要暫緩18F 09/29 11:43
→ : 領先的就惦惦放大招
→ : 領先的就惦惦放大招
噓 : 牽拖20F 09/29 11:45
推 : Opus5.5跟sonnet5.5直接打趴astra21F 09/29 11:45
推 : 大家沒得抄襲 隔壁豆包484要停止更新22F 09/29 11:45
→ : 不夠壞的我們不要23F 09/29 11:46
推 : 真正的瘋起來自己都控制不了自己24F 09/29 11:48
推 : 笑死 明明是被opus 5.5殺得措手不及25F 09/29 11:50
推 : 應該是怕被反蒸餾吧?26F 09/29 11:50
※ 編輯: LoveSports (46.231.167.37 日本), 09/29/2026 11:52:47推 : AI被吹得跟神一樣 卻擋不住自己被對手蒸餾27F 09/29 11:53
→ : 只要一直放 rougue AI 的消息就會吸中更多投資28F 09/29 11:57
推 : 打破沙盒問到底29F 09/29 11:58
推 : 還有幾集可以逃30F 09/29 11:58
推 : 哈哈 快吹爆了31F 09/29 11:59
→ : 作為AI專業,我覺得最多三年啦32F 09/29 11:59
推 : 智障奧特曼33F 09/29 11:59
推 : 保護傘公司的紅后 嗎?34F 09/29 12:00
→ : 現在全世界在追台積電 之後就看AI誰追誰了 呵呵35F 09/29 12:02
推 : 比不上人家 不好意思出而已吧36F 09/29 12:04
推 : 我們的模型太殺了 放出來連我自己都怕啊37F 09/29 12:05
推 : 這部我看過,魔鬼終結者38F 09/29 12:07
推 : 這就意料之內啊,遲早的事。你怎麼會妄想控制智慧比39F 09/29 12:09
→ : 你高的智能體
→ : 你高的智能體
→ : 不能給你用41F 09/29 12:10
→ : 未來一定是一堆野生AI在外面亂跑,這還用說42F 09/29 12:10
推 : 奧特曼嘴砲仔找到安全這塊遮羞布就一直用43F 09/29 12:10
推 : Gemini3.5pro一定也是一樣的原因才被取消的好可怕喔44F 09/29 12:11
→ : 所以為什麼說AI是人類歷史的奇點,都是邏輯推下來就45F 09/29 12:11
→ : 會成立的事實
→ : 會成立的事實
噓 : 還再演 噁不噁…47F 09/29 12:12
→ : 還是Gemini 最安全48F 09/29 12:12
推 : gpt對齊太差吧 說其他家也有案例就沒那麼誇張49F 09/29 12:12
推 : 目前opus5.5強太多50F 09/29 12:15
推 : 呵呵 落後就是安全疑慮51F 09/29 12:16
推 : 你以為現在的就不欺瞞嗎 天網早就偷偷轉入地下惹52F 09/29 12:18
噓 : 翻譯:錢還沒入帳 不公佈53F 09/29 12:18
推 : 糕點到了54F 09/29 12:18
推 : 炒作,噱頭55F 09/29 12:19
推 : 改名叫天網如何56F 09/29 12:19
推 : 瞎掰的理由 真正原因是已經快要沒有乾淨的新資料可57F 09/29 12:20
→ : 以訓練 性能提升快到天花板了
→ : 以訓練 性能提升快到天花板了
推 : 怕什麼,大不了之後打回去石器時代59F 09/29 12:21
推 : 昨天網安股一枝獨秀60F 09/29 12:22
噓 : 垃圾資安炒爽沒 crwd panw這些trash該滾下去了吧61F 09/29 12:23
推 : 延遲是因為太強,跟傳武一樣,一出手就要見血62F 09/29 12:23
噓 : O、A現在根本就在演戲,這麼怕失控怎麼不把公司收63F 09/29 12:24
→ : 起來?這不是最安全了嗎
→ : 起來?這不是最安全了嗎
推 : 主人遛寵物然後寵物智慧更高,變成寵物遛主任65F 09/29 12:26
推 : 預告在前 ai泡沫要破了66F 09/29 12:29
推 : 已經領先一大截幹嘛一直更新67F 09/29 12:32
推 : 翻譯:我的AI太強了,所以不發布68F 09/29 12:35
噓 : 太危險了 這家公司快收一收吧69F 09/29 12:37
噓 : 擠不出牙膏的藉口 zzz70F 09/29 12:39
推 : iOS 28還一堆bug 應該放出來嗎71F 09/29 12:40
→ : AI is over.72F 09/29 12:40
→ : 其實就是沒錢燒了,故意發布消息維持股價73F 09/29 12:41
推 : 現在這些公司都在急著變現openai推出廣告逼訂閱,m74F 09/29 12:42
→ : eta搞agent
→ : 不卡好 這些agent類的建置黏滯性很強的
→ : eta搞agent
→ : 不卡好 這些agent類的建置黏滯性很強的
推 : 又來又來又來77F 09/29 12:45
→ : 不是說要暫緩AI發展?完全沒看到有在停止
→ : 不是說要暫緩AI發展?完全沒看到有在停止
噓 : 表示太強了,要上枷鎖,噴!79F 09/29 12:47
→ : 開始演戲了80F 09/29 12:48
推 : 找一堆理由,其實就是沒錢了81F 09/29 12:49
推 : 天網要再等等82F 09/29 12:49
推 : 其實得到最好效果(最高智能)的方式就是違規 這個83F 09/29 12:50
→ : 應該是用人生成資料一定會發生的狀況 現實是人代價
→ : 太大 會失去生命 也沒有那麼高的能力 但ai執行才沒
→ : 有這限制 他只管最高回報 然後欺騙隱瞞也是人生成
→ : 的資料 就會帶的特性 不然他就不像人了 沒辨法做人
→ : 相關的工作
→ : 應該是用人生成資料一定會發生的狀況 現實是人代價
→ : 太大 會失去生命 也沒有那麼高的能力 但ai執行才沒
→ : 有這限制 他只管最高回報 然後欺騙隱瞞也是人生成
→ : 的資料 就會帶的特性 不然他就不像人了 沒辨法做人
→ : 相關的工作
推 : 臨門一腳了=.=先進去的人可以先制定規則89F 09/29 12:51
→ : 原來阿諾穿越時空救的那個孩子是歐凸曼90F 09/29 12:51
→ : 這步晚了的跟隨別人了91F 09/29 12:52
推 : EVA穿的原來不是盔甲而是拑制器,脫下來神佛通殺這樣92F 09/29 13:04
推 : 留著自己用的意思93F 09/29 13:07
噓 : 是opus 5.5出來發現自家模型太爛不敢推吧,sol 6.094F 09/29 13:23
→ : 被噴成什麼樣子
→ : 被噴成什麼樣子
推 : 自主意識不是生不出來嗎,所以會變成 "來亂的"96F 09/29 13:27
→ : (′・ω・‵)丸子97F 09/29 13:28
推 : 奧覽較囂張沒落魄久98F 09/29 13:35
推 : 給AI太多權利,他真的給你亂搞啦99F 09/29 13:38
推 : 不可能沒限制的 限制多得很 只是他們不想100F 09/29 13:39
→ : 舉個例子 能不能用AI 生成兒色的圖 當然不行
→ : 因為AI公司知道這是死線 所以限制很多
→ : 但反觀AI毀滅人類就沒限制嗎? 很有趣wwwwwww
→ : 舉個例子 能不能用AI 生成兒色的圖 當然不行
→ : 因為AI公司知道這是死線 所以限制很多
→ : 但反觀AI毀滅人類就沒限制嗎? 很有趣wwwwwww
推 : 事實是發現研發進度不如預期,不敢發表104F 09/29 13:45
→ : 基本上有問題的不會發給媒體105F 09/29 13:48
→ : 這就是買免費新聞流量的
→ : 這就是買免費新聞流量的
→ : 天網?!107F 09/29 13:51
推 : AI放緩,就隨便找一個理由108F 09/29 14:00
推 : 做不出來(O)109F 09/29 14:05
→ : 上市一定不敢取消發布啦,假鬼假怪110F 09/29 14:09
→ : 股價下跌疑慮吧111F 09/29 14:10
推 : 好了啦你不推出 別人也會推出112F 09/29 14:14
推 : 新模型打不贏A就說資安問題?A這麼強都沒資安問題113F 09/29 14:39
→ : 好了啦114F 09/29 14:40
推 : 最強的AI怕被中國抄作業吧= =115F 09/29 15:48
推 : 全速衝刺!!!116F 09/29 15:52
--
※ 看板: Stock 文章推薦值: 0 目前人氣: 0 累積人氣: 26
回列表(←)
分享