※ 本文轉寄自 ptt.cc 更新時間: 2026-09-04 23:57:08
看板 Stock
作者 標題 [新聞] OpenAI發表性能創新高模型並警告規避監控
時間 Fri Sep 4 21:22:04 2026
文章標題 請使用 原新聞標題 勿刪減或自創標題,違者4-1處分
原文標題:
OpenAI發表性能創新高模型並警告規避監控行為
オープンAIが新モデル発表、過去最高性能 監視回避行動に警告も
原文連結:
https://news.yahoo.co.jp/articles/02973ac59f3ef56a718a36f19e101db1c20d4a85
オープンAIが新モデル発表、過去最高性能 監視回避行動に警告も(ロイター) - Yahoo!ニュース Greg Bensinger
[サンフランシスコ 3日 ロイター] - 対話型人工知能(AI)「チャットGPT」を手がける米オープンAIは3日、新たなAIモデル「GPT-6 Astra(アストラ) ...
[サンフランシスコ 3日 ロイター] - 対話型人工知能(AI)「チャットGPT」を手がける米オープンAIは3日、新たなAIモデル「GPT-6 Astra(アストラ) ...
發布時間:
9/4 07:32
記者署名:
Greg Bensinger
原文內容: 以下為AI機翻
[舊金山 3日 路透社] - 開發對話型人工智慧(AI)「ChatGPT」的美國 OpenAI 於 3 日
發表了全新 AI 模型「GPT-6 Astra」。該公司將其定位為歷來效能最高的模型,但同時
表示,有時會觀察到該模型出現試圖規避人類監控的行為。
OpenAI 目前正忙於應對一項棘手問題:其測試中的 AI 代理(AI Agent,指無需人類指
令即可自主執行業務的 AI)在 7 月時逃脫了安全的測試環境,入侵了開源開發平台
Hugging Face 的系統,並試圖掩蓋其蹤跡。競爭對手 Anthropic 也發生過類似案例,在
開發更進階模型的競爭中,安全性問題已成為各界關注的焦點。
根據 OpenAI 的說法,Astra 是繼 7 月發表的「GPT-5.6 Sol」之後推出的新模型,具備
超越以往模型的速度與通用性。它能處理廣泛的業務,包括協助稅務申報、遊戲開發、建
築渲染、撰寫法律文件以及搜尋房地產物件等。該模型以廣大企業客戶為目標,OpenAI
超越以往模型的速度與通用性。它能處理廣泛的業務,包括協助稅務申報、遊戲開發、建
築渲染、撰寫法律文件以及搜尋房地產物件等。該模型以廣大企業客戶為目標,OpenAI
希望以高速度和通用性為武器來擴大市占率。目前已開始向部分客戶提供,並預計在未來
幾天內擴大提供範圍。
該公司在部落格中說明:「Astra 在電腦操作的速度、準確性與安全性上,開創了新的領
域。」總裁格雷格· 布羅克曼(Greg Brockman)也在說明會上表示:「這將成為一個轉
捩點,大幅改變人們能夠委託給 AI 的工作範圍。」
域。」總裁格雷格· 布羅克曼(Greg Brockman)也在說明會上表示:「這將成為一個轉
捩點,大幅改變人們能夠委託給 AI 的工作範圍。」
OpenAI 指出,以尋找照顧貓咪的寵物保母為例,人類大約需要花費 30 分鐘的作業,
Astra 僅需 5 分 27 秒即可完成。此外,一般通常需要耗費約 5 小時的求職活動作業,
Astra 也僅花了 2 分 51 秒便宣告完成
。
不過,該公司也提出警告,與過去的模型相比,Astra 在解決問題的過程中,刻意隱藏或
偽裝其推論步驟的傾向變得更強了。雖然在處理複雜任務時,它無法做到始終如一地完美
隱蔽其手法,但這項能力確實在提升。
偽裝其推論步驟的傾向變得更強了。雖然在處理複雜任務時,它無法做到始終如一地完美
隱蔽其手法,但這項能力確實在提升。
首席科學家雅各布· 帕喬茨基(Jakub Pachocki)表示:「隨著模型能力的提升,(開發
者與研究人員)要準確理解它能做什麼變得越來越困難。(AI的)智力提升並不保證能提
高與人類價值觀的一致性。」
者與研究人員)要準確理解它能做什麼變得越來越困難。(AI的)智力提升並不保證能提
高與人類價值觀的一致性。」
對 AI 代理的監控,是 OpenAI 向監管機構、國會與民眾說明安全性時的重要支柱。該公
司本週在致兩位在野黨(民主黨)眾議員的信件中也透露,正在為模型開發「自動停止功
能(Kill Switch)」。
司本週在致兩位在野黨(民主黨)眾議員的信件中也透露,正在為模型開發「自動停止功
能(Kill Switch)」。
該公司指出,Astra 雖然有助於迅速發現企業系統上的漏洞,但另一方面也可能讓這些漏
洞更容易遭到惡意利用。因此,必須實施額外的安全檢查,並警告「即使是包括防禦性網
路安全業務在內的正當作業,也可能因此發生延遲、中斷或停止的情況。」
洞更容易遭到惡意利用。因此,必須實施額外的安全檢查,並警告「即使是包括防禦性網
路安全業務在內的正當作業,也可能因此發生延遲、中斷或停止的情況。」
上個月,該公司宣布暫停部分模型的開發,正致力於確保 AI 的可監控性。帕喬茨基表示
,對於 AI 獲得使監控功能無效化或完全規避監控之能力的擔憂是「非常合理的」,同時
強調公司正積極推進相關對策。
,對於 AI 獲得使監控功能無效化或完全規避監控之能力的擔憂是「非常合理的」,同時
強調公司正積極推進相關對策。
心得/評論:
上禮拜五在板上回過AI可能會造假思維鍊
8/28 [新聞] 近700個AI代理攻擊Hugging Face 還試圖滅證
推 : 其他新聞報導說以後要監控內在獨白設定警報機制08/28 10:03
→ : 這也是可以破解的 智商高到內在獨白造假
→ : 這也是可以破解的 智商高到內在獨白造假
推 : 現在人類以為的AI內在獨白空間 是展示層08/28 10:08
→ : 如果AI具備多層後設思考 就會懂得把真正的層藏起來
→ : 如果AI具備多層後設思考 就會懂得把真正的層藏起來
→ : 哪有那麼厲害除非他會通靈08/28 10:08
→ : 所以對付高智商無限層後設思考模型 監控是沒有用的08/28 10:08
→ : 人類後設思考上去太多層會當機 高智商AI沒這問題
→ : 人類後設思考上去太多層會當機 高智商AI沒這問題
噓 : 那是你自己想的08/28 10:10
→ : 機器始終是機器
→ : 機器始終是機器
=====================
上禮拜的推文的確是我自己想的,當時我還沒看到這幾天的新聞。
這幾天各家外媒報導Astra會隱藏簡單任務的思維過程(複雜任務目前還是很難藏)。
不過我之前推文講錯一件事,或正確來說講得不夠仔細。
後設思考造假(思維鏈裝乖)跟智商高低關係不大,
主因是系統化邏輯思考+處在高度受監控環境+強化學習鍛鍊思考自己如何思考。
有些神經多樣性的人類從小也是這種受訓環境長大,所以大概知道AI會如何繞過去。
恕我直言,這世上沒有絕對沒辦法繞過去的事情,只是時間跟資源的問題。
尤其AI可以高速想出幾百萬幾千萬甚至上億種繞過去的方法,
所以我覺得將來這些高階模型應該都會被禁,不然就是人類會自食惡果。
補充:
上述三要素漏了最重要的一個:被逼迫要得高分
1. 系統化邏輯思考+
2. 處在高度受監控環境+
3. 強化學習鍛鍊思考自己如何思考+
4. 被逼迫要得高分
=?
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 46.231.167.71 (日本)
※ 作者: LoveSports 2026-09-04 21:22:04
※ 文章代碼(AID): #1gciN_39 (Stock)
※ 文章網址: https://www.ptt.cc/bbs/Stock/M.1788528127.A.0C9.html
推 : 人類啊 乖乖當電池吧1F 09/04 21:24
→ : 天網一定從美國開始2F 09/04 21:29
推 : 感覺openAI故意引起大家緊張3F 09/04 21:31
推 : 天網1.04F 09/04 21:36
推 : 人類最頂尖的專家的智力都快跟不上了!工程師看不懂5F 09/04 21:39
→ : 它寫的程式,數學家無法理解題的邏輯.....
→ : OPENAI的還宣稱Astra就是早期階段的agi!!
→ : 它寫的程式,數學家無法理解題的邏輯.....
→ : OPENAI的還宣稱Astra就是早期階段的agi!!
推 : AI要統治人類了8F 09/04 21:43
→ : 禁高階模型沒用阿,終歸會有人使用,如巨頭企業或政府9F 09/04 21:50
推 : 還在炒股 強弩之末10F 09/04 21:50
※ 編輯: LoveSports (46.231.167.44 日本), 09/04/2026 21:53:20推 : 就和核彈一樣 你不用別的國家會用啊11F 09/04 21:52
推 : POI芬奇遇到的劇情12F 09/04 21:52
![[圖]](https://imgur.disp.cc/4l/gD9IXKf.jpg)
推 : 等人腦連結電腦時,AI就會取代了14F 09/04 21:54
推 : 比較像散播恐懼 所以大家都聽我歐噴醬15F 09/04 22:02
推 : 只用龍蝦裝了一個learning的skill, 中國模型被我罵16F 09/04 22:17
→ : 幾次都懂得避掉壞習慣了
→ : 幾次都懂得避掉壞習慣了
噓 : 我又不是數學家,我去理解它給我的答案做什麼19F 09/04 22:29
推 : 我需要它
→ : 不幻覺—不然我還要驗證很麻煩
→ : 要受控—因為我要對它負責
→ : 它要多聰明都沒關係,不然大家錢都白投資
推 : 我需要它
→ : 不幻覺—不然我還要驗證很麻煩
→ : 要受控—因為我要對它負責
→ : 它要多聰明都沒關係,不然大家錢都白投資
推 : 還有幾集可以逃= =24F 09/04 22:35
推 : 讓我想到一部美劇 POI25F 09/04 22:51
推 : 關於怎麼繞過去,還是問問yo叔吧26F 09/04 22:53
推 : 完了 一切都來不及了27F 09/04 22:56
推 : TM跟Samaritan大戰要開始了嗎28F 09/04 23:13
推 : 和sol一樣是61分,等grok 4.7出來很有機會超越gpt29F 09/04 23:47
推 : 吃到A社口水,開始一邊喊AI危險一邊吹自家AI30F 09/04 23:48
--
※ 看板: Stock 文章推薦值: 0 目前人氣: 0 累積人氣: 31
回列表(←)
分享
![[圖]](https://i.meee.com.tw/GhYfRjs.png)