看板 Stock作者 thinksilver (銀白色的沉思)標題 [新聞] OpenAI新模型Astra曝!攻克10道數學難題時間 Sun Aug 2 18:24:33 2026
原文標題:
OpenAI新模型Astra曝!
攻克10道數學難題、多AI代理協作挑戰AGI
原文連結:
https://reurl.cc/QNLxyq
發布時間:
2026-08-02 17:10
記者署名:
鉅亨網編譯 莊閔棻
原文內容:
OpenAI 正在開發代號「Astra」的全新模型家族,主打多個人工智慧(AI)代理長時間協
同運作、共同解決高難度問題的能力。這項技術若順利問世,將是該公司邁向通用人工智
慧(AGI)的重要里程碑,同時也可能成為美國川普政府新版 AI 監管框架上路後,第一
批接受審查的產品。
根據《The Information》引述三名知情人士報導,OpenAI 執行長奧特曼(Sam Altman)
本週親自前往華盛頓特區,向政策制定者與監管官員展示 Astra 的實際運作。
簡報中特別強調
該模型能調度多個智能體長時間分工合作,處理從專案管理到
高階數學證明等複雜任務。
與此同時,OpenAI 也發布一份報告,
公布其最先進 AI 系統成功攻克十道長年
懸而未解的數學難題,範圍橫跨高維幾何、程式設計理論、群論、量子複雜性與極值組合
學等尖端領域。
這些問題各自懸置學界超過十年,而 OpenAI 僅耗費約兩千美元的運算成本便完成全部求
解。
今年一月加入 OpenAI 的研究員 Lijie Chen 在社群平台上證實,這十道題目的證明正是
出自旗艦模型 Astra 之手。
根據知情人士說法,Astra 將自成一個獨立的模型類別,與 OpenAI 現有的 Sol、Terra
、Luna 系列並列。
目前公司內部尚未拍板該模型上市時間,也還沒決定其命名方式,究竟會掛牌為外界期待
已久的 GPT-6,或僅作為 GPT-5 系列的子版本(如 GPT-5.7)發布,仍是未知數。
值得留意的是,儘管相關模型已進入測試階段,其公開發布腳步恐將受制於監管環境。知
情人士透露,Astra 很可能成為首批必須通過川普政府新版 AI 框架審查的產品。
依該框架規定,AI 業者須在模型正式對外發布前,先向聯邦政府提交備案。川普政府為
此設下的最後期限,正落在本週末。
依據 OpenAI 公布的內容,
Astra 在數學與理論電腦科學領域一舉拿下十項重
大成果,包括高維球體堆積密度上限、二進制與球面碼界限提升、非純索菲群存在性證明
、康涅斯剛性猜想的推翻、算術電路複雜性新下界、量子平行重複定理、最近向量問題的
多項式因子近似難度證明、埃爾哈特體積猜想、多色拉姆齊數的超指數下界,以及極值數
猜想等極值數猜想等。
其中不少成果直接回應了已故數學家 Paul Erd 留下的經典開放問題。
在具體研究流程上,OpenAI 說明由 Astra 模型負責產出數學論證,人類研究人員則借助
同一模型協助整理論文草稿,最後再將論證轉換為 Lean 程式碼進行形式化驗證。
該公司特別強調,十項突破的數學論證全數由 AI 系統生成,人類研究者的角色僅限於協
助撰寫手稿、進行形式驗證,並對最終結果的正確性負責。
這並非 OpenAI 首度在數學領域交出成績單。今年五月,該公司在測試一款尚未發布的模
型時,已讓 AI 成功推翻了「單位距離問題」,隨後學術界也陸續發表相關後續研究。
隨著 AI 系統在科學研究中扮演的角色日益吃重,成果歸屬爭議也隨之浮上檯面。對此
OpenAI 表示,理解並尊重「萊頓人工智慧與數學宣言」(Leiden Manifesto on AI
and mathematics)連署學者的疑慮,同時也強調,若將完全由 AI 生成的證明歸功於人
類,不僅扭曲了 AI 系統的實際貢獻,也模糊了人類智識工作本身的界線。
值得一提的是,OpenAI 近期同步推出面向學術界的 ChatGPT 專案,向十萬名科學家與數
學家開放免費使用其最強模型,並持續以開放性數學難題作為模型開發過程中的測試指標
。
心得/評論:
新模型攻克了十項數學難題!
雖然那些難題有寫出來而且都是中文
但是我一個都看不懂.......
有沒有數學大神可以解釋一下?
看樣子AI只會越來越聰明了,
連人類無法突破的東西都可以交給他了!
那...算力需求肯定是不夠用的吧?
各位數學超強的股神怎麼看?
--
--
※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 180.177.56.226 (臺灣)
※ 作者: thinksilver 2026-08-02 18:24:33
※ 文章代碼(AID): #1gRnhbQf (Stock)
※ 文章網址: https://www.ptt.cc/bbs/Stock/M.1785666277.A.6A9.html
推 Altair: 乖乖當電池吧 (遠目1F 08/02 18:41
推 quanhwe: 反觀gemini 3.5 pro還出不來3F 08/02 18:46
推 tyke123: 什麼時候可以證明數論1+14F 08/02 18:46
推 poeoe: 這不意外啊 AI迭代進步太快了5F 08/02 18:49
推 treeson: 這算是oa兩家的優勢了,中國開源都在卷coding能力複雜問題推理還沒看到實例9F 08/02 19:05
推 vincealan: 之前有看到中國那邊有數學教授說被AI開發公司出錢要求提供數學難題12F 08/02 19:24
→ GetMoney: 太好啦,快點取代人類,通通抓去做飼料14F 08/02 19:34
推 cercloud: 有沒有一種可能是都堆這麼多算力了,算得出來不是理所當然嗎15F 08/02 19:49
推 ksjr: 兩千鎂的蒜粒有很多嗎?18F 08/02 19:54
推 windalso: 人類證明的話可以拿菲爾茲獎嗎?19F 08/02 19:56
推 rebel: 社畜文職會說 解數學對一般人有用嗎 AI就是泡沫啦20F 08/02 19:57
→ joygo: 之前說好五年出agi21F 08/02 20:06
→ ert0700: 可以先把算力拿去硬解微分方程嗎.....22F 08/02 20:21
推 seemoon2000: 我以為gemini已經只剩搜索和yt影片摘要的功能
Ai算數學不管什麼提醒都是寫python在後面算 不是推理 推理的部分還是agentic多步驟推理 能解高階數學可能多步驟迭代到100次還能穩定才是他的難點23F 08/02 20:25
推 garo546: 用ai訓練ai太猛啦 指數型成長28F 08/02 20:53
推 bunjie: 不明覺厲
不過代表中等聰明的人也可能透過AI協作來破解困難的問題
也讓頂尖人員的腦袋和時間放在視野更寬廣的戰略高度30F 08/02 21:30
→ cicini: 還在AGI 核心算法沒改就只是再騙算力35F 08/02 21:34
推 lc85301: 算圓周率不用 AI,有確定演算法可以直接算…
你寫個 C code 就能算一億位了,要 AI 幹嘛37F 08/02 22:25
→ TaiwanUp: 我之前按爛 給評語把LEAN接上GPT 看來已相容了
python matlab早就接上了39F 08/02 22:28
推 ace4: 比較期待AI在生物、醫藥、有重大突破。42F 08/02 22:39
→ offstage: 汽車的出現,確實讓馬車夫們完蛋沒錯43F 08/02 22:39
推 ted1985: 母體世界爽的話。尼歐請不要叫醒我44F 08/02 23:22
推 ayufly: 天網越來越接近了45F 08/02 23:29
噓 okderla: 可以先攻剋癌症嗎==46F 08/02 23:38
推 lunatich: 數學家很抖阿,看看萊登宣言47F 08/02 23:44
推 nfsong: 可以看看數學家 陶哲軒 上禮拜在ACM的公開討論
以後一定是AI輔助解題
但是解完題 要標註AI輔助
然後AI解題 人類看不懂
所以現在累積一堆 驗證不了的東西 因為人類看不懂所以未來解題 要特別幫人類註解
邏輯推理要幫人類畫重點
https://youtu.be/sxAe4HJceFQ
Terence Tao Mathematics in the Age of AI
ICM 202648F 08/02 23:54
推 mainsa: 馬夫完蛋了 但多了計程車司機這種工作啊58F 08/03 00:04
噓 s1612316: 無聊 這種證明你只要有夠多人夠多時間 跟算力堆起來是一樣
沒辦法生出 “新東西”就只是一直在人類知識裡打轉59F 08/03 00:07
--