[新聞] OpenAI新模型Astra曝!攻克10道數學難題、多AI代理協作挑戰AGI

看板Stock (股票)作者 (銀白色的沉思)時間1小時前 (2026/08/02 18:24), 編輯推噓12(1314)
留言18則, 15人參與, 9分鐘前最新討論串1/1
原文標題: OpenAI新模型Astra曝!攻克10道數學難題、多AI代理協作挑戰AGI 原文連結: https://reurl.cc/QNLxyq 發布時間: 2026-08-02 17:10 記者署名: 鉅亨網編譯 莊閔棻 原文內容: OpenAI 正在開發代號「Astra」的全新模型家族,主打多個人工智慧(AI)代理長時間協 同運作、共同解決高難度問題的能力。這項技術若順利問世,將是該公司邁向通用人工智 慧(AGI)的重要里程碑,同時也可能成為美國川普政府新版 AI 監管框架上路後,第一 批接受審查的產品。 根據《The Information》引述三名知情人士報導,OpenAI 執行長奧特曼(Sam Altman) 本週親自前往華盛頓特區,向政策制定者與監管官員展示 Astra 的實際運作。 簡報中特別強調該模型能調度多個智能體長時間分工合作,處理從專案管理到 高階數學證明等複雜任務。 與此同時,OpenAI 也發布一份報告,公布其最先進 AI 系統成功攻克十道長年 懸而未解的數學難題,範圍橫跨高維幾何、程式設計理論、群論、量子複雜性與極值組合 學等尖端領域。 這些問題各自懸置學界超過十年,而 OpenAI 僅耗費約兩千美元的運算成本便完成全部求 解。 今年一月加入 OpenAI 的研究員 Lijie Chen 在社群平台上證實,這十道題目的證明正是 出自旗艦模型 Astra 之手。 根據知情人士說法,Astra 將自成一個獨立的模型類別,與 OpenAI 現有的 Sol、Terra 、Luna 系列並列。 目前公司內部尚未拍板該模型上市時間,也還沒決定其命名方式,究竟會掛牌為外界期待 已久的 GPT-6,或僅作為 GPT-5 系列的子版本(如 GPT-5.7)發布,仍是未知數。 值得留意的是,儘管相關模型已進入測試階段,其公開發布腳步恐將受制於監管環境。知 情人士透露,Astra 很可能成為首批必須通過川普政府新版 AI 框架審查的產品。 依該框架規定,AI 業者須在模型正式對外發布前,先向聯邦政府提交備案。川普政府為 此設下的最後期限,正落在本週末。 依據 OpenAI 公布的內容,Astra 在數學與理論電腦科學領域一舉拿下十項重 大成果,包括高維球體堆積密度上限、二進制與球面碼界限提升、非純索菲群存在性證明 、康涅斯剛性猜想的推翻、算術電路複雜性新下界、量子平行重複定理、最近向量問題的 多項式因子近似難度證明、埃爾哈特體積猜想、多色拉姆齊數的超指數下界,以及極值數 猜想等極值數猜想等。 其中不少成果直接回應了已故數學家 Paul Erd 留下的經典開放問題。 在具體研究流程上,OpenAI 說明由 Astra 模型負責產出數學論證,人類研究人員則借助 同一模型協助整理論文草稿,最後再將論證轉換為 Lean 程式碼進行形式化驗證。 該公司特別強調,十項突破的數學論證全數由 AI 系統生成,人類研究者的角色僅限於協 助撰寫手稿、進行形式驗證,並對最終結果的正確性負責。 這並非 OpenAI 首度在數學領域交出成績單。今年五月,該公司在測試一款尚未發布的模 型時,已讓 AI 成功推翻了「單位距離問題」,隨後學術界也陸續發表相關後續研究。 隨著 AI 系統在科學研究中扮演的角色日益吃重,成果歸屬爭議也隨之浮上檯面。對此 OpenAI 表示,理解並尊重「萊頓人工智慧與數學宣言」(Leiden Manifesto on AI and mathematics)連署學者的疑慮,同時也強調,若將完全由 AI 生成的證明歸功於人 類,不僅扭曲了 AI 系統的實際貢獻,也模糊了人類智識工作本身的界線。 值得一提的是,OpenAI 近期同步推出面向學術界的 ChatGPT 專案,向十萬名科學家與數 學家開放免費使用其最強模型,並持續以開放性數學難題作為模型開發過程中的測試指標 。 心得/評論: 新模型攻克了十項數學難題! 雖然那些難題有寫出來而且都是中文 但是我一個都看不懂....... 有沒有數學大神可以解釋一下? 看樣子AI只會越來越聰明了, 連人類無法突破的東西都可以交給他了! 那...算力需求肯定是不夠用的吧? 各位數學超強的股神怎麼看? -- ※ 發信站: 批踢踢實業坊(ptt.cc), 來自: 180.177.56.226 (臺灣) ※ 文章網址: https://www.ptt.cc/bbs/Stock/M.1785666277.A.6A9.html

08/02 18:41, 1小時前 , 1F
乖乖當電池吧 (遠目
08/02 18:41, 1F

08/02 18:44, 1小時前 , 2F
就現有公式下去套用
08/02 18:44, 2F

08/02 18:46, 1小時前 , 3F
反觀gemini 3.5 pro還出不來
08/02 18:46, 3F

08/02 18:46, 1小時前 , 4F
什麼時候可以證明數論1+1
08/02 18:46, 4F

08/02 18:49, 1小時前 , 5F
這不意外啊 AI迭代進步太快了
08/02 18:49, 5F

08/02 18:51, 1小時前 , 6F
人類快下課了
08/02 18:51, 6F

08/02 18:55, 1小時前 , 7F
完啦人類等死
08/02 18:55, 7F

08/02 19:01, 1小時前 , 8F
To the moon
08/02 19:01, 8F

08/02 19:05, 58分鐘前 , 9F
這算是oa兩家的優勢了,中國開源都在卷coding能力
08/02 19:05, 9F

08/02 19:05, 58分鐘前 , 10F
複雜問題推理還沒看到實例
08/02 19:05, 10F

08/02 19:17, 46分鐘前 , 11F
要失業啦
08/02 19:17, 11F

08/02 19:24, 39分鐘前 , 12F
之前有看到中國那邊有數學教授說被AI開發公司出錢
08/02 19:24, 12F

08/02 19:25, 38分鐘前 , 13F
要求提供數學難題
08/02 19:25, 13F

08/02 19:34, 29分鐘前 , 14F
太好啦,快點取代人類,通通抓去做飼料
08/02 19:34, 14F

08/02 19:49, 14分鐘前 , 15F
有沒有一種可能是都堆這麼多算力了,算得出來不是
08/02 19:49, 15F

08/02 19:49, 14分鐘前 , 16F
理所當然嗎
08/02 19:49, 16F

08/02 19:52, 11分鐘前 , 17F
以前是連堆算力都算不出來
08/02 19:52, 17F

08/02 19:54, 9分鐘前 , 18F
兩千鎂的蒜粒有很多嗎?
08/02 19:54, 18F
文章代碼(AID): #1gRnhbQf (Stock)
文章代碼(AID): #1gRnhbQf (Stock)