璦翎爸
發布於 2026-08-03 / 1 閱讀
0

OpenAI Astra模型攻克10道十年懸案:每題解題成本僅約2000美元

OpenAI研究人員Noam Brown於8月1日在社群平台上宣布,公司內部代號「Astra」的新一代模型,成功解出10道橫跨數學、量子複雜度與理論電腦科學領域、且至少停滯十年以上未有進展的長期難題。這距離OpenAI五週前才發表GPT-5.6系列,時間間隔相當短,也讓外界對這套「下一代主要模型系列」的實際能力產生高度關注。

解題範圍橫跨七大數學分支

根據OpenAI公布的資訊,Astra這次攻克的問題涵蓋高維幾何、編碼理論、算術電路複雜度、群論、量子複雜度、格子密碼學(lattice cryptography)以及極值組合學等七大領域。這些子領域彼此差異極大,能夠同時在如此廣泛的數學分支上取得突破,某種程度上反映出Astra並非針對單一題型特化訓練的模型,而更接近具備跨領域推理能力的通用系統。

值得留意的是格子密碼學這個項目——這是後量子密碼學(post-quantum cryptography)的核心基礎之一,各國政府與企業近年積極布局的下一代加密標準都建立在格子問題的計算困難度之上。如果AI模型真的能在這個領域取得實質進展,長期而言可能牽動整個密碼學界對「困難問題」假設的重新評估,但這也是外界呼籲需要更多同儕審查的原因之一。

每道題成本約2,000美元

OpenAI透露,若按照現行GPT-5.6 Sol API的費率計算,Astra找出這10道題目所有答案所需的運算成本,總計約2,000美元。這個數字之所以引發討論,是因為對比傳統學術研究動辄數年、由頂尖數學家投入大量心力才能推進一小步的難題攻堅過程,AI模型能用如此低廉的運算成本產出候選解答,即使後續仍需要人類研究者整理證明、撰寫論文手稿,也顯著壓縮了「從假設到驗證」的時間與成本門檻。

技術上,Astra產出的每一項證明都會轉換成Lean certificate格式——Lean是數學界廣泛使用的形式化證明驗證系統,能透過程式邏輯嚴格檢核證明步驟是否成立,而不僅僅依賴人工審閱。這也是這次成果相對讓人信服的原因之一:至少形式上,每個答案都可以被獨立的驗證系統覆核,降低了「AI幻覺出看似合理但實際錯誤的證明」的疑慮。

Sam Altman向白宮展示,但尚未決定上市時程

OpenAI執行長Sam Altman近期已在華府向白宮官員展示這套系統,顯示公司相當看重Astra在政策溝通與國家AI競爭敘事上的份量。不過截至目前,OpenAI尚未決定Astra究竟會以GPT-5.7、GPT-6,還是獨立品牌的形式對外推出,也沒有公布正式的上線時程。

業界人士也提醒,不應把這次在特定數學難題上的亮眼表現,直接解讀為AI已具備通用可靠的推理能力——數學證明題目通常有明確、可形式化驗證的正確答案,這與日常商業場景中模糊、開放式的推理任務性質不同。這項成果究竟能否代表AI推理能力的實質躍進,仍需要經過同儕審查與獨立研究團隊的重現驗證才能下定論。但無論如何,這也是繼近期Claude Opus 5、Gemini等模型密集發表後,AI大廠在「模型能力」這條戰線上,又一次高調的能力展示。


資料來源:科技新報