Episode Details
Back to Episodes
OpenAI 新模型推進十個長年數學難題,六天後自家喊停這個模型的內部活動
Description
OpenAI 六天內為同一個模型發了兩篇公告。前一篇說它推進十個開放已久的數學難題,換算約兩千美元。後一篇轉談 AI 安全,說無法排除它跨過 Critical 網路能力門檻。
⭐ 文章深度讀:原文沒有回答的三件事
→ https://heymaibao.com/openai-ten-math-advances-six-days-later-pause/
⚡ 章節重點
開場 00:00
第一篇:十個問題,兩千美元 00:48
第二篇:六天後,同一個模型 03:01
我認為那段沒人說出口的話 05:49
原文沒有回答的三件事 07:54
對你來說呢 08:10
📝 懶人包
∙ 二〇二六年八月一日,OpenAI 發表十項數學與理論計算機科學結果,每一項都解決或大幅推進一個長年開放的問題,由 Astra 的內部版本產出。依原文說法,找出這些解答所需的 token 總量,依 Sol API 費率換算大約兩千美元
∙ 同一篇裡 OpenAI 主動說,把完全由 AI 系統生成的證明宣稱成人類作者的作品是誤導。數學論證由系統產生,公司做的是協助準備論文、在 Lean 這套證明檢查工具裡形式化,並為證明的正確性負責
∙ 六天後的八月七日,OpenAI 說對同一個 Astra 的內部評估顯示,它無法排除已達到 Preparedness Framework (OpenAI 自家的風險分級框架) 定義的 Critical 網路能力門檻,並暫停未達強化安控要求的內部活動
∙ 我的觀察是,讓模型自己推進數學前沿的那套能力,和讓 OpenAI 對它踩下煞車的那套能力,很可能是同一種東西指向不同的題目。順著這個看法往下走,還會掉出一個判斷 AI 能力宣稱的小工具
📚 參考資料
Ten advances in mathematics and theoretical computer science
→ https://openai.com/index/ten-advances-in-mathematics/
Responding to the next frontier of critical cyber capabilities
→ https://openai.com/index/responding-next-frontier-critical-cyber-capabilities/
openai/ten-proofs
→ https://github.com/openai/ten-proofs
OpenAI Preparedness Framework v2
→ https://cdn.openai.com/pdf/18a02b5d-6b67-4cec-ab64-68cdfbddebcd/preparedness-framework-v2.pdf