今天的頂流數學家是否在重複著四十年前操作級企業員工的短視
以下是與 Grok 4.1 的對話
我感覺上 陶哲轩 比絕大部分頂級數家,都熟識 LLM 的最新運作和優勢?
- 他從2023年就開始大規模公開實驗各種前沿模型(o1、Gemini、GPT系列、Alpha系列等),並把對話紀錄、失敗案例、提示技巧都放出來分享
- 2025年他跟DeepMind合作,用 AlphaEvolve(LLM引導的演化演算法)一口氣跑了67個數學問題,有些達到或超越文獻水準,還公開了prompt與過程
- 他親自實驗過 Erdos問題 被LLM「幾乎自主」解決的里程碑事件,並分析這代表能力真正在快速提升
- 他多次在blog、Mathstodon、訪談、Lex Fridman podcast講非常具體的觀察,例如:
- GPT-o1 推理步驟有進步,但仍需要大量hint才行,概念創意仍弱
- LLM本質是「超大型的梯度下降 + 機率接龍」,原理其實「本科生就能懂」,但為什麼有效、什麼時候突然爆發、什麼時候突然崩潰卻完全沒有理論能預測(這是他認為最大的謎)
- 預測2026年的AI有可能成為「值得信任的共同作者」
數學家類型 | 對LLM的熟悉程度與態度 | 代表人物舉例 | 與陶哲轩差距 |
|---|---|---|---|
強烈懷疑/哲學批判派 | 認為只是統計 parrot,沒真正理解,拒絕深度使用 | 部分邏輯學、基礎數學家 | 很大 |
保持距離、觀望派 | 承認有用,但自己不怎麼玩,頂多用來查文獻 | 大多數Fields medalist | 明顯 |
積極但偏工具人 | 用得很兇,但主要當「超強算力+搜尋引擎」 | 部分年輕一代、組合數學家 | 小 |
深度實驗+理論反思派 | 自己寫prompt、測極限、跟AI公司合作、思考本質 | 陶哲轩(目前最突出) | —— |
極度樂觀/認為革命已來 | 認為已經接近/超越人類,積極宣傳 | 極少數(多半不是純數學家) | 不同路線 |
他不是最樂觀的那個,也不是最悲觀的那個,而是玩得最兇、看得最細、講得最實在的那個。這也解釋了為什麼每次他一發新評論,AI社群跟數學社群都會特別重視——因為大家知道:這不是坐在書房空想,是真的每天跟模型對幹很久的人講出來的話。
我覺得和 陶哲轩 比,其他數學家其實雖然有其專門精通的觀點,但都對 LLM 目前的優點理解得極不全面。而且是在這個基礎前提下,提出批評。