ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

深度 | Claude花2000美元刷九圈物理纪录,25位菲尔兹奖得主却联名说AI数学严重错位

深度 | Claude花2000美元刷九圈物理纪录,25位菲尔兹奖得主却联名说AI数学严重错位 Anthropic 的 Claude 完成六粒子九圈散射振幅推演成本只要 1000-2000 美元同一天包括陶哲轩在内的 25 位菲尔兹奖得主联名公开信说 AI 在数学中严重错位。我判断这两条新闻是同一枚硬币的两面一面是 AI 在人类已搭好框架的领域把「执行」做到极致另一面是数学家们惊恐地发现当「解题」成为衡量 AI 的标尺研究的理解、原创、脉络、归属正在被架空。上图这次突破的强项是「执行」弱项是「没有新原理」两者要分开看。这次计算强在哪也弱在哪先说清楚 Claude 做了什么。在平面 N4 超杨-米尔斯理论框架下算出六粒子散射过程的九圈量子修正刷新 2023 年 SLAC 物理学家 Lance Dixon 的八圈纪录。用 Claude Science 平台底层 Fable 5.1Python 加 SymPy两条路线——bootstrap 自举法和 form factor 法——结果一致。强在长程自主运行、自我纠错、软件工程执行连续数天不崩、两条路线交叉验证、把 300 亿项的符号运算跑完这已经超过绝大多数人类研究生的工程能力。弱在它用的是已知方法没提出新物理原理。Dixon 亲自核验坦言「之前认为九圈太难对 Claude 能完成感到意外」——而「意外」恰恰说明这是已知框架内的极限执行不是物理洞见的突破。成本 2000 美元是最该被记住的数字单次计算 1000-2000 美元这个数字被大多数人忽略了。过去这类前沿理论推导是顶级物理学家加大量算力加数月时间。现在 Claude 用 96 核 CPU 跑一周、花不到 2000 美元干完了。这意味着「前沿理论推导的单位成本」被拉低了几个数量级。这才是真正值得恐慌的地方——不是因为 AI 突然比人类聪明是因为它把「执行」的成本打到了地板。当一个研究方向的执行成本趋近于零游戏规则就变了比拼的不再是「谁能算出来」而是「谁能想出该算什么」。菲尔兹奖公开信数学家们在怕什么9 月 11 日25 位菲尔兹奖得主联名公开信《AI 在数学中的严重错位》点破核心担忧把「解决开放问题」作为衡量 AI 的主要指标会弱化数学研究的理解深度、思想原创性、学术脉络延续、成果归属。翻译成大白话数学家怕的不是 AI 太强是评价标准被 AI 带偏。数学研究的价值从来不只是解出一道题而是理解为什么这么解、这个解和其他数学的联系、谁贡献了什么。如果整个领域开始用「AI 能不能解题」当标尺这些更深层的价值就会被系统性边缘化。作为回应OpenAI 成立了 9 名数学家组成的独立咨询小组负责评估学术意义、协调发布节奏、制定学术规范。这个动作本身就是承认AI 公司的发论文节奏已经快到传统学术体系跟不上了。上图公开信的核心不是反 AI是怕评价标准被「解题能力」单一化。真正的冲突两种研究范式的碰撞AI 范式是已知方法加极限执行加低成本加 24 小时不眠不休Claude 干的是把人类已经想清楚的方法执行到人类执行不到的深度。人类范式是理解、原创、脉络、归属菲尔兹奖得主捍卫的是研究作为一种人类智识活动的完整性。冲突点在于AI 范式会稀释人类范式的稀缺性。当 Claude 花 2000 美元就能刷一个世界纪录那「刷纪录」就不再是顶尖物理学家的专属成就。这里有个微妙的平衡。中国团队的何颂组独立算出了九圈的 symbol 部分用了 GPT-6 辅助但框架自建。这个对照说明——真正有价值的是「搭建方法框架」那一步不是「执行计算」那一步。Claude 强在执行弱在框架何颂强在框架执行借了 AI。未来的分野就在这里。上图两种范式的碰撞真正的价值分野在「想该算什么」而非「谁能算出来」。我的判断这次突破的价值在工程不在物理。Claude 做的是软件工程、长程自主、自我纠错的极致展示不是物理洞见的突破——Dixon 说意外而不是震撼。它强在把一个已知方法连续跑几天、跑到人类没跑到的深度。这是真本事但和发现新物理是两码事别被「九圈世界纪录」的标题带偏。「1000-2000 美元」比「九圈」更该被记住。我原以为这种前沿推导至少要几十万美元算力结果是 96 核 CPU 跑一周、不到 2000 美元。这意味着理论推导的执行成本已经被打到地板接下来这个领域比拼的会是「谁能想出该算什么」而不是「谁能算出来」。我判断这会让「提出好问题」和「搭建方法框架」的价值被推到前所未有的高度——而这恰恰是公开信里说的「思想原创性」。公开信不是反 AI是反单一化评价。我原以为数学家会反对 AI 进入数学细读发现不是——他们反对的是把解题能力当唯一标尺。这个区分很重要。公开信的真实诉求是给 AI 时代的数学研究立一套不只看解题的评价体系。我判断OpenAI 的 9 人顾问组只是个开始接下来会有更多机构被迫成立类似机制而「AI 科研成果如何署名、如何归属、如何评价」会成为一个新的制度性议题。一句话Claude 九圈计算证明了 AI 能把已知方法的执行做到极致菲尔兹奖公开信则在追问执行之外研究的价值还剩什么这两条新闻合起来是 AI 冲击基础科学时最诚实的一次对质。每日更新。
返回列表