竟被两名高中生用AI攻破了-全网震撼!菲奖得主未解难题 (竟被两名高中)

竟被两名生用AI攻破了全网震撼菲奖得主未解

新智元报道

竟被两名生用AI攻破了全网震撼菲奖得主未解

你敢信?

人没上大学,研究已经接上了「菲尔兹奖得主」的工作了。

竟被两名生用AI攻破了全网震撼菲奖得主未解

就在今天,UCLA数学圈传出了一条让所有人震惊的消息——

两名高中生Aayush Bathija和Prince Rohatgi,在博士后的辅导下,解决了一个数学家许埈珥(June Huh)从未攻克的难题。

更抓人眼球的是,这项证明,是在AI重度辅助下完成的!

一个是Claude Opus 5,另一个GPT-5.6 Sol。

竟被两名生用AI攻破了全网震撼菲奖得主未解

目前,题为《洛伦兹多项式的有界比》论文已在arXiv发表,长达75页。

竟被两名生用AI攻破了全网震撼菲奖得主未解

论文:

两名高中生加一名博士后的名字,就写在作者栏里。

竟被两名生用AI攻破了全网震撼菲奖得主未解

高中生指导者,UCLA 博士后 Daniel Soskin

那么,在这项研究中,他们到底解了什么题?

要厘清这一点,首先还得从菲尔兹奖得主许埈珥的工作讲起。

他们解出的,究竟是什么?

许埈珥是韩国人,于2022年获得菲尔兹奖。

他的经历也相当传奇,高中辍学做诗人,后面才转到纯数学科研,39岁压线拿到了菲尔兹奖(菲尔兹奖只奖励给40周岁以下的年轻人)。

竟被两名生用AI攻破了全网震撼菲奖得主未解

2020年,他与合作者建立的「洛伦兹多项式」(Lorentzian多项式)理论,正是其重要代表工作之一。

名字有点陌生,但「多项式」,大家中学时就见过。每一项前面的数字,就是系数。

「洛伦兹多项式」的特殊之处在于, 这些系数之间存在严格的数学约束,不能随意搭配。

这套理论把组合数学中的问题,与几何、系数之间的不等式联系了起来。

而这次研究追问的,正是这些约束究竟有多强。

比如,把一些系数相乘,再除以另一些系数,就能得到一个比值。

只要多项式满足规定条件,这个比值是否就有一道永远突破不了的「天花板」?

竟被两名生用AI攻破了全网震撼菲奖得主未解

高数中经典的 Hessian 矩阵的定义,你还记得嘛?

算出某一组系数的比值,并不难。真正难的是:面对无穷多种符合条件的多项式,判断哪些比值始终有上限,哪些可以无限增大。

如果有上限,还要继续追问: 这个上限究竟能压到多低,才是最精确的答案?

此前,许埈珥与合作者已经在 二次洛伦兹多项式 中,刻画了哪些比值有上限,并在三个变量的情况下求出了最优上界。

但这条路,还没有走完。

从二次升到三次、四次,乃至任意次数,原来的规律还管用吗?

次数越高,系数之间的关系越复杂。二次情形下成立的结论,不能直接搬过去。

这就是两名高中生,此次研究切入的缺口——

把关于系数比值的研究推进到更高次数,弄清哪些比值始终有界,并进一步寻找最精确的上限。

竟被两名生用AI攻破了全网震撼菲奖得主未解

论文最核心的公式「主结构定理」,把此前二次洛伦兹多项式的相关结论推广到了任意次数。它说明了一个系数比值有没有统一上界,可以用一套离散凸性条件来完整判定。

读到这里,你只需要记住一个问题: 这些受约束的系数,能把比值推到多高?

下面,我们用一个简单的例子,把这道「天花板」讲清楚。

洛伦兹多项式:系数之间有「平衡约束」

先看一个多项式:

竟被两名生用AI攻破了全网震撼菲奖得主未解

这里 a,b,c 都是正数。把中间项写成 2b,是为了让后面的关系更简洁。

在这个最简单的情形中,它是洛伦兹多项式,恰好要求:

竟被两名生用AI攻破了全网震撼菲奖得主未解

也就是说: 两端的系数都很大,中间的系数就不能太小。 这是洛伦兹结构所体现的对数凹性质的一个入门例子。

例如,a=4、c=9,就必须有 b>=6。你不能随意把 b 改成 1,还指望它留在这个多项式族里。

当变量更多、次数更高时,这种约束会变复杂,需要各种求导结果共同满足特定条件。正式定义涉及一个描述曲率的矩阵,它在严格情形下具有「一个正、其余负」的特征值结构, 「洛伦兹」这个名字就对应这种正负结构 。不过,只记住「系数受到一整套相互关联的约束」,就足够理解本文主线。

把刚才的不等式变形一下:

竟被两名生用AI攻破了全网震撼菲奖得主未解

这就叫一个 「有界比值」 :无论怎样选择符合条件的系数,这个比值都越不过 1。

但倒过来:

就没有统一上限。

比如固定 a=c=1,让 b 不断增大,仍然满足洛伦兹条件,倒过来的比值却可以任意大。

于是,自然会问:

面对更复杂的多项式,把不同系数相乘、相除,究竟哪些组合有上限,哪些没有?

这篇论文就是要系统回答这个问题,而前面的二次例子属于已有的基础情形。

两个高中生联手AI,破解了

写下这篇论文的两位学生Aayush Bathija和Prince Rohatgi,都来自加州橡树公园高中(Oak PARK High School)。

他们同时是UCLA Olga Radko数学圈(ORMC)的成员。

Aayush在读高二,是AIME资格获得者。Prince目前高三,同样进过AIME,还在数学圈里担任AMC 10/12(相当于高一)竞赛课的主讲老师。

搁在以往,一个高中生想要摸到「菲奖级」领域,至少需要5-8年大学与博士训练。

但这一次,在UCLA数学系博士后Daniel Soskin指导下,他们直接联手AI打了一场漂亮的闪电战。

竟被两名生用AI攻破了全网震撼菲奖得主未解

他们解题的核心,是把AI与形式化计算工具深度嵌入到数学发现的核心工作流中。

整体的证明核心思路,可以理解成: 检查一个比例是否可能失控,先研究它在极端情况下怎么变化。

把复杂数值,变成简单指数

设 t 越来越接近 0,三个系数分别取:

竟被两名生用AI攻破了全网震撼菲奖得主未解

那么:

竟被两名生用AI攻破了全网震撼菲奖得主未解

倒过来就是 t-4,会趋向无穷大。

这里最有用的一点是: 乘除法变成了指数的加减法。指数的正负,直接告诉我们比例会缩小还是爆涨。

这种提取「主导幂次」的思路,与论文使用的 「热带化」方法 有关。已有的洛伦兹多项式理论告诉我们:合法的幂次图案受到一种叫 M-凸性 的离散凸性规则控制

可以把它理解成「哪些变化速度能够同时出现」的数学规则。

论文的关键步骤是证明: 一个比值只要能够无限增大,就能找到一条具有这种幂次特征的路径,把失控暴露出来。

因而,对这些路径的检查可以升级为完整判据。证明中用到了半代数几何的曲线选择等工具。

而到这里也别忘了,所有这一切高深的说法,都是两个高中生借助AI搞定的。

Claude和ChatGPT,参与「证明思路」

论文致谢中,作者直接摊牌——

Claude Opus 5和GPT-5.6 Sol,是这一次证明的核心工具。

竟被两名生用AI攻破了全网震撼菲奖得主未解

它们被用于 计算、证明思路和编辑辅助 。其中,「证明思路」尤其关键。

这意味着模型的用途已经深入研究探索:面对一个尚待解决的问题,寻找可能成立的推导路径。

不过,作者也明确写下了另一面: 部分建议有帮助,另一些则具有误导性。

他们表示,已独立核验全部计算,并对论文内容承担责任。

这几句话,勾勒出了此次合作的实际边界:AI可以提供思路,研究者需要筛选、推敲,并把有价值的线索变成经得起检查的论证。

模型给出一个看起来漂亮的答案,研究并未结束。条件是否齐全、推导是否成立、边界情况是否遗漏,都要继续追问。

AI进入了探索环节,严格验证依然是成果成立的前提。

博士后导师和ORMC研究项目的支持,也因此格外重要。两名学生得以接触真实的开放问题,并在专业指导下开展研究。AI则被嵌入这套协作之中,辅助计算与思路探索。

菲尔兹奖得主集体喊停

却停不下来了

戏剧性的是,就在这项研究公布的前一天,数学界刚掀起了一场轩然大波。

全球25位菲尔兹奖得主联合签署公开信,发出最强警告,「AI正在摧毁数学本身」!

竟被两名生用AI攻破了全网震撼菲奖得主未解

许埈珥本人,也是签署人之一。

竟被两名生用AI攻破了全网震撼菲奖得主未解

部分名单

未曾想到,两个高中生用AI辅助,在许埈珥自己的研究方向上做出了成果。

25位菲尔兹奖担心的是,纯数学研究的严密性、科研的纯粹性,可能被算力算法正在碾碎。

但Aayush和Prince的故事,给出了另一面——

AI把研究门槛降下之后,被释放出来的不只是「解题速度」,还有更多人的入场资格。

一个AIME资格的高中生,在博士后指导下,用AI辅助,碰到了菲尔兹奖得主没走完的路。

这在五年前,几乎不可能。

数学前沿,不再只属于那些熬了十几年才走到门口的人。

至于这是好事还是坏事,数学共同体还得吵很久。但门,已经被推开了一条缝。

参考资料:

编辑:桃子 马可


首次击败人类数学天才,高中生最难数学考试被deepmind AI攻克了

Google DeepMind 开发的 AlphaGeometry2 首次超越 IMO 平均金牌得主水平,攻克了被视为高中生最难数学考试的国际数学奥林匹克竞赛(IMO)中的几何难题。

一、AlphaGeometry2 的突破性表现 图|AG2 与 AG1 的训练数据分布对比(a-c):a. 问题复杂度提升;b. 问题类型分布更均衡;c. 辅助点证明比例优化 二、AG2 的技术改进与能力扩展 图|搜索算法概览:通过知识共享机制结合多个搜索树,共享已证明的推理 三、当前局限性与未来方向 四、对 AI 发展的启示

伦敦帝国理工学院数学家 Kevin Buzzard 评价:“计算机不久后或能在 IMO 竞赛中拿满分。 ” AlphaGeometry2 的突破标志着 AI 在数学推理领域迈出重要一步,也为未来 AI 技术的发展提供了新的方向。

全球数学竞赛,Ai全军覆没!Ai神话终结?

AI在本次全球数学竞赛中表现不佳,确实反映出其在数学领域与人类高手存在显著差距,但并不能因此断言AI神话终结或AI永远无法在数学上战胜人类。 以下从多个角度分析这一现象及其背后的原因:

一、AI在数学竞赛中的具体表现 二、AI在围棋与数学领域表现差异的原因 三、对AI发展现状的理性看待 四、哲学层面的思考:AI能否在数学上战胜人类? 五、结论

AI在数学竞赛中的失利并非神话终结,而是揭示了其当前的技术边界。 数学作为人类智慧的结晶,既包含可被算法模拟的部分(如计算),也包含需直觉和创造力的领域(如证明)。 未来AI可能在特定数学任务中接近或超越人类,但全面战胜人类高手仍需突破理论瓶颈。 更合理的展望是:AI与人类将共同推动数学进步,而非形成零和博弈。

高三党暴击DeepSeek!超难压轴题人机大战结果离谱!AI竟输在这步……

DeepSeek在挑战一道高三圆锥曲线压轴题时失败,最终结论错误,且在计算一般式时超时罢工,正确答案为直线QT过定点(0,-2)。以下是对此事件的详细分析:

题目特点与挑战 DeepSeek解题情况 正确答案与人类解题优势 对AI解题的理性看待
本文地址: https://h89.5slw.cn/article/3061.html
洋芋田

该站点未添加描述description...

科技--人民网

人民网科技频道以航天、生物、生命科学等多专业学科为主要报道对象,关注中国自主创新进程和世界科技发展,集科普性和专业性于一体,频道下设航天科技、生命科学、学界动态、科技产业、评论等十余个栏目;品牌栏目“科技会客厅”访谈邀请众多重量级嘉宾及时解读热点事件,为网友答疑解惑。

会计之星

该站点未添加描述description...

至和网图库 - 海量免费三维图纸模型下载 | 机械CAD图纸 | 夹具模具设计 | 建筑图纸资源库

至和网提供海量免费三维图纸模型、机械CAD图纸、夹具模具设计图纸、建筑图纸等资源下载。面向工程师提供设计工具、设计方案及技术资源在线使用,助力工业设计效率提升。

速发卡-高端自动发卡平台

发卡网,云寄售,专注数字产品虚拟电商行业,专业提供虚拟卡券、数字权益等虚拟产品销售系统开发,及传统企业数字化转型新零售电商系统、社交电商、知识付费等解决方案,充分将公域流量转为私域流量,帮助企业快速积累用户并实现精准营销,专业技术团队,提供品牌定制服务,满足您的个性化需求,私有化部署并可提供源代码交付。

创建在线

该站点未添加描述description...

万彩办公大师官网-免费的办公工具百宝箱OfficeBox,绿色无广告无捆绑

万彩办公大师,绿色免费的办公小工具合集,包括PDF工具集;文档/音视频/图片转换工具集;OCR识别工具集;录屏工具集;图片处理工具集;文件处理工具集.绿色安全无广告无捆绑.

广视AI榜 大屏之家 深圳广视技术信息有限公司

广视AI榜/大屏之家由深圳市广视技术信息有限公司于2020年建立。经过多年深耕,我们从关注屏幕交互的网站发展为一个关注科技、商业、汽车、生活的新媒体,并启动“广视AI榜”媒体号,通过每天一手全球AI应用新闻、AI落地应用分享与AI应用热评,助力各行业实现AI应用落地,与时俱进,助力各行业发展。我们在多个平台拥有新媒体账号,重点运营知乎、头条、微博、百度、B站、抖音、雪球新媒体平台。拥有多个直播号,参与主流品牌发布会视频直播。内容团队来自CPU/GPU原厂、主流科技媒体以及AI商用方案公司。本公司拥有多个AI相关注册商标:aigcsolution、AIRANKINGS等。

地质网论坛(dzw6.com)-地质交流论坛|地质工作者社区|地质网论坛

地质网论坛是地质工作者社区,每日更新地质行业会议培训通知、招聘岗位大全,分享工程地质、GIS工具、软件系统等实用资源,助力地质从业者交流成长。

cnfont.cn

该站点未添加描述description...

南京业茂财税

南京业茂财税拥有专业而强大的服务团队并始终恪守独立、客观、公正、保密的原则,以服务高于一切、责任重于泰山为经营理念,全心全意为客户提供高质量的服务。

北京科技大学

该站点未添加描述description...