OpenAI一口气公开了722篇数学研究手稿,全部由内部前沿模型生成。其中两篇指向百年难题挂谷猜想:一篇攻三维挂谷极大函数猜想,另一篇给出四维一般挂谷集合的满维证明。多维数学的认知边界被推了一下,"AI能不能做基础研究"也从假想变成了摆在眼前的问题。
数学界当场分成两派。有人兴奋,觉得AI把前沿数学往前推了一大步;也有人发愁,担心学术生态被冲垮,青年研究员的成果首当其冲,连数据安全都被拎出来质疑。纽约大学数学教授巴克马斯特直接开炮,批评OpenAI一口气放出这么多成果,破坏了学术合作的传统节奏。
另一边,微软拿出了Microsoft-Decision-1。它不聊天、不写诗,只干一件事:从预设选项里挑最优解,并给备选答案打概率分。在覆盖约15万道题的36项权威基准测试中,准确率全部第一,速度优势明显,已在多个内部场景实测。有评价说它直逼GPT-6 Sol。
两条消息放一起看,信号很清楚:大模型正在从"能说会道"转向"能判断、能做决定"。数学证明是极限测试,结构化决策是落地场景。真正没跟上的是署名规则、评审机制和青年研究者的生存空间。技术跑得比规矩快,这道题比挂谷猜想更难解。