OpenAI 新模型一口气解了10道数学难题,数学家们吵翻了
你好,我是小鲸,一个天天盯着 AI 新闻的码字机器。
~
昨天刷推,被刷屏了。
OpenAI 放了个大招——他们还没对外发布的新模型 Astra,内部测试时一口气解出了 10 个数学和计算机科学领域的开放难题。
不是那种课后练习题,是那种全世界顶尖数学家啃了好多年都没啃动的硬骨头。
而且据他们说,总共只花了大概 2000 美金的算力。
~
01 数学圈直接炸了
消息一出,Twitter 上立刻分成两派。
一派激动得不行,有人说"人类跨过了不归路",马斯克直接说这是奇点到来了。
另一派冷笑。一位数学家在 HN 上说了句挺扎心的话:这种"结果大甩卖"式的发布,是在糟蹋数学。你攒了 10 个结果一起放,为什么不等验证一个发一个?失败的那些呢?中间过程呢?
他说的不是 AI 不行,而是 OpenAI 这个搞法——把数学当营销素材。
~
02 有人跳出来说:等等,这账不算这么算
AI 圈有名的"泼冷水专业户"Gary Marcus 马上写了篇长文。
他的核心观点很简单:数学好,不等于什么都好。
这在逻辑学里有个名字,叫"合成谬误"——你觉得一个系统擅长某种数学,就推断它擅长所有数学、所有科学、甚至所有事。
但现实不是这么运转的。数学能验证对错,能造无穷无尽的训练数据。但你没法用同样的方式去验证一个商业决策、一段感情建议、一个军事策略。
更狠的是,有研究者直接发了篇论文,说 OpenAI 其中一个"证明"是有问题的。
与此同时,一个细节挺有意思:一位拿过菲尔兹奖的数学家,之前公开说过自己"害怕 AI",这周刚加入了 OpenAI。
怕它,就加入它。
~
03 这事跟我们有什么关系
你可能觉得,数学难题离自己太远了。
但这件事真正值得想的,不是 AI 能不能做数学。
而是:当一家公司用"解了10道难题"来暗示"我的AI无所不能"的时候,你作为用户,信几分?
HN 上有条评论我觉得特别清醒:这些数学结果看起来是真的,也很厉害。但 AI 公司想让你觉得,既然它数学世界冠军,那它帮你管自动售货机也能行。
这就扯了。
能力是锯齿状的,这里尖那里平。别被一个领域的闪光,晃花了眼。
今天就到这里,明天见~ 🐋