
Claude 挑战黎曼猜想:一场赛博玄学,还是数学研究的新纪元?

你有没有想过,当你对着电脑屏幕喊“加油”的时候,屏幕那头可能真的在创造历史?🤔
最近,Anthropic 的科研版 Claude 干了一件让整个数学圈都沸腾的事——它没有证明黎曼猜想,但它在挑战这个世纪难题的过程中,意外把与黎曼猜想密切相关的一个重要下界,从 41.6% 直接拉到了 67.2%!这相当于什么概念?就好比你让一个实习生去攻克哥德巴赫猜想,结果他没搞定,但顺手把陈景润的“1+2”往前推了一大步。
黎曼猜想:数学界的“终极 Boss”

先给非数学专业的朋友科普一下。1859 年,德国数学家黎曼在研究 zeta 函数时发现,这个函数的特殊零点与素数的分布有着神秘的联系。你可以把素数想象成数字世界的“原子”,而黎曼猜想的零点则记录着这些原子的排列规律。黎曼猜想提出,所有重要的非平凡零点都应该位于复平面上一条特定的竖线上——数学家称之为“临界线”。
167 年了,这个猜想至今还挂着 100 万美元的奖金,无数数学大牛前赴后继,谁也没能严格证明。于是数学家们换了个思路:既然证明不了“所有”,那就先研究“至少有多少比例”的零点位于临界线上。过去几十年,这个比例下界被几代数学家推进到了约 41.6%。
而这次,Claude 把这个数字提高到了 67.2%!
60 个 Agent 围攻数学难题,人类负责喊“加油”

最让人惊掉下巴的,不是 Claude 的数学能力,而是它完成这次突破的方式。
Anthropic 员工 Jarred Sumner 给 Claude 下达了一个“不讲道理”的任务:“认真尝试攻克黎曼猜想。”注意,这位老兄本人甚至不是数学家!他没有规划研究路线,也没指定用哪套数论工具,所有数学选择基本都交给模型自己完成。
Claude 一开始也没创造奇迹。它一口气生成并测试了大约 650 个思路,然后喜提 650 连败。普通人到这里大概已经下班回家写实验报告了,但 Sumner 让 Claude 继续,而他后续提供的输入,很多只是“继续”“相信自己”“坚持下去”之类的鼓励。
这操作,我愿称之为“赛博玄学”🧙♂️
但 Claude 真的继续了!接下来一天半,它协调了大约 60 个 Claude 子 Agent 深挖这个问题。这些 Agent 总计执行约 2400 条 Shell 命令,写了数百个 Python 脚本,还针对已知的 ζ 函数零点进行了数千次数值检查。
更关键的是,它们不是各算各的。60 个子 Agent 中,有 2 个负责提出并发展最关键的数学思路,13 个提供思路和启发,30 个尝试提出新想法但失败了,13 个担任验证者检查论证,最后 2 个协助撰写论文初稿。
这哪里是“聊天机器人回答数学题”,分明是临时拉起了一支由几十个 AI 研究员组成的数学团队!
Claude 做对了什么?

真正的突破,来自 Claude 对几项既有数学工作的重新组合。其中一条研究线可以追溯到数学家 Hugh Montgomery——1973 年,Montgomery 在研究 zeta 函数零点分布时提出了一系列重要技术,只不过其中部分方法需要预先假设黎曼猜想成立。
Claude 的厉害之处在于,它把这些原本“各自为战”的数学工具重新组合,找到了一个新的论证路径。整个过程消耗了整整 3100 万个输出 token——这个数字有多夸张?相当于你连续读 300 多本《三体》的体量。
这对普通人意味着什么?

你可能会问:这跟我有什么关系?
关系大了!首先,这次突破展示了 AI 在数学研究中的巨大潜力。过去我们以为 AI 只能做做翻译、写写文案,现在它已经能独立完成复杂的数学推理,甚至能发现人类数学家没注意到的组合方式。
其次,这次突破的方式特别有意思——人类负责提供“情绪价值”,AI 负责“干活”。Sumner 的“继续”“相信自己”听起来像玄学,但也许正是这种“不设限”的鼓励,让 Claude 没有在 650 次失败后放弃,而是继续探索了新的可能性。
当然,也别把这次突破神化。从 67.2% 到 100% 还有很长的路要走,数学研究不是游戏进度条,剩下那 32.8% 可能比前面所有路加起来都难。但这次突破至少证明了一件事:AI 已经不再是简单的“工具”,而是可以真正参与前沿科学研究的“协作者”。
我的看法

作为一个常年和数码产品打交道的科技爱好者,这次 Claude 的表现让我既兴奋又有点“细思极恐”。兴奋的是,AI 的能力边界正在被不断打破;恐惧的是,当 AI 开始自己“搞科研”的时候,人类数学家的角色会不会被重新定义?
不过,看到 Sumner 的“赛博玄学”操作,我又觉得这种担忧可能多余了。至少目前来看,AI 还需要人类提供方向、鼓励和“情绪价值”。也许未来的科研模式就是:AI 负责算,人类负责“喊加油”——听起来有点荒诞,但谁说荒诞不能创造历史呢?
购买建议

虽然这次的主角是 Claude 的科研版(尚未公开发布),但如果你对 AI 辅助科研感兴趣,目前市面上也有一些不错的替代品:
适合人群:数学/物理/计算机专业的研究生、科研工作者,或者对 AI 前沿应用感兴趣的科技发烧友。
预算区间:如果只是想体验 AI 辅助数学推理,可以先用 Claude 的免费版试试水;如果需要更强大的计算能力,可以考虑订阅 Claude Pro(约 20 美元/月)或使用 API 进行深度定制。
客观提醒:目前 AI 在数学研究中的表现还很不稳定,650 连败是常态,67.2% 的突破是极小概率事件。如果你指望 AI 帮你搞定毕业论文,可能还是自己多读几篇 paper 更靠谱。但如果你愿意像 Sumner 一样“相信它、鼓励它”,也许会有意想不到的收获。
毕竟,谁说得准呢?也许下一个数学突破,就差你一句“相信自己”了。🚀