Anthropic发布了Claude Mythos模型,该模型通过简洁的证明解决了具有百年历史的Erdős单位距离猜想。Anthropic工程师Sholto Douglas在X平台上宣布了这一消息。此前,OpenAI的GPT-5.5也攻克了这一数学难题,标志着领先AI供应商在纯数学发现领域的竞争日益激烈。该突破展示了一种与传统单一模型不同的协作代理模式。据悉,该团队构建了一个包含多个独立Claude Code实例的自动化测试系统。在该系统中,有权访问Mythos的代理实例负责接收问题并生成不同的解决方案路径,然后将其总结并分发给其他独立运行的实例进行交叉验证。
据报道,该团队构建了一个自动化测试系统,其中包含多个独立的Claude Code实例。在此系统中,可以访问Mythos的代理实例负责接收问题并生成不同的解决方案路径,然后将其汇总并分发到其他独立运行的实例以进行交叉验证。数学家Daniel Litt评论说,Mythos的最初结果“略逊于”OpenAI的解决方案,但该模型最终找到了与OpenAI相同的解决问题的路径,并独立推导出了更原始和简洁的证明。目前,Anthropic已正式发布了Opus4.7编译的证明版本。
这一进展再次引发了业界对“纯粹大型语言模型(LLM)”和“符号推理辅助系统”发展路径的讨论。此前,Google DeepMind曾宣布使用其AlphaProof Nexus系统解决了九个Erdős问题,但由于其对Lean形式证明语言的高度依赖,引发了关于纯粹生成式AI领域自主推理价值的辩论。相比之下,Claude Code作为一个代理框架,现在正通过多代理协作来应对人类面临的顶级科学挑战。人工智能领域目前正在经历巨大的范式转变,一位菲尔兹奖得主最近证实,ChatGPT5.5Pro可以在两小时内自主完成博士级别的数学研究。随着Claude Mythos和GPT-5.5在算法发现和系统漏洞利用等前沿领域展示出自主进化能力,人工智能正从早期的“提示工程”阶段全面转向具有深度逻辑推理和科学探索能力的自主代理时代。
