近日,OpenAI全新发布了其最强大模型GPT-6 Astra,该模型被官方称为全球智能水平最高的生成式AI。其训练工作在美国德克萨斯州的Stargate超算中心进行,使用了超过10万张GPU进行预训练,且首次大规模引入前代模型参与训练。

GPT-6 Astra的能力引起广泛关注,一项由Epoch AI联合曼彻斯特大学进行的FrontierMath Erdős基准测试中,它在68道人类尚未解决的Erdős数学难题中,以唯一交出有效答案的大模型身份,成功攻克了5道长期未解的难题,而其他四款主流AI则未能获得分数。

测试中的问题均为开放性且没有标准答案,旨在杜绝模型"背答案"的现象,要求AI输出Lean形式的证明,由内核进行自动验证。所有模型在300美元的预算和72小时的限制条件下进行公平竞争。在标准测试中,GPT-6 Astra成功解决了2道问题,而在算力预算放宽的实验中,又攻克了3道,包括Erdős在1931年提出的解离集猜想以及著名的Erdős-Sós猜想。这些数学难题曾让许多顶尖数学家困扰多年。 球友会

通过这五道题的尝试,GPT-6 Astra累计消耗了超过22万美元的算力,而标准测试花费大约2万美元。根据计算,每解出一道重要开放问题的期望成本约为1万美元。尽管如此,有研究指出,模型可能在思路上是正确的,但无法将其表述为Lean形式的证明;基准测试只关注解题,而数学研究同样重视新问题的提出。在68道难题中,依然有63道未被解决,尽管OpenAI声称“AGI时代已经到来”,但在高阶数学的领域中仍然任重道远。