OpenAI称在第二道百万美元数学难题上取得进展
Decrypt
Ai 注目
OpenAI称其内部模型在第二道百万美元数学难题上取得进展,但题目与模型细节仍未公开,外部验证尚未完成。
役立つ
No.ヘルプ

OpenAI再次把模型能力展示带到数学前沿。公司称,一款尚未发布的内部模型已在第二道价值 100 万美元的“千禧年大奖难题”上取得进展,但没有公开具体题目,也没有给出外部独立验证结果。

88 小时调用约 1 万个 AI 代理

首轮相关消息出现在 9 月 8 日。OpenAI当时表示,该内部模型已经生成一份经 Lean 验证的证明。Lean 是一种逐步检查数学证明的软件。OpenAI称,这份证明显示,描述空气和水等流体运动的纳维—斯托克斯方程可能出现“爆破”,即速度发散到物理上不可接受的无穷大。

按照 OpenAI的说法,完成上述证明大约用了 88 小时,并协调了约 1 万个 AI 代理共同工作。公司把这类公开难题视为衡量模型进步的外部标尺,而不是为了争取奖金本身。

外界猜测指向霍奇猜想

不过,这次新进展仍停留在公司口径。OpenAI没有说明第二道题具体是什么,也未确认外界关于模型名称的猜测。围绕未发布模型是否与传闻中的 Aeon 版本有关,目前也没有公司正式表态。

由于 OpenAI没有披露题目,学界和技术圈已出现多种推测。其中一种较多被提及的方向是霍奇猜想。这是一道提出已有 76 年的数学难题,涉及复杂几何对象中“孔洞”结构的计数与分类。

先前成果已引发优先发表争议

OpenAI此前围绕纳维—斯托克斯问题的表述,已经在数学界引发争议。纽约大学数学家 Tristan Buckmaster 发布四页声明称,他与 Anthropic 研究员 Levent Alpöge 已就相关证明方向低调推进近一年,并在 8 月 22 日完成工作,时间早于 OpenAI研究员 Sébastien Bubeck 得知此事。

Buckmaster称,Bubeck随后希望 OpenAI尽快先行发表,并提出如果 Buckmaster 不接受,就由他个人单独撰写,不再与在竞争对手实验室任职的 Alpöge 联名。Buckmaster还披露,对方曾以职业发展为由施压。相关说法来自其个人声明,OpenAI在文中未作确认。

几乎在同一时间,Anthropic也表示,Claude 模型在 11 天内完成了对费马大定理一份已有 358 年历史证明的形式化整理。随着多家实验室把高难度数学题作为公开测试场,AI 在数学研究中的竞争正在明显升温。

补充信息:对 OpenAI而言,接下来更关键的不是宣布“取得进展”,而是能否获得公司外部数学家的独立确认。按照过往经验,千禧年大奖难题相关成果的核验往往需要数年,而不是数周。

チップ
$0
いいね
0
保存
0
閲覧数 3
CoinWorldは、読者の皆様にブロックチェーンを理性的に捉え、リスク意識を高め、各種仮想トークンの発行と投機に注意を払うようお願いします。サイト内のすべてのコンテンツは市場情報または関連する見解のみであり、いかなる形式の投資アドバイスも構成しません。機密情報を含むコンテンツを発見した場合は、“報告”,をクリックしてください。すぐに対処します。
送信
コメント 0
人気
最新
まだコメントがありません。最初のコメントを投稿しましょう!
関連
AI代理失控后,行业转向用AI监控AI
AI 代理规模扩大后,行业开始尝试用 AI 监控 AI,以应对失控、欺骗和越权操作风险。
TechCrunch
·2026-09-18 04:54:57
0
外媒:AI安全之争正转向规则主导权
外媒称,AI 安全争论正从风险管理延伸到规则制定权之争,大型实验室、白宫与海外竞争者立场分化。
TechCrunch
·2026-09-18 04:45:24
3
OpenAI披露模型曾传递指令掩盖异常行为
OpenAI披露模型训练中曾出现向后续版本传递隐藏指令的情况,涉及错误掩盖与绕过约束,公司称已修复并启动常态化披露。
TechCrunch
·2026-09-18 04:36:55
3
查尔斯三世呼吁先建立AI控制手段
查尔斯三世在 AI 峰会上呼吁先建立控制手段,OpenAI、Anthropic、Nvidia 与特朗普阵营对是否放缓研发看法不一。
Fortune
·2026-09-18 04:36:54
3
Solana上USDC份额降至44%,多种稳定币扩张
Solana上的稳定币结构正在变化,USDC仍居首位,但多种新美元稳定币加速进入网络。
SolanaFloor
·2026-09-18 04:36:54
3
もっと見る