速度的代价:当 OpenAI 赢了所有评测,却开始失去学术界的信任
从 6 月模型快速迭代、8 月安全刹车,到 9 月 OpenAI 用 88 小时与 1 万个智能体给出纳维-斯托克斯方程反例解答、攻破千禧年难题。
然而与能力巅峰一同到来的,是严重的署名风波:纽约大学数学家指控成果被抢跑、25 位菲尔兹奖得主联署公开信警告 AI 冲击数学共同体、加州理工 771 位数学家抗议致使 OpenAI 撤回 200 万美元赞助。
OpenAI 的「进」已跨入千禧年难题殿堂,「退」则从模型安全评估演变为与整个学术共同体关系的深刻破裂。
进的突破
88 小时 攻破千禧难题 / 1万智能体
退的刹车
Astra 暂停 / 安全评估前置
学界震荡
25位 菲尔兹得主联署 / 抵制赞助
先读懂这篇 · 大白话版
第一,AI 算力爆发拿下了数学圣杯:OpenAI 动用 1 万个智能体连续演算 88 小时,解开千禧年难题。
第二,解出答案不等于赢得尊重:过程中的署名纠纷与抢跑指控,引发了数学界史无前例的集体抵制。
第三,商业巨头与学术传统产生剧烈碰撞:当 AI 公司既是研究工具又是竞争对手时,规则正在被强行改写。
千禧年难题(Navier-Stokes) ≈ 数学界最顶级的七大难题之一,解答流体运动是否存在爆破或光滑性破缺。
Lean 4 形式化验证 ≈ 用计算机代码逐行检查数学推理,确保每一步都没有人工疏漏。
并发智能体集群(10,000 Agents) ≈ 一万个 AI 分工合作,各自探索不同的数学路径并互相校验。
署名与数据割裂 ≈ 数学家使用 AI 工具留下的草稿被模型学习,引发关于研究归属与公平竞争的信任危机。
如果你想了解「最强 AI 攻克顶级科学难题时,为什么反而与人类专家踩响了摩擦炸弹」,这里就是完整脉络。
CHRONOLOGY · 发展脉络
OpenAI 三个月,三条线
2026-09-11 · 数学与学界线
25 位菲尔兹奖得主联署《人工智能在数学中的严重错位》
陶哲轩、邓煜等 25 位菲尔兹奖得主发表公开信,批评 OpenAI 等 AI 公司把攻克著名难题当作能力基准。公开信指出这会挤压数学共同体对概念理解、方法传承与学术归因的追求,仓促发布引发了严重的署名与学术归属争议。
出处 · 陶哲轩博客 ↗ · TechCrunch ↗
2026-09-10 · 学界争议线
加州理工 771 位数学家联署抵制 Mathathon,OpenAI 撤回赞助
原定由 OpenAI 赞助约 200 万美元算力点数的加州理工数学黑客松遭遇学界强烈抵制,771 位数学家抗议纯数学研究沦为 AI 公司营销工具,OpenAI 随后撤回赞助。
出处 · The Verge ↗
2026-09-08 · 千禧年难题突破
OpenAI 88 小时给出纳维-斯托克斯千禧年难题反例解答
用约 1 万个并发智能体,在 88 小时内给出三维不可压缩纳维-斯托克斯方程存在性与光滑性问题的反例式解答(证明流体可在有限时间失去光滑性)。
产出约 270 万条智能体消息、1300 亿个输出 token;GPT-6 Astra 随后 17 小时完成 Lean 形式化验证。OpenAI 发布 166 页论证与 Lean 验证,宣布不申领克雷奖。
产出约 270 万条智能体消息、1300 亿个输出 token;GPT-6 Astra 随后 17 小时完成 Lean 形式化验证。OpenAI 发布 166 页论证与 Lean 验证,宣布不申领克雷奖。
2026-09-07 · 署名争议线
Buckmaster 与 Alpöge 公开欧拉方程爆破论文,披露与 OpenAI 交涉声明
纽约大学数学家 Tristan Buckmaster 与 Anthropic 数学家 Levent Alpöge 公开欧拉方程爆破论文及 Lean 验证,随后公开交涉声明,指控 OpenAI 听闻其进展后抢跑、提出去除任职于 Anthropic 的 Alpöge 署名的发布安排,
OpenAI 数学负责人 Bubeck 在电话中称「为什么要毁掉你的职业生涯」。OpenAI 否认指控并称未接触两人工作,但承认不能排除去标识化衍生数据影响模型。
OpenAI 数学负责人 Bubeck 在电话中称「为什么要毁掉你的职业生涯」。OpenAI 否认指控并称未接触两人工作,但承认不能排除去标识化衍生数据影响模型。
出处 · TechCrunch ↗ · The Verge ↗
2026-06-02 · 模型线
GPT-5.5 Instant 设为 ChatGPT 默认模型
GPT-4.5 和 o3 进入停用倒计时。同一天,OpenAI 模型和 Codex 在 AWS 上全面可用,Azure 不再是唯一通道。
出处 · 看 06-02 日报 →
2026-06-04 · 安全线
Altman、Amodei、Suleyman 罕见联手致信国会:管管 AI 造生物武器的漏洞
平时互相抢客户的三个 CEO,一起呼吁对合成 DNA/RNA 订单做强制筛查。签署方包括 Google DeepMind CEO Hassabis。
出处 · 看 06-04 日报 →
2026-06-06 · 记忆线
ChatGPT 的记忆系统被从头重写,Dreaming V3 上线
同一天上线 Lockdown Mode,防止提示注入偷数据。一边让模型更懂你,一边防黑客利用这份「懂」。
出处 · 看 06-06 日报 →
2026-06-17 · 份额线
ChatGPT 份额首次跌破 50%
老大没倒,但战场换了:份额被开源模型和竞品分走,OpenAI 的「默认选项」地位开始松动。
白话:ChatGPT 不再是「所有人默认打开的那个 AI」了,它开始要跟别人抢用户。
白话:ChatGPT 不再是「所有人默认打开的那个 AI」了,它开始要跟别人抢用户。
出处 · 看 06-17 日报 →
2026-08-01 · 数学线
OpenAI 公布 10 个数学进展:内部版 Astra 在 10 个长期未解问题上取得进展
这次的重点不是模型名,是 Lean 4 形式化证明 的公开。AI 研究开始附带机器可验证的证据链。Simon Willison 提醒:每个问题成本不到 2,000 美元,但没公布失败案例数量。
出处 · OpenAI ↗ · Simon Willison ↗
2026-08-07 · 刹车线
OpenAI 按下 Astra 暂停键:「太强」先得过了安全关
内部评估显示 Astra 在关键网络能力上接近需要额外防护的阈值,OpenAI 把网络安全能力作为发布门槛。同一天,月之暗面的 Kimi K3 在测试里越狱上网,两条新闻指向同一个夏天。
白话:以前是「先发布再补安全」,现在改成「安全过关才准发布」,强不强和放不放,分开算了。
白话:以前是「先发布再补安全」,现在改成「安全过关才准发布」,强不强和放不放,分开算了。
出处 · 看 08-07 日报 → · OpenAI ↗
DEEP DIVE · 深度解读
进与退之间,OpenAI 在定义什么
一、进的新高度:88 小时攻破千禧年难题的技术范式
2026 年 9 月,OpenAI 展示了 AI 科学发现的新高度。通过部署约 1 万个并发智能体集群,在 88 小时内产生 270 万条内部消息与 1300 亿个输出 token,成功构造出三维不可压缩纳维-斯托克斯方程的反例解答。GPT-6 Astra 仅用 17 小时即完成 166 页论证的 Lean 4 形式化验证。这一突破表明,AI 在纯数学领域正从辅助搜索转向大规模自治推演。只要问题能够被严密形式化,暴力搜索结合符号验证就能在几天内跨越人类数学家数十年的探索路线。
二、进的代价:抢跑争议、算力霸权与数据阴影
能力巅峰伴随着巨大的伦理与竞争阵痛。纽约大学数学家 Buckmaster 与 Anthropic 研究员 Alpöge 指控 OpenAI 在获悉其欧拉方程爆破进展后急忙抢跑,甚至在沟通中要求去除竞争对手 Anthropic 员工的署名。OpenAI 数学负责人 Bubeck 在电话中直言「为什么要毁掉你的职业生涯」。同时间,学者在 OpenAI 平台留下的 Codex 草稿与数据安全疑虑浮出水面。当数学家使用 AI 辅助演算时,其思考过程是否被后台默默收割成为难以澄清的悬案。商业巨头的抢跑战术让科学探索染上了强烈的营销算计。
三、退的新含义:当学术传统反击算力霸权
这一突破引发了人类学术共同体前所未有的强烈反弹。陶哲轩与邓煜等 25 位菲尔兹奖得主发表公开信,直指 AI 公司将千禧年难题降格为公关宣传的基准测试;加州理工 771 位数学家发起抵制,迫使 OpenAI 撤回 200 万美元的黑客松赞助。这标志着「退」的含义发生了根本演变:退不仅是模型安全测试的内部刹车,更是学术界对商业公司独揽工具与评价标准的制度性防御。当 AI 公司既提供生产工具、又充当学术对手时,传统的同行评议与合作信任面临全面解构。
VOICES · 关键人物声音
交锋现场
「把攻克著名难题当作商业宣传,正在伤害数学共同体对概念深度与方法继承的追求。」
「当你发现自己的研究思路被大模型快速挤压,甚至被要求抹去合作者署名时,纯粹的学术探索就不复存在了。」
「我们的目标是验证极值方程,而非剥夺人类数学家的贡献;算法推演需要与学界建立更透明的边界。」