先讲三句人话:
第一,AI 的「聪明」在肉眼可见地加速——三个月内主力模型连升两代,还开始自己证明数学难题(带可查证的证明)。
第二,能力越强,刹车越急——因为「太强」,OpenAI 自己把一个新模型按下暂停,等安全标准跟上再放。
第三,「默认选项」的地位在松动——ChatGPT 市场份额第一次跌破一半,它不再是所有人默认打开的 AI。
模型迭代(GPT-5.5→5.6) ≈ 类似手机换代,一代更比一代聪明,但 OpenAI 换代速度是手机的好几倍。
Astra ≈ OpenAI 正在憋的「下一代」模型,主打多个 AI 分工协作解决难题。
Lean 4 证明 ≈ 用机器可验证的数学证明,让「AI 解出了难题」变成「有证明可以查」,而不是它说了算。
安全评估前置 ≈ 能力达不达标,先过安全关再发布,能力上限和安全下限分开算。
如果你想了解「全世界最头部 AI 公司现在强到什么程度、又卡在什么问题上」,这块就是答案。
出处 · 看 06-02 日报 →
出处 · 看 06-04 日报 →
出处 · 看 06-06 日报 →
出处 · 看 06-17 日报 →
出处 · OpenAI · Simon Willison
出处 · 看 08-07 日报 → · OpenAI
三个月里 OpenAI 的进,是往「可验证」的方向进。GPT-5.5 到 5.6 是能力升级,但真正有信息量的是 10 个数学问题的 Lean 4 证明公开:AI 研究第一次把「解出来了」变成「有证明能查」。
这是对质疑的回应:当所有人都在质疑 AI 的「幻觉」,OpenAI 选择用形式化证明说话。
二、退的逻辑:安全标准成了闸门进得越快,退得越急。Astra 因为「太强」被暂停,安全评估被前置到模型面世之前。这不是姿态,是防线:在 Kimi K3 越狱、AISI 事故报告接连曝出的夏天,任何一家实验室都不敢赌「先发布再补安全」。
值得注意的转变:「强不强」和「放不放出来」第一次被拆成两件事:能力的上限,和安全的下限,开始分开计算。
三、份额跌破 50%:默认选项的终结ChatGPT 份额首次跌破 50%,是三个月里最被低估的信号。它不是「OpenAI 不行了」,而是「OpenAI 不再默认」:开源模型、竞品、本地模型都在分食。
这也是 OpenAI 一边加速模型迭代、一边急着上市的原因:默认选项的窗口正在关闭,它得在窗口关上之前,把「用户习惯」变成「资本结构」。
"我想看的不是结果,是他们怎么问出来的。"
—— Simon Willison · 评论 OpenAI 数学结果 · simonwillison.net
"人们更在意 AI 能不能把时间还给人。"
—— Greg Brockman · OpenAI 联合创始人 · simonwillison.net
"奇点已经到来,我们就身处其中。"
—— Sam Altman · OpenAI CEO · X @sama