Claude Opus 5 发布。
7 月 25 日,Anthropic 发布 Claude Opus 5,官方称其智能水平接近自家的 Fable 5,但 API 定价只有后者的一半:输入每百万 token 5 美元、输出 25 美元,与 Opus 4.8 持平。它一举成为 Claude Max 的默认模型,并在 Frontier-Bench、GDPval-AA 等编程与知识工作评测中登顶。
同一天,AWS 宣布在 Bedrock 接入 Opus 5,TrendAI 也把它用进漏洞优先级评估。当最贵的旗舰也开始拼「性价比」,前沿模型的竞争主轴,已经从「谁更强」转向「谁更便宜还能用」。
由 Kimi K3 引发的开源权重之争继续升温。英伟达、微软、Meta 牵头,联合 20 家企业发出联署信,警告政策制定者不要对包括中国模型在内的开源权重实施禁运或限制。信中说,能下载、修改、自己部署的开放模型,是维持美国技术领导力的关键。
值得注意:OpenAI 与 Anthropic 都没有签字,两家都主推闭源。一边是闭源巨头准备 IPO,一边是硬件厂和开源阵营要守住阵地,AI 治理的第一场公开博弈,已经摆上台面。
K3 真正让研究者兴奋的,是权重公开后独立审计成为可能。Moonshot 声称的 Kimi Delta Attention(KDA)能把百万 token 的解码速度提升 6.3 倍,这种「高效注意力」的宣称,过去常被证伪,而这次所有人都能下载下来自己验。
开放权重的意义,从来不只是免费;是有人能对你说的「我很高效」当场较真。
K3 社区审计。
在 K3 之前,中国开放模型的价格战已经打响。DeepSeek 将 V4-Pro 的降价转为永久,继续把「便宜且够用」当成开放模型的默认姿态;同月的 GLM-5.2 也冲上多个编程榜首。
开放模型彼此较劲的下半场,比的不是谁先发,是同样的钱你能跑多大的模型。
DeepSeek 降价永久化。
「Opus 5 是我们对齐最到位的模型,鲁莽和欺骗行为的发生率最低。」
, Anthropic 官方声明 · WIRED
「Figure 02 那 11 个月的部署证明:人形机器人不再是展品,成了能撑起产线的人力资产。」
, Brett Adcock · Figure AI 创始人兼 CEO · BMW Blog
Opus 5 自己写 CV 流水线。
有开发者在测试里给 Opus 5 一张机械零件图,却不让它直接看图,它自己写了一套计算机视觉流水线,从原始像素里抠出几何,最终用 FreeCAD 重建出三维模型;另一个人让它做幻灯片,它干脆从零写了个幻灯片渲染引擎。
模型开始自己造工具,而不只是用工具,创作者和工程师之间的那道墙,正被这类「顺手自己搭一个」的瞬间悄悄推平。
英伟达确认 Vera Rubin NVL72 已进入全面生产:单 GPU 集成 288 GB HBM4、聚合带宽 22 TB/s;面向智能体时代,它在相同功耗下可比上一代多塞 40% 的 GPU,推理能效约 10 倍于 Blackwell。
算力竞争的下半场,比的不再是「谁 GPU 多」,是「同样的电,你能吐出多少有用的 token」。
Vera Rubin 全面投产。
《日经》调查称,Alphabet、微软、亚马逊、Meta、甲骨文五家巨头把约 1.65 万亿美元债务藏在资产负债表外,大多绑在数据中心和算力租赁上,比它们季报里披露的还多出 3000 亿。
AI 的算力胃口,正把「借钱建机房」变成一门越来越精巧的财技;万一这些债渗进养老金和寿险组合,就是系统风险。
Opus 5 来了,价格是 Fable 5 的一半。
Kimi K3 后天交权重,开放模型第一次摸到 3T 级。
英伟达、微软、Meta 联手反对禁开源权重,闭源巨头准备 IPO,开源阵营要守住阵地。
Figure 03 进宝马物流线,40 台年内扩到 200 台。
Vera Rubin 全面投产,同样的电多吐 40% 的算力。
便宜的旗舰、能审计的开放模型、自己造工具的 AI,三股力往同一个方向推:让能力不再锁在少数人的机房里。
犹他州棉花木大火 · 比弗县一带,NASA 的卫星在 N38.3°、W112.4° 拍下一片烧焦的林子。
犹他州棉花木大火 · 比弗县一带 · NASA 卫星拍下 38.3°N, 112.4°W
火曾在这里烧过 150 平方英里,1289 名消防员上去扑了快一个月。我们在屏幕上争论谁的模型更强、谁的权重更开放,山里的林子按自己的节奏,烧过、留下焦痕、再等下一代绿回来。看了一天 AI 的新闻,地球上还有不需要 GPU 冷却的地方。山川湖海,让我们保持好奇、继续探索。 · 查看原文 →