「前沿模型的竞争力最终要落在可验证的真实任务与成本结构上。」
Mira Murati · 技术研究者
「审慎本身正在成为竞争力的一部分,能力跃迁必须与护栏同步。」
Demis Hassabis · DeepMind 联合创始人
美国商务部批准 OpenAI 大范围发布 GPT-5.6 系列。Axios 独家报道后获多方确认:三款模型 Sol、Terra、Luna 将在周四(7 月 9 日)向所有用户开放。
上个月应政府要求紧急限制访问后,经过数周 CAISI 框架下的额外安全测试,联邦政府最终放行。
这次放行标志着一个转折—此前 GPT-5.6 仅限少数经过审查的合作伙伴访问,细节需报备当局。
如今面向全球开放,意味着美国政府的 AI 安全审查框架从”堵”转向了”测完即放”。3 款模型撑起这次放行。
NotebookLM 从”笔记助手”进化为一个带工作台的 AI 研究环境。Google 在 6 月底的更新中给 NotebookLM 装上了 Gemini 3.5、一个安全的云端计算机(可写代码跑分析),并接入了 Google 搜索自动找源。
用户可以从一个模糊想法起步,让 NotebookLM 自己找资料、跑数据、生成 PDF 报表或预算表格。
这中间有两个实用变化:一是上百个预置软件技能让模型能处理专业任务(数据清洗、格式转换、图表生成),二是输出格式扩展到 PDF 报告、预算表、课程作业纸,且支持生成后二次编辑。
对经常需要从零搭建研究框架的人来说,这不只是一个升级—它在变成一个新的工作入口。
Momenta Global 今天在港交所首日交易,开盘价 HK$301,较发行价 HK$295.60 仅微涨 1.8%,盘中最高 HK$314.80 后回落至 HK$299 附近。IPO 募资约 58.9 亿港元,公开发售部分 413.6 倍超额认购,但首日表现平淡。
Momenta 由前微软研究员曹旭东 2016 年创立,为丰田、比亚迪等车厂提供辅助驾驶方案。
截至今年已交付超 100 万台量产车,2025 年授权服务收入从 2 亿跃至 9.7 亿人民币。
基石投资者包括梅赛德斯-奔驰、贝莱德、博裕资本。
7 月 7 日,欧盟委员会正式发布《Action Plan on Cybersecurity and AI》。计划指出:AI 既可用于发现漏洞、预防攻击、加固关键基础设施,也可能被恶意方用来自动化攻击、以前所未有的速度和规模发起网络行动。
欧盟将联合成员国、产业与欧盟层面机构,共同强化数字基础设施的韧性。
这是把”AI 既是矛也是盾”从口号变成协调机制的一步。
继此前的合规执法期之后,欧盟正把监管从”模型本身”延伸到”模型带来的安全外部性”—不再只问模型训练得合不合规,也要问它上线后会怎样被用、被攻。
Liquid AI 开源 Antidoom,针对的是推理小模型的著名翻车:陷入循环反复输出同一 token,直到把上下文耗尽。
方法叫 FTPO(最终 token 偏好优化),把触发循环的那个 token 重新标注、把概率重分配给替代项。
数字很硬:greedy 采样下 LFM2.5-2.6B 的死循环率从 10.2% 降到 1.4%,Qwen3.5-4B 从 22.9% 降到 1%,且下游评测同步受益。这是当下研究转向的缩影:不堆参数,精准拆特定失败模式。
当模型尺寸不再增长,把每个已知失败模式拆掉,就是新的提升路径。
Harvey 与 Artificial Analysis 发布 Harvey LAB-AA 法律 agent 基准:120 道私有法律任务、24 个执业领域,要求端到端产出合规交付物。
结果最强模型 Fable 5 全过率也只有 14.2%,Opus 4.8 与 GLM-5.2 并列 7.5%—而 GLM 的单任务成本只有 Fable 的约 6%。
消息本身很扎心:模型能通过大量单项评分,却仍交不出合格的端到端成果。
单项强不等于能用,这层差距第一次被一个垂直基准量化。
但资本没等。
同一天 Norm Ai 完成 $1.2B 估值、1.2 亿美元 C 轮,主打”全栈 agentic law“。
法律 AI 的两条线同时推进:评测在揭短,钱在加注。
垂直行业的胜负手不是模型总分,是能不能把最后一段交付做好。
Hugging Face 7 月 7 日发布 LeRobot v0.6.0(主题”Imagine, Evaluate, Improve“)。这个机器人学习框架继续把”训练—评估—改进”的工具开源化,让更多人能上手做真实世界的机器人策略,而不只是盯着 benchmark 跑分。
它呼应了本周的一条暗线:当最强模型越来越便宜、越来越开放,稀缺价值正从”算法”转向”能动手的身体”和真实场景数据。
开源框架把造机器人的门槛往下拉了一截。
HF 7 月 7 日论文日榜由《UI-MOPD》领跑(53 赞)—它聚焦让操作图形界面的 Agent 跨平台持续学习、不”学了新的忘了旧的”。
研究热度正从”更大的模型”转向”Agent 怎么稳定地长期变强”。
但同一天,斯坦福 2026 AI Index 戳破了一层泡沫:广泛使用的评测存在可信度问题,无效题率从 MMLU Math 的 2% 到 GSM8K 的 42% 不等。
当所有前沿模型都能考满分,考卷本身反而成了最该被审计的东西。
「活干得飞快,可我的 Fable 额度反而比以前掉得更慢了。」
— Simon Willison(独立开发者,个人博客 Notes,07-03)· Simon Willison.net
「公开市场从不缺数据。」
— Grishin Robotics(评 LinqAlpha,07-02)· PR Newswire
7 月 2 日,纽约 AI 公司 LinqAlpha 宣布完成 2200 万美元 A 轮,由 AVP、Atinum、GFT Ventures 领投。其定位是为公开市场做”多智能体投研”,让每家机构用自己的研究框架训练出能提前发现市场信号的 AI Agent。
官方称已服务美欧亚数十家金融机构,客户合计管理规模超 5 万亿美元。
金融是 Agent“可信度即生命”的硬场景—它示范了垂直 Agent 如何靠”学你的判断”而非”通用大模型”建立壁垒。
门槛不在模型,在于你把行业 know-how 喂给了它多少。
Google 宣布将在 2027 年 6 月 25 日后停止 Google Earth Pro 桌面应用的下载。这个诞生于 2000 年代初期的桌面 GIS 工具,曾是无数地理、建筑、环境从业者”看世界”的窗口—从 3D 建筑模型到历史影像回溯,从 GIS 数据导入到高清打印输出。
2015 年转为免费后成为最广泛使用的专业地图工具之一。
退场的直接原因是 Google 的资源向 Web 版倾斜,但深层信号是:桌面 GIS 时代正在被云端 + AI 驱动的空间计算取代。
正如 Google Earth Pro 开启了一个时代,它的退场也在标记一个新阶段的开始。
今天几条新闻拼出同一幅画面:钱在流向 AI,但人在挑。
OpenAI 拿到商务部批文,GPT-5.6 全球放开—这是监管层面的绿灯。
同一天,Momenta 在港股近持平开盘,AI IPO 从”无脑追”变成了”看看再说”。
更早一天,摩根士丹利喊半导体的涨法不对,建议从芯片转向能真正从 AI 赚到钱的云厂商。
而本周融资榜首给了休斯顿能源公司 Joulent(17.5 亿美元战略融资),人形机器人 Zeroth 拿下蚂蚁领投的 5 亿元—钱正从”租模型”转向”造身体、供电、落地”。
三个信号指向同一个结论:AI 投资进入了”挑食期”,看谁先把钱变成收入。
巴塔哥尼亚的安第斯山脉,在 2026 年南半球初秋被一层新雪勾出轮廓。
Snow in the Shadow of the Andes · NASA · 45.00°S, 72.00°W
看了一天 AI 的新闻,地球上还有不需要 GPU 冷却的地方。山川湖海,让我们保持好奇、继续探索。