AI Intelligence Briefing
AI 情报日报
2026-07-08 · 周三 本期 11 条
Voices
声音

「前沿模型的竞争力最终要落在可验证的真实任务与成本结构上。」

Mira Murati · 技术研究者

「审慎本身正在成为竞争力的一部分,能力跃迁必须与护栏同步。」

Demis Hassabis · DeepMind 联合创始人

Lead Story
今日头版
GPT-5.6 获批大范围上线,周四全球发布,但真正的硬仗才刚刚开始

美国商务部批准 OpenAI 大范围发布 GPT-5.6 系列。Axios 独家报道后获多方确认:三款模型 Sol、Terra、Luna 将在周四(7 月 9 日)向所有用户开放。
上个月应政府要求紧急限制访问后,经过数周 CAISI 框架下的额外安全测试,联邦政府最终放行。

这次放行标志着一个转折—此前 GPT-5.6 仅限少数经过审查的合作伙伴访问,细节需报备当局。
如今面向全球开放,意味着美国政府的 AI 安全审查框架从”堵”转向了”测完即放”。3 款模型撑起这次放行。

  • 三款模型:Sol(旗舰)、Terra、Luna
  • 此前因国家安全担忧被限制,经政府额外测试后放行
  • CAISI 框架:美国前沿 AI 监管从「堵」转向「测完即放」
  • Preview 访问即日起全球开放,正式发布 7 月 9 日
GPT-5.6 获批大范围上线,OpenAI 三款模型全球开放
Frontline
前线
NotebookLM 变身 AI 工作台,云端代码 + 自动图表 + 来源搜索,但真正的硬仗才刚刚开始

NotebookLM 从”笔记助手”进化为一个带工作台的 AI 研究环境。Google 在 6 月底的更新中给 NotebookLM 装上了 Gemini 3.5、一个安全的云端计算机(可写代码跑分析),并接入了 Google 搜索自动找源。
用户可以从一个模糊想法起步,让 NotebookLM 自己找资料、跑数据、生成 PDF 报表或预算表格。

这中间有两个实用变化:一是上百个预置软件技能让模型能处理专业任务(数据清洗、格式转换、图表生成),二是输出格式扩展到 PDF 报告、预算表、课程作业纸,且支持生成后二次编辑。
对经常需要从零搭建研究框架的人来说,这不只是一个升级—它在变成一个新的工作入口。

  • 运行 Gemini 3.5 + Antigravity,推理和准确性升级
  • 内置云端计算机,可写代码跑分析(100+ 软件技能)
  • 可搜索网络自动找源,从模糊想法开始搭建研究
  • 输出格式:PDF 报告、图表、预算表、课件,支持生成后编辑
  • 面向 AI Ultra 及 Workspace 企业客户开放
NotebookLM 升级为带云端代码和自动图表的 AI 工作台
Momenta 港股首日近持平开盘,750 亿港元 IPO 遇冷

Momenta Global 今天在港交所首日交易,开盘价 HK$301,较发行价 HK$295.60 仅微涨 1.8%,盘中最高 HK$314.80 后回落至 HK$299 附近。IPO 募资约 58.9 亿港元,公开发售部分 413.6 倍超额认购,但首日表现平淡。

Momenta 由前微软研究员曹旭东 2016 年创立,为丰田、比亚迪等车厂提供辅助驾驶方案。
截至今年已交付超 100 万台量产车,2025 年授权服务收入从 2 亿跃至 9.7 亿人民币。
基石投资者包括梅赛德斯-奔驰、贝莱德、博裕资本。

  • 开盘持平,首日表现谨慎,AI IPO 从「无脑追」到「挑着买」
  • Momenta R7 世界模型已量产,合资伙伴覆盖全球前十大车企中的九家
  • 技术授权服务收入 2025 年 9.7 亿人民币,从 2 亿起步三年近 5 倍
  • 募资 60% 用于研发:升级算力、扩大数据存储、扩建工程团队
Momenta 港交所首日交易,自动驾驶公司港股 IPO
欧盟发布《网络安全与 AI 行动计划》,把”矛与盾”变成协调机制

7 月 7 日,欧盟委员会正式发布《Action Plan on Cybersecurity and AI》。计划指出:AI 既可用于发现漏洞、预防攻击、加固关键基础设施,也可能被恶意方用来自动化攻击、以前所未有的速度和规模发起网络行动。
欧盟将联合成员国、产业与欧盟层面机构,共同强化数字基础设施的韧性。

这是把”AI 既是矛也是盾”从口号变成协调机制的一步。
继此前的合规执法期之后,欧盟正把监管从”模型本身”延伸到”模型带来的安全外部性”—不再只问模型训练得合不合规,也要问它上线后会怎样被用、被攻。

  • AI 用于防御:发现漏洞、加固关键基础设施
  • AI 也用于攻击:自动化、规模化网络行动
  • 监管从「模型本身」延伸到「安全外部性」
  • 欧盟 + 成员国 + 产业三方协调机制
Liquid AI 把”复读死循环”砍掉九成,小模型终于不原地打转了

Liquid AI 开源 Antidoom,针对的是推理小模型的著名翻车:陷入循环反复输出同一 token,直到把上下文耗尽。
方法叫 FTPO(最终 token 偏好优化),把触发循环的那个 token 重新标注、把概率重分配给替代项。

数字很硬:greedy 采样下 LFM2.5-2.6B 的死循环率从 10.2% 降到 1.4%,Qwen3.5-4B 从 22.9% 降到 1%,且下游评测同步受益。这是当下研究转向的缩影:不堆参数,精准拆特定失败模式。

当模型尺寸不再增长,把每个已知失败模式拆掉,就是新的提升路径。

法律 AI 测出残酷真相,最强模型全过率只有 14.2%—但资本照样砸 1.2 亿美元估值

Harvey 与 Artificial Analysis 发布 Harvey LAB-AA 法律 agent 基准:120 道私有法律任务、24 个执业领域,要求端到端产出合规交付物。
结果最强模型 Fable 5 全过率也只有 14.2%,Opus 4.8 与 GLM-5.2 并列 7.5%—而 GLM 的单任务成本只有 Fable 的约 6%。

消息本身很扎心:模型能通过大量单项评分,却仍交不出合格的端到端成果
单项强不等于能用,这层差距第一次被一个垂直基准量化。

但资本没等。
同一天 Norm Ai 完成 $1.2B 估值、1.2 亿美元 C 轮,主打”全栈 agentic law“。
法律 AI 的两条线同时推进:评测在揭短,钱在加注。

垂直行业的胜负手不是模型总分,是能不能把最后一段交付做好。

Open Source Frontline
开源前线
LeRobot v0.6.0 发布,把”训练—评估—改进”开源化

Hugging Face 7 月 7 日发布 LeRobot v0.6.0(主题”Imagine, Evaluate, Improve“)。这个机器人学习框架继续把”训练—评估—改进”的工具开源化,让更多人能上手做真实世界的机器人策略,而不只是盯着 benchmark 跑分。

它呼应了本周的一条暗线:当最强模型越来越便宜、越来越开放,稀缺价值正从”算法”转向”能动手的身体”和真实场景数据。
开源框架把造机器人的门槛往下拉了一截。

  • 主题:Imagine, Evaluate, Improve(想象—评估—改进)
  • 训练—评估—改进工具开源化
  • 降低真实世界机器人策略的开发门槛
Hugging Face LeRobot 开源机器人学习框架 v0.6.0
Hugging Face Blog
GUI Agent 登顶日榜,但评测本身正在”翻车”

HF 7 月 7 日论文日榜由《UI-MOPD》领跑(53 赞)—它聚焦让操作图形界面的 Agent 跨平台持续学习、不”学了新的忘了旧的”。
研究热度正从”更大的模型”转向”Agent 怎么稳定地长期变强”。

但同一天,斯坦福 2026 AI Index 戳破了一层泡沫:广泛使用的评测存在可信度问题,无效题率从 MMLU Math 的 2% 到 GSM8K 的 42% 不等。
当所有前沿模型都能考满分,考卷本身反而成了最该被审计的东西。

  • UI-MOPD:GUI Agent 跨平台持续学习,避免「学新忘旧」
  • 研究重心从「更大模型」转向「Agent 长期变强」
  • Stanford:常用基准无效题率最高达 42%
  • 度量危机:模型满分了,考卷反而该被审计
Stanford HAI 2026 AI Index 报告:评测基准的度量危机
Voices
声音

「活干得飞快,可我的 Fable 额度反而比以前掉得更慢了。」

— Simon Willison(独立开发者,个人博客 Notes,07-03)· Simon Willison.net

「公开市场从不缺数据。」

— Grishin Robotics(评 LinqAlpha,07-02)· PR Newswire

Tools & Making
创造
LinqAlpha,把”数据”拧成”判断”的投研 Agent

7 月 2 日,纽约 AI 公司 LinqAlpha 宣布完成 2200 万美元 A 轮,由 AVP、Atinum、GFT Ventures 领投。其定位是为公开市场做”多智能体投研”,让每家机构用自己的研究框架训练出能提前发现市场信号的 AI Agent。

官方称已服务美欧亚数十家金融机构,客户合计管理规模超 5 万亿美元。
金融是 Agent“可信度即生命”的硬场景—它示范了垂直 Agent 如何靠”学你的判断”而非”通用大模型”建立壁垒。
门槛不在模型,在于你把行业 know-how 喂给了它多少。

  • 多智能体投研:用机构自己的框架训练 Agent
  • 服务 70+ 金融机构,客户 AUM 超 5 万亿美元
  • 垂直 Agent 的壁垒 = 学你的判断,不是通用大模型
LinqAlpha 完成 2200 万美元 A 轮,做公开市场的多智能体投研
Visual
视觉
Google Earth Pro 退场,桌面 GIS 时代的句号

Google 宣布将在 2027 年 6 月 25 日后停止 Google Earth Pro 桌面应用的下载。这个诞生于 2000 年代初期的桌面 GIS 工具,曾是无数地理、建筑、环境从业者”看世界”的窗口—从 3D 建筑模型到历史影像回溯,从 GIS 数据导入到高清打印输出。
2015 年转为免费后成为最广泛使用的专业地图工具之一。

退场的直接原因是 Google 的资源向 Web 版倾斜,但深层信号是:桌面 GIS 时代正在被云端 + AI 驱动的空间计算取代。
正如 Google Earth Pro 开启了一个时代,它的退场也在标记一个新阶段的开始。

  • 2027 年 6 月 25 日起停止下载,已安装用户可继续使用
  • Google 建议迁移至 Web 版 Google Earth
  • 桌面 GIS 工具被云端 + AI 空间计算取代
Google Earth Pro 桌面应用界面截图
The Verge
Capital
投资
AI 资本市场的分化信号,放行、冷开、挑估值、转供电

今天几条新闻拼出同一幅画面:钱在流向 AI,但人在挑。

OpenAI 拿到商务部批文,GPT-5.6 全球放开—这是监管层面的绿灯。
同一天,Momenta 在港股近持平开盘,AI IPO 从”无脑追”变成了”看看再说”。
更早一天,摩根士丹利喊半导体的涨法不对,建议从芯片转向能真正从 AI 赚到钱的云厂商。

而本周融资榜首给了休斯顿能源公司 Joulent(17.5 亿美元战略融资),人形机器人 Zeroth 拿下蚂蚁领投的 5 亿元—钱正从”租模型”转向”造身体、供电、落地”。
三个信号指向同一个结论:AI 投资进入了”挑食期”,看谁先把钱变成收入。

  • GPT-5.6 放行 = 监管绿灯,商业化加速
  • Momenta 冷开 = AI IPO 叙事从「追」到「挑」
  • Joulent 17.5 亿美元登融资榜首 = 电比模型贵
  • Zeroth 5 亿元 = 钱从「租模型」转向「造身体」
AI 资本市场分化信号:本周最大融资轮次
Takeaway
小结
监管松口的同一天,资本市场在说”慢一点”,而钱正悄悄从”租模型”挪到”造身体、供电、落地”。欧盟把 AI 安全写进协调机制,开源社区把机器人框架往下拉门槛—这一期的主角,从”谁的模型最强”换成了”谁能给它供电、给它身体、给它可信的度量”。
Be Curious
Be Curious

巴塔哥尼亚的安第斯山脉,在 2026 年南半球初秋被一层新雪勾出轮廓。

NASA 卫星影像:Snow in the Shadow of the Andes

Snow in the Shadow of the Andes · NASA · 45.00°S, 72.00°W
看了一天 AI 的新闻,地球上还有不需要 GPU 冷却的地方。山川湖海,让我们保持好奇、继续探索。