AI 情报日报 · 前沿信号流

AI 情报日报

2026-07-05 星期日 No.056 8 条现场

今天刻意把镜头从几个大厂移开。头版是一个独立研究者找到了 Mythos 漏掉的 Linux 内核漏洞。前线是中国开源模型、初创机器人数据工厂、以及特斯拉给 AI 账单踩刹车。大厂动态压成信号条。

HEADLINE
今日头版

一个人找到了顶级 AI「看漏」的 Linux 提权漏洞

Bad Epoll: Linux root提权漏洞概念图

Bad Epoll(CVE-2026-46242):藏在 epoll 系统调用中的 use-after-free 竞态条件。图:The Hacker News。

新披露的 Linux 内核漏洞 Bad Epoll(CVE-2026-46242)允许一个无特权用户直接获取 root 权限。它藏在 epoll 子系统的竞态代码里,属于 use-after-free 类型,同一段代码中,Anthropic 的旗舰模型 Mythos 此前找到过另一个 bug,却漏掉了这一个。

漏洞由独立安全研究员 Jaeyoung Chung 发现并作为 0-day 提交给 GooglekernelCTF 计划,该计划对内核 exploit 的奖励为 71,337 美元起。

Chung 在 GitHub 上发布了完整的技术复盘,指出竞态窗口「只有约 6 条指令宽」,需要精确控制 CPU 调度和 slab 分配器的状态才能稳定触发。

漏洞影响 Linux 6.4 及以上版本,覆盖主流桌面发行版、服务器和较新 Android 设备。Chung 给出的 PoC 可靠性达 99%。补丁由内核社区在数月内完成,但首次修复不完整,最终正确补丁用了近两个月才落地。这起事件再次暴露了一个现实:即使最先进的 AI 代码审查系统,也无法替代人类对复杂竞态条件的直觉。

当全世界都在说「AI 会自动挖洞」时,这条给出了最锋利的反例,同一段代码,AI 看过、漏了,人补上了。判断力仍然稀缺。

The Hacker News · thehackernews.com / 作者复盘 · github.com

DISPATCH
前线

GLM-5.2:目前最强的纯文本开源权重模型,来自中国

智谱AI GLM-5.2 模型示意图

GLM-5.2:753B MoE、100万 token 上下文、MIT 许可。图:Z.ai。

不是 OpenAI、不是 Anthropic,被一线开发者反复点名最强开源权重的,是北京 智谱 AI(Z.ai)的 GLM-5.2753B 参数 MoE(每次推理约激活 40B),支持 100 万 token 上下文,以 MIT 许可放出完整权重,这意味着商用几乎无限制。

Simon Willison 在评测中称其「可能是最强的纯文本开源权重 LLM」。在多个中文和英文基准测试中,GLM-5.2 在代码生成、数学推理和长文档理解等维度上超越了同量级竞品。智谱 AI 是 GLM 系列的长期推动者,从 2023 年的 ChatGLM 一路迭代到今天的 5.2,并始终保持着开源路线。

开源权重正在把「只有大厂能做前沿模型」的假设一点点凿穿。MIT 许可意味着任何人都可以基于它构建产品,这对全球 AI 生态的格局影响可能比某个闭源模型的发布更深。

Simon Willison · simonwillison.net / Z.ai · z.ai

ZCode 来了:智谱给 GLM-5.2 配了官方 IDE,把「拿开源模型干活」做成默认

智谱没有只发一个 checkpoint,还顺手给 GLM-5.2 铺了一圈产品面:ZCode 是官方开发环境,支持自带 API key(BYOK)、跨平台,coding-plan 订阅用户还有额度加成,面向 GLM 工作流和长时自主任务优化的 AI 原生编码 IDE。

生态跟得也快:LangChain 出了 GLM-5.2 编码指南,其 CEO 直接点名「开发者正把 GLM-5.2 当日常主力模型」。

Mercor 的评测把 GLM-5.2 列为 APEX-SWE 上第一个领跑某个类别的开源模型(Integration 类 55.3% Pass@1),Kimi K2.7 紧随其后。「最强开源权重」正在从一句评价,变成一套能天天用的工作流。

vLLM 也补齐了配套:原生支持 DeepSeek 的 DSpark 投机解码,8×B300 上跑到约 250 tok/s;GLM-5.2 的 DSpark 预览声称解码再快约 1.5 倍。开源模型的能力,正在被工程配套一件件抬起来。

Z.ai · x.com/@Zai_org / Mercor / vLLM · x.com/@vllm_project

浏览器里跑起 Gemma 4:M4 上 255 tok/s,内核是 Fable 5 写的

Google 晒出 WebGPU 上的 Gemma 4:在苹果 M4 上跑到 255 tok/s,提速的关键是用 Claude Fable 5 写的 WebGPU 内核,模型自己生成的代码,优化了它自己将要运行的推理路径。

同一条线,开源社区还拼出了完全开源的实时语音栈:Gemma 4 31B + Cerebras 推理,目标当 OpenAI 实时 API 的平替;Hugging Face 内核库也开始收录 MiniMax 的 MSA 内核。

端侧推理正在从「能跑」走向「跑得快」,当浏览器和手机都能本地跑像样的模型,云端的垄断叙事又被削掉一块

Google · x.com/@googlegemma / 实时语音栈 · x.com/@andimarafioti

特斯拉给每位工程师的 AI 开销封顶 200 美元/周

特斯拉 AI 花费上限政策

特斯拉从 7 月 6 日起对全体员工实行每周 200 美元 AI 花费上限。图:Electrek。

连把未来押在 AI 上的公司,也开始为 token 账单踩刹车。特斯拉从 7 月 6 日起对全体员工实行每周 200 美元的 AI 花费上限,超出部分需经理审批。此前部分工程师在 AI 工具上的每周开销达到数千美元。

这条消息引发了行业内的广泛共鸣,AI 能力的提升速度远超公司治理体系的跟进速度。最常被引用的反面案例是 Uber:该公司曾给约 5000 名工程师无护栏铺开 Claude Code 的使用权限,结果四个月内烧掉了 34 亿美元的 AI 预算。最终 Uber 不得不紧急叫停并重新设计预算管控流程。

真正的问题:AI 的投入回报变成了一笔糊涂账。每个工程师都能在几分钟内消耗数千美元,成本缺乏可见性,这才是根因。这不是技术问题,是管理问题。

Electrek · electrek.co / The Information

Apptronik 开「机器人公园」:用真实数据工厂喂养人形机器人

Apptronik Apollo 2 人形机器人在Robot Park中作业

Apptronik 的 Apollo 2 人形机器人。图中为双足版本,此外还有轮式变体。图:Apptronik。

机器人公司 Apptronik 在奥斯汀启用了一座近 9 万平方英尺的 Robot Park,让成队的 Apollo 2 人形机器人在逼真的物流、制造和零售环境中反复执行真实操作任务,同时采集训练数据。Apollo 2 提供双足与轮式两种形态,以适应不同场景需求。

Robot Park 的数据采集链路与 Google DeepMind 的具身智能模型训练管线直接打通。Apptronik 同时预告了首个真正意义上的产品级版本 Apollo 3,称其将在可靠性、成本和部署便捷性上达到商业量产标准。

人形机器人的最大瓶颈始终是数据,实验室模拟数据和真机操作数据之间存在巨大的 Sim-to-Real 鸿沟。Robot Park 的赌注是:规模化采集真实操作数据,是跨越这道鸿沟的唯一路径。

大模型的下一个战场是物理世界的数据。谁能规模化采到真实操作数据,谁就握住了具身智能的燃料。

Reuters · reuters.com / Apptronik · apptronik.com

VOICES · 一线原话
声音

「你得把代码理解到能够继续参与的深度。」

Geoffrey Litt · 经 Simon Willison 转述 · simonwillison.net

「The race window is tiny, only about six instructions……」

Jaeyoung Chung · 报告 Bad Epoll 漏洞的研究者 · github.com

MAKERS · AI 产出了什么
创造

首部全 AI 生成长片登上翠贝卡电影节,也点燃了抵制

Dreams of Violets 电影画面截图

《Dreams of Violets》剧照:影片使用 AI 视频工具根据新闻报道和目击者证词重建了 2026 年伊朗抗议事件。图:Variety。

一部每一帧都由 AI 生成的 75 分钟纪实剧情片《Dreams of Violets》,成为纽约 翠贝卡电影节史上首部全 AI 长片。

影片由科技创业者兄弟 Ash 与 Pooya Koosha 执导,取材自 2026 年 1 月伊朗全国抗议与安全部队镇压事件,国际组织估算死亡人数超过 7000 人。全部影像基于新闻报道、照片和目击者证词由 AI 视频工具生成。

影片在电影节上引发了激烈争论。一面是技术探索者的欢呼,认为这是 AI 叙事能力的里程碑;另一面是大量电影人和伊朗裔艺术家的公开抵制,指责影片「窃取了真实受害者的故事,并用 AI 替代了人类创作者」。

Koosha 兄弟辩护称他们希望通过 AI 让被主流媒体忽视的悲剧获得关注,而批评者则认为这恰恰剥夺了当事人和记者用自己的声音讲述的权利。

生产门槛塌掉之后,稀缺的变成了谁有权讲、讲什么、代价谁来担。

Variety · variety.com / Deadline · deadline.com

MONEY · 钱在流动
投资与资金流向

Patronus AI 的 5000 万美元 Series B:用数字孪生世界压力测试 AI agents

Patronus AI 完成 5000 万美元 Series B,估值不详。它的方法很独特:用 digital world models,对真实系统的高保真数字孪生,来压力测试 AI agents。

传统 AI 安全测试依赖静态基准集,Patronus 的做法是让 AI agent 在一个模拟的完整业务环境中自主运行,观察它是否会在复杂场景下做出危险行为。

这项技术的价值在 agent 大规模部署的当下尤为突出,你不可能让一个可能出错的 agent 在真实客户数据上试错。Patronus 的 investors 包括 Lightspeed 和 NEA。公司称其客户覆盖金融、医疗和电商领域,部分客户已将 digital world model 测试嵌入 CI/CD 管线。

当 agent 从 demo 走向生产,验证层的价值会越来越大,谁负责安全验证,谁就有定价权。

Patronus AI 的 5000 万美元 Series B:用数字孪生世界压力测试 AI agents

Patronus AI 的 5000 万美元 Series B:用数字孪生世界压力测试 AI agents。

TechCrunch

SIGNALS · 快讯
信号条

Five Eyes 联合警告:前沿 AI 让「能发动重大网络攻击」的时间表以月计而非以年计;CISA 要求联邦机构 3 天内打补丁。6 月非农仅 +5.7 万(预期 18.5 万),AI 被列为结构性因素之一。

Menlo Ventures 募得 30 亿美元新基金,其持股的模型公司股权已值近 140 亿美元。LiteLLM 曝安全漏洞,泄露多家供应商 API key。GPT-5.6 Sol 仍被政府锁在限量预览,约 20 家机构可用。Mythos Fable 5 计费悬崖 7 月 7 日到期,订阅内 50% 额度福利结束。

THE WRAP
今日小结

今天刻意求杂,信源覆盖独立研究者、中国开源实验室、初创机器人公司、好莱坞、VC 战场:

「AI 找漏洞」的叙事需要校准,Bad Epoll 证明同一段代码 Mythos 看过、漏了,人补上了。

开源权重正在凿穿只有大厂能做前沿的假设,GLM-5.2 以 MIT 许可放出 753B 参数,商用无限制。

AI 的成本治理正在成为显学,特斯拉封顶、Uber 烧掉 34 亿,入口和验证层成为资本新猎物。

今天覆盖 5 家公司 + 1 位独立研究者,信源包括 The Hacker News、Reuters、TechCrunch、Variety、Electrek、Simon Willison 等。
Stratechery
BE CURIOUS 🌌
保持好奇
从卫星看佛得角,西非萨赫勒地带

Cape Verde · 15.0°N, 23.5°W
人口 52 万、面积比崇明岛还小—佛得角却是本届世界杯最让人尊敬的球队。法定时间对西班牙、乌拉圭、阿根廷三支前冠军保持不败。场外更猛:华为给他们建了数据中心和电子政务平台,12 月要办 Web Summit(首次登陆非洲),目标是当「西非的爱沙尼亚」,用 AI 和数字经济逆转人才外流。
看了一天 AI 的新闻,还有更大的世界等着探索。