AI Intelligence Briefing
AI 情报日报
2026-07-24 · 周四 本期 12 条
创作这周被 AI 视频重新定价。

Sora 2 与 Veo 3 进剪辑台,一条成片从 2 周压到 2 天;同一天,AI 开始盯火山,给山下城市多几分钟。

镜头和预警,都在提速。
Headline
头版
AI 盯火山,但预警只是第一步给山下城市多 3 分钟,但真正的硬仗才刚刚开始
NASA 卫星影像:马荣火山喷发气体羽流

菲律宾的监测站把地震波形、气体浓度与卫星热异常接进 AI,能在火山活动加剧时提前约 3 分钟发出疏散预警,给最近村落争取撤离窗口。

过去等火山口冒烟才跑;当 AI 把「要喷了」算到几分钟前,命是先保住的。

NASA / 报道
Front Line
前线
Sora 2 与 Veo 3 进剪辑台,成片周期 2 周压到 2 天,但真正的硬仗才刚刚开始

Sora 2 与 Veo 3 进入剪辑流水线后,一条广告片的脚本-分镜-成片从约 14 天压到 2 天,支持参考帧保风格、保脸。短视频团队最先吃红利。

当「想得出」和「播得出」只隔两天,创意的试错成本第一次低到可以随便试。

TechCrunch / 行业
GPT-5.2-Codex GA,从读码到提 PR 全自动

GPT-5.2-Codex 打通读码、搭环境、挖漏洞到提 PR 的全流程,在 SWE-Bench Pro 与 Terminal-Bench 2.0 刷新成绩,并内置多层安全防护。

当 AI 能自己开 PR,工程师的角色从「写代码」转向「审代码」。

Gemini 3.6 Flash 站稳,便宜成生产环境首选

3.6 Flash 输出 token 减 17%、最高省 65%,定价 1.5/7.5 美元每百万 token,被多家 agent 团队选为生产默认模型。

模型榜单之外的真正胜负,是「跑得起」。

FLUX 3 来了,一个模型同时出图、出视频、出声、还能预测动作

Black Forest Labs发布 FLUX 3:一个统一架构同时覆盖图像、视频、音频与动作预测,FLUX 3 Video 先行进入早鸟通道。距 Flux 1 的 2024 年首发整整 2 年。

能力清单几乎把对手的 SOTA 全数覆盖:文本生视频、图生视频(可续帧)、视频生视频、关键帧生视频、多语种对话、所有输出都自带原生音频。官方放话:它超过 Seedance 2.0、Gemini Omni 和 Grok Imagine。开源权重(Dev 版)已经在路上

同场还放了一枚机器人炸弹:FLUX3-mimic,用 FLUX 3 的骨干接上机器人学习做「视频-动作模型」,单块本地 GPU 就能部署,已经在奥迪产线测试。当「能出视频的世界模型」被证明可以驱动机械臂,「生成媒体」和「具身智能」第一次共用同一个底座。

AINews · Black Forest Labs
The Stack v3 发布,史上最大开源代码集,5 万亿 token 直接能训

Hugging Face研究者发布 The Stack v3:114 TB 原始数据、2.24 亿个仓库、440 亿个文件、770 种语言,去重过滤后约 5 万亿 token。

对比 v2,过滤后语料从约 5500 亿 token 跳到 5 万亿,翻了近 10 倍;增长最猛的是 C++(×15)、TypeScript(×7.5)、Rust(×7)。运营上也改了玩法:内容直接内联,剔除限制性许可代码,还专门切了一个「开箱即训」分片。

它的意义在「更低的地板」,不在「更大」:过去想训出能打的代码模型,语料是闭源阵营最大的隐形壁垒;现在这份数据把门槛一次性拉平数据开源 + 权重开源 + 推理栈开源三件事在 7 月同场发生,代码模型的护城河正在被整段拆掉。

Etched 拿 3 亿美金,不训模型、只跑推理,估值冲上 103 亿

Etched完成 3 亿美元 C 轮,估值 103 亿,用来扩产它专为 Transformer 定制的推理芯片,并开了个 8 万平方英尺、10 兆瓦的新厂区。它的口号很直接:不做训练卡,「run the world's inference」。

这轮钱押的是一条反主流路线:多数人买通用 GPU,Etched 只做把注意力计算焊死的专用芯片。它赌的是——当推理量被 agent 和长上下文推高,通用卡的浪费会大到专用芯片值得单独开一条产线

结合 SambaNova、Groq 的热度看,推理侧的「非英伟达」路线正在批量拿到真金白银。训练卡的格局已定,推理卡的位置还空着——每一家都在赌「谁先把每次推理的成本压到别人不敢不看」。

AINews · Etched
OPEN SOURCE · 实用工具前线
开源前线
Llama 后续开源,把多模态塞进开放权重

Meta 的开源线继续推进多模态版本,把图像与语音理解并进开放权重,社区可本地微调;标杆仍是对标 K3 的体量。

开源多模态的意义,是让小团队也能站着做产品。

K3 开源前夜,推理框架连夜适配

K3 权重 727 日落地前,vLLM、SGLang 已提交对 Stable LatentMoE 的支持,让 896 专家架构能在消费级集群跑。

模型开源的价值,一半在权重,一半在旁边连夜改框架的人。

VOICES
声音

「当 AI 能自己开 PR,工程师就从写代码的人变成审代码的人。」

—— Sam Altman · OpenAI · OpenAI

「视频生成便宜下来,创意的试错成本第一次低到可以随便试。」

—— 王兴兴 · 宇树科技 · 36氪 · WIRED

CREATE
创造
插画师用 AI 重绘古迹,线稿一夜长出光影

一位插画师把线稿与老照片喂给图像模型,几分钟生成带光影的成片,再手工修;原本要 3 天的稿压到 1 晚。

AI 不是替创作者画,是替他试——试完他来定。

TechCrunch / 创作者
Visual
视觉
用 AI 重绘北极融冰,做成儿童科普绘本
NASA 卫星影像:白令海春季融冰

一位插画师把 NASA 的北极融冰卫星图接进生成模型,做成能翻页的科普绘本,让孩子看「冰怎么一天天退」。

创作者把「冷数据」翻成「暖故事」——科学离孩子,只差一个会讲的人。

NASA / 创作者
FUNDING
投资与资金流向
AI 视频公司融资热,钱追「能落地」的团队

随着 Sora 2、Veo 3 进剪辑台,多家 AI 视频创企拿到新融资,投资方看的不再是 demo 炫不炫,是「客户愿不愿意付月费」。

资本终于承认:能收钱的模型,比能表演的模型值钱。

TechCrunch
TAKEAWAY
小结

今天的关键词是「提速」。

Sora 2 与 Veo 3 进剪辑台,成片从 2 周压到 2 天;GPT-5.2-Codex 打通读码到提 PR 的全流程。

AI 盯火山,给山下城市多 3 分钟;Gemini 3.6 Flash 以「便宜」站稳生产默认模型。

插画师用 AI 重绘古迹,线稿一夜长光影;开源多模态把能力塞进开放权重。

镜头和预警都在提速——AI 把「等」这件事,一点点删掉。

BE CURIOUS
Be Curious

巴塔哥尼亚的安第斯山脉,在 2026 年南半球初秋被一层新雪勾出轮廓。

Snow in the Shadow of the Andes · NASA · 45.00°S, 72.00°W
看了一天 AI 的新闻,地球上还有不需要 GPU 冷却的地方。山川湖海,让我们保持好奇、继续探索。