OpenAI 的 GPT-5.6 本周开始接入 Microsoft 365 Copilot—这意味着数亿办公用户会在 Word、Excel、Outlook 里直接调用当前最强的前沿模型(编码智能指数冲到 80 分),而不只是打开一个聊天框。模型落地的方式变了:从”去一个 AI 网站”变成”在每天用的软件里它就在那儿”。
对普通人来说,AI 从工具清单上的一个新图标,变成了默认入口本身。
前沿实验室 推出 ChatGPT Work—一个能跨应用和文件执行任务的 agent,可生成文档、表格、演示文稿和 web 应用,持续处理数小时的长项目。它内置 Codex 技术,ultra 模式下协调 4 个 agent 并行。
真正的变化,是它从”更会写”走向”替你跑完一整段工作流”:从拉取上下文到产出成品,中间不再需要人一步步指挥。
GitHub Copilot 宣布支持接入 GPT-5.6 等前沿模型,并按实际用量计费。开发者不再被锁死在单一模型后端;企业也开始能按 token 核算 AI 编码的真实成本,三层定价 Sol $5/$30 每百万 token 成为可对照的标尺。
当”换模型”和”看账单”都变成普通操作,AI 编程工具的竞争就从”谁的模型强”转向”谁让模型更好用、更可控”。

GitHub Copilot 接入 GPT-5.6,模型开始可换、计费开始透明。
前沿实验室 将”生物安全漏洞赏金”常态化,最高 5 万美元 奖励发现 GPT-5.6 可被用于生物风险的越狱或滥用路径的研究者。这不再只是一次性的公关动作—把”模型越强、越要有人专门找它的危险用法”写进日常运营。
前沿模型的能力边界,正用真金白银的赏金来测绘。
GPT-5.6 把模型分成 Luna / Terra / Sol 三档再加多档 effort,API 上可选的组合多达 36 种,普通用户却只看到一根滑块。社区实测后的共识是「三档三用」:日常编码用 Luna high,想要更好质量用 Luna xhigh;中等任务 Terra medium;跨仓库改动才轮到 Terra high。Sebastian Raschka 给出的经验法则更直接,除非要 Terra Ultra 级性能,否则一律 Luna 加高 effort 设置,性能持平还更便宜。
用户的抱怨集中在两处:一是 30 多种组合让人无所适从,还缺「自动路由」选项;二是 $200 Pro 计划越来越难自证划算,Sol、Terra、Luna 各有各的限额和单价,你不再只是「选最好的模型」,得先算清楚「这个月怎么花不亏」。
当模型按「档位」卖而不是按「型号」卖,定价的复杂度本身就成了新的用户门槛。
前沿实验室 产品负责人 Fidji Simo 宣布卸任全职岗位,转为兼职顾问,理由是长期慢性病需要休养。她此前从 Instacart CEO 任上被挖来掌舵 ChatGPT,过去两年正是 ChatGPT 从工具变成「超级应用」的阶段,GPT-5.6 的发布也刚在上周完成。
在 前沿实验室 冲刺「超级应用」叙事的当口,把产品一号位换成顾问席,至少说明这家公司愿意在产品节奏上松一口气。当 ChatGPT 已不再需要「救火队长」,前沿实验室 的管理重心正在从增长转向维稳。
据多方信源,北京方面正与主要 AI 实验室讨论限制最先进模型的海外访问,智谱(THUDM)等国产前沿模型的出海路径被重新审视。当训练出的模型不再只是产品,更被中美两边同时纳入战略资产考量,开源与出海的边界就会越收越紧。
对做应用的人来说,能稳定拿到的模型权重,本身就是一种供给风险。
阿里巴巴旗下 inclusionAI 开源 Avernet—一个面向多 agent 协作的框架,让多个专精 agent 分工完成复杂任务,并带可观测与调度能力。开源社区对”agent 怎么一起干活”的答案越来越具体:不堆一个更大的模型,把任务拆给会配合的专职智能体。
普通人能用它搭自己的小团队,而不是等一个大公司在黑箱里替你排。
NousResearch 开源 hermes-agent—一套强调本地部署、可自托管的 agent 工具链,把”你的 agent 跑在你自己的机器上”做成默认选项。和云端托管相反,数据与控制权都留在用户这一侧。
对在意隐私和可控性的人,这是另一条路:能力不一定最强,但你知道它在哪、归谁管。

NousResearch 开源 hermes-agent:本地就能跑的 agent 栈。
DeepSeek 发布并开源 V4,延续”用工程效率对抗算力劣势”的路线,在更少算力下逼近前沿模型表现,不堆 万卡 集群也能打。它的意义不在某一个榜单分数,而在反复证明:前沿能力不一定只属于堆得起万卡集群的巨头。
开源权重意味着任何人都能拿去改、拿去跑—模型能力的扩散,比任何发布会都更难收回。
「我们的监管框架没准备好应对自主智能体—指望每个动作都靠人兜底,不现实。」
— Sarah Breeden · 英格兰银行副行长 · 7/11
「实验室不必为每个下游滥用负责,但有义务预见可预见的伤害。」
— Rachel Adams · 全球 AI 治理中心 · 7/11 · U.S. News / Reuters
GitHub 更新 Copilot 的用量计费规则,并强化个人访问令牌(PAT)的安全治理,包括更细的权限范围和过期策略。当 AI 代理开始用你的身份调用 API,令牌就不再是一串随便生成的密码。
治理的重点从”能不能用”转向”用了什么、以谁之名、能不能追到”。
前沿实验室 将 GPT-Live 全双工语音能力推向默认,基于 Whisper 的实时识别让用户能像打电话一样打断、插话、自然接话。语音交互的拐点,是从”能听懂”跨到”不用等”—双方可以同时说,模型自己判断什么时候该接、什么时候该让。
最接近真人的对话,往往最不像是和机器说话。
Google Photos 的 Video Remix 基于 Gemini,可对视频加入电影级补光、自定义背景以及水彩、手绘等艺术风格。AI 视频编辑正沉进最普通的相册应用。
真正改变大众视觉表达的,往往是默认入口—你不用学剪辑,点一下就重混出一条新片子。
投资圈开始把 AI 模型的”分发权”(谁能把模型塞进什么产品、卖给谁)和”风险定价”(为模型滥用和失误买单的成本)当成独立的可投资主题。模型不再只是技术资产,它的流通方式和连带风险都在被金融化。
当保险费、审计费、合规成本都开始写进模型的账本,AI 生意的真实成本才第一次看得见。
黑海在 2026 年春夏被浮游植物染成一片乳蓝。
Black Sea phytoplankton bloom · 43.0°N, 35.0°E
PACE 卫星 6 月拍到这场藻华—密密麻麻的微生物把整片海染成奶蓝色,一次大爆发就喂饱半个海域的食物链。
当我们争论哪个模型更强,它按自己的节奏来了又散,不关心任何基准。
看了一天 AI 的新闻,地球上还有不需要 GPU 冷却的地方。
山川湖海,让我们保持好奇、继续探索。