现在 AI 到什么程度了?这一周发生的事,可以浓缩成三句话:
第一,AI 的「聪明程度」已经能写代码、做视频、读 70 万字长文,不是演示,是免费开放、谁都能下载跑起来。
第二,价格被打到「几乎不要钱」,处理 100 万 token(约 75 万汉字)的成本低到几分钱,普通人也能用得起顶级 AI。
第三,中国公司第一次在「开源」这条路上集体领先,五家中国公司接连放出旗舰模型,连美国的芯片股都被吓跌了。
参数(304B / 2.8 万亿)≈ 模型的「脑容量」,数字越大通常越聪明,但更贵更慢。
开源 / 开放权重≈ 把模型的「大脑构造图」免费公开,谁都能下载、改造、自己跑。
多模态≈ 一个模型同时能看懂文字、图片、音频、视频,还能生成它们。
token≈ 模型处理文字的最小单位,100 万 token 大约等于 75 万汉字。
如果你只想知道「这一周 AI 行业发生了什么、为什么值得关注」,读完这一块就够了。下面的时间线是给想深挖的人看的。
出处 · 看 06-13 日报 →
出处 · The Atlantic
出处 · 看 07-20 日报 →
出处 · DeepSeek API 更新日志 · Simon Willison
出处 · MiniMax 官方公告
出处 · 看 08-01 日报 → · 月之暗面开放平台
出处 · Alibaba Cloud · FT
出处 · MiniMax 官方公告 · ComfyUI
出处 · Simon Willison
出处 · MiniMax 官方 · Reddit AMA
出处 · 看 08-07 日报 → · WIRED
同一周,五家公司做了五件不同的事:DeepSeek 赌性价比(13B 激活打 Agent 活)、Kimi 赌体量(2.8T 全量开源)、MiniMax 赌多模态(视频直出 2K)、阿里赌商用(先做 API 产品)、智谱则更早就用 GLM-5.2 把「便宜的中国 agent」摆上了桌。
共同点更值得看:五家都在把「开源 + 低价 + 可用」绑在一起,而不是只刷 benchmark。这不是巧合。2025 年的价格战教会了所有人,光有模型分数不够,要让开发者真的用起来。
二、为什么是「一周」而不是「一年」五家公司在 7 天内密集出手,背后是同一个节点:7 月底是各家训练算力、融资到账、产品排期的交汇点。DeepSeek 融资到账后的第一次技术兑现、月之暗面 F 轮后的开源、阿里的旗舰转商用,都是「钱到位了,该交作业了」。
FT 给阿里的评价用得上:「这场竞赛不只是做出顶级 AI,更是做出能回本的 AI」。
三、Kimi K3 震美股:中国模型第一次成为宏观变量8 月 2 日,Kimi K3 开源当天,英伟达核心供应商和 AI 数据中心 REITs 被抛售,摩根大通称其为「DeepSeek 2.0 时刻」。一位美股基金经理说:「我们第一次把一个中国模型当成系统性变量来定价」。
这句话的分量,比任何跑分都重:当开源权重便宜到「企业自建机房门槛变低」,云算力长期租约开始被重新计算。中国模型的性价比,第一次动摇了别人的算力叙事。
四、智谱这步棋:先从「便宜」攻进去智谱 GLM-5.2 抢在大家之前,把「中国廉价 AI」这个词写进了硅谷的注意力。The Atlantic 说得直白:美国大厂好不容易说服企业掏钱用 AI agent,账单却贵到员工一人一个月几千美元,Uber 几个月烧光全年预算——这时候一个便宜好几倍、代码能力还能打的开源模型递过来,比什么营销都好使。
中国企业先把「agent 能力的性价比」做成现实,剩下的战场,就是谁先把这波便宜变成真正的份额。
五、余波:开源之后,才是真正的开始开源只是第一步。权重放出来之后,本地部署、微调、工具链适配、ComfyUI 接入、开发者口碑,这些才是决定「开源能不能长成气候」的战场。MiniMax H3 从发布到开源只用了 3 天,但要让创作者真的用它做片子,还有很长的路。
DeepSeek 的 V4-Flash 被部署进自己的 Agent 流水线,原本一个团队写一天的脚本让 Agent 自己跑。中国模型的下一站,是从「模型好用」到「模型能替人干活」。
"它明显超出这个体量该有的表现。"
—— Simon Willison · AI 研究者 · simonwillison.net
"这场竞赛不只是做出顶级 AI,更是做出能回本的 AI。"
—— FT · 评论阿里 Qwen 发布 · Financial Times
出处来源自付费项目「吃点好的」高质量阅读库,到这里进入深度阅读区 →