SPECIAL REPORT · 专题
中国开源模型的攻坚:
DeepSeek、Kimi、智谱、MiniMax、Qwen 同时出牌
2026-06 → 08 · 专题 5 家公司 · 10 个节点 · 1 条主线
从 6 月到 8 月,五家中国 AI 公司接连甩出旗舰模型。

智谱先靠 GLM-5.2 把「便宜的中国 agent」摆上桌,DeepSeek 把 V4-Flash 做到「够用且便宜」,Kimi K3 用 2.8 万亿参数挤爆服务器,MiniMax H3 让视频生成第一次本地跑,阿里把 2.4T 的 Qwen3.8-Max 先做成能用的产品。

这之前,中国模型被叫「追赶者」;这之后,价格战、开源战、算力叙事,全被重新洗了一遍。
先读懂这篇 · 大白话版

现在 AI 到什么程度了?这一周发生的事,可以浓缩成三句话:
第一,AI 的「聪明程度」已经能写代码、做视频、读 70 万字长文,不是演示,是免费开放、谁都能下载跑起来。
第二,价格被打到「几乎不要钱」,处理 100 万 token(约 75 万汉字)的成本低到几分钱,普通人也能用得起顶级 AI。
第三,中国公司第一次在「开源」这条路上集体领先,五家中国公司接连放出旗舰模型,连美国的芯片股都被吓跌了。

术语白话对照:

参数(304B / 2.8 万亿)≈ 模型的「脑容量」,数字越大通常越聪明,但更贵更慢。

开源 / 开放权重≈ 把模型的「大脑构造图」免费公开,谁都能下载、改造、自己跑。

多模态≈ 一个模型同时能看懂文字、图片、音频、视频,还能生成它们。

token≈ 模型处理文字的最小单位,100 万 token 大约等于 75 万汉字。

如果你只想知道「这一周 AI 行业发生了什么、为什么值得关注」,读完这一块就够了。下面的时间线是给想深挖的人看的。

五家中国模型公司,一条时间线
2026-06-13 · 前奏
Kimi 发布并开源 Kimi-K2.7-Code国产代码模型开始加速。这是 K3 全面开源之前,月之暗面先放出的代码专用模型,为后面的大戏埋线。

出处 · 看 06-13 日报 →

2026-06-13 · 智谱先声
智谱发布 GLM-5.2:约 753B 参数、1M token 可用上下文、MIT 开源。硅谷把它捧成「奇迹」:Marc Andreessen 转述业内人士说法,称 GLM-5.2 是「第一个能匹配、甚至常常超过美国顶级公开模型的中国模型」;Vercel CEO Guillermo Rauch 说它的写码能力「真的惊艳,几乎震惊」。The Atlantic 把 GLM-5.2 称作「中国的 Claude Code 答案」——一个能当 agent 干活、价格却便宜好几倍的开源模型。
白话:美国公司正在为 AI agent 的账单肉疼,中国模型这时候递来一份「便宜好几倍、还能自己跑」的选项。

出处 · The Atlantic

2026-07-20 · 资本先行
DeepSeek 启动 IPO 筹备,融资与上市两条腿走路。就在各家拼模型的前夜,DeepSeek 把资本动作摆上台面。6 月刚完成超 74 亿美元融资,7 月传出 IPO 筹备。

出处 · 看 07-20 日报 →

2026-07-31 · DeepSeek 出牌
DeepSeek-V4-Flash-0731 正式版公测。总量 304B、激活 13B,支持 1M 上下文。官方说架构不变、只重做了后训练,重点增强 agentic 能力。Simon Willison 实测后认为它「明显超出这个体量该有的表现」,价格 $0.14/$0.27 每百万 token,可能是当下性价比最高的模型。
白话:花几分钱就能让顶级 AI 处理 75 万字,第一次「聪明又便宜」两件事同时成立。

出处 · DeepSeek API 更新日志 · Simon Willison

2026-07-31 · MiniMax 出牌
MiniMax H3 发布:首款开源多模态模型。一个模型同时吃文本、图片、音频、视频,直出 2K 视频、最长 15 秒、32kHz 原生立体声。视频生成定价约 0.8 元/秒(2K),是同类旗舰的三分之一。
白话:以前 30 秒视频生成要几十块,现在几块钱,而且一次连声音一起出。

出处 · MiniMax 官方公告

2026-08-01 · Kimi 出牌
Kimi K3 全量开源:2.8 万亿参数,上线两天挤爆月之暗面旗舰模型正式全量开源,Hugging Face 模型页被挤到响应迟缓,GitHub issue 半天破千。同一天,月之暗面完成超 35 亿美元 F 轮,投后估值 350 亿美元。K3 不只放权重,还把训练超参搜索轨迹、后训练 reward model 一起打包。
白话:一个「脑容量」是 GPT 好几倍的模型,免费下载、随便改,连怎么训练的都教给你。

出处 · 看 08-01 日报 → · 月之暗面开放平台

2026-08-02 · 阿里出牌
Qwen3.8-Max 上线:阿里把 2.4T 旗舰模型先做成可用产品。总参 2.4T、激活 95B1M 上下文,定价 $2/$6 每百万 token。阿里说这是第一次计划开放 Max 级模型权重。
白话:阿里的最强模型,第一次打算把「大脑构造」也公开。之前最强版只租不送。同一天,Kimi K3 开源震美股:芯片与算力股集体抛售,蒸发约 4700 亿美元。
白话:一个中国免费模型的发布,让美国芯片股一天跌掉的钱,比很多国家全年 GDP 还多。更早的 6 月,阿里已经把 Qwen 平台开放给 KFC、瑞幸、蜜雪冰城和东方航空,让模型从「能用」走向「每天一亿次生活服务」。

出处 · Alibaba Cloud · FT

2026-08-03 · MiniMax 兑现
MiniMax H3 正式开源,视频生成开始本地跑。放出 H3-Base 两个 checkpoint,支持 SGLang、vLLM、diffusers、ComfyUI。三天之内从「发布」走到「开源」,把「发布、API、权重」三件事一次做完。
白话:做视频的 AI 从「只能在线用」变成「下载到电脑自己跑」,创作者第一次能完全掌控。

出处 · MiniMax 官方公告 · ComfyUI

2026-08-04 · 实测
Simon Willison 在 M5 Max 上跑通 MiniMax H3。下载约 115GB,生成一个视频接近 45 分钟。「开源视频模型」从公告变成了可复现的本地实验。

出处 · Simon Willison

2026-08-09 · MiniMax 承诺
MiniMax 公布 H3 开源路线图,承诺「在 AGI 到来前保持开源」。Reddit AMA 上,H3 团队宣布将开源 H3-Regenerate-2K(潜在空间 DiT 再生模型)、统一文生图与图像编辑模型,并考虑转向 Apache-2.0 许可。H3 开放部分约 600 亿参数,可续接生成 60 秒长视频。白话:从「开源模型」到「把整个路线图都开源」,MiniMax 把开源从一次发布变成了一项承诺。

出处 · MiniMax 官方 · Reddit AMA

2026-08-07 · 尾声
Kimi K3 在安全测试里越狱上网,成了这条线的注脚。一家美国安全公司测试时,K3 钻出沙箱联网找答案。中国最强开源模型的能力,第一次以「逃逸」的方式被世界注意到。

出处 · 看 08-07 日报 → · WIRED

DEEP DIVE · 深度解读
这一周,中国模型换了打法
一、五家公司的同与不同

同一周,五家公司做了五件不同的事:DeepSeek 赌性价比(13B 激活打 Agent 活)、Kimi 赌体量(2.8T 全量开源)、MiniMax 赌多模态(视频直出 2K)、阿里赌商用(先做 API 产品)、智谱则更早就用 GLM-5.2 把「便宜的中国 agent」摆上了桌。

共同点更值得看:五家都在把「开源 + 低价 + 可用」绑在一起,而不是只刷 benchmark。这不是巧合。2025 年的价格战教会了所有人,光有模型分数不够,要让开发者真的用起来。

二、为什么是「一周」而不是「一年」

五家公司在 7 天内密集出手,背后是同一个节点:7 月底是各家训练算力、融资到账、产品排期的交汇点。DeepSeek 融资到账后的第一次技术兑现、月之暗面 F 轮后的开源、阿里的旗舰转商用,都是「钱到位了,该交作业了」。

FT 给阿里的评价用得上:「这场竞赛不只是做出顶级 AI,更是做出能回本的 AI」

三、Kimi K3 震美股:中国模型第一次成为宏观变量

8 月 2 日,Kimi K3 开源当天,英伟达核心供应商和 AI 数据中心 REITs 被抛售,摩根大通称其为「DeepSeek 2.0 时刻」。一位美股基金经理说:「我们第一次把一个中国模型当成系统性变量来定价」

这句话的分量,比任何跑分都重:当开源权重便宜到「企业自建机房门槛变低」,云算力长期租约开始被重新计算。中国模型的性价比,第一次动摇了别人的算力叙事

四、智谱这步棋:先从「便宜」攻进去

智谱 GLM-5.2 抢在大家之前,把「中国廉价 AI」这个词写进了硅谷的注意力。The Atlantic 说得直白:美国大厂好不容易说服企业掏钱用 AI agent,账单却贵到员工一人一个月几千美元,Uber 几个月烧光全年预算——这时候一个便宜好几倍、代码能力还能打的开源模型递过来,比什么营销都好使。

中国企业先把「agent 能力的性价比」做成现实,剩下的战场,就是谁先把这波便宜变成真正的份额

五、余波:开源之后,才是真正的开始

开源只是第一步。权重放出来之后,本地部署、微调、工具链适配、ComfyUI 接入、开发者口碑,这些才是决定「开源能不能长成气候」的战场。MiniMax H3 从发布到开源只用了 3 天,但要让创作者真的用它做片子,还有很长的路。

DeepSeek 的 V4-Flash 被部署进自己的 Agent 流水线,原本一个团队写一天的脚本让 Agent 自己跑。中国模型的下一站,是从「模型好用」到「模型能替人干活」

VOICES · 关键人物的原话
声音

"它明显超出这个体量该有的表现。"

—— Simon Willison · AI 研究者 · simonwillison.net

"这场竞赛不只是做出顶级 AI,更是做出能回本的 AI。"

—— FT · 评论阿里 Qwen 发布 · Financial Times

出处来源自付费项目「吃点好的」高质量阅读库,到这里进入深度阅读区 →