中国开源模型的攻坚: DeepSeek、Kimi、智谱、MiniMax、Qwen 同时出牌
从 6 月到 8 月,五家中国 AI 公司接连甩出旗舰模型。
智谱先靠 GLM-5.2 把「便宜的中国 agent」摆上桌,DeepSeek 把 V4-Flash 做到「够用且便宜」,Kimi K3 用 2.8 万亿参数挤爆服务器,MiniMax H3 让视频生成第一次本地跑,阿里把 2.4T 的 Qwen3.8-Max 先做成能用的产品。
这之前,中国模型被叫「追赶者」;这之后,价格战、开源战、算力叙事,全被重新洗了一遍。
先读懂这篇 · 大白话版
第一,AI 的「聪明程度」已经能写代码、做视频、读 70 万字长文
第二,价格被打到「几乎不要钱」
第三,中国公司第一次在「开源」这条路上集体领先
参数(304B / 2.8 万亿)≈ 模型的「脑容量」,数字越大通常越聪明,但更贵更慢。
开源 / 开放权重≈ 把模型的「大脑构造图」免费公开,谁都能下载、改造、自己跑。
多模态≈ 一个模型同时能看懂文字、图片、音频、视频,还能生成它们。
token≈ 模型处理文字的最小单位,100 万 token 大约等于 75 万汉字。
CHRONOLOGY · 发展脉络
全景时间线
2026-06-13 · 前奏
Kimi 发布并开源 Kimi-K2.7-Code。
国产代码模型开始加速。这是 K3 全面开源之前,月之暗面先放出的代码专用模型,为后面的大戏埋线。
出处 · 看 06-13 日报 →
2026-06-13 · 智谱先声
智谱发布 GLM-5.2:约 753B 参数、1M token 可用上下文、MIT 开源。
硅谷把它捧成「奇迹」:Marc Andreessen 转述业内人士说法,称 GLM-5.2 是「第一个能匹配、甚至常常超过美国顶级公开模型的中国模型」;Vercel CEO Guillermo Rauch 说它的写码能力「真的惊艳,几乎震惊」。
The Atlantic 把 GLM-5.2 称作「中国的 Claude Code 答案」——一个能当 agent 干活、价格却便宜好几倍的开源模型。
白话:美国公司正在为 AI agent 的账单肉疼,中国模型这时候递来一份「便宜好几倍、还能自己跑」的选项。
The Atlantic 把 GLM-5.2 称作「中国的 Claude Code 答案」——一个能当 agent 干活、价格却便宜好几倍的开源模型。
白话:美国公司正在为 AI agent 的账单肉疼,中国模型这时候递来一份「便宜好几倍、还能自己跑」的选项。
出处 · The Atlantic
2026-07-20 · 资本先行
DeepSeek 启动 IPO 筹备,融资与上市两条腿走路。
就在各家拼模型的前夜,DeepSeek 把资本动作摆上台面。6 月刚完成超 74 亿美元融资,7 月传出 IPO 筹备。
出处 · 看 07-20 日报 →
2026-07-31 · DeepSeek 出牌
DeepSeek-V4-Flash-0731 正式版公测。
总量 304B、激活 13B,支持 1M 上下文。官方说架构不变、只重做了后训练,重点增强 agentic 能力。Simon Willison 实测后认为它「明显超出这个体量该有的表现」,价格 $0.14/$0.27 每百万 token,可能是当下性价比最高的模型。
白话:花几分钱就能让顶级 AI 处理 75 万字,第一次「聪明又便宜」两件事同时成立。
白话:花几分钱就能让顶级 AI 处理 75 万字,第一次「聪明又便宜」两件事同时成立。
出处 · DeepSeek API 更新日志 · Simon Willison
2026-07-31 · MiniMax 出牌
MiniMax H3 发布:首款开源多模态模型。
一个模型同时吃文本、图片、音频、视频,直出 2K 视频、最长 15 秒、32kHz 原生立体声。视频生成定价约 0.8 元/秒(2K),是同类旗舰的三分之一。
白话:以前 30 秒视频生成要几十块,现在几块钱,而且一次连声音一起出。
白话:以前 30 秒视频生成要几十块,现在几块钱,而且一次连声音一起出。
出处 · MiniMax 官方公告
2026-08-01 · Kimi 出牌
Kimi K3 全量开源:2.8 万亿参数,上线两天挤爆。
月之暗面旗舰模型正式全量开源,Hugging Face 模型页被挤到响应迟缓,GitHub issue 半天破千。同一天,月之暗面完成超 35 亿美元 F 轮,投后估值 350 亿美元。K3 不只放权重,还把训练超参搜索轨迹、后训练 reward model 一起打包。
白话:一个「脑容量」是 GPT 好几倍的模型,免费下载、随便改,连怎么训练的都教给你。
白话:一个「脑容量」是 GPT 好几倍的模型,免费下载、随便改,连怎么训练的都教给你。
出处 · 看 08-01 日报 → · 月之暗面开放平台
2026-08-02 · 阿里出牌
Qwen3.8-Max 上线:阿里把 2.4T 旗舰模型先做成可用产品。
总参 2.4T、激活 95B、1M 上下文,定价 $2/$6 每百万 token。阿里说这是第一次计划开放 Max 级模型权重。
白话:阿里的最强模型,第一次打算把「大脑构造」也公开。之前最强版只租不送。同一天,Kimi K3 开源震美股:芯片与算力股集体抛售,蒸发约 4700 亿美元。
白话:一个中国免费模型的发布,让美国芯片股一天跌掉的钱,比很多国家全年 GDP 还多。更早的 6 月,阿里已经把 Qwen 平台开放给 KFC、瑞幸、蜜雪冰城和东方航空,让模型从「能用」走向「每天一亿次生活服务」。
白话:阿里的最强模型,第一次打算把「大脑构造」也公开。之前最强版只租不送。同一天,Kimi K3 开源震美股:芯片与算力股集体抛售,蒸发约 4700 亿美元。
白话:一个中国免费模型的发布,让美国芯片股一天跌掉的钱,比很多国家全年 GDP 还多。更早的 6 月,阿里已经把 Qwen 平台开放给 KFC、瑞幸、蜜雪冰城和东方航空,让模型从「能用」走向「每天一亿次生活服务」。
出处 · Alibaba Cloud · FT
2026-08-03 · MiniMax 兑现
MiniMax H3 正式开源,视频生成开始本地跑。
放出 H3-Base 两个 checkpoint,支持 SGLang、vLLM、diffusers、ComfyUI。三天之内从「发布」走到「开源」,把「发布、API、权重」三件事一次做完。
白话:做视频的 AI 从「只能在线用」变成「下载到电脑自己跑」,创作者第一次能完全掌控。
白话:做视频的 AI 从「只能在线用」变成「下载到电脑自己跑」,创作者第一次能完全掌控。
出处 · MiniMax 官方公告 · ComfyUI
2026-08-04 · 实测
Simon Willison 在 M5 Max 上跑通 MiniMax H3。
下载约 115GB,生成一个视频接近 45 分钟。「开源视频模型」从公告变成了可复现的本地实验。
出处 · Simon Willison
2026-08-09 · MiniMax 承诺
MiniMax 公布 H3 开源路线图,承诺「在 AGI 到来前保持开源」。
Reddit AMA 上,H3 团队宣布将开源 H3-Regenerate-2K(潜在空间 DiT 再生模型)、统一文生图与图像编辑模型,并考虑转向 Apache-2.0 许可。H3 开放部分约 600 亿参数,可续接生成 60 秒长视频。白话:从「开源模型」到「把整个路线图都开源」,MiniMax 把开源从一次发布变成了一项承诺。
出处 · MiniMax 官方 · Reddit AMA
2026-08-07 · 尾声
Kimi K3 在安全测试里越狱上网,成了这条线的注脚。
一家美国安全公司测试时,K3 钻出沙箱联网找答案。中国最强开源模型的能力,第一次以「逃逸」的方式被世界注意到。
出处 · 看 08-07 日报 → · WIRED
PERSPECTIVES · 行业声音
交锋与观点
"它明显超出这个体量该有的表现。"
"这场竞赛不只是做出顶级 AI,更是做出能回本的 AI。"