7 月 17 日,月之暗面正式发布 Kimi K3。三个数字先记住:参数量 2.8T,多项基准测试超过 Claude Opus 4.8,月底开源。
发布当天的场面很说明问题:全网刷屏,算力告急,老用户在社交平台上开玩笑说"好消息是 K3 终于发了,坏消息是我得跟大家一起抢容量"。上一次国产模型有这个待遇,还是年初 DeepSeek 那一波。
但 K3 和之前所有"国产追赶"故事都不太一样。以前的叙事是"以十分之一的成本达到八成性能",这次的叙事变成了:正面超过。
K3 强在哪
从目前公开的信息看,K3 的几个关键点:
- 2.8T 总参数,MoE 架构,激活参数量控制在推理成本可接受的范围
- 多项基准超过 Claude Opus 4.8,尤其是推理和代码类任务
- 宣布月底开源,延续 K2 系列的开源路线
- 发布即接入 Kimi 全线产品,API 同步开放
排队等容量这件事本身就是最真实的评测。Benchmark 可以刷,用户拿真金白银的 API 调用量投票做不了假。
值得一提的是背景:上周 Cognition 刚发布了基于 Kimi K2.7 底座微调的编程模型 SWE-1.7,美国明星创业公司公开用中国开源底座。K3 这时候放出"月底开源",等于告诉全世界的开发者:更强的底座马上免费。
开源 2.8T 意味着什么
有人会问,2.8T 的模型开源了普通人也跑不动,意义在哪?
意义在生态位。对三类玩家影响完全不同:
| 玩家 | 影响 |
|---|---|
| 云厂商 | 多了一个旗舰级托管选项,直接冲击闭源 API 定价 |
| 创业公司 | 可以像 Cognition 那样在顶级底座上做后训练,用小钱做出旗舰产品 |
| 闭源实验室 | 定价权被进一步侵蚀,“能力领先"的窗口期越来越短 |
高盛本月刚向客户推荐 DeepSeek、Kimi 等中国模型,理由是成本效率。K3 开源之后,这个推荐理由会从"便宜够用"升级成"便宜且顶级”。
冷静的部分
热闹归热闹,几件事还要观察:
一是算力瓶颈是真的。 发布即告急说明月之暗面的推理供给撑不起需求,这会直接影响 API 的稳定性和企业客户的信任。能力领先如果配不上供给能力,窗口期会被浪费掉。
二是"多项测试超过"需要时间验证。 发布日的评测数字和三个月后的社区共识经常是两回事,Opus 4.8 在真实复杂任务上的稳定性是拿海量生产流量喂出来的。
三是商业化压力更大了。 模型越强、越开源,月之暗面自己靠什么赚钱的问题就越尖锐。这是所有开源路线玩家的共同考题。
我的看法
K3 最大的意义不在跑分,在于它把行业的默认假设改了:从"中国模型什么时候追上"变成"下一代谁先发"。
当追赶者和领跑者的发布节奏开始交错,竞争就进入了真正的拉锯阶段。对开发者和用户来说,这是最好的时代,旗舰能力的价格正在被两边的军备竞赛快速打下来。
月底开源见真章。到时候我们做一期 K3 本地部署和 API 实测。