这几天被 Kimi K3 刷屏了,X 上在吹,HN 上在吹,都说是国产之光,deepseek 时刻 2.0 来了。
我也试了一下,浅浅分享自己的体验吧。
先说好的地方:
- 前端能力很强。
Kimi K3 前端能力这块,算是跻身全球第一梯队,真要个人排名的话,目前我给它排第二,还超越不了 Fable 5--LMArena 人类盲投榜上它前端甚至排第一,但我实测体感,Fable 5 还是更稳。
不过比 GPT-5.6 强得多,这是 GPT 系列家族的通病,前端能力一直很弱。
特别是那个刷屏的 3D 建模,我不知道设计圈怎么看,我觉得挺牛的。
- 长时复杂任务处理能力也很不错。
比如要做一个复杂的系统,定好一份计划,扔给它,/goal 模式让它自动处理,出错的概率,以及最后交付的结果非常不错。
- 原生多模态能力。
K3 可以直接理解视频,比如语气,音效,转场之类的,比普通的只能理解文字和图片的 CC/Codex 好多了。喂给 K3 一个视频,让它帮你生成同样风格的 seedance 的提示词,它可以生成得很精准。
- 开源。
Kimi 是开源的,权重 7 月 27 日就放出来,这意味着以后任何一家 AI 公司都可以直接拿去用,拿去蒸馏,而 Fable 5 和 GPT-5.6 都是自家闭源的旗舰大模型。
然后再讲讲不好的地方吧。(轻喷)
- 国产最贵。
目前 K3 价格是国产最贵,如果你和国产对比,你一定会不习惯,甚至说它想钱想疯了,但是和国外对比不算贵,成本和 GPT-5.6 差不多,约是 Opus 4.8 的一半。不过考虑到能力嘛,一分钱一分货,我觉得有道理。
- 速度稍慢。
感觉它比 CC + Fable 5 慢得多,比 Codex + GPT-5.6 也一样慢不少。
- 幻觉率偏高。
这个你瞎编一个问题去问它,你就知道了。幻觉率高的模型会给你一个答案,并且瞎编一个理由。
但是幻觉低的模型,它遇到它不知道的知识,会诚实地告诉你它不知道,甚至可以反问你。
最后,综合评价一下,我觉得它确实能跻身世界前三,但跟 CC + Fable 5 和 Codex + GPT-5.6 还有点差距。
但这毕竟是国产模型第一次敢跟 Anthropic 和 OpenAI 掰手腕,所以我觉得,还是未来可期啊。
你们试了没?

