导读:2026年7月,中国AI圈被一个叫Kimi K3的模型搅动了。上线不到一周,它成了硅谷和国内开发者社区中最割裂的存在——有人惊呼“国产旗舰终于追上了”,有人吐槽“根本没法好好用”。 这种褒贬不一,不是谁在黑谁,而是Kimi K3身上恰好同时具备了天使和魔鬼的两面。
让人兴奋的:它真的能“干活”了
如果你只看榜单,Kimi K3的成绩单确实漂亮。2.8万亿参数、100万token上下文,在Artificial Analysis综合智能指数上排名全球第三,仅次于Claude Fable 5和GPT-5.6 Sol;更是在前端代码盲测中登顶Arena榜首,压过所有美国闭源模型。
但真正让开发者觉得“真香”的,不是跑分,是它在真实任务里的表现。
一个最出圈的测试是:让Kimi K3从零复刻一个《GTA5》风格的网页游戏。在完全无人干预的Auto模式下,它生成了一个可玩的开放世界——有驾驶系统、碰撞体积、警察追捕逻辑,甚至玩家犯罪后警车会赶来、警察会下车开枪、直升机用探照灯搜索玩家。这些细节说明它真的理解了游戏机制,而不只是堆代码。
另一个让硅谷创业公司紧张的点是:它已经悄悄嵌入生产流程。SpaceX旗下代码工具Cursor的核心跑在Kimi前代模型上,DoorDash把低级别工作交给了Kimi。K3发布后,近200家美国创业公司联名警告政府:如果封禁中国开源模型,“将有数百家公司瞬间死亡”。
“审美”是另一个让用户买单的理由。和GPT-5.6 Sol同题PK时,K3生成的3D迷宫带像素风,火炬和墙面纹理更有设计感;“日本武士拔刀”动画色彩更浓烈、视觉冲击力更强。在“好不好看”这件事上,不少测评者认为K3赢过了Sol。
让人头疼的:慢、贵、还买不到
如果说“强”是共识,那“慢”就是另一个共识。
同样一个3D迷宫游戏,GPT-5.6 Sol已经能玩了,Kimi K3还在加载;生成时间通常是Sol的两到三倍,视频剪辑任务能花近两个小时。有用户调侃:“用它干活,得先泡杯咖啡,喝完它还没做完。”
价格也让很多人犯了难。API输出定价每百万token 15美元,虽然只有Fable 5的三分之一,但比国内对手智谱GLM-5.2贵了3倍多,比DeepSeek更是贵了一个量级。更现实的问题是:K3完成单个任务的token消耗量偏高,开个699元最高档会员,一天测几个任务就消耗了5亿token。
最魔幻的是,上线48小时服务器就被挤爆,月之暗面直接宣布暂停C端新用户订阅。想花钱买会员?对不起,排队等着算力扩容。
争议背后:两个更根本的问题
表面的褒贬之下,其实藏着两个更深层的博弈。
第一,开源到底是“加速”还是“减速”? 硅谷为此吵翻了。OpenAI战略主管公开说开源模型是“减速主义”,会削弱前沿实验室利润、拖慢最强模型发展;黄仁勋则反驳说“免费的AI对芯片好”,更便宜的模型会让更多人用AI,算力需求反而会增加。这场争论的结果,可能影响美国是否会用政策手段封堵中国开源模型。
第二,Kimi要走哪条路? DeepSeek当年引爆市场,靠的是“能力接近前沿+价格断崖式下跌+权重立即开源”三件事同时发生。而K3的定价在国内算贵的,完整权重承诺7月27日才发布。月之暗面选择了一条不一样的路——不做“价格屠夫”,而是希望靠真正的任务交付能力赢得付费用户。这条路能走通吗?只有时间能回答。
总结
Kimi K3之所以褒贬不一,因为它既不是“完美神器”,也不是“营销噱头”。
它确实在某些场景里做出了让人惊艳的复杂作品,也确实验证了中国模型能挤进全球第一梯队的技术实力。但同时,它的速度、成本和可用性,离“让人用得舒心”还有明显距离。
这是一个“上限很高、下限还没稳住”的产品——如果你愿意为它的审美和复杂任务能力买单、且不介意等一等,它可能会给你惊喜;如果你追求稳定、快速、省心,那它现在的槽点也是真实存在的。
免责声明:凡注明来源中国制造网的所有作品,均为中国制造网合法拥有版权或有权使用的作品,欢迎转载并注明出处。非本网站作品均来自互联网,仅代表作者本人的观点,中国制造网转载目的在于传递信息,并不代表本网赞同其观点或对其真实性负责。因作者信息不明等原因,中国制造网使用的部分作品报酬未及时支付,相关权利人可与本网联系。
