网络 2026-08-14

导读:8月13日晚,深度求索正式发布了其旗舰模型DeepSeek-V4-Pro的正式版,距离预览版上线整整过去了111天。 与此相对,被视为直接竞争者的Kimi K3已于上月发布。这场发生在“粤籍双雄”之间的较量,不仅是技术能力的比拼,更折射出全球AI竞争格局的深刻变化。

01 正式版DeepSeek-V4-Pro:补齐了最大短板

DeepSeek-V4-Pro正式版的硬参数与预览版保持一致:1.6T总参数、49B激活参数的MoE结构,支持1M上下文、384K最大输出。和预览版相比,后训练方面的升级非常明显,让性能有了质的飞跃。

最夸张的数字来自Agent相关评测。DeepSWE(DeepSeek自家的软件工程基准)从预览版的12.8飙到62.7,涨了近50分;Cybergym从52.7到83.3;Terminal Bench从72.1到87.9;DSBench-Hard翻了一倍多达到67.2

这些测试的共同特点是——涉及长链路的代码修改、环境操作和工具调用,恰好是预览版最容易翻车的地方。从V4 Flash正式版的更新日志可以推断,这轮升级的核心就是面向代码Agent场景的大规模后训练。Flash版已经用同样的方法把Agent能力做到了“远超预览版”的程度,Pro版只是补上了同一课

在真实任务测试中,V4-Pro-0813表现亮眼。实测中,它能完整闭环游戏开发逻辑,碰撞、计分、结算功能全部正常,页面配色、交互反馈也摆脱了模板化AI风格。对模糊需求的“产品化补全”能力,相比预览版有明显进步

02 Kimi K3:全球最大开源模型,编程能力登顶

Kimi K3发布于7月16日,拥有2.8万亿总参数,896个专家中每次激活16个,是全球首个开源的3万亿级别模型

在Artificial Analysis智能指数上,K3得分57,排名全球第三,仅次于Anthropic的Fable 5(60分)和OpenAI的GPT-5.6 Sol(59分),超过了Claude Opus 4.8。在Frontend Code Arena榜单上,K3以1679分超越Claude Fable 5,登顶全球第一

在Agent能力上,K3优势明显——独立评测显示其Agent任务得分89.5,远超DeepSeek V4 Pro的59.1。在长程软件工程和连续任务执行方面,K3更具优势。

但K3也有短板:速度是最大痛点。实测显示,同一场景生成时间约为GPT-5.6 Sol的两到三倍,复杂任务耗时更长。代码质量虽高,但Token消耗量也更大

03 各有千秋:一场没有“碾压”的对决

根据官方基准测试和第三方测评,两款模型呈现出“各有千秋”的局面,并未出现一方完全碾压的情况:

 
 
维度 Kimi K3 DeepSeek-V4-Pro正式版
参数规模 2.8T总参数 1.6T总参数
Agent能力 较强,长程任务优势明显 大幅提升,已追至接近
编程能力 代码质量高,Frontend Code Arena登顶 成本极低,LiveCodeBench全球第一
速度 偏慢,稳定性待提升 国内速度王者,极其稳定
API输入价格 20元/百万token 3元/百万token
API输出价格 100元/百万token 6元/百万token

在SuperCLUE-Terminal中文智能体终端编程测评中,DeepSeek-V4-Pro-0813拿到51.52分,在所有参测模型里排名第二,仅次于Kimi-K3。最亮眼的是它的成本控制——单题调用仅1.42元,大概是Kimi-K3的十四分之一

正如一位资深开发者总结的:Kimi K3是“能干活”——复杂工程任务更可靠;DeepSeek V4 Pro是“干完要返工”的风险更低,但部分场景下稳定性和Java适配性仍待提升

04 价格博弈:DeepSeek引入峰谷定价

值得注意的是,DeepSeek-V4-Pro发布后,API定价策略也进行了调整。根据官方公告,将于8月17日起采用峰谷定价,高峰时段价格有所上涨

目前DeepSeek-V4-Pro-0813的API价格尚未调整,仍保持输入3元/百万token、输出6元/百万token的定价,与预览版持平。但8月6日DeepSeek已预告“计划近期整体上调API定价,预计涨幅较大”,窗口期能撑多久尚不确定

Kimi K3的API价格则为输入20元/百万token、输出100元/百万token

05 双雄对决的背后:中国AI加速形成“系统性优势”

从DeepSeek到Kimi,中国AI厂商正通过开源策略,将自身的技术特点转化为系统性优势,并加速基础模型的商品化进程

中国开放权重AI模型在全球范围内的采用,正悄然重塑全球AI技术领域的竞争格局。澳大利亚新南威尔士大学计算机科学家托比·沃尔什评价说:“这证明人工智能不会成为一个赢家通吃的市场。”

《自然》杂志也刊文指出,中国开放权重模型正在改变投资者和用户对美国前沿模型价值的看法

从DeepSeek-R1震动全球投资界,到Kimi K3引发硅谷关于开源模型扩散效应的讨论,中国AI力量正从“追赶者”转变为“领跑者”之一。这场“粤籍双雄”的较量,不仅关乎技术能力的比拼,更折射出全球AI竞争格局与投资逻辑的深刻变化。

免责声明:凡注明来源中国制造网的所有作品,均为中国制造网合法拥有版权或有权使用的作品,欢迎转载并注明出处。非本网站作品均来自互联网,仅代表作者本人的观点,中国制造网转载目的在于传递信息,并不代表本网赞同其观点或对其真实性负责。因作者信息不明等原因,中国制造网使用的部分作品报酬未及时支付,相关权利人可与本网联系。

分享到: