实测:DeepSeek追上Kimi了吗?

日期:2026-08-17 18:57:15 / 人气:20



DeepSeek-V4-Pro正式版终于落地,API静默上线、公告撤回又重发,过程曲折,但方向明确:继续押注长上下文、长输出与Agent任务。1M上下文、384K最大输出、思考模式默认开启、新增low/high/max三档思考强度,规格摆得比Kimi K3更激进。价格也涨了——峰谷定价下,高峰时段输出27元/百万token,是旧版的四倍半。那么,能力跟上了吗?

把两款模型放进同一套提示词里跑,答案很清晰:DeepSeek赢在速度,Kimi胜在完成度。

内容创作:各擅胜场。 续写AI漫剧《被裁掉的女孩》第二季,DeepSeek叙事顺、逻辑稳,但“AI味”仍在;Kimi K3则犯了结构错误,把提示词里的背景介绍直接写进正文,破坏沉浸感。换到工作场景,写《2026年AI编程工具行业竞争格局分析报告》,Kimi K3完胜——数据详实、表格清晰、来源标注完整,像一份能直接上会的材料;DeepSeek框架虽清朗,但内容偏薄,对竞争关系的分析点到即止。

编程:快与准的拉扯。 做“电影选片器”网页,两者功能都达标,DeepSeek却在小细节上翻车——胶片图标与文字重叠,影响观感。难度升级到“截图还原艺术博物馆官网”,差距拉开:DeepSeek仅抓色调,把博物馆做成品牌官网,属于“毫不相关”;Kimi K3结构还原度高,仅用几何图形替代缺失的实景照片,理解力明显更胜一筹。再测“威尼斯运河快艇游戏”,两者都能跑,但Kimi的视觉审美碾压——水面倒影、衣物悬挂状态、快艇音效,沉浸感拉满;DeepSeek虽能5分钟改完交错桥洞逻辑,但水面无倒影、衣物像“贴”上去,美感欠奉。

视觉审美:理解力的鸿沟。 用Three.js还原“金色水母湖”,DeepSeek先卡壳,半小时后才出图,仍带渲染错误;更关键的是理解偏差——把“金色水母群”做成灰色椭圆,满屏金色光点反而像星空,完全偏离“金色星河”的核心要求。Kimi K3一次出片,40分钟交付可运行成品,水母层次分明、光束穿透水面,写实感强,仅缺水下植物这一细节。

物理仿真:逻辑的试金石。 “鞭炮箱子”3D连锁爆炸,Kimi K3十分钟跑通:鞭炮落箱不穿模、外部火源引燃、烟雾效果写实,正常燃放与单个引爆逻辑分明。DeepSeek-V4-Pro耗时40分钟,问题一堆:鞭炮穿模、火星凭空出现、爆炸如白屏卡顿,基础物理规则都没守住。

结论:性价比仍在,但护城河变窄。 DeepSeek-V4-Pro在叙事连贯性、代码修改速度上仍有优势,尤其适合快速迭代场景。但涉及视觉理解、物理仿真、复杂信息整合时,Kimi K3的完成度明显更高。考虑到DeepSeek价格已不再“绝对低价”,其竞争力正从“便宜够用”转向“便宜且好用”——后者尚需验证。

更深的信号在于DeepSeek的转向:团队扩张一倍、招聘Agent全链路岗位、开源Harness框架、启动百亿级外部融资。它不再满足于做“模型供应商”,而要成为Agent基础设施的搭建者。未来真正的较量,不在跑分榜上,而在谁能把模型能力封装成普通人用得顺手的工作流。DeepSeek-V4-Pro是这一步的垫脚石,但通往用户桌面的路,Kimi似乎走得更靠前一些。

作者:傲世皇朝




现在致电 5243865 OR 查看更多联系方式 →

傲世皇朝 版权所有