DeepSeek V4正式版即将落地:七分之一的价格,逼近顶级性能
三个月的靴子,终于要落地了

七月的最后一个周末,AI 圈的气氛忽然变得微妙。
各大社区突然开始流传一份验货口诀:看思维链里的第一人称,如果出现的是”I’m”和”I’ll”,而非老版本的”Let me”,那就说明你已经摸到了 V4 正式版。博主 AiBattle 率先给出这个鉴别方法,开发者们随后蜂拥而入,用各种刁钻的 prompt 去试探这个新模型的边界。
开发者 Pankaj Kumar 在体验后给出了相当详细的评价:整体表现逼近 Opus 4.8 的水平,编码能力直追 GPT-5.6 Sol。Agent 能力有明显跃升,3D 场景生成和 SVG 渲染的质量提升肉眼可见。不过他也坦言,同样的任务 V4 需要的迭代轮数比 Fable 5 更多,而面对 Kimi K3 这种强敌,V4 大概率还有差距。

Flash 和 Pro 双线出击,价格屠刀再挥一刀
这次 V4 同时放出两个版本:Flash 轻量版和 Pro 增强版。
首轮测试 demo 已经外流,有人认为 V4 的综合表现可以打平 Claude 5,但 Pro 版相比 Flash 版的优势并没有拉开太大,这多少出乎预料。V4 生成了 3D 模拟射击游戏、我的世界与无人深空混合风格的沙盒游戏、还有经典割绳子的复刻版本,Agent 自主编码的能力在这些 demo 里展现得相当充分。
真正让开发者兴奋的是定价策略。V4 引入了峰谷计费机制:Pro 版每百万输出 tokens 平时仅需 0.87 美元,高峰期 1.74 美元;Flash 版更是低至 0.28 美元和 0.56 美元。缓存命中输入只要 0.0028 美元。作为对比,Fable 5 的同等价格是 50 美元。七倍的性能差距,五十分之一的价格差,性价比的天平已经彻底倾斜。

性价比之王的王座,能坐多久
V4 预览版在 SWE-bench Verified 上的成绩距离 Claude Opus 4.6 Max 仅差 0.2%,而价格只有后者的七分之一。
这个数字的含义不言自明。在企业级部署场景中,成本从来不是可选项,而是决定性因素。V4 用极低的价格撕开了一条通往顶级性能的通道,这对于那些预算有限但需要高质量推理能力的团队来说,几乎是改变游戏规则的一击。
与此同时,deepseek-chat 和 deepseek-reasoner 两个老版本将于 7 月 24 日正式下线,意味着官方已经做好了全面切换的准备。全网苦等三个月的 V4 正式版,最快可能就在明天与所有人见面。AI 模型的军备竞赛从来不缺剧情反转,但这一次,价格屠夫拿着性价比的刀,直接捅进了高端市场最柔软的腹地。
来源:新智元
