TL;DR:
等了近三个月的DeepSeek V4正式版终于要来了,性能接近Opus级,编码能跟GPT-5.6 Sol掰手腕,但价格还是那么“真香”。不过这次首次引入了峰谷计费,算力也要开始学会“错峰出行”了。
全网等了快三个月,DeepSeek V4正式版(GA)终于要落地了。根据多方爆料,最快明天就能发布,最迟也不过这几天。目前一部分用户已拿到灰度测试权限,民间甚至传出了“验货口诀”:看思维链(CoT)的第一人称是不是从“Let me”变成了“I’m”“I’ll”——如果变了,恭喜,你已经用上了满血版。
这次V4正式版分两个版本:DeepSeek V4 Flash 和 DeepSeek V4 Pro。一个主打轻量快跑,一个堆料走性能路线。
性能摸底:接近Opus,但迭代有点多?
开发者Pankaj Kumar第一时间体验后给出了一个中肯评价:“整体表现接近Opus 4.8级别,编码直追GPT-5.6 Sol;Agent能力大幅增强,3D和SVG生成显著变好;但同样一个任务,V4所需的迭代轮数比Fable 5多。”1 翻译成大白话就是:性能挺能打,但还不是“全项冠军”,尤其在效率上还有提升空间。
这位开发者还表示,从目前生态位来看,V4大概率打不过刚发布的Kimi K3,但价格会显著更低——如果这个性能配上这个价格,那可能又是一次“DeepSeek时刻”。
首轮测试demo已经在外流,褒贬不一。有人觉得它已经能打平Claude 5,也有开发者指出Pro版并未比Flash版领先太多——这不禁让人怀疑:难道Flash版才是真正的“完全体”?不过,从流出的生成Demo看,V4的编码能力确实有看头:一款由V4 Pro生成的3D模拟射击游戏(操控攻城弩车打靶),一个融合《我的世界》和《无人深空》的HTML混合游戏,甚至能把“割绳子”经典玩法一次性跑出来——这些以前需要反复调试的活,现在它一遍就能搞定。
价格屠夫装计价器:峰谷计费来了,但依然真香
性能可能不是第一,但价格永远是DeepSeek的王牌。这次V4正式版在API定价上做了一件从未做过的事:引入“峰谷计费”。
具体来看:
- deepseek-v4-pro:百万输出tokens平时0.87美元,高峰1.74美元;缓存未命中输入平时0.435美元。
- deepseek-v4-flash:百万输出0.28美元,高峰0.56美元;缓存命中输入低至0.0028美元。
也就是说,那个从不涨价的“价格屠夫”,第一次给自己的算力装上了计价器——高峰时段价格翻倍,但低谷时段依然香得离谱。对个人用户影响不大,但对那些把Agent全天挂着的团队来说,这算是一笔需要重新算计的成本。好在缓存命中的价格极低,把批量任务、评测跑分、数据生成挪到高峰之外,成本还能压回来。
对比同类竞品:Fable 5的百万输出定价是50美元——V4 Pro的高峰价还不到它的3.5%,Flash版更是低到忽略不计。所以就算装上计价器,V4在性价比上依然是碾压级的存在。
在V4预览版发布时,官方自测的SWE-bench Verified中,DeepSeek-V4-Pro-Max距Claude Opus 4.6 Max仅差0.2个百分点,价格却只有对方的七分之一2。不过在长上下文检索、专业软件工程和部分知识推理评测中,Opus仍保持领先。这局不算赢,但绝对不算输。
这只“靴子”终于落地,但掀桌子靠的不是纯性能
全网苦等三个月的这只“靴子”终于要落地了。从目前流出的信息看,V4大概率不会是个“全项第一”的模型——前有Fable 5和GPT-5.6 Sol挡路,侧有Kimi K3追赶,想靠纯性能掀桌子,难度不小。
但DeepSeek从来不打那张牌。真正的看点始终是那条被反复验证的老路径:把Opus级的能力,价格压到七分之一。当其他巨头的API按百万Token几十美元计价时,哪怕装上了“峰谷计价器”,V4依然是大杀四方的价格屠夫。
顺带提一句,老模型名 deepseek-chat 和 deepseek-reasoner 将在7月24日正式下线。新旧交替,V4时代要正式开始了。