DeepSeek V4「满血版」即将发布:性能逼近Opus级,峰谷计费重塑API生态

DeepSeek V4「满血版」即将发布:性能逼近Opus级,峰谷计费重塑API生态

核心事件速览

DeepSeek V4正式版可能最早于明日发布,最迟不过这几天。目前,一部分开发者已提前拿到DeepSeek V4(GA)灰度测试权限。该版本包含两个子版本:DeepSeek V4 FlashDeepSeek V4 Pro


一、如何验证自己是否已接入V4?

博主AiBattle总结了一套民间「验货口诀」:观察模型思维链(CoT)的第一人称表述

  • 如果模型的思考过程以「I'm」「I'll」开头,大概率已接入V4 GA版;
  • 如果仍以「Let me」开头,则仍为老版本。

这一识别方式已成为当前开发者圈内的通用验证手段。


二、首轮测试性能表现

开发者Pankaj Kumar对V4的性能做了初步总结,其推文链接如下:

https://x.com/pankajkumar_dev/status/2078536231026372846

关键结论:

维度 表现
整体能力 接近Opus 4.8级别
编码能力 直追GPT-5.6 Sol
Agent能力 大幅增强
3D/SVG生成 显著改善
迭代轮数 比Fable 5多

此外,有测试demo显示,V4 Pro可一次生成完整的3D模拟射击游戏(含攻城弩车打靶玩法及基础UI),以及《我的世界》+《无人深空》混合风格的HTML游戏、「割绳子」经典游戏复刻等。


三、价格策略:首次引入「峰谷计费」

DeepSeek上个月底向所有API用户发送邮件,宣布将于7月中旬上线V4正式版,并同步调整API定价。

API定价详情

deepseek-v4-pro:
- 百万输出tokens:平时 $0.87,高峰 $1.74
- 缓存未命中的输入:$0.435

deepseek-v4-flash:
- 百万输出:$0.28,高峰 $0.56
- 缓存命中的输入:$0.0028

影响分析

  • 对个人用户:影响有限。
  • 对企业团队:将Agent挂在工作时间不间断跑的团队需重新核算成本。
  • 优化空间:缓存命中价格极低,批量任务、评测跑分、数据生成可挪至非高峰时段以降低成本。

四、性价比定位:「价格屠夫」的延续

V4正式版的核心竞争力并非「全项第一」,而是以更低价格提供接近Opus级的能力

回顾预览版自测数据:
- DeepSeek-V4-Pro-Max在SWE-bench Verified中距Claude Opus 4.6 Max仅差0.2个百分点;
- 价格仅为对方的七分之一。

尽管在长上下文检索、专业软件工程和部分知识推理评测中,Opus仍保持领先,但V4在性价比上依然具备显著优势。


五、老模型下线通知

  • deepseek-chatdeepseek-reasoner 两个老模型名将于 7月24日正式下线

六、竞争格局研判

从当前生态位来看:

模型 定位
Fable 5 / GPT-5.6 Sol 性能领先
Kimi K3 综合竞争力强
DeepSeek V4 性价比优先

V4大概率打不过刚发布的Kimi K3,但价格显著更低。DeepSeek的策略路径始终清晰:将顶级能力压到七分之一价格,而非追求纯性能碾压。


结语

全网苦等三个月的这只「靴子」终于要落地。V4不会是「全项第一」的模型,但凭借Opus级的能力和极具竞争力的定价,它依然是那个大杀四方的「价格屠夫」。对于AI从业者和开发者而言,关注点应从「谁最强」转向「谁最值」——在峰谷计费的新规则下,如何优化调用策略将成为新的核心竞争力。


参考资料:
- https://x.com/pankajkumar_dev/status/2078536231026372846