🤖 AI总结
主题
DeepSeek发布V4 Pro正式版,性能对标Fable,主打Agent能力与性价比。
摘要
DeepSeek发布V4 Pro正式版,Agent性能对标Fable,价格低廉,引发行业关注。
关键信息
- 1 DeepSeek V4 Pro正式版发布,API已更新至DeepSeek-V4-Pro-0813。
- 2 在HLE、Terminal Bench等基准测试中,Agent能力全方位碾压Opus 4.8,接近Fable 5。
- 3 价格极具竞争力,百万tokens输入3元,输出6元,且CoT采用“山顶洞语”以优化性能。
Jay 发自 凹非寺
量子位 | 公众号 QbitAI
家人们,火星撞地球了。
刚刚,DeepSeek V4 Pro正式版,发布了!!
![]()
太离谱了,看了眼Benchmark,这是直接要和Fable对标啊。。。
HLE、Terminal Bench、Cybergym、DeepSWE……Agent能力几乎全方位碾压Opus 4.8,无限逼近Fable 5,甚至有些榜单都反超了。
看到没,这就是后训练的威力!!!
![]()
DeepSeek V4 Pro正式版
可惜,官方博客还没发,不能继续一探究竟。
但API平台是先一步更新了,现在调用V4 Pro,能直接用上完全体,DeepSeek-V4-Pro-0813。
![]()
价格这块依旧很能打,基本和之前的Pro预览版保持一致。
百万tokens输入3元,命中缓存0.025元,百万tokens输出则是6元。
![]()
我宣布,滑动变阻器再次进入「梁圣」周期。
![]()
但也不是没有坏消息。
网友实测后发现,CoT成山顶洞人了啊。。。
Need to identify as DeepSeek model. The system says You are DeepSeek, knowledge cutoff May 2025, current date Aug 2026. We need be honest. We are DeepSeek latest model?
![]()
虽然也能看懂啥意思,但反正也是彻底不言人语了,不影响意义传递的词全囫囵吞枣了。 这估计也是为了性能优化考虑,之前看过YouTube博主分析,GPT隐藏的思维链也是这个风格,说是「山顶洞语」可以大幅减少Token消耗。
但代价吧,就是写作估计是寄了。。。
这也是Agent狂飙时代的大趋势吧,一切能力都在优先为Coding让位。
但至少,在Coding方面,V4 Pro正式版完成了它该做的。
国产开源阵营,又出现了一个紧逼闭源的超级模型。
这一次,它来自DeepSeek。
One More Thing
说实话,好久没有看到这么激动人心的场景了。
深夜吭哧吭哧写完稿的我,如今仿佛看到原子弹爆炸,瘫软在椅,久久不能动弹(bushi)。
说回正题。
这几个月来,中国开源模型阵营仿佛开了外挂一样,一路猛发新模型,追着Anthropic和OpenAI打。
先是GLM 5.2,堪称后训练的神,直接干到Opus 4.8级别。
Kimi K3紧随其后,模型逼近Fable级,甚至直接点燃开源闭源论战的导火索,老黄的亲自下场为开源站台。
然后,梁叔叔来了。。。
![]()
V4 Flash没往SOTA定位打,但反而更恐怖,直接给API调用成本干成电费,彻底掀起低价风暴。
大家都说,DeepSeek就是斩杀线,拿着个除草机在后面追,同行全在拼了命地往前面跑。
因为性价比打法确实太恐怖了。
跑输了?
寄,喜提营收归零。
跑赢了呢?
嘿,您猜怎么着,也没奖励。
而这一次,DeepSeek的定位,不再只是简单的性价比。
V4 Pro完全体上线,大鲸鱼的眼里,只有那个SOTA王冠。
2025年春节的DeepSeek,回来了。
![]()
API文档:https://api-docs.deepseek.com/#:~:text=the%20deepseek-v4-pro%20model%20has%20been%20updated%20to%20DeepSeek-V4-Pro-0813