家人们,火星撞地球了。
(资料图片仅供参考)
刚刚,DeepSeek V4 Pro正式版,发布了!!
太离谱了,看了眼Benchmark,这是直接要和Fable对标啊。。。
HLE、Terminal Bench、Cybergym、DeepSWE……Agent能力几乎全方位碾压Opus 4.8,无限逼近Fable 5,甚至有些榜单都反超了。
看到没,这就是后训练的威力!!!
可惜,官方博客还没发,不能继续一探究竟。
但API平台是先一步更新了,现在调用V4 Pro,能直接用上完全体,DeepSeek-V4-Pro-0813。
价格这块依旧很能打,基本和之前的Pro预览版保持一致。
百万tokens输入3元,命中缓存0.025元,百万tokens输出则是6元。
我宣布,滑动变阻器再次进入「梁圣」周期。
但也不是没有坏消息。
网友实测后发现,CoT成山顶洞人了啊。。。
虽然也能看懂啥意思,但反正也是彻底不言人语了,不影响意义传递的词全囫囵吞枣了。 这估计也是为了性能优化考虑,之前看过YouTube博主分析,GPT隐藏的思维链也是这个风格,说是「山顶洞语」可以大幅减少Token消耗。
但代价吧,就是写作估计是寄了。。。
这也是Agent狂飙时代的大趋势吧,一切能力都在优先为Coding让位。
但至少,在Coding方面,V4 Pro正式版完成了它该做的。
国产开源阵营,又出现了一个紧逼闭源的超级模型。
这一次,它来自DeepSeek。
说实话,好久没有看到这么激动人心的场景了。
深夜吭哧吭哧写完稿的我,如今仿佛看到原子弹爆炸,瘫软在椅,久久不能动弹(bushi)。
说回正题。
这几个月来,中国开源模型阵营仿佛开了外挂一样,一路猛发新模型,追着Anthropic和OpenAI打。
先是GLM 5.2,堪称后训练的神,直接干到Opus 4.8级别。
Kimi K3紧随其后,模型逼近Fable级,甚至直接点燃开源闭源论战的导火索,老黄的亲自下场为开源站台。
然后,梁叔叔来了。。。
V4 Flash没往SOTA定位打,但反而更恐怖,直接给API调用成本干成电费,彻底掀起低价风暴。
大家都说,DeepSeek就是斩杀线,拿着个除草机在后面追,同行全在拼了命地往前面跑。
因为性价比打法确实太恐怖了。
跑输了?
寄,喜提营收归零。
跑赢了呢?
嘿,您猜怎么着,也没奖励。
而这一次,DeepSeek的定位,不再只是简单的性价比。
V4 Pro完全体上线,大鲸鱼的眼里,只有那个SOTA王冠。
2025年春节的DeepSeek,回来了。
API文档:https://api-docs.deepseek.com/#:~:text=the%20deepseek-v4-pro%20model%20has%20been%20updated%20to%20DeepSeek-V4-Pro-0813
