刚刚,DeepSeek V4 Pro正式版发布,多项对标Fable 5
现在调用V4 Pro,能直接用上完全体
本条来自 量子位(AI / 中文),聚焦 technology、ai。 太离谱了,看了眼Benchmark,这是 直接要和Fable对标啊。。。
现在调用V4 Pro,能直接用上完全体
- 刚刚,DeepSeek V4 Pro正式版,发布了!!
- 含35个基准测试的综合评估框架,覆盖22个子类别医疗任务
- 正推动AI硬件从“工具”向“成长伙伴”演进
- 太离谱了,看了眼Benchmark,这是 直接要和Fable对标啊
现在调用V4 Pro,能直接用上完全体
刚刚,DeepSeek V4 Pro正式版,发布了!!
太离谱了,看了眼Benchmark,这是 直接要和Fable对标啊。。。
HLE、Terminal Bench、Cybergym、DeepSWE……Agent能力几乎全方位碾压Opus 4.8,无限逼近Fable 5,甚至有些榜单都反超了。
但API平台是先一步更新了,现在调用V4 Pro,能直接用上完全体, DeepSeek-V4-Pro-0813 。
价格这块依旧很能打,基本和之前的Pro预览版保持一致。
百万tokens输入 3元 ,命中缓存 0.025元 ,百万tokens输出则是 6元 。
网友实测后发现, CoT成山顶洞人了啊。。。
Need to identify as DeepSeek model. The system says You are DeepSeek, knowledge cutoff May 2025, current date Aug 2026. We need be honest. We are DeepSeek latest model?
虽然也能看懂啥意思,但反正也是彻底不言人语了,不影响意义传递的词全囫囵吞枣了。 这估计也是为了性能优化考虑,之前看过YouTube博主分析, GPT隐藏的思维链也是这个风格 ,说是「山顶洞语」可以大幅减少Token消耗。
这也是Agent狂飙时代的大趋势吧,一切能力都在优先为Coding让位。
但至少,在Coding方面,V4 Pro正式版完成了它该做的。
国产开源阵营,又出现了一个紧逼闭源的超级模型。
说实话,好久没有看到这么激动人心的场景了。
深夜吭哧吭哧写完稿的我,如今仿佛看到原子弹爆炸,瘫软在椅,久久不能动弹(bushi)。
这几个月来,中国开源模型阵营仿佛开了外挂一样,一路猛发新模型,追着Anthropic和OpenAI打。
先是 GLM 5.2 ,堪称后训练的神,直接干到Opus 4.8级别。
Kimi K3 紧随其后,模型逼近Fable级,甚至直接点燃开源闭源论战的导火索,老黄的亲自下场为开源站台。
V4 Flash没往SOTA定位打,但反而更恐怖,直接给API调用成本干成电费,彻底掀起低价风暴。
大家都说,DeepSeek就是斩杀线,拿着个除草机在后面追,同行全在拼了命地往前面跑。
而这一次,DeepSeek的定位,不再只是简单的性价比。
V4 Pro完全体上线,大鲸鱼的眼里,只有那个SOTA王冠。
2025年春节的DeepSeek,回来了。
API文档:https://api-docs.deepseek.com/#:~:text=the%20deepseek-v4-pro%20model%20has%20been%20updated%20to%20DeepSeek-V4-Pro-0813
含35个基准测试的综合评估框架,覆盖22个子类别医疗任务
正推动AI硬件从“工具”向“成长伙伴”演进
量子位 QbitAI 版权所有©北京极客伙伴科技有限公司 京ICP备17005886号-1
本条目归入「Technology AI」垂直,涉及真实话题:technology、ai。
· 市场:关注 technology、ai 对相关品类与竞争格局的潜在影响。
· 消费者:受众行为与偏好变化值得追踪。
· 品牌:本动向对品牌资产建设的启示。
· 渠道:内容分发与触点组合(社媒 / 电商 / 线下)的协同值得复盘。
· 核心话题:technology、ai。
· 可思考:如何把「technology」的洞察,转化为可衡量的内容与增长动作?
面试中可引用「刚刚,DeepSeek V4 Pro正式版发布,多项对标Fable 5」:围绕 technology、ai,说明你对行业动向的判断与可落地动作。
本条目相关英文术语可在「商务英语」模块按话题检索,用于外企面试表达训练。
这几个月来,中国开源模型阵营仿佛开了外挂一样,一路猛发新模型,追着Anthropic和OpenAI打。…