铭鸿体育资讯网

DeepSeek官方公布的评测结果清清楚楚,在终端Agent测试Terminal

DeepSeek官方公布的评测结果清清楚楚,在终端Agent测试Terminal Bench上,V4 Pro正式版拿下87.9分,Fable 5是88.0分。

就差0.1分,在AI安全智能体评测CyberGym和高难度自动化评测AutomationBench上,V4 Pro直接反超了Fable 5。

DeepSWE跑出62.7分,对比预览版的12.8分,翻了快五倍。
 
成本这块更有意思。预览版时期,V4 Pro每百万Token输入3元、输出6元。

这个价格本身就是行业地板Anthropic和OpenAI的同类模型,价格是它的十几倍。

V4 Pro正式版刚上线那几天,价格没动,开发者群里一片狂欢,“梁圣牛逼”刷了满屏。
 
狂欢没持续多久。
 
8月13日深夜,深度求索官方公众号发文,宣布调价。

新价格2026年8月17日0时生效。高峰时段V4 Pro输出价格涨到27元/百万Token。

算下来确实涨了不少,但要注意这个“暴涨12倍”的说法,对比的是缓存命中的极限优惠价,不是常规价格。噱头大于实质。
 
有人翻出6月底的预告DeepSeek当时就说V4正式版上线后会涨价,引入峰谷定价。

只是没想到涨得这么猛,高峰时段9点到12点、14点到18点,刚好是大部分公司干活的时间。

有创业者在即刻上吐槽:“以前一个月API花两千,现在奔着两万去了。”
 
“技术民主化”这个词,本来就有问题,民主化的前提是成本足够低,低到人人用得起。

DeepSeek之前确实做到了V4 Flash把API调用成本干成电费,但那是Flash,不是Pro。Pro从一开始定位就是旗舰,是冲着SOTA王冠去的。

2025年春节DeepSeek爆火之后,整个行业对“国产AI就该便宜”形成了肌肉记忆。

GLM 5.2、Kimi K3接连发力,价格一个比一个狠。

大家默认了中国大模型=性价比,现在DeepSeek突然说不玩了,我要去追Fable 5了,开发者懵了。
 
但换个角度想如果V4 Pro真能逼近甚至超越Fable 5,27块钱贵吗?
 
Fable 5什么价格?Anthropic没公开具体数字,但业内人士估算,百万Token输出在200元以上。

V4 Pro就算涨到27,仍然是Fable 5的七分之一到八分之一。

“成本只有对手十四分之一”的说法,在正式版价格下依然成立。只是没有预览版那么夸张了。
 
这场争吵的本质,不是价格涨没涨,是预期错位。
 
深度求索把V4 Pro定义为“旗舰”,开发者把它当成“升级版便宜货”。

两边不在一个频道上说话,官方评测图里有一行小字很多人没注意——V4 Pro正式版上下文长度1M,最大输出384K。

这是什么概念?一本《三体》90万字,它能一口气处理完,这种级别的能力,成本不可能永远地板价。
 
更值得关注的是行业格局的变化。中银国际证券的报告指出,AI产业正从“榜单排名竞争”转向“真实调用量和商业落地竞争”。
 
8月15日,超算互联网上线了DeepSeek V4 Pro正式版和智能体框架DeepSeek Harness。

8月16日,阿里巴巴旗下“千问办公”首发上线V4 Pro。大厂已经在接入了。

8月17日零点一过,该充值的充值,该迁移的迁移,真正的问题不是“涨没涨价”,是“值不值这个价”。