DeepSeek V4 Pro正式版上线:Agent能力大幅跃升,性能逼近Fable 5
8月13日,没有预告,没有发布会。8月12日晚间,DeepSeek悄然更新API文档,将旗舰模型V4 Pro正式转正。新版本编号为DeepSeek-V4-Pro-0813,调用方式保持不变,已接入API的开发者可直接体验。
这次从预览版到正式版的跨越,核心升级落在Agent能力上。V4 Pro正式版支持100万Token上下文窗口和38.4万Token最大输出,能一次性处理大型代码库或多份长文档,同时新增对Responses API和Codex的原生支持。模型仍采用MoE稀疏架构,总参数约1.6万亿,每Token激活约490亿参数。
从官方公布的评测数据看,V4 Pro正式版在多维度Agent测试中较预览版有代际提升。Terminal Bench 2.1从72.1升至87.9,Cybergym从52.7升至83.3,DeepSWE更是从12.8飙升至62.7(提升近5倍)。官方宣称其在多项测试中逼近Anthropic的Claude Fable 5,部分子项甚至实现反超。
不过,独立测试平台Artificial Analysis给出综合评分53分,仅比V4 Flash高出1分,社区评测也显示在部分经典任务上与旧版差异不大。有分析认为,Pro版的完整性能可能需搭配DeepSeek自研推理框架DeepSeek Harness才能充分释放,也可能与当前尚未全量部署有关。
定价方面,V4 Pro为3元/百万Token输入、6元/百万Token输出(缓存命中低至0.025元),约为V4 Flash的三倍。虽然官方此前已预告“近期将较大幅度上调API价格”,但目前0813版本仍未调价。在性能接近Fable 5的前提下,V4 Pro的价格仅为前者的几十分之一,性价比优势依然突出。