洱海新闻

倒反天罡?DeepSeek-V4-Flash正式版上线,干翻自家先发的Pro版

来源:洱海新闻 分类:科技
倒反天罡?DeepSeek-V4-Flash正式版上线,干翻自家先发的Pro版

智东西

作者 | 王涵

编辑 | 冰倩

智东西7月31日获悉,DeepSeek-V4-Flash正式版的API现已启动公测,另外,DeepSeek-V4-Pro正式版也将在8月初上线。此次更新距离DeepSeek V4预览版发布已有3个月。

DeepSeek-V4-Flash正式版基于MoE架构设计,总参数量达284B(激活参数为13B),同时支持最长100万token上下文,允许在非思考与思考模式间切换。模型结构及尺寸未变,仅进行了后训练优化。

DeepSeek V4预览版已针对Claude Code、OpenClaw、OpenCode、CodeBuddy等主流Agent产品完成适配与优化。Flash正式版原生支持OpenAI的Responses API格式,并专门适配Codex(*开发者无需调整Base URL即可切换模型*)。

根据DeepSeek API文档记载,DeepSeek-V4-Flash正式版的Agent能力实现显著提升,基准测试数据如下:

4月24日,DeepSeek正式发布并开源DeepSeek-V4系列预览版本。DeepSeek-V4-Pro侧重性能上限,对标闭源旗舰模型;而DeepSeek-V4-Flash在参数规模与激活规模上有所缩减,以此换取更低延迟与更低成本。

DeepSeek-V4-Pro-Preview在Agentic Coding等评测中位列开源模型第一梯队,内部评测显示交付质量已接近Claude Opus 4.6的非思考模式,但思考模式之间仍存差距。

DeepSeek-V4-Pro-Preview在数学、STEM及竞赛型代码等高难度任务上超越当前已公开的开源模型,整体表现接近GPT-5.4、Claude Opus 4.6-Max等顶级闭源模型。

DeepSeek-V4在长上下文效率上同样实现突破:在100万token场景下,单token推理计算量仅为V3.2的27%,KV Cache占用降至约10%,大幅降低长链路任务的算力与显存成本。

定价方面,DeepSeek-V4-Pro在输入命中缓存时为1元/百万tokens,输入未命中缓存为12元/百万tokens,输出为24元/百万tokens;DeepSeek-V4-Flash在输入命中缓存时仅需0.2元/百万tokens,未命中输入1元/百万tokens,输出2元/百万tokens。

结语:价格战只关乎入场券,Agent能力才是决胜关键

今日,OpenAI宣布GPT-5.6 Luna降价80%,Terra降价20%,这一举动被业内视为受国产大模型低价策略施压所致。价格战持续至今,API调用成本已非开发者选择模型的唯一考量,真正稀缺的是可靠的Agent能力。

过去半年,国产团队在保持价格优势的同时,着力弥补Agent与Coding领域的短板。DeepSeek-V4-Flash正式版的Agent能力全面超越之前的Pro预览版,以更亲民的价格提供更强的工作效能,这印证了:低价未必意味着低能。

对开发者而言,价格战决定的是参与资格,而模型的Agent能力才是衡量智能极限的标准。

相关推荐