DeepSeek-V4-Flash正式版上线公测!

2026-08-03 DeepSeek

2026年7月31日DeepSeek-V4-Flash正式版上线公测

🚀 性能表现

  • Agent能力跃升正式版核心提升在于Agent(智能体)能力大幅增强。它能像真正的工程师一样工作,例如打开终端、分析代码仓库、调用工具并完成端到端的开发任务。
  • 基准测试领先:在多项权威评测中,V4-Flash正式版成绩优异,尤其在终端操作(82.7分)网络安全对抗(76.7分)工具调用(70.3分) 等方面表现出色。
  • 推理能力接近Pro版:在推理任务上,V4-Flash的表现接近更高端的V4-Pro版本。尤其在简单Agent任务上,两者表现相当。

新增了对 Responses API 格式的支持
Responses API 目前仅支持 deepseek-v4-flash 模型,暂不支持 deepseek-v4-pro 模型。
配置方式:https://api-docs.deepseek.com/zh-cn/guides/responses_api/

💡 核心特性

  • 模型架构:采用混合专家(MoE) 架构。总参数量为2840亿(284B),但每次推理仅激活其中的130亿(13B) 参数,这使其在保持强大能力的同时,实现了极高的计算效率。
  • 超长上下文:原生支持100万(1M)token的上下文窗口。这使其能一次性处理如《三体》三部曲体量的长文本,在长文档分析、复杂代码库理解等任务中优势明显。
  • 技术创新:采用DSA2稀疏注意力等架构优化,相比前代V3.2,其推理算力和KV Cache占用分别仅为前者的10%和7%,显著降低了部署和运行成本。

💰 价格与可用性

  • API定价:延续了DeepSeek的高性价比策略。以每百万tokens计:
    • 输入(缓存命中):0.2元
    • 输入(缓存未命中):1元
    • 输出2元
    • 相比之下,V4-Pro版的价格分别为1元、12元和24元,Flash版在成本上优势巨大。