DeepSeek-V4-Flash

厂家 / 系列
深度求索DeepSeek
上下文
1M
输入价
$0.44 / 百万 tokens
输出价
$1.32 / 百万 tokens
许可
开源

快速对比

DeepSeek-V4-Flash 固定为第一列,选择一个候选即可并列查看关键规格。

查看 DeepSeek 系列对比

COMPARE MATRIX · 横向比较

模型比较

并列查看 0模型的关键规格

当前不足 2 项,可关闭面板后继续选择。

已选模型规格比较矩阵
比较项
规格暂无可比较规格
提示:左右滚动可查看全部项目

概览

DeepSeek-V4 系列的高性价比档,284B 总参、13B 激活的 MoE 模型,采用压缩稀疏注意力与重压缩注意力的混合设计,并引入流形约束超连接(mHC)强化残差通路,预训练用了超过 32 万亿 token。上下文同样是 100 万 token、最大输出 384K token,价格却只有 V4-Pro 的三分之一,适合大批量长文处理与日常编码。权重以 MIT 协议开放,提供 FP8 混合与 FP4+FP8 混合两种精度版本,0731 版在 Hugging Face 的上月下载量接近 400 万次。另有实验性视觉版本 deepseek-v4-flash-vision-exp 支持图像输入,价格与文本版一致。

模态
文本
参数量
284B (MoE,激活 13B)
许可说明
开源 · MIT

能力

  • 百万 token 上下文,成本仅为旗舰档的三分之一
  • 混合注意力架构,长文推理开销低
  • 可调节思考强度的推理模式
  • 代码生成与竞赛级编程
  • MIT 协议开放权重,提供 FP8/FP4 混合精度版本

基准测试

分数按各测试原始量表列示,不同测试之间不作百分比换算。

测试项目得分量表
Terminal Bench 2.182.7/ 100
CyberGym76.7/ 100
DSBench-FullStack68.7/ 100
DeepSWE54.4/ 100
NL2Repo54.2/ 100

版本历史

  1. 2026-08

    • 推出实验性多模态版本 deepseek-v4-flash-vision-exp,支持图像输入
  2. 2026-07

    上下文 1M输入 $0.44 / 百万 tokens输出 $1.32 / 百万 tokens
    • V4-Flash 正式版(0731)公测上线,智能体表现大幅提升

使用该模型的工具

浏览全部工具