DeepSeek-V4-Flash
- 上下文
- 1M
- 输入价
- $0.44 / 百万 tokens
- 输出价
- $1.32 / 百万 tokens
- 许可
- 开源
概览
DeepSeek-V4 系列的高性价比档,284B 总参、13B 激活的 MoE 模型,采用压缩稀疏注意力与重压缩注意力的混合设计,并引入流形约束超连接(mHC)强化残差通路,预训练用了超过 32 万亿 token。上下文同样是 100 万 token、最大输出 384K token,价格却只有 V4-Pro 的三分之一,适合大批量长文处理与日常编码。权重以 MIT 协议开放,提供 FP8 混合与 FP4+FP8 混合两种精度版本,0731 版在 Hugging Face 的上月下载量接近 400 万次。另有实验性视觉版本 deepseek-v4-flash-vision-exp 支持图像输入,价格与文本版一致。
- 模态
- 文本
- 参数量
- 284B (MoE,激活 13B)
- 许可说明
- 开源 · MIT
能力
- 百万 token 上下文,成本仅为旗舰档的三分之一
- 混合注意力架构,长文推理开销低
- 可调节思考强度的推理模式
- 代码生成与竞赛级编程
- MIT 协议开放权重,提供 FP8/FP4 混合精度版本
基准测试
分数按各测试原始量表列示,不同测试之间不作百分比换算。
| 测试项目 | 得分 | 量表 |
|---|---|---|
| Terminal Bench 2.1 | 82.7 | / 100 |
| CyberGym | 76.7 | / 100 |
| DSBench-FullStack | 68.7 | / 100 |
| DeepSWE | 54.4 | / 100 |
| NL2Repo | 54.2 | / 100 |
版本历史
2026-08
- 推出实验性多模态版本 deepseek-v4-flash-vision-exp,支持图像输入
2026-07
上下文 1M输入 $0.44 / 百万 tokens输出 $1.32 / 百万 tokens- V4-Flash 正式版(0731)公测上线,智能体表现大幅提升


