概览
DeepSeek-V4.1-Flash 于 2026-09-10 正式发布,是 DeepSeek 新架构系列中的最小尺寸模型,原生支持多模态视觉理解。官方称其在智能水平上可媲美包括 Claude Opus 4.1、GPT-5、Gemini 2.5 Pro、DeepSeek V4 Pro 在内的一众旗舰;Agent 场景下 KV Cache 对 HBM/SSD 需求分别降至上一代的约 1/4 与 1/8,显著降低缓存命中成本。API 调用将 model 设为 `deepseek-flash`。旧名 `deepseek-v4-flash` / `deepseek-v4-flash-vision-exp` 已下线但临时路由到 V4.1-Flash 并按 Flash 价计费;自 2026-09-14 12:00(北京时间)起,`deepseek-v4-pro` 请求也将全部路由到 V4.1-Flash 并按 Flash 价计费,直至未来 V4.1-Pro。上下文 1M、最大输出 384K,支持思考/非思考模式。价格(每百万 tokens):输入缓存命中空闲¥0.02/高峰¥0.04,未命中空闲¥1/高峰¥2,输出空闲¥4/高峰¥8;高峰为北京时间周一至周五 9:00-12:00、14:00-18:00。来源:https://api-docs.deepseek.com/news/news260910;https://api-docs.deepseek.com/zh-cn/quick_start/pricing;https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash
- 模态
- 多模态
- 许可说明
- 开源 · 开源 · MIT(HF 权重)
能力
- 原生图像理解


