DeepSeek-V4.1-Flash
DeepSeek 推出的多模态模型 · 发布于 2026-09
开源
多模态
开源
API 可用
模型简介
DeepSeek-V4.1-Flash 是 DeepSeek 于 2026 年 9 月 10 日发布的新架构家族最小尺寸成员。552B 总参数 MoE,采用全新 Causal-Encoder-Decoder(CED)非对称架构,输入侧仅激活 8B、输出侧激活 16B,专为 Agent 时代「输入重、输出轻」的真实负载设计。支持 100 万 tokens 上下文与最大 384K 输出,原生多模态视觉理解,KV Cache 相比上一代 HBM 需求降至 1/4。基准全面超越旗舰 V4 Pro,API 定价低至缓存命中 ¥0.02/百万 tokens,是 Agent 时代最具性价比的开源模型。
核心特性
- CED 非对称架构(输入 8B / 输出 16B)
- 100万 tokens 上下文 + 384K 最大输出
- 原生多模态视觉理解
- KV Cache 压缩(HBM 降至 1/4、SSD 降至 1/8)
核心优势
- 基准全面超越 V4 Pro
- API 成本极低(缓存命中 ¥0.02/M)
- 输入侧轻量化高效读入
- 开源可商用
技术规格
参数量
552B (输入 8B / 输出 16B 激活)
上下文窗口
1M tokens
API 支持
是
开源状态
开源
发布日期
2026-09
提供商
DeepSeek
价格信息
缓存命中输入 ¥0.02/百万 tokens、未命中 ¥1、输出 ¥4(空闲时段,高峰翻倍);开源免费
基准测试
GPQA Diamond 90.9, Codeforces 3471, Terminal-Bench 2.1 90.6, CyberGym 88.1,全面超越 V4 Pro