核心信息
DeepSeek V4.1 Flash 是 DeepSeek 新架构家族中最小的一款模型,现已通过 Requesty 提供,采用更低的价格(输入 $0.30/百万 token、缓存命中 $0.006/百万 token、输出 $1.20/百万 token),并支持原生图像理解和 100 万 token 上下文窗口。
要点
- 相比 DeepSeek v4 Flash,输入价格下降 32%,缓存命中下降 57%,输出下降 9%。
- 新增原生视觉理解与 100 万 token 上下文,同时强调更快的推理速度和更高吞吐量,适合生产环境使用。