ChengRang
EN

DeepSeek V4.1-Flash 热门 新增

AI 开发平台 开源
本页为 DeepSeek V4 的版本 / 子产品详情。查看 DeepSeek V4 总览 →

DeepSeek 2026/9/10 发布的新架构家族最小模型:552B MoE(prefill 激活 8B、解码激活 16B)、原生视觉理解、1M 上下文、FP4 KV 缓存每 token 约 890 字节,官方称全面超越 V4 Pro;MIT 开源,API 输入缓存未命中低至 1 元/百万 token

大模型 开源 多模态 1M 上下文 Agent
访问 DeepSeek V4.1-Flash 官网

免责声明:测评内容仅代表编辑个人观点和使用体验,不构成任何商业推荐或投资建议。产品信息和价格可能随时变动,请以官方最新信息为准。

产品简介

DeepSeek-V4.1-Flash 是深度求索于 2026 年 9 月 10 日发布的全新模型结构系列中的最小尺寸模型,也是该家族首个正式版。它采用全新的 Causal Encoder-Decoder 架构,设计目标是能力上限更高、推理速度更快、吞吐更大,并可扩展到更大参数规模的模型。

模型为 552B MoE 架构,prefill 阶段激活约 8B 参数、解码阶段激活约 16B 参数,支持 1M 上下文与最大 384K 输出。最值得关注的是 KV 缓存优化:FP4 量化的全局 KV 缓存降至每 token 约 890 字节,约为上一代 V4-Flash 的四分之一,显著降低了 Agent 长上下文场景的显存与存储成本。

它是 DeepSeek 首个原生支持多模态视觉理解的正式版模型,在需要视觉理解的 Agent 基准上直接衔接了 8 月底 Vision-Exp 实验版验证过的方向。API 模型名更新为 deepseek-flash,MIT 协议开源上架 Hugging Face,第三方云平台同步接入。

核心功能

适合谁用

以下类型的用户会特别受益于 DeepSeek V4.1-Flash:

优点亮点

价格与方案

API 峰谷定价(每百万 token):输入缓存命中空闲 0.02 元、高峰 0.04 元;输入未命中空闲 1 元、高峰 2 元;输出空闲 4 元、高峰 8 元。高峰时段为北京时间工作日 9:00-12:00、14:00-18:00。并发限制 2500。模型权重 MIT 协议开源,自部署无授权费用。

总结与建议

DeepSeek-V4.1-Flash 是 2026 年国内开源模型阵营最重要的一次更新。它用新架构同时做到了能力提升和成本骤降,官方直接以它替代自家旗舰 V4 Pro,第三方实测也认可这个判断。对需要长上下文 Agent、多模态理解和低成本规模化部署的团队,它是当前开源阵营的首选之一;对 API 用户,峰谷定价加缓存优惠把成本压到了行业最低档。

版本演进

分类
AI 开发平台
价格
开源
标签
大模型 · 开源 · 多模态