DeepSeek V4.1 Flash模型发布:更强、更快、更普惠

CNMO科技
 来自北京

【CNMO科技消息】9月10日,DeepSeek正式发布DeepSeek V4.1 Flash模型。这是其全新模型结构系列中的最小尺寸的模型,具备原生多模态视觉理解能力。

DeepSeek

DeepSeek

据CNMO科技了解,DeepSeek V4.1 Flash为552B参数的MoE模型,采用全新的Causal-Encoder-Decoder结构,输入和输出不对称,输入激活只有8B,输出激活16B,成本显著低于已知的同尺寸模型。同时,V4.1 Flash还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括DeepSeek V4 Pro在内的一众旗舰模型的智能水平。

新一代模型大幅减少了KV Cache缓存的大小,与上一代模型相比,对HBM的需求减少到1/4,对SSD的需求减少到1/8。在Agent使用场景中,缓存命中的费用往往占比较高,对KV Cache的压缩大幅降低了Agent类任务的使用成本。

此外,DeepSeek V4.1 Flash已同步上线DeepSeek API,原生支持多模态,将模型名称更改为deepseek-flash即可调用最新的V4.1 Flash模型。旧版本模型V4 Flash 与 V4 Flash Vision Exp现已下线,出于兼容考虑,模型名deepseek-v4-flash、deepseek-v4-flash-vision-exp将被暂时路由到V4.1 Flash。

得益于模型架构的创新,DeepSeek V4.1 Flash能够以更低的成本服务更多的用户,因此DeepSeek相应下调了V4.1 Flash 的定价。同时,为了更合理地调配资源,其仍然采用峰谷定价,闲时价格为高峰时段价格的一半。新价格于2026年9月10日12:00开始生效。

“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。

Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”

热点新闻