DeepSeek推出V4.1-Flash:552B MoE模型,原生支持视觉理解
摘要
DeepSeek发布V4.1-Flash,采用全新Causal Encoder-Decoder架构,原生支持视觉理解。该模型为552B参数MoE,输入激活8B、输出激活16B,KV cache需求降至HBM的1/4、SSD的1/8,API价格进一步下调。
DeepSeek今日推出其新架构家族中的最小成员——V4.1-Flash。该模型首次采用Causal Encoder-Decoder架构,并原生集成视觉理解能力,标志着DeepSeek在模型架构与多模态方向上的同步推进。
从参数规模看,V4.1-Flash总参数量为552B,采用MoE(混合专家)设计。其中,输入处理阶段激活8B参数,输出生成阶段激活16B参数。这种非对称激活策略意味着模型在理解与生成任务上采取不同的计算资源配置。
在部署效率方面,官方数据显示,V4.1-Flash的KV cache需求较上一代模型大幅降低:HBM占用降至原来的1/4,SSD存储需求降至1/8。这一优化直接降低了推理时的显存与存储开销,也为API价格的下调提供了空间。
DeepSeek表示,V4.1-Flash的API价格将低于此前版本。结合架构创新与原生视觉能力,该模型有望在保持轻量激活的同时,为开发者提供更具成本效益的多模态推理选项。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗