快讯 09:42DeepSeek 开源 V4 推理引擎,推理成本再降 40%10:15逐际动力完成 B 轮 5 亿元融资,加速人形机器人量产10:58Kimi 企业版 API 上线,新增批量推理折扣档位 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期四 · 09-10 16:16 约 1 分钟读完

DeepSeek推出V4.1-Flash:552B MoE模型,原生支持视觉理解

摘要

DeepSeek发布V4.1-Flash,采用全新Causal Encoder-Decoder架构,原生支持视觉理解。该模型为552B参数MoE,输入激活8B、输出激活16B,KV cache需求降至HBM的1/4、SSD的1/8,API价格进一步下调。

DeepSeek今日推出其新架构家族中的最小成员——V4.1-Flash。该模型首次采用Causal Encoder-Decoder架构,并原生集成视觉理解能力,标志着DeepSeek在模型架构与多模态方向上的同步推进。

从参数规模看,V4.1-Flash总参数量为552B,采用MoE(混合专家)设计。其中,输入处理阶段激活8B参数,输出生成阶段激活16B参数。这种非对称激活策略意味着模型在理解与生成任务上采取不同的计算资源配置。

在部署效率方面,官方数据显示,V4.1-Flash的KV cache需求较上一代模型大幅降低:HBM占用降至原来的1/4,SSD存储需求降至1/8。这一优化直接降低了推理时的显存与存储开销,也为API价格的下调提供了空间。

DeepSeek表示,V4.1-Flash的API价格将低于此前版本。结合架构创新与原生视觉能力,该模型有望在保持轻量激活的同时,为开发者提供更具成本效益的多模态推理选项。

DeepSeekV4.1-FlashMoE视觉理解
本文由新大陆基于公开信息编辑整理
3,284
收录 AI 工具
186
模型产品档案
57
企业落地案例
1,247
完整版提示词