DeepSeek 推出 V4.1-Flash:新架构支持原生视觉理解,定价大幅下调
摘要
DeepSeek 发布 V4.1-Flash 模型,采用 Causal Encoder-Decoder 新架构,首次支持原生视觉理解,参数规模为 552B MoE,输入处理激活 8B、输出生成激活 16B,同时价格大幅下调。
DeepSeek 近日推出新一代模型 V4.1-Flash,在架构层面引入 Causal Encoder-Decoder 设计,并首次实现原生视觉理解能力。这一发布标志着该公司在多模态方向上的重要进展。
据官方信息,V4.1-Flash 采用 552B 参数的混合专家(MoE)架构。在推理过程中,输入处理阶段激活 8B 参数,输出生成阶段激活 16B 参数,兼顾了处理效率与生成质量。
除架构与能力升级外,DeepSeek 同步对 V4.1-Flash 的定价进行了大幅下调。对于依赖 API 调用的开发者和企业用户而言,这一调整有望降低多模态应用的部署成本。
原生视觉理解的加入,意味着模型可直接处理图像输入,无需依赖外部视觉编码模块。结合新架构与降价策略,V4.1-Flash 或将在多模态推理市场引发新一轮竞争。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗