快讯 09:42DeepSeek 开源 V4 推理引擎,推理成本再降 40%10:15逐际动力完成 B 轮 5 亿元融资,加速人形机器人量产10:58Kimi 企业版 API 上线,新增批量推理折扣档位 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期四 · 09-10 16:49 约 1 分钟读完

DeepSeek 推出 V4.1-Flash:新架构支持原生视觉理解,定价大幅下调

摘要

DeepSeek 发布 V4.1-Flash 模型,采用 Causal Encoder-Decoder 新架构,首次支持原生视觉理解,参数规模为 552B MoE,输入处理激活 8B、输出生成激活 16B,同时价格大幅下调。

DeepSeek 近日推出新一代模型 V4.1-Flash,在架构层面引入 Causal Encoder-Decoder 设计,并首次实现原生视觉理解能力。这一发布标志着该公司在多模态方向上的重要进展。

据官方信息,V4.1-Flash 采用 552B 参数的混合专家(MoE)架构。在推理过程中,输入处理阶段激活 8B 参数,输出生成阶段激活 16B 参数,兼顾了处理效率与生成质量。

除架构与能力升级外,DeepSeek 同步对 V4.1-Flash 的定价进行了大幅下调。对于依赖 API 调用的开发者和企业用户而言,这一调整有望降低多模态应用的部署成本。

原生视觉理解的加入,意味着模型可直接处理图像输入,无需依赖外部视觉编码模块。结合新架构与降价策略,V4.1-Flash 或将在多模态推理市场引发新一轮竞争。

DeepSeekV4.1-Flash多模态MoE
本文由新大陆基于公开信息编辑整理
3,284
收录 AI 工具
186
模型产品档案
57
企业落地案例
1,247
完整版提示词