快讯 09:42DeepSeek 开源 V4 推理引擎,推理成本再降 40%10:15逐际动力完成 B 轮 5 亿元融资,加速人形机器人量产10:58Kimi 企业版 API 上线,新增批量推理折扣档位 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期五 · 09-11 22:21 约 1 分钟读完

DeepSeek-V4.1-Flash 首发上线硅基流动,552B MoE 原生支持 1M 上下文

摘要

硅基流动宣布 DeepSeek-V4.1-Flash 于 Day 0 上线其平台。该模型采用 552B MoE 架构,prefill 约 8B 激活、decode 约 16B 激活,具备原生视觉能力与 1M 上下文窗口,KV cache 占用约为 V4 Flash 的四分之一,并以 MIT 许可证开放。

硅基流动今日宣布,DeepSeek-V4.1-Flash 已在发布当天(Day 0)同步上线其推理平台,用户可直接调用这一新版本模型。

据官方信息,DeepSeek-V4.1-Flash 采用 552B 参数的 MoE(混合专家)架构,其中 prefill 阶段约激活 8B 参数,decode 阶段约激活 16B 参数。模型原生支持视觉输入,并具备 1M 上下文窗口。

在工程层面,该模型的 KV cache 占用约为 V4 Flash 的四分之一,这意味着在长上下文场景下可显著降低显存压力与推理成本。许可证方面,DeepSeek-V4.1-Flash 采用 MIT 协议开放。

此次 Day 0 上线延续了硅基流动快速接入新模型的策略。对开发者而言,552B MoE 与 1M 上下文的组合,配合更低的 KV cache 开销,有望在长文档理解、多模态推理等场景中提供新的选择。

DeepSeek硅基流动MoE1M上下文
本文由新大陆基于公开信息编辑整理
3,284
收录 AI 工具
186
模型产品档案
57
企业落地案例
1,247
完整版提示词