DeepSeek-V4.1-Flash 首发上线硅基流动,552B MoE 原生支持 1M 上下文
摘要
硅基流动宣布 DeepSeek-V4.1-Flash 于 Day 0 上线其平台。该模型采用 552B MoE 架构,prefill 约 8B 激活、decode 约 16B 激活,具备原生视觉能力与 1M 上下文窗口,KV cache 占用约为 V4 Flash 的四分之一,并以 MIT 许可证开放。
硅基流动今日宣布,DeepSeek-V4.1-Flash 已在发布当天(Day 0)同步上线其推理平台,用户可直接调用这一新版本模型。
据官方信息,DeepSeek-V4.1-Flash 采用 552B 参数的 MoE(混合专家)架构,其中 prefill 阶段约激活 8B 参数,decode 阶段约激活 16B 参数。模型原生支持视觉输入,并具备 1M 上下文窗口。
在工程层面,该模型的 KV cache 占用约为 V4 Flash 的四分之一,这意味着在长上下文场景下可显著降低显存压力与推理成本。许可证方面,DeepSeek-V4.1-Flash 采用 MIT 协议开放。
此次 Day 0 上线延续了硅基流动快速接入新模型的策略。对开发者而言,552B MoE 与 1M 上下文的组合,配合更低的 KV cache 开销,有望在长文档理解、多模态推理等场景中提供新的选择。
本文由新大陆基于公开信息编辑整理
信息来源:AIHOT AIHOT原文 ↗