浪潮信息元脑SD200 Ultra超节点亮相:国产芯片单机跑通2.8万亿参数Kimi K3
浪潮信息在AICC2026发布元脑SD200 Ultra超节点,基于国产AI芯片单机承载2.8万亿参数Kimi K3,Token生成时延降至5.85毫秒以内,单用户速度达170 Tokens/s,为业界平均水平的5倍,并支持10万亿参数模型单机运行。
在2026人工智能计算大会(AICC2026)上,浪潮信息正式推出元脑SD200 Ultra超节点AI服务器及元脑HC2000多元算力机组。该产品定位面向前沿大模型推理场景,核心卖点在于以国产AI芯片为底座,实现超大规模参数模型的单机承载能力。
据浪潮信息介绍,元脑SD200 Ultra单机可运行2.8万亿参数的Kimi K3大模型,Token生成时延首次压至5.85毫秒以内,对应单用户生成速度为170 Tokens/s,达到业界平均水平的5倍。该机型同时支持10万亿参数规模的前沿模型单机运行。Token生成时延指大模型每输出一个词元所需的平均时间,是衡量推理响应速度的关键指标之一。
硬件架构层面,SD200 Ultra采用3D Hyper Mesh设计,紧耦合128颗本土AI芯片,提供8TB统一编址显存与64TB内存。系统使用原生内存语义通信,通信时延低至0.69微秒。通过全局统一编址、虚拟影子设备映射、跨域地址翻译与路由,该超节点实现了GPU跨主机域的统一寻址访问,构建出百纳秒级低时延内存语义互连域。
浪潮信息还提到,借助对称内存技术,SD200 Ultra首次在基于本土AI芯片的超节点上实现GPU显存直连,使GPU可直接访问远端GPU显存,AllReduce通信时间降低3.5倍。该特性针对Kimi K3推理场景进行了优化,旨在缓解大规模并行推理中的通信瓶颈。