快讯 23:45苹果 2026 款 Mac mini 明日开售:M6 与 M5 Pro 双芯片,6999 元起23:40苹果2026款Mac Studio开售:M5 Max与Ultra双芯,19999元起23:32苹果 M6 Mac mini 首发 2nm 制程,实测对比上代性能提升 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期二 · 09-22 07:40 约 1 分钟读完

浪潮信息元脑SD200 Ultra超节点亮相:国产芯片单机跑通2.8万亿参数Kimi K3

摘要

浪潮信息在AICC2026发布元脑SD200 Ultra超节点,基于国产AI芯片单机承载2.8万亿参数Kimi K3,Token生成时延降至5.85毫秒以内,单用户速度达170 Tokens/s,为业界平均水平的5倍,并支持10万亿参数模型单机运行。

在2026人工智能计算大会(AICC2026)上,浪潮信息正式推出元脑SD200 Ultra超节点AI服务器及元脑HC2000多元算力机组。该产品定位面向前沿大模型推理场景,核心卖点在于以国产AI芯片为底座,实现超大规模参数模型的单机承载能力。

据浪潮信息介绍,元脑SD200 Ultra单机可运行2.8万亿参数的Kimi K3大模型,Token生成时延首次压至5.85毫秒以内,对应单用户生成速度为170 Tokens/s,达到业界平均水平的5倍。该机型同时支持10万亿参数规模的前沿模型单机运行。Token生成时延指大模型每输出一个词元所需的平均时间,是衡量推理响应速度的关键指标之一。

硬件架构层面,SD200 Ultra采用3D Hyper Mesh设计,紧耦合128颗本土AI芯片,提供8TB统一编址显存与64TB内存。系统使用原生内存语义通信,通信时延低至0.69微秒。通过全局统一编址、虚拟影子设备映射、跨域地址翻译与路由,该超节点实现了GPU跨主机域的统一寻址访问,构建出百纳秒级低时延内存语义互连域。

浪潮信息还提到,借助对称内存技术,SD200 Ultra首次在基于本土AI芯片的超节点上实现GPU显存直连,使GPU可直接访问远端GPU显存,AllReduce通信时间降低3.5倍。该特性针对Kimi K3推理场景进行了优化,旨在缓解大规模并行推理中的通信瓶颈。

浪潮信息元脑SD200 Ultra国产AI芯片Kimi K3
本文由新大陆基于公开信息编辑整理
213
收录 AI 工具
23
模型产品档案
45
企业落地案例
5
完整版提示词