国产GPU联手类脑芯片,首个异构混合推理系统在廊坊发布
摘要
2026中国算力大会上,移动云联合多家机构发布国内首个国产GPU+类脑芯片大模型异构混合推理系统。经Deepseek V4实测,该系统较同类国产GPU集群性价比提升超一倍,运营成本降低40%以上,面向金融、安防等高安全场景提供全栈国产化推理底座。
9月11日至13日,2026中国算力大会在河北廊坊召开。会议期间,移动云公司携手中国电子科技南湖研究院、北京灵汐科技、上海天数智芯及清华大学、北京大学,共同推出国内首个国产GPU与类脑芯片协同的大模型异构混合推理系统。
据官方披露的实测数据,在Deepseek V4模型上,该系统的性价比达到同类国产GPU算力集群的两倍以上,业务运营成本则压降超过40%。这一结果意味着国产算力方案在推理效率与经济性上取得了可量化的突破。
技术层面,该系统采用“分而治之、协同增效”的设计思路。具体而言,团队将大模型推理过程拆分为PD与AF两个阶段,并按模块特性分配至不同芯片:Attention计算交由国产GPU处理,以发挥其通用计算能力;FFN(MOE专家)等延时敏感模块则部署在类脑芯片上,借助其存算一体架构与片上大容量SRAM的优势。
为支撑两类异构算力的协作,项目方自研了模型编译器、高速互联协议及统一推理引擎,实现任务拆解、协同调度与结果聚合,从而绕开传统单GPU推理的瓶颈。
应用层面,该系统可适配Token工厂、AI代码生成、多智能体协同及智能制造等高实时性场景,同时面向金融、安防、通信等安全敏感行业,提供全栈国产化的推理底座。
本文由新大陆基于公开信息编辑整理
信息来源:IT之家 IT之家原文 ↗