后摩智能下代端边AI芯片敲定3D CIM架构,同面积算力翻倍
摘要
后摩智能在2026全球AI芯片峰会上确认,其下代大模型端边AI芯片将采用3D CIM存算一体架构,融合存算与3D DRAM技术,同等面积下算力可达2倍,并有望改善功耗与散热。其2025年7月发布的M50芯片已获超150款产品定点。
在近日举办的2026全球AI芯片峰会上,后摩智能(HOUMO.AI)对外确认了其下一代大模型端边AI芯片的技术路线:该芯片将基于3D CIM存算一体架构打造,并把存算融合与3D DRAM技术结合在一起。这意味着后摩智能在端边大模型芯片上选择了垂直堆叠的演进方向。
按照后摩智能公布的信息,新一代旗舰芯片的目标是让端侧具备超实时的思考与互动能力。借助垂直堆叠结构,芯片能够在同等面积下实现2倍算力,同时还有望进一步缓解功耗与散热方面的压力。对于端边设备而言,算力密度与能效比正是制约大模型落地的关键指标。
后摩智能上一代产品是2025年7月发布的后摩漫界M50芯片。该芯片典型功耗为10W,可提供160TOPS(INT8)或100TFLOPS(bFP16)算力,支持48GB内存容量和153.6GB/s内存带宽。目前M50已获得超过150款产品定点,应用场景较为丰富。
从M50的规模化定点到下一代3D CIM架构的确认,后摩智能正在延续其端边AI芯片的迭代节奏。3D CIM与3D DRAM的组合能否在量产中兑现2倍算力的承诺,将影响端侧大模型设备的性能上限与散热设计空间。
本文由新大陆基于公开信息编辑整理
信息来源:IT之家 IT之家原文 ↗