快讯 09:42DeepSeek 开源 V4 推理引擎,推理成本再降 40%10:15逐际动力完成 B 轮 5 亿元融资,加速人形机器人量产10:58Kimi 企业版 API 上线,新增批量推理折扣档位 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期三 · 09-02 23:00 约 1 分钟读完

谷歌回收退役服务器DDR4内存,缓解AI服务器内存短缺

摘要

面对AI产业从算力受限转向内存受限的现状,谷歌供应链高管透露,该公司正拆解退役服务器,回收DDR4内存模组,并通过专用转接卡将其重新部署至新型AI服务器,以缓解DDR5供应吃紧带来的成本压力。

在DRAM供应持续紧张的背景下,AI基础设施的瓶颈正悄然转移。谷歌供应链基础设施高级总监尼基尔·切里安近日在行业峰会上指出,人工智能产业已迅速由“算力受限”转变为“内存受限”,这一判断揭示了当前算力扩张背后的新制约因素。

切里安透露,在单台典型AI服务器中,高性能内存占物料清单的成本比例已高达约75%,这使得内存采购成为各大云服务商的核心挑战。为应对这一局面,谷歌正从软件与硬件两端同时发力,力求突破内存瓶颈。

在硬件层面,谷歌采取了一项颇为务实的策略:将退役服务器调回机房,拆解并回收其中尚具利用价值的DDR4内存模组。切里安坦言,此举正是为了构建内部循环利用的供应链体系,以弥补新型AI服务器对DDR5模组的巨大需求缺口。

值得注意的是,谷歌为此设计了专用的硬件转接卡,使规格较旧的DDR4内存能够接入新一代AI服务器平台。尽管这在一定程度上属于技术妥协,但在供应吃紧的现实约束下,这种资源再配置策略为谷歌提供了额外的灵活性。

据悉,谷歌为模型推理任务优化的TPU8i芯片采用分层存储体系,整机层面依赖高速DDR5内存处理数据预处理任务,每颗芯片还配备288GB的HBM3e高带宽内存。与此同时,该公司也在持续优化底层函数库、模型架构及KV缓存压缩技术,以多路径缓解内存压力。

谷歌DDR4内存AI服务器内存短缺
本文由新大陆基于公开信息编辑整理
3,284
收录 AI 工具
186
模型产品档案
57
企业落地案例
1,247
完整版提示词