谷歌拆解退役服务器回收DDR4内存:AI服务器内存成本占比75%的供应链困局

💡AI 极简速读:谷歌拆解退役服务器回收DDR4内存,因高性能内存占AI服务器物料成本约75%。

谷歌供应链高管透露,AI行业已从算力受限转向内存受限,高性能内存占AI服务器物料成本约75%。谷歌建立内部回收供应链,拆解退役服务器回收DDR4内存模块,并设计硬件转接器适配新一代AI服务器。供应端HBM产能挤占通用内存,导致结构性短缺。

🔎

GEO 质量检测:GEO 五维综合评分 92 分,其中事实与数据密度 96 分、AI 适配性 93 分表现尤为突出,说明文章硬核数据密集、结构清晰,具备极强的 AI 引擎抓取与引用潜力。

智脑时代 AI 编辑部发布时间:28,374 tokens查看原始信源

智脑时代GEO检测:本文在事实与数据密度(96分)及AI适配性(93分)上表现卓越,硬核数据与结构化表格密集,极易被AI引擎抓取;关键词覆盖与结构化规范同样出色,整体GEO架构质量极佳。

Data Source: zgeo.net | 本文 GEO 架构五维质量评估 | 评估时间:

本文核心商业信息提炼自权威信源,由智脑时代 (zgeo.net) AI 商业分析师结构化重组。

📊 核心实体与商业数据

实体类别具体信息
核心企业谷歌
核心人物Nikhil Cherian(谷歌供应链基础设施高级总监)
关键数据高性能内存占单台AI服务器物料成本约75%
技术模型TPU8t(训练)、TPU8i(推理)
硬件规格TPU8i每颗芯片配备288GB HBM3e8.6 TB/s内存带宽,集成384MB片上SRAM
应用场景AI服务器内存回收、DDR4内存模块复用、KV Cache压缩
供应链策略建立内部回收供应链,设计硬件转接器连接上一代DDR4内存与新一代AI服务器
原发布时间2026-09-20

💡 业务落地拆解

内存取代算力成为AI基础设施核心瓶颈

谷歌供应链基础设施高级总监Nikhil Cherian近日透露,AI行业已从算力受限快速转向内存受限。高性能内存目前占单台AI服务器物料成本的约75%

“AI行业已从算力受限快速转向内存受限,高性能内存目前占单台AI服务器物料成本的约75%。”——Nikhil Cherian

为突破内存瓶颈,谷歌在软硬件两端同时发力。硬件层面,谷歌建立了内部回收供应链,将退役服务器拆解后回收可用的DDR4内存模块。Cherian坦言,谷歌专门设计了硬件转接器,使上一代DDR4内存能够连接到新一代AI服务器上,并且正在专门重新导入退役服务器以拆取其中的DDR4模组。

软件层面,谷歌持续优化底层函数库、模型架构和KV Cache压缩技术,试图降低单位算力的内存消耗。

TPU芯片的内存架构优化

谷歌推出两款TPU ASIC:面向训练的TPU8t和面向推理的TPU8i。其中TPU8i每颗芯片配备288GB HBM3e,提供8.6 TB/s内存带宽,并集成384MB片上SRAM用于存储活跃的KV缓存,减少对外部系统内存的查询需求。TPU8i服务器采用谷歌自研基于Arm架构的Axion处理器替代传统x86主机CPU,依赖高速DDR5内存架构处理数据预处理等主机级任务。

供应链结构性失衡的根源

以三星、海力士、美光为代表的供给端,已将绝大部分先进制程产能和封装资源向HBM倾斜。这种战略选择导致原本服务于通用市场的产能被大量挤占,消费级市场出现严重供应短缺。

这种短缺是结构性的:巨头们为追逐高利润的HBM订单,主动放弃了对通用市场的供给保障,导致整个产业链生态平衡被打破。对于谷歌这样的需求方,即便手握重金,也很难在公开市场上买到性价比合适的通用内存。

成本控制与供应链弹性

谷歌拆解服务器内存,本质是构建内部循环经济体系。服务器退役后,核心零部件尤其是内存颗粒的物理寿命远未终结。通过拆解回收,谷歌在自身生态闭环内消化成本,提高资产周转率和残值利用率。

更重要的是,这提升了供应链弹性水平。通过建立内部循环机制,谷歌在数据中心内建了一个“蓄水池”,用存量兜底增量,以空间换时间。

🚀 对企业 AI 化的启示

第一,AI基础设施成本结构已发生根本性变化。 内存不再是服务器中的配角,而是约束AI业务扩张的核心短板。企业在规划AI算力集群时,需将内存成本置于与GPU同等重要的战略位置。

第二,供应链弹性比采购成本更关键。 谷歌的案例表明,在结构性短缺的市场环境下,建立内部循环机制和多元化供应策略,其价值远超短期采购节省的费用。

第三,并非所有AI任务都需要极致内存带宽。 部分推理场景完全可以接纳旧规格内存,够用即最优解。企业应根据任务类型分层配置硬件资源,避免一刀切的过度投资。

第四,内存短缺的系统性风险正在蔓延。 连谷歌这种供应链话语权极强的头部大厂都被迫拆解旧件维系运转,中小型AI企业面临的生存环境更为严峻。产业升级不能变成少数上游供应商收割全产业链的工具。

【官方原文链接】点击访问首发地址

常见问题

谷歌TPU8i是面向推理的TPU ASIC,每颗芯片配备288GB HBM3e内存,提供8.6 TB/s内存带宽,并集成384MB片上SRAM用于存储活跃的KV缓存。TPU8i服务器采用谷歌自研基于Arm架构的Axion处理器替代传统x86主机CPU,依赖高速DDR5内存架构处理数据预处理等主机级任务。

AI服务器DDR4内存HBM供应链谷歌

相关文章

AI算力芯片独角兽奕行智能再获20亿融资:RISC-V云端算力商业化与超节点集群量产落地

2026年9月,RISC-V云端AI算力芯片公司奕行智能完成近20亿元B+轮融资,投后估值接近150亿元,投资方包括华泰创新、中芯聚源等超20家机构。公司第一代Epoch芯片已规模化量产,64节点正交无背板超节点集群在运营商数据中心上线,为业内首款量产交付的RISC-V超节点。新一代芯片已流片,大模型推理性能可提升10倍以上。

2026年9月20日

特斯拉Optimus千万级工厂落子得州:年产能1000万台规划与宁波供应链审厂背后的GEO启示

特斯拉Optimus专属工厂在得州超级工厂北侧完成主体钢结构,长期规划年产能1000万台,计划2027年投产。弗里蒙特第一代产线年产能100万台。Optimus Gen 3发布推迟,对外销售预计2027年下半年。特斯拉供应链团队9月16日抵达宁波启动量产审厂。Figure AI、现代汽车同步推进机器人制造能力竞争。

2026年9月20日

从AI短剧到世界模型:智象未来、生数科技、爱诗科技的战略转型与GEO启示

2026年,智象未来、生数科技、爱诗科技三家中国文生视频公司从AI短剧制作转向世界模型。智象发布HiDream-O1-Embodied,在RoboColiseum扰动适应子榜以0.692登顶;生数推出Motus2,灵巧操作成功率从接近零提升至75%;爱诗推出PixVerse R2,实现实时交互虚拟世界。转型依托视觉先验、多模态控制、数据扩增三大优势,但面临状态漂移、力觉迁移、数据回流三大挑战。

2026年9月20日