据《The Information》报道,Google 正在开发 Frozen v2,这是一款新的 AI 服务器芯片,将 Gemini 的底层架构直接嵌入硅片之中,以将推理效率提升最多 10 倍。与 GPU 等通用芯片以及 Google 自家的 TPU 不同,Frozen v2 为了更高的推理效率和更低的能耗,牺牲了灵活性:通过将模型架构硬编码到硬件本身来实现。
该项目源于 Google 严重的 AI 算力短缺,导致其内部 GPU 和 TPU 资源承压,并影响了部分 Google Cloud 客户。为弥补基础设施缺口,Google 已同意每月向 SpaceX 支付约 10 亿美元,由 xAI 提供 AI 算力能力。