Google 押注 Frozen v2 专用芯片|为 Gemini 硬编架构,目标 6 到 10 倍效率、2028 上线
一句话总结
The Information 爆料 Google 内部代号 Frozen v2 的新 AI 推理芯片为 Gemini 硬编架构,目标每瓦服务 token 数是现 TPU 的 6 到 10 倍,最快 2028 年上线。动因是内部算力严重短缺,Google Cloud 已在婉拒新的大客户。
The Information 7 月 20 日爆料,Google 内部代号 Frozen v2 的新 AI 推理芯片为 Gemini 量身打造——把模型底层架构直接光刻进硅片,每瓦服务 token 数目标达到现有 TPU 的 6 到 10 倍,最快 2028 年投入使用。消息一出 Alphabet 股价上涨。
Frozen v2 不是把模型权重焊死的「原始 Frozen」设计(那个已被搁置),而是只硬编架构的灵活版本,换权重不用换芯片,延长使用寿命。项目动因来自 Google 内部算力严重短缺——紧到 Google Cloud 正在婉拒新的外部大客户。Google 将 Frozen v2 定为独立于 TPU 产品线的新分支。
方向指向 AI 芯片正从「通用计算」滑向「模型专用推理」。英伟达 GPU 的通用性优势在 Gemini 这种超级规模模型面前,正被 Google 用「一颗芯片只跑一个家族」的极端垂直集成挑战。Google 未官方确认该项目。
via Crypto Briefing / CNBC / The Information
Frozen v2 不是把模型权重焊死的「原始 Frozen」设计(那个已被搁置),而是只硬编架构的灵活版本,换权重不用换芯片,延长使用寿命。项目动因来自 Google 内部算力严重短缺——紧到 Google Cloud 正在婉拒新的外部大客户。Google 将 Frozen v2 定为独立于 TPU 产品线的新分支。
方向指向 AI 芯片正从「通用计算」滑向「模型专用推理」。英伟达 GPU 的通用性优势在 Gemini 这种超级规模模型面前,正被 Google 用「一颗芯片只跑一个家族」的极端垂直集成挑战。Google 未官方确认该项目。
via Crypto Briefing / CNBC / The Information
