YYaaa News

Google 押注 Frozen v2 專用晶片|為 Gemini 硬編架構,目標 6 到 10 倍效率、2028 上線

一句話總結

The Information 爆料 Google 內部代號 Frozen v2 的新 AI 推理晶片為 Gemini 硬編架構,目標每瓦服務 token 數是現 TPU 的 6 到 10 倍,最快 2028 年上線。動因是內部算力嚴重短缺,Google Cloud 已在婉拒新的大客戶。

Google 押注 Frozen v2 專用晶片|為 Gemini 硬編架構,目標 6 到 10 倍效率、2028 上線

The Information 7 月 20 日爆料,Google 內部代號 Frozen v2 的新 AI 推理晶片為 Gemini 量身打造——把模型底層架構直接光刻進矽片,每瓦服務 token 數目標達到現有 TPU 的 6 到 10 倍,最快 2028 年投入使用。消息一出 Alphabet 股價上漲。

Frozen v2 不是把模型權重焊死的「原始 Frozen」設計(那個已被擱置),而是只硬編架構的靈活版本,換權重不用換晶片,延長使用壽命。專案動因來自 Google 內部算力嚴重短缺——緊到 Google Cloud 正在婉拒新的外部大客戶。Google 將 Frozen v2 定為獨立於 TPU 產品線的新分支

方向指向 AI 晶片正從「通用計算」滑向「模型專用推理」。英偉達 GPU 的通用性優勢在 Gemini 這種超級規模模型面前,正被 Google 用「一顆晶片只跑一個家族」的極端垂直集成挑戰。Google 未官方確認該項目。

via Crypto Briefing / CNBC / The Information
Google 押注 Frozen v2 專用晶片|為 Gemini 硬編架構,目標 6 到 10 倍效率、2028 上線