Google 傳為 Gemini 打造新 AI 晶片

2026/07/21(二) 05:21・精選・原始出處

Google 傳出正在設計代號「Frozen v2」的新伺服器 AI 晶片,目標不是單純堆算力,而是讓 Gemini 產生每個 token 時更省電。消息稱它會延續 Google 的 full-stack 路線,把模型、晶片、網路與軟體一起調校;若計畫順利,預計 2028 年推出,每單位電力的 token 產出效率可能是現有 Google AI 晶片的 6~10 倍。不過這些數字來自匿名消息,Google 只表示持續研究軟硬體協同設計,並未正式確認產品或量產時程。

現實應用

最直接的用途是 Gemini 大規模推論,包括搜尋、Workspace、Cloud AI 與各種 Agent 服務。對 Google 來說,效率提升代表同一座資料中心能處理更多請求,也能壓低電力、散熱與單次推論成本。真正用得上的首先是 Google 自家服務;若未來比照 TPU 對外提供,Google Cloud 客戶、模型服務商及大量使用生成式 AI 的企業也會受益。

期望評估

我認為低標期望是 Frozen v2 即使達不到 6~10 倍,也能透過針對 Gemini 的硬體與編譯器最佳化,改善每瓦效能並降低對 GPU 的依賴。高標期望則是它讓 Gemini 的長推理與 Agent 工作流變得更便宜,Google 因而能用相同資本支出服務更多使用者,甚至把成本優勢反映到 Cloud 定價。不過 2028 年仍很遠,模型架構、製程與記憶體需求都可能改變,現在不宜把內部目標當成成品規格。

商業策略分析

最受影響的是 Nvidia 與其他 AI 加速器供應商。Google 自研晶片愈成熟,採購談判籌碼就愈大,也能避開供應短缺。Alphabet 規劃投入約 1,800~1,900 億美元擴建 AI 基礎設施,市場現在更在意投入能否轉成可持續的推論收入;報導曝光後股價一度上漲約 3%,也反映投資人期待效率改善。我猜這案子值得晶片、雲端與資料中心業者持續追蹤,但現階段比較像技術方向訊號,不是可立即採購或部署的產品。

延伸連結