商傳媒|葉安庭/綜合外電報導

谷歌(Google)正積極研發一款專為其人工智慧(AI)模型 Gemini 量身打造的內部伺服器晶片,代號「Frozen v2」,預計將其架構直接整合於晶片硬體中。據《The Information》報導,這款晶片預計可將 AI 回應效率提升 6 至 10 倍,遠超谷歌現有的張量處理單元(TPU)晶片,並規劃於 2028 年開始部署。

「Frozen v2」晶片的核心概念,源於谷歌 DeepMind 首席科學家傑夫·迪恩(Jeff Dean)最初提出的想法,旨在將 AI 模型架構而非模型權重永久嵌入晶片。此設計確保了晶片的適應性,未來仍可載入新的模型權重,克服了初代「Frozen」晶片因模型快速迭代而可能迅速過時的問題。與通用的 TPU 晶片不同,Frozen v2 的高度專業化使其預計不會對外部客戶開放銷售,主要目的在於緩解谷歌內部對 AI 運算能力的需求壓力。

谷歌此舉的背後,是日益增長的 AI 運算成本挑戰。Flexera 的報告指出,許多企業的 AI 預算增長速度超出預期,且隨著採用率提高,運算、資料儲存、模型使用費以及基礎設施成本也隨之攀升。AI 服務的複雜計費模式,如基於 Token(單詞或片段)的消耗、API 使用費及 GPU 資源成本,都讓成本預測與優化變得困難。GitHub Copilot 在轉用 Token 計費後,也引發用戶對費用飆升的擔憂,凸顯 AI 軟體開支管理的挑戰。

透過 Frozen v2 晶片,谷歌期望大幅降低 AI 推理(Inference)成本,從而在競爭激烈的 AI 市場中取得顯著優勢,特別是能與 OpenAI 和 Anthropic 等競爭對手抗衡。此戰略也與谷歌既定的目標相呼應,即希望其 TPU 晶片能夠佔據輝達(Nvidia)年度營收的百分之十。隨著科技巨頭紛紛投入自研 AI 晶片,這將加速全球 AI 晶片市場的競爭態勢,並對既有的半導體供應鏈帶來深遠影響。