![]()
谷歌正在嘗試把 Gemini 與芯片更緊密地結(jié)合起來。
據(jù)《The Information》援引知情人士消息,谷歌母公司 Alphabet 正在研發(fā)一款服務(wù)器 AI 芯片,內(nèi)部非正式代號(hào)為“Frozen v2”。這款芯片針對(duì) Gemini 模型設(shè)計(jì),計(jì)劃最早于 2028 年部署。谷歌工程師預(yù)計(jì),以單位功耗所能處理的 Token 數(shù)量計(jì)算,其效率可能達(dá)到公司最新一代自研 AI 芯片的 6—10 倍。
谷歌目前尚未正式確認(rèn) Frozen v2 項(xiàng)目,也沒有公布芯片規(guī)格。公司在回應(yīng)媒體時(shí)表示,其團(tuán)隊(duì)一直在研究和試驗(yàn)提升性能與效率的新方案,但并非所有項(xiàng)目最終都會(huì)進(jìn)入生產(chǎn)階段。谷歌同時(shí)強(qiáng)調(diào),從底層共同設(shè)計(jì)硬件和軟件,是其打造高度集成系統(tǒng)的重要方式。但報(bào)道發(fā)布后,Alphabet 股價(jià)在當(dāng)?shù)貢r(shí)間 7 月 20 日早盤上漲約 3.3%。
與現(xiàn)有 TPU 相比,F(xiàn)rozen v2 的主要區(qū)別,是它進(jìn)一步收窄了芯片的適用范圍。它的定位是一顆更極致的“專用芯片”。根據(jù)現(xiàn)有報(bào)道,谷歌計(jì)劃將 Gemini 的部分架構(gòu)特征固化在芯片中,針對(duì)其計(jì)算路徑和常用操作進(jìn)行專門優(yōu)化。
大模型推理不僅需要完成大量矩陣運(yùn)算,還要頻繁從高帶寬內(nèi)存讀取參數(shù)。數(shù)據(jù)在內(nèi)存與計(jì)算單元之間移動(dòng),會(huì)消耗時(shí)間和電力。Frozen v2 希望減少這部分開銷,從而提高響應(yīng)速度,并在相同功耗下處理更多請(qǐng)求。報(bào)道所稱的 6—10 倍效率提升,具體指每單位功耗能夠處理的 Token 數(shù)量,并不是芯片峰值算力。
谷歌現(xiàn)有 TPU 同樣是面向機(jī)器學(xué)習(xí)的專用處理器,但需要適配不同模型,并承擔(dān)訓(xùn)練、推理等多種任務(wù)。最新一代 Ironwood 單顆芯片配備 192GB 高帶寬內(nèi)存,單位功耗性能約為上一代 Trillium 的兩倍,最多可由 9216 顆芯片組成 Superpod。Frozen v2 不會(huì)取代 TPU,而是作為一條更具針對(duì)性的產(chǎn)品線,與其并行使用。
![]()
(來源:Google)
但專用芯片也有其劣勢(shì),更深的模型與芯片綁定會(huì)降低靈活性。芯片從設(shè)計(jì)到投產(chǎn)通常需要數(shù)年,如果此后 Gemini 的基礎(chǔ)架構(gòu)發(fā)生較大變化,已經(jīng)固化的設(shè)計(jì)可能難以適配。Frozen v2 能否獲得長(zhǎng)期收益,既取決于實(shí)際能效,也取決于谷歌能否在快速迭代模型的同時(shí),維持底層架構(gòu)的相對(duì)穩(wěn)定。
那么,谷歌為什么要“鋌而走險(xiǎn)”?首先一個(gè)原因,是為了應(yīng)對(duì)持續(xù)增長(zhǎng)的算力需求。據(jù)相關(guān)數(shù)據(jù),谷歌內(nèi)部的 AI 計(jì)算資源短缺已經(jīng)引發(fā)不同團(tuán)隊(duì)之間的資源競(jìng)爭(zhēng),Google Cloud 甚至因此拒絕過部分外部客戶訂單。
大模型的計(jì)算需求包括訓(xùn)練與推理兩個(gè)階段。訓(xùn)練先進(jìn)模型需要集中投入大量算力,但隨著 Gemini 被加入搜索、辦公軟件、云服務(wù)和智能終端,長(zhǎng)期發(fā)生的推理可能形成更龐大的成本。單次生成的費(fèi)用看似有限,乘以數(shù)以億計(jì)的用戶和持續(xù)增長(zhǎng)的調(diào)用量后,電力、芯片、網(wǎng)絡(luò)及數(shù)據(jù)中心投入都會(huì)成為重要支出。
Alphabet 已將 2026 年資本開支預(yù)期上調(diào)至 1,800 億—1,900 億美元,主要用于擴(kuò)建 AI 計(jì)算能力、數(shù)據(jù)中心和相關(guān)基礎(chǔ)設(shè)施。在這一背景下,提高每瓦電力能夠生成的 Token 數(shù),不僅意味著更低的能源消耗,還意味著同一座數(shù)據(jù)中心能夠承載更多用戶請(qǐng)求。對(duì)于已經(jīng)擁有大量 Gemini 使用場(chǎng)景的谷歌而言,即使單次推理成本只下降一小部分,規(guī)模化之后也可能帶來可觀節(jié)省。
![]()
圖|谷歌歷年資本開支預(yù)期(來源:S&P)
自研芯片還可以加強(qiáng)谷歌對(duì)供應(yīng)鏈和產(chǎn)品節(jié)奏的控制,減少對(duì)英偉達(dá)等外部芯片供應(yīng)商的依賴。但這種“減少依賴”并不等于完全替代。Frozen v2 即使順利投產(chǎn),預(yù)計(jì)規(guī)模也將低于 TPU;谷歌的數(shù)據(jù)中心仍會(huì)同時(shí)使用 TPU、GPU 及其他計(jì)算設(shè)備。它更像是為高頻且相對(duì)穩(wěn)定的 Gemini 任務(wù)增加一類成本更低的專用工具。
谷歌也不是唯一走向自研芯片的 AI 公司。2026 年 6 月,OpenAI 與博通公布首款自研推理芯片 Jalape?o。OpenAI 表示,這款芯片圍繞大語言模型推理設(shè)計(jì),將結(jié)合博通的芯片實(shí)現(xiàn)和網(wǎng)絡(luò)技術(shù)以及 Celestica 的服務(wù)器系統(tǒng)能力,計(jì)劃于 2026 年底開始部署。
![]()
(來源:OpenAI)
Anthropic 也被曝已經(jīng)開始研究自有 AI 芯片,并與三星電子等潛在合作方接觸。不過該項(xiàng)目仍處于早期階段,芯片的用途、性能目標(biāo)和服務(wù)器部署方式尚未明確 Anthropic 同時(shí)表示,亞馬遜 Trainium、谷歌 TPU 和英偉達(dá) GPU 仍將是其擴(kuò)張算力的重要基礎(chǔ)。中國(guó)方面,此前 DeepSeek 和近期的月之暗面也有自研芯片方面的傳聞。
除專注于基礎(chǔ)模型的公司外,亞馬遜、微軟、Meta、阿里巴巴、百度和字節(jié)跳動(dòng)等擁有云服務(wù)或大規(guī)模互聯(lián)網(wǎng)業(yè)務(wù)的企業(yè),也在不同程度上推進(jìn)專用 AI 芯片。其中部分芯片服務(wù)于模型訓(xùn)練,部分集中于推理、推薦和廣告等高頻工作負(fù)載。它們共同反映出一個(gè)趨勢(shì):隨著 AI 服務(wù)規(guī)模擴(kuò)大,掌握模型的公司越來越希望同時(shí)參與芯片和計(jì)算系統(tǒng)設(shè)計(jì)。
這些項(xiàng)目屬于同一輪趨勢(shì):AI 公司希望根據(jù)自身模型和業(yè)務(wù)負(fù)載設(shè)計(jì)芯片,以獲得更好的成本、能效和供應(yīng)保障。但它們并不是完全相同的技術(shù)路線。Trainium、Maia、MTIA 以及 OpenAI 的 Jalape?o 主要面向一類或多類 AI 工作負(fù)載,仍保留一定通用性;Frozen v2 則稱會(huì)把 Gemini 的部分架構(gòu)直接固化進(jìn)硬件,模型與芯片的綁定程度可能更高。
因此,F(xiàn)rozen v2 所代表的不只是谷歌擴(kuò)大自研芯片投入,也是一項(xiàng)更激進(jìn)的軟硬件協(xié)同試驗(yàn)。答案將取決于芯片能否如期投產(chǎn),也取決于到 2028 年時(shí),Gemini 是否仍然適合這塊為它提前設(shè)計(jì)的硅片。
1.https://techcrunch.com/2026/07/20/google-is-working-on-a-new-ai-chip-designed-to-make-gemini-more-efficient/
2.https://www.reuters.com/business/google-plans-new-chip-run-gemini-models-more-efficiently-information-reports-2026-07-20/
3.https://blog.google/innovation-and-ai/infrastructure-and-cloud/google-cloud/ironwood-tpu-age-of-inference/
4.https://blog.google/innovation-and-ai/infrastructure-and-cloud/google-cloud/ironwood-google-tpu-things-to-know/
運(yùn)營(yíng)/排版:何晨龍
注:封面由 AI 輔助生成
特別聲明:以上內(nèi)容(如有圖片或視頻亦包括在內(nèi))為自媒體平臺(tái)“網(wǎng)易號(hào)”用戶上傳并發(fā)布,本平臺(tái)僅提供信息存儲(chǔ)服務(wù)。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.