
作者 | 趙昊
最新消息顯示,谷歌正在研發(fā)一款內(nèi)部代號為“Frozen v2”的新型服務(wù)器芯片,旨在更高效地運(yùn)行Gemini模型。
據(jù)報(bào)道,這款芯片將把Gemini模型部分架構(gòu)永久嵌入到芯片之中,從而減少回答用戶問題所需的計(jì)算量和數(shù)據(jù)傳輸量。
報(bào)道寫道,谷歌工程師預(yù)計(jì),與公司最新一代AI芯片——TPU(張量處理器)相比,F(xiàn)rozen芯片單位功耗可提供6至10倍的Token處理能力。
報(bào)道稱,谷歌計(jì)劃于2028年部署Frozen這款芯片,但不會取代通用型TPU,而是成為谷歌定制芯片產(chǎn)品線中更具針對性的專用分支。
受該消息影響,谷歌A(股票代碼:GOOGL)美股早盤一度漲近3.7%,谷歌C(GOOG)最高時(shí)漲約3.9%

谷歌在聲明中回應(yīng)稱,公司團(tuán)隊(duì)“持續(xù)研究并試驗(yàn)各類創(chuàng)新技術(shù),旨在為用戶和客戶提供最佳性能和最高效率”。
聲明提到,“雖然并非所有項(xiàng)目都會進(jìn)入量產(chǎn)階段,但這種嚴(yán)格的探索是我們?nèi)珬?zhàn)略的核心組成部分。”
谷歌還表示:“通過從底層協(xié)同設(shè)計(jì)硬件和軟件,我們確保整個(gè)系統(tǒng)實(shí)現(xiàn)深度集成,并針對真實(shí)工作負(fù)載進(jìn)行了高度優(yōu)化。”
分析認(rèn)為,該項(xiàng)目旨在緩解谷歌內(nèi)部日益嚴(yán)重的算力短缺問題。此前,算力不足不僅加劇了內(nèi)部資源競爭,據(jù)稱還迫使谷歌云拒絕部分外部客戶業(yè)務(wù)。
就在上月,谷歌還同意每月向SpaceX支付近10億美元,以彌補(bǔ)算力缺口,兌現(xiàn)對企業(yè)客戶的算力承諾。
不過,F(xiàn)rozen的設(shè)計(jì)也存在一定代價(jià),即靈活性下降。報(bào)道稱,只有在谷歌未來Gemini模型繼續(xù)沿用相同底層架構(gòu)的情況下,該芯片才能兼容后續(xù)版本。
目前,谷歌將Frozen v2視為一次試驗(yàn)性項(xiàng)目,暫無計(jì)劃像TPU一樣進(jìn)行大規(guī)模生產(chǎn)。
當(dāng)下,谷歌AI業(yè)務(wù)還面臨更緊迫的挑戰(zhàn)。先前有消息稱,下一代Gemini Pro發(fā)布時(shí)間已經(jīng)推遲,谷歌還流失了多名資深A(yù)I研究人員至競爭對手。

