7月21日消息,據媒體報道,谷歌正在研發一款全新服務器芯片,計劃將Gemini大模型的底層架構直接固化進硬件,以大幅提升AI服務的運行效率。
該芯片內部代號為Frozen v2,旨在解決當前谷歌面臨的AI算力嚴重短缺問題——算力缺口已引發內部資源緊張,甚至迫使谷歌云拒絕了不少外部客戶的合作訂單。
據知情人士透露,研發團隊測算,該芯片正式落地后,單位功耗可處理的詞元(Token)數量將達到谷歌現有自研AI芯片最新一代產品的6至10倍,能效實現質的飛躍。
“Frozen”這一代號源于其核心設計理念:將大模型的部分運算邏輯永久蝕刻在硅片硬件中。目前,工程師仍在敲定芯片的核心功能模塊及各組件協同方案。谷歌計劃最早于2028年部署該芯片。
Frozen項目旨在開辟一條全新自研芯片產品線,與谷歌現有張量處理器(TPU)形成互補,而非取而代之。當前應用最廣泛的AI芯片——英偉達GPU及谷歌TPU,均為通用型芯片,可適配多種不同大模型,但運行任何模型時都需要實時執行大量耗時的邏輯判斷。
相比之下,Frozen v2直接內置適配Gemini系列模型的底層運算邏輯,能夠大幅減少芯片運算步驟與數據搬運量。
知情人士表示,該專用芯片有望更快響應用戶提問,支撐谷歌推出全新AI應用場景。但這也意味著谷歌將押注自身會持續沿用當前Gemini大模型的底層架構——只有后續Gemini模型采用與芯片設計一致的基礎架構,才能在該芯片上正常運行。
自研AI芯片已幫助谷歌降低Gemini的運行成本,谷歌在設計TPU時便圍繞Gemini做了適配,但TPU內置的模型信息遠少于Frozen系列芯片。
谷歌暫無計劃大規模量產Frozen v2,其產能規模將遠低于TPU。知情人士稱,由于量產規模有限,谷歌可延后引入外部設計、代工合作伙伴;同時,谷歌將這一代產品視為技術試驗平臺,待大模型底層架構趨于穩定后,為研發更高專用化芯片積累工程經驗。

