2 月 28 日消息,當地時間 2 月 27 日,據《The Information》援引知情人士消息稱,Meta 在自研 AI 芯片方面遭遇重大挫折,已放棄其最先進的訓練芯片項目,并將開發重點轉向結構更簡單的替代方案。
由于芯片設計難度超出預期,Meta 上周決定取消正在開發的高端 AI 訓練芯片,并已向 AI 基礎設施部門員工通報這一調整。
Meta 調整芯片戰略的同時,也在加強與現有芯片供應商的合作。據報道,Meta 已簽署價值數十億美元的協議,從谷歌租用 AI 芯片。AMD 本周表示,將與 Meta 合作部署最多 6GW 的 Instinct AI 芯片,以支持 Meta 下一代 AI 基礎設施。此外,Meta 本月還宣布與英偉達建立跨多代合作關系,將繼續在數據中心部署英偉達芯片。
Meta 自研芯片屬于“Meta 訓練和推理加速器”(MTIA)項目,目標是降低對外部供應商的依賴,同時減少數據中心運營成本并增強基礎設施控制能力。
Meta 已放棄其第二代訓練芯片 Iris 的一個版本,并隨后啟動更先進芯片 Olympus 的開發,但該項目同樣遭到了夭折的命運。一名參與芯片開發的人員表示,公司內部對能否開發出可與英偉達性能匹敵的芯片持懷疑態度,原因包括開發周期長、設計復雜以及功耗控制難度高。如果功耗無法有效控制,將削弱芯片相對于英偉達產品的競爭力。
在技術架構方面,Iris 采用單指令多數據(SIMD)架構,這種架構更易于硬件設計,但軟件開發難度較高。Olympus 則采用單指令多線程(SIMT)架構,與英偉達芯片類似。這種架構更適合 AI 訓練軟件,但硬件實現復雜度更高。
Meta 原計劃最早于 2026 年第四季度完成 Olympus 設計,而芯片設計完成后通常仍需至少 9 個月才能實現量產。Olympus 的 GPU 原計劃采用 Meta 去年收購的 Rivos 的技術,該技術可兼容英偉達的 Cuda 軟件生態,而 Cuda 是當前 AI 訓練的行業標準。
Meta 最初計劃基于 Olympus 構建大規模 AI 訓練服務器集群,但管理層認為,這一方案存在風險,可能影響公司在與 OpenAI 和谷歌競爭過程中訓練新模型的進度。此外,軟件成熟度可能不及英偉達生態,而復雜設計也可能增加量產難度。
因此,Meta 目前計劃繼續依賴外部供應商提供的 AI 訓練芯片,因為這些芯片的軟件生態更加成熟,風險更低。

