6月25日,OpenAI與博通(Broadcom)周三發布雙方合作的首款定制AI芯片Jalape?o,定位是專門服務大語言模型“推理”的處理器,也就是用戶向ChatGPT提問后,模型在服務器端生成答案的那一步。
據CNBC與路透社報道,這款芯片由OpenAI與博通共同設計和開發,TSMC負責制造,Celestica將建設服務器系統,是OpenAI第一次公開推出自有AI處理器。OpenAI總裁格雷格·布羅克曼(Greg Brockman)稱,Jalape?o從初始設計到流片用了9個月,部分設計和優化過程還使用了OpenAI自己的AI模型。

它先解決的不是訓練,而是每天的使用成本
Jalape?o不是用來訓練下一代大模型的芯片,而是面向推理場景。它對應的是ChatGPT回答問題、整理材料、生成圖片說明、處理辦公任務時背后的計算過程。
這也是OpenAI最容易感到成本壓力的地方。訓練模型是階段性的大工程,但推理是每天、每分鐘都在發生的消耗。用戶越多、調用越頻繁,服務器、芯片和電力成本就越高。Jalape?o的意義不在于讓OpenAI立刻擺脫英偉達,而是讓它在最常用、最花錢的環節里多一種自有選擇。
“成本低約50%”仍是早期測試口徑
博通首席執行官陳福陽在發布中稱,早期測試顯示,Jalape?o的推理成本比當前主流AI圖形處理器低約50%,性能與英偉達Blackwell芯片處于同一水平。
這個數字對市場很敏感,但目前仍應按“早期測試”和公司高管表述理解。Jalape?o還沒有公布完整技術報告,也沒有進入大規模商用驗證。換句話說,它已經展示了OpenAI想降低推理成本的方向,但最終能否穩定做到同等性能、更低成本,還要看后續部署結果。
對用戶和企業客戶的影響,會先體現在速度和價格上
如果Jalape?o后續部署順利,且性能兌現,用戶可能會感受到一些更具體的變化:高峰期響應更穩、復雜任務等待時間更短、部分高級功能的使用門檻下降。
對企業客戶和開發者來說,成本變化更直接。AI服務按調用量收費,底層推理成本如果下降,同樣預算就能支撐更多請求、更長上下文和更復雜的工作流。OpenAI過去主要靠購買通用AI芯片擴張算力,現在開始把芯片按自己的模型需求定制,這會讓它在產品定價和服務穩定性上多一點主動權。
年底開始部署,但不會立刻改寫芯片格局
按CNBC報道,Jalape?o計劃在今年年底開始部署,先服務OpenAI內部需求,再逐步擴展到微軟等合作伙伴的數據中心。
對博通來說,這是一筆重要的AI定制芯片案例;對OpenAI來說,這是從“買算力”走向“設計算力”的一步。不過,英偉達在訓練芯片、軟件生態和大規模集群上的優勢仍然很強。Jalape?o更現實的作用,是先在推理端替OpenAI分擔成本和供應壓力,而不是馬上取代現有主力GPU。
這塊芯片真正要回答的問題很簡單:當AI從演示變成日常工具,誰能把每一次回答的成本降下來,誰就更有機會把高級功能做成用戶也能頻繁使用的服務。

