《電子技術應用》
您所在的位置:首頁 > 人工智能 > 业界动态 > 英伟达Blackwell架构将AI推理成本压缩至十分之一

英伟达Blackwell架构将AI推理成本压缩至十分之一

2026-02-13
來源:IT之家

英偉達2月12日發布博文,宣布在AI推理領域的“token經濟學”(Tokenomics)方面,其 Blackwell 架構取得里程碑式進展。

英偉達在博文中指出,通過推行“極致軟硬件協同設計”策略,優化硬件在處理復雜 AI 推理負載時的效率,解決了隨著模型參數膨脹帶來的算力成本激增問題。數據顯示相比上一代 Hopper 架構,Blackwell 平臺將單位 Token 生成成本降低至十分之一。

format,f_avif.avif (1).jpg

行業落地方面,包括 Baseten、DeepInfra、Fireworks AI 及 Together AI 在內的多家推理服務提供商已開始利用 Blackwell 平臺托管開源模型。

援引博文介紹,英偉達指出,通過結合開源前沿智能模型、Blackwell 的硬件優勢以及各廠商自研的優化推理棧,這些企業成功實現了跨行業的成本縮減。

format,f_avif.avif (2).jpg

例如,專注于多智能體(Multi-agent)工作流的 Sentient Labs 反饋,其成本效率相比 Hopper 時代提升了 25% 至 50%;而游戲領域的 Latitude 等公司也借此實現了更低的延遲和更可靠的響應。

format,f_avif.avif (3).jpg

Blackwell 的高效能核心在于其旗艦級系統 GB200 NVL72。該系統采用 72 個芯片互聯的配置,并配備了高達 30TB 的高速共享內存。這種設計完美契合了當前主流的“混合專家(MoE)”架構需求,能夠將 Token 批次高效地拆分并分散到各個 GPU 上并行處理。

format,f_avif.avif (4).jpg

在 Blackwell 大獲成功的同時,英偉達已將目光投向下一代代號為“Vera Rubin”的平臺。據悉,Rubin 架構計劃通過引入針對預填充(Prefill)階段的 CPX 等專用機制,進一步推高基礎設施的效率天花板。

2.jpg

本站內容除特別聲明的原創文章之外,轉載內容只為傳遞更多信息,并不代表本網站贊同其觀點。轉載的所有的文章、圖片、音/視頻文件等資料的版權歸版權所有權人所有。本站采用的非本站原創文章及圖片等內容無法一一聯系確認版權者。如涉及作品內容、版權和其它問題,請及時通過電子郵件或電話通知我們,以便迅速采取適當措施,避免給雙方造成不必要的經濟損失。聯系電話:010-82306118;郵箱:aet@chinaaet.com。
主站蜘蛛池模板: 国产精品视频色| 亚洲综合色激情五月| 99色这里只有精品| 国产精品欧美日韩久久| 色婷婷精品国产一区二区三区| 国产精品入口尤物| 91久久久久久久一区二区| 精品人妻少妇一区二区| 国产精品久久久久久久久久99| 日韩欧美一区三区| 国产精品一区二区三| 日韩欧美精品一区二区三区经典| 日本一区二区在线视频观看| 免费毛片一区二区三区久久久| 激情五月六月婷婷| 在线视频一二三区| 久久五月天婷婷| 国产中文字幕在线免费观看| 久久久久99精品成人片| 亚洲欧美国产不卡| 欧美亚洲国产成人| 亚洲日本精品国产第一区| 国产精品久久久久免费| 国产精品福利在线观看| 免费观看国产精品视频| 久久久久久久久91| 国产欧美日韩综合精品| 国产精品av网站| 亚洲高清不卡一区| 国产精品一区电影| 97精品在线视频| 亚洲欧洲精品在线观看| 91禁国产网站| 久久久久欧美| 欧美大片欧美激情性色a∨久久| 一区中文字幕在线观看| 91精品久久久久久久久久久| 成人a在线观看| 久久99久久99精品免观看粉嫩| 亚洲一区二区不卡视频| 亚洲精品中文字幕在线|