5月11日消息,隨著AI需求轉向推理時代,算力不再是主要瓶頸,內存墻的問題愈發嚴重,高帶寬低延遲的內存架構成為挑戰,現在國內公司也通過架構創新實現了飛躍。
日前新紫光集團宣布推出“紫弦”三維化近存計算(PNM)架構,以3D DRAM為核心,首創3.5D異質異構集成方案,存儲帶寬可達30TB/s。
這是什么概念呢,目前AMD及NVIDIA再用的HBM3e顯存單個帶寬也就1.2TB/s,B200顯卡帶寬也就做到了8TB/s,紫弦的30TB/s帶寬可以說碾壓性領先。
不僅如此,該架構的延遲也非常低,PNM近存計算模式下訪存延遲最大降低18倍。
與NVIDIA的B200顯卡相比,模擬仿真顯示同等算力下Token吞吐率較B200系列高出1.5至2倍以上。
這次發布的技術也不只是紙上談兵,新紫光強調該技術可規模化量產,更重要的一點是不會被國外技術限制,它是基于國內領先供應鏈做的可規模化量產。
不過該技術具體什么時候量產上市還沒消息,只能說國產的AI系統完全可以在先進制程受限制的情況下,通過架構和技術創新走一條不同的路。

本站內容除特別聲明的原創文章之外,轉載內容只為傳遞更多信息,并不代表本網站贊同其觀點。轉載的所有的文章、圖片、音/視頻文件等資料的版權歸版權所有權人所有。本站采用的非本站原創文章及圖片等內容無法一一聯系確認版權者。如涉及作品內容、版權和其它問題,請及時通過電子郵件或電話通知我們,以便迅速采取適當措施,避免給雙方造成不必要的經濟損失。聯系電話:010-82306118;郵箱:aet@chinaaet.com。
