《電子技術應用》
您所在的位置:首頁 > 可编程逻辑 > 业界动态 > 如何使用FPGA加速机器学习算法

如何使用FPGA加速机器学习算法

2016-05-27
作者:haoxingheng

  當前,AI因為其CNN(卷積神經網絡)算法出色的表現在圖像識別領域占有舉足輕重的地位。基本的CNN算法需要大量的計算和數據重用,非常適合使用FPGA來實現。上個月,Ralph Wittig(Xilinx CTO Office的卓越工程師) 在2016年OpenPower峰會上發表了約20分鐘時長的演講并討論了包括清華大學在內的中國各大學研究CNN的一些成果。

  在這項研究中出現了一些和CNN算法實現能耗相關的幾個有趣的結論:

  ①限定使用片上Memory;

  ②使用更小的乘法器

  ③進行定點匹配:相對于32位定點或浮點計算,將定點計算結果精度降為16位。如果使用動態量化,8位計算同樣能夠產生很好的結果。

  在演講中Wittig還提到了CNN相關的兩款產品:CAPI-compatible Alpha DataADM-PCIE-8K5 PCIe加速卡和Auviz Systems提供的AuvizDNN(深度神經網絡)開發庫。

  ADM-PCIE-8K5 PCIe加速卡

  Alpha DataADM-PCIE-8K5 PCIe加速卡用于X86和IBM Power8/9數據中心和云服務,加速卡基于Xilinx Kintex UltraScale KU115 FPGA,支持Xilinx SDAcess基于OpenCL、C/C++的開發和基于Vivado HLx的HDL、HLS設計流程。

1.png

  圖1 Alpha DataADM-PCIE-8K5 PCIe加速卡

  Alpha DataADM-PCIE-8K5 PCIe加速卡片上帶32GB DDR4-2400內存(其中16GB含ECC),雙通道SFP+支持雙通道10G以太網接入。提供包括高性能PCIe/DMA在內的板級支持包(BSP) 、OpenPOWER架構的CAPI、FPGA參考設計、即插即用的O/S驅動和成熟的API等設計資源。

  AuvizDNN開發庫

  深度學習技術使用大量的已知數據來找出一組權重和偏置值來匹配預期結果。處理被稱之為訓練,訓練的結果是大量的模型,這一事實促使工程師們尋求使用GPU之類的專用硬件來進行訓練和分類計算。

  隨著未來數據量的巨幅增長,機器學習將會搬到云端完成。這樣就急需一種既可以加速算法,又不會大規模增加功耗的處理平臺,在這種情況下,FPGA開始登場。

  隨著一些列的先進開發環境投入使用,軟件開發工程師將他們的設計在Xilinx FPGA上實現變得更加容易。Auviz Systems開發的AuvizDNN庫為用戶提供優化的函數接口,用戶可以針對不同的應用創建自定義的CNN。這些函數可以方便的通過Xilinx SDAcess這樣的集成開發環境調用。在創建對象和數據池后,就會調用函數創建每一個卷積層、然后是致密層,最后是 softmax層,如下圖2所示。

2.png

  圖2 實現CNN的函數調用順序


本站內容除特別聲明的原創文章之外,轉載內容只為傳遞更多信息,并不代表本網站贊同其觀點。轉載的所有的文章、圖片、音/視頻文件等資料的版權歸版權所有權人所有。本站采用的非本站原創文章及圖片等內容無法一一聯系確認版權者。如涉及作品內容、版權和其它問題,請及時通過電子郵件或電話通知我們,以便迅速采取適當措施,避免給雙方造成不必要的經濟損失。聯系電話:010-82306118;郵箱:aet@chinaaet.com。
主站蜘蛛池模板: 久久中文精品视频| 国产精品久久av| 激情五月六月婷婷| 国产国产精品人在线视| 91精品国产91久久久久福利| 亚洲中文字幕久久精品无码喷水| 亚洲激情免费视频| 久久久久久久久久久99| 国产一区高清视频| 国产专区精品视频| 国产成人精品日本亚洲专区61| 欧美日韩无遮挡| 日韩在线视频在线观看| 国产精品成人久久久久| 国产无套内射久久久国产| 国产精品麻豆va在线播放| 欧美日本高清一区| 日韩av在线综合| 精品视频一区在线| 99在线观看视频免费| 国产精品久久久久久久7电影| 亚洲熟妇无码一区二区三区| 国产精品久久久久福利| 久久99国产综合精品女同| 国产99在线免费| 精品久久蜜桃| 精品日韩欧美| 久久九九国产精品怡红院 | 久精品国产欧美| 91精品视频网站| 亚洲不卡中文字幕无码| 国产精品久久在线观看| 精品国产拍在线观看| 亚洲资源视频| 日日摸天天爽天天爽视频| 国产区精品在线观看| 久久视频在线免费观看| 狠狠色综合网站久久久久久久| 极品尤物一区二区三区| 一区二区不卡视频| 久久精品视频亚洲|