《電子技術應用》
您所在的位置:首頁 > 通信与网络 > 设计应用 > 基于HLS工具的CNN加速器的设计与优化方法研究
基于HLS工具的CNN加速器的设计与优化方法研究
2021年电子技术应用第3期
程佳风,王红亮
中北大学 电子测量技术国家重点实验室,山西 太原030051
摘要: 基于软硬件协同设计的思想,利用HLS工具,在PYNQ-Z2平台上设计并实现了一个卷积神经网络加速器,对卷积运算采用矩阵切割的优化方法,均衡了资源消耗和计算资源,使得加速器的性能达到了最优。利用MNIST数据集对加速器IP核进行性能测试,实验结果表明:对单张图片的测试,该加速器相对于ARM平台实现了5.785的加速效果,对于1 000张图片的测试则可达到9.72的加速效果,随着测试图片数量的不断增加,加速器的性能也将越来越优。
中圖分類號: TN108.1
文獻標識碼: A
DOI:10.16157/j.issn.0258-7998.200841
中文引用格式: 程佳風,王紅亮. 基于HLS工具的CNN加速器的設計與優化方法研究[J].電子技術應用,2021,47(3):18-21,26.
英文引用格式: Cheng Jiafeng,Wang Hongliang. Research on the design and optimization method of CNN accelerator based on HLS tools[J]. Application of Electronic Technique,2021,47(3):18-21,26.
Research on the design and optimization method of CNN accelerator based on HLS tools
Cheng Jiafeng,Wang Hongliang
National Key Laboratory for Electronic Measurement Technology,North University of China,Taiyuan 030051,China
Abstract: Based on the idea of software and hardware co-design, this article uses HLS tools to design and implement a convolutional neural network accelerator on the PYNQ-Z2 platform, and uses the matrix cutting optimization method for convolution operations to balance resource consumption and computing resources , so that the performance of the accelerator is optimized. This article uses the MNIST data set to test the performance of the accelerator IP core. The experimental results show that: for a single image test, the accelerator achieves an acceleration effect of 5.785 compared with the ARM platform, and an acceleration of 9.72 for a 1000 image test. As a result, as the number of test images continues to increase, the performance of the accelerator will become better and better.
Key words : convolutional neural network(CNN);PYNQ-Z2;HLS tool;accelerator

0 引言

    近年來,卷積神經網絡的應用范圍越來越廣泛,其應用場景也日益復雜,卷積神經網絡的計算密集和存儲密集特征日益凸顯,成為快速高效實現卷積神經網絡的限制。于是基于GPU[1]、ASIC[2]、FPGA[3]的不同的加速器平臺被相繼提出以提升CNN的設計性能。GPU的電力消耗巨大,硬件結構固定,限制了卷積神經網絡在嵌入式設備的應用;ASIC開發成本極高,靈活性低,不適合搭載復雜多變的卷積神經網絡;FPGA具有功耗低、性能高、靈活性好的特點,因此更加適用于卷積神經網絡硬件加速的開發研究,但由于Verilog HDL開發門檻高,開發周期相對較長,影響了FPGA在卷積神經網絡應用的普及[4-5]

    本文基于軟硬件協同的思想,利用HLS工具,在PYNQ-Z2上實現了一個卷積神經網絡加速器,并采用矩陣切割的設計方法對卷積核運算進行優化。




本文詳細內容請下載:http://www.tom3567.com/resource/share/2000003402




作者信息:

程佳風,王紅亮

(中北大學 電子測量技術國家重點實驗室,山西 太原030051)

此內容為AET網站原創,未經授權禁止轉載。
主站蜘蛛池模板: 欧美亚洲另类激情另类| 久久99精品视频一区97| 国产精品吹潮在线观看| 日韩在线视频一区| 青春草国产视频| 欧美中文在线视频| 久久视频在线观看中文字幕| 久久久黄色av| 欧美精品国产精品久久久| 国产精品秘入口18禁麻豆免会员| 国产精品高清免费在线观看| 99在线视频首页| 性欧美精品一区二区三区在线播放V| 国产日韩精品在线| 久久久精品免费视频| 九九精品在线观看| 国产区精品在线观看| 精品国产综合| 欧美日韩亚洲一区二区三区四区| 国产不卡在线观看| 久久久精品欧美| 亚洲精品国产系列| 国产精品麻豆免费版| 欧美精品久久久久久久自慰| 国产日韩视频在线播放| 国产精品久久久久久久av电影 | 少妇av一区二区三区无码| 久久国产午夜精品理论片最新版本| 日韩欧美亚洲精品| 在线一区日本视频| 91免费精品视频| 99精品国产高清在线观看| 国产成人精品日本亚洲11| 在线精品亚洲一区二区| 国产精品自拍首页| 国产欧美日韩小视频| 国产精品久久久久久久久婷婷| 一区二区三区不卡在线| 欧美激情网友自拍| 日韩视频免费观看| 国产精品黄视频|