基于CUDA技术的卷积神经网络识别算法被引量：9

CUDA Technology Based Recognition Algorithm of Convolutional Neural Networks

机构地区：[1]上海理工大学光电信息与计算机工程学院,上海200093

出　　处：《计算机工程》2010年第15期179-181,共3页Computer Engineering

基　　金：国家自然科学基金资助项目(60573108);上海教委发展基金资助项目(09YZ428);上海教委科研创新基金资助重点项目(08ZZ76);上海市重点学科建设基金资助项目(S30501)

摘　　要：针对具有高浮点运算能力的流处理器设备GPU对神经网络的适用性问题,提出卷积神经网络的并行化识别算法,采用计算统一设备架构(CUDA)技术,并定义其上的并行化数据结构,描述计算任务到CUDA的映射机制。实验结果证明,在GTX200硬件架构的GPU上实现的并行识别算法的平均浮点运算能力峰值较CPU上串行算法提高了近60倍,更适用于神经网络的相关应用。For the problem whether Graphic Processing Unit（GPU）,the stream processor with high performance of floating-point computing is applicable to neural networks,this paper proposes the parallel recognition algorithm of Convolutional Neural Networks（CNNs）.It adopts Compute Unified Device Architecture（CUDA） technology,definites the parallel data structures,and describes the mapping mechanism for computing tasks on CUDA.It compares the parallel recognition algorithm achieved on GPU of GTX200 hardware architecture with the serial algorithm on CPU.It improves speed by nearly 60 times.Result shows that GPU based the stream processor architecture are more applicable to some related applications about neural networks than CPU.

关键词：流处理器单指令多线程 GTX200硬件架构 CUDA技术卷积神经网络

分类号：TP193[自动化与计算机技术—控制理论与控制工程]

参考文献：

正在载入数据...

二级参考文献：

正在载入数据...

耦合文献：

正在载入数据...

引证文献：

正在载入数据...

二级引证文献：

正在载入数据...

同被引文献：

正在载入数据...

高级检索 检索式检索

时间限定

期刊范围

学科限定全选

高级检索 检索式检索

时间限定

期刊范围

学科限定全选

基于CUDA技术的卷积神经网络识别算法被引量：9

我的收藏

参考文献：

二级参考文献：

耦合文献：

引证文献：

二级引证文献：

同被引文献：

相关期刊文献：

相关的主题

相关的作者对象

相关的机构对象

下载全文

高级检索检索式检索

时间限定

期刊范围

学科限定全选

高级检索 检索式检索

时间限定

期刊范围

学科限定全选

基于CUDA技术的卷积神经网络识别算法 被引量：9

我的收藏

参考文献：

二级参考文献：

耦合文献：

引证文献：

二级引证文献：

同被引文献：

相关期刊文献：

相关的主题

相关的作者对象

相关的机构对象

下载全文

用户登录

高级检索检索式检索

基于CUDA技术的卷积神经网络识别算法被引量：9