基于CUDA实现MRRR算法并行  

Parallel Realization of the MRRR Algorithm Based on CUDA

在线阅读下载全文

作  者:汪丽杰[1] 赵永华[1] 

机构地区:[1]中国科学院计算机网络信息中心超算中心,北京100190

出  处:《计算机科学》2012年第3期286-289,共4页Computer Science

基  金:国家自然科学基金(60873113);国家高技术研究发展计划(863)(2010AA012301);国家重点基础研究发展规划(973)(2011CB309702)资助

摘  要:MRRR(Multiple Relatively Robust Representations)算法是求解对称三对角矩阵本征值问题高效、精确的算法之一。在分析MRRR算法及CUDA(Compute Unified Device Architecture)并行体系结构的基础上,针对算法的可并行性,采用单指令多线程并行方式实现了基于CUDA的MRRR算法并行,并从存储结构方面优化算法。实验结果显示,与LAPACK库中串行MRRR实现相比,并行方法在保证精度的基础上获得了20倍的加速比,进而从计算精度和计算时间上说明MRRR算法适合在GPU上并行。The algorithm of multiple relatively robust representations(MRRR) is one of the fastest and most accurate algorithms. After analyzing the MRRR algorithm and CUDA parallel architecture, parallel MRRR algorithm based on CUDA was given, and explored the optimization in memory structure. Compared with LAPACK's MRRR implementation this parallel method provides 20-fold speedups. This result demonstrates the algorithm can be mapped efficiently onto GPU.

关 键 词:MRRR 并行 CUDA 本征问题 

分 类 号:TP391.13[自动化与计算机技术—计算机应用技术]

 

参考文献:

正在载入数据...

 

二级参考文献:

正在载入数据...

 

耦合文献:

正在载入数据...

 

引证文献:

正在载入数据...

 

二级引证文献:

正在载入数据...

 

同被引文献:

正在载入数据...

 

相关期刊文献:

正在载入数据...

相关的主题
相关的作者对象
相关的机构对象