ISCAS OpenIR
SW-VML:基于神威蓝光处理器的向量数学软件包
解庆春; 张云泉; 鲁永泉; 李焱; 杨飞; 王靖
2013
Conference Name2013全国高性能计算学术年会
Pages1-11
Conference Date2013
Conference Place桂林
Department中国传媒大学高性能计算中心,北京100024;中国科学院软件研究所并行软件与计算科学实验室,北京100190 中国传媒大学高性能计算中心,北京100024;中国科学院计算技术研究所计算机体系结构国家重点实验室,北京100190 中国传媒大学高性能计算中心,北京100024 中国科学院软件研究所并行软件与计算科学实验室,北京100190
English Abstract  首先,本文介绍了SIMD扩展技术,并分析了使用SIMD扩展的三种万式,认为通过调用特定目标平台优化的第三万库是应用领域软件开发者快速开发高效并行程序的较好的万式:其次,介绍了国产神威处理嚣SW-1600平台,并利用Sl MD扩展和循环展开等技术开发了SW-VML(SW Vector Math Library),开发过程中提出了访存对界、简化向量条件分支的优化万法,解决了非对界访存、向量与标量数组转换影响性能的问题,并根据sw编译嚣对0penMP的支持,开发了多线程0penMp版.最后,在sw_1600平台上采用不同向量规模对SW-VML进行了测试,测试鲒果显示Sl MD向量化相对于串行程序加速比为2.08,4线程相对单线程平均加速比为2,26.SW-VML是国产神威系列处理嚣上开发的常用向量函数软件包,SW-VML可以用作在神威蓝光高性能计算平台开发高性能程序的基础软件工具包.
KeywordSimd扩展 神威处理器sw_1600 向量数学库 向量化
Language中文
Content Type会议论文
URIhttp://ir.iscas.ac.cn/handle/311060/16565
Collection中国科学院软件研究所
Recommended Citation
GB/T 7714
解庆春,张云泉,鲁永泉,等. SW-VML:基于神威蓝光处理器的向量数学软件包[C],2013:1-11.
Files in This Item:
There are no files associated with this item.
Related Services
Recommend this item
Bookmark
Usage statistics
Export to Endnote
Google Scholar
Similar articles in Google Scholar
[解庆春]'s Articles
[张云泉]'s Articles
[鲁永泉]'s Articles
Baidu academic
Similar articles in Baidu academic
[解庆春]'s Articles
[张云泉]'s Articles
[鲁永泉]'s Articles
Bing Scholar
Similar articles in Bing Scholar
[解庆春]'s Articles
[张云泉]'s Articles
[鲁永泉]'s Articles
Terms of Use
No data!
Social Bookmark/Share
All comments (0)
No comment.
 

Items in the repository are protected by copyright, with all rights reserved, unless otherwise indicated.