X为了获得更好的用户体验,请使用火狐、谷歌、360浏览器极速模式或IE8及以上版本的浏览器
帮助中心 | 关于我们
欢迎来到辽阳市科技创新服务平台,请 登录 | 注册
尊敬的 , 欢迎光临!  [会员中心]  [退出登录]
当前位置: 首页 >  科技成果  > 详细页

[00297711]基于GPU的稀疏矩阵数据存储方法

交易价格: 面议

所属行业: 分析仪器

类型: 发明专利

技术成熟度: 正在研发

专利所属地:中国

专利号:CN201110415911.7

交易方式: 技术转让 技术转让 技术入股

联系人: 华中科技大学

进入空间

所在地:湖北武汉市

服务承诺
产权明晰
资料保密
对所交付的所有资料进行保密
如实描述
|
收藏
|

技术详细介绍

摘要:本发明公开了一种基于GPU的稀疏矩阵数据存储方法,该方法包括:1)对行长度数组length[]按照升序排序;2)按每行非零元素的个数将数组length[]分为[0,8),[8,16),[16,32),[32,+∞)四段,每段分别合并32、16、8、4行;3)对各数据段中的行进行补零操作,对各数据段进行补行操作,所补行的元素全为零;4)产生SC-CSR格式的三个一维数组cval[]、ccol_ind[]、crow_ptr[],本发明的方法中,分段处理降低了每行的行长度变化幅度,从而减少了线程束、线程块间的负载不平衡,相邻行交错合并避免了行非零元素少于32时的线程束计算资源浪费,提高了CUDA显存联合访问的效率,并减少了计算内核并行归约的步骤,从而显著提高了稀疏矩阵向量乘的计算性能。
摘要:本发明公开了一种基于GPU的稀疏矩阵数据存储方法,该方法包括:1)对行长度数组length[]按照升序排序;2)按每行非零元素的个数将数组length[]分为[0,8),[8,16),[16,32),[32,+∞)四段,每段分别合并32、16、8、4行;3)对各数据段中的行进行补零操作,对各数据段进行补行操作,所补行的元素全为零;4)产生SC-CSR格式的三个一维数组cval[]、ccol_ind[]、crow_ptr[],本发明的方法中,分段处理降低了每行的行长度变化幅度,从而减少了线程束、线程块间的负载不平衡,相邻行交错合并避免了行非零元素少于32时的线程束计算资源浪费,提高了CUDA显存联合访问的效率,并减少了计算内核并行归约的步骤,从而显著提高了稀疏矩阵向量乘的计算性能。

推荐服务:

主办单位:辽阳市科学技术局

技术支持单位:科易网

辽ICP备16017206号-1

辽公网安备 21100302203138号

关于我们

平台简介

联系我们

客服咨询

400-649-1633

工作日:08:30-21:00

节假日:08:30-12:00

13:30-17:30