从电路模拟的复杂推演到量子化学的微观分析,大规模稀疏线性方程组的高效求解是科学计算领域的核心需求。但传统稀疏直接求解器因数据非零元分布稀疏且不规则,导致运算低效、算力浪费等问题。近日,中国科学技术大学计算机科学与技术学院特任副研究员陈俊仕团队,在鲲鹏昇腾科教创新卓越中心的算力支持下,创新研发出面向鲲鹏处理器矩阵算力基于密集kernel的LU直接求解器,以密集运算方式实现了稀疏计算的高效求解,成功突破传统运算瓶颈。

该研究创新构建了一种面向稀疏矩阵计算的密集计算范式,系统化解构了传统稀疏直接求解器的性能瓶颈。团队通过将分散的非零元整合为更加规整的密集数据块,将不规则稀疏矩阵映射为统一稠密的大块结构,进而采用基于稠密矩阵运算的数值分解算法,取代传统稀疏运算中聚合非零小分块的碎片化计算模式,显著降低了由不规则内存访问引发的计算与调度开销,最终实现了计算效率与硬件利用率的协同优化。
该方案的顺利落地,深度依赖于鲲鹏平台的计算特性。硬件层面,鲲鹏920新型号集成专用矩阵运算单元,原生具备高密度数值分解运算的高效承载能力,可精准匹配密集数据块的集中化处理需求;其多核架构为大规模密集数据块的并行运算提供了坚实基础,避免算力闲置或过载。软件层面,鲲鹏 KML 数学库针对密集型矩阵运算进行深度优化,通过底层算法与硬件架构的协同,进一步放大了密集运算模式的性能潜力。经 70 余个跨领域测试集验证,该方案性能较SuperLU 求解器平均加速32.2倍,在基础硬件配置下实现了平均 9.6 倍性能加速,大幅压缩了科学计算的时间成本。
目前,相关研究成果已发表于 CCF B 类国际会议 Euro-Par 2025,其核心技术已申请中国发明专利并获得授权。此次成果是鲲鹏平台在科学计算领域的典型实践,该方法对于现代高性能处理器上稀疏计算问题的高效求解、充分地发挥处理器上的矩阵运算单元具有很好的应用价值。未来,随着鲲鹏生态的持续完善,其在高性能计算领域的赋能作用将进一步凸显,助力更多科研团队突破技术难关,推动科研成果加速落地转化。
声明:本网转发此文章,旨在为读者提供更多信息资讯,所涉内容不构成投资、消费建议。文章事实如有疑问,请与有关方核实,文章观点非本网观点,仅供读者参考。
上一篇:郎永淳的自留地:在易显智能,亲手书写中国科技的篇章...
下一篇:返回列表
近日,由国家数据局联合19个部门共同举办2025年“数据要素×”大赛圆满结束...
2025-11-28 21:00:43
当市场的波动成为常态,投资的难度日益攀升,投资者应该坚守“理想主义”的信念,...
2025-11-28 17:57:28
近日,智元远征A2(SNA210041BA00652号机器人)成...
2025-11-28 14:02:29
随着气温逐渐降低,新雪季的脚步悄然临近,国内各地滑雪场纷纷行动起...
2025-11-28 13:22:32
11月28日,轻松健康集团已通过香港联合交易所聆讯,拟于主板挂牌上市。公开信...
2025-11-28 13:03:18
截至10月底,全国发电装机容量达37.5亿千瓦,同比增长17.3...
2025-11-28 12:29:31
随着寒潮渐次南下,传统农业本应进入淡季,但冬季蔬菜种植产业却逆势...
2025-11-28 11:51:13
11月27日,中国工商银行党委书记、董事长廖林会见来访的中国人保集团党委书记...
2025-11-28 11:15:36
11月26日下午,香港新界大埔区宏福苑多栋住宅楼发生五级火灾,造成重大损失和...
2025-11-28 10:30:14
11月27日,搭载千问的夸克AI眼镜正式发布,这标志着阿里千问首次走出屏幕,...
2025-11-28 06:14:34