
【基于GPU的矩阵乘法并行程序】及其性能分析(n=500, 1000, 1500, 2000, 3000, 5000)
5星
- 浏览量: 0
- 大小:None
- 文件类型:None
简介:
本文探讨了在不同规模(n=500至5000)下,基于GPU的矩阵乘法并行程序的性能表现,并进行了详尽的分析。
题目描述:编写一个矩阵乘法的GPU并行程序,并与对应规模的串行程序进行运行时间比对(n=500, 1000, 1500, 2000, 3000, 5000),画出不同规模和对应的运行时间对比图。矩阵A为(n,n),矩阵B也为(n,n);C = A x B。
要求:
1. 完成程序的开发并验证其正确性,编写实验报告(包括但不限于源代码、变量及语句详细说明)。
2. 在实验报告中通过图表展示CPU串行和GPU并行在各种规模下的运行时间对比情况;
3. 在实验报告中通过图表分析不同数据分配方式下GPU并行的运行时间差异。
设计思路:矩阵乘法实验采用VS2019 community+CUDA 10.1环境进行开发,在确保代码无误后,上传cu文件至xtfp,并在shell环境中使用学校提供的并行网络再次验证程序性能。最终结果用于分析不同规模下CPU串行和GPU并行的运行时间差异。
实验预览:展示各种规模下的对比图表以说明运行效率的不同表现。
全部评论 (0)
还没有任何评论哟~


