CN114968374B 一种基于新一代神威超级计算机的多层循环进程级和线程级协同自动优化方法 (山东省计算中心(国家超级计算济南中心))_第1页
CN114968374B 一种基于新一代神威超级计算机的多层循环进程级和线程级协同自动优化方法 (山东省计算中心(国家超级计算济南中心))_第2页
CN114968374B 一种基于新一代神威超级计算机的多层循环进程级和线程级协同自动优化方法 (山东省计算中心(国家超级计算济南中心))_第3页
CN114968374B 一种基于新一代神威超级计算机的多层循环进程级和线程级协同自动优化方法 (山东省计算中心(国家超级计算济南中心))_第4页
CN114968374B 一种基于新一代神威超级计算机的多层循环进程级和线程级协同自动优化方法 (山东省计算中心(国家超级计算济南中心))_第5页
已阅读5页,还剩20页未读 继续免费阅读

下载本文档

版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领

文档简介

一种基于新一代神威超级计算机的多层循本发明涉及一种基于新一代神威超级计算机的多层循环进程级和线程级协同自动优化方2将应用程序中的多层循环程序段和硬件架构相互对应,实现各优化即节点内通信优化和节点间的通信优化,使得各个进程在各自通信域中进行集中通将应用程序中的多层循环程序段和硬件架构相互对应,实现各层循环对应到从核簇内的单个从核上;此时第4层循环之间的信息传递采用的是从核簇内2.根据权利要求1所述的一种基于新一代神威超级计算机的多层循环进程级和线程级3.根据权利要求1所述的一种基于新一代神威超级计算机的多层循环进程级和线程级个进程对应处理器的1个核组;处理器上的6个核组平均处理应用程序中的第2层循环的所4.根据权利要求3所述的一种基于新一代神威超级计算机的多层循环进程级和线程级进同一处理器上的进程组中的6个进程上进行计算,平均分配方式使用块划分或者是循环块划分是指:将应用程序中的第2层循环中存在的所有循环平均分配到同一进程组中5.根据权利要求1所述的一种基于新一代神威超级计算机的多层循环进程级和线程级36.根据权利要求1所述的一种基于新一代神威超级计算机的多层循环进程级和线程级进程级的并行划分是指:首先,根据应用程序中的最外两层循环即第1线程级的并行划分是指:只在一个申威众核处理器内,进行7.一种计算机设备,包括存储器和处理器,所述存于,所述处理器执行所述计算机程序时实现权利要求1_6任一所述的基于新一代神威超级处理器执行时实现权利要求1_6任一所述的基于新一代神威超级计算机的多层循环进程级接口函数SMLO_LOOP_4(intloop_start,intloop_end,intloop_increment,void*接口函数SMLO_LOOP_3(intloop_start,intloop_end,intloop_increment,void*接口函数SMLO_LOOP_2(intloop_start,intloop_end,intloop_increment,void*接口函数SMLO_LOOP_1(intloop_start,intloop_end,intloop_increment,void*4[0003]新一代神威超级计算机使用了我国自主研发的新一代高性能异构众核处理器——SW26010pro。新一代神威超级计算机的每个计算节点包含2颗申威SW26010pro处理5[0014]一种基于新一代神威超级计算机的多层循环进程级和线[0019]每1个处理器上包括6个核组,每个核组对应1个进程,这6个进程划分为1个进程程对应处理器的1个核组;处理器上的6个核组平均处理应用程序中的第2层循环的所有循[0021]进一步优选的,将应用程序中的第2层循环以块划分或者循环划分的方式分配到处理器上的进程组中的6个进程上进行计算,平均分配方式使用块划分或者是循环划分的[0022]循环划分是指:0至5号进程分别对应处理应用程序中的第2层循环中的第0至5次[0023]块划分是指:将应用程序中的第2层循环中存在的所有循环平均分配到同一进程[0024]根据本发明优选的,将应用程序中的第3层循环对应到单个核组内的单个从核簇第3层循环映射到从核簇上;循环次数较少是指循环次数少于64,64为单个核组的从核数6器执行所述计算机程序时实现基于新一代神威超级计算机的多层循环进程级和线程级协行时实现基于新一代神威超级计算机的多层循环进程级和线程级协同自动优化方法的步[0032]接口函数SMLO_LOOP_4(intloop_start,intloop_end,intloop_increment,void*(*func)(void*),void*func_args),intloop_start是指循环的起始数值,intloop_end是指循环的结束数值,intloop_increment是指循环的增量,void*(*func)[0033]接口函数SMLO_LOOP_3(intloop_start,intloop_end,intloop_increment,[0034]接口函数SMLO_LOOP_2(intloop_start,intloop_end,intloop_increment,[0035]接口函数SMLO_LOOP_1(intloop_start,intloop_end,intloop_increment,7[0041]4、本发明的方法和并行接口函数适用于多台神威超级计算机和多个版本的申威[0047]一种基于新一代神威超级计算机的多层循环进程级和线[0050]根据实施例1所述的一种基于新一代神威超级计算机的多层循环进程级和线程级[0054]每1个处理器上包括6个核组,每个核组对应1个进程,这6个进程划分为1个进程8[0056]将应用程序中的第2层循环以块划分或者循环划分的方式分配到每个进程中,包[0057]循环划分是指:0至5号进程分别对应处理应用程序中的第2层循环中的第0至5次[0058]块划分是指:将应用程序中的第2层循环中存在的所有循环平均分配到同一进程应用程序中的第3层循环的循环次数,决定对应采用并行的是若干个从核簇还是若干个从[0062]根据实施例1或2所述的一种基于新一代神威超级计算机的多层循环进程级和线9[0067]OpenMOC是一种用于反应堆物理临界计算的特征线方法(MOC)中性粒子输运代本发明使用了所述方法和接口对其进行了并行优化。使用本发明所述方法优化的OpenMOC器执行所述计算机程序时实现实施例1_3任一基于新一代神威超级计算机的多层循环进程行时实现实施例1_3任一基于新一代神威超级计算机的多层循环进程级和线程级协同自动[0076]一种自动化并行接口SMLO,用于实现实施例1_3任一所述多层循环进程级和线程[0078]接口函数SMLO_LOOP_4(intloop_start,intloop_end,intloop_increment,void*(*func)(void*),void*func_args),intloop_start是指循环的起始数值,intloop_end是指循环的结束数值,intloop_increment是指循环的增量,void*(*func)[0079]接口函数SMLO_LOOP_3(intloop_start,intloop_end,intloop_increment,[0080]接口函数SMLO_LOOP_2(intloop_start,intloop_end,intloop_increment,[0081]接口函数SMLO_LOOP_1(intloop_start,intloop_end,intloop_increment,[0083]本

温馨提示

  • 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
  • 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
  • 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
  • 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
  • 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
  • 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
  • 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。

评论

0/150

提交评论