期刊文献+
共找到12篇文章
< 1 >
每页显示 20 50 100
Design of efficient parallel algorithms on shared memory multiprocessors 认领 引用
1
作者 Qiao Xiangzhen 《Wuhan University Journal of Natural Sciences》 CAS 1996年第Z1期344-349,共6页
The design of parallel algorithms is studied in this paper. These algorithms are applicable to shared memory MIMD machines In this paper, the emphasis is put on the methods for design of the efficient parallel algorit... The design of parallel algorithms is studied in this paper. These algorithms are applicable to shared memory MIMD machines In this paper, the emphasis is put on the methods for design of the efficient parallel algorithms. The design of efficient parallel algorithms should be based on the following considerationst algorithm parallelism and the hardware-parallelism; granularity of the parallel algorithm, algorithm optimization according to the underling parallel machine. In this paper , these principles are applied to solve a model problem of the PDE. The speedup of the new method is high. The results were tested and evaluated on a shared memory MIMD machine. The practical results were agree with the predicted performance. 展开更多
关键词 parallel algorithm, shared memory multiprocessor parallel granularity optimization.
暂未订购 下载PDF
作物生长模型分布式并行调度方案的比较 认领 引用 被引量:4
2
作者 姜海燕 尹言 +2 位作者 彭川阳 汤亮 曹卫星 《农业工程学报》 EI CAS CSCD 北大核心 2011年第6期237-243,共7页
为了提高作物生长模型的计算速度,论文提出了多种分布式并行调度方案。综合分析了田块尺度下作物生长子模型以及子模型内部组分的数据依赖关系和计算流程。以流水线技术和分治策略为基础,分别在模型组分层、子模型层和驱动数据层设计了... 为了提高作物生长模型的计算速度,论文提出了多种分布式并行调度方案。综合分析了田块尺度下作物生长子模型以及子模型内部组分的数据依赖关系和计算流程。以流水线技术和分治策略为基础,分别在模型组分层、子模型层和驱动数据层设计了不同的分布式并行调度方案。在WCCS2003(Windows Compute Cluster Server 2003)组成的PC集群环境下,分别采用了OpenMP、MPI_OpenMP混合以及MPI编程模型实现了多种调度方案的并行模拟。并行加速比的实验分析表明,优化后的子模型层并行调度方案,在6个双核CPUs组成的PC集群上的平均加速比可达到8.2,更接近模型并行计算加速比的预测值。在分布式集群环境下,采用基于MPI的子模型层中等粒度的并行调度方案具有更快的计算速度,更适合于作物生长模拟系统。 展开更多
关键词 作物 并行算法 消息传递 生长模拟模型 集群 共享内存
暂未订购 下载PDF
作物生育期模拟并行调度算法的研究与设计 认领 引用 被引量:5
3
作者 姜海燕 彭川阳 +2 位作者 尹言 朱艳 曹卫星 《江苏农业学报》 北大核心 2010年第6期1210-1216,共7页
探明作物生育期模拟在PC集群环境下的并行调度算法,有助于提高模型的计算效率。该研究综合应用划分策略和流水线技术,具体分析了已有作物的生长发育和物候期模拟算法的输入输出参数特性,确定了作物生育期模拟通用算法框架,包括热效应、... 探明作物生育期模拟在PC集群环境下的并行调度算法,有助于提高模型的计算效率。该研究综合应用划分策略和流水线技术,具体分析了已有作物的生长发育和物候期模拟算法的输入输出参数特性,确定了作物生育期模拟通用算法框架,包括热效应、光周期效应、春化效应、有效积温、生理发育时间和物候期共6个计算单元;进一步明确了具有独立、自依赖和相互依赖关系的作物模型的计算任务划分和数据分解方法。为达到数据通讯和同步开销最小的目标,设计了多节点混合调度的优化模型。该研究提出了基于OpenMP的多处理机并行调度算法和基于MPI/OpenMP混合的多节点并行调度算法,并在Windows Compute Cluster Server2003组成的PC集群环境下,在加速比、计算缓冲区大小和计算节点个数等方面进行了性能度量与比较。结果表明:两种并行调度算法均可有效提高小麦生育期模拟的计算效率,第1种算法简单易行,平均加速比为1.55,对集群计算资源的利用率有限;第2种算法的平均加速比是3.37,当计算量较大时,具有更好的计算性能。 展开更多
关键词 生长发育与物候期 模拟模型 小麦 并行算法 共享内存 消息传递
暂未订购 下载PDF
共享内存系统中高效并行FDTD计算方案 认领 引用 被引量:3
4
作者 赖生建 王秉中 黄廷祝 《电子科技大学学报》 EI CAS 北大核心 2010年第5期680-683,共4页
针对电大问题的FDTD仿真,在共享内存系统中提出一种不交换数据的并行FDTD计算方案。该方案利用共享内存系统的通用多核处理器架构,直接读取并行场域边界面的数据实现并行计算,采用自主开发的多线程技术实现FDTD的并行计算。通过数值仿... 针对电大问题的FDTD仿真,在共享内存系统中提出一种不交换数据的并行FDTD计算方案。该方案利用共享内存系统的通用多核处理器架构,直接读取并行场域边界面的数据实现并行计算,采用自主开发的多线程技术实现FDTD的并行计算。通过数值仿真测试,提出了最大并行计算效率的区域划分方式,并验证了所提出的方案是一种理想的基于共享内存系统的并行FDTD计算方案。 展开更多
关键词 计算效率 时域有限差分法 通用多核处理器 并行算法 共享内存
暂未订购 下载PDF
面向共享内存结构的并行Delaunay网格生成算法 认领 引用 被引量:1
5
作者 张晓蒙 陆忠华 +1 位作者 张鉴 马文鹏 《计算机应用研究》 CSCD 北大核心 2016年第6期1616-1619,共4页
针对目前大多数并行Delaunay网格生成算法对共享内存结构利用不充分、不能够利用超级计算机多层次体系结构优势的情况,提出了一种充分利用共享内存结构的基于算法并行模式的并行Delaunay网格生成算法。通过对候选点集进行高效划分来实... 针对目前大多数并行Delaunay网格生成算法对共享内存结构利用不充分、不能够利用超级计算机多层次体系结构优势的情况,提出了一种充分利用共享内存结构的基于算法并行模式的并行Delaunay网格生成算法。通过对候选点集进行高效划分来实现插点操作的并行,增大了一次选择之后进行并行插点的点集规模。使用Open MP并行模型对所提出算法进行并行实现,并与串行开源软件Triangle进行了对比。实验结果表明算法能够将候选点集划分成互不冲突的子集进行并行处理,在保证网格质量的同时具有较好的并行效率。 展开更多
关键词 网格生成 Delaunay算法 并行计算 共享内存
暂未订购 下载PDF
一种改进多亲遗传算法的并行模型研究 认领 引用 被引量:1
6
作者 吴佳英 李平 +1 位作者 郑金华 胡宁静 《计算机工程》 CAS 北大核心 2007年第5期190-192,196,共3页
通过分析传统遗传算法和多亲遗传算法的不足,提出了一种多亲遗传算法的改进算法:基于共享存储器的多亲遗传算法,并对其进行了理论分析,讨论了GA的并行模型特点后,结合粗粒度并行模型和群体分组的并行方式,提出了一种MGASM的并行模型,该... 通过分析传统遗传算法和多亲遗传算法的不足,提出了一种多亲遗传算法的改进算法:基于共享存储器的多亲遗传算法,并对其进行了理论分析,讨论了GA的并行模型特点后,结合粗粒度并行模型和群体分组的并行方式,提出了一种MGASM的并行模型,该模型有利于改进MGASM的性能,提高其搜索效率。将MGASM-PPGA应用到了数据聚类问题中,进行了仿真实验,获得了理想的实验结果。 展开更多
关键词 多亲遗传算法 共享存储器 理论分析 并行处理 数据聚类
暂未订购 下载PDF
基于OpenMP的高效多子阵合成孔径声呐距离多普勒成像算法 认领 引用 被引量:1
7
作者 钟何平 黄攀 唐劲松 《计算机应用研究》 CSCD 北大核心 2019年第3期950-953,共4页
为充分利用多核CPU计算资源解决多子阵合成孔径声呐成像效率低的问题,提出了一种共享内存环境下的距离多普勒成像算法并行解决方案。在分析多子阵合成孔径声呐距离多普勒成像算法并行性的基础上,对算法中预处理、距离向脉冲压缩、固定... 为充分利用多核CPU计算资源解决多子阵合成孔径声呐成像效率低的问题,提出了一种共享内存环境下的距离多普勒成像算法并行解决方案。在分析多子阵合成孔径声呐距离多普勒成像算法并行性的基础上,对算法中预处理、距离向脉冲压缩、固定相位补偿、距离徙动校正和方位向脉冲压缩进行了OpenMP并行化设计,充分利用多核CPU计算资源实现了大数据量合成孔径声呐图像快速重构。对实测数据的成像实验结果表明,并行成像算法加速比高达19. 86,满足实时合成孔径声呐系统成像需求。 展开更多
关键词 合成孔径声呐 距离多普勒成像算法 并行计算 共享内存 OpenMP
暂未订购 下载PDF
压缩存储的并行高斯-约当消元法及性能优化 认领 引用 被引量:1
8
作者 熊壬浩 刘羽 《计算机工程与设计》 北大核心 2016年第6期1526-1530,共5页
为加速Occam反演算法中对称带状系数矩阵上的高斯-约当消元法,研究二维等带宽存储方法,提出一种基于对分策略的并行算法,解决顺序策略中因工作三角形上各行的计算量不同导致的负载不均衡问题。在共享内存并行系统上验证该算法的效果,着... 为加速Occam反演算法中对称带状系数矩阵上的高斯-约当消元法,研究二维等带宽存储方法,提出一种基于对分策略的并行算法,解决顺序策略中因工作三角形上各行的计算量不同导致的负载不均衡问题。在共享内存并行系统上验证该算法的效果,着重研究该平台上算法性能的优化。与串行算法进行对比,对比结果表明,优化方法大幅提升了算法的时间性能,在此基础上并行高斯-约当算法的加速比可达3.72,基于该并行算法的反演算法加速性能良好。 展开更多
关键词 高斯-约当消元法 二维等带宽存储 高性能计算 算法优化 共享存储并行程序设计
暂未订购 下载PDF
SGI系统上星载SAR并行成像算法 认领 引用
9
作者 高国荣 王开志 +1 位作者 刘兴钊 韩传钊 《计算机工程》 EI CAS 北大核心 2004年第19期45-46,67,共2页
对星载合成孔径雷达(SAR)并行处理算法在分布式共享存储器(DSM)HPC平台下的实现作了深入研究,对比了用消息传递和OpenMP两种并行编程模型实现的并行方案,在此基础上提出了基于进程的共享变量并行模型。这种模型克服了前两种模型的缺点,... 对星载合成孔径雷达(SAR)并行处理算法在分布式共享存储器(DSM)HPC平台下的实现作了深入研究,对比了用消息传递和OpenMP两种并行编程模型实现的并行方案,在此基础上提出了基于进程的共享变量并行模型。这种模型克服了前两种模型的缺点,经过实验测试和实际SAR成像应用,证明是一种高效、稳定的并行方案。 展开更多
关键词 合成孔径雷达 高性能计算 并行成像算法 共享变量
暂未订购 下载PDF
XML数据查询的并行算法 认领 引用
10
作者 朱华兴 周丽娟 周梦熊 《自动化技术与应用》 2007年第1期38-41,共4页
目前已经提出了多种查询XML数据的方法,然而这些传统的方法不能充分利用多处理器和多核心处理器的优势。本文提出了一种XML查询的并行算法,大幅提高了共享存储器多处理器、多核心处理器系统中XML数据的查询效率。
关键词 XML 查询处理 并行算法 共享存储器
暂未订购 下载PDF
基于共享存储的并行狭义遗传算法 认领 引用
11
作者 晏妮 《电子设计工程》 2015年第7期74-76,共3页
遗传算法具有简单、易算且方便分布并行处理等特点,基于这种优势,遗传算法被广泛应用于众多领域范围内,比如机器学习、工业控制等。为解决高难度的非线性及其相关问题,采用基于共享存储的并行狭义遗传算法,可以有效实现对数据级的并行操... 遗传算法具有简单、易算且方便分布并行处理等特点,基于这种优势,遗传算法被广泛应用于众多领域范围内,比如机器学习、工业控制等。为解决高难度的非线性及其相关问题,采用基于共享存储的并行狭义遗传算法,可以有效实现对数据级的并行操作,具有较强的并行度,其只需较少的通讯开销就能获得比原先更高的运行效率,至少提高至50%以上。文中详细阐述了基于共享存储的并行狭义遗传算法,仿真实验验证了其正确性和高效性。 展开更多
关键词 共享存储 并行狭义遗传算法 非线性 探究
暂未订购 下载PDF
基于共享内存方式化简矢量数据的并行策略 认领 引用
12
作者 黄飞龙 张吉才 +1 位作者 宋默 郭力刚 《测绘科学与工程》 2019年第3期61-66,共6页
矢量数据化简是制图综合领域的重要研究内容,但是传统的简化算法,如道格拉斯-普克(Douglas-Reucker,DP)算法等,多基于串行计算方式,存在计算量大、执行效率低的问题。本文利用共享内存并行处理技术对DP算法进行并行化改造,提出了点级并... 矢量数据化简是制图综合领域的重要研究内容,但是传统的简化算法,如道格拉斯-普克(Douglas-Reucker,DP)算法等,多基于串行计算方式,存在计算量大、执行效率低的问题。本文利用共享内存并行处理技术对DP算法进行并行化改造,提出了点级并行、要素级并行以及双并行三种并行策略,并进行了相关实验验证与对比分析。实验结果表明,在合适的线程数量下,三种并行策略均可提高矢量数据的化简效率,其中双并行算法可以最大限度地利用计算机的多核计算资源,取得最佳的加速比。 展开更多
关键词 矢量数据化简 DP算法 共享内存 并行处理 OpenMP
暂未订购 下载PDF
上一页 1 下一页 到第
在线咨询 使用帮助 返回顶部 意见反馈