期刊文献+
共找到96篇文章
< 1 2 5 >
每页显示 20 50 100
Reworks系统下FT2000平台的FFT库性能与SIMD加速分析 认领 引用
1
作者 李雪伟 石炜 +1 位作者 岳世鑫 王绍宇 《科学技术与工程》 EI 北大核心 2026年第8期3359-3366,共8页
针对嵌入式实时操作系统(real-time operating systems,RTOS)的高性能快速傅里叶变换(fast Fourier transform,FFT)需求,开展基于国产FT2000/4处理器平台的本地实现和FFT性能加速研究。重点介绍了开源库FFTW和ARM专用库Ne10对FFT的支持... 针对嵌入式实时操作系统(real-time operating systems,RTOS)的高性能快速傅里叶变换(fast Fourier transform,FFT)需求,开展基于国产FT2000/4处理器平台的本地实现和FFT性能加速研究。重点介绍了开源库FFTW和ARM专用库Ne10对FFT的支持参数、核心算法实现、编译支持情况及各自特点等,对比了两种库在不同数据规模和单指令多数据(single instruction multiple data,SIMD)加速条件下的计算性能,并在Reworks系统下的FT2000平台上进行测试实验。结果表明:在未启用SIMD场景下,FFTW凭借算法的优化和内存管理性能显著优于Ne10,最高是Ne10的467%,启用SIMD后,Ne10展现出架构定制化的优势,最高实现525%的性能提升,在基3和基5的部分长度中,Ne10也表现出较高的性能。可见FFT库的实现以及SIMD加速对计算性能的关键影响,为嵌入式系统FFT的选择提供理论与实践依据。 展开更多
关键词 快速傅里叶变换(FFT) 单指令多数据(SIMD)加速 FFTW Ne10 Reworks系统
暂未订购 下载PDF
掺氢天然气管道仿真方法研究 认领 引用
2
作者 田晓龙 杨罗 +2 位作者 吴小平 代明亮 江明 《北京化工大学学报(自然科学版)》 CAS CSCD 北大核心 2026年第1期40-50,共11页
迄今,掺氢天然气的仿真工作始终无法有效平衡计算精度和仿真速度这2项参数,不利于指导现场运行方案的快速决策。针对这一问题,将组分追踪方程、水力方程和热力方程进行去耦仿真,分析了耦合模型与气体瞬态管网模拟软件TGNET结果、耦合模... 迄今,掺氢天然气的仿真工作始终无法有效平衡计算精度和仿真速度这2项参数,不利于指导现场运行方案的快速决策。针对这一问题,将组分追踪方程、水力方程和热力方程进行去耦仿真,分析了耦合模型与气体瞬态管网模拟软件TGNET结果、耦合模型和去耦模型结果的差异性,确定了最优的时间步长和空间步长,引入单指令多数据(SIMD)并行计算技术,基于AVX2指令集实现中间参数求解过程的快速化处理,以实际案例进行了计算和分析。结果显示:耦合模型结果与TGNET软件结果的吻合程度较高,两者的计算时间分别为8237 ms和8359 ms,2种模型具有一致性和相容性;去耦模型计算时采用时间步长90 s、空间步长1 km的组合较为合适,与耦合模型相比,此组合下的加速比为2.89;与最大压力-最大流量边界条件相比,最大流量-最大流量边界条件下的压力、温度、氢气摩尔分数的误差均有所增大,建议在管网规划设计、运行调峰、突发性用气和供气安全冗余保障等工况下优先使用该边界条件;与去耦模型相比,引入SIMD指令的计算加速比为2.68,低于理论加速比上限。研究结果可为大型掺氢天然气管网的仿真工作提供理论依据和实际参考。 展开更多
关键词 掺氢天然气 仿真 耦合模型 去耦模型 边界条件 SIMD
暂未订购 下载PDF
国产平台下软件移植优化的研究进展 认领 引用
3
作者 王林柱 金能智 +1 位作者 杨博超 刘君毅 《信息记录材料》 2026年第10期4-6,15,共3页
随着我国高性能计算(HPC)技术的快速发展,国产处理器平台的软件生态建设成为关键议题。本文系统梳理了近年来基于ARM、申威、海光等国产平台在科学计算、人工智能、气象模拟等领域的软件移植与优化研究进展。研究表明,通过单指令多数据... 随着我国高性能计算(HPC)技术的快速发展,国产处理器平台的软件生态建设成为关键议题。本文系统梳理了近年来基于ARM、申威、海光等国产平台在科学计算、人工智能、气象模拟等领域的软件移植与优化研究进展。研究表明,通过单指令多数据流(SIMD)向量化、并行优化、内存优化等关键技术,国产平台上的应用软件性能得到显著提升,部分应用性能接近或达到国际先进水平。本文总结了典型应用的移植优化方法与性能提升效果,为国产平台软件生态建设提供了参考。 展开更多
关键词 国产平台 软件移植 性能优化 单指令多数据流(SIMD) 并行计算 高性能计算(HPC)
暂未订购 下载PDF
RISC-V向量滑动指令在编译器中的自动生成方法 认领 引用
4
作者 姚金阳 刘福东 戚旭衍 《信息工程大学学报》 2026年第2期169-177,共9页
针对RISC-V V扩展向量滑动指令在图形处理、信号处理等领域实用价值显著,但现有编译器自动向量化框架不支持其自动生成、性能潜力受限的问题,提出一种面向该指令的自动向量化框架。首先,该框架可识别具有目标特征的标量循环,并将其自动... 针对RISC-V V扩展向量滑动指令在图形处理、信号处理等领域实用价值显著,但现有编译器自动向量化框架不支持其自动生成、性能潜力受限的问题,提出一种面向该指令的自动向量化框架。首先,该框架可识别具有目标特征的标量循环,并将其自动转换为含向量滑动指令的向量化循环;其次,该框架已集成至GCC编译器(GNU C/C++Compiler)。基于gem5模拟器,选取多领域典型应用核心函数开展测试。实验结果表明,所提框架可有效完成向量滑动指令的自动生成。性能对比显示,与标量版本相比,经向量滑动指令优化后的核心函数性能提升显著,最高加速比为20.1,几何平均加速比为8.44。 展开更多
关键词 编译器 自动向量化 单指令多数据 RISC-V架构 向量滑动指令
暂未订购 下载PDF
利用即时代码生成加速ARM平台的SPMM 认领 引用
5
作者 施俊 王庆林 +3 位作者 田飞扬 王志成 李润华 刘杰 《计算机科学》 CSCD 北大核心 2026年第6期163-170,共8页
近年来,随着ARM架构处理器在边缘计算设备和云服务器领域的快速普及,以及稀疏矩阵乘稠密矩阵(SPMM)在深度学习等计算密集型应用中的关键作用日益凸显,针对ARM平台的稀疏计算优化研究已成为学术热点。当前ARM平台的SPMM解决方案主要采用... 近年来,随着ARM架构处理器在边缘计算设备和云服务器领域的快速普及,以及稀疏矩阵乘稠密矩阵(SPMM)在深度学习等计算密集型应用中的关键作用日益凸显,针对ARM平台的稀疏计算优化研究已成为学术热点。当前ARM平台的SPMM解决方案主要采用提前编译(AOT)模式,即在程序执行前完成全部编译工作。然而,SPMM的AOT解决方案面临3个主要限制:不必要的内存访问、额外的分支开销以及冗余指令。因此,提出ASPJIT,其是一个ARM平台的即时(JIT)汇编代码生成框架,以加速ARM多核CPU上的SPMM计算。ASPJIT基于运行时稀疏特征分析,采用基于稀疏判断的列转行算法动态优化计算序列,显著提升指令级并行度(ILP);此外,ASPJIT通过寄存器分配策略缓存高频访问数据以减少内存访问时延,并精选单指令多数据SIMD指令集最大化算术吞吐量。对ASPJIT进行了性能评估,并将其与两个AOT基线进行了比较,第一个涉及使用ARM gcc编译器自动向量化编译的现有SPMM实现,第二个使用了ARM Eigen提供的经过优化的SPMM例程。结果表明,ASPJIT分别提供了平均3.8倍和5.6倍的提升。 展开更多
关键词 稀疏矩阵乘稠密矩阵 提前编译 即时汇编代码生成 单指令多数据 ARM多核CPU
暂未订购 下载PDF
基于SIMD的并行傅里叶空间图像相似度计算 认领 引用 被引量:5
6
作者 郭渝洛 边浩东 +3 位作者 董润婷 唐嘉豪 王晓英 黄建强 《计算机工程》 CAS CSCD 北大核心 2021年第11期247-253,共7页
在冷冻电镜三维重建计算模型中,傅里叶空间图像相似度算法被频繁调用,大量的计算开销导致模型整体运行速度变慢。针对该问题,提出一种基于SIMD的并行傅里叶空间图像相似度算法。通过手动负载均衡方式最大化CPU的线程使用率,添加AVX-512... 在冷冻电镜三维重建计算模型中,傅里叶空间图像相似度算法被频繁调用,大量的计算开销导致模型整体运行速度变慢。针对该问题,提出一种基于SIMD的并行傅里叶空间图像相似度算法。通过手动负载均衡方式最大化CPU的线程使用率,添加AVX-512指令集增强CPU矢量寄存器的作用,同时设计高效的数据结构提升内存访问效率。在Intel Xeon Platinum 9242平台上的实验结果表明,与原始的OpenMP并行模型相比,经该算法优化后的程序可获得平均5.132倍的加速比,并且具有较强的鲁棒性。 展开更多
关键词 冷冻电镜 负载均衡 缓存 单指令多数据流矢量化 傅里叶空间 图像相似度计算 并行计算
暂未订购 下载PDF
SIMD计算机的面向对象仿真方法 认领 引用 被引量:1
7
作者 王馨梅 张发存 崔杜武 《计算机工程》 EI CAS 北大核心 2005年第17期90-91,94,共2页
以网格互联型SIMD计算机为例,提出一个数据并行计算的面向对象仿真方法:首先对网格互联型SIMD计算机系统结构进行研究,抽象出其数学模型。然后在数学模型基础上,结合3个辅助表,设计出一个高度兼容的仿真机类,该类可实例化为不同结构参... 以网格互联型SIMD计算机为例,提出一个数据并行计算的面向对象仿真方法:首先对网格互联型SIMD计算机系统结构进行研究,抽象出其数学模型。然后在数学模型基础上,结合3个辅助表,设计出一个高度兼容的仿真机类,该类可实例化为不同结构参数及指令集的网格互联型SIMD计算机的仿真机对象。这种方法能大大提高计算机仿真软件的开发效率。 展开更多
关键词 仿真 面向对象设计 SIMD
暂未订购 下载PDF
EDO-SIMD:内嵌数据组织的SIMD多媒体扩展指令集 认领 引用
8
作者 刘坤杰 秦兴 +2 位作者 严晓浪 李德贤 彭剑英 《浙江大学学报(工学版)》 EI CAS 北大核心 2008年第4期565-570,共6页
针对单指令多数据(SIMD)并行多媒体扩展在图像和视频等媒体应用中数据组织和存取等非有效计算开销过大的问题,采用嵌入式处理器面向应用定制指令集的设计思路,通过将数据组织与计算或存取相融合,设计了内嵌数据组织和可变长向量存取两... 针对单指令多数据(SIMD)并行多媒体扩展在图像和视频等媒体应用中数据组织和存取等非有效计算开销过大的问题,采用嵌入式处理器面向应用定制指令集的设计思路,通过将数据组织与计算或存取相融合,设计了内嵌数据组织和可变长向量存取两类特殊扩展指令,并与其他基本指令构成了EDO-SIMD(embedded data organi-zation SIMD)多媒体扩展指令集.性能测试结果表明,EDO-SIMD指令体系可显著降低典型媒体应用核心的非有效计算开销,并提高数据级并行效率. 展开更多
关键词 多媒体处理 单指令多数据 内嵌数据组织
暂未订购 下载PDF
SIMD图像处理机存储系统研究 认领 引用
9
作者 段宗涛 沙爱民 孙朝云 《微电子学与计算机》 北大核心 2008年第5期114-116,共3页
为了获得尽可能高的并行计算单元的计算能力,对SIMD图像处理机的存储系统进行了深入研究.该存储系统根据图像处理应用的特点,使用基于编译获得的数据流存取全局信息进行数据流调度,有效地提高了数据存取的速度,满足了并行计算单元对数... 为了获得尽可能高的并行计算单元的计算能力,对SIMD图像处理机的存储系统进行了深入研究.该存储系统根据图像处理应用的特点,使用基于编译获得的数据流存取全局信息进行数据流调度,有效地提高了数据存取的速度,满足了并行计算单元对数据存取速度的要求,为SIMD图像处理机系统性能的提高提供了支持. 展开更多
关键词 阵列处理器 协处理器 流调度 双缓冲区 SIMD
暂未订购 下载PDF
Implimentations of SIMD machine using programmable gate array 认领 引用
10
作者 胡铭曾 《Journal of Harbin Institute of Technology(New Series)》 EI CAS 2000年第3期10-13,共4页
Field Programmable Gate Array(FPGA) and Single Instruction Multiple Data(SIMD) processing array share many architecture features. In both architectures, an array is employed to provide high speed computation. In this ... Field Programmable Gate Array(FPGA) and Single Instruction Multiple Data(SIMD) processing array share many architecture features. In both architectures, an array is employed to provide high speed computation. In this paper we show that the implementation of a Single Instruction Multiple Data (SIMD) machine the ABC 90 using the Field Programmable Gate Array (FPGA) is not completely suitable because of its characteristics. The comparison between the programmable gate arrays show that, they have many architectures features in common. Within this framework, we examine the differences and similarities between these array structures and touch upon techniques and lessons which can be done between these architectures in order to choose the appropriate Programmable gate array to implement a general purpose parallel computer. In this paper we introduce the principal of the Dynamically Programmable Date Array(DPGA) which combines the best feature of the FPGA and the SIMD arrays into a single array architecture. By the same way we show that the DPGA is more appropriate then the FPGA for wiring, hardwiring the general purpose parallel computers: SIMD and its implementation. 展开更多
关键词 Field Programmable Gate Array Single Instruction Multiple Data Dynamically Programmable Data Array
暂未订购 下载PDF
Blocking optimized SIMD tree search on modern processors 认领 引用 被引量:2
11
作者 张倬 陆宇凡 +2 位作者 沈文枫 徐炜民 郑衍衡 《Journal of Shanghai University(English Edition)》 2011年第5期437-444,共8页
Tree search is a widely used fundamental algorithm. Modern processors provide tremendous computing power by integrating multiple cores, each with a vector processing unit. This paper reviews some studies on exploiting... Tree search is a widely used fundamental algorithm. Modern processors provide tremendous computing power by integrating multiple cores, each with a vector processing unit. This paper reviews some studies on exploiting single instruction multiple date (SIMD) capacity of processors to improve the performance of tree search, and proposes several improvement methods on reported SIMD tree search algorithms. Based on blocking tree structure, blocking for memory alignment and dynamic blocking prefetch are proposed to optimize the overhead of memory access. Furthermore, as a way of non-linear loop unrolling, the search branch unwinding shows that the number of branches can exceed the data width of SIMD instructions in the SIMD search algorithm. The experiments suggest that blocking optimized SIMD tree search algorithm can achieve 1.6 times response speed faster than the un-optimized algorithm. 展开更多
关键词 single instruction multiple date SIMD tree search binary search streaming SIMD extensions (SSE) Cell broadband engine (BE)
暂未订购 下载PDF
分簇VLIW DSP上支持单双字模式选择的SIMD编译优化 认领 引用 被引量:2
12
作者 黄胜兵 郑启龙 郭连伟 《计算机应用》 CSCD 北大核心 2015年第8期2371-2374,共4页
BWDSP100是一款采用超长指令字(VLIW)和单指令多数据流(SIMD)架构的针对高性能计算领域而设计的32位静态标量数字信号处理器,其指令级并行(ILP)主要是通过其特殊的分簇体系结构和SIMD指令来实现,然而现有的编译框架无法对这些特殊的SIM... BWDSP100是一款采用超长指令字(VLIW)和单指令多数据流(SIMD)架构的针对高性能计算领域而设计的32位静态标量数字信号处理器,其指令级并行(ILP)主要是通过其特殊的分簇体系结构和SIMD指令来实现,然而现有的编译框架无法对这些特殊的SIMD指令提供支持。由于BWDSP100拥有丰富的SIMD向量化资源,且其所运用的雷达数字信号处理领域对程序的性能要求极高,因此针对BWDSP100结构的特点,在传统Open64编译器中SIMD编译优化框架的基础上提出并实现了一种支持单双字模式选择的SIMD编译优化算法,通过该算法可以显著提高一些在DSP上有着广泛运用计算密集型程序的性能。实验结果表明,与优化前相比,该算法方案在BWDSP编译器上的实现能够平均取得5.66的加速比。 展开更多
关键词 编译优化 指令级并行 分簇体系数字信号处理器 超长指令字 单指令多数据流 Open64编译器
暂未订购 下载PDF
SIMD非对齐访存结构设计与实现 认领 引用 被引量:2
13
作者 余成龙 王永文 《计算机工程》 CAS CSCD 北大核心 2016年第9期1-4,共4页
单指令流多数据流(SIMD)是实现数据级并行的有效方法,但访问地址非对齐的数据严重影响程序的向量化,造成处理器性能下降。为降低非对齐访存延时,对高性能应用程序的访存结构进行建模,设计并实现SIMD分离缓冲行非对齐访存结构与双体cach... 单指令流多数据流(SIMD)是实现数据级并行的有效方法,但访问地址非对齐的数据严重影响程序的向量化,造成处理器性能下降。为降低非对齐访存延时,对高性能应用程序的访存结构进行建模,设计并实现SIMD分离缓冲行非对齐访存结构与双体cache非对齐访存结构。实验结果表明,在双体cache非对齐访存结构下,通过两数组相加与SIMD向量化实现的非对齐访存代码可达到对齐访存代码性能的99%,提高了SIMD向量化的访存效率。 展开更多
关键词 高性能计算 数据级并行 向量化 单指令流多数据流扩展 非对齐访存 Gem5模拟器
暂未订购 下载PDF
软件SIMD的研究及应用 认领 引用 被引量:1
14
作者 卜士喜 竺红卫 《计算机工程》 CAS 北大核心 2010年第19期53-55,共3页
介绍软件SIMD技术,在不支持SIMD架构的处理器上使用该技术实现寄存器高低字节的并行运算,提高处理器的速度。软件SIMD包括基本的加减法运算、乘法运算和点积运算。在现有研究的基础上,解决包含负数的点积运算、复数运算中应用软件SIMD... 介绍软件SIMD技术,在不支持SIMD架构的处理器上使用该技术实现寄存器高低字节的并行运算,提高处理器的速度。软件SIMD包括基本的加减法运算、乘法运算和点积运算。在现有研究的基础上,解决包含负数的点积运算、复数运算中应用软件SIMD技术的问题,使其能广泛应用于数字信号处理等领域。 展开更多
关键词 单指令多数据流 软件SIMD 并行运算 数字信号处理
暂未订购 下载PDF
基于MMX技术的SIMD并行运算优化算法 认领 引用 被引量:1
15
作者 张剑 《传感技术学报》 EI CAS 北大核心 2005年第4期897-900,共4页
将面向对象思想引入到SAD值计算的并行操作过程中,并从SIMD并行运算的角度出发,给出了改进的图像组织优化算法,通过对MMX优化后的编码器速度的测试结果知,在目前H.264/AVC的视频编码上,该编码器的编码速度有明显地提高,为实现窄带中的... 将面向对象思想引入到SAD值计算的并行操作过程中,并从SIMD并行运算的角度出发,给出了改进的图像组织优化算法,通过对MMX优化后的编码器速度的测试结果知,在目前H.264/AVC的视频编码上,该编码器的编码速度有明显地提高,为实现窄带中的实时视频通信提供了保障。 展开更多
关键词 编码器 矢量 并行运算 单指令多数据
暂未订购 下载PDF
SIMD并行运算的参考图像组织方法 认领 引用 被引量:1
16
作者 李学渊 《传感技术学报》 EI CAS 北大核心 2006年第1期183-186,共4页
从单指令多数据并行运算的角度出发,将面向对象的思想引入到SAD值计算的并行操作过程中,给出了一种改进的图像组织优化算法,通过对多个标准测试序列进行运动预测的测试结果知,在当前最复杂的视频编码H.264/AVC上,该算法的实施可以明显... 从单指令多数据并行运算的角度出发,将面向对象的思想引入到SAD值计算的并行操作过程中,给出了一种改进的图像组织优化算法,通过对多个标准测试序列进行运动预测的测试结果知,在当前最复杂的视频编码H.264/AVC上,该算法的实施可以明显地提高编码器的编码速度,为实现窄带中的实时视频通信提供了保障。 展开更多
关键词 单指令多数据 帧问编码 并行运算 运动预测
暂未订购 下载PDF
Efficient SIMD optimization for media processors 认领 引用
17
作者 Jian-peng ZHOU Ce SHI 《Journal of Zhejiang University-SCIENCE A》 SCIE EI CAS 2008年第4期524-530,共7页
Single instruction multiple data (SIMD) instructions are often implemented in modem media processors. Although SIMD instructions are useful in multimedia applications, most compilers do not have good support for SIM... Single instruction multiple data (SIMD) instructions are often implemented in modem media processors. Although SIMD instructions are useful in multimedia applications, most compilers do not have good support for SIMD instructions. This paper focuses on SIMD instructions generation for media processors. We present an efficient code optimization approach that is integrated into a retargetable C compiler. SIMD instructions are generated by finding and combining the same operations in programs. Experimental results for the UltraSPARC VIS instruction set show that a speedup factor up to 2.639 is obtained. 展开更多
关键词 Retargetable compiler Single instruction multiple data SIMD instruction LCC
暂未订购 下载PDF
基于SIMD架构的相干累加运算优化方法 认领 引用
18
作者 陈源 王元钦 董绪荣 《计算机工程》 EI CAS CSCD 北大核心 2011年第20期268-270,共3页
针对软件GPS接收机在处理高数据流时存在的实时性问题,提出一种基于单指令多数据流(SIMD)架构的相干运算优化方法。分析跟踪环路结构、SIMD指令与相干积分累加运算量,使用多媒体扩展指令集对流水线进行优化。实验结果表明,完成1 s数据... 针对软件GPS接收机在处理高数据流时存在的实时性问题,提出一种基于单指令多数据流(SIMD)架构的相干运算优化方法。分析跟踪环路结构、SIMD指令与相干积分累加运算量,使用多媒体扩展指令集对流水线进行优化。实验结果表明,完成1 s数据的相干积分累加计算时间为0.7 s,该运算量仅为使用普通单指令多数据流指令的6.5%,具有较高的实时性。 展开更多
关键词 单指令多数据流技术 GPS软件 相干积分 流水线优化
暂未订购 下载PDF
ALGORITHMS AND ARCHITECTURE IMPLEMENTATIONS OF MIMO OFDM BASEBAND RECEIVER BASED ON THE SIMD DSP CORE 认领 引用 被引量:1
19
作者 Hao Xuefei Chen Jie +1 位作者 Zhao Danfeng Zhou Chaoxian 《Journal of Electronics(China)》 2006年第5期763-768,共6页
This letter presents a programmable single-chip architecture for Multi-lnput and Multi-Output (M1MO) OFDM baseband receiver. The architecture comprises a Single Instruction Multiple Data (SIMD) DSP core and three ... This letter presents a programmable single-chip architecture for Multi-lnput and Multi-Output (M1MO) OFDM baseband receiver. The architecture comprises a Single Instruction Multiple Data (SIMD) DSP core and three coprocessors that are used for synchronization, FFT and channel decoder. In this MIMO OFDM system, the Zero Correlation Zone (ZCZ) code is used as the synchronization word preamble of packet in the physical layer in order to avoid the interference from other transmitting antennas. Furthermore, a simple channel estimation algorithm is proposed which is appropriate tbr the SIMD DSP computation. 展开更多
关键词 Multi-Input and Multi-Output (MIMO) OFDM Baseband receiver Zero Correlation Zone (ZCZ) code Single Instruction Multiple Data SIMD DSP
暂未订购 下载PDF
基于SIMD结构的矩形行列式并行算法研究 认领 引用
20
作者 王艾昕 《计算机工程与应用》 CSCD 2012年第25期48-51,56,共4页
在运用行列式Schur余子式算法的理论基础上,提出了对SIMD结构的并行机,可适用于对行列式按行分块并行处理算法,把一个n阶行列式的求值过程分解成相对独立的若干个二阶行列式的求值过程,而且它们的求值过程是相对独立的,具有并行性,从而... 在运用行列式Schur余子式算法的理论基础上,提出了对SIMD结构的并行机,可适用于对行列式按行分块并行处理算法,把一个n阶行列式的求值过程分解成相对独立的若干个二阶行列式的求值过程,而且它们的求值过程是相对独立的,具有并行性,从而设计出n阶行列式求值的并行算法。给出了该算法的实现步骤,分析了算法的加速比;对算法进行了模拟实验,结果说明了其性能。 展开更多
关键词 单指令多数据流 并行计算机 并行算法 加速比
暂未订购 下载PDF
上一页 1 2 5 下一页 到第
在线咨询 使用帮助 返回顶部 意见反馈