期刊文献+
共找到1,900篇文章
< 1 2 95 >
每页显示 20 50 100
基于条件语句半不变性分析的循环分裂优化 认领 引用
1
作者 韩林 邵晶晶 +3 位作者 聂凯 李浩然 刘浩浩 陈梦尧 《计算机科学》 CSCD 北大核心 2026年第2期117-123,共7页
循环分裂是一种重要的编译优化技术,可有效减少循环控制开销、提升指令流水线效率,并为后续优化创造机会。针对GCC编译器现有循环分裂策略适用范围受限的问题,提出了一种改进的循环分裂优化算法,该算法基于静态单赋值形式,根据循环内条... 循环分裂是一种重要的编译优化技术,可有效减少循环控制开销、提升指令流水线效率,并为后续优化创造机会。针对GCC编译器现有循环分裂策略适用范围受限的问题,提出了一种改进的循环分裂优化算法,该算法基于静态单赋值形式,根据循环内条件变量所在PHI节点的位置,将其区分为循环头PHI节点条件变量和合并PHI节点条件变量,针对这两种条件变量,算法分别进行半不变性分析,并以此选择分裂点,从而实现更通用的循环分裂优化。在申威GCC编译器中实现了该算法。在申威新一代处理器平台上的实验结果显示,相比原有的循环分裂算法,该算法使SPEC CPU 2006测试集中的470.lbm测试程序性能提升8.8%,SPEC CPU 2017测试集中的620.omnetpp_s测试程序性能提升4.3%。所提方法扩展了可优化循环结构的范围,提升了申威GCC编译器的优化效率,可助力国产申威平台的基础软件生态建设。 展开更多
关键词 GCC编译器 循环优化 循环分裂 静态单赋值 控制依赖
暂未订购 下载PDF
L2C可信编译器中的时钟分析/检查及其验证框架探讨 认领 引用
2
作者 甘元科 王蕾 王生原 《计算机科学》 CSCD 北大核心 2026年第6期388-395,共8页
Scade是一种广泛用于安全关键嵌入式控制软件开发的著名商业工具,其建模语言是一种同步语言,扩展自同步数据流语言Lustre。L2C可信编译器是经过形式化验证的类Scade建模语言到C语言高可信编译器长线项目之一。与同类工作相比,其源语言... Scade是一种广泛用于安全关键嵌入式控制软件开发的著名商业工具,其建模语言是一种同步语言,扩展自同步数据流语言Lustre。L2C可信编译器是经过形式化验证的类Scade建模语言到C语言高可信编译器长线项目之一。与同类工作相比,其源语言特性更接近于Scade建模语言。对于L2C可信编译器前端设计的一个重要环节,即时钟分析/检查过程的构造与验证,主要介绍分析/检查过程所采用的时钟分析/检查规则,并探讨其验证框架。 展开更多
关键词 Scade 同步语言 可信编译器 形式化验证的编译器 时钟分析/检查 Coq
暂未订购 下载PDF
RISC-V向量滑动指令在编译器中的自动生成方法 认领 引用
3
作者 姚金阳 刘福东 戚旭衍 《信息工程大学学报》 2026年第2期169-177,共9页
针对RISC-V V扩展向量滑动指令在图形处理、信号处理等领域实用价值显著,但现有编译器自动向量化框架不支持其自动生成、性能潜力受限的问题,提出一种面向该指令的自动向量化框架。首先,该框架可识别具有目标特征的标量循环,并将其自动... 针对RISC-V V扩展向量滑动指令在图形处理、信号处理等领域实用价值显著,但现有编译器自动向量化框架不支持其自动生成、性能潜力受限的问题,提出一种面向该指令的自动向量化框架。首先,该框架可识别具有目标特征的标量循环,并将其自动转换为含向量滑动指令的向量化循环;其次,该框架已集成至GCC编译器(GNU C/C++Compiler)。基于gem5模拟器,选取多领域典型应用核心函数开展测试。实验结果表明,所提框架可有效完成向量滑动指令的自动生成。性能对比显示,与标量版本相比,经向量滑动指令优化后的核心函数性能提升显著,最高加速比为20.1,几何平均加速比为8.44。 展开更多
关键词 编译器 自动向量化 单指令多数据 RISC-V架构 向量滑动指令
暂未订购 下载PDF
面向国产交换芯片的多模态网络后端编译器设计 认领 引用 被引量:1
4
作者 凃化清 王元鸿 +3 位作者 徐琪 朱俊 邹涛 隆克平 《电子与信息学报》 EI CAS CSCD 北大核心 2026年第2期686-696,共11页
当前,后端编译器相关工作主要针对软件可编程交换机(BMv2)、现场可编程门阵列(FPGA)、Intel Tofino系列芯片等可编程设备进行设计和优化,不适用于国产盛科TsingMa.MX交换芯片上多模态网络程序的编译。为此,该文提出面向TsingMa.MX交换... 当前,后端编译器相关工作主要针对软件可编程交换机(BMv2)、现场可编程门阵列(FPGA)、Intel Tofino系列芯片等可编程设备进行设计和优化,不适用于国产盛科TsingMa.MX交换芯片上多模态网络程序的编译。为此,该文提出面向TsingMa.MX交换芯片的多模态网络后端编译器p4c-TsingMa,实现了高级网络编程语言到TsingMa.MX交换芯片的编译,使TsingMa.MX交换芯片同时支持多种网络模态报文的解析与转发。p4cTsingMa首先使用先序遍历方法从中间表示中提取出协议类型、协议字段、动作等关键信息,然后根据所提取的信息进行指令转译,最终生成TsingMa.MX芯片控制命令。同时,p4c-TsingMa采用用户自定义字段(UDF)合并方法,将不同网络模态的匹配指令合并在1个查找表中,从而1次提取多个模态的匹配项,提高芯片资源利用率。实验结果表明,p4c-TsingMa可实现对多种网络模态程序的正确编译,相较于未启用UDF表项合并算法、单端口独立配置各模态UDF规则的场景,其可将寄存器资源利用率提升37.5%~75%。 展开更多
关键词 多模态网络 可编程数据平面 国产交换芯片 后端编译器
暂未订购 下载PDF
面向CPU-DSP异构处理器的Fortran编译器实现技术研究 认领 引用
5
作者 朱鹏志 黄春 +3 位作者 沈洁 陈诚 徐浩然 龙标 《计算机科学》 CSCD 北大核心 2026年第6期145-152,共8页
Fortran语言在科学与工程计算领域具有广泛应用。然而,通用数字信号处理器(General-Purpose Digital Signal Processor,GPDSP)目前主要使用C语言或汇编语言进行编程,尚不支持Fortran语言。针对这一现状,面向CPU-DSP异构处理器的Fortran... Fortran语言在科学与工程计算领域具有广泛应用。然而,通用数字信号处理器(General-Purpose Digital Signal Processor,GPDSP)目前主要使用C语言或汇编语言进行编程,尚不支持Fortran语言。针对这一现状,面向CPU-DSP异构处理器的Fortran编译器实现技术,基于LLVM Flang编译器框架设计并实现了Fortran编译器原型mtFortran,完成了Flang前端移植,并重点解决了Fortran程序在异构架构上的编译和运行支持,包括加载执行、语法支持、内建函数实现及输入输出(I/O)系统适配问题。实验结果表明,该Fortran编译器成功支持Fortran语言商用测试集U_F90_TS_LITE中GUIDE F90测试集的语法特性,在176个测试程序中运行时库已完全支持的测试程序(102道)全部通过异构编译与加载执行验证,主要类别内建函数的实现率达79.38%,并可支持典型高性能计算程序的运行(如NPB-EP测试程序),实现了Fortran程序在CPU-DSP异构处理器架构上的基础运行能力,为后续完善标准支持、性能优化及并行化扩展奠定了基础。 展开更多
关键词 CPU-DSP异构处理器 Fortran编译器 Fortran运行时 LLVM Flang
暂未订购 下载PDF
利用即时代码生成加速ARM平台的SPMM 认领 引用
6
作者 施俊 王庆林 +3 位作者 田飞扬 王志成 李润华 刘杰 《计算机科学》 CSCD 北大核心 2026年第6期163-170,共8页
近年来,随着ARM架构处理器在边缘计算设备和云服务器领域的快速普及,以及稀疏矩阵乘稠密矩阵(SPMM)在深度学习等计算密集型应用中的关键作用日益凸显,针对ARM平台的稀疏计算优化研究已成为学术热点。当前ARM平台的SPMM解决方案主要采用... 近年来,随着ARM架构处理器在边缘计算设备和云服务器领域的快速普及,以及稀疏矩阵乘稠密矩阵(SPMM)在深度学习等计算密集型应用中的关键作用日益凸显,针对ARM平台的稀疏计算优化研究已成为学术热点。当前ARM平台的SPMM解决方案主要采用提前编译(AOT)模式,即在程序执行前完成全部编译工作。然而,SPMM的AOT解决方案面临3个主要限制:不必要的内存访问、额外的分支开销以及冗余指令。因此,提出ASPJIT,其是一个ARM平台的即时(JIT)汇编代码生成框架,以加速ARM多核CPU上的SPMM计算。ASPJIT基于运行时稀疏特征分析,采用基于稀疏判断的列转行算法动态优化计算序列,显著提升指令级并行度(ILP);此外,ASPJIT通过寄存器分配策略缓存高频访问数据以减少内存访问时延,并精选单指令多数据SIMD指令集最大化算术吞吐量。对ASPJIT进行了性能评估,并将其与两个AOT基线进行了比较,第一个涉及使用ARM gcc编译器自动向量化编译的现有SPMM实现,第二个使用了ARM Eigen提供的经过优化的SPMM例程。结果表明,ASPJIT分别提供了平均3.8倍和5.6倍的提升。 展开更多
关键词 稀疏矩阵乘稠密矩阵 提前编译 即时汇编代码生成 单指令多数据 ARM多核CPU
暂未订购 下载PDF
以系统能力培养为导向的多维融合编译教学改革 认领 引用
7
作者 方建滨 黄春 +2 位作者 沈洁 陈振邦 王挺 《计算机教育》 2026年第5期13-17,共5页
针对当前编译教学中普遍存在的知识传授碎片化、工程实践薄弱、与产业前沿及系统能力培养目标脱节的突出问题,提出以系统能力培养为核心导向的“课程体系纵向贯通、课赛科教产多维融合”的教学改革思路,系统阐述如何以“系统能力图谱”... 针对当前编译教学中普遍存在的知识传授碎片化、工程实践薄弱、与产业前沿及系统能力培养目标脱节的突出问题,提出以系统能力培养为核心导向的“课程体系纵向贯通、课赛科教产多维融合”的教学改革思路,系统阐述如何以“系统能力图谱”为指引进行课程目标与内容重组,构建“编译原理—并行编译与优化—高级编译技术”三级递进课程体系,通过“课课融合、课赛融合、科教融合、产教融合”四维协同机制将知识学习、实战训练、科研反哺与产业对接融为一体,最后说明教学改革成效。 展开更多
关键词 系统能力 编译课程 多维融合 教学改革 产教协同
暂未订购 下载PDF
基于定制化中间表示和向量化汇编的动态翻译优化方法 认领 引用
8
作者 兰彦志 李欣宇 +2 位作者 牛根 曾露 张福新 《高技术通讯》 CAS 北大核心 2026年第4期354-363,共10页
二进制翻译技术是实现跨指令集软件兼容的重要手段,广泛应用于软件迁移、硬件模拟和调试验证等领域。传统研究主要聚焦于提升翻译后代码质量,对翻译过程性能的优化关注较少。然而,随着即时编译技术的普及以及客户程序代码规模的不断增长... 二进制翻译技术是实现跨指令集软件兼容的重要手段,广泛应用于软件迁移、硬件模拟和调试验证等领域。传统研究主要聚焦于提升翻译后代码质量,对翻译过程性能的优化关注较少。然而,随着即时编译技术的普及以及客户程序代码规模的不断增长,翻译过程的性能瓶颈愈发显著。为应对这一挑战,本文深入分析了现有二进制翻译系统的翻译特点,设计了一种定制化的中间表示,显著加快了翻译速度。此外,针对翻译过程中的汇编环节,提出了一种基于向量化的汇编优化方法,进一步缩短了翻译时间。在MIPS(microprocessor without interlocked pipeline stages)平台上的测试表明,使用定制化中间表示并结合向量化汇编优化后,SPEC CPU 2000测试基准的翻译速度达到QEMU(quick emulator)的4.3倍,Octane 2.0测试基准的整体翻译速度提升至QEMU的4.1倍,验证了所提方法的有效性。 展开更多
关键词 二进制翻译 翻译时间 中间表示 向量化 龙架构
暂未订购 下载PDF
基于超级块嵌套的动态二进制翻译性能优化方法 认领 引用
9
作者 金帅 柴志雷 周浩杰 《北京航空航天大学学报》 EI CAS CSCD 北大核心 2026年第6期2123-2132,共10页
直接块链接方法可以在动态二进制翻译过程中降低翻译器介入频率、提升目标程序运行性能,单纯的直接块链接只关注逻辑层面的连接,并未关注物理存储位置的连续。针对该问题,提出了一种基于超级块嵌套的动态二进制翻译性能优化方法。基于... 直接块链接方法可以在动态二进制翻译过程中降低翻译器介入频率、提升目标程序运行性能,单纯的直接块链接只关注逻辑层面的连接,并未关注物理存储位置的连续。针对该问题,提出了一种基于超级块嵌套的动态二进制翻译性能优化方法。基于二进制翻译器预翻译目标代码生成的中间表示(IR)指令,通过构建嵌套结构的超级块使代码实现物理存储位置的连续,从而增加指令cache命中率。实验结果表明:以动态二进制翻译领域最经典的且最常用的SPEC2006作为测试基准,以主流的开源二进制翻译器QEMU6.0为实验框架时,相比未采用超级块嵌套的版本,所提方法可将cache命中率平均提升53.28%,最大可提升90%。目标程序运行性能平均提升3.07%,最高可提升4.58%。 展开更多
关键词 动态二进制翻译 超级块 中间码嵌套 翻译器QEMU 指令cache
暂未订购 下载PDF
智能管控驱动的编译原理全链AI教学体系构建与应用 认领 引用
10
作者 吴昱 汤茂斌 应伟勤 《计算机教育》 2026年第7期112-120,共9页
分析编译原理课程线上线下混合式教学的核心痛点,提出“教-学-练-评-研”的“全链智教”智慧教育闭环框架,介绍智能管控驱动的编译原理全链AI教学体系构建流程,最后说明教学效果。
关键词 智能管控 编译原理 人工智能 智慧课程 教学体系
暂未订购 下载PDF
Wafer:基于多样化代码模糊技术的WebAssembly编译器测试 认领 引用
11
作者 张云哲 曾瑞莹 +3 位作者 赵文轩 顾嘉臻 周扬帆 王新 《计算机应用与软件》 北大核心 2026年第2期1-7,49,共7页
WebAssembly是一种兼具高可移植性和高性能的字节码格式,但其编译器并不绝对可靠。Wafer是一种基于模糊技术的C到WebAssembly的编译器测试工具,它采用三种代码模糊策略生成多样化的测试程序,并通过比较编译后的字节码与原C程序的行为来... WebAssembly是一种兼具高可移植性和高性能的字节码格式,但其编译器并不绝对可靠。Wafer是一种基于模糊技术的C到WebAssembly的编译器测试工具,它采用三种代码模糊策略生成多样化的测试程序,并通过比较编译后的字节码与原C程序的行为来解决测试基准问题。Wafer对两个被广泛使用的编译器Cheerp和Emscripten进行了测试,发现了14个新的漏洞,均已得到开发人员的确认。实验证明,Wafer能够检测多种类型的程序错误,覆盖率高于现有工具。 展开更多
关键词 模糊测试 编译器测试 WebAssembly 代码生成
暂未订购 下载PDF
AI+智能教学平台辅助编译原理教学探索 认领 引用
12
作者 陈思 张哲宁 《计算机教育》 2026年第2期40-45,共6页
针对传统编译原理教学模式中学习路径单一、学生被动学习、知识传递与价值塑造脱节、考核方式机械等问题,提出构建一个AI+智能教学平台,将课程资源推荐、互动与智能问答、学生状态分析、考核与评估作为核心模块,采用“线上线下混合式+... 针对传统编译原理教学模式中学习路径单一、学生被动学习、知识传递与价值塑造脱节、考核方式机械等问题,提出构建一个AI+智能教学平台,将课程资源推荐、互动与智能问答、学生状态分析、考核与评估作为核心模块,采用“线上线下混合式+层次化”方式开展教学,具体从编译原理课程教学目标与挑战、教学模式与实践、创新突破、教学实践效果4个方面详细阐述AI+智能教学平台对编译原理教学的支持作用,通过对教学结果的分析,说明该平台能显著提高学生的学习效率,增强学生主动学习的积极性。 展开更多
关键词 编译原理 人工智能 智能教学 AI平台 教学改革
暂未订购 下载PDF
基于产教融合的编译原理教学改革与创新实践 认领 引用
13
作者 陆恒杨 方伟 《计算机教育》 2026年第1期151-155,共5页
基于信创产业对计算机基础型人才的紧迫需求,分析编译原理课程教学存在的痛点问题,提出基于产教融合的课程改革思路,从教学体系建设、质量管理体系建设、系统能力人才培养3个方面介绍教学改革与创新实践,最后说明教改效果。
关键词 产教融合 编译原理 教学改革 创新实践
暂未订购 下载PDF
生成式人工智能赋能Aeo-PBL教学模式应用研究 认领 引用
14
作者 沈金伟 陈小瀚 +1 位作者 岳川 郑苑丹 《办公自动化》 2026年第15期116-119,共4页
针对编译原理课程教学过程中存在重理论讲解,轻思维和实践能力培养的问题;本研究提出面向能力提升的产生式学习模式(Aeo-PBL),从教学目标、教学方法、课程评价3个阶段,对编译原理课程进行具体的教学设计与实施。实践结果表明:Aeo-PBL模... 针对编译原理课程教学过程中存在重理论讲解,轻思维和实践能力培养的问题;本研究提出面向能力提升的产生式学习模式(Aeo-PBL),从教学目标、教学方法、课程评价3个阶段,对编译原理课程进行具体的教学设计与实施。实践结果表明:Aeo-PBL模式达成课程教学目标,有效促进学生编程能力和创新能力的提升,为我国高等教育课程改革提供可借鉴的实践路径和理论依据。 展开更多
关键词 生成式人工智能 Aeo-PBL 教学模式应用 教学改革
暂未订购 下载PDF
针对VLIW DSP编译器弊端及异常处理方案 认领 引用
15
作者 韦凯 洪泽 《电子技术应用》 2026年第1期92-95,共4页
随着高性能处理器并行度要求的提高,VLIW编译器的弊端也逐步显现,如何平衡代码的正确性和性能成为首要目标。VLIW编译器无法通过有限的代码信息去深度挖掘指令并行性,从而导致指令资源冲突等问题。因此,提出一种基于内核的异常处理方案... 随着高性能处理器并行度要求的提高,VLIW编译器的弊端也逐步显现,如何平衡代码的正确性和性能成为首要目标。VLIW编译器无法通过有限的代码信息去深度挖掘指令并行性,从而导致指令资源冲突等问题。因此,提出一种基于内核的异常处理方案,在保证代码运行正确性的同时,提高指令的并行度。以C6000系列DSP为例,针对C6000编译器的弊端,开发内核异常处理方案,通过内核异常中断确保代码优化的正确性。最后通过C66x内核资源冲突的典型案例,验证了该异常处理方案的实用性,为VLIW架构处理器程序优化提供方向。 展开更多
关键词 VLIW 编译器 资源冲突 C6000 异常处理
暂未订购 下载PDF
范式重构:AI赋能编译器设计实验课程革新 认领 引用
16
作者 戴慧珺 张利平 《计算机应用文摘》 2026年第7期44-46,50,共3页
围绕西安交通大学编译器设计实验课程的AI赋能改革进展与发展方向,系统探讨了生成式AI技术在“编译原理”课程教学中的创新路径。课程改革主要体现在重构课程内容、升级实验环境、优化评价体系等方面,将传统分散的9个知识点实验重构为4... 围绕西安交通大学编译器设计实验课程的AI赋能改革进展与发展方向,系统探讨了生成式AI技术在“编译原理”课程教学中的创新路径。课程改革主要体现在重构课程内容、升级实验环境、优化评价体系等方面,将传统分散的9个知识点实验重构为4个阶段的综合任务——词法分析、语法分析、语义分析和目标代码生成。同时,依托阿里云平台和通义灵码提供代码生成与调试支持,构建了AI赋能的教学与培养模式。 展开更多
关键词 编译器 AI赋能 编程实践 范式重构 生成式AI
暂未订购 下载PDF
嵌入式装置IEC61131程序编译与执行方案设计 认领 引用
17
作者 韩科文 陈宏君 +1 位作者 周磊 叶立文 《工业控制计算机》 2026年第3期10-11,14,共2页
为满足不同国家用户的灵活编程可配置的需求,面向国际市场销售的控制保护装置需提供用户逻辑编程功能。面向用户的编程需具备通用标准、安全可靠和高效运行的特点。将可编程控制器的国际标准IEC61131引入到电力嵌入式设备编程,面向用户... 为满足不同国家用户的灵活编程可配置的需求,面向国际市场销售的控制保护装置需提供用户逻辑编程功能。面向用户的编程需具备通用标准、安全可靠和高效运行的特点。将可编程控制器的国际标准IEC61131引入到电力嵌入式设备编程,面向用户提供标准符号库,支持用户使用功能块图、梯形图和结构化文本语言进行编程。上位机软件支持程序编辑、编译和调试功能,将用户程序编译为跨平台的中间指令,编译过程中除常规的报错提示外,还支持数组越界和除零保护等防误措施。装置侧构建了高效解释器,针对指令编写了对应的内联执行函数,在初始化过程中构建了指令执行函数表,以常规指令线性表驱动和跳转指令二次定位方式,达到了C编译器编译执行60%的效率,满足了实际应用的实时性要求。解释器调用控制保护平台标准接口,对外注册若干组输入和输出变量,支持和装置保护程序进行数据交互和人机通信配置,实现了研发核心程序和用户自定义程序的解耦开发和组件化运行。该软件已经应用于80多个国家的变电站工程,显著提升了产品的竞争力。 展开更多
关键词 嵌入式装置 逻辑编程 IEC61131 程序编译 指令执行
暂未订购 下载PDF
基于RISC-V指令拓展的神经网络加速器编译技术研究 认领 引用
18
作者 王一品 蔡成欢 +5 位作者 许嘉滨 周学功 张逢喆 曹伟 张帆 余新胜 《计算机科学》 CSCD 北大核心 2026年第6期128-136,共9页
随着人工智能的快速发展,基于RISC-V指令扩展的神经网络加速器成为研究热点。深度学习编译器是实现神经网络模型在硬件平台上高效部署的关键。然而,结合硬件特性修改现有编译器的调优规则对开发人员要求较高,同时现有编译器缺乏对专门... 随着人工智能的快速发展,基于RISC-V指令扩展的神经网络加速器成为研究热点。深度学习编译器是实现神经网络模型在硬件平台上高效部署的关键。然而,结合硬件特性修改现有编译器的调优规则对开发人员要求较高,同时现有编译器缺乏对专门转置硬件单元的编译支持,无法通过数据流重构实现高效转置,导致未充分发挥此类硬件的性能潜力。针对这些问题,首先,基于MLIR框架设计了一款面向RISC-V神经网络专用加速器的编译工具链,可实现模型端到端的部署;其次,在MLIR框架中引入了硬件特征相关的Dialect,编译器能够结合加速器缓冲区大小、脉动阵列尺寸、双缓冲策略以及数据流模式优化分块矩阵乘法操作,并结合硬件结构,通过改变矩阵数据流的方式实现矩阵转置操作,避免大规模数据的交换。此外,还根据脉动阵列特性实现了卷积算子融合以及矩阵乘法与向量计算的算子融合。实验结果表明,转置优化后运行速度平均提升了14.55倍,算子融合后运行速度平均提升了41.59%,综合优化后BERT模型运行速度平均提升了5.13%。 展开更多
关键词 深度学习编译器 RISC-V 加速器 MLIR 编译优化
暂未订购 下载PDF
C语言编译器关键模块的设计与实现研究 认领 引用
19
作者 张丽 《信息记录材料》 2026年第4期46-48,共3页
为了克服传统的C语言编译器在复杂语法结构、语义准确性、代码生成效率等方面的缺陷,本文提出了一种C语言编译器关键模块的设计方法,该方法通过改进语法分析算法、深化语义分析技术和优化代码生成技术来提升C语言编译器的整体性能。分... 为了克服传统的C语言编译器在复杂语法结构、语义准确性、代码生成效率等方面的缺陷,本文提出了一种C语言编译器关键模块的设计方法,该方法通过改进语法分析算法、深化语义分析技术和优化代码生成技术来提升C语言编译器的整体性能。分别对语法分析、语义分析、代码生成这三个主要部分进行详细设计后,使用递归下降语法分析算法结合符号表管理技术和中间代码优化技术可使编译器快速地运行。结果显示,该编译器对复杂语法规则的识别更加准确,语义分析更加彻底,代码生成速度也更快捷。 展开更多
关键词 C语言编译器 语法分析 语义分析 代码生成 模块设计
暂未订购 下载PDF
SWTuner:基于机器学习方法的分布式编译调优框架 认领 引用
20
作者 周文浩 沈莉 +6 位作者 王飞 肖谦 李斌 高秀武 宋长明 安虹 漆锋滨 《软件学报》 EI CSCD 北大核心 2026年第6期2527-2545,共19页
随着编译技术的不断进步,现代编译器支持了更为丰富的编程模型和复杂的编译优化,使得手动调整编译选项以获得最佳性能变得非常困难.尽管已有多种自动化的编译调优方法被提出,但是面对庞大的搜索空间,传统的启发式搜索算法很难避免陷入... 随着编译技术的不断进步,现代编译器支持了更为丰富的编程模型和复杂的编译优化,使得手动调整编译选项以获得最佳性能变得非常困难.尽管已有多种自动化的编译调优方法被提出,但是面对庞大的搜索空间,传统的启发式搜索算法很难避免陷入局部最优解.同时,现有调优方法主要针对单核或多核架构设计,这限制了它们在大规模并行计算系统中的应用.为了解决这些问题,设计并实现基于机器学习方法的分布式编译调优框架SWTuner,通过引入AUC-Bandit分布式元搜索策略、机器学习模型指导的性能预测以及基于SHAP的编译选项分析及筛选等技术手段,有效提升了编译调优过程中的资源利用率和搜索效率.实验结果显示,SWTuner在神威新一代超级计算机上对典型测试用例的调优中表现出色,相较于其他调优方法,其不仅缩短了搜索时间,还能够显著降低搜索过程中的实际运行功耗.在调优过程中,SWTuner所使用的随机森林模型显示出了良好的泛化能力和预测准确性,并且在保证调优效果的前提下有效降低了搜索空间的维度,为高性能计算中的自动编译调优提供了一个高效且可靠的解决方案. 展开更多
关键词 自动化调优 AUC-Bandit算法 分布式元搜索 随机森林模型 Shapley值
暂未订购 下载PDF
上一页 1 2 95 下一页 到第
在线咨询 使用帮助 返回顶部 意见反馈