生啃“编译原理”(一)——引论

2024-08-23 01:58
文章标签 编译 原理 引论

本文主要是介绍生啃“编译原理”(一)——引论,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

开篇:

        做为软件工程专业的一员,在本科时候,关于《编译原理》这门课,没有开,没有开,没有开。。。只能通过自己学习来深入了解编译原理。并希望能够达到实现一个简单编译器的地步。


  • 1 语言处理器

   关于语言处理器,其本身就是一个大程序,而这个大程序的主要目的在于翻译源程序。

   以Java为例,有时候,我们可能会有疑问,当写完一段或复杂或简单的业务逻辑程序之后,计算机是如何去执行这段源程序的?

   这时候,就需要语言处理器去将源程序翻译为目标机器代码供计算机执行。在计算机诞生之初,机器代码过于晦涩难懂,不易理解和上手使用,所以诞生了更接近人类自然语言的高级程序设计语言(早期的Fortran和C),那么问题就来了,计算机并不能读懂这些高级程序设计语言,或者说,计算机并不能理解这些高级程序设计语言的语法和语义。因此就需要语言处理器去翻译和处理,并在最后执行这些源程序。

  语言处理器总体上分为两类:编译器和解释器  

  •    编译器:本身编译器即为一个程序,只将源程序翻译成机器可以理解的目标机器代码,同时收集与源程序相关的变量信息存放于指定位置供后续翻译使用,而这个指定位置叫做符号表,翻译完毕之后,编译器会将目标机器代码作为输出,供后续使用。整个翻译的过程较为复杂,这里只做总体认识。
  •    解释器:解释器相比于编译器,有一个很大的不同之处就在于,他并不像编译器那样对源程序进行翻译,而是直接将源程序配合用户的输入通过解释器去一步步执行源程序,并直接产生结果输出。
  •    两者的优劣:从上述对比其实可以发现,编译器并不执行源程序,仅仅是一个翻译的过程,所以从速度上来说,编译器会快于解释器,但是相反,由于解释器会直接执行源程序,所以在执行过程中,对源程序的语义和语法的检查将比编译器更加精确。

    而在实际生产环境中,源程序往往是分布于各个独立的文件之中,这些独立的文件需要经过一个叫做“聚合”的阶段,才能进行下一步的编译操作。而负责聚合操作的对象,叫做所谓的预处理器。而预处理器的聚合操作仅仅是语言处理系统的第一步。

预处理器的主要作用就是对源程序进行聚合操作,得到聚合源程序后,再又汇编器生成目标汇编程序,汇编程序再又汇编器生成可重定位的机器代码(因为大型程序都是通过多部分各自编译的方式进行的),最后利用链接器将可重定位的机器代码与库文件及可重定位对象文件进行链接,并交由加载器将最终得到的机器代码放置内存中运行。

这里需要强调几个概念:

  • 汇编器:由于汇编程序易于输出和调试,因此在大型程序中会首选汇编器将源程序先翻译成汇编语言。汇编器也是编译器的一种。
  • 链接器:由于大型程序会被分成多个部分进行编译,因此生成的机器代码必须是可重定向的,因为后续需要将其与库文件和可重定向的其他目标文件链接到一起。
  • 加载器:负责将所有的可执行的目标文件放到内存中执行。

  • 2 编译器结构
在上一节中提到,编译器最主要的作用是翻译程序,那么编译器里面的结构到底是怎么样的?
       首先,编译器其实可以分为两部分:分析部分(前端)和综合部分(后端)。
       分析部分:分析部分会将源程序分解为多个组成要素,并在组成要素上语法结构,并用这个结构来创建一个中间表示,同时提供语义上的检查信息。此外,分析部分还会收集有关源程序的信息,并把信息存放于符号表中。最后分析部分将符号表和中间表示形式一并传给综合部分。
      综合部分:根据分析部分传入的符号表和中间表示形式创建用户期待的目标程序。
如果更详细的研究一下编译过程,实际上编译器是顺序地执行了一组步骤。每个步骤把源程序从一种表示转化成另一种表示。

1.词法分析:将源程序转化成字符流,并组织成有意义的词素序列,对于每个词素,词法分析会产生词法单元。
2.语法分析:利用词法单元的第一个分量创建树形的中间表示。常用的中间表示是语法树
3.语义分析:在上一阶段得到语法树之后,需要结合符号表中的信息来检查源程序是否和语言定义的语义保持一致。
4.中间代码生成器:一个编译器可能构造出一个或多个中间表示。语法树就是其中之一,而且语法树通常在语法分析和语义分析中使用,在语法分析和语义分析完成之后,编译器会生成一个明确的低级的或者类机器语言中间表示。这个中间表示应该易于生成且能够被轻松地翻译为目标机器上的语言。
5.机器无关代码优化器:机器无关的代码优化目的在于改进中间代码以便生成更好的目标代码。
6.代码生成器:以源程序的中间表示作为输入,并把它们映射到目标语言。如果目标语言是机器代码,则必须为程序使用的每个变量选择寄存器或者内存位置。而代码生成的至关重要的一个方面就是合理分配寄存器以存放变量值。
7.机器相关代码优化器:机器相关代码优化,其操作内容与5相似,后续将做介绍。
  • 3 程序设计语言发展
以下仅介绍三种分类方式。
   第一种:按语言的代来分代。
第一代:机器语言
第二代:汇编语言
第三代:Fortran,C,Cobol,C++,C#,Java等高级程序设计语言
第四代:SQL,PostScript等特定应用设计的语言
第五代:基于逻辑和约束的语言,比如OPS5
   第二种:按照程序完成计算任务的方式划分。
强制式:指明如何完成一个计算任务,C++,C#,Java
声明式:要进行哪些计算,Haskell
   第三种:按照术语划分。
冯诺依曼语言:以冯诺依曼计算机体系结构为计算模型的程序设计语言。如C
面向对象语言:C++,C#,Java
脚本语言:Awk,JavaScript,PHP,Python

这篇关于生啃“编译原理”(一)——引论的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1098030

相关文章

Spring Boot Interceptor的原理、配置、顺序控制及与Filter的关键区别对比分析

《SpringBootInterceptor的原理、配置、顺序控制及与Filter的关键区别对比分析》本文主要介绍了SpringBoot中的拦截器(Interceptor)及其与过滤器(Filt... 目录前言一、核心功能二、拦截器的实现2.1 定义自定义拦截器2.2 注册拦截器三、多拦截器的执行顺序四、过

Java 队列Queue从原理到实战指南

《Java队列Queue从原理到实战指南》本文介绍了Java中队列(Queue)的底层实现、常见方法及其区别,通过LinkedList和ArrayDeque的实现,以及循环队列的概念,展示了如何高效... 目录一、队列的认识队列的底层与集合框架常见的队列方法插入元素方法对比(add和offer)移除元素方法

SQL 注入攻击(SQL Injection)原理、利用方式与防御策略深度解析

《SQL注入攻击(SQLInjection)原理、利用方式与防御策略深度解析》本文将从SQL注入的基本原理、攻击方式、常见利用手法,到企业级防御方案进行全面讲解,以帮助开发者和安全人员更系统地理解... 目录一、前言二、SQL 注入攻击的基本概念三、SQL 注入常见类型分析1. 基于错误回显的注入(Erro

Spring IOC核心原理详解与运用实战教程

《SpringIOC核心原理详解与运用实战教程》本文详细解析了SpringIOC容器的核心原理,包括BeanFactory体系、依赖注入机制、循环依赖解决和三级缓存机制,同时,介绍了SpringBo... 目录1. Spring IOC核心原理深度解析1.1 BeanFactory体系与内部结构1.1.1

MySQL 批量插入的原理和实战方法(快速提升大数据导入效率)

《MySQL批量插入的原理和实战方法(快速提升大数据导入效率)》在日常开发中,我们经常需要将大量数据批量插入到MySQL数据库中,本文将介绍批量插入的原理、实现方法,并结合Python和PyMySQ... 目录一、批量插入的优势二、mysql 表的创建示例三、python 实现批量插入1. 安装 PyMyS

Java编译错误java.lang.NoSuchFieldError的解决方案详析

《Java编译错误java.lang.NoSuchFieldError的解决方案详析》java.lang.NoSuchFieldError是Java中的一种运行时错误,:本文主要介绍Java编译错... 目录前言解决方案1. 统一JDK版本环境2. 优化maven-compiler-plugin配置3. 清

深入理解Redis线程模型的原理及使用

《深入理解Redis线程模型的原理及使用》Redis的线程模型整体还是多线程的,只是后台执行指令的核心线程是单线程的,整个线程模型可以理解为还是以单线程为主,基于这种单线程为主的线程模型,不同客户端的... 目录1 Redis是单线程www.chinasem.cn还是多线程2 Redis如何保证指令原子性2.

GO语言中gox交叉编译的实现

《GO语言中gox交叉编译的实现》本文主要介绍了GO语言中gox交叉编译的实现,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起学习学习吧... 目录一、安装二、使用三、遇到的问题1、开启CGO2、修改环境变量最近在工作中使用GO语言进行编码开发,因

Java中流式并行操作parallelStream的原理和使用方法

《Java中流式并行操作parallelStream的原理和使用方法》本文详细介绍了Java中的并行流(parallelStream)的原理、正确使用方法以及在实际业务中的应用案例,并指出在使用并行流... 目录Java中流式并行操作parallelStream0. 问题的产生1. 什么是parallelS

Java中Redisson 的原理深度解析

《Java中Redisson的原理深度解析》Redisson是一个高性能的Redis客户端,它通过将Redis数据结构映射为Java对象和分布式对象,实现了在Java应用中方便地使用Redis,本文... 目录前言一、核心设计理念二、核心架构与通信层1. 基于 Netty 的异步非阻塞通信2. 编解码器三、