生啃“编译原理”(一)——引论

2024-08-23 01:58
文章标签 编译 原理 引论

本文主要是介绍生啃“编译原理”(一)——引论,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

开篇:

        做为软件工程专业的一员,在本科时候,关于《编译原理》这门课,没有开,没有开,没有开。。。只能通过自己学习来深入了解编译原理。并希望能够达到实现一个简单编译器的地步。


  • 1 语言处理器

   关于语言处理器,其本身就是一个大程序,而这个大程序的主要目的在于翻译源程序。

   以Java为例,有时候,我们可能会有疑问,当写完一段或复杂或简单的业务逻辑程序之后,计算机是如何去执行这段源程序的?

   这时候,就需要语言处理器去将源程序翻译为目标机器代码供计算机执行。在计算机诞生之初,机器代码过于晦涩难懂,不易理解和上手使用,所以诞生了更接近人类自然语言的高级程序设计语言(早期的Fortran和C),那么问题就来了,计算机并不能读懂这些高级程序设计语言,或者说,计算机并不能理解这些高级程序设计语言的语法和语义。因此就需要语言处理器去翻译和处理,并在最后执行这些源程序。

  语言处理器总体上分为两类:编译器和解释器  

  •    编译器:本身编译器即为一个程序,只将源程序翻译成机器可以理解的目标机器代码,同时收集与源程序相关的变量信息存放于指定位置供后续翻译使用,而这个指定位置叫做符号表,翻译完毕之后,编译器会将目标机器代码作为输出,供后续使用。整个翻译的过程较为复杂,这里只做总体认识。
  •    解释器:解释器相比于编译器,有一个很大的不同之处就在于,他并不像编译器那样对源程序进行翻译,而是直接将源程序配合用户的输入通过解释器去一步步执行源程序,并直接产生结果输出。
  •    两者的优劣:从上述对比其实可以发现,编译器并不执行源程序,仅仅是一个翻译的过程,所以从速度上来说,编译器会快于解释器,但是相反,由于解释器会直接执行源程序,所以在执行过程中,对源程序的语义和语法的检查将比编译器更加精确。

    而在实际生产环境中,源程序往往是分布于各个独立的文件之中,这些独立的文件需要经过一个叫做“聚合”的阶段,才能进行下一步的编译操作。而负责聚合操作的对象,叫做所谓的预处理器。而预处理器的聚合操作仅仅是语言处理系统的第一步。

预处理器的主要作用就是对源程序进行聚合操作,得到聚合源程序后,再又汇编器生成目标汇编程序,汇编程序再又汇编器生成可重定位的机器代码(因为大型程序都是通过多部分各自编译的方式进行的),最后利用链接器将可重定位的机器代码与库文件及可重定位对象文件进行链接,并交由加载器将最终得到的机器代码放置内存中运行。

这里需要强调几个概念:

  • 汇编器:由于汇编程序易于输出和调试,因此在大型程序中会首选汇编器将源程序先翻译成汇编语言。汇编器也是编译器的一种。
  • 链接器:由于大型程序会被分成多个部分进行编译,因此生成的机器代码必须是可重定向的,因为后续需要将其与库文件和可重定向的其他目标文件链接到一起。
  • 加载器:负责将所有的可执行的目标文件放到内存中执行。

  • 2 编译器结构
在上一节中提到,编译器最主要的作用是翻译程序,那么编译器里面的结构到底是怎么样的?
       首先,编译器其实可以分为两部分:分析部分(前端)和综合部分(后端)。
       分析部分:分析部分会将源程序分解为多个组成要素,并在组成要素上语法结构,并用这个结构来创建一个中间表示,同时提供语义上的检查信息。此外,分析部分还会收集有关源程序的信息,并把信息存放于符号表中。最后分析部分将符号表和中间表示形式一并传给综合部分。
      综合部分:根据分析部分传入的符号表和中间表示形式创建用户期待的目标程序。
如果更详细的研究一下编译过程,实际上编译器是顺序地执行了一组步骤。每个步骤把源程序从一种表示转化成另一种表示。

1.词法分析:将源程序转化成字符流,并组织成有意义的词素序列,对于每个词素,词法分析会产生词法单元。
2.语法分析:利用词法单元的第一个分量创建树形的中间表示。常用的中间表示是语法树
3.语义分析:在上一阶段得到语法树之后,需要结合符号表中的信息来检查源程序是否和语言定义的语义保持一致。
4.中间代码生成器:一个编译器可能构造出一个或多个中间表示。语法树就是其中之一,而且语法树通常在语法分析和语义分析中使用,在语法分析和语义分析完成之后,编译器会生成一个明确的低级的或者类机器语言中间表示。这个中间表示应该易于生成且能够被轻松地翻译为目标机器上的语言。
5.机器无关代码优化器:机器无关的代码优化目的在于改进中间代码以便生成更好的目标代码。
6.代码生成器:以源程序的中间表示作为输入,并把它们映射到目标语言。如果目标语言是机器代码,则必须为程序使用的每个变量选择寄存器或者内存位置。而代码生成的至关重要的一个方面就是合理分配寄存器以存放变量值。
7.机器相关代码优化器:机器相关代码优化,其操作内容与5相似,后续将做介绍。
  • 3 程序设计语言发展
以下仅介绍三种分类方式。
   第一种:按语言的代来分代。
第一代:机器语言
第二代:汇编语言
第三代:Fortran,C,Cobol,C++,C#,Java等高级程序设计语言
第四代:SQL,PostScript等特定应用设计的语言
第五代:基于逻辑和约束的语言,比如OPS5
   第二种:按照程序完成计算任务的方式划分。
强制式:指明如何完成一个计算任务,C++,C#,Java
声明式:要进行哪些计算,Haskell
   第三种:按照术语划分。
冯诺依曼语言:以冯诺依曼计算机体系结构为计算模型的程序设计语言。如C
面向对象语言:C++,C#,Java
脚本语言:Awk,JavaScript,PHP,Python

这篇关于生啃“编译原理”(一)——引论的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1098030

相关文章

Python中随机休眠技术原理与应用详解

《Python中随机休眠技术原理与应用详解》在编程中,让程序暂停执行特定时间是常见需求,当需要引入不确定性时,随机休眠就成为关键技巧,下面我们就来看看Python中随机休眠技术的具体实现与应用吧... 目录引言一、实现原理与基础方法1.1 核心函数解析1.2 基础实现模板1.3 整数版实现二、典型应用场景2

Java的IO模型、Netty原理解析

《Java的IO模型、Netty原理解析》Java的I/O是以流的方式进行数据输入输出的,Java的类库涉及很多领域的IO内容:标准的输入输出,文件的操作、网络上的数据传输流、字符串流、对象流等,这篇... 目录1.什么是IO2.同步与异步、阻塞与非阻塞3.三种IO模型BIO(blocking I/O)NI

JAVA封装多线程实现的方式及原理

《JAVA封装多线程实现的方式及原理》:本文主要介绍Java中封装多线程的原理和常见方式,通过封装可以简化多线程的使用,提高安全性,并增强代码的可维护性和可扩展性,需要的朋友可以参考下... 目录前言一、封装的目标二、常见的封装方式及原理总结前言在 Java 中,封装多线程的原理主要围绕着将多线程相关的操

kotlin中的模块化结构组件及工作原理

《kotlin中的模块化结构组件及工作原理》本文介绍了Kotlin中模块化结构组件,包括ViewModel、LiveData、Room和Navigation的工作原理和基础使用,本文通过实例代码给大家... 目录ViewModel 工作原理LiveData 工作原理Room 工作原理Navigation 工

Java的volatile和sychronized底层实现原理解析

《Java的volatile和sychronized底层实现原理解析》文章详细介绍了Java中的synchronized和volatile关键字的底层实现原理,包括字节码层面、JVM层面的实现细节,以... 目录1. 概览2. Synchronized2.1 字节码层面2.2 JVM层面2.2.1 ente

MySQL的隐式锁(Implicit Lock)原理实现

《MySQL的隐式锁(ImplicitLock)原理实现》MySQL的InnoDB存储引擎中隐式锁是一种自动管理的锁,用于保证事务在行级别操作时的数据一致性和安全性,本文主要介绍了MySQL的隐式锁... 目录1. 背景:什么是隐式锁?2. 隐式锁的工作原理3. 隐式锁的类型4. 隐式锁的实现与源代码分析4

MySQL中Next-Key Lock底层原理实现

《MySQL中Next-KeyLock底层原理实现》Next-KeyLock是MySQLInnoDB存储引擎中的一种锁机制,结合记录锁和间隙锁,用于高效并发控制并避免幻读,本文主要介绍了MySQL中... 目录一、Next-Key Lock 的定义与作用二、底层原理三、源代码解析四、总结Next-Key L

Spring Cloud Hystrix原理与注意事项小结

《SpringCloudHystrix原理与注意事项小结》本文介绍了Hystrix的基本概念、工作原理以及其在实际开发中的应用方式,通过对Hystrix的深入学习,开发者可以在分布式系统中实现精细... 目录一、Spring Cloud Hystrix概述和设计目标(一)Spring Cloud Hystr

IDEA编译报错“java: 常量字符串过长”的原因及解决方法

《IDEA编译报错“java:常量字符串过长”的原因及解决方法》今天在开发过程中,由于尝试将一个文件的Base64字符串设置为常量,结果导致IDEA编译的时候出现了如下报错java:常量字符串过长,... 目录一、问题描述二、问题原因2.1 理论角度2.2 源码角度三、解决方案解决方案①:StringBui

MySQL中的MVCC底层原理解读

《MySQL中的MVCC底层原理解读》本文详细介绍了MySQL中的多版本并发控制(MVCC)机制,包括版本链、ReadView以及在不同事务隔离级别下MVCC的工作原理,通过一个具体的示例演示了在可重... 目录简介ReadView版本链演示过程总结简介MVCC(Multi-Version Concurr