生啃“编译原理”(一)——引论

2024-08-23 01:58
文章标签 编译 原理 引论

本文主要是介绍生啃“编译原理”(一)——引论,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

开篇:

        做为软件工程专业的一员,在本科时候,关于《编译原理》这门课,没有开,没有开,没有开。。。只能通过自己学习来深入了解编译原理。并希望能够达到实现一个简单编译器的地步。


  • 1 语言处理器

   关于语言处理器,其本身就是一个大程序,而这个大程序的主要目的在于翻译源程序。

   以Java为例,有时候,我们可能会有疑问,当写完一段或复杂或简单的业务逻辑程序之后,计算机是如何去执行这段源程序的?

   这时候,就需要语言处理器去将源程序翻译为目标机器代码供计算机执行。在计算机诞生之初,机器代码过于晦涩难懂,不易理解和上手使用,所以诞生了更接近人类自然语言的高级程序设计语言(早期的Fortran和C),那么问题就来了,计算机并不能读懂这些高级程序设计语言,或者说,计算机并不能理解这些高级程序设计语言的语法和语义。因此就需要语言处理器去翻译和处理,并在最后执行这些源程序。

  语言处理器总体上分为两类:编译器和解释器  

  •    编译器:本身编译器即为一个程序,只将源程序翻译成机器可以理解的目标机器代码,同时收集与源程序相关的变量信息存放于指定位置供后续翻译使用,而这个指定位置叫做符号表,翻译完毕之后,编译器会将目标机器代码作为输出,供后续使用。整个翻译的过程较为复杂,这里只做总体认识。
  •    解释器:解释器相比于编译器,有一个很大的不同之处就在于,他并不像编译器那样对源程序进行翻译,而是直接将源程序配合用户的输入通过解释器去一步步执行源程序,并直接产生结果输出。
  •    两者的优劣:从上述对比其实可以发现,编译器并不执行源程序,仅仅是一个翻译的过程,所以从速度上来说,编译器会快于解释器,但是相反,由于解释器会直接执行源程序,所以在执行过程中,对源程序的语义和语法的检查将比编译器更加精确。

    而在实际生产环境中,源程序往往是分布于各个独立的文件之中,这些独立的文件需要经过一个叫做“聚合”的阶段,才能进行下一步的编译操作。而负责聚合操作的对象,叫做所谓的预处理器。而预处理器的聚合操作仅仅是语言处理系统的第一步。

预处理器的主要作用就是对源程序进行聚合操作,得到聚合源程序后,再又汇编器生成目标汇编程序,汇编程序再又汇编器生成可重定位的机器代码(因为大型程序都是通过多部分各自编译的方式进行的),最后利用链接器将可重定位的机器代码与库文件及可重定位对象文件进行链接,并交由加载器将最终得到的机器代码放置内存中运行。

这里需要强调几个概念:

  • 汇编器:由于汇编程序易于输出和调试,因此在大型程序中会首选汇编器将源程序先翻译成汇编语言。汇编器也是编译器的一种。
  • 链接器:由于大型程序会被分成多个部分进行编译,因此生成的机器代码必须是可重定向的,因为后续需要将其与库文件和可重定向的其他目标文件链接到一起。
  • 加载器:负责将所有的可执行的目标文件放到内存中执行。

  • 2 编译器结构
在上一节中提到,编译器最主要的作用是翻译程序,那么编译器里面的结构到底是怎么样的?
       首先,编译器其实可以分为两部分:分析部分(前端)和综合部分(后端)。
       分析部分:分析部分会将源程序分解为多个组成要素,并在组成要素上语法结构,并用这个结构来创建一个中间表示,同时提供语义上的检查信息。此外,分析部分还会收集有关源程序的信息,并把信息存放于符号表中。最后分析部分将符号表和中间表示形式一并传给综合部分。
      综合部分:根据分析部分传入的符号表和中间表示形式创建用户期待的目标程序。
如果更详细的研究一下编译过程,实际上编译器是顺序地执行了一组步骤。每个步骤把源程序从一种表示转化成另一种表示。

1.词法分析:将源程序转化成字符流,并组织成有意义的词素序列,对于每个词素,词法分析会产生词法单元。
2.语法分析:利用词法单元的第一个分量创建树形的中间表示。常用的中间表示是语法树
3.语义分析:在上一阶段得到语法树之后,需要结合符号表中的信息来检查源程序是否和语言定义的语义保持一致。
4.中间代码生成器:一个编译器可能构造出一个或多个中间表示。语法树就是其中之一,而且语法树通常在语法分析和语义分析中使用,在语法分析和语义分析完成之后,编译器会生成一个明确的低级的或者类机器语言中间表示。这个中间表示应该易于生成且能够被轻松地翻译为目标机器上的语言。
5.机器无关代码优化器:机器无关的代码优化目的在于改进中间代码以便生成更好的目标代码。
6.代码生成器:以源程序的中间表示作为输入,并把它们映射到目标语言。如果目标语言是机器代码,则必须为程序使用的每个变量选择寄存器或者内存位置。而代码生成的至关重要的一个方面就是合理分配寄存器以存放变量值。
7.机器相关代码优化器:机器相关代码优化,其操作内容与5相似,后续将做介绍。
  • 3 程序设计语言发展
以下仅介绍三种分类方式。
   第一种:按语言的代来分代。
第一代:机器语言
第二代:汇编语言
第三代:Fortran,C,Cobol,C++,C#,Java等高级程序设计语言
第四代:SQL,PostScript等特定应用设计的语言
第五代:基于逻辑和约束的语言,比如OPS5
   第二种:按照程序完成计算任务的方式划分。
强制式:指明如何完成一个计算任务,C++,C#,Java
声明式:要进行哪些计算,Haskell
   第三种:按照术语划分。
冯诺依曼语言:以冯诺依曼计算机体系结构为计算模型的程序设计语言。如C
面向对象语言:C++,C#,Java
脚本语言:Awk,JavaScript,PHP,Python

这篇关于生啃“编译原理”(一)——引论的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1098030

相关文章

深入探索协同过滤:从原理到推荐模块案例

文章目录 前言一、协同过滤1. 基于用户的协同过滤(UserCF)2. 基于物品的协同过滤(ItemCF)3. 相似度计算方法 二、相似度计算方法1. 欧氏距离2. 皮尔逊相关系数3. 杰卡德相似系数4. 余弦相似度 三、推荐模块案例1.基于文章的协同过滤推荐功能2.基于用户的协同过滤推荐功能 前言     在信息过载的时代,推荐系统成为连接用户与内容的桥梁。本文聚焦于

hdu4407(容斥原理)

题意:给一串数字1,2,......n,两个操作:1、修改第k个数字,2、查询区间[l,r]中与n互质的数之和。 解题思路:咱一看,像线段树,但是如果用线段树做,那么每个区间一定要记录所有的素因子,这样会超内存。然后我就做不来了。后来看了题解,原来是用容斥原理来做的。还记得这道题目吗?求区间[1,r]中与p互质的数的个数,如果不会的话就先去做那题吧。现在这题是求区间[l,r]中与n互质的数的和

maven 编译构建可以执行的jar包

💝💝💝欢迎莅临我的博客,很高兴能够在这里和您见面!希望您在这里可以感受到一份轻松愉快的氛围,不仅可以获得有趣的内容和知识,也可以畅所欲言、分享您的想法和见解。 推荐:「stormsha的主页」👈,「stormsha的知识库」👈持续学习,不断总结,共同进步,为了踏实,做好当下事儿~ 专栏导航 Python系列: Python面试题合集,剑指大厂Git系列: Git操作技巧GO

hdu4407容斥原理

题意: 有一个元素为 1~n 的数列{An},有2种操作(1000次): 1、求某段区间 [a,b] 中与 p 互质的数的和。 2、将数列中某个位置元素的值改变。 import java.io.BufferedInputStream;import java.io.BufferedReader;import java.io.IOException;import java.io.Inpu

hdu4059容斥原理

求1-n中与n互质的数的4次方之和 import java.io.BufferedInputStream;import java.io.BufferedReader;import java.io.IOException;import java.io.InputStream;import java.io.InputStreamReader;import java.io.PrintWrit

寻迹模块TCRT5000的应用原理和功能实现(基于STM32)

目录 概述 1 认识TCRT5000 1.1 模块介绍 1.2 电气特性 2 系统应用 2.1 系统架构 2.2 STM32Cube创建工程 3 功能实现 3.1 代码实现 3.2 源代码文件 4 功能测试 4.1 检测黑线状态 4.2 未检测黑线状态 概述 本文主要介绍TCRT5000模块的使用原理,包括该模块的硬件实现方式,电路实现原理,还使用STM32类

TL-Tomcat中长连接的底层源码原理实现

长连接:浏览器告诉tomcat不要将请求关掉。  如果不是长连接,tomcat响应后会告诉浏览器把这个连接关掉。    tomcat中有一个缓冲区  如果发送大批量数据后 又不处理  那么会堆积缓冲区 后面的请求会越来越慢。

Windows环境利用VS2022编译 libvpx 源码教程

libvpx libvpx 是一个开源的视频编码库,由 WebM 项目开发和维护,专门用于 VP8 和 VP9 视频编码格式的编解码处理。它支持高质量的视频压缩,广泛应用于视频会议、在线教育、视频直播服务等多种场景中。libvpx 的特点包括跨平台兼容性、硬件加速支持以及灵活的接口设计,使其可以轻松集成到各种应用程序中。 libvpx 的安装和配置过程相对简单,用户可以从官方网站下载源代码

PHP原理之内存管理中难懂的几个点

PHP的内存管理, 分为俩大部分, 第一部分是PHP自身的内存管理, 这部分主要的内容就是引用计数, 写时复制, 等等面向应用的层面的管理. 而第二部分就是今天我要介绍的, zend_alloc中描写的关于PHP自身的内存管理, 包括它是如何管理可用内存, 如何分配内存等. 另外, 为什么要写这个呢, 因为之前并没有任何资料来介绍PHP内存管理中使用的策略, 数据结构, 或者算法. 而在我们

Smarty模板执行原理

为了实现程序的业务逻辑和内容表现页面的分离从而提高开发速度,php 引入了模板引擎的概念,php 模板引擎里面最流行的可以说是smarty了,smarty因其功能强大而且速度快而被广大php web开发者所认可。本文将记录一下smarty模板引擎的工作执行原理,算是加深一下理解。 其实所有的模板引擎的工作原理是差不多的,无非就是在php程序里面用正则匹配将模板里面的标签替换为php代码从而将两者