生啃“编译原理”(一)——引论

2024-08-23 01:58
文章标签 编译 原理 引论

本文主要是介绍生啃“编译原理”(一)——引论,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

开篇:

        做为软件工程专业的一员,在本科时候,关于《编译原理》这门课,没有开,没有开,没有开。。。只能通过自己学习来深入了解编译原理。并希望能够达到实现一个简单编译器的地步。


  • 1 语言处理器

   关于语言处理器,其本身就是一个大程序,而这个大程序的主要目的在于翻译源程序。

   以Java为例,有时候,我们可能会有疑问,当写完一段或复杂或简单的业务逻辑程序之后,计算机是如何去执行这段源程序的?

   这时候,就需要语言处理器去将源程序翻译为目标机器代码供计算机执行。在计算机诞生之初,机器代码过于晦涩难懂,不易理解和上手使用,所以诞生了更接近人类自然语言的高级程序设计语言(早期的Fortran和C),那么问题就来了,计算机并不能读懂这些高级程序设计语言,或者说,计算机并不能理解这些高级程序设计语言的语法和语义。因此就需要语言处理器去翻译和处理,并在最后执行这些源程序。

  语言处理器总体上分为两类:编译器和解释器  

  •    编译器:本身编译器即为一个程序,只将源程序翻译成机器可以理解的目标机器代码,同时收集与源程序相关的变量信息存放于指定位置供后续翻译使用,而这个指定位置叫做符号表,翻译完毕之后,编译器会将目标机器代码作为输出,供后续使用。整个翻译的过程较为复杂,这里只做总体认识。
  •    解释器:解释器相比于编译器,有一个很大的不同之处就在于,他并不像编译器那样对源程序进行翻译,而是直接将源程序配合用户的输入通过解释器去一步步执行源程序,并直接产生结果输出。
  •    两者的优劣:从上述对比其实可以发现,编译器并不执行源程序,仅仅是一个翻译的过程,所以从速度上来说,编译器会快于解释器,但是相反,由于解释器会直接执行源程序,所以在执行过程中,对源程序的语义和语法的检查将比编译器更加精确。

    而在实际生产环境中,源程序往往是分布于各个独立的文件之中,这些独立的文件需要经过一个叫做“聚合”的阶段,才能进行下一步的编译操作。而负责聚合操作的对象,叫做所谓的预处理器。而预处理器的聚合操作仅仅是语言处理系统的第一步。

预处理器的主要作用就是对源程序进行聚合操作,得到聚合源程序后,再又汇编器生成目标汇编程序,汇编程序再又汇编器生成可重定位的机器代码(因为大型程序都是通过多部分各自编译的方式进行的),最后利用链接器将可重定位的机器代码与库文件及可重定位对象文件进行链接,并交由加载器将最终得到的机器代码放置内存中运行。

这里需要强调几个概念:

  • 汇编器:由于汇编程序易于输出和调试,因此在大型程序中会首选汇编器将源程序先翻译成汇编语言。汇编器也是编译器的一种。
  • 链接器:由于大型程序会被分成多个部分进行编译,因此生成的机器代码必须是可重定向的,因为后续需要将其与库文件和可重定向的其他目标文件链接到一起。
  • 加载器:负责将所有的可执行的目标文件放到内存中执行。

  • 2 编译器结构
在上一节中提到,编译器最主要的作用是翻译程序,那么编译器里面的结构到底是怎么样的?
       首先,编译器其实可以分为两部分:分析部分(前端)和综合部分(后端)。
       分析部分:分析部分会将源程序分解为多个组成要素,并在组成要素上语法结构,并用这个结构来创建一个中间表示,同时提供语义上的检查信息。此外,分析部分还会收集有关源程序的信息,并把信息存放于符号表中。最后分析部分将符号表和中间表示形式一并传给综合部分。
      综合部分:根据分析部分传入的符号表和中间表示形式创建用户期待的目标程序。
如果更详细的研究一下编译过程,实际上编译器是顺序地执行了一组步骤。每个步骤把源程序从一种表示转化成另一种表示。

1.词法分析:将源程序转化成字符流,并组织成有意义的词素序列,对于每个词素,词法分析会产生词法单元。
2.语法分析:利用词法单元的第一个分量创建树形的中间表示。常用的中间表示是语法树
3.语义分析:在上一阶段得到语法树之后,需要结合符号表中的信息来检查源程序是否和语言定义的语义保持一致。
4.中间代码生成器:一个编译器可能构造出一个或多个中间表示。语法树就是其中之一,而且语法树通常在语法分析和语义分析中使用,在语法分析和语义分析完成之后,编译器会生成一个明确的低级的或者类机器语言中间表示。这个中间表示应该易于生成且能够被轻松地翻译为目标机器上的语言。
5.机器无关代码优化器:机器无关的代码优化目的在于改进中间代码以便生成更好的目标代码。
6.代码生成器:以源程序的中间表示作为输入,并把它们映射到目标语言。如果目标语言是机器代码,则必须为程序使用的每个变量选择寄存器或者内存位置。而代码生成的至关重要的一个方面就是合理分配寄存器以存放变量值。
7.机器相关代码优化器:机器相关代码优化,其操作内容与5相似,后续将做介绍。
  • 3 程序设计语言发展
以下仅介绍三种分类方式。
   第一种:按语言的代来分代。
第一代:机器语言
第二代:汇编语言
第三代:Fortran,C,Cobol,C++,C#,Java等高级程序设计语言
第四代:SQL,PostScript等特定应用设计的语言
第五代:基于逻辑和约束的语言,比如OPS5
   第二种:按照程序完成计算任务的方式划分。
强制式:指明如何完成一个计算任务,C++,C#,Java
声明式:要进行哪些计算,Haskell
   第三种:按照术语划分。
冯诺依曼语言:以冯诺依曼计算机体系结构为计算模型的程序设计语言。如C
面向对象语言:C++,C#,Java
脚本语言:Awk,JavaScript,PHP,Python

这篇关于生啃“编译原理”(一)——引论的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1098030

相关文章

Java中流式并行操作parallelStream的原理和使用方法

《Java中流式并行操作parallelStream的原理和使用方法》本文详细介绍了Java中的并行流(parallelStream)的原理、正确使用方法以及在实际业务中的应用案例,并指出在使用并行流... 目录Java中流式并行操作parallelStream0. 问题的产生1. 什么是parallelS

Java中Redisson 的原理深度解析

《Java中Redisson的原理深度解析》Redisson是一个高性能的Redis客户端,它通过将Redis数据结构映射为Java对象和分布式对象,实现了在Java应用中方便地使用Redis,本文... 目录前言一、核心设计理念二、核心架构与通信层1. 基于 Netty 的异步非阻塞通信2. 编解码器三、

Java HashMap的底层实现原理深度解析

《JavaHashMap的底层实现原理深度解析》HashMap基于数组+链表+红黑树结构,通过哈希算法和扩容机制优化性能,负载因子与树化阈值平衡效率,是Java开发必备的高效数据结构,本文给大家介绍... 目录一、概述:HashMap的宏观结构二、核心数据结构解析1. 数组(桶数组)2. 链表节点(Node

Redis中Hash从使用过程到原理说明

《Redis中Hash从使用过程到原理说明》RedisHash结构用于存储字段-值对,适合对象数据,支持HSET、HGET等命令,采用ziplist或hashtable编码,通过渐进式rehash优化... 目录一、开篇:Hash就像超市的货架二、Hash的基本使用1. 常用命令示例2. Java操作示例三

Redis中Set结构使用过程与原理说明

《Redis中Set结构使用过程与原理说明》本文解析了RedisSet数据结构,涵盖其基本操作(如添加、查找)、集合运算(交并差)、底层实现(intset与hashtable自动切换机制)、典型应用场... 目录开篇:从购物车到Redis Set一、Redis Set的基本操作1.1 编程常用命令1.2 集

Redis中的有序集合zset从使用到原理分析

《Redis中的有序集合zset从使用到原理分析》Redis有序集合(zset)是字符串与分值的有序映射,通过跳跃表和哈希表结合实现高效有序性管理,适用于排行榜、延迟队列等场景,其时间复杂度低,内存占... 目录开篇:排行榜背后的秘密一、zset的基本使用1.1 常用命令1.2 Java客户端示例二、zse

Redis中的AOF原理及分析

《Redis中的AOF原理及分析》Redis的AOF通过记录所有写操作命令实现持久化,支持always/everysec/no三种同步策略,重写机制优化文件体积,与RDB结合可平衡数据安全与恢复效率... 目录开篇:从日记本到AOF一、AOF的基本执行流程1. 命令执行与记录2. AOF重写机制二、AOF的

java程序远程debug原理与配置全过程

《java程序远程debug原理与配置全过程》文章介绍了Java远程调试的JPDA体系,包含JVMTI监控JVM、JDWP传输调试命令、JDI提供调试接口,通过-Xdebug、-Xrunjdwp参数配... 目录背景组成模块间联系IBM对三个模块的详细介绍编程使用总结背景日常工作中,每个程序员都会遇到bu

Python中isinstance()函数原理解释及详细用法示例

《Python中isinstance()函数原理解释及详细用法示例》isinstance()是Python内置的一个非常有用的函数,用于检查一个对象是否属于指定的类型或类型元组中的某一个类型,它是Py... 目录python中isinstance()函数原理解释及详细用法指南一、isinstance()函数

java 恺撒加密/解密实现原理(附带源码)

《java恺撒加密/解密实现原理(附带源码)》本文介绍Java实现恺撒加密与解密,通过固定位移量对字母进行循环替换,保留大小写及非字母字符,由于其实现简单、易于理解,恺撒加密常被用作学习加密算法的入... 目录Java 恺撒加密/解密实现1. 项目背景与介绍2. 相关知识2.1 恺撒加密算法原理2.2 Ja