【Linux取经路】探寻shell的实现原理

2024-02-07 12:52

本文主要是介绍【Linux取经路】探寻shell的实现原理,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

在这里插入图片描述

文章目录

  • 一、打印命令行提示符
  • 二、读取键盘输入的指令
  • 三、指令切割
  • 四、普通命令的执行
  • 五、内建指令执行
    • 5.1 cd指令
    • 5.2 export指令
    • 5.3 echo指令
  • 六、结语

一、打印命令行提示符

const char* getusername() // 获取用户名
{return getenv("USER");
}const char* gethostname() // 获取主机名
{return getenv("HOSTNAME");
}const char* getpwd() // 获取当前所处的目录
{char* pos = strrchr(getenv("PWD"), '/'); // 查找最后一个 ‘/’ if(*(pos+1) != '\0') return pos+1; // 说明不是根目录,返回最后一个文件夹return pos;
}void tooltip() // 打印命令行提示框
{printf(LEFT "%s@%s %s" RIGHT PROMPT" ", getusername(), gethostname(), getpwd());
}

在这里插入图片描述
代码分析:获取基础信息本质上是通过调用 getenv 接口来获取对应环境变量的值。借助 strrchr 函数来查找当前路径中的最后一个文件分隔符 /,它有可能是文件分隔符也有可能是根目录因此要单独判断。

二、读取键盘输入的指令

char command[1024]; // 存储键盘输入的指令int getcommand(char* command, int size) // 读取指令
{memset(command, '\0', size);char* ret = fgets(command, size, stdin); // 这里 ret 一定不为空,因为至少会输入一个回车,fgets 可以读取回车assert(ret != NULL);(void)ret;// “假装使用一下ret,防止有些编译器警告”// aaabc\n\0command[strlen(command)-1] = '\0'; // 去掉结尾的 \nreturn 1;
}int interact(char* command, int size) // 交互
{tooltip();while(getcommand(command, size) && (strlen(command) == 0)){tooltip();}
}int main()
{interact(command, sizeof(command)); // 交互printf("echo: %s\n", command);return 0;
}

在这里插入图片描述
代码分析:键盘输入的指令本质上就是一串字符串,这里不能用 scanf 来获取字符串,因为 scanf 是不会读取空格和回车的(遇到空格和回车就停止读取),而我们一般的指令都是带选项的,指令和选项之间一般会用空格隔开,用 scanf 会导致我们指令读不全。这里使用 fgets 函数来读取键盘输入,其第一参数是存储指令的空间的首地址;第二个参数是空间的大小;第三个参数是从哪个文件流中读取,一个 C/C++ 程序默认会打开三个文件流 stdinstdoutstderr,这里选择从 stdin 中读取,也就是从标准输入中读取。gets 函数会在结尾自动帮我们添加 \0,并且当读取的字符个数大于存储容量时,该函数会自动在结尾放 \0,因此我们可以不用考虑为 \0 预留空间或者认为的在字符串结尾加 \0。其次该函数读取成功返回 command 的首地址,否则返回 NULL,在当前场景下,除非读取错误,否则至少都会读入一个 \n,一般我们输入完指令就是敲回车,什么指令不输也敲回车,因此正常情况下 ret 不可能为 NULL。这里还要考虑删除掉读取到的 \n,因为我们不需要它,我们只要完整的指令。

三、指令切割

#define SEPARATOR " " // 指令分隔符
char* argv[ARGC_LONG] = {NULL}; // 存储指令和选项的起始地址void commandcut(char* command, char** argv, int argvsize) // 指令切割
{memset(argv, 0, argvsize); // 清空char cop_command[COMMAND_LONG] = {'\0'}; // 保证 command 串不被改变for(int i = 0; command[i] != '\0'; i++){cop_command[i] = command[i];}// 开始切割子串char* ret = strtok(cop_command, SEPARATOR);int i = 0;while(ret != NULL){argv[i++] = ret;ret = strtok(NULL, " ");}
}int main()
{while(1){// 1、交互获取命令行参数interact(command, sizeof(command)); // 交互// 到这里说明指令已经获取到了,接下来将指令打散// 2、指令切割commandcut(command, argv, sizeof(argv));for(int i = 0; argv[i]; i++){printf("[%d]: %s\n", i, argv[i]);}printf("echo: %s\n", command);}return 0;
}

在这里插入图片描述

代码分析:这一步主要是借助 strtok 函数将获取到的指令切割成一个一个的子串,将所有子串的起始地址存储在 argv 里面。注意 strtok 函数会改变原空间的内容,因此创建了一段临时的空间 cop_command

四、普通命令的执行

void normalcommandexecution(char** _argv, int* _lastcode) // 普通命令的执行
{pid_t id = fork();if(id < 0){perror("fork");}else if(id == 0){// childint ret = execvp(_argv[0], _argv);if(ret == -1){perror("exeecp");exit(EXIT_CODE);}}else{// fatherint status;pid_t ret = waitpid(id, &status, 0); // 阻塞等待if(ret == id){*_lastcode = WEXITSTATUS(status);}}
}int main()
{while(1){// 1、交互获取命令行参数interact(command, sizeof(command)); // 交互// 到这里说明指令已经获取到了,接下来将指令打散// 2、指令切割commandcut(command, argv, sizeof(argv));// 3、普通命令执行normalcommandexecution(argv, &lastcode);}return 0;
}

在这里插入图片描述
代码分析:对于 ls 这种普通指令(非内建指令),先通过 fork 创建子进程,然后再调用 execvp 接口进行程序替换,去执行输入的指令。

五、内建指令执行

5.1 cd指令

bool isnormalcommand(char **_argv) // 指令判断
{if (strcmp(_argv[0], "cd") == 0)return false;return true;
}void changpwd(char** _argv) // 更改当前工作目录
{chdir(_argv[1]); // 更改当前工作目录// getpwd(pwd, sizeof(pwd));sprintf(getenv("PWD"), "%s", getcwd(pwd, sizeof(pwd))); // 修改环境变量
}void builtincommand(char **_argv) // 内建命令执行
{if (strcmp(_argv[0], "cd") == 0){changpwd(_argv);}
}int main()
{while (1){// 1、交互获取命令行参数interact(command, sizeof(command)); // 交互// 到这里说明指令已经获取到了,接下来将指令打散// 2、指令切割commandcut(command, argv, sizeof(argv));// 3、指令判断// 3、普通命令执行if (isnormalcommand(argv)) // 普通指令normalcommandexecution(argv, &lastcode);else // 内建指令builtincommand(argv);}return 0;
}

在这里插入图片描述

代码分析:要考虑内建指令,那在指令切割之后要先对指令进行判断。内建指令不需要创建子进程去执行,而是直接由当前的 bash 进程去执行。比如说 cd 指令,执行完 cd 指令后,我们要让当前的 bash 更改工作目录,而不是让其创建子进程去执行 cd 指令,那样改变的就是子进程的工作目录。可以发现,一个指令执行完后,如果会对 bash 产生影响,那么它就必须是内建指令。其次关于 cd 指令,它改变了当前的工作目录,这一点该如何理解呢?我 myshell 就是一个可执行程序,我的源代码和编译得到的可执行文件始终都放在 /home/wcy/linux-s/2023-10-28a/myshell 目录下,你 cd 命令凭什么能改变我的工作目录?其实并不然,这里改变工作目录是:一个可执行程序在变成进程产生 PCB 对象后,PCB 里面维护了一个属性就叫做当前可执行程序的工作目录,cd 指令改变的其实就是这一属性,并不是改变 myshell 程序的存储位置,我们通过调用 chdir 系统调用来修改这一属性。最后,因为我们前面是通过环境变量来获取当前工作目录,而环境变量在被当前 myshell 进程从父进程继承下来后是不会自动发生改变的,因此在执行完 cd 指令后,我们要对 PWD 环境变量进行修改,环境变量本质上就是存储在内存中的一段字符串信息,因此我们可以采用 sprintf 函数对该字符串信息进行修改。

在这里插入图片描述

5.2 export指令

#define USER_ENV_SIZE 100  // 允许用户添加的环境变量个数
#define USER_ENV_LONG 1024 // 用户一个环境变量的最大长度char userenv[USER_ENV_SIZE][USER_ENV_LONG]; // 保存用户添加的环境变量
int userenvnum = 0;                         // 当前用户输入的环境变量个数void exportcommand(char** _argv, char(*_userenv)[USER_ENV_LONG], int* _userenvnum)
{// 将用户输入的环境变量存储起来strcpy(_userenv[*_userenvnum], _argv[1]);int ret = putenv(_userenv[(*_userenvnum)++]);if (ret == 0)perror("putenv");
}

在这里插入图片描述
代码分析:只要 bash 不退出,我们每次添加的环境变量都应该被保存起来,我们输入的环境变量是被当做指令保存在 command 里面,当下一次输入指令,上一次输入的内容就会被清空。putenv 添加环境变量,并不是把对应的字符串拷贝到系统的表当中,而是把该字符串的地址保存在系统的表中,因此我们要确保保存环境变量字符串的那个地址里的环境变量不会被修改,所以我们需要为用户输入的环境变量,也就是那一串字符串单独开辟一块空间进行存储,保证在内次重新输入指令的时候,不会影响到之前用户添加的环境变量。因为环境变量本质就是一个字符串,所以这里我们定义了一个字符二维数组来存储用户输入的环境变量,先把用户输入的环境变量存入我们定义的这个数组,然后再调用 putenv 函数将数组中的内容添加到当前的环境变量。这样就可以保证只要当前 bash 不退出,用户历史上添加的环境变量都在。这里涉及到二维数组传参的问题,再来回顾一下,数组名表示首元素地址,二维数组的首元素是一个一维数组,所以函数形参的类型是一个字符一维数组的地址,也就是 char(*)[USER_ENV_LONG]

5.3 echo指令

void echocommand(char **_argv, int _argc)
{if (_argv[1][0] == '$'){char *ptr = _argv[1] + 1;printf("%s\n", getenv(ptr));}else{int i = 1;while (i < _argc){char *ret = strtok(_argv[i], "\"");while (ret != NULL){printf("%s", ret);ret = strtok(NULL, "\"");}printf("%c", ' ');i++;}printf("\n");}
}

在这里插入图片描述
代码分析echo 指令需要考虑将输入的 " 去掉,其次可能连续输入多个字符串,还要考虑 echo$ 配合使用是去打印环境变量的值。

小结:当我们登陆的时候,系统就是要启动一个 shell 进程,我们 shell 本身的环境变量是在用户登录的时候,shell 会读取用户目录下的 .bash_profile 文件,里面保存了导入环境变量的方式。

在这里插入图片描述
在这里插入图片描述

六、结语

今天的分享到这里就结束啦!如果觉得文章还不错的话,可以三连支持一下,春人的主页还有很多有趣的文章,欢迎小伙伴们前去点评,您的支持就是春人前进的动力!

在这里插入图片描述

这篇关于【Linux取经路】探寻shell的实现原理的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/687798

相关文章

mybatis执行insert返回id实现详解

《mybatis执行insert返回id实现详解》MyBatis插入操作默认返回受影响行数,需通过useGeneratedKeys+keyProperty或selectKey获取主键ID,确保主键为自... 目录 两种方式获取自增 ID:1. ​​useGeneratedKeys+keyProperty(推

Spring Boot集成Druid实现数据源管理与监控的详细步骤

《SpringBoot集成Druid实现数据源管理与监控的详细步骤》本文介绍如何在SpringBoot项目中集成Druid数据库连接池,包括环境搭建、Maven依赖配置、SpringBoot配置文件... 目录1. 引言1.1 环境准备1.2 Druid介绍2. 配置Druid连接池3. 查看Druid监控

Linux在线解压jar包的实现方式

《Linux在线解压jar包的实现方式》:本文主要介绍Linux在线解压jar包的实现方式,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录linux在线解压jar包解压 jar包的步骤总结Linux在线解压jar包在 Centos 中解压 jar 包可以使用 u

linux解压缩 xxx.jar文件进行内部操作过程

《linux解压缩xxx.jar文件进行内部操作过程》:本文主要介绍linux解压缩xxx.jar文件进行内部操作,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录一、解压文件二、压缩文件总结一、解压文件1、把 xxx.jar 文件放在服务器上,并进入当前目录#

Linux系统性能检测命令详解

《Linux系统性能检测命令详解》本文介绍了Linux系统常用的监控命令(如top、vmstat、iostat、htop等)及其参数功能,涵盖进程状态、内存使用、磁盘I/O、系统负载等多维度资源监控,... 目录toppsuptimevmstatIOStatiotopslabtophtopdstatnmon

c++ 类成员变量默认初始值的实现

《c++类成员变量默认初始值的实现》本文主要介绍了c++类成员变量默认初始值,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起学习学习吧... 目录C++类成员变量初始化c++类的变量的初始化在C++中,如果使用类成员变量时未给定其初始值,那么它将被

Qt使用QSqlDatabase连接MySQL实现增删改查功能

《Qt使用QSqlDatabase连接MySQL实现增删改查功能》这篇文章主要为大家详细介绍了Qt如何使用QSqlDatabase连接MySQL实现增删改查功能,文中的示例代码讲解详细,感兴趣的小伙伴... 目录一、创建数据表二、连接mysql数据库三、封装成一个完整的轻量级 ORM 风格类3.1 表结构

基于Python实现一个图片拆分工具

《基于Python实现一个图片拆分工具》这篇文章主要为大家详细介绍了如何基于Python实现一个图片拆分工具,可以根据需要的行数和列数进行拆分,感兴趣的小伙伴可以跟随小编一起学习一下... 简单介绍先自己选择输入的图片,默认是输出到项目文件夹中,可以自己选择其他的文件夹,选择需要拆分的行数和列数,可以通过

Python中将嵌套列表扁平化的多种实现方法

《Python中将嵌套列表扁平化的多种实现方法》在Python编程中,我们常常会遇到需要将嵌套列表(即列表中包含列表)转换为一个一维的扁平列表的需求,本文将给大家介绍了多种实现这一目标的方法,需要的朋... 目录python中将嵌套列表扁平化的方法技术背景实现步骤1. 使用嵌套列表推导式2. 使用itert

Python使用pip工具实现包自动更新的多种方法

《Python使用pip工具实现包自动更新的多种方法》本文深入探讨了使用Python的pip工具实现包自动更新的各种方法和技术,我们将从基础概念开始,逐步介绍手动更新方法、自动化脚本编写、结合CI/C... 目录1. 背景介绍1.1 目的和范围1.2 预期读者1.3 文档结构概述1.4 术语表1.4.1 核