shell中字符串的截取方法、cut基本用法

2024-04-02 08:32

本文主要是介绍shell中字符串的截取方法、cut基本用法,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

一、八种基本字符截取方法:
1、使用 # 号操作符。从左边删除第一次出现 substr 左边字符(包括substr ),保留右边字符。
用法为 #*substr
例如:



即删除从左边开始到第一个"//"及其左边所有字符
2、使用 ## 号操作符。从左边删除最后一次出现substr 左边字符(包括substr ),保留右边字符。
用法为 ##*subst
例如:



即删除最后出现的"/"及其左边所有字符
3、使用 % 号操作符。从右边删除第一次出现 substr 右边字符(包括substr ),保留左边字符。
用法为 %substr
例如:



即删除从右边开始到第一个"/"及其右边所有字符
4、使用 %% 号操作符。从右边删除最后一次出现 substr 右边字符(包括substr ),保留左边字符。
用法为 %%substr*
例如:



即删除从右边开始到最后一个"/"及其右边所有字符
5、从左边第几个字符开始以及字符的个数
用法为 :start:len
例如:



即 0 表示左边第一个字符开始,5 表示字符的总个数。
6、从左边第几个字符开始一直到结束
用法为 :start
例如:



即 7 表示左边第8个字符开始
7、从右边第几个字符开始以及字符的个数
用法为 :0-start:len
例如:



即 0-10 表示右边算起第10个字符开始,6 表示字符的个数。
8、从右边第几个字符开始一直到结束
用法为 :0-start
例如:



即 0-4 表示右边算起第4个字符开始。

二、使用 cut 进行字符串截取
cut 命令接受三个定位方法:
1、字节(bytes),用选项-b;
2、字符(characters),用选项-c;
3、域(fields),用选项-f。

三、字节 -b 的使用
(1) 以“字节”定位
例如:
如果我们想提取每一行的第3个字节,就这样:





注:-b后面可以设定要提取哪一个字节,其实-b和3之间没有空格也是可以的,但推荐有空格 :)

(2) 如果“字节”定位中,我想提取第3,第4、第5和第12个字节
-b支持形如3-5的写法,而且多个定位之间用逗号隔开就成了。
例如:





但有一点要 注意,cut命令如果使用了-b选项,那么执行此命令时,cut会先把-b后面所有的定位进行从小到大排序,然后再提取。可不能颠倒定位的顺序哦。
例如:




(3)类似于“3-5”这样的小技巧
例如:





注:-3表示从第一个字节到第三个字节,而3-表示从第三个字节到行尾。可以看到这两种情况下,都包括了第三个字节“e”。如果执行who|cut -b -3,3-,是输出整行,而不会出现连续两个重叠的e的。

四、字符 -c 的使用
例如:





但是,-c 和 -b 怎么没有区别呢? 其实不然,只是因为这个例子举的不好,所以看不出来,who 输出的都是单字节字符,所以用-b和-c没有区别,如果提取中文,区别就出来了。
例如:





如上,用 -c 则会以字符为单位,输出正常;而 -b 只会以字节(8位二进制位)来计算,输出就是乱码。当遇到多字节字符时,可以使用 -n 选项,-n 用于告诉 cut 不要将多字节字符拆开。
例如:






五、域 -f 是怎么回事呢?
(1)为什么会有“域”的提取呢,因为刚才提到的 -b 和 -c 只能在固定格式的文档中提取信息,而对于非固定格式的信息则束手无策,而“域”可以。
比如/etc/passwd文件,它并不像 who 的输出信息那样具有固定格式,而是比较零散的排放。但是,冒号在这个文件的每一行中都起到了非常重要的作用,冒号用来隔开每一个项。
cut命令提供了这样的提取方式,具体的说就是设置“间隔符”,再设置“提取第几个域”,就OK了。
例如(/etc/passwd的前五行内容):





用 -d 设置间隔符为冒号:,然后用 -f 设置要取的是第一个域。
(2)在设定 -f 时,也可以使用 3-5 或者 4- 类似的格式:






(3)如果遇到空格和制表符时,怎么办?
有时候制表符确实很难辨认,有一个方法可以看出一段空格到底是由若干个空格组成的还是由一个制表符组成的。





如果是制表符(TAB),那么会显示为 /t 符号,如果是空格,就会原样显示。通过此方法就可以判断制表符和空格了。
应该在cut -d中用什么符号来设定制表符或空格呢?其实,cut 的 -d 选项的默认间隔符就是制表符/t,所以当你就是要使用制表符的时候,完全就可以省略-d选项,而直接用-f来取域就可以了。
例如:



这篇关于shell中字符串的截取方法、cut基本用法的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/869486

相关文章

PyTorch核心方法之state_dict()、parameters()参数打印与应用案例

《PyTorch核心方法之state_dict()、parameters()参数打印与应用案例》PyTorch是一个流行的开源深度学习框架,提供了灵活且高效的方式来训练和部署神经网络,这篇文章主要介绍... 目录前言模型案例A. state_dict()方法验证B. parameters()C. 模型结构冻

Python字符串处理方法超全攻略

《Python字符串处理方法超全攻略》字符串可以看作多个字符的按照先后顺序组合,相当于就是序列结构,意味着可以对它进行遍历、切片,:本文主要介绍Python字符串处理方法的相关资料,文中通过代码介... 目录一、基础知识:字符串的“不可变”特性与创建方式二、常用操作:80%场景的“万能工具箱”三、格式化方法

springboot+redis实现订单过期(超时取消)功能的方法详解

《springboot+redis实现订单过期(超时取消)功能的方法详解》在SpringBoot中使用Redis实现订单过期(超时取消)功能,有多种成熟方案,本文为大家整理了几个详细方法,文中的示例代... 目录一、Redis键过期回调方案(推荐)1. 配置Redis监听器2. 监听键过期事件3. Redi

基于SpringBoot实现分布式锁的三种方法

《基于SpringBoot实现分布式锁的三种方法》这篇文章主要为大家详细介绍了基于SpringBoot实现分布式锁的三种方法,文中的示例代码讲解详细,感兴趣的小伙伴可以跟随小编一起学习一下... 目录一、基于Redis原生命令实现分布式锁1. 基础版Redis分布式锁2. 可重入锁实现二、使用Redisso

浅析python如何去掉字符串中最后一个字符

《浅析python如何去掉字符串中最后一个字符》在Python中,字符串是不可变对象,因此无法直接修改原字符串,但可以通过生成新字符串的方式去掉最后一个字符,本文整理了三种高效方法,希望对大家有所帮助... 目录方法1:切片操作(最推荐)方法2:长度计算索引方法3:拼接剩余字符(不推荐,仅作演示)关键注意事

自定义注解SpringBoot防重复提交AOP方法详解

《自定义注解SpringBoot防重复提交AOP方法详解》该文章描述了一个防止重复提交的流程,通过HttpServletRequest对象获取请求信息,生成唯一标识,使用Redis分布式锁判断请求是否... 目录防重复提交流程引入依赖properties配置自定义注解切面Redis工具类controller

python版本切换工具pyenv的安装及用法

《python版本切换工具pyenv的安装及用法》Pyenv是管理Python版本的最佳工具之一,特别适合开发者和需要切换多个Python版本的用户,:本文主要介绍python版本切换工具pyen... 目录Pyenv 是什么?安装 Pyenv(MACOS)使用 Homebrew:配置 shell(zsh

Java中的CompletableFuture核心用法和常见场景

《Java中的CompletableFuture核心用法和常见场景》CompletableFuture是Java8引入的强大的异步编程工具,支持链式异步编程、组合、异常处理和回调,介绍其核心用法,通过... 目录1、引言2. 基本概念3. 创建 CompletableFuture3.1. 手动创建3.2.

Java调用DeepSeek API的8个高频坑与解决方法

《Java调用DeepSeekAPI的8个高频坑与解决方法》现在大模型开发特别火,DeepSeek因为中文理解好、反应快、还便宜,不少Java开发者都用它,本文整理了最常踩的8个坑,希望对... 目录引言一、坑 1:Token 过期未处理,鉴权异常引发服务中断问题本质典型错误代码解决方案:实现 Token

Nginx 访问控制的多种方法

《Nginx访问控制的多种方法》本文系统介绍了Nginx实现Web访问控制的多种方法,包括IP黑白名单、路径/方法/参数控制、HTTP基本认证、防盗链机制、客户端证书校验、限速限流、地理位置控制等基... 目录一、IP 白名单与黑名单1. 允许/拒绝指定IP2. 全局黑名单二、基于路径、方法、参数的访问控制