首页 > > 操作系统 > Linux >

大数据系列博客之 --- 深入简出 Shell 脚本语言…

2018-11-06 06:48:24来源：博客园阅读 ()

首先声明，此系列shell系列博客分为四篇发布，分别是：

　　基础篇：https://www.cnblogs.com/lsy131479/p/9914747.html

　　提升篇：https://www.cnblogs.com/lsy131479/p/9914897.html

　　高级篇：https://www.cnblogs.com/lsy131479/p/9914962.html

　　面试篇：

10. Shell工具（重点）

10.1 cut

cut的工作就是“剪”，具体的说就是在文件中负责剪切数据用的。cut 命令从文件的每一行剪切字节、字符和字段并将这些字节、字符和字段输出。

1.基本用法

cut [选项参数]  filename

说明：默认分隔符是制表符

2.选项参数说明

参数表

选项参数	功能
-f	列号，提取第几列
-d	分隔符，按照指定分隔符分割列

3.案例实操

（0）数据准备

[fsdm@hadoop101 datas]$ touch cut.txt
[fsdm@hadoop101 datas]$ vim cut.txt
bei shen
jing zhen
wo  wo
lai  lai
le  le

　　注意：标红部分第三行，第四行，第五行，中间是两个空格第一行，第二行是一个空格

（1）切割cut.txt第一列

[fsdm@hadoop101 datas]$ cut -d " " -f 1 cut.txt 
bei
jing
wo
lai
le

（2）切割cut.txt第二列

[fsdm@hadoop101 datas]$ cut -d " " -f 2,3 cut.txt 
shen
zhen

（3）切割cut.txt第二、三列

[fsdm@hadoop101 datas]$ cut -d " " -f 2,3 cut.txt 
shen
zhen
 wo
 lai
 le

（4）在cut.txt文件中切割出guan

[fsdm@hadoop101 datas]$ cat cut.txt | grep "guan" | cut -d " " -f 1
guan

（5）选取系统PATH变量值，第2个“：”开始后的所有路径：

[fsdm@hadoop101 datas]$ echo $PATH
/usr/lib64/qt-3.3/bin:/usr/local/bin:/bin:/usr/bin:/usr/local/sbin:/usr/sbin:/sbin:/home/fsdm/bin

[fsdm@hadoop102 datas]$ echo $PATH | cut -d: -f 2-
/usr/local/bin:/bin:/usr/bin:/usr/local/sbin:/usr/sbin:/sbin:/home/fsdm/bin

（6）切割ifconfig 后打印的IP地址

[fsdm@hadoop101 datas]$ ifconfig eth0 | grep "inet addr" | cut -d: -f 2 | cut -d" " -f1
192.168.1.102

10.2 sed

sed是一种流编辑器，它一次处理一行内容。处理时，把当前处理的行存储在临时缓冲区中，称为“模式空间”，接着用sed命令处理缓冲区中的内容，处理完成后，把缓冲区的内容送往屏幕。接着处理下一行，这样不断重复，直到文件末尾。文件内容并没有改变，除非你使用重定向存储输出。

1. 基本用法

sed [选项参数]  ‘command’  filename

2. 选项参数说明

参数表

选项参数	功能
-e	直接在指令列模式上进行sed的动作编辑。

3. 命令功能描述

功能描述表

命令	功能描述
a	新增，a的后面可以接字串，在下一行出现
d	删除
s	查找并替换

4. 案例实操

（0）数据准备

[fsdm@hadoop102 datas]$ touch sed.txt
[fsdm@hadoop102 datas]$ vim sed.txt
bei shen
jing zhen
wo  wo
lai  lai

le  le

（1）将“mei nv”这个单词插入到sed.txt第二行下，打印。

[fsdm@hadoop102 datas]$ sed '2a mei nv' sed.txt 
dong shen
guan zhen
mei nv
wo  wo
lai  lai

le  le
[fsdm@hadoop102 datas]$ cat sed.txt 
dong shen
guan zhen
wo  wo
lai  lai

le  le

注意：实际文件内容并没有改变

（2）删除sed.txt文件所有包含wo的行

[fsdm@hadoop102 datas]$ sed '/wo/d' sed.txt
dong shen
guan zhen
lai  lai

le  le

（3）将sed.txt文件中wo替换为ni

[fsdm@hadoop102 datas]$ sed 's/wo/ni/g' sed.txt 
dong shen
guan zhen
ni  ni
lai  lai

le  le

注意：‘g’表示global，全部替换的意思

（4）将sed.txt文件中的第二行删除并将wo替换为ni

[fsdm@hadoop102 datas]$ sed -e '2d' -e 's/wo/ni/g' sed.txt 
dong shen
ni  ni
lai  lai

le  le

10.3 awk

一个强大的文本分析工具，把文件逐行的读入，以空格为默认分隔符将每行切片，切开的部分再进行分析处理。

1. 基本用法

awk [选项参数] ‘pattern1{action1}  pattern2{action2}...’ filename

pattern：表示AWK在数据中查找的内容，就是匹配模式

action：在找到匹配内容时所执行的一系列命令

2. 选项参数说明

参数表

选项参数	功能
-F	指定输入文件折分隔符
-v	赋值一个用户定义变量

3. 案例实操

（0）数据准备

[fsdm@hadoop102 datas]$ sudo cp /etc/passwd ./

（1）搜索passwd文件以root关键字开头的所有行，并输出该行的第7列。

[fsdm@hadoop102 datas]$ awk -F: '/^root/{print $7}' passwd 
/bin/bash

（2）搜索passwd文件以root关键字开头的所有行，并输出该行的第1列和第7列，中间以“，”号分割。

[fsdm@hadoop102 datas]$ awk -F: '/^root/{print $1","$7}' passwd 
root,/bin/bash

注意：只有匹配了pattern的行才会执行action

（3）只显示/etc/passwd的第一列和第七列，以逗号分割，且在所有行前面添加列名user，shell在最后一行添加"dahaige，/bin/zuishuai"。

[fsdm@hadoop102 datas]$ awk -F : 'BEGIN{print "user, shell"} {print $1","$7} END{print "dahaige,/bin/zuishuai"}' passwd
user, shell
root,/bin/bash
bin,/sbin/nologin
。。。
fsdm,/bin/bash
dahaige,/bin/zuishuai

注意：BEGIN 在所有数据读取行之前执行；END 在所有数据执行之后执行。

（4）将passwd文件中的用户id增加数值1并输出

[fsdm@hadoop102 datas]$ awk -v i=1 -F: '{print $3+i}' passwd
1
2
3
4

4. awk的内置变量

变量表

变量	说明
FILENAME	文件名
NR	已读的记录数
NF	浏览记录的域的个数（切割后，列的个数）

5. 案例实操

（1）统计passwd文件名，每行的行号，每行的列数

[fsdm@hadoop102 datas]$ awk -F: '{print "filename:"  FILENAME ", linenumber:" NR  ",columns:" NF}' passwd 
filename:passwd, linenumber:1,columns:7
filename:passwd, linenumber:2,columns:7
filename:passwd, linenumber:3,columns:7

（2）切割IP

[fsdm@hadoop102 datas]$ ifconfig eth0 | grep "inet addr" | awk -F: '{print $2}' | awk -F " " '{print $1}' 
192.168.1.102

（3）查询sed.txt中空行所在的行号

[fsdm@hadoop102 datas]$ awk '/^$/{print NR}' sed.txt 
5

10.4 sort

sort命令是在Linux里非常有用，它将文件进行排序，并将排序结果标准输出。

1. 基本语法

sort(选项)(参数)

参数表

选项	说明
-n	依照数值的大小排序
-r	以相反的顺序来排序
-t	设置排序时所用的分隔字符
-k	指定需要排序的列

参数：指定待排序的文件列表

2. 案例实操

（0）数据准备

[fsdm@hadoop102 datas]$ touch sort.sh
[fsdm@hadoop102 datas]$ vim sort.sh 
bb:40:5.4
hehe:20:4.2
haha:50:2.3
heihei:10:3.5
ss:30:1.6

（1）按照“：”分割后的第三列倒序排序。

[fsdm@hadoop102 datas]$ sort -t : -nrk 3  sort.sh 
bb:40:5.4
hehe:20:4.2
heihei:10:3.5
haha:50:2.3
ss:30:1.6

高级篇结束，如需深入请阅读后续篇章，如有疑问私信或评论指出

标签：

版权申明：本站文章部分自网络，如有侵权，请联系：west999com@outlook.com
特别注意：本站所有转载文章言论不代表本站观点，本站所提供的摄影照片，插画，设计作品，如需使用，请与原作者联系，版权归原作者所有

上一篇：大数据系列博客之 --- 深入简出 Shell 脚本语言（提升篇）

下一篇：linux rar 解压忽略带密码压缩包

IDC资讯：主机资讯注册资讯托管资讯 vps资讯网站建设

网站运营：建站经验策划盈利搜索优化网站推广免费资源

网站联盟：联盟新闻联盟介绍联盟点评网赚技巧

行业资讯：搜索引擎网络游戏电子商务广告传媒

网络编程： Asp.Net编程 Asp编程 Php编程 Xml编程 Access Mssql Mysql 其它

服务器技术： Web服务器 Ftp服务器 Mail服务器 Dns服务器安全防护

软件技巧：其它软件 Word Excel Powerpoint Ghost Vista QQ空间 QQ FlashGet 迅雷

网页制作： FrontPages Dreamweaver Javascript css photoshop fireworks Flash

程序设计： Java技术 C/C++ VB delphi

网络知识：网络协议网络安全网络管理组网方案 Cisco技术

操作系统： Win2000 WinXP Win2003 Mac OS Linux FreeBSD

热门词条

最新资讯

热门关注

热门标签