awk概述

AWK是一种处理文本文件的语言，是一个强大的文本分析工具。

它是专门为文本处理设计的编程语言，也是行处理软件，通常用于扫描、过滤、统计汇总工作数据可以来自标准输入也可以是管道或文件

awk工作原理

工作原理（1）:

当读到第一行时，匹配条件，然后执行指定动作，再接着读取第二行数据处理，不会默认输出

如果没有定义匹配条件默认是匹配所有数据行，awk隐含循环，条件匹配多少次动作就会执行多少次

工作原理（2）:

逐行读取文本，默认以空格或tab键为分隔符进行分隔，将分隔所得的各个字段保存到内建变量中，并按模式或者条件执行编辑命令。

sed命令常用于一整行的处理，而awk比较倾向于将一行分成多个""字段"然后再进行处理。awk信息的读入也是逐行读取的，执行结果可以通过print的功能将字段数据打印显示。在使用awk命令的过程中,可以使用逻辑操作符"

&&"表示"与"、"| |"表示"或"、"!."表示非" ;还可以进行简单的数学运算，如+、一、*、/、%、^分别表示加、减、乘、除、取余和乘方。

awk命令格式

基本用法：

逐行执行开始之前执行什么任务，结束之后再执行什么任务，用BEGIN、END

BEGIN一般用来做初始化操作，仅在读取数据记录之前执行一次 END一般用来做汇总操作，仅在读取完数据记录之后执行一次

awk命令格式

awk选项 '模式或条件{操作}' 文件1文件2 ...

awk -f 脚本文件文件1文件2 ..

格式: awk关键字选项命令部分'{xxxx}'文件名

awk包含几个特殊的内建变量（可直接用)如下所示:

FS:指定每行文本的字段分隔符，默认为空格或制表位（就是tab）。

NF:当前处理的行的字段个数。

NR:当前处理的行的行号(序数) 。

$0:当前处理的行的整行内容。

$n:当前处理行的第n个字段(第n列)。

FILENAME:被处理的文件名。

RS:行分隔符。awk从文件上读取资料时,将根据Rs的定义把资料切割成许多条记录，而awk一次仅读入一条记录,以进行处理。预设值是' \n'

简说:数据记录分隔，默认为\n，即每行为一条记录

例子

常用命令

awk -F: NR==10'{print $1}' zz   ##打印第10行第一列

awk -F : '{print $NF}' zz      ##打印最后一列

awk 'END{print NR}' zz     ##打印总行数

awk 'END{print $0}' zz      ##打印最后一整行内容

Linux---awk基本用法

awk概述

awk工作原理

awk命令格式