awk命令簡介

2024-06-28 13:25:15

字體：大中小

來源：轉載

供稿：網友

awk命令簡介

awk是一個強大的文本分析工具，相對于grep的查找，sed的編輯，awk在其對數據分析并生成報告時，顯得尤為強大。簡單來說awk就是把文件逐行的讀入，以空格為默認分隔符將每行切片，切開的部分再進行各種分析處理。

awk有3個不同版本: awk、nawk和gawk，未作特別說明，一般指gawk，gawk 是 AWK 的 GNU 版本。

awk其名稱得自于它的創始人 Alfred Aho 、Peter Weinberger 和 Brian Kernighan 姓氏的首個字母。實際上 AWK 的確擁有自己的語言： AWK 程序設計語言，三位創建者已將它正式定義為“樣式掃描和處理語言”。它允許您創建簡短的程序，這些程序讀取輸入文件、為數據排序、處理數據、對輸入執行計算以及生成報表，還有無數其他的功能。

樣式處理功能

cat /etc/passwd|head -5#resultroot:x:0:0:root:/root:/bin/bashbin:x:1:1:bin:/bin:/sbin/nologindaemon:x:2:2:daemon:/sbin:/sbin/nologinadm:x:3:4:adm:/var/adm:/sbin/nologinlp:x:4:7:lp:/var/spool/lpd:/sbin/nologin

處理后：

cat /etc/passwd|head -10|awk  -F ':'  'BEGIN {PRint "name,shell"}  {print $1","$7} END {print "blue,/bin/nosh"}'#resultname,shellroot,/bin/bashbin,/sbin/nologindaemon,/sbin/nologinadm,/sbin/nologinlp,/sbin/nologinblue,/bin/nosh

awk工作流程是這樣的：先執行BEGING，然后讀取文件，讀入有/n換行符分割的一條記錄，然后將記錄按指定的域分隔符劃分域，填充域，$0則表示所有域,$1表示第一個域,$n表示第n個域,隨后開始執行模式所對應的動作action。接著開始讀入第二條記錄······直到所有的記錄都讀完，最后執行END操作。

模板匹配功能

awk '{pattern + action}' {filenames}

pattern 表示 awk 在數據中查找的內容，而 action 是在找到匹配內容時所執行的一系列命令?；ɡㄌ枺▄}）不需要在程序中始終出現，但它們用于根據特定的模式對一系列指令進行分組。 pattern就是要表示的正則表達式，用斜杠括起來。

比如：搜索/etc/passwd有root關鍵字的所有行

awk -F: '/root/' /etc/passwd#resultroot:x:0:0:root:/root:/bin/bashOperator:x:11:0:operator:/root:/sbin/nologin

這種是pattern的使用示例，匹配了pattern(這里是root)的行才會執行action(沒有指定action，默認輸出每行的內容)。搜索支持正則，例如找root開頭的: awk -F: '/^root/' /etc/passwd 搜索/etc/passwd有root關鍵字的所有行，并顯示對應的shell

awk -F: '/root/{print $7}' /etc/passwd#result/bin/bash/sbin/nologin

awk內置變量

awk有許多內置變量用來設置環境信息，這些變量可以被改變，下面給出了最常用的一些變量。

ARGC        命令行參數個數ARGV        命令行參數排列ENVIRON     支持隊列中系統環境變量的使用FILENAME    awk瀏覽的文件名FNR         瀏覽文件的記錄數NR          已讀的記錄數NF          瀏覽記錄的域的個數FS          設置輸入域分隔符，等價于命令行 -F選項OFS         輸出域分隔符RS          控制記錄分隔符ORS         輸出記錄分隔符

統計/etc/passwd:文件名，每行的行號，每行的列數，對應的完整行內容:

awk  -F ':'  '{print "filename:" FILENAME ",linenumber:" NR ",columns:" NF ",linecontent:"$0}' /etc/passwd

使用printf替代print,可以讓代碼更加簡潔，易讀

awk  -F ':'  '{printf("filename:%10s,linenumber:%s,columns:%s,linecontent:%s/n",FILENAME,NR,NF,$0)}' /etc/passwd

awk中同時提供了print和printf兩種打印輸出的函數。其中print函數的參數可以是變量、數值或者字符串。字符串必須用雙引號引用，參數用逗號分隔。如果沒有逗號，參數就串聯在一起而無法區分。printf函數，其用法和c語言中printf基本相似,可以格式化字符串,輸出復雜時，printf更加好用，代碼更易懂。

awk編程

變量和賦值

除了awk的內置變量，awk還可以自定義變量。下面統計/etc/passwd的賬戶人數

awk '{count++;print $0;} END{print "user count is ", count}' /etc/passwd root:x:0:0:root:/root:/bin/bash ... user count is 40

這里沒有初始化count，雖然默認是0，但是妥當的做法還是初始化為0:

awk 'BEGIN {count=0;print "[start]user count is ", count} {count=count+1;print $0;} END{print "[end]user count is ", count}' /etc/passwd [start]user count is 0 root:x:0:0:root:/root:/bin/bash ... [end]user count is 40

統計某個文件夾下的文件占用的字節數

ls -l |awk 'BEGIN {size=0;} {size=size+$5;} END{print "[end]size is ", size}' [end]size is 439289

如果以M為單位顯示:

ls -l |awk 'BEGIN {size=0;} {size=size+$5;} END{print "[end]size is ", size/1024/1024,"M"}' [end]size is 0.418939 M

條件語句

awk中的條件語句是從C語言中借鑒來的，見如下聲明方式：

if (expression) {    statement;    statement;    ... ...}if (expression) {    statement;} else {    statement2;}if (expression) {    statement1;} else if (expression1) {    statement2;} else {    statement3;}

循環語句

awk中的循環語句同樣借鑒于C語言，支持while、do/while、for、break、continue，這些關鍵字的語義和C語言中的語義完全相同。

數組

因為awk中數組的下標可以是數字和字母，數組的下標通常被稱為關鍵字(key)。值和關鍵字都存儲在內部的一張針對key/value應用hash的表格里。由于hash不是順序存儲，因此在顯示數組內容時會發現，它們并不是按照你預料的順序顯示出來的。數組和變量一樣，都是在使用時自動創建的，awk也同樣會自動判斷其存儲的是數字還是字符串。一般而言，awk中的數組用來從記錄中收集信息，可以用于計算總和、統計單詞以及跟蹤模板被匹配的次數等等。

顯示/etc/passwd的賬戶

awk -F ':' 'BEGIN {count=0;} {name[count] = $1;count++;}; END{for (i = 0; i < NR; i++) print i, name[i]}' /etc/passwd0 root1 bin2 daemon3 adm4 lp...

計算兩個文件的差集

awk '{if(NR==FNR){a[$1]=0}if(NR!=FNR && !($1 in a))print}'  file1 file2

awk編程的內容極多，這里只羅列簡單常用的用法，更多請參考 http://www.gnu.org/software/gawk/manual/gawk.html

上一篇：第六課 GDB調試 (上)

下一篇：s3c6410_時鐘初始化

學習交流

如何查找有故障的配件

如何查找有故障的配件...

熱門圖片

猜你喜歡的新聞

猜你喜歡的關注

新聞熱點

最牛同桌！我考了696分我同桌考了703分

2024-06-26 22:28:41

650分！高二女生考入北大：遺憾不能上高三

2024-06-26 22:26:16

男生估分600只考了397 媽媽：高考雖重要，但不代表所有

2024-06-26 22:23:01

唐尚珺回應是否會直播帶貨：有人出100萬想和他合作！

2024-06-25 19:29:23

名校搶人名場面：清華、北大太拼了！

2024-06-25 19:22:14

男生高考語文滿分！網友：第一次聽說

2024-06-25 19:19:15

疑難解答

圖片精選

網友關注