Linux如何使用Awk处理报表_Linux下字段提取与数据统计实战【指南】

裘德小鎮的故事

发布时间：2025-12-30 15:53:08

893人浏览过

来源于php中文网

原创

Awk是Linux中用于字段提取与数据统计的高效命令行工具，支持按列提取、条件过滤统计、数值计算、多字段分组及格式化输出。

linux如何使用awk处理报表_linux下字段提取与数据统计实战【指南】

如果您需要从Linux系统中的文本报表中提取特定字段或进行数据统计，则Awk是内置且高效的命令行工具。以下是针对字段提取与数据统计的多种实用方法：

一、按列提取指定字段

Awk默认以空白字符（空格、制表符）为分隔符，通过$N可直接引用第N列内容，适用于结构化日志或CSV格式报表。

1、提取文件中每行的第2列和第4列，以制表符分隔输出：
awk '{print $2, $4}' report.txt

2、提取以冒号为分隔符的/etc/passwd中用户名（第1列）和用户ID（第3列）：
awk -F ':' '{print $1, $3}' /etc/passwd

3、仅显示第5列非空的行：
awk '$5 != "" {print $0}' report.txt

二、条件过滤后统计频次

结合模式匹配与计数变量，可快速统计某字段值出现次数，适用于日志分析或销售报表分类汇总。

1、统计access.log中HTTP状态码为404的请求数量：
awk '$9 == "404" {count++} END {print count+0}' access.log

2、统计report.csv中第3列（部门名称）各值出现频次：
awk -F ',' '{dept[$3]++} END {for (d in dept) print d, dept[d]}' report.csv

3、仅输出出现次数大于5的部门：
awk -F ',' '{dept[$3]++} END {for (d in dept) if (dept[d] > 5) print d, dept[d]}' report.csv

三、数值字段求和与平均值计算

Awk支持算术运算，适合对数字型字段（如销售额、响应时间）执行累加、均值等聚合操作。

1、计算sales.txt中第2列（金额）的总和：
awk '{sum += } END {print sum+0}' sales.txt

HaiSnap

一站式AI应用开发和部署工具

下载

2、计算第2列的平均值（自动处理空行和非数字行）：
awk '$2 ~ /^[0-9.]+$/ {sum += $2; count++} END {if (count > 0) print sum/count}' sales.txt

3、同时输出总和、计数、平均值，用制表符分隔：
awk '$2 ~ /^[0-9.]+$/ {sum += $2; count++} END {print sum, count, (count>0 ? sum/count : 0)}' sales.txt

四、多字段组合分组统计

利用复合键（如$1,$2）作为数组下标，可实现按多个维度分组聚合，适用于订单报表中“地区+产品类型”的交叉统计。

1、按第1列（省份）和第3列（产品类别）统计数量：
awk '{key = $1 "," $3; cnt[key]++} END {for (k in cnt) print k, cnt[k]}' order_report.txt

2、在组合键基础上附加第4列（销售额）求和：
awk '{key = $1 "," $3; cnt[key]++; sum[key] += $4} END {for (k in cnt) print k, cnt[k], sum[k]}' order_report.txt

3、仅输出销售额总和超过10000的组合：
awk '{key = $1 "," $3; sum[key] += $4} END {for (k in sum) if (sum[k] > 10000) print k, sum[k]}' order_report.txt

五、格式化输出报表结果

通过printf可控制字段对齐、小数位数及分隔符样式，使统计结果更符合正式报表要求。

1、将统计结果按左对齐15字符、右对齐8字符格式输出：
awk '{cnt[$1]++} END {for (k in cnt) printf "%-15s %8d\n", k, cnt[k]}' log.txt

2、金额列保留两位小数并添加美元符号：
awk '{printf "%-10s $%.2f\n", $1, $2}' financial.txt

3、添加表头，并用等号线分隔：
awk 'BEGIN {printf "%-12s %-8s %-10s\n", "Region", "Count", "Total"; printf "%s\n", "===================================="} {sum[$1] += $3; cnt[$1]++} END {for (r in cnt) printf "%-12s %-8d $%.2f\n", r, cnt[r], sum[r]}' data.txt

LINUX如何对SSH服务进行安全加固_提升LINUX服务器安全性的配置技巧

Linux如何安装GCC编译器_Linux下C/C++开发环境搭建【指南】

Linux怎么挂载NFS网络共享目录_Linux服务端配置与客户端连接【教程】

Linux如何安装MongoDB数据库_Linux环境配置与用户权限设置【教程】

Linux如何安装Python3_Linux多版本管理与pip换源设置【教程】

相关标签:

linux access 工具 csv linux系统状态码格式化输出 print if count for printf http linux Access

本站声明：本文内容由网友自发贡献，版权归原作者所有，本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容，请联系admin@php.cn

上一篇：Linux如何配置PAM认证模块_Linux系统登录策略与密码强度限制【步骤】下一篇：Linux如何修改文件权限_Linux下chmod与chown命令深度应用【指南】

作者最新文章

MacBook电池健康度怎么看_延长Mac电池寿命的技巧【分享】

2025-12-30 16:08

手机怎么抓拍【技巧】

2025-12-30 16:09

火狐浏览器插件怎么安装_Firefox附加组件安装和管理教程【扩展】

2025-12-30 16:19

siri有什么好玩的用法功能【推荐】

2025-12-30 16:21

c++如何实现并查集算法_c++ 路径压缩与按秩合并优化【案例】

2025-12-30 16:23

Win11怎么创建桌面快捷方式_Windows 11网页与程序快捷方式制作【详解】

2025-12-30 16:27

电脑摄像头怎么打开电脑前置摄像头的打开方式【教程】

2025-12-30 16:27

composer怎么配置自动化代码风格检查_composer引入php-cs-fixer【教程】

2025-12-30 16:28

Mac的iCloud云盘如何使用？（文件同步与管理）

2025-12-30 16:30

如何通过Composer安装PHP-CS-Fixer并配置脚本_使用Composer统一团队代码风格

2025-12-30 16:38

热门AI工具

DeepSeek

幻方量化公司旗下的开源大模型平台

AI大模型

开放平台

豆包大模型

字节跳动自主研发的一系列大型语言模型

AI大模型

通义千问

阿里巴巴推出的全能AI助手

AI大模型

腾讯元宝

腾讯混元平台推出的AI助手

文档处理

Excel 表格

文心一言

文心一言是百度开发的AI聊天机器人，通过对话可以生成各种形式的内容。

AI大模型

中文写作

讯飞写作

基于讯飞星火大模型的AI写作工具，可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

中文写作

写作工具

即梦AI

一站式AI创作平台，免费AI图片和视频生成。

图片拼接

图画生成

ChatGPT

最最强大的AI聊天机器人程序，ChatGPT不单是聊天机器人，还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

AI大模型

中文写作

智谱清言 - 免费全能的AI助手

AI大模型

PDF 文档

相关专题

python中print函数的用法

python中print函数的语法是“print(value1, value2, ..., sep=' ', end=' ', file=sys.stdout, flush=False)”。本专题为大家提供print相关的文章、下载、课程内容，供大家免费下载体验。

183

2023.09.27

if什么意思

if的意思是“如果”的条件。它是一个用于引导条件语句的关键词，用于根据特定条件的真假情况来执行不同的代码块。本专题提供if什么意思的相关文章，供大家免费阅读。

710

2023.08.22

counta和count的区别

Count函数用于计算指定范围内数字的个数，而CountA函数用于计算指定范围内非空单元格的个数。本专题为大家提供相关的文章、下载、课程内容，供大家免费下载体验。

192

2023.11.20

printf用法大全

php中文网为大家提供printf用法大全，以及其他printf函数的相关文章、相关下载资源以及各种相关课程，供大家免费下载体验。

2023.06.20

fprintf和printf的区别

fprintf和printf的区别在于输出的目标不同，printf输出到标准输出流，而fprintf输出到指定的文件流。根据需要选择合适的函数来进行输出操作。更多关于fprintf和printf的相关文章详情请看本专题下面的文章。php中文网欢迎大家前来学习。

276

2023.11.28

http500解决方法

http500解决方法有检查服务器日志、检查代码错误、检查服务器配置、检查文件和目录权限、检查资源不足、更新软件版本、重启服务器或寻求专业帮助等。本专题为大家提供相关的文章、下载、课程内容，供大家免费下载体验。

264

2023.11.09

http请求415错误怎么解决

解决方法：1、检查请求头中的Content-Type；2、检查请求体中的数据格式；3、使用适当的编码格式；4、使用适当的请求方法；5、检查服务器端的支持情况。更多http请求415错误怎么解决的相关内容，可以阅读下面的文章。

385

2023.11.14

HTTP 503错误解决方法

HTTP 503错误表示服务器暂时无法处理请求。想了解更多http错误代码的相关内容，可以阅读本专题下面的文章。

991

2024.03.12

桌面文件位置介绍

本专题整合了桌面文件相关教程，阅读专题下面的文章了解更多内容。

2025.12.30

热门下载

网站特效

网站源码

网站素材

前端模板