linux下IO性能监控iostat命令详解iostat主要用于监控系统设备的IO负载情况，iostat首次运行时显示自

iostat主要用于监控系统设备的IO负载情况，iostat首次运行时显示自系统启动开始的各项统计信息，之后运行iostat将显示自上次运行该命令以后的统计信息。用户可以通过指定统计的次数和时间来获得所需的统计信息。

通过iostat方便查看CPU、网卡、tty设备、磁盘、CD-ROM 等等设备的活动情况,负载信息

命令格式：

Iostat [参数] [时间] [次数]

命令参数

-C 显示CPU使用情况

-d 显示磁盘使用情况

-k 以 KB 为单位显示

-m 以 M 为单位显示

-N 显示磁盘阵列(LVM) 信息

-n 显示NFS 使用情况

-p[磁盘] 显示磁盘和分区的情况

-t 显示终端和CPU的信息

-x 显示详细信息

-V 显示版本信息

1.显示所有设备负载情况

[root@localhost ~]# iostat
Linux 3.10.0-1062.el7.x86_64 (192.168.32.130) 	03/08/2020 	_x86_64_	(4 CPU)

avg-cpu:  %user   %nice %system %iowait  %steal   %idle
           0.07    0.00    0.08    0.00    0.00   99.85

Device:            tps    kB_read/s    kB_wrtn/s    kB_read    kB_wrtn
sda               0.66        11.89         1.73     264550      38515
scd0              0.00         0.05         0.00       1028          0
dm-0              0.58        10.46         1.64     232638      36467
dm-1              0.00         0.10         0.00       2204          0

Cpu属性值说明：

avg-cpu: 总体cpu使用情况统计信息，对于多核cpu，这里为所有cpu的平均值。重点关注iowait值，表示CPU用于等待io请求的完成时间。

Device: 各磁盘设备的IO统计信息

%user：CPU处在用户模式下的时间百分比。

%nice：CPU处在带NICE值的用户模式下的时间百分比。

%system：CPU处在系统模式下的时间百分比。

%iowait：CPU等待输入输出完成时间的百分比。

%steal：管理程序维护另一个虚拟处理器时，虚拟CPU的无意识等待时间百分比。

%idle：CPU空闲时间百分比。

注：如果%iowait的值过高，表示硬盘存在I/O瓶颈，%idle值高，表示CPU较空闲，如果%idle值高但系统响应慢时，有可能是CPU等待分配内存，此时应加大内存容量。%idle值如果持续低于10，那么系统的CPU处理能力相对较低，表明系统中最需要解决的资源是CPU。

tps: 每秒进程下发的IO读、写请求数量

KB_read/s: 每秒从驱动器读入的数据量，单位为K。

KB_wrtn/s: 每秒从驱动器写入的数据量，单位为K。

KB_read: 读入数据总量，单位为K。

KB_wrtn: 写入数据总量，单位为K。

2.查看设备使用率（%util）和响应时间（await）

[root@localhost ~]# iostat -d -x -k 1 1 
Linux 3.10.0-1062.el7.x86_64 (192.168.32.130) 	03/08/2020 	_x86_64_	(4 CPU)

Device:         rrqm/s   wrqm/s     r/s     w/s    rkB/s    wkB/s  avgrq-sz  avgqu-sz  await  r_await  w_await  svctm  %util
sda               0.00     0.02    0.43    0.21    11.36     1.70    40.63     0.00    0.65    0.62    0.71   0.41   0.03
scd0              0.00     0.00    0.00    0.00     0.04     0.00   114.22     0.00    1.89    1.89    0.00   1.33   0.00
dm-0              0.00     0.00    0.34    0.23     9.99     1.62    40.85     0.00    0.74    0.73    0.74   0.45   0.03
dm-1              0.00     0.00    0.00    0.00     0.09     0.00    50.09     0.00    0.41    0.41    0.00   0.27   0.00

rrqm/s：每秒进行 merge 的读操作数目.即 delta(rmerge)/s

wrqm/s：每秒进行 merge 的写操作数目.即 delta(wmerge)/s

r/s：每秒完成的读 I/O 设备次数.即 delta(rio)/s

w/s：每秒完成的写 I/O 设备次数.即 delta(wio)/s

wsec/s：每秒写扇区数.即 delta(wsect)/s

rkB/s：每秒读K字节数.是 rsect/s 的一半,因为每扇区大小为512字节.(需要计算)

wkB/s：每秒写K字节数.是 wsect/s 的一半.(需要计算)

avgrq-sz：平均每次设备I/O操作的数据大小 (扇区).delta(rsect+wsect)/delta(rio+wio)

avgqu-sz：平均I/O队列长度.即 delta(aveq)/s/1000 (因为aveq的单位为毫秒).

await：平均每次设备I/O操作的等待时间 (毫秒).即 delta(ruse+wuse)/delta(rio+wio)

svctm：平均每次设备I/O操作的服务时间 (毫秒).即 delta(use)/delta(rio+wio)

%util：一秒中有百分之多少的时间用于 I/O 操作,或者说一秒中有多少时间 I/O 队列是非空的，即 delta(use)/s/1000 (因为use的单位为毫秒)

如果 %util 接近 100%，说明产生的I/O请求太多，I/O系统已经满负荷，该磁盘可能存在瓶颈。 idle小于70% IO压力就较大了，一般读取速度有较多的wait。同时可以结合vmstat 查看查看b参数(等待资源的进程数)和wa参数(IO等待所占用的CPU时间的百分比，高过30%时IO压力高)。

另外 await 的参数也要多和 svctm 来参考。差的过高就一定有 IO 的问题。 avgqu-sz 也是个做 IO 调优时需要注意的地方，这个就是直接每次操作的数据的大小，如果次数多，但数据拿的小的话，其实 IO 也会很小。如果数据拿的大，那么IO 的数据会高。也可以通过 avgqu-sz × ( r/s or w/s ) = rsec/s or wsec/s。也就是讲，读定速度是这个来决定的。

svctm 一般要小于 await (因为同时等待的请求的等待时间被重复计算了)，svctm 的大小一般和磁盘性能有关，CPU/内存的负荷也会对其有影响，请求过多也会间接导致 svctm 的增加。

await 的大小一般取决于服务时间(svctm) 以及 I/O 队列的长度和 I/O 请求的发出模式。如果 svctm 比较接近 await，说明 I/O 几乎没有等待时间；如果 await 远大于 svctm，说明 I/O 队列太长，应用得到的响应时间变慢，如果响应时间超过了用户可以容许的范围，这时可以考虑更换更快的磁盘，调整内核 elevator 算法，优化应用，或者升级 CPU。

队列长度(avgqu-sz)也可作为衡量系统 I/O 负荷的指标，但由于 avgqu-sz 是按照单位时间的平均值，所以不能反映瞬间的 I/O 洪水。

疑惑：dm-0/1/2是什么？怎么来的？参考链接：www.cnblogs.com/ultranms/p/…