- 4
- 0
- 约 10页
- 2018-06-07 发布于广东
- 举报
linux 系监控、诊断工具之 IO wait
网址:edu.51CTO.com
linux 系统监控、诊断工具之 IO wait
1、问题:
最近在做日志的实时同步,上线之前是做过单份线上日志压力测试的,消息队列和客户端、本机都没问题,但是没想到上了第二份日志之后,问题来了:
集群中的某台机器 top 看到负载巨高,集群中的机器硬件配置一样,部署的软件都一样,却单单这一台负载有问题,初步猜测可能硬件有问题了。
同时,我们还需要把负载有异常的罪魁祸首揪出来,到时候从软件、硬件层面分别寻找解决方案。
2、排查:
从 top 中可以看到 load average 偏高,%wa 偏高,%us 很低:
从上图我们大致可以推断 IO 遇到了瓶颈,下面我们可以再用相关的 IO 诊断工具,具体的验证排查下。
PS:如果你对 top 的用法不了解,请参考我去年写的一篇博文:
HYPERLINK /leejun2005/blog/157910 linux 系统监控、诊断工具之 top 详解
常用组合方式有如下几种:
? 用vmstat、sar、iostat检测是否是CPU瓶颈?? 用free、vmstat检测是否是内存瓶颈?? 用iostat、dmesg 检测是否是磁盘I/O瓶颈?? 用netstat检测是否是网络带宽瓶颈
2.1 vmstat
vmstat命令的含义为
原创力文档

文档评论(0)