服务器巡检不需要什么高大上的监控系统,几条命令配合起来,每天花两分钟就能掌握服务器运行状况。

CPU 负载

top -bn1 | head -5
# 看 load average,超过 CPU 核数需要留意

内存

free -h
# 关注 available 列

磁盘

df -h
# Use% 超过 80% 就该清理了

磁盘 IO

iostat -x 1 3
# %util 接近 100% 说明磁盘瓶颈

网络连接

ss -tunap | grep ESTAB | wc -l

错误日志

journalctl --since yesterday -p err

建议把这几个命令写到一个脚本里,每天早上执行一次,有问题第一时间发现。