Linux服务器资源监控完全指南:8个必知工具与技巧
作为Linux系统管理员,实时掌握服务器资源使用情况至关重要。本文将深入解析8种专业级监控方案,助您构建全方位的服务器健康预警系统。
一、基础命令监控三剑客
1. top命令 - 实时进程监控
执行top命令可查看:
- CPU使用率(us用户空间/sy内核空间)
- 内存占用(buffers/cache区别)
- 进程资源消耗排序
高级技巧:按"M"按内存排序,"P"按CPU排序,":resize"调整界面
2. vmstat - 系统整体监控
使用vmstat 2 5(每2秒采样,共5次)重点观察:
| 参数 | 含义 | 警戒值 |
|---|---|---|
| r | 运行队列长度 | >CPU核心数 |
| si/so | 交换分区使用 | >0即报警 |
3. iostat - 磁盘IO分析
iostat -xmt 2输出包含:
- %util > 70%表示磁盘过载
- await > 50ms需优化
二、高级监控工具推荐
4. Glances - 全能监控仪表盘
安装:pip install glances
优势特性:
- Web界面支持(端口61208)
- API访问接口
- 容器/GPU监控
5. Prometheus + Grafana 组合
企业级监控方案搭建步骤:
- 安装Node Exporter采集数据
- 配置Prometheus抓取规则
- Grafana导入官方仪表板(ID:1860)

三、自动化监控方案
6. 监控脚本示例
#!/bin/bash
ALERT=90
df -H | grep -vE '^Filesystem|tmpfs' | awk '{ print $5 " " $1 }' | while read output;
do
usage=$(echo $output | awk '{ print $1}' | cut -d'%' -f1)
if [ $usage -ge $ALERT ]; then
echo "磁盘空间警报: $output"
fi
done
7. 邮件报警配置
通过mailx实现:
- 安装postfix服务
- 配置/etc/mail.rc
- 测试:
echo "测试内容" | mail -s "主题" [email protected]
四、监控最佳实践
- 建立基线数据(连续7天正常值)
- 关键指标设置多级阈值(警告/严重)
- 定期生成周报/月报(使用sar工具)
通过本文介绍的工具组合,您可以构建从基础到企业级的完整监控体系,建议根据实际业务需求选择适合的方案组合使用。
