前面我们掌握了文件操作、权限、用户、检索、文本三剑客。
今天进入运维核心刚需:系统监控!
线上服务器卡顿、程序卡死、磁盘爆满、内存溢出、端口异常……
99%的服务器故障,都靠今天的命令排查解决!
Day8 一次性吃透:磁盘、内存、CPU、进程、网络 全套监控命令,零基础掌握专业运维排障思路!
一、今日学习目标
✅ 掌握磁盘空间排查:df、du 命令
✅ 掌握内存/缓存查看:free 命令
✅ 掌握CPU与进程监控:top、ps 命令
✅ 掌握端口与网络状态:netstat、ss 命令
✅ 学会服务器负载、卡死、资源爆满快速定位方法
二、磁盘监控:df & du(排查磁盘爆满)
服务器最常见故障:磁盘100%占用,服务无法写入、报错宕机
1、df 查看整体磁盘分区使用
查看系统所有分区总容量、已用、剩余空间
bash
df -h
-h:人性化显示GB/MB单位(必加参数)
2、du 查看文件/文件夹占用大小
找出「哪个文件夹最占空间」
bash
# 查看当前目录总大小
du -sh
# 查看目录下所有文件大小排序
du -lh
- s:只显示汇总大小
- h:人性化单位显示
💡 黄金组合排查流程:
df -h 发现磁盘满 → du -sh /* 找出大目录 → 清理无用日志/垃圾文件
三、内存监控:free 命令(排查内存溢出)
bash
free -h
输出字段解读(工作重点):
- total:总内存
- used:已使用内存
- free:空闲内存
- buff/cache:缓存占用
- available:真正可用内存(看这个即可)
运维常识:
Linux会自动利用空闲内存做缓存,free空闲小不代表内存不足,以available为准!
四、CPU & 进程监控:top & ps
1、top 实时动态监控(运维最常用)
bash
top
实时展示:CPU占用、内存占用、进程状态、系统负载
重点查看:
- %CPU:进程CPU占用
- %MEM:进程内存占用
- load average:系统负载
常用快捷键:
- P:按CPU排序
- M:按内存排序
- q:退出
2、ps 静态查看进程
适合查询某个程序是否在运行
bash
# 查看所有进程
ps -ef
# 精准筛选进程(查Java、Python、Nginx)
ps -ef | grep nginx
3、杀死异常进程(卡死/死循环进程)
bash
kill -9 进程ID
-9:强制终止(彻底杀掉卡死进程)
五、网络&端口监控:netstat & ss
排查端口占用、服务监听、连接异常必备!
1、netstat 查看端口状态
bash
# 查看所有端口
netstat -an
# 查看正在监听的端口
netstat -an | grep LISTEN
# 查看80、8080端口是否被占用
netstat -an | grep 8080
2、ss 高效端口查询(替代netstat,速度更快)
bash
ss -ltnp
六、系统负载查看:uptime
快速看服务器运行状态、负载高低
bash
uptime
输出解读:
load average: 0.00, 0.01, 0.05
分别代表:1分钟、5分钟、15分钟平均负载
经验标准:
单核CPU负载<1 正常
负载>1 服务器压力大、卡顿
七、企业标准排障流程(必记)
1. 服务器卡顿 → top 看CPU/内存占用最高进程
2. 磁盘报错无法写入 → df -h 查爆满分区
3. 磁盘满 → du -sh 找大文件清理日志
4. 服务启动失败 → 查端口占用 netstat -an
5. 程序僵死 → ps 查进程、 kill -9 重启
八、今日实操作业
bash
# 1. 查看磁盘整体状态
df -h
# 2. 查看目录占用大小
du -sh /home
# 3. 查看内存状态
free -h
# 4. 实时监控系统进程
top
# 5. 查看所有监听端口
netstat -ltnp
# 6. 查看系统负载
uptime
九、今日知识点总结
1. df:看整体磁盘分区,du:看具体文件占用,配合排查磁盘爆满
2. free -h 看真实可用内存,不要被free空闲内存误导
3. top实时监控CPU/内存,是排查服务器卡顿第一命令
4. ps + grep 精准检索进程,kill -9 处理异常进程
5. netstat/ss 排查端口占用,解决服务端口冲突
6. uptime 快速判断服务器整体负载压力
✅ 到今天,你已经具备基础服务器运维排障能力!
日常80%的服务器异常,你都可以独立解决!