当前位置:首页>Linux>Linux30天入门计划|Day8:系统监控全套命令!排查CPU、内存、磁盘、网络故障

Linux30天入门计划|Day8:系统监控全套命令!排查CPU、内存、磁盘、网络故障

  • 2026-10-11 06:42:54
Linux30天入门计划|Day8:系统监控全套命令!排查CPU、内存、磁盘、网络故障

前面我们掌握了文件操作、权限、用户、检索、文本三剑客。

今天进入运维核心刚需:系统监控!

线上服务器卡顿、程序卡死、磁盘爆满、内存溢出、端口异常……
99%的服务器故障,都靠今天的命令排查解决!

Day8 一次性吃透:磁盘、内存、CPU、进程、网络 全套监控命令,零基础掌握专业运维排障思路!

一、今日学习目标

✅ 掌握磁盘空间排查:df、du 命令
✅ 掌握内存/缓存查看:free 命令
✅ 掌握CPU与进程监控:top、ps 命令
✅ 掌握端口与网络状态:netstat、ss 命令
✅ 学会服务器负载、卡死、资源爆满快速定位方法

二、磁盘监控:df & du(排查磁盘爆满)

服务器最常见故障:磁盘100%占用,服务无法写入、报错宕机

1、df 查看整体磁盘分区使用

查看系统所有分区总容量、已用、剩余空间

bash
 

df -h
 

-h:人性化显示GB/MB单位(必加参数)

2、du 查看文件/文件夹占用大小

找出「哪个文件夹最占空间」

bash
 

# 查看当前目录总大小
du -sh

# 查看目录下所有文件大小排序
du -lh
 

- s:只显示汇总大小
- h:人性化单位显示

💡 黄金组合排查流程:
 df -h  发现磁盘满 →  du -sh /*  找出大目录 → 清理无用日志/垃圾文件

三、内存监控:free 命令(排查内存溢出)

bash
 

free -h
 

输出字段解读(工作重点):

- total:总内存
- used:已使用内存
- free:空闲内存
- buff/cache:缓存占用
- available:真正可用内存(看这个即可)

运维常识:
Linux会自动利用空闲内存做缓存,free空闲小不代表内存不足,以available为准!

四、CPU & 进程监控:top & ps

1、top 实时动态监控(运维最常用)

bash
 

top
 

实时展示:CPU占用、内存占用、进程状态、系统负载

重点查看:

- %CPU:进程CPU占用
- %MEM:进程内存占用
- load average:系统负载

常用快捷键:

- P:按CPU排序
- M:按内存排序
- q:退出

2、ps 静态查看进程

适合查询某个程序是否在运行

bash
 

# 查看所有进程
ps -ef

# 精准筛选进程(查Java、Python、Nginx)
ps -ef | grep nginx
 

3、杀死异常进程(卡死/死循环进程)

bash
 

kill -9 进程ID
 

-9:强制终止(彻底杀掉卡死进程)

五、网络&端口监控:netstat & ss

排查端口占用、服务监听、连接异常必备!

1、netstat 查看端口状态

bash
 

# 查看所有端口
netstat -an

# 查看正在监听的端口
netstat -an | grep LISTEN

# 查看80、8080端口是否被占用
netstat -an | grep 8080
 

2、ss 高效端口查询(替代netstat,速度更快)

bash
 

ss -ltnp
 

六、系统负载查看:uptime

快速看服务器运行状态、负载高低

bash
 

uptime
 

输出解读:
 load average: 0.00, 0.01, 0.05 
分别代表:1分钟、5分钟、15分钟平均负载

经验标准:
单核CPU负载<1 正常
负载>1 服务器压力大、卡顿

七、企业标准排障流程(必记)

1. 服务器卡顿 →  top  看CPU/内存占用最高进程
2. 磁盘报错无法写入 →  df -h  查爆满分区
3. 磁盘满 →  du -sh  找大文件清理日志
4. 服务启动失败 → 查端口占用  netstat -an 
5. 程序僵死 →  ps  查进程、 kill -9  重启

八、今日实操作业

bash
 

# 1. 查看磁盘整体状态
df -h

# 2. 查看目录占用大小
du -sh /home

# 3. 查看内存状态
free -h

# 4. 实时监控系统进程
top

# 5. 查看所有监听端口
netstat -ltnp

# 6. 查看系统负载
uptime
 

九、今日知识点总结

1. df:看整体磁盘分区,du:看具体文件占用,配合排查磁盘爆满
2. free -h 看真实可用内存,不要被free空闲内存误导
3. top实时监控CPU/内存,是排查服务器卡顿第一命令
4. ps + grep 精准检索进程,kill -9 处理异常进程
5. netstat/ss 排查端口占用,解决服务端口冲突
6. uptime 快速判断服务器整体负载压力

✅ 到今天,你已经具备基础服务器运维排障能力!
日常80%的服务器异常,你都可以独立解决!

最新文章

随机文章