
课程目标这一天重点使用前面学习的监控 压测 调优进行企业故障场景处理。课程中的性能分析思路是按照 CPU → 内存 → 磁盘 IO → 网络 → 应用 进行观察和定位。场景 1服务器 CPU 持续高负载企业故障运维人员收到告警服务器 CPU 使用率持续升高业务访问变慢。要求人为制造 CPU 压力stress -c 2 -t 60根据以上制造问题进行分析。要求完成找出 CPU 占用最高的进程分析 load average查看每个 CPU 核心状态判断是否属于 CPU 瓶颈给出处理方案场景 2服务器内存不足企业故障业务服务器运行一段时间后系统可用内存越来越少部分业务响应变慢。要求制造内存压力stress -m 2 --vm-bytes 512M -t 60注意这个是制造故障。这条命令是干什么每个参数的作用。要求完成以上制造问题进行分析。重点判断系统是否出现内存不足以及 Swap 压力。场景 3服务器磁盘 IO 过高企业故障业务服务器访问突然变慢CPU 并没有明显异常但是系统 IO 等待升高。要求制造磁盘 IOdd if/dev/zero of/test.dbf bs1M count1024 oflagdirect注意这个是制造故障。这条命令是干什么每个参数的作用。要求完成找出哪个磁盘 IO 最高哪个进程产生 IOwa 是否升高是否存在磁盘 IO 瓶颈场景 4服务器网络流量异常企业故障IDC 收到流量告警发现服务器对外网络流量突然增加需要运维人员定位异常进程。iperf3 -c IP -t 60注意这个命令工具需要在其他机器上安装。以上制造网络问题进行网络分析。要求找出哪块网卡流量异常哪个进程占用网络带宽判断是否属于正常业务如果属于异常程序制定处理方案场景 5Web 服务器高并发企业故障公司 Web 服务器访问量突然增加需要验证服务器在高并发情况下的性能。要求部署 HTTP 服务然后进行ab -n 5000 -c 50 http://服务器IP/注意这个是制造故障。这条命令是干什么每个参数的作用。故障观察要求分析CPU 变化网络变化并发变化响应时间Failed Requests是否存在性能瓶颈场景 6服务器资源综合压力企业故障公司业务高峰期服务器同时出现 CPU、内存、IO 压力需要运维人员判断主要瓶颈。要求执行stress-ng --cpu 2 --vm 2 --vm-bytes 256M --io 2 --timeout 60s注意这个是制造故障。这条命令是干什么每个参数的作用。最终要求回答CPU、内存、磁盘 IO、网络哪个资源最可能成为当前瓶颈为什么