目录-
- 排查顺序
- 方法论
- 性能分析工具
- CPU分析思路
- 内存分析思路
- IO分析思路
- 网络分析思路
- 基准测试工具
- 参考
排查顺序
整体情况:-
top/htop/atop命令查看进程/线程、CPU、内存使用情况,CPU使用情况; -
dstat 2查看CPU、磁盘IO、网络IO、换页、中断、切换,系统I/O状态; -
vmstat 2查看内存使用情况,内存状态; -
iostat -d -x 2查看所有磁盘的IO情况,系统I/O状态; -
iotop查看IO靠前的进程,系统的I/O状态; -
perf top查看占用CPU最多的函数,CPU使用情况; -
perf record -ag -- sleep 15;perf report查看CPU事件占比,调用栈,CPU使用情况; -
sar -n DEV 2查看网卡的吞吐,网卡状态; -
/usr/share/bcc/tools/filetop -C查看每个文件的读写情况,系统的I/O状态; -
/usr/share/bcc/tools/opensnoop显示正在被打开的文件,系统的I/O状态; -
mpstat -P ALL 1单核CPU是否被打爆; -
ps aux --sort=-%cpu按CPU使用率排序,找出CPU消耗最多进程; -
ps -eo pid,comm,rss | awk '{m=$3/1e6;s["*"]+=m;s[$2]+=m} END{for (n in s) printf"%10.3f GB %s\n",s[n],n}' | sort -nr | head -20统计前20内存占用; -
awk 'NF>3{s["*"]+=s[$1]=$3*$4/1e6} END{for (n in s) printf"%10.1f MB %s\n",s[n],n}' /proc/slabinfo | sort -nr | head -20统计内核前20slab的占用;
-
pidstat 2 -p 进程号查看可疑进程CPU使用率变化情况; -
pidstat -w -p 进程号 2查看可疑进程的上下文切换情况; -
pidstat -d -p 进程号 2查看可疑进程的IO情况; -
lsof -p 进程号查看进程打开的文件; -
strace -f -T -tt -p 进程号显示进程发起的系统调用;
-
ethtool -S查看网卡硬件情况; -
cat/proc/net/softnet_stat/ifconfig eth1查看网卡驱动情况; -
netstat -nat|awk '{print awk $NF}'|sort|uniq -c|sort -n查看连接状态分布; -
ss -ntp或者netstat -ntp查看连接队列; -
查看协议栈情况;netstat -s
方法论
RED方法:监控服务的请求数(Rate)、错误数(Errors)、响应时间(Duration)。Weave Cloud在监控微服务性能时提出的思路。USE方法:监控系统资源的使用率(Utilization)、饱和度(Saturation)、错误数(Errors)。
性能分析工具
Linux 内核的各个子系统出发,汇总了对各个子系统进行性能分析时,你可以选择的工具。不过,虽然这个图是性能分析最好的参考资料之一,它其实还不够具体。比如,当你需要查看某个性能指标时,这张图里对应的子系统部分,可能有多个性能工具可供选择。但实际上,并非所有这些工具都适用,具体要用哪个,还需要你去查找每个工具的手册,对比分析做出选择。CPU分析思路
首先,从 CPU 的角度来说,主要的性能指标就是 CPU 的使用率、上下文切换以及 CPU Cache 的命中率等。下面这张图就列出了常见的 CPU 性能指标。

内存分析思路
接着我们来看内存方面。从内存的角度来说,主要的性能指标,就是系统内存的分配和使用、进程内存的分配和使用以及 SWAP 的用量。下面这张图列出了常见的内存性能指标。
IO分析思路
从文件系统和磁盘 I/O 的角度来说,主要性能指标,就是文件系统的使用、缓存和缓冲区的使用,以及磁盘 I/O 的使用率、吞吐量和延迟等。下面这张图列出了常见的 I/O 性能指标。
网络分析思路
从网络的角度来说,主要性能指标就是吞吐量、响应时间、连接数、丢包数等。根据 TCP/IP 网络协议栈的原理,我们可以把这些性能指标,进一步细化为每层协议的具体指标。这里我同样用一张图,分别从链路层、网络层、传输层和应用层,列出了各层的主要指标。
基准测试工具
除了性能分析外,很多时候,我们还需要对系统性能进行基准测试。比如,- 在文件系统和磁盘 I/O 模块中,我们使用 fio 工具,测试了磁盘 I/O 的性能。
- 在网络模块中,我们使用 iperf、pktgen 等,测试了网络的性能。
- 而在很多基于 Nginx 的案例中,我们则使用 ab、wrk 等,测试 Nginx 应用的性能。

参考
- 相当一部分内容来自极客时间出品的倪鹏飞专栏《Linux性能优化》, 这是之前这个专栏的学习笔记。
- 另一份资料是IBM红宝书Linux性能调优指南。
- 此外,The Linux Documentation Project是一个非常好的资料库。
- 将硬件中断的处理任务分配个多个CPU:SMP affinity and proper interrupt handling in Linux
- Hidden Costs of Memory Allocation
- https://www.lijiaocn.com/soft/linux/
END
开发板/核心板/主板/整机
OEM/ODM
原文标题:Linux问题分析与性能优化
文章出处:【微信公众号:启扬ARM嵌入式开发】欢迎添加关注!文章转载请注明出处。
声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。
举报投诉
-
Linux
+关注
关注
88文章
11851浏览量
219783
发布评论请先 登录
相关推荐
热点推荐
VirtualLab:光栅的优化与分析
| | 光栅是光学工程师使用的最基本的工具。为了设计和分析这类组件,快速物理光学建模和设计软件VirtualLab Fusion为用户提供了许多有用的工具。其中包括参数优化,以轻松优化系统,以及参数
发表于 04-23 08:17
Linux进程树分析工具pstree详解与实战指南(另一视角优化Linux系统)
在 Linux 系统开发与运维中,理解进程的运行状态和相互关系是排查问题、优化性能的基础。pstree 作为一款轻量高效的进程树可视化工具,能直观展示系统中所有进程的父子关系,为系统分析提供关键线索。本文将从基础用法到实战
Linux性能分析实战:用trace揪出卡顿、高CPU的“真凶”
做 Linux 开发或运维的你,是否常被这些问题困扰:服务突然卡顿却找不到根源,CPU 占用率飙升但查不到 “罪魁祸首”,系统响应变慢却摸不清瓶颈?其实,Linux 内核早已为我们准备了 “透视镜”——trace 跟踪技术,今天就手把手教你从生成 trace 文件到可视化
Linux系统性能优化与调试的思路
在开发过程中,对系统性能的要求越来越高,在求职的过程中很多岗位不单单是要求驱动开发或者系统开发,会解决系统性能瓶颈问题,往往是加分项,有些公司特别是大厂都会把性能优化单独划分一个岗位。
LDO性能优化的应用技巧
本文围绕LDO性能优化的关键环节展开,系统阐述了从启动过程控制、不同负载条件下稳定工作到瞬态响应提升的全链路应用技巧。内容涵盖启动过冲抑制、电子负载在CC/CR模式下的适应性优化、启动震荡改善、负载
Linux系统冗余设计裁剪开机时间优化
1、在保留现有功能(RT-Linux实时特性、SPI驱动正常工作、网口通信正常、USB驱动)的前提下,将Upboard开发板的Linux系统开机时间从当前~60秒优化至≤20秒(上电启动至系统完全
发表于 12-16 22:17
Coremark测试集分析与性能优化思路
一段时间修改输入(注入错误)并重复状态机操作。将输入修改回原始形式。
4. 设计意图
编译器在不断改进,在分析代码方面做得越来越好。而coremark的出现就是为了解决“Dhrystone的主要部分
发表于 10-24 08:21
Linux系统性能优化技巧
经过10年一线运维经验,我发现大多数工程师只掌握了Linux优化的冰山一角。今天分享的这些秘技,能让你的系统性能提升200%以上!
Linux系统性能指南
Linux服务器运行了很多应用,在高负载下,服务器可能会出现性能瓶颈,例如CPU利用率过高、内存不足、磁盘I/O瓶颈等,从而导致系统卡顿,服务无法正常运行等问题。所以针对以上问题,可以通过调整内核参数和系统的相关组件,优化应用程
推进电机端盖结构的抗冲击分析及优化
。同时以此为基础,在保证推进电机的抗冲击性能的约束前提条件下,以提高电机的转矩密度为目标,建立了相应的数学模型和参数化的有限元模型,对该结构进行了设计优化,为实际工程设计了奠定基础。
纯分享帖,需要者可点
发表于 06-23 07:12
开源系统适配:聚徽分享国产工控平板在 Linux / 鸿蒙系统下的技术优化
在工业自动化与智能化加速推进的当下,国产工控平板的系统适配成为提升设备性能与竞争力的关键环节。Linux 和鸿蒙作为开源系统,凭借其高度的开放性与可定制性,为国产工控平板带来新的发展机遇。如何对国产
鸿蒙5开发宝藏案例分享---Grid性能优化案例
发现鸿蒙宝藏:优化Grid组件性能的实战技巧!
大家好呀!最近在鸿蒙开发者社区挖到一个超实用的性能优化案例—— 解决Grid组件加载慢、滚动卡顿的问题 。官方其实藏了不少宝藏案例,但很
发表于 06-12 17:47
鸿蒙5开发宝藏案例分享---性能优化案例解析
鸿蒙性能优化宝藏指南:实战工具与代码案例解析
大家好呀!今天在翻鸿蒙开发者文档时,意外挖到一个 性能优化宝藏库 ——原来官方早就提供了超多实用工具和案例,但很多小伙伴可能没发现!这篇就
发表于 06-12 16:36
手把手教你如何调优Linux网络参数
在高并发网络服务场景中,Linux内核的默认网络参数往往无法满足需求,导致性能瓶颈、连接超时甚至服务崩溃。本文基于真实案例分析,从参数解读、问题诊断到优化实践,手把手教你如何调优
VirtualLab:光栅的优化与分析
光栅是光学工程师使用的最基本的工具。为了设计和分析这类组件,快速物理光学建模和设计软件VirtualLab Fusion为用户提供了许多有用的工具。其中包括参数优化,以轻松优化系统,以及参数运行,它
发表于 05-23 08:49
Linux问题分析与性能优化
评论