Linux Perf性能分析常用手段(火焰图,gprof,kernelshark,bts)

2023-10-07 02:40

本文主要是介绍Linux Perf性能分析常用手段(火焰图,gprof,kernelshark,bts),希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

系统级性能优化通常包括两个阶段:性能剖析(performance profiling)和代码优化。性能剖析的目标是寻找性能瓶颈,查找引发性能问题的原因及热点代码。代码优化的目标是针对具体性能问题而优化代码或编译选项,以改善软件性能。本篇主要讲性能分析中常用的工具——perf。

Perf 原理如下图所示:

Perf依赖如下组建实现功能:

1)PMU:性能监控单元(Performance Monitor Unit), CPU提供的一个性能监视单元,用于统计CPU性能数据;
2)Tracepoint:散落在内核源代码中的一些 hook,它们可以在特定的代码被运行到时被触发,这一特性可以被各种 trace/debug 工具所使用。
3)内核运行状态计数,例如:  1) 进程切换   2) Page fault   3) 中断计数,记录在内核数据中。

perf event事件分为三种:

  • Hardware Event由PMU部件产生,在特定的条件下探测性能事件是否发生以及发生的次数。比如cache命中。
  • Software Event是内核产生的事件,分布在各个功能模块中,统计和操作系统相关性能事件。比如进程切换,tick数等。
  • Tracepoint Event是内核中静态tracepoint所触发的事件,这些tracepoint用来判断程序运行期间内核的行为细节,比如slab分配器的分配次数等。

下面开始介绍Perf的使用:

0:编译Perf

安装依赖:

sudo apt-get install libgtk2.0-dev libaudit-dev libdwarf-dev libbfd-dev libnuma-dev libperl-dev libzstd-dev libdw-dev

Perf是开源代码,你可以选择安装DEB包的方式使用,也是自行编译。任何人都可以下载编译,Perf代码在LINUX内核目录树中,进入内核tools/perf目录,执行 make

如果想用gdb debug perf,则需要修改MAKEFILE重新编译:

export DEBUG=1

之后修改tools/perf/Makefile.config,将编译优化级别降低为-O0.

1.安装perf

$ uname -r
5.4.0-81-generic
$ sudo apt install linux-tools-common
$ sudo apt install linux-tools-5.4.0-81-generic
$ sudo apt install trace-cmd
$ sudo apt install kernelshark
$ sudo apt-get install linux-tools-common linux-tools-"$(uname -r)" linux-cloud-tools-"$(uname -r)" linux-tools-generic linux-cloud-tools-generic

 2.生成data:

使用方法,以分析pid为123456的cpu-clock情况,延时5秒,并查看函数调用

sudo perf record -p 123456 -g -e cpu-clock sleep 5

生成perf.data,下面拿一个进行堆排序的程序为例,对齐进行火焰图分析:

czl@czl-VirtualBox:~/flame$ pidof a.out
10007
czl@czl-VirtualBox:~/flame$ sudo perf record -F 99 -p 10007 -g -- sleep 30
[ perf record: Woken up 1 times to write data ]
[ perf record: Captured and wrote 0.100 MB perf.data (747 samples) ]
czl@czl-VirtualBox:~/flame$ 

perf record 表示采集系统事件, 没有使用 -e 指定采集事件, 则默认采集 cycles(即 CPU clock 周期), -F 99 表示每秒 99 次, -p 13204 是进程号, 即对哪个进程进行分析, -g 表示记录调用栈, sleep 30 则是持续 30 秒.-F 指定采样频率为 99Hz(每秒99次), 如果 99次 都返回同一个函数名, 那就说明 CPU 这一秒钟都在执行同一个函数, 可能存在性能问题.

此时生成的perf.data已经包含了这段时间内的系统采样信息,保存下来的静态信息可以用来进行下一步的分析,这样做的好处是可以不用实时在线,后续可以用离线的数据进行分析。比如,可以执行如下命令,看一下当前数据代表的perf top输出。

$ sudo perf report -i perf.data

热点汇编指令:

 3.分析perf.data

执行如下命令

sudo perf report -n --stdio
# To display the perf.data header info, please use --header/--header-only options.
#
#
# Total Lost Samples: 0
#
# Samples: 747  of event 'cpu-clock:pppH'
# Event count (approx.): 7545454470
#
# Children      Self       Samples  Command  Shared Object      Symbol                            
# ........  ........  ............  .......  .................  ..................................
#70.41%     5.89%            44  a.out    libc-2.27.so       [.] __GI___libc_write|          |--64.52%--__GI___libc_write|          entry_SYSCALL_64_after_hwframe|          |          |           --64.39%--do_syscall_64|                     |          |                     |--42.03%--__x64_sys_write|                     |          ksys_write|                     |          |          |                     |          |--39.89%--vfs_write|                     |          |          |          |                     |          |           --38.42%--__vfs_write|                     |          |                     |          |                     |          |                      --38.02%--tty_write|                     |          |                                |          |                     |          |                                |--35.07%--n_tty_write|                     |          |                                |          |          |                     |          |                                |          |--21.02%--mutex_lock|                     |          |                                |          |          |          |                     |          |                                |          |           --20.62%--_cond_resched|                     |          |                                |          |                     |          |                     |          |                                |          |                      --20.35%--__schedule|                     |          |                                |          |                                |          |                     |          |                                |          |                                 --20.21%--finish_task_switch|                     |          |                                |          |          |                     |          |                                |          |--5.35%--pty_write|                     |          |                                |          |          |          |                     |          |                                |          |          |--4.28%--tty_flip_buffer_push|                     |          |                                |          |          |          |          |                     |          |                                |          |          |           --4.15%--queue_work_on|                     |          |                                |          |          |          |                     |          |                                |          |           --0.80%--__lock_text_start|                     |          |                                |          |          |                     |          |                                |          |--3.88%--do_output_char|                     |          |                                |          |          |          |                     |          |                                |          |           --3.75%--pty_write|                     |          |                                |          |                     |          |                     |          |                                |          |                     |--2.95%--tty_flip_buffer_push|                     |          |                                |          |                     |          queue_work_on|                     |          |                                |          |                     |          |                     |          |                                |          |                      --0.67%--__lock_text_start|                     |          |                                |          |          |                     |          |                                |          |--1.07%--wait_woken|                     |          |                                |          |          schedule_timeout|                     |          |                                |          |          schedule|                     |          |                                |          |          __schedule|                     |          |                                |          |          finish_task_switch|                     |          |                                |          |          |                     |          |                                |           --0.54%--tty_write_room|                     |          |                                |                     tty_buffer_space_avail|                     |          |                                |          |                     |          |                                 --0.80%--__virt_addr_valid|                     |          |          |                     |           --1.47%--__fdget_pos|                     |                     |          |                     |                      --1.34%--__fget_light|                     |          |                      --20.88%--exit_to_usermode_loop|                                |          |                                 --20.62%--schedule|                                           |          |                                            --20.48%--__schedule|                                                      |          |                                                       --20.35%--finish_task_switch|          |--1.07%--0x3020203120203220|          __GI___libc_write|          |--0.94%--0x3220203120203020|          __GI___libc_write|          |--0.80%--0x3620203420203720|          __GI___libc_write|          |--0.67%--0x3520203420203620|          __GI___libc_write|          |--0.67%--0x3220203320203420|          __GI___libc_write|          |--0.54%--0x3220203420203520|          __GI___libc_write|          --0.54%--0x3220203020203120__GI___libc_write64.52%     0.00%             0  a.out    [kernel.kallsyms]  [k] entry_SYSCALL_64_after_hwframe|---entry_SYSCALL_64_after_hwframe|          --64.39%--do_syscall_64|          |--42.03%--__x64_sys_write|          ksys_write|          |          |          |--39.89%--vfs_write|          |          |          |          |           --38.42%--__vfs_write|          |                     |          |          |                      --38.02%--tty_write|          |                                |          |          |                                |--35.07%--n_tty_write|          |                                |          |          |          |                                |          |--21.02%--mutex_lock|          |                                |          |          |          |          |                                |          |           --20.62%--_cond_resched|          |                                |          |                     |          |          |                                |          |                      --20.35%--__schedule|          |                                |          |                                |          |          |                                |          |                                 --20.21%--finish_task_switch|          |                                |          |          |          |                                |          |--5.35%--pty_write|          |                                |          |          |          |          |                                |          |          |--4.28%--tty_flip_buffer_push|          |                                |          |          |          |          |          |                                |          |          |           --4.15%--queue_work_on|          |                                |          |          |          |          |                                |          |           --0.80%--__lock_text_start|          |                                |          |          |          |                                |          |--3.88%--do_output_char|          |                                |          |          |          |          |                                |          |           --3.75%--pty_write|          |                                |          |                     |          |          |                                |          |                     |--2.95%--tty_flip_buffer_push|          |                                |          |                     |          queue_work_on|          |                                |          |                     |          |          |                                |          |                      --0.67%--__lock_text_start|          |                                |          |          |          |                                |          |--1.07%--wait_woken|          |                                |          |          schedule_timeout|          |                                |          |          schedule|          |                                |          |          __schedule|          |                                |          |          finish_task_switch|          |                                |          |          |          |                                |           --0.54%--tty_write_room|          |                                |                     tty_buffer_space_avail|          |                                |          |          |                                 --0.80%--__virt_addr_valid|          |          |           --1.47%--__fdget_pos|                     |          |                      --1.34%--__fget_light|          --20.88%--exit_to_usermode_loop|          --20.62%--schedule|          --20.48%--__schedule|          --20.35%--finish_task_switch64.39%     1.47%            11  a.out    [kernel.kallsyms]  [k] do_syscall_64|          --62.92%--do_syscall_64|          |--42.03%--__x64_sys_write|          ksys_write|          |          |          |--39.89%--vfs_write|          |          |          |          |           --38.42%--__vfs_write|          |                     |          |          |                      --38.02%--tty_write|          |                                |          |          |                                |--35.07%--n_tty_write|          |                                |          |          |          |                                |          |--21.02%--mutex_lock|          |                                |          |          |          |          |                                |          |           --20.62%--_cond_resched|          |                                |          |                     |          |          |                                |          |                      --20.35%--__schedule|          |                                |          |                                |          |          |                                |          |                                 --20.21%--finish_task_switch|          |                                |          |          |          |                                |          |--5.35%--pty_write|          |                                |          |          |          |          |                                |          |          |--4.28%--tty_flip_buffer_push|          |                                |          |          |          |          |          |                                |          |          |           --4.15%--queue_work_on|          |                                |          |          |          |          |                                |          |           --0.80%--__lock_text_start|          |                                |          |          |          |                                |          |--3.88%--do_output_char|          |                                |          |          |          |          |                                |          |           --3.75%--pty_write|          |                                |          |                     |          |          |                                |          |                     |--2.95%--tty_flip_buffer_push|          |                                |          |                     |          queue_work_on|          |                                |          |                     |          |          |                                |          |                      --0.67%--__lock_text_start|          |                                |          |          |          |                                |          |--1.07%--wait_woken|          |                                |          |          schedule_timeout|          |                                |          |          schedule|          |                                |          |          __schedule|          |                                |          |          finish_task_switch|          |                                |          |          |          |                                |           --0.54%--tty_write_room|          |                                |                     tty_buffer_space_avail|          |                                |          |          |                                 --0.80%--__virt_addr_valid|          |          |           --1.47%--__fdget_pos|                     |          |                      --1.34%--__fget_light|          --20.88%--exit_to_usermode_loop|          --20.62%--schedule|          --20.48%--__schedule|          --20.35%--finish_task_switch42.17%     0.13%             1  a.out    [kernel.kallsyms]  [k] __x64_sys_write|          --42.03%--__x64_sys_writeksys_write|          |--39.89%--vfs_write|          |          |           --38.42%--__vfs_write|                     |          |                      --38.02%--tty_write|                                |          |                                |--35.07%--n_tty_write|                                |          |          |                                |          |--21.02%--mutex_lock|                                |          |          |          |                                |          |           --20.62%--_cond_resched|                                |          |                     |          |                                |          |                      --20.35%--__schedule|                                |          |                                |          |                                |          |                                 --20.21%--finish_task_switch|                                |          |          |                                |          |--5.35%--pty_write|                                |          |          |          |                                |          |          |--4.28%--tty_flip_buffer_push|                                |          |          |          |          |                                |          |          |           --4.15%--queue_work_on|                                |          |          |          |                                |          |           --0.80%--__lock_text_start|                                |          |          |                                |          |--3.88%--do_output_char|                                |          |          |          |                                |          |           --3.75%--pty_write|                                |          |                     |          |                                |          |                     |--2.95%--tty_flip_buffer_push|                                |          |                     |          queue_work_on|                                |          |                     |          |                                |          |                      --0.67%--__lock_text_start|                                |          |          |                                |          |--1.07%--wait_woken|                                |          |          schedule_timeout|                                |          |          schedule|                                |          |          __schedule|                                |          |          finish_task_switch|                                |          |          |                                |           --0.54%--tty_write_room|                                |                     tty_buffer_space_avail|                                |          |                                 --0.80%--__virt_addr_valid|          --1.47%--__fdget_pos|          --1.34%--__fget_light42.03%     0.13%             1  a.out    [kernel.kallsyms]  [k] ksys_write|          --41.90%--ksys_write|          |--39.89%--vfs_write|          |          |           --38.42%--__vfs_write|                     |          |                      --38.02%--tty_write|                                |          |                                |--35.07%--n_tty_write|                                |          |          |                                |          |--21.02%--mutex_lock|                                |          |          |          |                                |          |           --20.62%--_cond_resched|                                |          |                     |          |                                |          |                      --20.35%--__schedule|                                |          |                                |          |                                |          |                                 --20.21%--finish_task_switch|                                |          |          |                                |          |--5.35%--pty_write|                                |          |          |          |                                |          |          |--4.28%--tty_flip_buffer_push|                                |          |          |          |          |                                |          |          |           --4.15%--queue_work_on|                                |          |          |          |                                |          |           --0.80%--__lock_text_start|                                |          |          |                                |          |--3.88%--do_output_char|                                |          |          |          |                                |          |           --3.75%--pty_write|                                |          |                     |          |                                |          |                     |--2.95%--tty_flip_buffer_push|                                |          |                     |          queue_work_on|                                |          |                     |          |                                |          |                      --0.67%--__lock_text_start|                                |          |          |                                |          |--1.07%--wait_woken|                                |          |          schedule_timeout|                                |          |          schedule|                                |          |          __schedule|                                |          |          finish_task_switch|                                |          |          |                                |           --0.54%--tty_write_room|                                |                     tty_buffer_space_avail|                                |          |                                 --0.80%--__virt_addr_valid|          --1.47%--__fdget_pos|          --1.34%--__fget_light41.90%     0.27%             2  a.out    [kernel.kallsyms]  [k] __schedule|          --41.63%--__schedulefinish_task_switch41.63%    41.63%           311  a.out    [kernel.kallsyms]  [k] finish_task_switch|          |--7.36%--0x3220203120203020|          __GI___libc_write|          entry_SYSCALL_64_after_hwframe|          do_syscall_64|          |          |          |--5.35%--exit_to_usermode_loop|          |          schedule|          |          __schedule|          |          finish_task_switch|          |          |           --2.01%--__x64_sys_write|                     ksys_write|                     vfs_write|                     __vfs_write|                     tty_write|                     n_tty_write|                     mutex_lock|                     _cond_resched|                     __schedule|                     finish_task_switch|          |--5.35%--0x3220203020203120|          __GI___libc_write|          entry_SYSCALL_64_after_hwframe|          do_syscall_64|          |          |          |--2.81%--exit_to_usermode_loop|          |          schedule|          |          __schedule|          |          finish_task_switch|          |          |           --2.54%--__x64_sys_write|                     ksys_write|                     vfs_write|                     __vfs_write|                     tty_write|                     n_tty_write|                     |          |                      --2.28%--mutex_lock|                                _cond_resched|                                __schedule|                                finish_task_switch|          |--5.09%--0x3220203120203320|          __GI___libc_write|          entry_SYSCALL_64_after_hwframe|          do_syscall_64|          |          |          |--2.54%--__x64_sys_write|          |          ksys_write|          |          vfs_write|          |          __vfs_write|          |          tty_write|          |          n_tty_write|          |          mutex_lock|          |          _cond_resched|          |          __schedule|          |          finish_task_switch|          |          |           --2.54%--exit_to_usermode_loop|                     schedule|                     __schedule|                     finish_task_switch|          |--4.55%--0x3620203720203820|          __GI___libc_write|          entry_SYSCALL_64_after_hwframe|          do_syscall_64|          |          |          |--2.68%--__x64_sys_write|          |          ksys_write|          |          vfs_write|          |          __vfs_write|          |          tty_write|          |          n_tty_write|          |          mutex_lock|          |          _cond_resched|          |          __schedule|          |          finish_task_switch|          |          |           --1.87%--exit_to_usermode_loop|                     schedule|                     __schedule|                     finish_task_switch|          |--4.28%--0x3220203420203520|          __GI___libc_write|          entry_SYSCALL_64_after_hwframe|          do_syscall_64|          |          |          |--2.68%--__x64_sys_write|          |          ksys_write|          |          vfs_write|          |          __vfs_write|          |          tty_write|          |          n_tty_write|          |          mutex_lock|          |          _cond_resched|          |          __schedule|          |          finish_task_switch|          |          |           --1.61%--exit_to_usermode_loop|                     schedule|                     __schedule|                     finish_task_switch|          |--4.15%--0x3520203420203620|          __GI___libc_write|          entry_SYSCALL_64_after_hwframe|          do_syscall_64|          |          |          |--2.28%--__x64_sys_write|          |          ksys_write|          |          vfs_write|          |          __vfs_write|          |          tty_write|          |          n_tty_write|          |          mutex_lock|          |          _cond_resched|          |          __schedule|          |          finish_task_switch|          |          |           --1.87%--exit_to_usermode_loop|                     schedule|                     __schedule|                     finish_task_switch|          |--4.15%--0x3220203320203420|          __GI___libc_write|          entry_SYSCALL_64_after_hwframe|          do_syscall_64|          |          |          |--2.68%--__x64_sys_write|          |          ksys_write|          |          vfs_write|          |          __vfs_write|          |          tty_write|          |          n_tty_write|          |          |          |          |           --2.41%--mutex_lock|          |                     _cond_resched|          |                     __schedule|          |                     finish_task_switch|          |          |           --1.47%--exit_to_usermode_loop|                     schedule|                     __schedule|                     finish_task_switch|          |--4.02%--0x3620203420203720|          __GI___libc_write|          entry_SYSCALL_64_after_hwframe|          do_syscall_64|          |          |          |--2.68%--__x64_sys_write|          |          ksys_write|          |          vfs_write|          |          __vfs_write|          |          tty_write|          |          n_tty_write|          |          |          |          |          |--2.14%--mutex_lock|          |          |          _cond_resched|          |          |          __schedule|          |          |          finish_task_switch|          |          |          |          |           --0.54%--wait_woken|          |                     schedule_timeout|          |                     schedule|          |                     __schedule|          |                     finish_task_switch|          |          |           --1.34%--exit_to_usermode_loop|                     schedule|                     __schedule|                     finish_task_switch|          --2.68%--0x3020203120203220__GI___libc_writeentry_SYSCALL_64_after_hwframedo_syscall_64|          |--1.47%--exit_to_usermode_loop|          schedule|          __schedule|          finish_task_switch|          --1.20%--__x64_sys_writeksys_writevfs_write__vfs_writetty_writen_tty_writemutex_lock_cond_resched__schedulefinish_task_switch39.89%     0.54%      

这篇关于Linux Perf性能分析常用手段(火焰图,gprof,kernelshark,bts)的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/155532

相关文章

Linux线程同步/互斥过程详解

《Linux线程同步/互斥过程详解》文章讲解多线程并发访问导致竞态条件,需通过互斥锁、原子操作和条件变量实现线程安全与同步,分析死锁条件及避免方法,并介绍RAII封装技术提升资源管理效率... 目录01. 资源共享问题1.1 多线程并发访问1.2 临界区与临界资源1.3 锁的引入02. 多线程案例2.1 为

python panda库从基础到高级操作分析

《pythonpanda库从基础到高级操作分析》本文介绍了Pandas库的核心功能,包括处理结构化数据的Series和DataFrame数据结构,数据读取、清洗、分组聚合、合并、时间序列分析及大数据... 目录1. Pandas 概述2. 基本操作:数据读取与查看3. 索引操作:精准定位数据4. Group

MySQL中EXISTS与IN用法使用与对比分析

《MySQL中EXISTS与IN用法使用与对比分析》在MySQL中,EXISTS和IN都用于子查询中根据另一个查询的结果来过滤主查询的记录,本文将基于工作原理、效率和应用场景进行全面对比... 目录一、基本用法详解1. IN 运算符2. EXISTS 运算符二、EXISTS 与 IN 的选择策略三、性能对比

MySQL常用字符串函数示例和场景介绍

《MySQL常用字符串函数示例和场景介绍》MySQL提供了丰富的字符串函数帮助我们高效地对字符串进行处理、转换和分析,本文我将全面且深入地介绍MySQL常用的字符串函数,并结合具体示例和场景,帮你熟练... 目录一、字符串函数概述1.1 字符串函数的作用1.2 字符串函数分类二、字符串长度与统计函数2.1

Oracle数据库定时备份脚本方式(Linux)

《Oracle数据库定时备份脚本方式(Linux)》文章介绍Oracle数据库自动备份方案,包含主机备份传输与备机解压导入流程,强调需提前全量删除原库数据避免报错,并需配置无密传输、定时任务及验证脚本... 目录说明主机脚本备机上自动导库脚本整个自动备份oracle数据库的过程(建议全程用root用户)总结

MySQL 内存使用率常用分析语句

《MySQL内存使用率常用分析语句》用户整理了MySQL内存占用过高的分析方法,涵盖操作系统层确认及数据库层bufferpool、内存模块差值、线程状态、performance_schema性能数据... 目录一、 OS层二、 DB层1. 全局情况2. 内存占js用详情最近连续遇到mysql内存占用过高导致

Linux如何查看文件权限的命令

《Linux如何查看文件权限的命令》Linux中使用ls-R命令递归查看指定目录及子目录下所有文件和文件夹的权限信息,以列表形式展示权限位、所有者、组等详细内容... 目录linux China编程查看文件权限命令输出结果示例这里是查看tomcat文件夹总结Linux 查看文件权限命令ls -l 文件或文件夹

idea的终端(Terminal)cmd的命令换成linux的命令详解

《idea的终端(Terminal)cmd的命令换成linux的命令详解》本文介绍IDEA配置Git的步骤:安装Git、修改终端设置并重启IDEA,强调顺序,作为个人经验分享,希望提供参考并支持脚本之... 目录一编程、设置前二、前置条件三、android设置四、设置后总结一、php设置前二、前置条件

深度解析Nginx日志分析与499状态码问题解决

《深度解析Nginx日志分析与499状态码问题解决》在Web服务器运维和性能优化过程中,Nginx日志是排查问题的重要依据,本文将围绕Nginx日志分析、499状态码的成因、排查方法及解决方案展开讨论... 目录前言1. Nginx日志基础1.1 Nginx日志存放位置1.2 Nginx日志格式2. 499

Linux系统中查询JDK安装目录的几种常用方法

《Linux系统中查询JDK安装目录的几种常用方法》:本文主要介绍Linux系统中查询JDK安装目录的几种常用方法,方法分别是通过update-alternatives、Java命令、环境变量及目... 目录方法 1:通过update-alternatives查询(推荐)方法 2:检查所有已安装的 JDK方