使用google-perftools剖析程序性能瓶颈

admin 7月前 113

1.perftools

       google-perftool,它是由google开发的用来分析C/C++程序性能的一套工具,这里的性能分析主要包括内存和CPU两个方面,内存分析使用google-perftool所提供的tcmalloc,CPU分析使用它所提供的profiler。下面先分别介绍一下tcmalloc和profiler,然后再给出一些使用的例子,及一些使用时的注意事项。

2.详细介绍

(1)tcmalloc

       tcmalloc的全称是thread cache malloc,顾名思义,它是带有thread cache的内存管理工具。tcmalloc的主要优点有两个方面,一个是内存allocate/deallocate的速度,通常情况下它的速度比glibc所提供的malloc要快;另一个方面是小内存(< =32K)的管理,它的小内存是在thread cache里面管理的,一方面减少了加锁的开销,另一方面用来表示小内存所用的额外的空间也比较小,比较节省空间。因此,对于多线程下,经常小内存的allocation/deallocation的程序(尤其多线程下使用STL比较多的程序),可以尝试使用一下tcmalloc。

除了在allocate/deallocate内存时的优化外,tcmalloc还提供了heapcheck和heapprofile的功能。heap-check主要被用来检查程序中是否有内存泄露,在哪里泄露。tcmalloc另外一个功能是heap-profile。heap-profile,顾名思义,它就是描绘程序的heap轮廓,通过这样一个过程,我们就能知道,程序的heap里在每一时刻都有些啥东东。有了profile的结果,它可以帮助我们定位内存泄露,帮助我们发现一些频繁allocate内存的地方,以此来做一些优化。

(2)profiler

      profiler是由google-perftool所提供的用来做cpu-profile的工具。cpu-profile,它的主要功能就是通过采样的方式,给程序中cpu的使用情况进行“画像”,通过它所输出的结果,我们可以对程序中各个函数耗时情况一目了然。在对程序做性能优化的时候,这个是很重要的,先把最耗时的若干个操作优化好,程序的整体性能提升应该十分明显,这也是做性能优化的一个最为基本的原则—先优化最耗时的。

3.perftool的使用方式

关于google-perftool的使用,总体上来讲有以下三种方式:

(a)直接调用提供的api

这种方式比较适用于对于程序的某个局部来做分析的情况,直接在要做分析的局部调用相关的api即可。

(b)链接静态库

这种方式是最为常用的方式,后面会有详细的介绍。

(c)链接动态库

这种方式和静态库的方式差不多,但通常不推荐使用,除非使用者不想额外链一个静态库(因为链接静态库会增大binary的大小)的情况,可以考虑使用这种方式。

对于链接静态库的使用方式具体操作方式如下:

(1)heap-checker
gcc [...] -o myprogram -ltcmalloc
env HEAPCHECK=normal ./myprogram
 
(2)heap-profiler:
gcc [...] -o myprogram -ltcmalloc
env HEAPPROFILE=./myprogram.hprof ./myprogram
 
(3)cpu-profiler:
gcc [...] -o myprogram -lprofiler
env CPUPROFILE=./myprogram.prof ./myprogram

4.可视化转换工具pprof      

      通过上面的方法,可以生成google-perftool原始的输出结果。另外,google-perftool还提供了一个叫pprof的工具,它是一个perl的脚本,通过这个工具,可以将google-perftool的输出结果分析得更为直观,输出为图片、pdf等格式。

      假设被分析的程序二进制文件名为codeTest,perftools工具的原始结果输出为MyProfile,那么可以将原始输出转化成更友好的结果展示,如下:

#将perftools的原始输出转换成gv格式的可视化输出
pprof --gv ./codeTest MyProfile
#将perftools的原始输出转换成pdf格式的可视化输出
pprof --pdf ./codeTest MyProfile > MyProfile.pdf

      经过pprof转换格式后的可视化输出的形式可以是下面的样子:

学习资料来源于:

http://www.wuzesheng.com/?p=2147

http://www.ibm.com/developerworks/cn/linux/l-cn-googleperf/index.html

http://www.cnblogs.com/GODYCA/archive/2013/05/28/3104281.html


少客联盟- 版权声明 1、本主题所有言论和图片纯属会员个人意见,与少客联盟立场无关。
2、本站所有主题由该帖子作者发表,该帖子作者admin少客联盟享有帖子相关版权。
3、少客联盟管理员和版主有权不事先通知发贴者而删除本文。
4、其他单位或个人使用、转载或引用本文时必须同时征得该帖子作者admin少客联盟的同意。
5、帖子作者须承担一切因本文发表而直接或间接导致的民事或刑事法律责任。
6、本帖部分内容转载自其它媒体,但并不代表本站赞同其观点和对其真实性负责。
7、如本帖侵犯到任何版权问题,请立即告知本站,本站将及时予与删除并致以最深的歉意。
8、官方反馈邮箱:chinasuc@chinasuc.cn


上一篇:4个企业数据库安全优秀做法
下一篇:Linux动态库和静态库
Whatever is worth doing is worth doing well. juvenile hacker league
最新回复 (0)
    • 少客联盟
      2
        登录 注册 QQ登录(停用)
返回