由于cpu能耗优化的原因,火焰图有时并不准确。为此,我们来做一个小实验。
(还不熟悉什么是火焰图的可以看看文章末尾火焰图系列文章汇总)
1.小实验
这是一个简单c程序,其实就是一个死循环,如下:
#includeint globalv;void dosth(){ globalv++;}int main(){ globalv = 0; for(;;) dosth(); return 0;}
编译后可执行程序名为 func。接下来我开了两个终端,分别使用 taskset将 func运行在cpu0和cpu1上:
taskset 0x1 ./functaskset 0x2 ./func
然后使用bcc+flamegraph绘制火焰图:
/bcc/profile -i -f 99 -daf 10 > out.profile/mnt/sdb/flamegraph/flamegraph.plout.svg
得到的火焰图:
我的测试环境是qemu/kvm, 32核。
我们可以看到,火焰图显示, func程序占用了近四分之一的cpu时间。但是由于我们把 func绑定在cpu0和1上执行,根据小学数学我们应该可以计算出来 func最多占用 2/32=6.25%的时间。
是不是有点不对?
2.原因
由于linux会对cpu进行能耗优化,在低负载的时候,cpu并不是满负荷工作(降频),因此对于idle的cpu,bcc的采样数会减少,从而导致总采样数减少。我们可以看到,我们的采样频率是99个样本/(min*cpu)。运行了10s,那么总的样本数应该大约为 99*10*32=31680。而实际的总采样数只有8197。分母小了,自然 func占用的cpu时间比例增加了。
3.解决办法
当然,我们可以修改cpufreq强制让所有满负荷工作。但是这样一来麻烦,二来我的测试环境是虚拟机,修改起来更加麻烦。我们希望用一个简单的方法解决。
这就要提到flamegraph的隐藏功能了。为什么叫隐藏功能?因为如果你简单地 ./flamegraph.pl--help他不会告诉你这个用法。但是实际上他已经实现了这个功能,语法是:
./flamegraph.pl --total=n out2.svg
其中n为用户规定的总采样数。在我们的示例中,应该是31680。这样,我们绘制出来的火焰图是这个样子的:
嗯,的确有点丑,但是6.26%才是 func真正消耗了的cpu时间比例。
4.关于cpu时间准确性的讨论
怎样才算是绘制了准确的火焰图呢?
考虑如下情形,如果cpu1满负荷运转执行 func110秒钟,而cpu2半负荷运转执行 func25秒钟,剩下5s是idle。
算法1::实际上 func1和 func2一起是占用了15s的cpu时间。根据计算, func占用的时间占总时间的 15s/(10s*32)=4.69%。
算法2:如果按照上面第三节所描述的方法绘制火焰图,采样结果应该是 func1有大约990个样本, func2有大约 990/2/2=248个样本,绘制出来的火焰图 func占比为 (990+248)/31680=3.9%
两者不相等!笔者认为,原因在于二者算法所获结果的含义不同。算法1计算出来的是在这种运行情形下实际 func的执行时间占比。而算法2计算出来(或者说绘制出来)的是在cpu满负荷运转下func的cpu时间占比。从现实来看,不同背景负载,不同情形下同一个workload的运行时间可能不同。当系统负载加重时,linux会自动控制cpufreq将cpu频率增加。单单查看在某一个情形下workload的cpu执行时间意义有限。但是,对于一个workload而言,他所需要占用的计算资源量往往是相同的。因此,从程序优化角度而言,采用第三节所描述的方法计算cpu满负载下应用程序的时间占比对于我们优化代码更具有指导性意义。
2022年下半年全球半导体芯片短缺将得到缓解
一名嵌入式软件工程师对生活的重新思考
OpenHarmony多媒体子系统的源码分析
IR2117内部结构及工作原理
HDMI继续演进 泰克提供高效方案
火焰图系列之使用火焰图隐藏功能提高绘制精度
PCB的板级电磁兼容问题
称重仪表的维护及注意事项
FPGA入门之功能描述-组合逻辑
基于STM32MP1的医疗应用 — 心电仪
什么是人工智能处理器
ADI公司推出了第四代宽带RF收发器ADRV9026
TCP IP转EtherCAT网关以太网和TCP协议区别
未来五年MCU的消费电子市场复合年度增长率将达10%
汇总几种典型主动均衡电路
关于标本对自动血凝仪检测结果的影响
全新车规级MCU GD32A503正式发布
华为荣耀8评测:500天不卡顿的高颜值旗舰,顶级工艺麒麟芯片加持!男神吴亦凡的颜值担当
常见单相电机实物接线电路图
苹果Apple Pay已在5.07亿部iPhone上激活 零售商和银行采用率增长20%