Async-profiler中jfr2flame工具处理线程状态的问题解析

2025-05-28 02:47:56作者：宗隆裙

问题背景

在性能分析领域，async-profiler是一个广泛使用的Java应用性能分析工具，它能够生成JFR格式的性能数据文件。而jfr2flame则是配套工具，用于将JFR文件转换为直观的火焰图。然而，当启用jfrsync选项时，jfr2flame在处理同时包含cpu和wall事件的JFR文件时出现了异常。

问题现象

具体表现为：

使用--state DEFAULT参数时，生成的火焰图包含了所有执行样本，而不仅仅是CPU样本
使用--state RUNNABLE,SLEEPING参数时，生成的火焰图为空

技术分析

经过深入分析，发现问题根源在于线程状态的表示方式差异。当不启用jfrsync时，async-profiler使用自定义的状态值：

0=STATE_DEFAULT
1=STATE_RUNNABLE
2=STATE_SLEEPING

这些值与async-profiler源码中定义的常量完全一致。然而，当启用jfrsync后，线程状态采用了JVMTI的标准状态值：

0=STATE_NEW
5=STATE_RUNNABLE
225=STATE_SLEEPING
其他各种等待/阻塞状态

这种差异导致jfr2flame工具无法正确识别和过滤特定的线程状态，从而产生错误的火焰图输出。

解决方案

该问题已在最新版本中得到修复。现在推荐使用更简洁的命令行参数：

jfrconv --cpu 输入文件.jfr 输出cpu火焰图.html
jfrconv --wall 输入文件.jfr 输出wall火焰图.html

原有的--state参数仍然支持，但可以简写为：

jfrconv -s run,sleep 输入文件.jfr 输出wall火焰图.html

技术启示

这个问题揭示了性能分析工具中一个重要的技术细节：线程状态的标准化表示。在Java生态中，存在多种线程状态表示方式：

JVM内部状态
JVMTI标准状态
各性能工具自定义状态

当工具链中的不同组件采用不同的状态表示时，就可能出现兼容性问题。async-profiler的修复方案展示了如何正确处理这种差异，确保在不同配置下都能生成准确的性能分析结果。

对于性能分析工程师来说，理解这些底层细节有助于更准确地解读分析结果，并在遇到异常时能够快速定位问题根源。同时，这也提醒我们在使用性能分析工具时，要注意各组件版本的兼容性，特别是当使用高级特性（如jfrsync）时。

async-profiler

Sampling CPU and HEAP profiler for Java featuring AsyncGetCallTrace + perf_events

项目地址：https://gitcode.com/GitHub_Trending/as/async-profiler

登录后查看全文

项目优选

收起

kernel

deepin linux kernel

docs

OpenHarmony documentation | OpenHarmony开发者文档

Ascend Extension for PyTorch

本项目是CANN提供的数学类基础计算算子库，实现网络在NPU上加速计算。

openEuler内核是openEuler操作系统的核心，既是系统性能与稳定性的基石，也是连接处理器、设备与服务的桥梁。

Nop Platform 2.0是基于可逆计算理论实现的采用面向语言编程范式的新一代低代码开发平台，包含基于全新原理从零开始研发的GraphQL引擎、ORM引擎、工作流引擎、报表引擎、规则引擎、批处理引引擎等完整设计。nop-entropy是它的后端部分，采用java语言实现，可选择集成Spring框架或者Quarkus框架。中小企业可以免费商用

Java

leetcode

🔥LeetCode solutions in any programming language | 多种编程语言实现 LeetCode、《剑指 Offer（第 2 版）》、《程序员面试金典（第 6 版）》题解

Java

RuoYi-Vue3

🎉 (RuoYi)官方仓库基于SpringBoot，Spring Security，JWT，Vue3 & Vite、Element Plus 的前后端分离权限管理系统

Vue

1.37 K

781