首页
/ async-profiler中nativemem未捕获所有内存分配的问题分析

async-profiler中nativemem未捕获所有内存分配的问题分析

2025-05-28 13:05:34作者:范靓好Udolf

问题背景

在Rust应用程序的性能分析过程中,开发者发现async-profiler的nativemem功能未能捕获所有的内存分配调用。与jemalloc/jeprof工具相比,async-profiler的结果中缺失了部分调用栈信息。这些缺失的调用栈包括通过__GI___libc_malloc_int_malloc等底层分配函数的路径。

技术分析

经过深入调查,发现async-profiler在内存分配拦截机制上存在两个关键问题:

  1. 特定分配函数未被拦截:async-profiler原本没有拦截像posix_memalign这样的特殊内存分配函数。这些函数在Rust的标准库中被广泛使用,特别是在处理对齐内存分配时。

  2. 函数入口点修补不完整:当函数引用同时存在于.rela.plt.rela.dyn节区时,async-profiler只修补了其中一个节区的引用,导致部分调用路径未被正确捕获。

解决方案

开发团队针对这两个问题进行了修复:

  1. 扩展了拦截范围,现在能够正确捕获posix_memalign等特殊分配函数。

  2. 改进了函数入口点修补机制,确保无论函数引用出现在哪个节区都能被正确拦截。

实际影响

这个问题特别影响Rust应用程序的分析,因为Rust的内存分配器会使用多种底层分配策略。修复后,async-profiler能够提供更完整的内存分配分析结果,与jemalloc等工具的结果更加一致。

技术细节

在Linux系统中,内存分配通常通过以下路径进行:

  • 应用程序调用标准库分配函数
  • 这些函数最终调用底层的内存管理实现
  • 性能分析工具通过拦截这些调用点来收集数据

async-profiler通过动态修补这些调用点来实现无侵入式的分析。之前的实现遗漏了一些特殊情况,现在已得到完善。

结论

这个修复使得async-profiler在内存分配分析方面更加可靠,特别是对于使用Rust等现代语言开发的应用程序。开发者现在可以更有信心地使用async-profiler来进行全面的内存性能分析。

登录后查看全文

项目优选

收起
Cangjie-ExamplesCangjie-Examples
本仓将收集和展示高质量的仓颉示例代码,欢迎大家投稿,让全世界看到您的妙趣设计,也让更多人通过您的编码理解和喜爱仓颉语言。
Cangjie
295
1 K
RuoYi-Vue3RuoYi-Vue3
🎉 (RuoYi)官方仓库 基于SpringBoot,Spring Security,JWT,Vue3 & Vite、Element Plus 的前后端分离权限管理系统
Vue
503
397
leetcodeleetcode
🔥LeetCode solutions in any programming language | 多种编程语言实现 LeetCode、《剑指 Offer(第 2 版)》、《程序员面试金典(第 6 版)》题解
Java
51
15
ohos_react_nativeohos_react_native
React Native鸿蒙化仓库
C++
114
199
openGauss-serveropenGauss-server
openGauss kernel ~ openGauss is an open source relational database management system
C++
61
144
openHiTLSopenHiTLS
旨在打造算法先进、性能卓越、高效敏捷、安全可靠的密码套件,通过轻量级、可剪裁的软件技术架构满足各行业不同场景的多样化要求,让密码技术应用更简单,同时探索后量子等先进算法创新实践,构建密码前沿技术底座!
C
97
251
HarmonyOS-ExamplesHarmonyOS-Examples
本仓将收集和展示仓颉鸿蒙应用示例代码,欢迎大家投稿,在仓颉鸿蒙社区展现你的妙趣设计!
Cangjie
357
342
CangjieMagicCangjieMagic
基于仓颉编程语言构建的 LLM Agent 开发框架,其主要特点包括:Agent DSL、支持 MCP 协议,支持模块化调用,支持任务智能规划。
Cangjie
581
41
cherry-studiocherry-studio
🍒 Cherry Studio 是一款支持多个 LLM 提供商的桌面客户端
TypeScript
377
37
杨帆测试平台杨帆测试平台
扬帆测试平台是一款高效、可靠的自动化测试平台,旨在帮助团队提升测试效率、降低测试成本。该平台包括用例管理、定时任务、执行记录等功能模块,支持多种类型的测试用例,目前支持API(http和grpc协议)、性能、CI调用等功能,并且可定制化,灵活满足不同场景的需求。 其中,支持批量执行、并发执行等高级功能。通过用例设置,可以设置用例的基本信息、运行配置、环境变量等,灵活控制用例的执行。
JavaScript
21
2