DynamoRIO中处理异常栈指针与可写可执行页面的技术分析
2025-06-28 18:23:15作者:柏廷章Berta
背景介绍
DynamoRIO是一款功能强大的动态二进制插桩框架,它能够在运行时对程序进行代码转换和监控。在AArch64架构下,当应用程序在可写可执行页面中运行代码,并且栈指针(SP)被设置为非法值时,DynamoRIO的DEBUG版本会出现断言失败的问题。
问题现象
在DEBUG模式下运行特定测试程序时,DynamoRIO会在vmareas.c文件的3913行触发断言失败:ASSERT: "vmareas.c:3913 !dynamo_started"。该测试程序具有以下关键特征:
- 使用
mmap创建了一个同时具有可写(PROT_WRITE)和可执行(PROT_EXEC)权限的内存页 - 在该页中写入了一个简单的RET指令(机器码0xd65f03c0)
- 通过汇编辅助函数调用该代码,调用前将栈指针(SP)设置为非法值1
技术分析
断言的作用
原始断言ASSERT(!dynamo_started)的目的是确保在DynamoRIO未完全启动时不会执行某些操作。然而,在以下两种情况下会出现合法访问:
dr_prepopulate_cache()函数调用时(属于DynamoRIO自身的初始化过程)- 应用程序故意在可写可执行内存中运行代码,并设置异常栈指针
问题本质
这个断言过于严格,实际上DynamoRIO应该能够处理应用程序的这种特殊行为。特别是在生产环境中(非DEBUG模式),DynamoRIO已经能够正确处理这种情况,说明这不是一个功能性问题,而是DEBUG模式下的过度检查。
解决方案
开发团队经过讨论后决定:
- 将硬性断言改为
ASSERT_CURIOSITY,这是一个更温和的检查方式,不会导致程序终止 - 同时添加
SYSLOG_INTERNAL_WARNING日志,以便开发者了解这种特殊情况的发生
这种修改既保留了调试信息,又不会影响正常功能的执行。
技术意义
这个问题的解决体现了DynamoRIO对边缘情况的处理能力:
- 支持应用程序在可写可执行内存中运行代码
- 能够容忍异常的栈指针设置
- 区分DEBUG模式和生产环境的检查强度
这种灵活性对于二进制分析工具尤为重要,因为被分析的程序可能包含各种非标准行为,分析工具需要尽可能包容这些行为,同时提供足够的调试信息。
最佳实践建议
对于使用DynamoRIO的开发者,建议:
- 避免在正式版本中使用DEBUG构建,除非确实需要额外的检查
- 对于需要在可写可执行内存中运行代码的场景,确保充分测试
- 关注系统日志中的警告信息,及时了解潜在问题
这个问题的解决展示了DynamoRIO作为专业级动态二进制插桩框架的成熟度和对边缘情况的处理能力。
登录后查看全文
热门项目推荐
相关项目推荐
atomcodeClaude Code 的开源替代方案。连接任意大模型,编辑代码,运行命令,自动验证 — 全自动执行。用 Rust 构建,极致性能。 | An open-source alternative to Claude Code. Connect any LLM, edit code, run commands, and verify changes — autonomously. Built in Rust for speed. Get StartedRust0216
cann-learning-hubCANN 学习中心仓,支持在线互动运行、边学边练,提供教程、示例与优化方案,一站式助力昇腾开发者快速上手。Jupyter Notebook0138
uni-appA cross-platform framework using Vue.jsJavaScript08
GLM-5.2智谱开源 GLM-5.2,这是针对长文本任务的最新旗舰模型。相较于前代产品 GLM-5.1,它在长文本任务处理能力上实现了显著飞跃,并且首次在稳定的 100 万 token 上下文中提供这一能力。Jinja00
SwanLab⚡️SwanLab - an open-source, modern-design AI training tracking and visualization tool. Supports Cloud / Self-hosted use. Integrated with PyTorch / Transformers / LLaMA Factory / veRL/ Swift / Ultralytics / MMEngine / Keras etc.Python00
tiny-universe《大模型白盒子构建指南》:一个全手搓的Tiny-UniverseJupyter Notebook03
项目优选
收起
deepin linux kernel
C
32
16
openEuler内核是openEuler操作系统的核心,既是系统性能与稳定性的基石,也是连接处理器、设备与服务的桥梁。
C
471
465
Ascend Extension for PyTorch
Python
758
968
昇腾LLM分布式训练框架
Python
185
231
本项目是CANN提供的神经网络类计算算子库,实现网络在NPU上加速计算。
C++
698
1.4 K
本项目是CANN提供的transformer类大模型算子库,实现网络在NPU上加速计算。
C++
878
2.03 K
暂无描述
Dockerfile
780
5.08 K
🔥LeetCode solutions in any programming language | 多种编程语言实现 LeetCode、《剑指 Offer(第 2 版)》、《程序员面试金典(第 6 版)》题解
Java
70
22
本仓库是 Flutter SDK 与 Flutter Engine 的 OpenHarmony 适配版本,由 CPF-Flutter 团队维护。开发者可使用熟悉的 Flutter 技术栈开发 OpenHarmony 应用,3.35.7 及以后的适配版本可基于本仓库源码构建支持 OpenHarmony 的 Flutter Engine。
Dart
1.04 K
271
Claude Code 的开源替代方案。连接任意大模型,编辑代码,运行命令,自动验证 — 全自动执行。用 Rust 构建,极致性能。 | An open-source alternative to Claude Code. Connect any LLM, edit code, run commands, and verify changes — autonomously. Built in Rust for speed.
Get Started
Rust
2.08 K
216