bdwgc项目在Solaris系统上的信号传递问题分析
2025-06-25 11:13:49作者:史锋燃Gardner
问题背景
在bdwgc项目中,当在Solaris系统上使用DEFAULT_VDB或64位模式时,会出现信号传递失败的问题。具体表现为测试程序gctest在执行过程中会报告"Signals delivery fails constantly"错误,有时甚至会导致程序挂起。
问题表现
该问题在两种配置下出现:
- 使用DEFAULT_VDB编译时
- 在64位模式下编译时
测试程序会输出类似以下错误信息:
Running on SOLARIS/SPARC target
Supported VDBs: manual default
Switched to incremental mode
Signals delivery fails constantly at GC 4808
根本原因分析
通过深入分析线程堆栈和程序行为,发现这是一个并发问题,具体表现为:
- 线程挂起功能(GC_ENABLE_SUSPEND_THREAD)存在缺陷
- 在线程清理过程中信号丢失
- 导致线程无法正确挂起和恢复
- 最终形成死锁状态
从堆栈跟踪可以看出,一个线程(Thread 61)在退出时尝试获取GC_lock,而另一个线程(Thread 60)则试图挂起自己,同时还有线程在等待被挂起的线程确认状态。
临时解决方案
目前可以通过以下方式临时解决该问题:
- 在配置时使用
--disable-gcj-support选项 - 或者直接修改配置,取消定义GC_ENABLE_SUSPEND_THREAD宏
这两种方法都能有效避免信号传递失败的问题,因为它们禁用了有缺陷的线程挂起功能。
长期解决方案
项目维护者已经确认需要修复GC_retry_signals在GC_suspend_thread中的实现。这将从根本上解决信号丢失导致的线程挂起问题。不过由于问题复杂性较高,这被标记为低优先级任务。
技术细节
在Solaris系统上,特别是SPARC架构下,信号处理和线程同步机制有其特殊性。当使用DEFAULT_VDB或64位模式时,内存访问模式和信号传递机制的变化会放大原本存在的线程同步问题。
线程挂起功能依赖于信号来通知目标线程暂停执行,但在Solaris环境下,特别是在线程清理过程中,这些信号可能会丢失,导致线程无法正确响应挂起请求,最终形成死锁。
结论
bdwgc在Solaris系统上的信号传递问题主要源于线程挂起功能的实现缺陷。虽然目前有临时解决方案,但长期来看需要完善GC_retry_signals机制。对于需要在Solaris上使用bdwgc的开发者,建议暂时禁用GC_ENABLE_SUSPEND_THREAD功能以避免此问题。
登录后查看全文
热门项目推荐
相关项目推荐
GLM-5智谱 AI 正式发布 GLM-5,旨在应对复杂系统工程和长时域智能体任务。Jinja00
GLM-5.1GLM-5.1是智谱迄今最智能的旗舰模型,也是目前全球最强的开源模型。GLM-5.1大大提高了代码能力,在完成长程任务方面提升尤为显著。和此前分钟级交互的模型不同,它能够在一次任务中独立、持续工作超过8小时,期间自主规划、执行、自我进化,最终交付完整的工程级成果。Jinja00
LongCat-AudioDiT-1BLongCat-AudioDiT 是一款基于扩散模型的文本转语音(TTS)模型,代表了当前该领域的最高水平(SOTA),它直接在波形潜空间中进行操作。00- QQwen3.5-397B-A17BQwen3.5 实现了重大飞跃,整合了多模态学习、架构效率、强化学习规模以及全球可访问性等方面的突破性进展,旨在为开发者和企业赋予前所未有的能力与效率。Jinja00
HY-Embodied-0.5这是一套专为现实世界具身智能打造的基础模型。该系列模型采用创新的混合Transformer(Mixture-of-Transformers, MoT) 架构,通过潜在令牌实现模态特异性计算,显著提升了细粒度感知能力。Jinja00
FreeSql功能强大的对象关系映射(O/RM)组件,支持 .NET Core 2.1+、.NET Framework 4.0+、Xamarin 以及 AOT。C#00
项目优选
收起
deepin linux kernel
C
27
14
OpenHarmony documentation | OpenHarmony开发者文档
Dockerfile
659
4.26 K
🎉 (RuoYi)官方仓库 基于SpringBoot,Spring Security,JWT,Vue3 & Vite、Element Plus 的前后端分离权限管理系统
Vue
1.54 K
894
Ascend Extension for PyTorch
Python
503
609
openEuler内核是openEuler操作系统的核心,既是系统性能与稳定性的基石,也是连接处理器、设备与服务的桥梁。
C
391
286
暂无简介
Dart
905
218
🔥LeetCode solutions in any programming language | 多种编程语言实现 LeetCode、《剑指 Offer(第 2 版)》、《程序员面试金典(第 6 版)》题解
Java
69
21
昇腾LLM分布式训练框架
Python
142
168
本项目是CANN提供的数学类基础计算算子库,实现网络在NPU上加速计算。
C++
939
862
🍒 Cherry Studio 是一款支持多个 LLM 提供商的桌面客户端
TypeScript
1.33 K
108