Distribution项目中的Registry内存缓存问题分析与解决方案

2025-05-24 19:41:34作者：申梦珏Efrain

Distribution 是一个开源的软件分发平台，用于存储、分发和安装软件包，支持多种软件格式和平台。 * 软件分发平台、存储、分发和安装软件包 * 有什么特点：支持多种软件格式和平台、易于集成和扩展、用于软件包管理和分发

项目地址：https://gitcode.com/gh_mirrors/dis/distribution

问题背景

在Distribution项目的Registry实现中，存在一个关于内存缓存管理的设计问题。当使用默认配置时，Registry会将blob描述符(blobdescriptor)存储在内存中(inmemory)，这会导致在删除镜像标签并执行垃圾回收后，出现磁盘状态与内存状态不一致的情况。

问题现象

具体表现为：

用户推送一个镜像到Registry
删除该镜像标签并执行垃圾回收
再次尝试推送相同镜像时，Registry错误地认为相关blob已存在
实际上磁盘上的blob已被删除，导致后续操作失败

技术原理分析

Registry的存储系统由多个组件构成：

磁盘存储：实际存储镜像层数据的持久化存储
内存缓存：用于加速访问的blob描述符缓存
垃圾回收机制：清理不再被引用的blob数据

问题的核心在于：

默认配置下使用blobdescriptor: inmemory缓存策略
垃圾回收仅清理磁盘数据，不清理内存缓存
缓存与磁盘状态不一致导致后续操作异常

解决方案

针对这个问题，社区提出了几种解决方案：

配置修改方案：最简单的解决方法是修改Registry配置，不使用内存缓存：
```
storage:
  cache:
    blobdescriptor: redis  # 或其他持久化缓存方案
```
重启Registry：临时解决方案是在执行垃圾回收后重启Registry服务，强制清空内存缓存。
代码修复方案：更彻底的解决方案是修改Registry代码，确保垃圾回收过程同时清理内存缓存。这需要修改垃圾回收逻辑，使其能够感知并清理内存中的blob描述符。

最佳实践建议

对于生产环境中的Registry部署，建议：

避免使用纯内存缓存策略，特别是在需要频繁删除镜像的场景下
考虑使用Redis等外部缓存系统，既能保持性能又可维护一致性
如果必须使用内存缓存，应在垃圾回收后安排服务重启
密切关注社区进展，及时应用相关修复补丁

总结

Registry的内存缓存问题是一个典型的缓存一致性问题，在分布式系统中很常见。理解这个问题的本质有助于我们在设计类似系统时避免类似的陷阱。对于用户而言，最重要的是根据实际使用场景选择合适的缓存策略，并在操作流程中考虑缓存一致性的影响。

随着Distribution项目的持续发展，这个问题有望在后续版本中得到更完善的解决。在此之前，用户可以通过合理的配置和操作流程来规避这个问题带来的影响。

Distribution 是一个开源的软件分发平台，用于存储、分发和安装软件包，支持多种软件格式和平台。 * 软件分发平台、存储、分发和安装软件包 * 有什么特点：支持多种软件格式和平台、易于集成和扩展、用于软件包管理和分发

项目地址：https://gitcode.com/gh_mirrors/dis/distribution

登录后查看全文

项目优选

收起

deepin linux kernel

OpenHarmony documentation | OpenHarmony开发者文档

openEuler内核是openEuler操作系统的核心，既是系统性能与稳定性的基石，也是连接处理器、设备与服务的桥梁。

flutter_flutter

Ascend Extension for PyTorch

ohos_react_native

React Native鸿蒙化仓库

本项目是CANN提供的数学类基础计算算子库，实现网络在NPU上加速计算。

Nop Platform 2.0是基于可逆计算理论实现的采用面向语言编程范式的新一代低代码开发平台，包含基于全新原理从零开始研发的GraphQL引擎、ORM引擎、工作流引擎、报表引擎、规则引擎、批处理引引擎等完整设计。nop-entropy是它的后端部分，采用java语言实现，可选择集成Spring框架或者Quarkus框架。中小企业可以免费商用

🎉 (RuoYi)官方仓库基于SpringBoot，Spring Security，JWT，Vue3 & Vite、Element Plus 的前后端分离权限管理系统

华为昇腾面向大规模分布式训练的多模态大模型套件，支撑多模态生成、多模态理解。