EdgeDB 多服务器环境下函数缓存失效问题解析

2025-05-16 10:16:58作者：韦蓉瑛

在分布式数据库系统中，缓存一致性是一个常见但棘手的问题。本文将以 EdgeDB 项目中发现的一个典型缓存失效问题为例，深入分析其产生原因和解决方案。

问题现象

当 EdgeDB 在多服务器模式下运行时（例如通过两个实例共享同一个后端数据库），会出现函数缓存失效的情况。具体表现为客户端查询时抛出"function does not exist"错误，这表明系统尝试调用了一个已被缓存但实际上不存在的函数。

问题复现

通过以下步骤可以稳定复现该问题：

启动两个 EdgeDB 服务器实例，分别监听 5656 和 5657 端口
使用测试脚本随机生成并执行 2000 种简单查询
由于 EdgeDB 的函数缓存容量为 1000，系统会逐渐填满缓存并达到约50%的命中率
在缓存替换过程中，客户端开始收到函数不存在的错误

技术分析

缓存机制原理

EdgeDB 使用函数缓存来优化查询性能。当客户端执行查询时，系统会将其编译为 PostgreSQL 函数并缓存起来。缓存采用 LRU（最近最少使用）策略，容量为1000个条目。

多服务器环境下的问题

问题的核心在于多个前端服务器共享同一个后端数据库时，缓存失效通知机制存在缺陷：

当一个服务器实例因缓存满而淘汰旧条目时，它会在后端数据库中删除对应的函数
但是其他服务器实例并不知道这一变化，仍然保留着对被删除函数的引用
当这些实例尝试调用已被删除的函数时，就会抛出"function does not exist"错误

根本原因

这种问题属于典型的分布式系统缓存一致性问题。EdgeDB 原有的设计没有充分考虑多前端实例间的缓存同步机制，导致各实例对缓存状态的认识不一致。

解决方案

EdgeDB 团队通过以下方式解决了这个问题：

实现了跨实例的缓存失效通知机制
当一个实例淘汰缓存条目时，会广播通知其他实例
其他实例收到通知后，会同步更新自己的缓存状态
增加了缓存操作的原子性保证

经验总结

这个案例给我们几点重要启示：

在设计缓存系统时，必须考虑多实例环境下的同步问题
简单的单机缓存策略在分布式环境中可能带来一致性问题
广播通知是解决分布式缓存一致性的有效手段之一
对于数据库系统，缓存失效的处理需要特别小心，因为它直接影响查询的正确性

EdgeDB 团队通过这个问题的解决，进一步完善了其分布式缓存机制，为后续支持更大规模的集群部署打下了坚实基础。

edgedb

Gel supercharges Postgres with a modern data model, graph queries, Auth & AI solutions, and much more.

项目地址：https://gitcode.com/gh_mirrors/ed/edgedb

登录后查看全文

项目优选

收起

kernel

deepin linux kernel

kernel

openEuler内核是openEuler操作系统的核心，既是系统性能与稳定性的基石，也是连接处理器、设备与服务的桥梁。

Ascend Extension for PyTorch

本项目是CANN提供的transformer类大模型算子库，实现网络在NPU上加速计算。

本项目是CANN提供的神经网络类计算算子库，实现网络在NPU上加速计算。

本项目是CANN提供的数学类基础计算算子库，实现网络在NPU上加速计算。

本仓库是 Flutter SDK 与 Flutter Engine 的 OpenHarmony 适配版本，由 CPF-Flutter 团队维护。开发者可使用熟悉的 Flutter 技术栈开发 OpenHarmony 应用，3.35.7 及以后的适配版本可基于本仓库源码构建支持 OpenHarmony 的 Flutter Engine。