Logfire项目数据库迁移：从Timescale到自定义DataFusion架构的技术演进

2025-06-27 12:39:47作者：郁楠烈Hubert

Uncomplicated Observability for Python and beyond! 🪵🔥

项目地址：https://gitcode.com/GitHub_Trending/lo/logfire

在Logfire项目的最新进展中，开发团队完成了一项重大的技术架构升级——将底层数据库从Timescale迁移到了基于Apache DataFusion的自定义数据库解决方案。这一变革不仅显著提升了查询性能，也为平台未来的可扩展性奠定了坚实基础。

技术背景与挑战

Logfire最初采用Timescale作为其核心数据库，这是一个基于PostgreSQL的时序数据库扩展。虽然Timescale在时序数据处理方面表现出色，但Logfire团队在实际使用中遇到了几个关键限制：

性能瓶颈：由于用户可以通过SQL自由查询数据，预定义的连续聚合(continuous aggregates)功能难以发挥作用。同时，Timescale的压缩特性与行级权限(row-level permissions)不兼容，而后者对于多租户场景下的数据隔离至关重要。
架构限制：Timescale的开源/闭源混合商业模式使得理想的"存储计算分离"架构难以实现。团队既希望保持对技术栈的完全控制，又需要应对未来可能的规模扩展需求。

DataFusion解决方案

经过深入评估，团队选择了Apache DataFusion作为新数据库的基础，主要基于以下考量：

完全开源：DataFusion作为Apache项目，允许团队完全掌控技术栈，实现真正的存储计算分离架构。
Rust生态优势：DataFusion基于Rust构建，与团队技术栈高度契合。团队已经贡献了20多个PR，包括实现了JSON查询支持等关键功能。
卓越的可扩展性：DataFusion允许深度定制SQL语法、查询计划和索引策略，满足Logfire的特殊需求。
PostgreSQL兼容性：DataFusion的SQL解析器与PostgreSQL保持良好兼容，且团队可以持续改进。

技术实现细节

迁移过程中，团队采用了双写策略，同时向Timescale和新数据库(内部代号FusionFire)写入数据。经过数月优化，新数据库在大多数查询场景下展现出显著优势：

复杂聚合查询性能提升10倍以上
长时间范围数据分析能力大幅增强
资源利用率显著优化

目前仍有一些特定场景的优化空间：

近期数据的低延迟查询
部分PostgreSQL特有语法支持(如时间间隔运算)
百分位数计算等高级分析函数

用户影响与迁移策略

为确保平稳过渡，团队采取了渐进式迁移策略：

用户可通过界面手动切换查询引擎
逐步增加默认使用新数据库的用户比例
保留Timescale回退选项
提供明确的性能差异提示

对于依赖PostgreSQL协议的外部工具连接，团队暂时提供了HTTP API替代方案，并计划在未来重新实现完整的PostgreSQL协议支持。

未来展望

这一架构升级为Logfire带来了显著的性能提升和长期扩展能力。团队将继续优化新数据库，特别是在以下方面：

完善PostgreSQL语法兼容性
增强近期数据的查询性能
重新实现PostgreSQL协议支持
进一步优化资源利用率

这次数据库迁移展现了Logfire团队对技术选型的深思熟虑和对未来发展的清晰规划，为用户提供了更强大、更可靠的数据分析能力。

Uncomplicated Observability for Python and beyond! 🪵🔥

项目地址：https://gitcode.com/GitHub_Trending/lo/logfire

登录后查看全文

热门内容推荐

1 【亲测免费】开源项目 `build-your-own-x` 使用指南 2 【亲测免费】探索科技之旅：《Build Your Own X》项目详解 3 GitHub_Trending/bu/build-your-own-x自动化：CI/CD流程在自制项目中的应用 4 从零打造智能家居系统：用build-your-own-x实现家庭自动化

项目优选

收起

OpenHarmony documentation | OpenHarmony开发者文档

Ascend Extension for PyTorch

本项目是CANN提供的数学类基础计算算子库，实现网络在NPU上加速计算。

openEuler内核是openEuler操作系统的核心，既是系统性能与稳定性的基石，也是连接处理器、设备与服务的桥梁。

flutter_flutter

deepin linux kernel

🎉 (RuoYi)官方仓库基于SpringBoot，Spring Security，JWT，Vue3 & Vite、Element Plus 的前后端分离权限管理系统

ohos_react_native

React Native鸿蒙化仓库

openJiuwen agent-studio提供零码、低码可视化开发和工作流编排，模型、知识库、插件等各资源管理能力

cangjie_compiler

仓颉编译器源码及 cjdb 调试工具。