Langfuse项目中的LLM调用成本追踪机制解析

2025-05-22 15:24:34作者：农烁颖Land

Open source observability and analytics for LLM applications

项目地址：https://gitcode.com/GitHub_Trending/la/langfuse

在Langfuse项目的JavaScript SDK中，关于大语言模型(LLM)调用成本追踪机制的实现经历了一次重要的演进。本文将深入分析这一机制的技术细节及其变化。

旧版成本追踪机制

在早期版本中，Langfuse提供了较为灵活的成本追踪方式，开发者可以通过handleLLMEnd方法传递以下关键参数：

unit：指定计量单位，如"TOKENS"或"MILLISECONDS"
inputCost/outputCost/totalCost：直接指定输入/输出/总成本数值
input/output/total：对应的使用量数值

这种设计允许开发者根据不同的使用场景灵活指定计量单位和成本。例如，在处理音频转文本的场景中，开发者可以指定单位为"MILLISECONDS"来跟踪音频时长。

新版成本追踪机制

随着Langfuse V3版本的发布，成本追踪机制进行了重构，主要变化包括：

标准化token计量：现在统一使用token作为计量单位，参数名改为更明确的input_tokens/output_tokens/total_tokens
细粒度使用量追踪：新增input_token_details参数，支持更详细的使用量分类记录，如区分文本和音频的使用量
成本计算分离：不再直接接收成本参数，改为在服务端基于使用量和预设价格模型自动计算

技术实现分析

新版实现中，Langfuse采用了更结构化的数据模型：

interface TokenUsage {
  input_tokens?: number;
  output_tokens?: number;
  total_tokens?: number;
  input_token_details?: {
    text?: number;
    audio?: number;
    // 其他使用类型...
  };
}

这种设计带来了几个优势：

数据一致性：统一使用token作为标准单位，便于后续分析和比较
扩展性：通过input_token_details支持多种资源类型的细粒度追踪
自动化：成本计算逻辑集中在服务端，减少客户端配置负担

开发者适配建议

对于需要从旧版迁移的开发者，建议：

如果使用自定义单位(如毫秒)，需要在前端转换为等效token数
对于音频等非文本输入，可利用input_token_details.audio字段记录
成本计算应改为通过Langfuse后台的价格模型配置实现

未来演进方向

基于社区反馈，未来可能会进一步优化：

支持混合单位的成本计算(如输入为音频时长，输出为文本token)
提供更灵活的成本覆盖机制
增强使用量到成本的映射配置能力

这一演进体现了Langfuse在平衡灵活性和标准化方面的持续优化，为开发者提供了更强大且易用的LLM调用监控能力。

Open source observability and analytics for LLM applications

项目地址：https://gitcode.com/GitHub_Trending/la/langfuse

登录后查看全文

最新内容推荐

LabVIEW串口通信开发全攻略：从入门到精通的完整解决方案操作系统概念第六版PDF资源全面指南：适用场景与使用教程谷歌浏览器跨域插件Allow-Control-Allow-Origin：前端开发调试必备神器 Adobe Acrobat XI Pro PDF拼版插件：提升排版效率的专业利器基恩士LJ-X8000A开发版SDK样本程序全面指南 - 工业激光轮廓仪开发利器 Windows Server 2016 .NET Framework 3.5 SXS文件下载与安装完整指南 SteamVR 1.2.3 Unity插件：兼容Unity 2019及更低版本的VR开发终极解决方案 MQTT客户端软件源代码：物联网开发的强大工具与最佳实践指南 STM32到GD32项目移植完全指南：从兼容性到实战技巧中兴e读zedx.zed文档阅读器V4.11轻量版：专业通信设备文档阅读解决方案

项目优选

收起

deepin linux kernel

OpenHarmony documentation | OpenHarmony开发者文档

Nop Platform 2.0是基于可逆计算理论实现的采用面向语言编程范式的新一代低代码开发平台，包含基于全新原理从零开始研发的GraphQL引擎、ORM引擎、工作流引擎、报表引擎、规则引擎、批处理引引擎等完整设计。nop-entropy是它的后端部分，采用java语言实现，可选择集成Spring框架或者Quarkus框架。中小企业可以免费商用

🔥LeetCode solutions in any programming language | 多种编程语言实现 LeetCode、《剑指 Offer（第 2 版）》、《程序员面试金典（第 6 版）》题解

flutter_flutter

喝着茶写代码！最易用的自托管一站式代码托管平台，包含Git托管，代码审查，团队协作，软件包和CI/CD。

openEuler内核是openEuler操作系统的核心，既是系统性能与稳定性的基石，也是连接处理器、设备与服务的桥梁。

🎉 (RuoYi)官方仓库基于SpringBoot，Spring Security，JWT，Vue3 & Vite、Element Plus 的前后端分离权限管理系统

无需学习 Kubernetes 的容器平台，在 Kubernetes 上构建、部署、组装和管理应用，无需 K8s 专业知识，全流程图形化管理

基于golang开发的网关。具有各种插件，可以自行扩展，即插即用。此外，它可以快速帮助企业管理API服务，提高API服务的稳定性和安全性。