开源项目Calcium-Ion/new-api中Deepseek缓存计费功能的实现分析
2025-05-31 08:37:24作者:廉彬冶Miranda
在开源项目Calcium-Ion/new-api的最新开发中,针对Deepseek API的缓存计费功能进行了适配实现。这一功能优化对于使用Deepseek服务的开发者具有重要意义,能够显著降低API调用成本。
Deepseek最近引入了输入缓存机制,当相同输入被重复请求时,系统会直接从缓存中返回结果,而不是重新计算。这种机制带来的直接好处是缓存命中的输入token成本仅为原始成本的十分之一。为了帮助开发者准确掌握缓存使用情况,Deepseek在API响应中新增了缓存命中相关的token统计字段。
在技术实现层面,Deepseek的API响应现在包含两个关键的新字段:
- prompt_cache_hit_tokens:表示从缓存中命中的输入token数量
- prompt_cache_miss_tokens:表示未命中缓存需要实际处理的输入token数量
通过这两个字段,开发者可以精确计算实际产生的费用。例如,假设某次API调用返回的usage部分显示prompt_cache_hit_tokens为50,prompt_cache_miss_tokens为30,那么实际计费的输入token数应为50×0.1 + 30 = 35个token。
Calcium-Ion/new-api项目及时跟进这一特性,在代码提交a9bfcb0和d9390ff中实现了对Deepseek缓存计费功能的完整支持。这一改进使得项目能够更准确地反映API调用的实际成本,帮助开发者优化应用设计,提高缓存命中率以降低成本。
对于开发者而言,理解并利用这一特性可以带来显著的经济效益。在实际应用中,可以通过以下策略提高缓存命中率:
- 尽量保持相同输入的稳定性
- 对频繁查询的内容进行本地缓存
- 设计合理的请求参数结构
这一功能的实现体现了Calcium-Ion/new-api项目对最新API特性的快速响应能力,也展示了开源社区在保持技术前沿性方面的优势。开发者现在可以借助这一改进更精确地控制API使用成本,这对于预算敏感的应用场景尤为重要。
登录后查看全文
热门项目推荐
相关项目推荐
atomcodeClaude Code 的开源替代方案。连接任意大模型,编辑代码,运行命令,自动验证 — 全自动执行。用 Rust 构建,极致性能。 | An open-source alternative to Claude Code. Connect any LLM, edit code, run commands, and verify changes — autonomously. Built in Rust for speed. Get StartedRust0172
cann-learning-hubCANN 学习中心仓,支持在线互动运行、边学边练,提供教程、示例与优化方案,一站式助力昇腾开发者快速上手。Jupyter Notebook093
Step-3.7-FlashStep-3.7-Flash是一个拥有 1980 亿参数的稀疏混合专家(MoE)视觉语言模型,由 1960 亿参数的语言主干网络和 18 亿参数的视觉编码器组合而成,具备原生图像理解能力。Python00
BitCPM-CANN-8BBitCPM-CANN 是首个基于华为昇腾 NPU 原生构建的端到端 1.58 位(三值化)大语言模型训练系统。该系统将量化感知训练(QAT)集成到 Megatron-LM 框架中,并结合 MindSpeed 加速,覆盖了从自定义三值算子到基于昇腾 910B 的分布式并行训练的完整训练栈。Python00
MiniCPM5-1BMiniCPM5-1B,这是 MiniCPM5 系列的首款模型。它是一个专为端侧、本地部署和资源受限场景打造的 10 亿参数密集型 Transformer 模型,达到了 10 亿参数级开源模型的 SOTA 水平Jinja00
skillhubopenJiuwen 生态的 Skill 托管与分发开源方案,支持自建与可选 ClawHub 兼容。Python0239
热门内容推荐
最新内容推荐
项目优选
收起
deepin linux kernel
C
32
16
暂无描述
Dockerfile
749
4.86 K
Claude Code 的开源替代方案。连接任意大模型,编辑代码,运行命令,自动验证 — 全自动执行。用 Rust 构建,极致性能。 | An open-source alternative to Claude Code. Connect any LLM, edit code, run commands, and verify changes — autonomously. Built in Rust for speed.
Get Started
Rust
1.55 K
172
本项目是CANN提供的transformer类大模型算子库,实现网络在NPU上加速计算。
C++
835
1.83 K
Ascend Extension for PyTorch
Python
685
828
CANN 学习中心仓,支持在线互动运行、边学边练,提供教程、示例与优化方案,一站式助力昇腾开发者快速上手。
Jupyter Notebook
207
93
openEuler内核是openEuler操作系统的核心,既是系统性能与稳定性的基石,也是连接处理器、设备与服务的桥梁。
C
450
417
本项目是CANN提供的数学类基础计算算子库,实现网络在NPU上加速计算。
C++
1.02 K
1.04 K
暂无简介
Dart
997
258
本项目是CANN提供的神经网络类计算算子库,实现网络在NPU上加速计算。
C++
641
1.26 K