首页
/ TruLens项目中使用Groundedness评估RAG应用时的常见错误解析

TruLens项目中使用Groundedness评估RAG应用时的常见错误解析

2025-07-01 16:19:12作者:平淮齐Percy

概述

在利用TruLens框架评估检索增强生成(RAG)应用时,开发者经常会遇到关于Groundedness评估功能的配置问题。本文将通过一个典型错误案例,深入分析问题原因并提供正确的解决方案。

问题现象

开发者在使用TruLens的Groundedness功能评估RAG应用时,遇到了TypeError: Feedback.__init__() got an unexpected keyword argument 'groundedness_provider'的错误提示。这个错误表明在初始化Feedback类时传入了一个不被接受的参数。

错误原因分析

这个错误通常由以下原因导致:

  1. API版本不匹配:开发者可能参考了旧版文档,而当前使用的TruLens版本已经更新了API接口
  2. 初始化方式变更:新版本中Groundedness的初始化方式已经简化,不再需要单独创建Groundedness实例
  3. 参数传递方式改变:反馈函数的配置方式在新版本中更加直接

正确解决方案

在新版TruLens中,评估RAG应用的推荐方式如下:

import numpy as np
from trulens.apps.llamaindex import TruLlama
from trulens.core import Feedback
from trulens.providers.openai import OpenAI

# 初始化OpenAI提供者
provider = OpenAI()

# 选择用于反馈的上下文
context = TruLlama.select_context(query_engine)

# 定义Groundedness反馈函数
f_groundedness = (
    Feedback(
        provider.groundedness_measure_with_cot_reasons, 
        name="Groundedness"
    )
    .on(context.collect())  # 将上下文块收集到列表中
    .on_output()
)

# 定义问题/答案相关性反馈函数
f_answer_relevance = Feedback(
    provider.relevance_with_cot_reasons, 
    name="Answer Relevance"
).on_input_output()

# 定义问题/上下文块相关性反馈函数
f_context_relevance = (
    Feedback(
        provider.context_relevance_with_cot_reasons, 
        name="Context Relevance"
    )
    .on_input()
    .on(context)
    .aggregate(np.mean)
)

关键改进点

  1. 简化初始化流程:不再需要单独创建Groundedness实例,直接使用provider提供的方法
  2. 更清晰的上下文处理:使用context.collect()方法显式处理上下文块
  3. 更直观的反馈链式调用:通过链式调用清晰地表达反馈函数的应用范围

最佳实践建议

  1. 版本一致性:确保代码实现与所参考的文档版本一致
  2. 逐步验证:先构建简单的反馈函数,验证通过后再添加复杂逻辑
  3. 上下文明确:清晰地定义每个反馈函数应用的上下文范围
  4. 聚合策略:根据评估需求选择合适的聚合方法(如np.mean)

总结

TruLens框架在不断演进中优化了API设计,使RAG应用的评估更加简洁高效。开发者遇到类似初始化错误时,应首先检查API版本兼容性,并参考最新的官方文档实现方式。通过本文提供的解决方案,开发者可以顺利构建基于Groundedness的RAG评估流程,全面检测生成内容的真实性和相关性。

登录后查看全文
热门项目推荐
相关项目推荐

项目优选

收起
docsdocs
暂无描述
Markdown
827
5.49 K
kernelkernel
openEuler内核是openEuler操作系统的核心,既是系统性能与稳定性的基石,也是连接处理器、设备与服务的桥梁。
C
494
518
ops-nnops-nn
本项目是CANN提供的神经网络类计算算子库,实现网络在NPU上加速计算。
C++
786
1.58 K
pytorchpytorch
作为 Ascend for PyTorch 社区的核心组件,TorchNPU 是昇腾专为 PyTorch 打造的深度学习适配插件,使 PyTorch 框架能够直接调用昇腾 NPU,为开发者提供昇腾 AI 处理器的超强算力。
Python
803
1.14 K
ops-transformerops-transformer
本项目是CANN提供的transformer类大模型算子库,实现网络在NPU上加速计算。
C++
973
2.29 K
kernelkernel
deepin linux kernel
C
32
16
AscendNPU-IRAscendNPU-IR
AscendNPU-IR是基于MLIR(Multi-Level Intermediate Representation)构建的,面向昇腾亲和算子编译时使用的中间表示,提供昇腾完备表达能力,通过编译优化提升昇腾AI处理器计算效率,支持通过生态框架使能昇腾AI处理器与深度调优
C++
482
312
jiuwenswarmjiuwenswarm
JiuwenSwarm 是一款基于openJiuwen开发的智能AI Agent,它能够将大语言模型的强大能力,通过你日常使用的各类通讯应用,直接延伸至你的指尖。
Python
3.02 K
769
cannbot-skillscannbot-skills
CANNBot 是面向 CANN 开发的用于提升开发效率的系列智能体,本仓库为其提供可复用的 Skills 模块。
Markdown
1.26 K
811
cann-learning-hubcann-learning-hub
CANN 学习中心仓,支持在线互动运行、边学边练,提供教程、示例与优化方案,一站式助力昇腾开发者快速上手。
Jupyter Notebook
648
287