OpenTelemetry-js 中自定义采样器的实现与问题排查

2025-06-27 18:56:01作者：凤尚柏Louis

前言

在使用 OpenTelemetry 进行分布式追踪时，采样是一个重要的优化手段。本文将深入探讨如何在 OpenTelemetry-js 中实现自定义采样器，并解决实际开发中遇到的一个典型问题。

采样器基础概念

采样器决定了哪些追踪数据会被记录和导出。OpenTelemetry 提供了几种内置采样器：

AlwaysOnSampler：记录所有追踪数据
AlwaysOffSampler：不记录任何追踪数据
TraceIdRatioBasedSampler：基于追踪ID的比例采样

自定义采样器实现

在实际项目中，我们经常需要根据特定条件过滤掉不需要的追踪数据。例如，对于某些健康检查端点或特定的HTTP方法，我们可能不希望记录追踪信息。

实现思路

继承 TraceIdRatioBasedSampler 基类
重写 shouldSample 方法
在方法中添加自定义过滤逻辑

关键代码分析

class CustomSampler extends TraceIdRatioBasedSampler {
  public readonly excludeHttpMethods = HTTP_METHOD_BLACKLIST;
  public readonly excludeHttpRoutes = HTTP_ROUTE_BLACKLIST;

  shouldSample(
    context: Context,
    traceId: string,
    _spanName: string,
    _spanKind: SpanKind,
    attributes: Attributes,
    _links: Array<Link>
  ): SamplingResult {
    // 先执行父类的采样逻辑
    const radioSampleDecision = super.shouldSample(context, traceId);
    
    // 如果父类决定不记录，直接返回
    if (radioSampleDecision.decision === SamplingDecision.NOT_RECORD) {
      return radioSampleDecision;
    }

    // 获取HTTP方法和路由属性
    const httpMethod = attributes['http.method'] ?? attributes[ATTR_HTTP_REQUEST_METHOD];
    const httpRoute = attributes['http.route'] ?? attributes[ATTR_HTTP_ROUTE];

    // 标准化属性值
    const normalizedHttpMethod = httpMethod?.toString().toUpperCase() ?? 'GET';
    const normalizedHttpRoute = httpRoute?.toString().toLowerCase() ?? '/';

    // 检查是否在黑名单中
    if (this.excludeHttpMethods.includes(normalizedHttpMethod) {
      return {
        ...radioSampleDecision,
        decision: SamplingDecision.NOT_RECORD,
      };
    }

    if (this.excludeHttpRoutes.includes(normalizedHttpRoute)) {
      return {
        ...radioSampleDecision,
        decision: SamplingDecision.NOT_RECORD,
      };
    }

    return radioSampleDecision;
  }
}