Higress项目配置OpenTelemetry追踪时的问题分析与解决方案
问题背景
在使用Higress项目时,当尝试将追踪系统配置为OpenTelemetry时,发现higress-controller组件报错"skywalking service and port can not be empty"。这个问题源于Higress的追踪配置验证逻辑存在缺陷,导致即使明确指定了OpenTelemetry配置,系统仍然强制要求Skywalking配置。
问题分析
Higress的追踪配置验证逻辑中存在一个关键问题:在验证函数中,无论用户是否配置了Skywalking,只要Skywalking结构体不为空,就会触发验证。而通过Helm安装时,默认的values.yaml中Skywalking配置虽然为空字符串,但结构体本身存在,导致验证逻辑始终要求Skywalking服务地址和端口不能为空。
具体验证逻辑如下:
- 首先检查超时(timeout)和采样率(sampling)参数是否合法
- 然后检查Zipkin、Skywalking和OpenTelemetry三种追踪后端的配置
- 最后要求三种后端配置中有且仅有一种被启用
问题出在Skywalking的验证上,即使没有实际配置Skywalking,只要结构体存在就会触发验证。
解决方案
要解决这个问题,需要修改Helm的values.yaml配置,将Skywalking配置显式设置为null,而不是留空。这样可以确保Skywalking结构体不存在,从而跳过验证。
正确的values.yaml配置示例:
higress-core:
tracing:
enable: true
opentelemetry:
service: jaeger-collector.default.svc.cluster.local
port: 4317
sampling: 100
skywalking: null
timeout: 500
安装命令:
helm install higress -n higress-system higress.io/higress --create-namespace \
--render-subchart-notes \
--set global.local=true \
--set global.o11y.enabled=false \
--set global.onlyPushRouteCluster=false \
-f values.yaml
注意事项
-
安装过程中可能会看到警告信息"warning: cannot overwrite table with non table for higress.higress-core.tracing.skywalking",这是Helm的正常行为,不影响功能。
-
如果使用Jaeger作为OpenTelemetry后端,可能需要将服务地址从"jaeger-collector"改为"ot-collector",因为Jaeger的OpenTelemetry接收器默认使用ot-collector服务名。
-
确保OpenTelemetry后端的服务地址和端口正确无误,并且网络可达。
总结
Higress项目的追踪配置验证逻辑在处理OpenTelemetry时存在缺陷,通过正确配置values.yaml文件可以绕过这个问题。这个问题展示了在使用开源项目时,理解其配置验证逻辑的重要性,以及如何通过调整配置来满足系统要求。对于开发者来说,这也提示了在设计配置验证时需要考虑各种边界情况,避免强制要求用户配置他们并不打算使用的功能。
GLM-5智谱 AI 正式发布 GLM-5,旨在应对复杂系统工程和长时域智能体任务。Jinja00
GLM-5-w4a8GLM-5-w4a8基于混合专家架构,专为复杂系统工程与长周期智能体任务设计。支持单/多节点部署,适配Atlas 800T A3,采用w4a8量化技术,结合vLLM推理优化,高效平衡性能与精度,助力智能应用开发Jinja00
请把这个活动推给顶尖程序员😎本次活动专为懂行的顶尖程序员量身打造,聚焦AtomGit首发开源模型的实际应用与深度测评,拒绝大众化浅层体验,邀请具备扎实技术功底、开源经验或模型测评能力的顶尖开发者,深度参与模型体验、性能测评,通过发布技术帖子、提交测评报告、上传实践项目成果等形式,挖掘模型核心价值,共建AtomGit开源模型生态,彰显顶尖程序员的技术洞察力与实践能力。00
Kimi-K2.5Kimi K2.5 是一款开源的原生多模态智能体模型,它在 Kimi-K2-Base 的基础上,通过对约 15 万亿混合视觉和文本 tokens 进行持续预训练构建而成。该模型将视觉与语言理解、高级智能体能力、即时模式与思考模式,以及对话式与智能体范式无缝融合。Python00
MiniMax-M2.5MiniMax-M2.5开源模型,经数十万复杂环境强化训练,在代码生成、工具调用、办公自动化等经济价值任务中表现卓越。SWE-Bench Verified得分80.2%,Multi-SWE-Bench达51.3%,BrowseComp获76.3%。推理速度比M2.1快37%,与Claude Opus 4.6相当,每小时仅需0.3-1美元,成本仅为同类模型1/10-1/20,为智能应用开发提供高效经济选择。【此简介由AI生成】Python00
Qwen3.5Qwen3.5 昇腾 vLLM 部署教程。Qwen3.5 是 Qwen 系列最新的旗舰多模态模型,采用 MoE(混合专家)架构,在保持强大模型能力的同时显著降低了推理成本。00- RRing-2.5-1TRing-2.5-1T:全球首个基于混合线性注意力架构的开源万亿参数思考模型。Python00