Higress项目中AI路由与Eureka服务发现的集成探讨
2025-06-09 13:58:50作者:邓越浪Henry
在Higress项目中,AI路由功能为开发者提供了便捷的AI服务接入能力。本文将深入探讨如何将注册在Eureka中的模型服务与Higress的AI路由功能进行集成,以及相关的技术实现方案。
背景与需求场景
现代微服务架构中,Eureka作为服务发现组件被广泛使用。当企业将AI模型服务部署为微服务并注册到Eureka时,自然希望能够通过Higress的AI路由功能直接调用这些服务。这种集成方式可以带来以下优势:
- 服务动态发现:无需手动维护服务实例列表
- 负载均衡:自动利用Eureka的服务发现机制
- 高可用性:自动剔除不可用实例
当前技术限制
目前Higress的AI路由功能尚不支持直接从Eureka发现服务。这意味着在控制台创建AI路由时,无法直接选择Eureka中注册的模型服务作为后端。
替代解决方案
虽然直接集成暂不可用,但可以通过以下方式实现类似功能:
方案一:手动配置路由
- 在Higress控制台的"路由配置"页面为Eureka中的服务创建常规路由
- 通过路由右侧的"策略"链接添加"AI代理"插件
- 在插件配置中指定相关参数
方案二:使用AI-Proxy插件
对于协议不兼容标准AI接口的模型服务,可以利用AI-Proxy插件进行协议转换。配置要点包括:
- 确保后端服务提供兼容标准AI的接口
- 在插件配置中指定正确的服务域名(FQDN)
- 配置适当的协议转换规则
技术实现细节
当使用AI-Proxy插件时,关键配置项是client部分。对于Eureka注册的服务,需要确保:
- 服务在Eureka中的注册名称与Higress中配置的FQDN一致
- 服务实例的健康状态正常
- 网络连通性良好
最佳实践建议
- 对于生产环境,建议先通过常规路由测试服务连通性
- 协议转换时,注意检查请求/响应格式的兼容性
- 监控AI服务的响应时间和错误率
- 考虑实现服务降级机制
未来展望
随着Higress项目的持续发展,未来版本可能会增加对Eureka等注册中心的直接支持,使AI路由与服务发现的集成更加无缝。开发者可以关注项目更新,及时获取新功能。
通过以上方案,开发者可以在现有技术条件下,实现Eureka注册的AI模型服务与Higress AI路由的有效集成,构建稳定可靠的AI服务网关。
登录后查看全文
热门项目推荐
相关项目推荐
atomcodeClaude Code 的开源替代方案。连接任意大模型,编辑代码,运行命令,自动验证 — 全自动执行。用 Rust 构建,极致性能。 | An open-source alternative to Claude Code. Connect any LLM, edit code, run commands, and verify changes — autonomously. Built in Rust for speed. Get StartedRust0152- DDeepSeek-V4-ProDeepSeek-V4-Pro(总参数 1.6 万亿,激活 49B)面向复杂推理和高级编程任务,在代码竞赛、数学推理、Agent 工作流等场景表现优异,性能接近国际前沿闭源模型。Python00
LongCat-Video-Avatar-1.5最新开源LongCat-Video-Avatar 1.5 版本,这是一款经过升级的开源框架,专注于音频驱动人物视频生成的极致实证优化与生产级就绪能力。该版本在 LongCat-Video 基础模型之上构建,可生成高度稳定的商用级虚拟人视频,支持音频-文本转视频(AT2V)、音频-文本-图像转视频(ATI2V)以及视频续播等原生任务,并能无缝兼容单流与多流音频输入。00
auto-devAutoDev 是一个 AI 驱动的辅助编程插件。AutoDev 支持一键生成测试、代码、提交信息等,还能够与您的需求管理系统(例如Jira、Trello、Github Issue 等)直接对接。 在IDE 中,您只需简单点击,AutoDev 会根据您的需求自动为您生成代码。Kotlin03
Intern-S2-PreviewIntern-S2-Preview,这是一款高效的350亿参数科学多模态基础模型。除了常规的参数与数据规模扩展外,Intern-S2-Preview探索了任务扩展:通过提升科学任务的难度、多样性与覆盖范围,进一步释放模型能力。Python00
skillhubopenJiuwen 生态的 Skill 托管与分发开源方案,支持自建与可选 ClawHub 兼容。Python0112
热门内容推荐
最新内容推荐
项目优选
收起
暂无描述
Dockerfile
733
4.75 K
Ascend Extension for PyTorch
Python
647
795
openEuler内核是openEuler操作系统的核心,既是系统性能与稳定性的基石,也是连接处理器、设备与服务的桥梁。
C
434
395
本项目是CANN提供的数学类基础计算算子库,实现网络在NPU上加速计算。
C++
1.01 K
1.01 K
Claude Code 的开源替代方案。连接任意大模型,编辑代码,运行命令,自动验证 — 全自动执行。用 Rust 构建,极致性能。 | An open-source alternative to Claude Code. Connect any LLM, edit code, run commands, and verify changes — autonomously. Built in Rust for speed.
Get Started
Rust
1.18 K
152
deepin linux kernel
C
30
16
华为昇腾面向大规模分布式训练的多模态大模型套件,支撑多模态生成、多模态理解。
Python
146
237
暂无简介
Dart
984
252
昇腾LLM分布式训练框架
Python
166
198
🎉 (RuoYi)官方仓库 基于SpringBoot,Spring Security,JWT,Vue3 & Vite、Element Plus 的前后端分离权限管理系统
Vue
1.68 K
989