首页
/ Apache Kyuubi 中 Spark History Server 显示不完整应用时的类型转换问题分析

Apache Kyuubi 中 Spark History Server 显示不完整应用时的类型转换问题分析

2025-07-08 17:02:24作者:廉皓灿Ida

问题背景

在 Apache Kyuubi 项目中,当用户通过 Spark History Server 查看不完整的应用程序时,会遇到一个类型转换异常。具体表现为访问 Kyuubi 查询引擎 UI 时出现 HTTP 500 错误,错误信息显示无法将 java.lang.Integer 转换为 java.lang.Long。

错误现象

用户在使用 Spark 3.3.2 版本时,通过 ApplicationMaster 直接访问 Kyuubi Query Engine 页面可以正常显示,但当通过 Spark History Server 查看"不完整应用"中的 Kyuubi Query Engine 时,会出现以下错误:

HTTP ERROR 500 java.lang.ClassCastException: java.lang.Integer cannot be cast to java.lang.Long

堆栈跟踪显示错误发生在 Spark UI 的 StatementStatsPagedTable.row 方法中,具体是在处理 EnginePage 相关数据时发生的类型转换问题。

问题根源

经过分析,这个问题与 Jackson 库在处理 Scala 类型时的行为有关。具体来说,当 Jackson 反序列化某些数值类型时,可能会将原本应为 Long 类型的值反序列化为 Integer 类型,从而导致后续的类型转换失败。

这个问题类似于 Jackson 模块中已知的一个问题,即在处理 Scala 集合和数值类型时可能出现的类型不匹配情况。

解决方案

针对这个问题,社区提出了两种解决方案:

  1. 直接修改相关字段的类型定义,确保类型一致性
  2. 使用 Jackson 的 @JsonDeserialize 注解显式指定反序列化类型

最终采用了第二种更为优雅的解决方案,即在 operationRunTime 和 operationCpuTime 字段上添加注解:

@JsonDeserialize(contentAs = classOf[java.lang.Long])

这个注解明确告诉 Jackson 在反序列化时将内容转换为 java.lang.Long 类型,从而避免了后续的类型转换异常。

技术意义

这个修复不仅解决了眼前的问题,还具有以下技术意义:

  1. 增强了 Kyuubi 与 Spark History Server 的兼容性
  2. 提供了更健壮的类型处理机制
  3. 为类似的数据类型转换问题提供了参考解决方案

总结

在分布式系统和大数据处理框架中,类型系统的正确处理至关重要。Apache Kyuubi 作为 Spark SQL 的接口服务,需要确保在各种环境下都能正确处理数据类型。这次问题的解决展示了开源社区如何通过协作快速定位和修复复杂系统中的类型相关问题,提高了系统的稳定性和可靠性。

登录后查看全文
热门项目推荐

项目优选

收起
docsdocs
OpenHarmony documentation | OpenHarmony开发者文档
Dockerfile
143
1.91 K
kernelkernel
deepin linux kernel
C
22
6
nop-entropynop-entropy
Nop Platform 2.0是基于可逆计算理论实现的采用面向语言编程范式的新一代低代码开发平台,包含基于全新原理从零开始研发的GraphQL引擎、ORM引擎、工作流引擎、报表引擎、规则引擎、批处理引引擎等完整设计。nop-entropy是它的后端部分,采用java语言实现,可选择集成Spring框架或者Quarkus框架。中小企业可以免费商用
Java
8
0
ohos_react_nativeohos_react_native
React Native鸿蒙化仓库
C++
192
273
RuoYi-Vue3RuoYi-Vue3
🎉 (RuoYi)官方仓库 基于SpringBoot,Spring Security,JWT,Vue3 & Vite、Element Plus 的前后端分离权限管理系统
Vue
927
551
openHiTLSopenHiTLS
旨在打造算法先进、性能卓越、高效敏捷、安全可靠的密码套件,通过轻量级、可剪裁的软件技术架构满足各行业不同场景的多样化要求,让密码技术应用更简单,同时探索后量子等先进算法创新实践,构建密码前沿技术底座!
C
421
392
openGauss-serveropenGauss-server
openGauss kernel ~ openGauss is an open source relational database management system
C++
145
189
金融AI编程实战金融AI编程实战
为非计算机科班出身 (例如财经类高校金融学院) 同学量身定制,新手友好,让学生以亲身实践开源开发的方式,学会使用计算机自动化自己的科研/创新工作。案例以量化投资为主线,涉及 Bash、Python、SQL、BI、AI 等全技术栈,培养面向未来的数智化人才 (如数据工程师、数据分析师、数据科学家、数据决策者、量化投资人)。
Jupyter Notebook
75
64
Cangjie-ExamplesCangjie-Examples
本仓将收集和展示高质量的仓颉示例代码,欢迎大家投稿,让全世界看到您的妙趣设计,也让更多人通过您的编码理解和喜爱仓颉语言。
Cangjie
344
1.3 K
easy-eseasy-es
Elasticsearch 国内Top1 elasticsearch搜索引擎框架es ORM框架,索引全自动智能托管,如丝般顺滑,与Mybatis-plus一致的API,屏蔽语言差异,开发者只需要会MySQL语法即可完成对Es的相关操作,零额外学习成本.底层采用RestHighLevelClient,兼具低码,易用,易拓展等特性,支持es独有的高亮,权重,分词,Geo,嵌套,父子类型等功能...
Java
36
8