Druid SQL解析器对MySQL数组类型索引括号处理问题分析

2025-05-05 06:33:14作者：冯爽妲Honey

问题背景

在使用Druid SQL解析器处理MySQL ALTER TABLE语句时，发现其对数组类型索引的括号处理存在缺陷。具体表现为当创建基于数组类型转换的索引时，Druid解析器生成的SQL缺少必要的括号层级，导致语法错误。

问题重现

用户提供的原始SQL语句如下：

ALTER TABLE test.rs_urge_pickup_config 
ADD KEY idx_site_id_list2 ((cast(site_id_list as char(10) array))),
ADD KEY idx_site_from_list2 ((cast(site_from_list as char(30) array))),
ADD KEY idx_shipping_channel_list2 ((cast(shipping_channel_list as char(50) array)));

Druid解析器处理后生成的SQL为：

ALTER TABLE test.rs_urge_pickup_config
ADD KEY idx_site_id_list2 (CAST(site_id_list AS char(10) ARRAY)),
ADD KEY idx_site_from_list2 (CAST(site_from_list AS char(30) ARRAY)),
ADD KEY idx_shipping_channel_list2 (CAST(shipping_channel_list AS char(50) ARRAY));

而实际上MySQL要求更严格的括号嵌套，正确的语法应该是：

ALTER TABLE test.rs_urge_pickup_config
ADD KEY idx_site_id_list2 ((CAST(site_id_list AS char(10) ARRAY))),
ADD KEY idx_site_from_list2 ((CAST(site_from_list AS char(30) ARRAY))),
ADD KEY idx_shipping_channel_list2 ((CAST(shipping_channel_list AS char(50) ARRAY)));

技术分析

MySQL数组类型索引：MySQL从5.7版本开始支持JSON数据类型，8.0版本进一步增强了对JSON的支持。创建基于JSON数组的索引时，通常需要使用CAST函数将JSON数组转换为SQL数组类型，这种转换表达式需要额外的括号包裹。
Druid解析器的括号处理：Druid SQL解析器在处理这类复杂表达式时，会对括号进行"归一化"处理，即减少不必要的括号层级。这种设计在大多数情况下能简化SQL输出，但在处理MySQL数组类型索引这种特殊场景时会导致语法错误。
问题根源：Druid解析器没有针对MySQL数组类型索引这种特定语法进行特殊处理，而是采用通用的括号简化策略，导致生成的SQL不符合MySQL的语法要求。

解决方案

临时解决方案：用户可以手动修改生成的SQL，添加必要的括号层级。
长期解决方案：需要修改Druid解析器的源码，针对MySQL数组类型索引这种特定语法保留必要的括号层级。这涉及到：
- 识别CAST AS ARRAY这种特定表达式模式
- 在SQL生成阶段保留或添加额外的括号
- 确保不影响其他类型SQL的解析
版本兼容性：需要注意不同MySQL版本对数组类型索引的支持程度和语法要求的差异，确保解决方案具有良好的版本兼容性。