Keras 3中字典输入映射问题的分析与解决

2025-04-30 07:32:01作者：邬祺芯Juliet

在深度学习模型开发过程中，TensorFlow和Keras框架提供了多种灵活的数据输入方式。然而，当从Keras 2升级到Keras 3时，一些开发者可能会遇到输入数据处理方式的变化，特别是当使用字典形式作为模型输入时。

问题现象

在Keras 2版本中，开发者可以使用字典形式将数据传递给模型，即使模型定义时使用的是列表形式的输入。例如：

model = Model(inputs=[x, y], outputs=outputs)
model.fit({'before': x_train, 'after': y_train}, ...)

这种方式在Keras 2中可以正常工作，但在Keras 3中会引发形状不匹配的错误。错误信息表明模型期望的输入形状与实际提供的输入形状不一致。

Keras 3对输入数据处理进行了更严格的规范。主要变化在于：

在Keras 2中，框架会自动尝试匹配字典键和输入层，即使模型定义使用的是列表形式。而Keras 3取消了这种隐式转换，要求开发者显式地保持一致性。

要解决这个问题，开发者需要确保模型定义时的输入结构与训练时提供的数据结构完全一致。具体有两种方法：

# 定义模型时使用字典形式
model = Model(inputs={'before':x, 'after': y}, outputs=outputs)

# 训练时也使用字典形式
model.fit({'before': x_train, 'after': y_train}, ...)

# 定义模型时使用列表形式
model = Model(inputs=[x, y], outputs=outputs)

# 训练时也使用列表形式
model.fit([x_train, y_train], ...)

Keras 3的这一变化实际上提高了代码的明确性和可维护性，虽然需要开发者进行一些适配工作，但长期来看有助于减少隐式转换带来的潜在问题。理解框架的这种设计理念变化，有助于开发者编写出更加健壮和可维护的深度学习代码。

登录后查看全文