BoTorch项目中可训练输出变换的实现探讨

2025-06-25 15:25:00作者：凤尚柏Louis

Bayesian optimization in PyTorch

项目地址：https://gitcode.com/gh_mirrors/bo/botorch

背景介绍

在机器学习领域，特别是在高斯过程(GP)建模中，输出变换(Outcome Transform)是一种常见的技术手段，用于对模型的输出进行预处理或后处理。传统的输出变换通常是固定的、非学习的变换，但在某些应用场景中，我们希望能够学习这些变换的参数，从而更好地适应数据特性。

技术挑战

在BoTorch项目中，当前实现输出变换的方式存在一个关键限制：输出变换类继承自torch.nn.Module而不是GPyTorchModule，这使得它们无法直接参与模型的训练过程。此外，现有的实现中，输出变换不会在模型的前向传播(forward pass)过程中应用，这进一步限制了可训练输出变换的实现可能性。

解决方案探讨

针对这一挑战，社区成员提出了几种潜在的解决方案：

继承结构调整：将OutcomeTransform改为继承自GPyTorchModule，并修改SingleTaskGP的构造函数以接受这种可训练的变换。
两阶段训练方案：先在不使用输出变换的情况下训练SingleTaskGP，然后在fit_gpytorch_mll()中应用输出变换进行训练，最后通过set_outcome_transform()方法设置变换用于推理阶段。
自定义优化闭包：通过创建自定义的优化闭包(closure)来实现输出变换的训练，这是目前已经验证可行的临时方案。

实现细节

在实际实现中，开发者已经成功通过自定义优化闭包的方式实现了可训练的输出变换。具体实现要点包括：

创建了一个SALTransform类，实现了基于"Compositionally-Warped Gaussian Processes"论文的输出变换
通过将变换实例附加到模型上的方式实现参数共享
自定义的闭包函数在每次优化迭代时应用变换并计算相应的对数似然

这种实现虽然有效，但属于临时解决方案，更优雅的方式应该是通过修改BoTorch的核心架构来原生支持可训练的输出变换。

未来方向

基于现有讨论，未来可能的改进方向包括：

参考Warp输入变换的实现方式，为输出变换添加类似的参数训练机制
修改模型的前向传播逻辑，使其能够正确处理可训练的输出变换
提供内置的可训练输出变换实现，如可训练Power变换等

这些改进将使BoTorch在复杂建模任务中具有更大的灵活性，特别是在需要处理非标准输出分布的场景中。

总结

可训练输出变换是高斯过程建模中一个有价值的扩展功能，能够增强模型对复杂数据模式的适应能力。虽然目前可以通过一些技巧实现这一功能，但更理想的方式是通过BoTorch框架层面的改进来提供原生支持。这将为贝叶斯优化和高斯过程建模的研究和应用提供更强大的工具。

Bayesian optimization in PyTorch

项目地址：https://gitcode.com/gh_mirrors/bo/botorch

登录后查看全文

项目优选

收起

ops-transformer

本项目是CANN提供的transformer类大模型算子库，实现网络在NPU上加速计算。

本项目是CANN提供的神经网络类计算算子库，实现网络在NPU上加速计算。

Ascend Extension for PyTorch

deepin linux kernel

openEuler内核是openEuler操作系统的核心，既是系统性能与稳定性的基石，也是连接处理器、设备与服务的桥梁。

本项目是CANN提供的数学类基础计算算子库，实现网络在NPU上加速计算。

华为昇腾面向大规模分布式训练的多模态大模型套件，支撑多模态生成、多模态理解。

cann-learning-hub

CANN 学习中心仓，支持在线互动运行、边学边练，提供教程、示例与优化方案，一站式助力昇腾开发者快速上手。

Jupyter Notebook

昇腾LLM分布式训练框架