XGBoost中的DART树提升器详解
2025-07-07 06:40:13作者:秋阔奎Evelyn
概述
在机器学习领域,XGBoost是一个强大的梯度提升框架,而DART(Dropouts meet Multiple Additive Regression Trees)是XGBoost中一种特殊的树提升器。本文将深入解析DART的工作原理、特性以及使用方法。
DART的背景
传统XGBoost通常结合大量回归树和小学习率进行训练。这种情况下,早期添加的树对模型影响较大,而后期添加的树影响较小。DART借鉴了深度神经网络中的dropout技术,将其应用于提升树模型,在某些场景下能取得更好的效果。
DART的核心思想
DART通过在训练过程中随机"丢弃"(dropout)一些树来解决过拟合问题:
- 防止那些仅用于修正微小错误的"琐碎树"影响模型
- 引入随机性增强模型鲁棒性
- 通过规范化技术保持预测的稳定性
工作原理
在训练的第m轮中:
- 随机选择k棵树进行丢弃
- 设D为被丢弃树的叶子分数总和
- 新树的叶子分数为Fₘ = ηF̃ₘ
- 目标函数为:
\mathrm{Obj} = \sum_{j=1}^n L(y_j, \hat{y}_j^{m-1} - D_j + \tilde{F}_m) + \Omega(\tilde{F}_m) - 使用缩放因子来平衡D和Fₘ的过度影响
关键参数详解
DART继承了gbtree的基本参数(如eta、gamma、max_depth等),并新增了以下特有参数:
采样类型(sample_type)
uniform(默认):均匀随机丢弃树weighted:按权重比例丢弃树
规范化类型(normalize_type)
tree(默认):新树与每棵被丢弃树权重相同forest:新树与被丢弃树的总权重相同
丢弃率(rate_drop)
- 范围:[0.0, 1.0]
- 控制每轮丢弃树的比例
跳过丢弃概率(skip_drop)
- 范围:[0.0, 1.0]
- 跳过丢弃的概率,此时与普通gbtree行为相同
使用注意事项
- 训练速度可能比gbtree慢,因为随机丢弃会阻止使用预测缓冲区
- 由于随机性,早期停止可能不太稳定
- 预测时必须指定ntree_limit参数
示例代码
import xgboost as xgb
# 读取数据
dtrain = xgb.DMatrix('demo/data/agaricus.txt.train')
dtest = xgb.DMatrix('demo/data/agaricus.txt.test')
# 设置DART参数
param = {
'booster': 'dart',
'max_depth': 5,
'learning_rate': 0.1,
'objective': 'binary:logistic',
'silent': True,
'sample_type': 'uniform',
'normalize_type': 'tree',
'rate_drop': 0.1,
'skip_drop': 0.5
}
# 训练模型
num_round = 50
bst = xgb.train(param, dtrain, num_round)
# 进行预测(必须指定ntree_limit)
preds = bst.predict(dtest, ntree_limit=num_round)
适用场景
DART特别适合以下情况:
- 数据量相对较小,容易过拟合
- 需要更强的正则化效果
- 模型性能达到平台期,需要突破
总结
DART为XGBoost提供了一种创新的正则化方法,通过引入dropout技术增强了模型的泛化能力。虽然训练过程可能稍慢且不太稳定,但在特定场景下能带来显著的性能提升。理解其工作原理和参数配置,可以帮助开发者更好地利用这一强大工具。
登录后查看全文
热门项目推荐
相关项目推荐
GLM-5智谱 AI 正式发布 GLM-5,旨在应对复杂系统工程和长时域智能体任务。Jinja00
GLM-5-w4a8GLM-5-w4a8基于混合专家架构,专为复杂系统工程与长周期智能体任务设计。支持单/多节点部署,适配Atlas 800T A3,采用w4a8量化技术,结合vLLM推理优化,高效平衡性能与精度,助力智能应用开发Jinja00
jiuwenclawJiuwenClaw 是一款基于openJiuwen开发的智能AI Agent,它能够将大语言模型的强大能力,通过你日常使用的各类通讯应用,直接延伸至你的指尖。Python0138- QQwen3.5-397B-A17BQwen3.5 实现了重大飞跃,整合了多模态学习、架构效率、强化学习规模以及全球可访问性等方面的突破性进展,旨在为开发者和企业赋予前所未有的能力与效率。Jinja00
AtomGit城市坐标计划AtomGit 城市坐标计划开启!让开源有坐标,让城市有星火。致力于与城市合伙人共同构建并长期运营一个健康、活跃的本地开发者生态。00
CherryUSBCherryUSB 是一个小而美的、可移植性高的、用于嵌入式系统(带 USB IP)的高性能 USB 主从协议栈C00
热门内容推荐
最新内容推荐
Degrees of Lewdity中文汉化终极指南:零基础玩家必看的完整教程Unity游戏翻译神器:XUnity Auto Translator 完整使用指南PythonWin7终极指南:在Windows 7上轻松安装Python 3.9+终极macOS键盘定制指南:用Karabiner-Elements提升10倍效率Pandas数据分析实战指南:从零基础到数据处理高手 Qwen3-235B-FP8震撼升级:256K上下文+22B激活参数7步搞定机械键盘PCB设计:从零开始打造你的专属键盘终极WeMod专业版解锁指南:3步免费获取完整高级功能DeepSeek-R1-Distill-Qwen-32B技术揭秘:小模型如何实现大模型性能突破音频修复终极指南:让每一段受损声音重获新生
项目优选
收起
deepin linux kernel
C
27
11
OpenHarmony documentation | OpenHarmony开发者文档
Dockerfile
589
3.99 K
openEuler内核是openEuler操作系统的核心,既是系统性能与稳定性的基石,也是连接处理器、设备与服务的桥梁。
C
364
233
Ascend Extension for PyTorch
Python
423
504
本项目是CANN提供的数学类基础计算算子库,实现网络在NPU上加速计算。
C++
911
738
React Native鸿蒙化仓库
JavaScript
320
371
暂无简介
Dart
829
203
🔥LeetCode solutions in any programming language | 多种编程语言实现 LeetCode、《剑指 Offer(第 2 版)》、《程序员面试金典(第 6 版)》题解
Java
69
21
🎉 (RuoYi)官方仓库 基于SpringBoot,Spring Security,JWT,Vue3 & Vite、Element Plus 的前后端分离权限管理系统
Vue
1.43 K
803
昇腾LLM分布式训练框架
Python
128
152