Dynamic algorithm configuration (DAC) is a recent trend in automated machine learning, which can dynamically adjust the algorithm's configuration during the execution process and relieve users from tedious trial-and-error tuning tasks. Recently, multi-agent reinforcement learning (MARL) approaches have improved the configuration of multiple heterogeneous hyperparameters, making various parameter configurations for complex algorithms possible. However, many complex algorithms have inherent inter-dependencies among multiple parameters (e.g., determining the operator type first and then the operator's parameter), which are, however, not considered in previous approaches, thus leading to sub-optimal results. In this paper, we propose the sequential multi-agent DAC (Seq-MADAC) framework to address this issue by considering the inherent inter-dependencies of multiple parameters. Specifically, we propose a sequential advantage decomposition network, which can leverage action-order information through sequential advantage decomposition. Experiments from synthetic functions to the configuration of multi-objective optimization algorithms demonstrate Seq-MADAC's superior performance over state-of-the-art MARL methods and show strong generalization across problem classes. Seq-MADAC establishes a new paradigm for the widespread dependency-aware automated algorithm configuration. Our code is available at https://github.com/lamda-bbo/seq-madac.


翻译:动态算法配置(DAC)是自动化机器学习领域的新兴趋势,它能够在算法执行过程中动态调整其配置,从而将用户从繁琐的试错调参任务中解放出来。近年来,多智能体强化学习(MARL)方法改进了对多个异构超参数的配置,使得为复杂算法进行多样化参数配置成为可能。然而,许多复杂算法的多个参数之间存在固有的相互依赖关系(例如,先确定算子类型,再确定算子的参数),而现有方法并未考虑这些依赖关系,从而导致次优结果。本文提出序列多智能体动态算法配置(Seq-MADAC)框架,通过考虑多个参数之间的固有依赖关系来解决这一问题。具体而言,我们提出了一种序列优势分解网络,该网络能够通过序列优势分解利用动作顺序信息。从合成函数到多目标优化算法配置的实验表明,Seq-MADAC 的性能优于最先进的多智能体强化学习方法,并在不同问题类别上展现出强大的泛化能力。Seq-MADAC 为广泛存在的依赖感知自动化算法配置建立了新范式。我们的代码可在 https://github.com/lamda-bbo/seq-madac 获取。

0
下载
关闭预览

相关内容

DAC:Design Automation Conference。 Explanation:设计自动化会议。 Publisher:ACM。 SIT: https://dblp.uni-trier.de/db/conf/dac/
FlowQA: Grasping Flow in History for Conversational Machine Comprehension
专知会员服务
34+阅读 · 2019年10月18日
Stabilizing Transformers for Reinforcement Learning
专知会员服务
60+阅读 · 2019年10月17日
Keras François Chollet 《Deep Learning with Python 》, 386页pdf
专知会员服务
163+阅读 · 2019年10月12日
Transferring Knowledge across Learning Processes
CreateAMind
29+阅读 · 2019年5月18日
Unsupervised Learning via Meta-Learning
CreateAMind
44+阅读 · 2019年1月3日
meta learning 17年:MAML SNAIL
CreateAMind
11+阅读 · 2019年1月2日
STRCF for Visual Object Tracking
统计学习与视觉计算组
15+阅读 · 2018年5月29日
Focal Loss for Dense Object Detection
统计学习与视觉计算组
12+阅读 · 2018年3月15日
国家自然科学基金
13+阅读 · 2017年12月31日
国家自然科学基金
2+阅读 · 2015年12月31日
国家自然科学基金
2+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2014年12月31日
国家自然科学基金
0+阅读 · 2014年12月31日
Max-Margin Contrastive Learning
Arxiv
18+阅读 · 2021年12月21日
Memory-Gated Recurrent Networks
Arxiv
12+阅读 · 2020年12月24日
Arxiv
10+阅读 · 2020年6月12日
VIP会员
相关VIP内容
相关资讯
Transferring Knowledge across Learning Processes
CreateAMind
29+阅读 · 2019年5月18日
Unsupervised Learning via Meta-Learning
CreateAMind
44+阅读 · 2019年1月3日
meta learning 17年:MAML SNAIL
CreateAMind
11+阅读 · 2019年1月2日
STRCF for Visual Object Tracking
统计学习与视觉计算组
15+阅读 · 2018年5月29日
Focal Loss for Dense Object Detection
统计学习与视觉计算组
12+阅读 · 2018年3月15日
相关论文
Max-Margin Contrastive Learning
Arxiv
18+阅读 · 2021年12月21日
Memory-Gated Recurrent Networks
Arxiv
12+阅读 · 2020年12月24日
Arxiv
10+阅读 · 2020年6月12日
相关基金
国家自然科学基金
13+阅读 · 2017年12月31日
国家自然科学基金
2+阅读 · 2015年12月31日
国家自然科学基金
2+阅读 · 2015年12月31日
国家自然科学基金
0+阅读 · 2014年12月31日
国家自然科学基金
0+阅读 · 2014年12月31日
Top
微信扫码咨询专知VIP会员