
LearningToLearn:利用梯度驱动的双层优化方法学习损失与回报函数的算法合集
5星
- 浏览量: 0
- 大小:None
- 文件类型:None
简介:
LearningToLearn是一套创新算法,采用独特的梯度驱动双层优化策略,专注于高效地学习适应性损失和奖励函数,以提升机器学习模型的自适应性和泛化能力。
该存储库包含以下代码:
- ML3:在ICPR 2020上发表的通过学习损失进行元学习获得了最佳学生奖。
- MBIRL:基于模型的逆向强化学习,用于视觉演示,在CoRL 2020上发表。
要在LearningToLearn文件夹中设置并运行代码,请执行以下命令:
```
conda create -n l2l python=3.7
conda activate l2l
python setup.py develop
```
要复制ML3论文的结果,按照ml3文件夹中的说明进行操作。引用ML3的参考文献如下:
@inproceedings{ml3,
author = {Sarah Bechtle and Artem Molchanov and Yevgen Chebotar and Edward Grefenstette and Ludovic Righetti and Gaurav Sukhatme}
全部评论 (0)
还没有任何评论哟~


