| 1 |
Understanding Reward Ambiguity Through Optimal Transport Theory in Inverse Reinforcement Learning |
利用最优传输理论解决逆强化学习中的奖励模糊问题 |
reinforcement learning inverse reinforcement learning |
|
|
| 2 |
CLARA: Multilingual Contrastive Learning for Audio Representation Acquisition |
提出CLARA以解决多语言音频情感识别问题 |
representation learning contrastive learning |
|
|
| 3 |
Learning Gradient Fields for Scalable and Generalizable Irregular Packing |
提出基于梯度场学习的可扩展不规则包装解决方案 |
reinforcement learning spatial relationship |
|
|
| 4 |
MARVEL: Multi-Agent Reinforcement-Learning for Large-Scale Variable Speed Limits |
提出MARVEL框架以解决高速公路可变限速控制问题 |
reinforcement learning |
|
|
| 5 |
Enhancing the Performance of Automated Grade Prediction in MOOC using Graph Representation Learning |
通过图表示学习提升MOOC自动评分预测性能 |
representation learning |
✅ |
|
| 6 |
Accelerated Policy Gradient: On the Convergence Rates of the Nesterov Momentum for Reinforcement Learning |
提出加速策略梯度方法以提高强化学习收敛速度 |
reinforcement learning |
|
|
| 7 |
Accelerate Presolve in Large-Scale Linear Programming via Reinforcement Learning |
提出强化学习框架以加速大规模线性规划的预处理 |
reinforcement learning |
|
|
| 8 |
On The Expressivity of Objective-Specification Formalisms in Reinforcement Learning |
提出全面比较17种目标规范形式以解决RL中的表达性问题 |
reinforcement learning |
|
|
| 9 |
Hetero$^2$Net: Heterophily-aware Representation Learning on Heterogenerous Graphs |
提出Hetero$^2$Net以解决异构图中的异质性问题 |
representation learning |
|
|
| 10 |
Learning to Optimise Climate Sensor Placement using a Transformer |
提出基于深度强化学习的气候传感器优化布置方法 |
reinforcement learning deep reinforcement learning |
|
|
| 11 |
Improving Generalization of Alignment with Human Preferences through Group Invariant Learning |
提出一种新方法以提升对人类偏好的对齐泛化能力 |
reinforcement learning RLHF |
|
|