| 1 |
Multimodal Semantic-Aware Contrastive Learning For False Negative Mitigation in 3D Medical Imaging |
提出多模态语义感知对比学习以解决医学影像中的假阴性问题 |
contrastive learning multimodal |
|
|
| 2 |
A Continuous-Time Reinforcement Learning Framework for Fine-Tuning Discrete Diffusion Models |
提出连续时间强化学习框架以优化离散扩散模型 |
reinforcement learning PPO MDM |
|
|
| 3 |
MIDI-RAE-JEPA: Hierarchical Representation Learning and Generation for Symbolic Music |
提出MIDI-RAE-JEPA以解决符号音乐表示的自监督学习问题 |
flow matching JEPA representation learning |
|
|
| 4 |
Non-vacuous Generalization Bounds for Reinforcement Learning with Verifiable Rewards |
提出非空泛的强化学习泛化界限以解决可验证奖励问题 |
reinforcement learning distillation large language model |
|
|
| 5 |
On-Policy Delta Distillation |
提出On-Policy Delta Distillation以提升强化学习中的推理能力 |
reinforcement learning distillation |
✅ |
|
| 6 |
Angular Gaussian Supervised Contrastive Learning for Long-Tailed Electrocardiogram Arrhythmia Diagnosis |
提出Angular Gaussian监督对比学习以解决长尾心电图心律失常诊断问题 |
representation learning contrastive learning |
✅ |
|
| 7 |
Learning in Infinitesimal Non-Compositional Sketches |
提出LINCS框架以修复非组合性问题 |
reinforcement learning large language model |
|
|
| 8 |
Evaluating covariate balance for long time horizon Markov decision processes |
提出协变量平衡诊断以解决离线强化学习中的偏差问题 |
reinforcement learning offline RL offline reinforcement learning |
|
|
| 9 |
Optimal Self-Distillation for Rectified Flow via Linear Probing |
提出最优自蒸馏方法以提升修正流模型性能 |
distillation |
|
|
| 10 |
Trajectory-Aware Flow Matching for Topology Optimisation |
提出基于流匹配的拓扑优化框架以提升设计效率 |
flow matching |
|
|
| 11 |
TIDE: Trustworthy and Interpretable Battery Degradation Estimation with Contextual Learning and Symbolic Distillation |
提出TIDE以解决电池健康估计的信任性与可解释性问题 |
distillation |
|
|
| 12 |
Beyond Entropy: Correctness-Aware Advantage Shaping via Contrastive Policy Optimization |
提出对比策略优化以解决奖励可验证性问题 |
reinforcement learning distillation |
|
|