| 1 |
Toward Generalizable Cognitive Impairment Detection with Speech-Based Multimodal Large Language Models |
提出多模态框架以解决认知障碍检测问题 |
representation learning large language model multimodal |
|
|
| 2 |
M$^3$-Gen: Interpretable Multimodal Generation of Gene Expression Profiles Using Clinical and Imaging Data |
提出M$^3$-Gen以解决基因表达数据生成问题 |
contrastive learning multimodal |
|
|
| 3 |
Training Large Language Models for Self-Explanation Faithfulness |
提出强化学习方法以优化自我解释的可信度 |
reinforcement learning large language model |
|
|
| 4 |
X$^3$-OPD: Distilling Reasoning into Large Audio-Language Models via On-Policy Alignment |
提出X$^3$-OPD以解决音频语言模型推理能力不足问题 |
distillation large language model chain-of-thought |
|
|
| 5 |
Compact Latent Coordination for Autonomous Vehicles at Unsignalized Intersections |
提出MAPS以解决无信号交叉口自主车辆协调问题 |
reinforcement learning deep reinforcement learning DRL |
|
|
| 6 |
Context-weighted Discrete Flow Matching |
提出上下文加权离散流匹配以提升生成模型性能 |
flow matching |
|
|
| 7 |
Windowed-MTP: Removing the Full-Context Draft-KV Tax at Million-Token Context |
提出Windowed-MTP以解决百万标记上下文中的全上下文草稿KV成本问题 |
Mamba linear attention |
|
|
| 8 |
Approximate Quantum State Preparation Through Proximal Policy Optimization |
提出基于近端策略优化的量子态近似制备框架 |
reinforcement learning deep reinforcement learning |
|
|
| 9 |
Relative Value Learning |
提出相对价值学习框架以优化强化学习控制 |
reinforcement learning PPO |
|
|