cs.CL(2026-07-22)
📊 共 16 篇论文 | 🔗 2 篇有代码
🎯 兴趣领域导航
🔬 支柱九:具身大模型 (Embodied Foundation Models) (10 篇)
🔬 支柱二:RL算法与架构 (RL & Architecture) (6 篇)
| # | 题目 | 一句话要点 | 标签 | 🔗 | ⭐ |
|---|---|---|---|---|---|
| 11 | Reinforcement Learning for Large Language Model Selective Evidence Adoption from Contaminated Retrieval Results | 提出SelectBench以解决大语言模型选择性证据采纳问题 | reinforcement learning reward shaping large language model | ||
| 12 | SLPO: Scaling Latent Reasoning via a Surrogate Policy | 提出SLPO以解决潜在推理中的奖励优化问题 | reinforcement learning chain-of-thought | ||
| 13 | When Does Knowledge Distillation Hurt? Reliability-Aware Distillation for Low-Resource Language Summarization | 提出可靠性感知蒸馏方法以解决低资源语言摘要问题 | distillation | ||
| 14 | Notes to Self: Can LLMs Benefit from Experiential Abstractions? | 提出经验抽象方法以提升大型语言模型的推理能力 | reinforcement learning large language model | ||
| 15 | Multi-Mask Diffusion Language Models for Few-Step Generation | 提出多掩码扩散语言模型以解决少步生成问题 | distillation MDM | ||
| 16 | Solar Open 2 Technical Report | 提出Solar Open 2以解决长时间跨度智能任务的挑战 | linear attention distillation |