cs.AI(2023-10-11)
📊 共 16 篇论文 | 🔗 1 篇有代码
🎯 兴趣领域导航
支柱九:具身大模型 (Embodied Foundation Models) (10)
支柱二:RL算法与架构 (RL & Architecture) (5 🔗1)
支柱一:机器人控制 (Robot Control) (1)
🔬 支柱九:具身大模型 (Embodied Foundation Models) (10 篇)
🔬 支柱二:RL算法与架构 (RL & Architecture) (5 篇)
| # | 题目 | 一句话要点 | 标签 | 🔗 | ⭐ |
|---|---|---|---|---|---|
| 11 | DeePref: Deep Reinforcement Learning For Video Prefetching In Content Delivery Networks | 提出DeePref以解决视频预取在内容分发网络中的挑战 | reinforcement learning deep reinforcement learning | ||
| 12 | Language-Guided Reinforcement Learning for Hard Attention in Few-Shot Learning | 提出LaHA框架以解决少样本学习中的硬注意力问题 | reinforcement learning deep reinforcement learning | ||
| 13 | Online Speculative Decoding | 提出在线推测解码以提升大语言模型推理效率 | distillation large language model | ✅ | |
| 14 | Reinforcement Learning-based Knowledge Graph Reasoning for Explainable Fact-checking | 提出基于强化学习的知识图谱推理方法以实现可解释的事实核查 | reinforcement learning | ||
| 15 | Quantifying Agent Interaction in Multi-agent Reinforcement Learning for Cost-efficient Generalization | 提出影响程度指标以解决多智能体强化学习中的泛化问题 | reinforcement learning |
🔬 支柱一:机器人控制 (Robot Control) (1 篇)
| # | 题目 | 一句话要点 | 标签 | 🔗 | ⭐ |
|---|---|---|---|---|---|
| 16 | RoboCLIP: One Demonstration is Enough to Learn Robot Policies | 提出RoboCLIP以解决强化学习中的奖励指定问题 | manipulation reinforcement learning imitation learning |