cs.LG(2023-10-07)
📊 共 12 篇论文 | 🔗 1 篇有代码
🎯 兴趣领域导航
支柱二:RL算法与架构 (RL & Architecture) (5)
支柱九:具身大模型 (Embodied Foundation Models) (5)
支柱一:机器人控制 (Robot Control) (2 🔗1)
🔬 支柱二:RL算法与架构 (RL & Architecture) (5 篇)
| # | 题目 | 一句话要点 | 标签 | 🔗 | ⭐ |
|---|---|---|---|---|---|
| 1 | Digital Twin Assisted Deep Reinforcement Learning for Online Admission Control in Sliced Network | 提出数字双胞胎加速深度强化学习以解决切片网络的在线接纳控制问题 | reinforcement learning deep reinforcement learning DRL | ||
| 2 | Accelerate Multi-Agent Reinforcement Learning in Zero-Sum Games with Subgame Curriculum Learning | 提出子游戏课程学习框架以加速零和博弈中的多智能体强化学习 | reinforcement learning curriculum learning | ||
| 3 | Task Aware Modulation using Representation Learning: An Approach for Few Shot Learning in Environmental Systems | 提出TAM-RL以解决环境系统中的少样本学习问题 | representation learning multimodal | ||
| 4 | Improving Offline-to-Online Reinforcement Learning with Q Conditioned State Entropy Exploration | 提出Q条件状态熵探索以解决离线到在线强化学习的分布偏移问题 | reinforcement learning offline reinforcement learning CQL | ||
| 5 | Optimal Sequential Decision-Making in Geosteering: A Reinforcement Learning Approach | 提出基于深度强化学习的地质导向最优决策方法 | reinforcement learning |
🔬 支柱九:具身大模型 (Embodied Foundation Models) (5 篇)
| # | 题目 | 一句话要点 | 标签 | 🔗 | ⭐ |
|---|---|---|---|---|---|
| 6 | Beyond Text: A Deep Dive into Large Language Models' Ability on Understanding Graph Data | 评估大型语言模型在图数据理解中的能力 | large language model | ||
| 7 | Large Language Models for Spatial Trajectory Patterns Mining | 利用大型语言模型检测人类空间轨迹异常行为 | large language model | ||
| 8 | Critique Ability of Large Language Models | 提出CriticBench基准以评估大语言模型的批判能力 | large language model | ||
| 9 | Label-free Node Classification on Graphs with Large Language Models (LLMS) | 提出LLM-GNN以解决图节点分类中的标签依赖问题 | large language model | ||
| 10 | A Unified Perspective for Loss-Oriented Imbalanced Learning via Localization | 提出统一视角以解决失衡学习中的损失问题 | foundation model |
🔬 支柱一:机器人控制 (Robot Control) (2 篇)
| # | 题目 | 一句话要点 | 标签 | 🔗 | ⭐ |
|---|---|---|---|---|---|
| 11 | Offline Imitation Learning with Variational Counterfactual Reasoning | 提出OILCA框架以解决离线模仿学习中的数据稀缺问题 | manipulation imitation learning | ✅ | |
| 12 | Prompt-to-OS (P2OS): Revolutionizing Operating Systems and Human-Computer Interaction with Integrated AI Generative Models | 提出Prompt-to-OS以革新人机交互与操作系统 | manipulation |