cs.LG(2023-10-06)

📊 共 23 篇论文 | 🔗 7 篇有代码

🎯 兴趣领域导航

支柱二:RL算法与架构 (RL & Architecture) (11 🔗3) 支柱九:具身大模型 (Embodied Foundation Models) (10 🔗3) 支柱一:机器人控制 (Robot Control) (2 🔗1)

🔬 支柱二:RL算法与架构 (RL & Architecture) (11 篇)

#题目一句话要点标签🔗
1 Self-Confirming Transformer for Belief-Conditioned Adaptation in Offline Multi-Agent Reinforcement Learning 提出自确认变换器以解决离线多智能体强化学习中的适应问题 reinforcement learning offline RL offline reinforcement learning
2 Beyond Uniform Sampling: Offline Reinforcement Learning with Imbalanced Datasets 提出一种新采样策略以解决离线强化学习中的不平衡数据问题 reinforcement learning policy learning offline RL
3 Amortizing intractable inference in large language models 提出基于变分推断的LLM采样方法以解决后验分布不可处理问题 reinforcement learning large language model chain-of-thought
4 Confronting Reward Model Overoptimization with Constrained RLHF 提出约束强化学习以解决复合奖励模型过度优化问题 reinforcement learning RLHF large language model
5 Adjustable Robust Reinforcement Learning for Online 3D Bin Packing 提出可调鲁棒强化学习框架以解决在线3D装箱问题 reinforcement learning deep reinforcement learning DRL
6 Improving Reinforcement Learning Efficiency with Auxiliary Tasks in Non-Visual Environments: A Comparison 提出辅助任务以提高非视觉环境中的强化学习效率 reinforcement learning representation learning
7 Understanding, Predicting and Better Resolving Q-Value Divergence in Offline-RL 提出自激励特征度量以解决离线强化学习中的Q值发散问题 offline RL
8 T-Rep: Representation Learning for Time Series using Time-Embeddings 提出T-Rep以解决多变量时间序列表示学习问题 representation learning
9 Reinforcement Learning with Fast and Forgetful Memory 提出快速遗忘记忆以解决强化学习中的记忆问题 reinforcement learning
10 Perfect Alignment May be Poisonous to Graph Contrastive Learning 提出针对图对比学习的增强策略以提升下游任务性能 contrastive learning
11 Amortized Network Intervention to Steer the Excitatory Point Processes 提出ANI框架以优化动态图中的事件流管理 reinforcement learning policy learning

🔬 支柱九:具身大模型 (Embodied Foundation Models) (10 篇)

#题目一句话要点标签🔗
12 Can pruning make Large Language Models more efficient? 通过权重剪枝提升大型语言模型的计算效率 large language model
13 ReLU Strikes Back: Exploiting Activation Sparsity in Large Language Models 提出ReLU激活以解决大语言模型推理效率问题 large language model
14 Talk like a Graph: Encoding Graphs for Large Language Models 提出图结构数据编码方法以提升大语言模型推理能力 large language model
15 LLM4DV: Using Large Language Models for Hardware Test Stimuli Generation 提出LLM4DV以解决硬件测试刺激生成问题 large language model
16 The Role of Federated Learning in a Wireless World with Foundation Models 探讨基础模型与联邦学习在无线网络中的协同作用 foundation model
17 Profit: Benchmarking Personalization and Robustness Trade-off in Federated Prompt Tuning 提出基准测试以解决联邦学习中的个性化与鲁棒性权衡问题 large language model foundation model
18 BrainSCUBA: Fine-Grained Natural Language Captions of Visual Cortex Selectivity 提出BrainSCUBA以解决视觉皮层选择性描述问题 large language model
19 Why Do We Need Weight Decay in Modern Deep Learning? 探讨现代深度学习中权重衰减的必要性与作用 large language model
20 On the Embedding Collapse when Scaling up Recommendation Models 提出多嵌入设计以解决推荐模型的嵌入崩溃问题 foundation model
21 An In-Context Learning Agent for Formal Theorem-Proving 提出COPRA以解决形式定理证明中的学习效率问题 large language model

🔬 支柱一:机器人控制 (Robot Control) (2 篇)

#题目一句话要点标签🔗
22 PriViT: Vision Transformers for Fast Private Inference 提出PriViT以解决视觉变换器在私有推理中的效率问题 MPC
23 Program Synthesis with Best-First Bottom-Up Search 提出Bee Search以解决现有程序合成方法的信息损失问题 manipulation

⬅️ 返回 cs.LG 首页 · 🏠 返回主页