cs.LG(2023-10-03)

📊 共 24 篇论文 | 🔗 1 篇有代码

🎯 兴趣领域导航

支柱二:RL算法与架构 (RL & Architecture) (12 🔗1) 支柱九:具身大模型 (Embodied Foundation Models) (9) 支柱五:交互与反应 (Interaction & Reaction) (2) 支柱一:机器人控制 (Robot Control) (1)

🔬 支柱二:RL算法与架构 (RL & Architecture) (12 篇)

#题目一句话要点标签🔗
1 Can a student Large Language Model perform as well as it's teacher? 提出知识蒸馏以优化学生模型在资源受限环境中的表现 distillation large language model
2 Reinforcement Learning from Automatic Feedback for High-Quality Unit Test Generation 提出基于静态质量指标的强化学习方法以提升单元测试生成质量 reinforcement learning PPO large language model
3 A Deep Reinforcement Learning Approach for Interactive Search with Sentence-level Feedback 提出DQrank以解决交互搜索中的句子级反馈问题 reinforcement learning deep reinforcement learning
4 Language Models Represent Space and Time 提出语言模型空间与时间表示的研究以揭示其真实世界的理解能力 world model world models spatiotemporal
5 OOD Aware Supervised Contrastive Learning 提出OOD感知的监督对比学习以解决OOD检测问题 representation learning contrastive learning
6 Learning Optimal Advantage from Preferences and Mistaking it for Reward 提出基于遗憾的偏好模型以优化奖励学习 reinforcement learning RLHF large language model
7 Blending Imitation and Reinforcement Learning for Robust Policy Improvement 提出RPI算法以解决强化学习样本复杂度问题 reinforcement learning imitation learning
8 Distributionally Safe Reinforcement Learning under Model Uncertainty: A Single-Level Approach by Differentiable Convex Programming 提出一种可处理模型不确定性的单层安全强化学习方法 reinforcement learning
9 SNIP: Bridging Mathematical Symbolic and Numeric Realms with Unified Pre-training 提出SNIP模型以解决符号与数值领域的整合问题 contrastive learning multimodal
10 Conditional Instrumental Variable Regression with Representation Learning for Causal Inference 提出条件工具变量回归以解决因果推断中的混杂问题 representation learning
11 On Representation Complexity of Model-based and Model-free Reinforcement Learning 研究强化学习的电路复杂性以提升样本效率 reinforcement learning
12 PCGPT: Procedural Content Generation via Transformers 提出PCGPT框架以解决程序内容生成中的重复性问题 reinforcement learning offline reinforcement learning

🔬 支柱九:具身大模型 (Embodied Foundation Models) (9 篇)

#题目一句话要点标签🔗
13 Time-LLM: Time Series Forecasting by Reprogramming Large Language Models 提出Time-LLM以解决时间序列预测的模型通用性问题 large language model foundation model
14 Large Language Models as Analogical Reasoners 提出类比提示方法以提升大语言模型推理能力 large language model chain-of-thought
15 DeepDecipher: Accessing and Investigating Neuron Activation in Large Language Models 提出DeepDecipher以解决大语言模型可解释性不足问题 large language model
16 Can large language models provide useful feedback on research papers? A large-scale empirical analysis 利用GPT-4生成科研论文反馈以解决反馈不足问题 large language model
17 Sampling Multimodal Distributions with the Vanilla Score: Benefits of Data-Based Initialization 提出基于数据初始化的香草评分方法以解决多模态分布采样问题 multimodal
18 Large Language Models for Test-Free Fault Localization 提出LLMAO以解决无测试覆盖的故障定位问题 large language model
19 EGraFFBench: Evaluation of Equivariant Graph Neural Network Force Fields for Atomistic Simulations 提出EGraFFBench以评估等变图神经网络力场在原子模拟中的应用 foundation model
20 A Neural Scaling Law from Lottery Ticket Ensembling 提出彩票票据集成方法以揭示神经网络缩放定律 large language model
21 Perceiver-based CDF Modeling for Time Series Forecasting 提出Perceiver-CDF模型以解决时间序列预测中的计算资源限制问题 multimodal

🔬 支柱五:交互与反应 (Interaction & Reaction) (2 篇)

#题目一句话要点标签🔗
22 The Inhibitor: ReLU and Addition-Based Attention for Efficient Transformers under Fully Homomorphic Encryption on the Torus 提出基于ReLU和加法的注意力机制以提高同态加密下的Transformer效率 OMOMO
23 Learning unitaries with quantum statistical queries 提出量子统计查询算法以学习单位算子 CHOIS

🔬 支柱一:机器人控制 (Robot Control) (1 篇)

#题目一句话要点标签🔗
24 SelectFormer: Private and Practical Data Selection for Transformers 提出SelectFormer以解决私有数据选择问题 MPC

⬅️ 返回 cs.LG 首页 · 🏠 返回主页