cs.LG(2023-10-11)
📊 共 22 篇论文 | 🔗 5 篇有代码
🎯 兴趣领域导航
支柱二:RL算法与架构 (RL & Architecture) (11 🔗1)
支柱九:具身大模型 (Embodied Foundation Models) (8 🔗4)
支柱一:机器人控制 (Robot Control) (3)
🔬 支柱二:RL算法与架构 (RL & Architecture) (11 篇)
🔬 支柱九:具身大模型 (Embodied Foundation Models) (8 篇)
| # | 题目 | 一句话要点 | 标签 | 🔗 | ⭐ |
|---|---|---|---|---|---|
| 12 | LLark: A Multimodal Instruction-Following Language Model for Music | 提出LLark以解决音乐理解中的多模态指令跟随问题 | multimodal instruction following | ✅ | |
| 13 | Risk Aware Benchmarking of Large Language Models | 提出风险意识基准测试框架以评估大型语言模型的社会技术风险 | large language model foundation model | ||
| 14 | The Expressive Power of Transformers with Chain of Thought | 提出链式思维提升变换器推理能力 | chain-of-thought | ||
| 15 | Hypercomplex Multimodal Emotion Recognition from EEG and Peripheral Physiological Signals | 提出超复数多模态网络以解决情感识别的不足问题 | multimodal | ✅ | |
| 16 | CacheGen: KV Cache Compression and Streaming for Fast Large Language Model Serving | 提出CacheGen以解决长上下文处理延迟问题 | large language model | ✅ | |
| 17 | D2 Pruning: Message Passing for Balancing Diversity and Difficulty in Data Pruning | 提出D2 Pruning以平衡数据剪枝中的多样性与难度问题 | multimodal | ||
| 18 | MatFormer: Nested Transformer for Elastic Inference | 提出MatFormer以解决弹性推理问题 | foundation model | ✅ | |
| 19 | In-Context Unlearning: Language Models as Few Shot Unlearners | 提出上下文去学习方法以解决大语言模型的去学习问题 | large language model |
🔬 支柱一:机器人控制 (Robot Control) (3 篇)
| # | 题目 | 一句话要点 | 标签 | 🔗 | ⭐ |
|---|---|---|---|---|---|
| 20 | COPlanner: Plan to Roll Out Conservatively but to Explore Optimistically for Model-Based RL | 提出COPlanner以解决模型预测误差导致的次优策略问题 | MPC model predictive control reinforcement learning | ||
| 21 | Score Regularized Policy Optimization through Diffusion Behavior | 提出高效的确定性推理策略以解决扩散模型采样慢的问题 | locomotion reinforcement learning offline reinforcement learning | ||
| 22 | First-Order Dynamic Optimization for Streaming Convex Costs | 提出首阶动态优化算法以解决流式凸成本问题 | model predictive control |