cs.LG(2023-10-21)
📊 共 6 篇论文 | 🔗 1 篇有代码
🎯 兴趣领域导航
支柱二:RL算法与架构 (RL & Architecture) (3)
支柱九:具身大模型 (Embodied Foundation Models) (2 🔗1)
支柱三:空间感知与语义 (Perception & Semantics) (1)
🔬 支柱二:RL算法与架构 (RL & Architecture) (3 篇)
| # | 题目 | 一句话要点 | 标签 | 🔗 | ⭐ |
|---|---|---|---|---|---|
| 1 | One is More: Diverse Perspectives within a Single Network for Efficient DRL | 提出OMNet以解决深度强化学习中的低样本效率问题 | reinforcement learning deep reinforcement learning DRL | ||
| 2 | Stabilizing reinforcement learning control: A modular framework for optimizing over all stable behavior | 提出一种模块化框架以优化稳定性强化学习控制 | reinforcement learning deep reinforcement learning | ||
| 3 | Application of deep and reinforcement learning to boundary control problems | 提出深度学习与强化学习方法以解决边界控制问题 | reinforcement learning |
🔬 支柱九:具身大模型 (Embodied Foundation Models) (2 篇)
| # | 题目 | 一句话要点 | 标签 | 🔗 | ⭐ |
|---|---|---|---|---|---|
| 4 | Beyond Accuracy: Evaluating Self-Consistency of Code Large Language Models with IdentityChain | 提出IdentityChain框架以评估代码大语言模型的自一致性 | large language model | ✅ | |
| 5 | Revisiting Instruction Fine-tuned Model Evaluation to Guide Industrial Applications | 提出针对工业应用的指令微调模型评估方法 | large language model |
🔬 支柱三:空间感知与语义 (Perception & Semantics) (1 篇)
| # | 题目 | 一句话要点 | 标签 | 🔗 | ⭐ |
|---|---|---|---|---|---|
| 6 | CLIP meets Model Zoo Experts: Pseudo-Supervision for Visual Enhancement | 通过伪监督增强CLIP模型的视觉表示能力 | depth estimation |