arXiv 中文要点汇总
🤖 cs.RO
机器人📊 领域分布
机器人控制 8681
RL算法与架构 1451
具身大模型 1051
空间感知与语义 976
动作重定向 133
物理动画 111
生成式动作 81
视频提取与匹配 72
空间感知 65
交互与反应 15
其他 14
📆 最近更新
📝 最新论文
- Morphology-Aware Human Motion Retargeting for Wheeled-Humano...
提出形态感知的人类运动重定向方法以解决轮式类人机器人运动与操作问题 - RIDE: Relocalization-Informed Depth Estimation with 3D Gauss...
提出RIDE以解决机器人深度估计中的定位信息不足问题 - CAP: Continuously Adaptive Perception-Blind Humanoid Locomot...
提出CAP以解决复杂地形下人形机器人感知盲区问题 - IMLE-VLA: Fast Single-Step Action Generation for Vision-Lang... 🔗
提出IMLE-VLA以解决视觉-语言-动作策略中的推理瓶颈问题 - Harness Robotic OS: A Unified Embodied-Agent Runtime for Clo...
提出HROS以解决自主四足机器人检查系统的集成问题
👁️ cs.CV
视觉📊 领域分布
具身大模型 7025
RL算法与架构 5166
空间感知与语义 5154
机器人控制 1476
视频提取与匹配 666
生成式动作 625
动作重定向 561
物理动画 553
空间感知 328
交互与反应 213
视频提取与匹配 6
其他 5
📆 最近更新
📝 最新论文
- Multi-Modal Controlled Coherent Motion Generation
提出MOCO框架以解决多模态3D头像运动生成问题 - World in World: Explore the World with World Models
提出World in World以解决视频重渲染中的灵活控制问题 - Tri-DehazeGS: Scene--Medium Decoupled Gaussian Splatting wit... 🔗
提出Tri-DehazeGS以解决雾霾图像中的3D场景重建问题 - Recursive Code World Models: Building Complex Worlds through...
提出递归代码世界模型以重建复杂3D场景 - SenseNova-U1.5: Towards Native Unified Visual Intelligence
提出SenseNova-U1.5以实现统一的视觉智能
🎨 cs.GR
图形学📊 领域分布
空间感知与语义 316
机器人控制 120
具身大模型 81
生成式动作 71
RL算法与架构 60
物理动画 45
动作重定向 21
视频提取与匹配 16
空间感知 6
交互与反应 4
视频提取与匹配 1
📆 最近更新
📝 最新论文
- ReCHOIR: Contact-guided Human Object Interaction Retargeting...
提出ReCHOIR以解决多样化角色的人物与物体交互重定向问题 - Hologram Representation via Quadratic Phase Gaussian Splatti...
提出复数值二次相位高斯表示以提升全息图质量 - Learning Realistic Athletic Sprinting Without Demonstrations
提出肌肉驱动模拟系统以生成真实的运动表现 - InstantMimic: A High Performance System for Learning Physics...
提出InstantMimic以解决物理基础技能学习效率低下问题 - RealSimLoop: Online Real-to-Sim Adaptation via Differentiabl...
提出RealSimLoop以解决在线真实与仿真适配问题
🧠 cs.LG
机器学习 (RL, Diffusion, World Model)📊 领域分布
RL算法与架构 7146
具身大模型 5998
机器人控制 868
物理动画 543
生成式动作 163
交互与反应 106
空间感知与语义 95
动作重定向 92
视频提取与匹配 34
空间感知 3
其他 1
📆 最近更新
📝 最新论文
- Evaluating Time-Series Foundation Models and Multimodal Diet...
提出多模态饮食背景下的CGM预测方法以提升糖尿病管理 - Bidirectional Multimodal Fusion of Sky Images and Time-Serie...
提出SolCloudLLM以解决短期光伏发电预测中的多模态融合问题 - Topological Necessities: Mechanism-Invariant Strategic Subgo...
提出拓扑必要性以解决跨体态目标条件控制问题 - A Dynamic Fusion Large Language Model for Traffic Flow Predi...
提出动态融合大语言模型以解决交通流预测问题 - CausalArena: Benchmarking Causal Discovery in the Foundation...
提出CausalArena以解决因果发现评估的多样性问题
🤔 cs.AI
人工智能 (Agents, Planning)📊 领域分布
具身大模型 9457
RL算法与架构 3280
机器人控制 625
物理动画 185
空间感知与语义 150
生成式动作 108
交互与反应 72
动作重定向 58
视频提取与匹配 52
空间感知 3
📆 最近更新
📝 最新论文
- RAMamba-Net: A Reliability-Aware and Mamba-Based Multimodal ...
提出RAMamba-Net以解决听觉注意力检测中的多模态融合问题 - ORCH: Organizational Principles Enable Collective Intelligen...
提出ORCH以优化多智能体系统的组织与协调 - SIRF: A Spec-Internalized Risk Foundation Model for Industri...
提出SIRF模型以解决工业内容风险控制问题 - MindTopo: Can Foundation Models Reason in Topological Space?
提出MindTopo基准以评估基础模型在拓扑空间中的推理能力 - Exploring Diffusion Transformers for Cross-Modal Augmentatio...
提出CoMA-DiT以解决多模态脑状态解码中的数据增强问题
💬 cs.CL
自然语言 (VLA, Text-to-Motion)📊 领域分布
具身大模型 16925
RL算法与架构 3333
机器人控制 303
视频提取与匹配 103
空间感知与语义 71
生成式动作 43
动作重定向 43
物理动画 39
交互与反应 23
空间感知 1
📆 最近更新
📝 最新论文
- OmniHallu: Unified Hallucination Detection for Cross-Modal C...
提出OmniHallu以解决多模态大语言模型中的幻觉检测问题 - Domain-Specific Hallucination Detection in Large Language Mo... 🔗
提出多信号检测管道以解决大语言模型的幻觉问题 - Negative Self-Distillation: Learning to Reason by Avoiding F...
提出负自蒸馏方法以解决复杂推理任务中的性能下降问题 - MultiHuSE: A Multimodal Dataset for Humour Styles and Emotio...
提出MultiHuSE数据集以解决幽默风格与情感识别问题 - Robust Multimodal Sentiment Analysis with Incomplete Modalit...
提出基于语义感知完整性的重建方法以解决多模态情感分析中的不完整性问题
⚙️ eess.SY
系统控制 (MPC, Dynamics)📊 领域分布
机器人控制 1192
RL算法与架构 484
生成式动作 246
物理动画 198
具身大模型 181
交互与反应 27
空间感知与语义 12
动作重定向 8
视频提取与匹配 4
其他 4
空间感知 3
📆 最近更新
📝 最新论文
- Predefined-Time Resilient Integral Reinforcement Learning fo...
提出预定义时间鲁棒积分强化学习以解决输入约束非线性系统控制问题 - A Primal-Dual Formulation for Pricing Static Voltage Stabili...
提出一种原始-对偶定价方法以解决静态电压稳定性服务问题 - Context operations to architecture modelling output from lar...
提出基于大语言模型的上下文操作框架以优化系统工程设计 - The Global Asymptotic Stability Problem for Linear MPC Is Un...
证明线性模型预测控制的全局渐近稳定性问题是不可判定的 - Spatial LLM Workload Shifting Needs Foresight: Model Commitm...
提出模型承诺以解决AI数据中心在电网约束下的负载转移问题