arXiv 中文要点汇总
🤖 cs.RO
机器人📊 领域分布
机器人控制 8247
RL算法与架构 1371
具身大模型 1002
空间感知与语义 938
动作重定向 127
物理动画 104
生成式动作 75
空间感知 65
视频提取与匹配 62
交互与反应 15
其他 14
📆 最近更新
📝 最新论文
- Data Pyramid for Embodied Manipulation
提出数据金字塔模型以优化机器人操作数据收集 - τ: Learning Touch-Augmented Vision-Language-Action Models fr...
提出τ框架以解决触觉增强视觉-语言-动作模型的学习问题 - FloAff-Kitchen: Bridging Navigation and Manipulation via Can... 🔗
提出FloAff-Kitchen框架以解决移动操控中的地面可用性识别问题 - NEO: NeRF It Once, Edit It Many Times for Continuous Object ...
提出NEO框架以实现语言引导的NeRF编辑与机器人操作 - A note on the motion representation and configuration update...
提出基于SE(3)的刚体运动约束建模方法
👁️ cs.CV
视觉📊 领域分布
具身大模型 6634
空间感知与语义 4921
RL算法与架构 4843
机器人控制 1404
视频提取与匹配 629
生成式动作 600
物理动画 532
动作重定向 531
空间感知 328
交互与反应 204
视频提取与匹配 6
其他 5
📆 最近更新
📝 最新论文
- RP-OPSD: Resolution-Privileged On-Policy Self-Distillation f...
提出RP-OPSD以解决多模态大语言模型的自蒸馏问题 - GenSplatCodec: Feed-Forward Gaussian Splatting Compression v...
提出GenSplatCodec以解决低比特率高频纹理压缩问题 - MAViE: A Multi-scale Adaptive Vision Encoder for Fine-graine...
提出多尺度自适应视觉编码器以提升细粒度视觉感知与多模态推理效率 - ClinFusion: A Vision-Centric Multimodal LLM System for Holis...
提出ClinFusion以解决医疗领域多模态理解问题 - Color Fundus Photography Analysis: Co-evolution of Data, Pre...
提出多模态AI框架以提升眼底摄影分析的临床应用
🎨 cs.GR
图形学📊 领域分布
空间感知与语义 305
机器人控制 114
具身大模型 79
生成式动作 71
RL算法与架构 57
物理动画 43
动作重定向 21
视频提取与匹配 15
空间感知 6
交互与反应 4
视频提取与匹配 1
📆 最近更新
📝 最新论文
- MR-Compare: A Mixed-Reality Framework for Spatially Grounded... 🔗
提出MR-Compare框架以解决3D重建的视觉比较问题 - Fast Wave-optics Rendering of Multiplane Images for 3D Holog...
提出波光学渲染管道以高效合成3D全息图 - Packet-Loss Robust 3D Gaussian Compression via Atomic Packag...
提出一种抗丢包的3D高斯压缩框架以解决网络流传输问题 - ARDY: Autoregressive Diffusion with Hybrid Representation fo...
提出ARDY以解决实时人类动作生成的控制性与速度问题 - HoloTetSphere: Unified TetSphere Mesh Reconstruction for Phy...
提出HoloTetSphere以解决物理仿真中的网格重建问题
🧠 cs.LG
机器学习 (RL, Diffusion, World Model)📊 领域分布
RL算法与架构 6820
具身大模型 5723
机器人控制 832
物理动画 518
生成式动作 152
交互与反应 104
动作重定向 89
空间感知与语义 88
视频提取与匹配 33
空间感知 3
其他 1
📆 最近更新
📝 最新论文
- Learning Reusable Hybrid Motion Priors for Humanoid Locomoti...
提出可重用的混合运动先验以解决类人机器人运动控制问题 - Explainable Reinforcement Learning via Physics-Aware Policy ...
通过物理感知的策略蒸馏提升深度强化学习可解释性 - MEGA-CL: A Molecular Foundation Model for Generalizable ADME...
提出MEGA-CL以解决小分子ADMET预测的挑战 - Stress-Testing EEG Foundation Models for Clinical Decoding: ...
评估EEG基础模型在临床解码中的有效性与鲁棒性 - Evaluating Fuzz Testing for Reinforcement Learning Agents
提出全面评估方法以优化强化学习代理的模糊测试
🤔 cs.AI
人工智能 (Agents, Planning)📊 领域分布
具身大模型 8794
RL算法与架构 3020
机器人控制 571
物理动画 176
空间感知与语义 132
生成式动作 106
交互与反应 71
动作重定向 55
视频提取与匹配 48
空间感知 3
📆 最近更新
📝 最新论文
- DICA: Dual-Indicator Guided Contrastive Alignment in Multimo... 🔗
提出DICA以解决多模态大语言模型的视觉推理问题 - A Motion-Aware Vector Quantization Framework with Centroid R...
提出VQVLA框架以解决VLA模型推理延迟问题 - Task-Conditional Faithfulness Auditing of Multimodal LLMs fo...
提出任务条件的多模态大语言模型可信度审计框架以解决电网诊断问题 - HELIOS: An LLM-Driven Autonomous Indirect Trajectory Optimiz...
提出HELIOS以解决低推力轨迹优化中的多重挑战 - Making Mathematical Knowledge Explainable, Accessible and In...
通过大语言模型集成提升数学知识的可解释性与可访问性
💬 cs.CL
自然语言 (VLA, Text-to-Motion)📊 领域分布
具身大模型 16421
RL算法与架构 3181
机器人控制 295
视频提取与匹配 98
空间感知与语义 67
动作重定向 41
生成式动作 40
物理动画 36
交互与反应 21
空间感知 1
📆 最近更新
📝 最新论文
- StanceFlip: A Comprehensive Multi-Dimensional Benchmark for ...
提出StanceFlip基准以解决多模态对话立场翻转预测问题 - CONSISTRE: A Unified Consistency-Aware Framework for Documen...
提出CONSISTRE框架以解决文档级关系抽取中的一致性问题 - The Physics of Multi-Turn Long-Horizon Planning: From Pre-tr...
提出统一控制的多回合长远规划方法以提升基础模型能力 - D-Score: A Spectral Hidden-State Signal for Hallucination De...
提出D-Score以解决大型语言模型的幻觉检测问题 - Understanding Tone-Dependent Inference Cost in Large Languag...
研究提示语语气对大型语言模型推理成本的影响
⚙️ eess.SY
系统控制 (MPC, Dynamics)📊 领域分布
机器人控制 1144
RL算法与架构 463
生成式动作 236
物理动画 191
具身大模型 165
交互与反应 27
空间感知与语义 12
动作重定向 8
视频提取与匹配 4
其他 4
空间感知 3
📆 最近更新
📝 最新论文
- Bridging Reinforcement Learning and Optimal Control via Feas...
提出可行动作映射以解决约束动态系统控制问题 - Does Central Planning Fail Locally? Evaluating EV Charging F...
提出双层优化方法以解决电动汽车充电灵活性问题 - Understanding the role and value of battery storage in renew...
提出基于OU过程的LEM框架以优化可再生能源存储价值 - Deep Reinforcement Learning for Adaptive Gain Tuning in Cont...
提出混合控制方法以解决遥操作机器人中的关节柔性与延迟问题 - Safety and Security: Experimental Validation of Encrypted Mo...
提出加密模型预测控制以解决安全过程控制问题