Bridging Perception and Action: Spatially-Grounded Mid-Level Representations for Robot Generalization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Jonathan, Fu, Chuyuan Kelly, Shah, Dhruv, Sadigh, Dorsa, Xia, Fei, Zhang, Tingnan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Invariance Co-training for Robot Visual Generalization
par: Yang, Jonathan, et autres
Publié: (2025)
par: Yang, Jonathan, et autres
Publié: (2025)
Data Analogies Enable Efficient Cross-Embodiment Transfer
par: Yang, Jonathan, et autres
Publié: (2026)
par: Yang, Jonathan, et autres
Publié: (2026)
Pushing the Limits of Cross-Embodiment Learning for Manipulation and Navigation
par: Yang, Jonathan, et autres
Publié: (2024)
par: Yang, Jonathan, et autres
Publié: (2024)
CLAW: A Vision-Language-Action Framework for Weight-Aware Robotic Grasping
par: An, Zijian, et autres
Publié: (2025)
par: An, Zijian, et autres
Publié: (2025)
Grounding Robot Generalization in Training Data via Retrieval-Augmented VLMs
par: Gao, Jensen, et autres
Publié: (2026)
par: Gao, Jensen, et autres
Publié: (2026)
Automated Robot Recovery from Assumption Violations of High-Level Specifications
par: Meng, Qian, et autres
Publié: (2024)
par: Meng, Qian, et autres
Publié: (2024)
Context Representation via Action-Free Transformer encoder-decoder for Meta Reinforcement Learning
par: Enayati, Amir M. Soufi, et autres
Publié: (2025)
par: Enayati, Amir M. Soufi, et autres
Publié: (2025)
SeqVLA: Sequential Task Execution for Long-Horizon Manipulation with Completion-Aware Vision-Language-Action Model
par: Yang, Ran, et autres
Publié: (2025)
par: Yang, Ran, et autres
Publié: (2025)
CAVER: Curious Audiovisual Exploring Robot
par: Macesanu, Luca, et autres
Publié: (2025)
par: Macesanu, Luca, et autres
Publié: (2025)
Toward a Better Understanding of Robot Energy Consumption in Agroecological Applications
par: Bras, Alexis, et autres
Publié: (2024)
par: Bras, Alexis, et autres
Publié: (2024)
Action-Aware Pro-Active Safe Exploration for Mobile Robot Mapping
par: İşleyen, Aykut, et autres
Publié: (2025)
par: İşleyen, Aykut, et autres
Publié: (2025)
Autonomous Robotic System with Optical Coherence Tomography Guidance for Vascular Anastomosis
par: Haworth, Jesse, et autres
Publié: (2024)
par: Haworth, Jesse, et autres
Publié: (2024)
Development of Compositionality and Generalization through Interactive Learning of Language and Action of Robots
par: Vijayaraghavan, Prasanna, et autres
Publié: (2024)
par: Vijayaraghavan, Prasanna, et autres
Publié: (2024)
Action Agent: Agentic Video Generation Meets Flow-Constrained Diffusion
par: Sam, Jeffrin, et autres
Publié: (2026)
par: Sam, Jeffrin, et autres
Publié: (2026)
Enhancing Robustness in Language-Driven Robotics: A Modular Approach to Failure Reduction
par: Garrabé, Émiland, et autres
Publié: (2024)
par: Garrabé, Émiland, et autres
Publié: (2024)
Recent Advances of Deep Robotic Affordance Learning: A Reinforcement Learning Perspective
par: Yang, Xintong, et autres
Publié: (2023)
par: Yang, Xintong, et autres
Publié: (2023)
Teacher Motion Priors: Enhancing Robot Locomotion over Challenging Terrain
par: Jin, Fangcheng, et autres
Publié: (2025)
par: Jin, Fangcheng, et autres
Publié: (2025)
MaP-AVR: A Meta-Action Planner for Agents Leveraging Vision Language Models and Retrieval-Augmented Generation
par: Guo, Zhenglong, et autres
Publié: (2025)
par: Guo, Zhenglong, et autres
Publié: (2025)
Dimension-variable Mapless Navigation with Deep Reinforcement Learning
par: Zhang, Wei, et autres
Publié: (2020)
par: Zhang, Wei, et autres
Publié: (2020)
A Time-dependent Risk-aware distributed Multi-Agent Path Finder based on A*
par: Nordström, S, et autres
Publié: (2025)
par: Nordström, S, et autres
Publié: (2025)
Self-Supervised Depth Correction of Lidar Measurements from Map Consistency Loss
par: Agishev, Ruslan, et autres
Publié: (2023)
par: Agishev, Ruslan, et autres
Publié: (2023)
UniLab: A Heterogeneous Architecture for Robot RL Beyond GPU-Dominant Paradigms
par: Jia, Yufei, et autres
Publié: (2026)
par: Jia, Yufei, et autres
Publié: (2026)
DISCOVERSE: Efficient Robot Simulation in Complex High-Fidelity Environments
par: Jia, Yufei, et autres
Publié: (2025)
par: Jia, Yufei, et autres
Publié: (2025)
FGGS-LiDAR: Ultra-Fast, GPU-Accelerated Simulation from General 3DGS Models to LiDAR
par: Wu, Junzhe, et autres
Publié: (2025)
par: Wu, Junzhe, et autres
Publié: (2025)
RLPP: A Residual Method for Zero-Shot Real-World Autonomous Racing on Scaled Platforms
par: Ghignone, Edoardo, et autres
Publié: (2025)
par: Ghignone, Edoardo, et autres
Publié: (2025)
GS-Playground: A High-Throughput Photorealistic Simulator for Vision-Informed Robot Learning
par: Jia, Yufei, et autres
Publié: (2026)
par: Jia, Yufei, et autres
Publié: (2026)
The Impact of Class Uncertainty Propagation in Perception-Based Motion Planning
par: Shah, Jibran Iqbal, et autres
Publié: (2026)
par: Shah, Jibran Iqbal, et autres
Publié: (2026)
MonoForce: Self-supervised Learning of Physics-informed Model for Predicting Robot-terrain Interaction
par: Agishev, Ruslan, et autres
Publié: (2023)
par: Agishev, Ruslan, et autres
Publié: (2023)
Two-Steps Diffusion Policy for Robotic Manipulation via Genetic Denoising
par: Clemente, Mateo, et autres
Publié: (2025)
par: Clemente, Mateo, et autres
Publié: (2025)
Automated Feature Selection for Inverse Reinforcement Learning
par: Baimukashev, Daulet, et autres
Publié: (2024)
par: Baimukashev, Daulet, et autres
Publié: (2024)
Learning Affordances at Inference-Time for Vision-Language-Action Models
par: Shah, Ameesh, et autres
Publié: (2025)
par: Shah, Ameesh, et autres
Publié: (2025)
A Fast Online Omnidirectional Quadrupedal Jumping Framework Via Virtual-Model Control and Minimum Jerk Trajectory Generation
par: Yue, Linzhu, et autres
Publié: (2024)
par: Yue, Linzhu, et autres
Publié: (2024)
Multi Object Tracking for Predictive Collision Avoidance
par: Gebregziabher, Bruk, et autres
Publié: (2023)
par: Gebregziabher, Bruk, et autres
Publié: (2023)
PyroTrack: Belief-Based Deep Reinforcement Learning Path Planning for Aerial Wildfire Monitoring in Partially Observable Environments
par: Khoshdel, Sahand, et autres
Publié: (2024)
par: Khoshdel, Sahand, et autres
Publié: (2024)
Heuristic Search for Path Finding with Refuelling
par: Zhao, Shizhe, et autres
Publié: (2023)
par: Zhao, Shizhe, et autres
Publié: (2023)
Learning Barrier-Certified Polynomial Dynamical Systems for Obstacle Avoidance with Robots
par: Schonger, Martin, et autres
Publié: (2024)
par: Schonger, Martin, et autres
Publié: (2024)
Learning to Communicate Functional States with Nonverbal Expressions for Improved Human-Robot Collaboration
par: Roy, Liam, et autres
Publié: (2024)
par: Roy, Liam, et autres
Publié: (2024)
Stinger Robot: A Self-Bracing Robotic Platform for Autonomous Drilling in Confined Underground Environments
par: Liu, H., et autres
Publié: (2025)
par: Liu, H., et autres
Publié: (2025)
Simulation-based Scenario Generation for Robust Hybrid AI for Autonomy
par: Keno, Hambisa, et autres
Publié: (2024)
par: Keno, Hambisa, et autres
Publié: (2024)
Open, Reproducible and Trustworthy Robot-Based Experiments with Virtual Labs and Digital-Twin-Based Execution Tracing
par: Alt, Benjamin, et autres
Publié: (2025)
par: Alt, Benjamin, et autres
Publié: (2025)
Documents similaires
-
Invariance Co-training for Robot Visual Generalization
par: Yang, Jonathan, et autres
Publié: (2025) -
Data Analogies Enable Efficient Cross-Embodiment Transfer
par: Yang, Jonathan, et autres
Publié: (2026) -
Pushing the Limits of Cross-Embodiment Learning for Manipulation and Navigation
par: Yang, Jonathan, et autres
Publié: (2024) -
CLAW: A Vision-Language-Action Framework for Weight-Aware Robotic Grasping
par: An, Zijian, et autres
Publié: (2025) -
Grounding Robot Generalization in Training Data via Retrieval-Augmented VLMs
par: Gao, Jensen, et autres
Publié: (2026)