Look, Zoom, Understand: The Robotic Eyeball for Embodied Perception
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Jiashu, Han, Yifan, Xie, Yucheng, Guo, Ning, Lian, Wenzhao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
RobotPan: A 360$^\circ$ Surround-View Robotic Vision System for Embodied Perception
di: Ma, Jiahao, et al.
Pubblicazione: (2026)
di: Ma, Jiahao, et al.
Pubblicazione: (2026)
3D Generation for Embodied AI and Robotic Simulation: A Survey
di: Ye, Tianwei, et al.
Pubblicazione: (2026)
di: Ye, Tianwei, et al.
Pubblicazione: (2026)
Eye, Robot: Learning to Look to Act with a BC-RL Perception-Action Loop
di: Kerr, Justin, et al.
Pubblicazione: (2025)
di: Kerr, Justin, et al.
Pubblicazione: (2025)
Visual Environment-Interactive Planning for Embodied Complex-Question Answering
di: Lan, Ning, et al.
Pubblicazione: (2025)
di: Lan, Ning, et al.
Pubblicazione: (2025)
Uni-LaViRA: Language-Vision-Robot Actions Translation for Unified Embodied Navigation
di: Ding, Hongyu, et al.
Pubblicazione: (2026)
di: Ding, Hongyu, et al.
Pubblicazione: (2026)
IntentionVLA: Generalizable and Efficient Embodied Intention Reasoning for Human-Robot Interaction
di: Chen, Yandu, et al.
Pubblicazione: (2025)
di: Chen, Yandu, et al.
Pubblicazione: (2025)
Event Camera Meets Mobile Embodied Perception: Abstraction, Algorithm, Acceleration, Application
di: Wang, Haoyang, et al.
Pubblicazione: (2025)
di: Wang, Haoyang, et al.
Pubblicazione: (2025)
StereoPolicy: Improving Robotic Manipulation Policies via Stereo Perception
di: Han, Evans, et al.
Pubblicazione: (2026)
di: Han, Evans, et al.
Pubblicazione: (2026)
Closed Loop Interactive Embodied Reasoning for Robot Manipulation
di: Nazarczuk, Michal, et al.
Pubblicazione: (2024)
di: Nazarczuk, Michal, et al.
Pubblicazione: (2024)
Perception Matters: Enhancing Embodied AI with Uncertainty-Aware Semantic Segmentation
di: Prasanna, Sai, et al.
Pubblicazione: (2024)
di: Prasanna, Sai, et al.
Pubblicazione: (2024)
AoE: Always-on Egocentric Human Video Collection for Embodied AI
di: Yang, Bowen, et al.
Pubblicazione: (2026)
di: Yang, Bowen, et al.
Pubblicazione: (2026)
SAGE: Scalable Agentic 3D Scene Generation for Embodied AI
di: Xia, Hongchi, et al.
Pubblicazione: (2026)
di: Xia, Hongchi, et al.
Pubblicazione: (2026)
SpectralZoom: Efficient Segmentation with an Adaptive Hyperspectral Camera
di: Arnold, Jackson, et al.
Pubblicazione: (2024)
di: Arnold, Jackson, et al.
Pubblicazione: (2024)
Sparse Variable Projection in Robotic Perception: Exploiting Separable Structure for Efficient Nonlinear Optimization
di: Papalia, Alan, et al.
Pubblicazione: (2025)
di: Papalia, Alan, et al.
Pubblicazione: (2025)
The Yes-Man Syndrome: Benchmarking Abstention in Embodied Robotic Agents
di: Yeke, Doguhan, et al.
Pubblicazione: (2026)
di: Yeke, Doguhan, et al.
Pubblicazione: (2026)
EASE: Embodied Active Event Perception via Self-Supervised Energy Minimization
di: Chen, Zhou, et al.
Pubblicazione: (2025)
di: Chen, Zhou, et al.
Pubblicazione: (2025)
Embodied Scene Understanding for Vision Language Models via MetaVQA
di: Wang, Weizhen, et al.
Pubblicazione: (2025)
di: Wang, Weizhen, et al.
Pubblicazione: (2025)
From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding
di: Halacheva, Anna-Maria, et al.
Pubblicazione: (2025)
di: Halacheva, Anna-Maria, et al.
Pubblicazione: (2025)
ActMVS: Active Scene Reconstruction with Monocular Multi-View Stereo
di: Pu, Guo, et al.
Pubblicazione: (2026)
di: Pu, Guo, et al.
Pubblicazione: (2026)
WorldArena: A Unified Benchmark for Evaluating Perception and Functional Utility of Embodied World Models
di: Shang, Yu, et al.
Pubblicazione: (2026)
di: Shang, Yu, et al.
Pubblicazione: (2026)
RoboView-Bias: Benchmarking Visual Bias in Embodied Agents for Robotic Manipulation
di: Liu, Enguang, et al.
Pubblicazione: (2025)
di: Liu, Enguang, et al.
Pubblicazione: (2025)
Learning 3D Persistent Embodied World Models
di: Zhou, Siyuan, et al.
Pubblicazione: (2025)
di: Zhou, Siyuan, et al.
Pubblicazione: (2025)
Adaptive Illumination Control for Robot Perception
di: Turkar, Yash, et al.
Pubblicazione: (2026)
di: Turkar, Yash, et al.
Pubblicazione: (2026)
OmniVLA: Physically-Grounded Multimodal VLA with Unified Multi-Sensor Perception for Robotic Manipulation
di: Guo, Heyu, et al.
Pubblicazione: (2025)
di: Guo, Heyu, et al.
Pubblicazione: (2025)
3D-Mem: 3D Scene Memory for Embodied Exploration and Reasoning
di: Yang, Yuncong, et al.
Pubblicazione: (2024)
di: Yang, Yuncong, et al.
Pubblicazione: (2024)
SNOW: Spatio-Temporal Scene Understanding with World Knowledge for Open-World Embodied Reasoning
di: Sohn, Tin Stribor, et al.
Pubblicazione: (2025)
di: Sohn, Tin Stribor, et al.
Pubblicazione: (2025)
Evolvable Embodied Agent for Robotic Manipulation via Long Short-Term Reflection and Optimization
di: Wang, Jianzong, et al.
Pubblicazione: (2026)
di: Wang, Jianzong, et al.
Pubblicazione: (2026)
SKIP: Sparse Keyframe Interpolation Paradigm for Efficient Embodied World Models
di: He, Ziheng, et al.
Pubblicazione: (2026)
di: He, Ziheng, et al.
Pubblicazione: (2026)
UniScale: Unified Scale-Aware 3D Reconstruction for Multi-View Understanding via Prior Injection for Robotic Perception
di: Mahdavian, Mohammad, et al.
Pubblicazione: (2026)
di: Mahdavian, Mohammad, et al.
Pubblicazione: (2026)
PERSEUS: Perception with Semantic Endoscopic Understanding and SLAM
di: Acar, Ayberk, et al.
Pubblicazione: (2025)
di: Acar, Ayberk, et al.
Pubblicazione: (2025)
Towards Comprehensive Multimodal Perception: Introducing the Touch-Language-Vision Dataset
di: Cheng, Ning, et al.
Pubblicazione: (2024)
di: Cheng, Ning, et al.
Pubblicazione: (2024)
Guide, Think, Act: Interactive Embodied Reasoning in Vision-Language-Action Models
di: Ling, Yiran, et al.
Pubblicazione: (2026)
di: Ling, Yiran, et al.
Pubblicazione: (2026)
UniDriveVLA: Unifying Understanding, Perception, and Action Planning for Autonomous Driving
di: Li, Yongkang, et al.
Pubblicazione: (2026)
di: Li, Yongkang, et al.
Pubblicazione: (2026)
SocialNav: Training Human-Inspired Foundation Model for Socially-Aware Embodied Navigation
di: Chen, Ziyi, et al.
Pubblicazione: (2025)
di: Chen, Ziyi, et al.
Pubblicazione: (2025)
TartanGround: A Large-Scale Dataset for Ground Robot Perception and Navigation
di: Patel, Manthan, et al.
Pubblicazione: (2025)
di: Patel, Manthan, et al.
Pubblicazione: (2025)
Temporally Consistent Unsupervised Segmentation for Mobile Robot Perception
di: Ellis, Christian, et al.
Pubblicazione: (2025)
di: Ellis, Christian, et al.
Pubblicazione: (2025)
PhysVLM: Enabling Visual Language Models to Understand Robotic Physical Reachability
di: Zhou, Weijie, et al.
Pubblicazione: (2025)
di: Zhou, Weijie, et al.
Pubblicazione: (2025)
Multi-Task Learning for Robot Perception with Imbalanced Data
di: Erkent, Ozgur
Pubblicazione: (2026)
di: Erkent, Ozgur
Pubblicazione: (2026)
Neurosim: A Fast Simulator for Neuromorphic Robot Perception
di: Das, Richeek, et al.
Pubblicazione: (2026)
di: Das, Richeek, et al.
Pubblicazione: (2026)
Synthetica: Large Scale Synthetic Data for Robot Perception
di: Singh, Ritvik, et al.
Pubblicazione: (2024)
di: Singh, Ritvik, et al.
Pubblicazione: (2024)
Documenti analoghi
-
RobotPan: A 360$^\circ$ Surround-View Robotic Vision System for Embodied Perception
di: Ma, Jiahao, et al.
Pubblicazione: (2026) -
3D Generation for Embodied AI and Robotic Simulation: A Survey
di: Ye, Tianwei, et al.
Pubblicazione: (2026) -
Eye, Robot: Learning to Look to Act with a BC-RL Perception-Action Loop
di: Kerr, Justin, et al.
Pubblicazione: (2025) -
Visual Environment-Interactive Planning for Embodied Complex-Question Answering
di: Lan, Ning, et al.
Pubblicazione: (2025) -
Uni-LaViRA: Language-Vision-Robot Actions Translation for Unified Embodied Navigation
di: Ding, Hongyu, et al.
Pubblicazione: (2026)