Generalist Robot Manipulation beyond Action Labeled Data
Fuente:
arXiv
Salvato in:
| Autori principali: | Spiridonov, Alexander, Zaech, Jan-Nico, Nikolov, Nikolay, Van Gool, Luc, Paudel, Danda Pani |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ReVLA: Reverting Visual Domain Limitation of Robotic Foundation Models
di: Dey, Sombit, et al.
Pubblicazione: (2024)
di: Dey, Sombit, et al.
Pubblicazione: (2024)
SPEAR-1: Scaling Beyond Robot Demonstrations via 3D Understanding
di: Nikolov, Nikolay, et al.
Pubblicazione: (2025)
di: Nikolov, Nikolay, et al.
Pubblicazione: (2025)
From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding
di: Halacheva, Anna-Maria, et al.
Pubblicazione: (2025)
di: Halacheva, Anna-Maria, et al.
Pubblicazione: (2025)
Autonomous Vehicle Path Planning by Searching With Differentiable Simulation
di: Nachkov, Asen, et al.
Pubblicazione: (2025)
di: Nachkov, Asen, et al.
Pubblicazione: (2025)
Unlocking Efficient Vehicle Dynamics Modeling via Analytic World Models
di: Nachkov, Asen, et al.
Pubblicazione: (2025)
di: Nachkov, Asen, et al.
Pubblicazione: (2025)
AR-VLA: True Autoregressive Action Expert for Vision-Language-Action Models
di: Hu, Yutong, et al.
Pubblicazione: (2026)
di: Hu, Yutong, et al.
Pubblicazione: (2026)
GaussianVLM: Scene-centric 3D Vision-Language Models using Language-aligned Gaussian Splats for Embodied Reasoning and Beyond
di: Halacheva, Anna-Maria, et al.
Pubblicazione: (2025)
di: Halacheva, Anna-Maria, et al.
Pubblicazione: (2025)
Articulate3D: Holistic Understanding of 3D Scenes as Universal Scene Description
di: Halacheva, Anna-Maria, et al.
Pubblicazione: (2024)
di: Halacheva, Anna-Maria, et al.
Pubblicazione: (2024)
Autonomous Vehicle Controllers From End-to-End Differentiable Simulation
di: Nachkov, Asen, et al.
Pubblicazione: (2024)
di: Nachkov, Asen, et al.
Pubblicazione: (2024)
Occam's LGS: An Efficient Approach for Language Gaussian Splatting
di: Cheng, Jiahuan, et al.
Pubblicazione: (2024)
di: Cheng, Jiahuan, et al.
Pubblicazione: (2024)
A Simple and Generalist Approach for Panoptic Segmentation
di: Prisadnikov, Nedyalko, et al.
Pubblicazione: (2024)
di: Prisadnikov, Nedyalko, et al.
Pubblicazione: (2024)
LangHOPS: Language Grounded Hierarchical Open-Vocabulary Part Segmentation
di: Miao, Yang, et al.
Pubblicazione: (2025)
di: Miao, Yang, et al.
Pubblicazione: (2025)
EgoSpot:Egocentric Multimodal Control for Hands-Free Mobile Manipulation
di: Zhang, Ganlin, et al.
Pubblicazione: (2023)
di: Zhang, Ganlin, et al.
Pubblicazione: (2023)
Lego: Learning to Disentangle and Invert Personalized Concepts Beyond Object Appearance in Text-to-Image Diffusion Models
di: Motamed, Saman, et al.
Pubblicazione: (2023)
di: Motamed, Saman, et al.
Pubblicazione: (2023)
EvenNICER-SLAM: Event-based Neural Implicit Encoding SLAM
di: Chen, Shi, et al.
Pubblicazione: (2024)
di: Chen, Shi, et al.
Pubblicazione: (2024)
Event-Free Moving Object Segmentation from Moving Ego Vehicle
di: Zhou, Zhuyun, et al.
Pubblicazione: (2023)
di: Zhou, Zhuyun, et al.
Pubblicazione: (2023)
ProOOD: Prototype-Guided Out-of-Distribution 3D Occupancy Prediction
di: Zhang, Yuheng, et al.
Pubblicazione: (2026)
di: Zhang, Yuheng, et al.
Pubblicazione: (2026)
Vision encoders should be image size agnostic and task driven
di: Prisadnikov, Nedyalko, et al.
Pubblicazione: (2025)
di: Prisadnikov, Nedyalko, et al.
Pubblicazione: (2025)
Implicit-Zoo: A Large-Scale Dataset of Neural Implicit Functions for 2D Images and 3D Scenes
di: Ma, Qi, et al.
Pubblicazione: (2024)
di: Ma, Qi, et al.
Pubblicazione: (2024)
Continuous Pose for Monocular Cameras in Neural Implicit Representation
di: Ma, Qi, et al.
Pubblicazione: (2023)
di: Ma, Qi, et al.
Pubblicazione: (2023)
From Synchrony to Sequence: Exo-to-Ego Generation via Interpolation
di: Mahdi, Mohammad, et al.
Pubblicazione: (2026)
di: Mahdi, Mohammad, et al.
Pubblicazione: (2026)
Self-supervised pretraining for an iterative image size agnostic vision transformer
di: Prisadnikov, Nedyalko, et al.
Pubblicazione: (2026)
di: Prisadnikov, Nedyalko, et al.
Pubblicazione: (2026)
EReLiFM: Evidential Reliability-Aware Residual Flow Meta-Learning for Open-Set Domain Generalization under Noisy Labels
di: Peng, Kunyu, et al.
Pubblicazione: (2025)
di: Peng, Kunyu, et al.
Pubblicazione: (2025)
RefAtomNet++: Advancing Referring Atomic Video Action Recognition using Semantic Retrieval based Multi-Trajectory Mamba
di: Peng, Kunyu, et al.
Pubblicazione: (2025)
di: Peng, Kunyu, et al.
Pubblicazione: (2025)
Inferring Compositional 4D Scenes without Ever Seeing One
di: Gokmen, Ahmet Berke, et al.
Pubblicazione: (2025)
di: Gokmen, Ahmet Berke, et al.
Pubblicazione: (2025)
RICO: Two Realistic Benchmarks and an In-Depth Analysis for Incremental Learning in Object Detection
di: Neuwirth-Trapp, Matthias, et al.
Pubblicazione: (2025)
di: Neuwirth-Trapp, Matthias, et al.
Pubblicazione: (2025)
Incremental Object Detection with Prompt-based Methods
di: Neuwirth-Trapp, Matthias, et al.
Pubblicazione: (2025)
di: Neuwirth-Trapp, Matthias, et al.
Pubblicazione: (2025)
Taming CLIP for Fine-grained and Structured Visual Understanding of Museum Exhibits
di: Balauca, Ada-Astrid, et al.
Pubblicazione: (2024)
di: Balauca, Ada-Astrid, et al.
Pubblicazione: (2024)
RoHOI: Robustness Benchmark for Human-Object Interaction Detection
di: Wen, Di, et al.
Pubblicazione: (2025)
di: Wen, Di, et al.
Pubblicazione: (2025)
ConceptPose: Training-Free Zero-Shot Object Pose Estimation using Concept Vectors
di: Kuang, Liming, et al.
Pubblicazione: (2025)
di: Kuang, Liming, et al.
Pubblicazione: (2025)
Probabilistic Sampling of Balanced K-Means using Adiabatic Quantum Computing
di: Zaech, Jan-Nico, et al.
Pubblicazione: (2023)
di: Zaech, Jan-Nico, et al.
Pubblicazione: (2023)
Cross-View Multi-Modal Segmentation @ Ego-Exo4D Challenges 2025
di: Fu, Yuqian, et al.
Pubblicazione: (2025)
di: Fu, Yuqian, et al.
Pubblicazione: (2025)
SeasonScapes: Learning Large-scale Re-lightable 3D Landscapes with Seasonal Variation from Sparse Webcams
di: Kleger, Timo, et al.
Pubblicazione: (2026)
di: Kleger, Timo, et al.
Pubblicazione: (2026)
Ternary-Type Opacity and Hybrid Odometry for RGB NeRF-SLAM
di: Lin, Junru, et al.
Pubblicazione: (2023)
di: Lin, Junru, et al.
Pubblicazione: (2023)
Effective Tuning Strategies for Generalist Robot Manipulation Policies
di: Zhang, Wenbo, et al.
Pubblicazione: (2024)
di: Zhang, Wenbo, et al.
Pubblicazione: (2024)
FireScope: Wildfire Risk Raster Prediction with a Chain-of-Thought Oracle
di: Markov, Mario, et al.
Pubblicazione: (2025)
di: Markov, Mario, et al.
Pubblicazione: (2025)
B-GRTO: Bootstrapped Group Relative Tool Optimization for Referring Segmentation
di: Markov, Mario, et al.
Pubblicazione: (2026)
di: Markov, Mario, et al.
Pubblicazione: (2026)
Green-VLA: Staged Vision-Language-Action Model for Generalist Robots
di: Apanasevich, I., et al.
Pubblicazione: (2026)
di: Apanasevich, I., et al.
Pubblicazione: (2026)
RhoDARTS: Differentiable Quantum Architecture Search with Density Matrix Simulations
di: Kumar, Swagat, et al.
Pubblicazione: (2025)
di: Kumar, Swagat, et al.
Pubblicazione: (2025)
A Taxonomy for Evaluating Generalist Robot Manipulation Policies
di: Gao, Jensen, et al.
Pubblicazione: (2025)
di: Gao, Jensen, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ReVLA: Reverting Visual Domain Limitation of Robotic Foundation Models
di: Dey, Sombit, et al.
Pubblicazione: (2024) -
SPEAR-1: Scaling Beyond Robot Demonstrations via 3D Understanding
di: Nikolov, Nikolay, et al.
Pubblicazione: (2025) -
From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding
di: Halacheva, Anna-Maria, et al.
Pubblicazione: (2025) -
Autonomous Vehicle Path Planning by Searching With Differentiable Simulation
di: Nachkov, Asen, et al.
Pubblicazione: (2025) -
Unlocking Efficient Vehicle Dynamics Modeling via Analytic World Models
di: Nachkov, Asen, et al.
Pubblicazione: (2025)