RoboTAG: End-to-end Robot Configuration Estimation via Topological Alignment Graph
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Yifan, Zhan, Fangneng, Li, Wanhua, Sun, Haowen, Fragkiadaki, Katerina, Pfister, Hanspeter |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AREA3D: Active Reconstruction Agent with Unified Feed-Forward 3D Perception and Vision-Language Guidance
par: Xu, Tianling, et autres
Publié: (2025)
par: Xu, Tianling, et autres
Publié: (2025)
RoboGen: Towards Unleashing Infinite Data for Automated Robot Learning via Generative Simulation
par: Wang, Yufei, et autres
Publié: (2023)
par: Wang, Yufei, et autres
Publié: (2023)
Video Diffusion Alignment via Reward Gradients
par: Prabhudesai, Mihir, et autres
Publié: (2024)
par: Prabhudesai, Mihir, et autres
Publié: (2024)
CTRL-GS: Cascaded Temporal Residue Learning for 4D Gaussian Splatting
par: Hou, Karly, et autres
Publié: (2025)
par: Hou, Karly, et autres
Publié: (2025)
Robo-MUTUAL: Robotic Multimodal Task Specification via Unimodal Learning
par: Li, Jianxiong, et autres
Publié: (2024)
par: Li, Jianxiong, et autres
Publié: (2024)
Point2Graph: An End-to-end Point Cloud-based 3D Open-Vocabulary Scene Graph for Robot Navigation
par: Xu, Yifan, et autres
Publié: (2024)
par: Xu, Yifan, et autres
Publié: (2024)
Abstract 3D Perception for Spatial Intelligence in Vision-Language Models
par: Liu, Yifan, et autres
Publié: (2025)
par: Liu, Yifan, et autres
Publié: (2025)
EndoMUST: Monocular Depth Estimation for Robotic Endoscopy via End-to-end Multi-step Self-supervised Training
par: Shao, Liangjing, et autres
Publié: (2025)
par: Shao, Liangjing, et autres
Publié: (2025)
RoboPearls: Editable Video Simulation for Robot Manipulation
par: Tang, Tao, et autres
Publié: (2025)
par: Tang, Tao, et autres
Publié: (2025)
GeCo: Evaluating Geometric Consistency for Video Generation via Motion and Structure
par: Gu, Leslie, et autres
Publié: (2025)
par: Gu, Leslie, et autres
Publié: (2025)
Dex4D: Task-Agnostic Point Track Policy for Sim-to-Real Dexterous Manipulation
par: Kuang, Yuxuan, et autres
Publié: (2026)
par: Kuang, Yuxuan, et autres
Publié: (2026)
Learning to Assist: Physics-Grounded Human-Human Control via Multi-Agent Reinforcement Learning
par: Shibata, Yuto, et autres
Publié: (2026)
par: Shibata, Yuto, et autres
Publié: (2026)
3D Diffuser Actor: Policy Diffusion with 3D Scene Representations
par: Ke, Tsung-Wei, et autres
Publié: (2024)
par: Ke, Tsung-Wei, et autres
Publié: (2024)
Spatial RoboGrasp: Generalized Robotic Grasping Control Policy
par: Huang, Yiqi, et autres
Publié: (2025)
par: Huang, Yiqi, et autres
Publié: (2025)
Aligning Text-to-Image Diffusion Models with Reward Backpropagation
par: Prabhudesai, Mihir, et autres
Publié: (2023)
par: Prabhudesai, Mihir, et autres
Publié: (2023)
LangFlash: Feed-forward 3D Language Gaussian Splatting from Sparse Unposed Images
par: Liu, Yilong, et autres
Publié: (2026)
par: Liu, Yilong, et autres
Publié: (2026)
RiGS: Rigid-aware 4D Gaussian Splatting from a Single Monocular Video
par: Wu, Chenyu, et autres
Publié: (2026)
par: Wu, Chenyu, et autres
Publié: (2026)
Robo-ABC: Affordance Generalization Beyond Categories via Semantic Correspondence for Robot Manipulation
par: Ju, Yuanchen, et autres
Publié: (2024)
par: Ju, Yuanchen, et autres
Publié: (2024)
RoboPEPP: Vision-Based Robot Pose and Joint Angle Estimation through Embedding Predictive Pre-Training
par: Goswami, Raktim Gautam, et autres
Publié: (2024)
par: Goswami, Raktim Gautam, et autres
Publié: (2024)
Tree of Attributes Prompt Learning for Vision-Language Models
par: Ding, Tong, et autres
Publié: (2024)
par: Ding, Tong, et autres
Publié: (2024)
Joint-Task Regularization for Partially Labeled Multi-Task Learning
par: Nishi, Kento, et autres
Publié: (2024)
par: Nishi, Kento, et autres
Publié: (2024)
Generalized Trajectory Scoring for End-to-end Multimodal Planning
par: Li, Zhenxin, et autres
Publié: (2025)
par: Li, Zhenxin, et autres
Publié: (2025)
RoboGround: Robotic Manipulation with Grounded Vision-Language Priors
par: Huang, Haifeng, et autres
Publié: (2025)
par: Huang, Haifeng, et autres
Publié: (2025)
RoboEXP: Action-Conditioned Scene Graph via Interactive Exploration for Robotic Manipulation
par: Jiang, Hanxiao, et autres
Publié: (2024)
par: Jiang, Hanxiao, et autres
Publié: (2024)
RobotArena $\infty$: Scalable Robot Benchmarking via Real-to-Sim Translation
par: Jangir, Yash, et autres
Publié: (2025)
par: Jangir, Yash, et autres
Publié: (2025)
TAG: Target-Agnostic Guidance for Stable Object-Centric Inference in Vision-Language-Action Models
par: Zhou, Jiaying, et autres
Publié: (2026)
par: Zhou, Jiaying, et autres
Publié: (2026)
The RoboDepth Challenge: Methods and Advancements Towards Robust Depth Estimation
par: Kong, Lingdong, et autres
Publié: (2023)
par: Kong, Lingdong, et autres
Publié: (2023)
RoboGrasp: A Universal Grasping Policy for Robust Robotic Control
par: Huang, Yiqi, et autres
Publié: (2025)
par: Huang, Yiqi, et autres
Publié: (2025)
RoboDream: Compositional World Models for Scalable Robot Data Synthesis
par: Ye, Junjie, et autres
Publié: (2026)
par: Ye, Junjie, et autres
Publié: (2026)
RoboScape-R: Unified Reward-Observation World Models for Generalizable Robotics Training via RL
par: Tang, Yinzhou, et autres
Publié: (2025)
par: Tang, Yinzhou, et autres
Publié: (2025)
LangSplat: 3D Language Gaussian Splatting
par: Qin, Minghan, et autres
Publié: (2023)
par: Qin, Minghan, et autres
Publié: (2023)
Affordance-Aware Object Insertion via Mask-Aware Dual Diffusion
par: He, Jixuan, et autres
Publié: (2024)
par: He, Jixuan, et autres
Publié: (2024)
Diffusion Beats Autoregressive in Data-Constrained Settings
par: Prabhudesai, Mihir, et autres
Publié: (2025)
par: Prabhudesai, Mihir, et autres
Publié: (2025)
Unified Multimodal Discrete Diffusion
par: Swerdlow, Alexander, et autres
Publié: (2025)
par: Swerdlow, Alexander, et autres
Publié: (2025)
SocialGPT: Prompting LLMs for Social Relation Reasoning via Greedy Segment Optimization
par: Li, Wanhua, et autres
Publié: (2024)
par: Li, Wanhua, et autres
Publié: (2024)
DiffVLA++: Bridging Cognitive Reasoning and End-to-End Driving through Metric-Guided Alignment
par: Gao, Yu, et autres
Publié: (2025)
par: Gao, Yu, et autres
Publié: (2025)
GEM-4D: Geometry-Enhanced Video World Models for Robot Manipulation
par: Zhou, Kaichen, et autres
Publié: (2026)
par: Zhou, Kaichen, et autres
Publié: (2026)
ZTRS: Zero-Imitation End-to-end Autonomous Driving with Trajectory Scoring
par: Li, Zhenxin, et autres
Publié: (2025)
par: Li, Zhenxin, et autres
Publié: (2025)
RoboEvolve: Co-Evolving Planner-Simulator for Robotic Manipulation with Limited Data
par: Chen, Harold Haodong, et autres
Publié: (2026)
par: Chen, Harold Haodong, et autres
Publié: (2026)
RoboLLM: Robotic Vision Tasks Grounded on Multimodal Large Language Models
par: Long, Zijun, et autres
Publié: (2023)
par: Long, Zijun, et autres
Publié: (2023)
Documents similaires
-
AREA3D: Active Reconstruction Agent with Unified Feed-Forward 3D Perception and Vision-Language Guidance
par: Xu, Tianling, et autres
Publié: (2025) -
RoboGen: Towards Unleashing Infinite Data for Automated Robot Learning via Generative Simulation
par: Wang, Yufei, et autres
Publié: (2023) -
Video Diffusion Alignment via Reward Gradients
par: Prabhudesai, Mihir, et autres
Publié: (2024) -
CTRL-GS: Cascaded Temporal Residue Learning for 4D Gaussian Splatting
par: Hou, Karly, et autres
Publié: (2025) -
Robo-MUTUAL: Robotic Multimodal Task Specification via Unimodal Learning
par: Li, Jianxiong, et autres
Publié: (2024)