Afford-X: Generalizable and Slim Affordance Reasoning for Task-oriented Manipulation
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Xiaomeng, Li, Yuyang, Cui, Leiyao, Li, Pengfei, Gao, Huan-ang, Zhu, Yixin, Zhao, Hao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PreAfford: Universal Affordance-Based Pre-Grasping for Diverse Objects and Environments
di: Ding, Kairui, et al.
Pubblicazione: (2024)
di: Ding, Kairui, et al.
Pubblicazione: (2024)
O$^3$Afford: One-Shot 3D Object-to-Object Affordance Grounding for Generalizable Robotic Manipulation
di: Tian, Tongxuan, et al.
Pubblicazione: (2025)
di: Tian, Tongxuan, et al.
Pubblicazione: (2025)
GLOVER: Generalizable Open-Vocabulary Affordance Reasoning for Task-Oriented Grasping
di: Ma, Teli, et al.
Pubblicazione: (2024)
di: Ma, Teli, et al.
Pubblicazione: (2024)
Affordance-R1: Reinforcement Learning for Generalizable Affordance Reasoning in Multimodal Large Language Model
di: Wang, Hanqing, et al.
Pubblicazione: (2025)
di: Wang, Hanqing, et al.
Pubblicazione: (2025)
VoxAfford: Multi-Scale Voxel-Token Fusion for Open-Vocabulary 3D Affordance Detection
di: Sun, Haowen, et al.
Pubblicazione: (2026)
di: Sun, Haowen, et al.
Pubblicazione: (2026)
EqvAfford: SE(3) Equivariance for Point-Level Affordance Learning
di: Chen, Yue, et al.
Pubblicazione: (2024)
di: Chen, Yue, et al.
Pubblicazione: (2024)
AffordGrasp: Cross-Modal Diffusion for Affordance-Aware Grasp Synthesis
di: Wu, Xiaofei, et al.
Pubblicazione: (2026)
di: Wu, Xiaofei, et al.
Pubblicazione: (2026)
Simultaneous Tactile-Visual Perception for Learning Multimodal Robot Manipulation
di: Li, Yuyang, et al.
Pubblicazione: (2025)
di: Li, Yuyang, et al.
Pubblicazione: (2025)
AffordDP: Generalizable Diffusion Policy with Transferable Affordance
di: Wu, Shijie, et al.
Pubblicazione: (2024)
di: Wu, Shijie, et al.
Pubblicazione: (2024)
RAM: Retrieval-Based Affordance Transfer for Generalizable Zero-Shot Robotic Manipulation
di: Kuang, Yuxuan, et al.
Pubblicazione: (2024)
di: Kuang, Yuxuan, et al.
Pubblicazione: (2024)
TacMan-Turbo: Proactive Tactile Control for Robust and Efficient Articulated Object Manipulation
di: Zhao, Zihang, et al.
Pubblicazione: (2025)
di: Zhao, Zihang, et al.
Pubblicazione: (2025)
Ag2Manip: Learning Novel Manipulation Skills with Agent-Agnostic Visual and Action Representations
di: Li, Puhao, et al.
Pubblicazione: (2024)
di: Li, Puhao, et al.
Pubblicazione: (2024)
AffordTissue: Dense Affordance Prediction for Tool-Action Specific Tissue Interaction
di: Maksutova, Aiza, et al.
Pubblicazione: (2026)
di: Maksutova, Aiza, et al.
Pubblicazione: (2026)
ManipGPT: Is Affordance Segmentation by Large Vision Models Enough for Articulated Object Manipulation?
di: Kim, Taewhan, et al.
Pubblicazione: (2024)
di: Kim, Taewhan, et al.
Pubblicazione: (2024)
NaturalVLM: Leveraging Fine-grained Natural Language for Affordance-Guided Visual Manipulation
di: Xu, Ran, et al.
Pubblicazione: (2024)
di: Xu, Ran, et al.
Pubblicazione: (2024)
TASTE-Rob: Advancing Video Generation of Task-Oriented Hand-Object Interaction for Generalizable Robotic Manipulation
di: Zhao, Hongxiang, et al.
Pubblicazione: (2025)
di: Zhao, Hongxiang, et al.
Pubblicazione: (2025)
Egocentric Instruction-oriented Affordance Prediction via Large Multimodal Model
di: Ji, Bokai, et al.
Pubblicazione: (2025)
di: Ji, Bokai, et al.
Pubblicazione: (2025)
Learning Precise Affordances from Egocentric Videos for Robotic Manipulation
di: Li, Gen, et al.
Pubblicazione: (2024)
di: Li, Gen, et al.
Pubblicazione: (2024)
GarmentPile: Point-Level Visual Affordance Guided Retrieval and Adaptation for Cluttered Garments Manipulation
di: Wu, Ruihai, et al.
Pubblicazione: (2025)
di: Wu, Ruihai, et al.
Pubblicazione: (2025)
Planning-Guided Diffusion Policy Learning for Generalizable Contact-Rich Bimanual Manipulation
di: Li, Xuanlin, et al.
Pubblicazione: (2024)
di: Li, Xuanlin, et al.
Pubblicazione: (2024)
UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation
di: Tang, Yihe, et al.
Pubblicazione: (2025)
di: Tang, Yihe, et al.
Pubblicazione: (2025)
Vi-TacMan: Articulated Object Manipulation via Vision and Touch
di: Cui, Leiyao, et al.
Pubblicazione: (2025)
di: Cui, Leiyao, et al.
Pubblicazione: (2025)
GLOVER++: Unleashing the Potential of Affordance Learning from Human Behaviors for Robotic Manipulation
di: Ma, Teli, et al.
Pubblicazione: (2025)
di: Ma, Teli, et al.
Pubblicazione: (2025)
RT-Affordance: Affordances are Versatile Intermediate Representations for Robot Manipulation
di: Nasiriany, Soroush, et al.
Pubblicazione: (2024)
di: Nasiriany, Soroush, et al.
Pubblicazione: (2024)
Diffusion-VLA: Generalizable and Interpretable Robot Foundation Model via Self-Generated Reasoning
di: Wen, Junjie, et al.
Pubblicazione: (2024)
di: Wen, Junjie, et al.
Pubblicazione: (2024)
AffordanceLLM: Grounding Affordance from Vision Language Models
di: Qian, Shengyi, et al.
Pubblicazione: (2024)
di: Qian, Shengyi, et al.
Pubblicazione: (2024)
AffordGrasp: In-Context Affordance Reasoning for Open-Vocabulary Task-Oriented Grasping in Clutter
di: Tang, Yingbo, et al.
Pubblicazione: (2025)
di: Tang, Yingbo, et al.
Pubblicazione: (2025)
Towards Generalizable Robotic Manipulation in Dynamic Environments
di: Fang, Heng, et al.
Pubblicazione: (2026)
di: Fang, Heng, et al.
Pubblicazione: (2026)
Scalable Trajectory Generation for Whole-Body Mobile Manipulation
di: Niu, Yida, et al.
Pubblicazione: (2026)
di: Niu, Yida, et al.
Pubblicazione: (2026)
Two by Two: Learning Multi-Task Pairwise Objects Assembly for Generalizable Robot Manipulation
di: Qi, Yu, et al.
Pubblicazione: (2025)
di: Qi, Yu, et al.
Pubblicazione: (2025)
PanoAffordanceNet: Towards Holistic Affordance Grounding in 360° Indoor Environments
di: Zhu, Guoliang, et al.
Pubblicazione: (2026)
di: Zhu, Guoliang, et al.
Pubblicazione: (2026)
SparseDFF: Sparse-View Feature Distillation for One-Shot Dexterous Manipulation
di: Wang, Qianxu, et al.
Pubblicazione: (2023)
di: Wang, Qianxu, et al.
Pubblicazione: (2023)
GAMMA: Generalizable Articulation Modeling and Manipulation for Articulated Objects
di: Yu, Qiaojun, et al.
Pubblicazione: (2023)
di: Yu, Qiaojun, et al.
Pubblicazione: (2023)
Affordance RAG: Hierarchical Multimodal Retrieval with Affordance-Aware Embodied Memory for Mobile Manipulation
di: Korekata, Ryosuke, et al.
Pubblicazione: (2025)
di: Korekata, Ryosuke, et al.
Pubblicazione: (2025)
AffordanceGrasp-R1:Leveraging Reasoning-Based Affordance Segmentation with Reinforcement Learning for Robotic Grasping
di: Zhou, Dingyi, et al.
Pubblicazione: (2026)
di: Zhou, Dingyi, et al.
Pubblicazione: (2026)
Taccel: Scaling Up Vision-based Tactile Robotics via High-performance GPU Simulation
di: Li, Yuyang, et al.
Pubblicazione: (2025)
di: Li, Yuyang, et al.
Pubblicazione: (2025)
MoMa-Kitchen: A 100K+ Benchmark for Affordance-Grounded Last-Mile Navigation in Mobile Manipulation
di: Zhang, Pingrui, et al.
Pubblicazione: (2025)
di: Zhang, Pingrui, et al.
Pubblicazione: (2025)
3D-AffordanceLLM: Harnessing Large Language Models for Open-Vocabulary Affordance Detection in 3D Worlds
di: Chu, Hengshuo, et al.
Pubblicazione: (2025)
di: Chu, Hengshuo, et al.
Pubblicazione: (2025)
B*: Efficient and Optimal Base Placement for Fixed-Base Manipulators
di: Zhao, Zihang, et al.
Pubblicazione: (2025)
di: Zhao, Zihang, et al.
Pubblicazione: (2025)
Grasp Multiple Objects with One Hand
di: Li, Yuyang, et al.
Pubblicazione: (2023)
di: Li, Yuyang, et al.
Pubblicazione: (2023)
Documenti analoghi
-
PreAfford: Universal Affordance-Based Pre-Grasping for Diverse Objects and Environments
di: Ding, Kairui, et al.
Pubblicazione: (2024) -
O$^3$Afford: One-Shot 3D Object-to-Object Affordance Grounding for Generalizable Robotic Manipulation
di: Tian, Tongxuan, et al.
Pubblicazione: (2025) -
GLOVER: Generalizable Open-Vocabulary Affordance Reasoning for Task-Oriented Grasping
di: Ma, Teli, et al.
Pubblicazione: (2024) -
Affordance-R1: Reinforcement Learning for Generalizable Affordance Reasoning in Multimodal Large Language Model
di: Wang, Hanqing, et al.
Pubblicazione: (2025) -
VoxAfford: Multi-Scale Voxel-Token Fusion for Open-Vocabulary 3D Affordance Detection
di: Sun, Haowen, et al.
Pubblicazione: (2026)