ADAPT: Benchmarking Commonsense Planning under Unspecified Affordance Constraints
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Pei-An, Liang, Yong-Ching, Yeh, Jia-Fong, Su, Hung-Ting, Chen, Yi-Ting, Sun, Min, Hsu, Winston |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
VLN-NF: Feasibility-Aware Vision-and-Language Navigation with False-Premise Instructions
di: Su, Hung-Ting, et al.
Pubblicazione: (2026)
di: Su, Hung-Ting, et al.
Pubblicazione: (2026)
Affordance-Guided Coarse-to-Fine Exploration for Base Placement in Open-Vocabulary Mobile Manipulation
di: Lin, Tzu-Jung, et al.
Pubblicazione: (2025)
di: Lin, Tzu-Jung, et al.
Pubblicazione: (2025)
Context-Aware Replanning with Pre-explored Semantic Map for Object Navigation
di: Ko, Po-Chen, et al.
Pubblicazione: (2024)
di: Ko, Po-Chen, et al.
Pubblicazione: (2024)
FineBench: Benchmarking and Enhancing Vision-Language Models for Fine-grained Human Activity Understanding
di: Faure, Gueter Josmy, et al.
Pubblicazione: (2026)
di: Faure, Gueter Josmy, et al.
Pubblicazione: (2026)
VICtoR: Learning Hierarchical Vision-Instruction Correlation Rewards for Long-horizon Manipulation
di: Hung, Kuo-Han, et al.
Pubblicazione: (2024)
di: Hung, Kuo-Han, et al.
Pubblicazione: (2024)
SceneFunRI: Reasoning the Invisible for Task-Driven Functional Object Localization
di: Chen, Posheng, et al.
Pubblicazione: (2026)
di: Chen, Posheng, et al.
Pubblicazione: (2026)
AED: Adaptable Error Detection for Few-shot Imitation Policy
di: Yeh, Jia-Fong, et al.
Pubblicazione: (2024)
di: Yeh, Jia-Fong, et al.
Pubblicazione: (2024)
HERMES: temporal-coHERent long-forM understanding with Episodes and Semantics
di: Faure, Gueter Josmy, et al.
Pubblicazione: (2024)
di: Faure, Gueter Josmy, et al.
Pubblicazione: (2024)
Affordances-Oriented Planning using Foundation Models for Continuous Vision-Language Navigation
di: Chen, Jiaqi, et al.
Pubblicazione: (2024)
di: Chen, Jiaqi, et al.
Pubblicazione: (2024)
AffordanceLLM: Grounding Affordance from Vision Language Models
di: Qian, Shengyi, et al.
Pubblicazione: (2024)
di: Qian, Shengyi, et al.
Pubblicazione: (2024)
MovieCORE: COgnitive REasoning in Movies
di: Faure, Gueter Josmy, et al.
Pubblicazione: (2025)
di: Faure, Gueter Josmy, et al.
Pubblicazione: (2025)
Tracking-Assisted Object Detection with Event Cameras
di: Yen, Ting-Kang, et al.
Pubblicazione: (2024)
di: Yen, Ting-Kang, et al.
Pubblicazione: (2024)
Panoramic Affordance Prediction
di: Zhang, Zixin, et al.
Pubblicazione: (2026)
di: Zhang, Zixin, et al.
Pubblicazione: (2026)
Probabilistic 3D Multi-Object Cooperative Tracking for Autonomous Driving via Differentiable Multi-Sensor Kalman Filter
di: Chiu, Hsu-kuang, et al.
Pubblicazione: (2023)
di: Chiu, Hsu-kuang, et al.
Pubblicazione: (2023)
BEACON: Language-Conditioned Navigation Affordance Prediction under Occlusion
di: Gao, Xinyu, et al.
Pubblicazione: (2026)
di: Gao, Xinyu, et al.
Pubblicazione: (2026)
Improving Generalization Ability for 3D Object Detection by Learning Sparsity-invariant Features
di: Lu, Hsin-Cheng, et al.
Pubblicazione: (2025)
di: Lu, Hsin-Cheng, et al.
Pubblicazione: (2025)
RAGNet: Large-scale Reasoning-based Affordance Segmentation Benchmark towards General Grasping
di: Wu, Dongming, et al.
Pubblicazione: (2025)
di: Wu, Dongming, et al.
Pubblicazione: (2025)
GLOVER++: Unleashing the Potential of Affordance Learning from Human Behaviors for Robotic Manipulation
di: Ma, Teli, et al.
Pubblicazione: (2025)
di: Ma, Teli, et al.
Pubblicazione: (2025)
Investigating Video Reasoning Capability of Large Language Models with Tropes in Movies
di: Su, Hung-Ting, et al.
Pubblicazione: (2024)
di: Su, Hung-Ting, et al.
Pubblicazione: (2024)
PAVLM: Advancing Point Cloud based Affordance Understanding Via Vision-Language Model
di: Liu, Shang-Ching, et al.
Pubblicazione: (2024)
di: Liu, Shang-Ching, et al.
Pubblicazione: (2024)
EgoPlan-Bench: Benchmarking Multimodal Large Language Models for Human-Level Planning
di: Chen, Yi, et al.
Pubblicazione: (2023)
di: Chen, Yi, et al.
Pubblicazione: (2023)
ADAPT: An Autonomous Forklift for Construction Site Operation
di: Huemer, Johannes, et al.
Pubblicazione: (2025)
di: Huemer, Johannes, et al.
Pubblicazione: (2025)
Affordance Agent Harness: Verification-Gated Skill Orchestration
di: Huang, Haojian, et al.
Pubblicazione: (2026)
di: Huang, Haojian, et al.
Pubblicazione: (2026)
3D-AffordanceLLM: Harnessing Large Language Models for Open-Vocabulary Affordance Detection in 3D Worlds
di: Chu, Hengshuo, et al.
Pubblicazione: (2025)
di: Chu, Hengshuo, et al.
Pubblicazione: (2025)
TRACER: Texture-Robust Affordance Chain-of-Thought for Deformable-Object Refinement
di: Jia, Wanjun, et al.
Pubblicazione: (2026)
di: Jia, Wanjun, et al.
Pubblicazione: (2026)
Affordance RAG: Hierarchical Multimodal Retrieval with Affordance-Aware Embodied Memory for Mobile Manipulation
di: Korekata, Ryosuke, et al.
Pubblicazione: (2025)
di: Korekata, Ryosuke, et al.
Pubblicazione: (2025)
A4-Agent: An Agentic Framework for Zero-Shot Affordance Reasoning
di: Zhang, Zixin, et al.
Pubblicazione: (2025)
di: Zhang, Zixin, et al.
Pubblicazione: (2025)
Task-Oriented Human Grasp Synthesis via Context- and Task-Aware Diffusers
di: Liu, An-Lun, et al.
Pubblicazione: (2025)
di: Liu, An-Lun, et al.
Pubblicazione: (2025)
PanoAffordanceNet: Towards Holistic Affordance Grounding in 360° Indoor Environments
di: Zhu, Guoliang, et al.
Pubblicazione: (2026)
di: Zhu, Guoliang, et al.
Pubblicazione: (2026)
CompassAD: Intent-Driven 3D Affordance Grounding in Functionally Competing Objects
di: Li, Jingliang, et al.
Pubblicazione: (2026)
di: Li, Jingliang, et al.
Pubblicazione: (2026)
WLST: Weak Labels Guided Self-training for Weakly-supervised Domain Adaptation on 3D Object Detection
di: Tsou, Tsung-Lin, et al.
Pubblicazione: (2023)
di: Tsou, Tsung-Lin, et al.
Pubblicazione: (2023)
Robotouille: An Asynchronous Planning Benchmark for LLM Agents
di: Gonzalez-Pumariega, Gonzalo, et al.
Pubblicazione: (2025)
di: Gonzalez-Pumariega, Gonzalo, et al.
Pubblicazione: (2025)
The Wilhelm Tell Dataset of Affordance Demonstrations
di: Ringe, Rachel, et al.
Pubblicazione: (2025)
di: Ringe, Rachel, et al.
Pubblicazione: (2025)
RoboPCA: Pose-centered Affordance Learning from Human Demonstrations for Robot Manipulation
di: Xiao, Zhanqi, et al.
Pubblicazione: (2026)
di: Xiao, Zhanqi, et al.
Pubblicazione: (2026)
One-Shot Affordance Grounding of Deformable Objects in Egocentric Organizing Scenes
di: Jia, Wanjun, et al.
Pubblicazione: (2025)
di: Jia, Wanjun, et al.
Pubblicazione: (2025)
GLOVER: Generalizable Open-Vocabulary Affordance Reasoning for Task-Oriented Grasping
di: Ma, Teli, et al.
Pubblicazione: (2024)
di: Ma, Teli, et al.
Pubblicazione: (2024)
Egocentric Instruction-oriented Affordance Prediction via Large Multimodal Model
di: Ji, Bokai, et al.
Pubblicazione: (2025)
di: Ji, Bokai, et al.
Pubblicazione: (2025)
Affordance-R1: Reinforcement Learning for Generalizable Affordance Reasoning in Multimodal Large Language Model
di: Wang, Hanqing, et al.
Pubblicazione: (2025)
di: Wang, Hanqing, et al.
Pubblicazione: (2025)
V2V-LLM: Vehicle-to-Vehicle Cooperative Autonomous Driving with Multimodal Large Language Models
di: Chiu, Hsu-kuang, et al.
Pubblicazione: (2025)
di: Chiu, Hsu-kuang, et al.
Pubblicazione: (2025)
AffordGrasp: Cross-Modal Diffusion for Affordance-Aware Grasp Synthesis
di: Wu, Xiaofei, et al.
Pubblicazione: (2026)
di: Wu, Xiaofei, et al.
Pubblicazione: (2026)
Documenti analoghi
-
VLN-NF: Feasibility-Aware Vision-and-Language Navigation with False-Premise Instructions
di: Su, Hung-Ting, et al.
Pubblicazione: (2026) -
Affordance-Guided Coarse-to-Fine Exploration for Base Placement in Open-Vocabulary Mobile Manipulation
di: Lin, Tzu-Jung, et al.
Pubblicazione: (2025) -
Context-Aware Replanning with Pre-explored Semantic Map for Object Navigation
di: Ko, Po-Chen, et al.
Pubblicazione: (2024) -
FineBench: Benchmarking and Enhancing Vision-Language Models for Fine-grained Human Activity Understanding
di: Faure, Gueter Josmy, et al.
Pubblicazione: (2026) -
VICtoR: Learning Hierarchical Vision-Instruction Correlation Rewards for Long-horizon Manipulation
di: Hung, Kuo-Han, et al.
Pubblicazione: (2024)