Extending Embodied Question Answering from Perception to Decision
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gong, Xicheng, Li, Qiwei, Xu, Peiran, Mu, Yadong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
NavQ: Learning a Q-Model for Foresighted Vision-and-Language Navigation
par: Xu, Peiran, et autres
Publié: (2025)
par: Xu, Peiran, et autres
Publié: (2025)
RoboAgent: Chaining Basic Capabilities for Embodied Task Planning
par: Xu, Peiran, et autres
Publié: (2026)
par: Xu, Peiran, et autres
Publié: (2026)
RotVLA: Rotational Latent Action for Vision-Language-Action Model
par: Li, Qiwei, et autres
Publié: (2026)
par: Li, Qiwei, et autres
Publié: (2026)
ProgressVLA: Progress-Guided Diffusion Policy for Vision-Language Robotic Manipulation
par: Yan, Hongyu, et autres
Publié: (2026)
par: Yan, Hongyu, et autres
Publié: (2026)
Memory Centric Power Allocation for Multi-Agent Embodied Question Answering
par: Li, Chengyang, et autres
Publié: (2026)
par: Li, Chengyang, et autres
Publié: (2026)
FAST-EQA: Efficient Embodied Question Answering with Global and Local Region Relevancy
par: Zhang, Haochen, et autres
Publié: (2026)
par: Zhang, Haochen, et autres
Publié: (2026)
HIMM: Human-Inspired Long-Term Memory Modeling for Embodied Exploration and Question Answering
par: Li, Ji, et autres
Publié: (2026)
par: Li, Ji, et autres
Publié: (2026)
Visual Environment-Interactive Planning for Embodied Complex-Question Answering
par: Lan, Ning, et autres
Publié: (2025)
par: Lan, Ning, et autres
Publié: (2025)
Is the House Ready For Sleeptime? Generating and Evaluating Situational Queries for Embodied Question Answering
par: Dorbala, Vishnu Sashank, et autres
Publié: (2024)
par: Dorbala, Vishnu Sashank, et autres
Publié: (2024)
Map-based Modular Approach for Zero-shot Embodied Question Answering
par: Sakamoto, Koya, et autres
Publié: (2024)
par: Sakamoto, Koya, et autres
Publié: (2024)
EfficientEQA: An Efficient Approach to Open-Vocabulary Embodied Question Answering
par: Cheng, Kai, et autres
Publié: (2024)
par: Cheng, Kai, et autres
Publié: (2024)
Enter the Mind Palace: Reasoning and Planning for Long-term Active Embodied Question Answering
par: Ginting, Muhammad Fadhil, et autres
Publié: (2025)
par: Ginting, Muhammad Fadhil, et autres
Publié: (2025)
ConEQsA: Concurrent and Asynchronous Embodied Questions Scheduling and Answering
par: Wang, Haisheng, et autres
Publié: (2025)
par: Wang, Haisheng, et autres
Publié: (2025)
Explore until Confident: Efficient Exploration for Embodied Question Answering
par: Ren, Allen Z., et autres
Publié: (2024)
par: Ren, Allen Z., et autres
Publié: (2024)
NoisyEQA: Benchmarking Embodied Question Answering Against Noisy Queries
par: Wu, Tao, et autres
Publié: (2024)
par: Wu, Tao, et autres
Publié: (2024)
Neural Assembler: Learning to Generate Fine-Grained Robotic Assembly Instructions from Multi-View Images
par: Yan, Hongyu, et autres
Publié: (2024)
par: Yan, Hongyu, et autres
Publié: (2024)
Large Model Empowered Embodied AI: A Survey on Decision-Making and Embodied Learning
par: Liang, Wenlong, et autres
Publié: (2025)
par: Liang, Wenlong, et autres
Publié: (2025)
Closed-Loop Long-Horizon Robotic Planning via Equilibrium Sequence Modeling
par: Li, Jinghan, et autres
Publié: (2024)
par: Li, Jinghan, et autres
Publié: (2024)
Prune-Then-Plan: Step-Level Calibration for Stable Frontier Exploration in Embodied Question Answering
par: Frahm, Noah, et autres
Publié: (2025)
par: Frahm, Noah, et autres
Publié: (2025)
RobotPan: A 360$^\circ$ Surround-View Robotic Vision System for Embodied Perception
par: Ma, Jiahao, et autres
Publié: (2026)
par: Ma, Jiahao, et autres
Publié: (2026)
LLM-Driven Self-Refinement for Embodied Drone Task Planning
par: Zhang, Deyu, et autres
Publié: (2025)
par: Zhang, Deyu, et autres
Publié: (2025)
Embodied Tactile Perception of Soft Objects Properties
par: Dutta, Anirvan, et autres
Publié: (2025)
par: Dutta, Anirvan, et autres
Publié: (2025)
Weakly-Supervised Affordance Grounding Guided by Part-Level Semantic Priors
par: Xu, Peiran, et autres
Publié: (2025)
par: Xu, Peiran, et autres
Publié: (2025)
Local Occupancy-Enhanced Object Grasping with Multiple Triplanar Projection
par: Ma, Kangqi, et autres
Publié: (2024)
par: Ma, Kangqi, et autres
Publié: (2024)
Embodied Agent Interface: Benchmarking LLMs for Embodied Decision Making
par: Li, Manling, et autres
Publié: (2024)
par: Li, Manling, et autres
Publié: (2024)
HyCodePolicy: Hybrid Language Controllers for Multimodal Monitoring and Decision in Embodied Agents
par: Liu, Yibin, et autres
Publié: (2025)
par: Liu, Yibin, et autres
Publié: (2025)
EmboMatrix: A Scalable Training-Ground for Embodied Decision-Making
par: Lei, Zixing, et autres
Publié: (2025)
par: Lei, Zixing, et autres
Publié: (2025)
When Robots Should Say "I Don't Know": Benchmarking Abstention in Embodied Question Answering
par: Wu, Tao, et autres
Publié: (2025)
par: Wu, Tao, et autres
Publié: (2025)
QueryCAD: Grounded Question Answering for CAD Models
par: Kienle, Claudius, et autres
Publié: (2024)
par: Kienle, Claudius, et autres
Publié: (2024)
Safety of Embodied Navigation: A Survey
par: Wang, Zixia, et autres
Publié: (2025)
par: Wang, Zixia, et autres
Publié: (2025)
GraphEQA: Using 3D Semantic Scene Graphs for Real-time Embodied Question Answering
par: Saxena, Saumya, et autres
Publié: (2024)
par: Saxena, Saumya, et autres
Publié: (2024)
MIPD: A Multi-sensory Interactive Perception Dataset for Embodied Intelligent Driving
par: Li, Zhiwei, et autres
Publié: (2024)
par: Li, Zhiwei, et autres
Publié: (2024)
Embodied Perception for Test-time Grasping Detection Adaptation with Knowledge Infusion
par: Liu, Jin, et autres
Publié: (2025)
par: Liu, Jin, et autres
Publié: (2025)
EmbodiedClaw: Conversational Workflow Execution for Embodied AI Development
par: Zhou, Xueyang, et autres
Publié: (2026)
par: Zhou, Xueyang, et autres
Publié: (2026)
AI or Human? Understanding Perceptions of Embodied Robots with LLMs
par: Hriscu, Lavinia, et autres
Publié: (2025)
par: Hriscu, Lavinia, et autres
Publié: (2025)
EmbodiedCoder: Parameterized Embodied Mobile Manipulation via Modern Coding Model
par: Lin, Zefu, et autres
Publié: (2025)
par: Lin, Zefu, et autres
Publié: (2025)
Agentic Self-Evolutionary Replanning for Embodied Navigation
par: Li, Guoliang, et autres
Publié: (2026)
par: Li, Guoliang, et autres
Publié: (2026)
Fourier Controller Networks for Real-Time Decision-Making in Embodied Learning
par: Tan, Hengkai, et autres
Publié: (2024)
par: Tan, Hengkai, et autres
Publié: (2024)
RoboTron-Nav: A Unified Framework for Embodied Navigation Integrating Perception, Planning, and Prediction
par: Zhong, Yufeng, et autres
Publié: (2025)
par: Zhong, Yufeng, et autres
Publié: (2025)
Open-Ended Multi-Modal Relational Reasoning for Video Question Answering
par: Luo, Haozheng, et autres
Publié: (2020)
par: Luo, Haozheng, et autres
Publié: (2020)
Documents similaires
-
NavQ: Learning a Q-Model for Foresighted Vision-and-Language Navigation
par: Xu, Peiran, et autres
Publié: (2025) -
RoboAgent: Chaining Basic Capabilities for Embodied Task Planning
par: Xu, Peiran, et autres
Publié: (2026) -
RotVLA: Rotational Latent Action for Vision-Language-Action Model
par: Li, Qiwei, et autres
Publié: (2026) -
ProgressVLA: Progress-Guided Diffusion Policy for Vision-Language Robotic Manipulation
par: Yan, Hongyu, et autres
Publié: (2026) -
Memory Centric Power Allocation for Multi-Agent Embodied Question Answering
par: Li, Chengyang, et autres
Publié: (2026)