CityEQA: A Hierarchical LLM Agent on Embodied Question Answering Benchmark in City Space
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhao, Yong, Xu, Kai, Zhu, Zhengqiu, Hu, Yue, Zheng, Zhiheng, Chen, Yingfeng, Ji, Yatai, Gao, Chen, Li, Yong, Huang, Jincai |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Towards Autonomous UAV Visual Object Search in City Space: Benchmark and Agentic Methodology
por: Ji, Yatai, et al.
Publicado: (2025)
por: Ji, Yatai, et al.
Publicado: (2025)
EmbodiedCity: A Benchmark Platform for Embodied Agent in Real-world City Environment
por: Gao, Chen, et al.
Publicado: (2024)
por: Gao, Chen, et al.
Publicado: (2024)
NoisyEQA: Benchmarking Embodied Question Answering Against Noisy Queries
por: Wu, Tao, et al.
Publicado: (2024)
por: Wu, Tao, et al.
Publicado: (2024)
IndustryEQA: Pushing the Frontiers of Embodied Question Answering in Industrial Scenarios
por: Li, Yifan, et al.
Publicado: (2025)
por: Li, Yifan, et al.
Publicado: (2025)
EfficientEQA: An Efficient Approach to Open-Vocabulary Embodied Question Answering
por: Cheng, Kai, et al.
Publicado: (2024)
por: Cheng, Kai, et al.
Publicado: (2024)
DLW-CI: A Dynamic Likelihood-Weighted Cooperative Infotaxis Approach for Multi-Source Search in Urban Environments Using Consumer Drone Networks
por: Zhang, Xiaoran, et al.
Publicado: (2025)
por: Zhang, Xiaoran, et al.
Publicado: (2025)
FAST-EQA: Efficient Embodied Question Answering with Global and Local Region Relevancy
por: Zhang, Haochen, et al.
Publicado: (2026)
por: Zhang, Haochen, et al.
Publicado: (2026)
CityCube: Benchmarking Cross-view Spatial Reasoning on Vision-Language Models in Urban Environments
por: Xu, Haotian, et al.
Publicado: (2026)
por: Xu, Haotian, et al.
Publicado: (2026)
Heterogeneous Graph Reinforcement Learning for Dependency-aware Multi-task Allocation in Spatial Crowdsourcing
por: Zhao, Yong, et al.
Publicado: (2024)
por: Zhao, Yong, et al.
Publicado: (2024)
GraphEQA: Using 3D Semantic Scene Graphs for Real-time Embodied Question Answering
por: Saxena, Saumya, et al.
Publicado: (2024)
por: Saxena, Saumya, et al.
Publicado: (2024)
AutoS$^2$earch: Unlocking the Reasoning Potential of Large Models for Web-based Source Search
por: Zhu, Zhengqiu, et al.
Publicado: (2025)
por: Zhu, Zhengqiu, et al.
Publicado: (2025)
BridgeEQA: Virtual Embodied Agents for Real Bridge Inspections
por: Varghese, Subin, et al.
Publicado: (2025)
por: Varghese, Subin, et al.
Publicado: (2025)
IndustryAssetEQA: A Neurosymbolic Operational Intelligence System for Embodied Question Answering in Industrial Asset Maintenance
por: Shyalika, Chathurangi, et al.
Publicado: (2026)
por: Shyalika, Chathurangi, et al.
Publicado: (2026)
Psychology-driven LLM Agents for Explainable Panic Prediction on Social Media during Sudden Disaster Events
por: Liu, Mengzhu, et al.
Publicado: (2025)
por: Liu, Mengzhu, et al.
Publicado: (2025)
OpenCity: A Scalable Platform to Simulate Urban Activities with Massive LLM Agents
por: Yan, Yuwei, et al.
Publicado: (2024)
por: Yan, Yuwei, et al.
Publicado: (2024)
GeoNav: Empowering MLLMs with dual-scale geospatial reasoning for language-goal aerial navigation
por: Xu, Haotian, et al.
Publicado: (2025)
por: Xu, Haotian, et al.
Publicado: (2025)
StreamEQA: Towards Streaming Video Understanding for Embodied Scenarios
por: Wang, Yifei, et al.
Publicado: (2025)
por: Wang, Yifei, et al.
Publicado: (2025)
CityNavAgent: Aerial Vision-and-Language Navigation with Hierarchical Semantic Planning and Global Memory
por: Zhang, Weichen, et al.
Publicado: (2025)
por: Zhang, Weichen, et al.
Publicado: (2025)
Conversational Crowdsensing: A Parallel Intelligence Powered Novel Sensing Approach
por: Zhu, Zhengqiu, et al.
Publicado: (2024)
por: Zhu, Zhengqiu, et al.
Publicado: (2024)
EQA-RM: A Generative Embodied Reward Model with Test-time Scaling
por: Chen, Yuhang, et al.
Publicado: (2025)
por: Chen, Yuhang, et al.
Publicado: (2025)
TAG-EQA: Text-And-Graph for Event Question Answering via Structured Prompting Strategies
por: Kadam, Maithili, et al.
Publicado: (2025)
por: Kadam, Maithili, et al.
Publicado: (2025)
Beyond the Destination: A Novel Benchmark for Exploration-Aware Embodied Question Answering
por: Jiang, Kaixuan, et al.
Publicado: (2025)
por: Jiang, Kaixuan, et al.
Publicado: (2025)
Memory-Centric Embodied Question Answering
por: Zhai, Mingliang, et al.
Publicado: (2025)
por: Zhai, Mingliang, et al.
Publicado: (2025)
AirCopBench: A Benchmark for Multi-drone Collaborative Embodied Perception and Reasoning
por: Zha, Jirong, et al.
Publicado: (2025)
por: Zha, Jirong, et al.
Publicado: (2025)
3D Question Answering for City Scene Understanding
por: Sun, Penglei, et al.
Publicado: (2024)
por: Sun, Penglei, et al.
Publicado: (2024)
Efficient Multimodal Planning Agent for Visual Question-Answering
por: Chen, Zhuo, et al.
Publicado: (2026)
por: Chen, Zhuo, et al.
Publicado: (2026)
RAISECity: A Multimodal Agent Framework for Reality-Aligned 3D World Generation at City-Scale
por: Wang, Shengyuan, et al.
Publicado: (2025)
por: Wang, Shengyuan, et al.
Publicado: (2025)
Perceive, Reflect, and Plan: Designing LLM Agent for Goal-Directed City Navigation without Instructions
por: Zeng, Qingbin, et al.
Publicado: (2024)
por: Zeng, Qingbin, et al.
Publicado: (2024)
Warehouse Spatial Question Answering with LLM Agent
por: Huang, Hsiang-Wei, et al.
Publicado: (2025)
por: Huang, Hsiang-Wei, et al.
Publicado: (2025)
CityTrajBench: A Unified Benchmark for City-Scale Vehicle Trajectory Generation
por: Zhu, Shibo, et al.
Publicado: (2026)
por: Zhu, Shibo, et al.
Publicado: (2026)
HIMM: Human-Inspired Long-Term Memory Modeling for Embodied Exploration and Question Answering
por: Li, Ji, et al.
Publicado: (2026)
por: Li, Ji, et al.
Publicado: (2026)
Invisible Walls in Cities: Designing LLM Agent to Predict Urban Segregation Experience with Social Media Content
por: Fan, Bingbing, et al.
Publicado: (2025)
por: Fan, Bingbing, et al.
Publicado: (2025)
UrbanVideo-Bench: Benchmarking Vision-Language Models on Embodied Intelligence with Video Data in Urban Spaces
por: Zhao, Baining, et al.
Publicado: (2025)
por: Zhao, Baining, et al.
Publicado: (2025)
Memory Centric Power Allocation for Multi-Agent Embodied Question Answering
por: Li, Chengyang, et al.
Publicado: (2026)
por: Li, Chengyang, et al.
Publicado: (2026)
FHIR-AgentBench: Benchmarking LLM Agents for Realistic Interoperable EHR Question Answering
por: Lee, Gyubok, et al.
Publicado: (2025)
por: Lee, Gyubok, et al.
Publicado: (2025)
EQA
Publicado: (2013)
Publicado: (2013)
InViC: Intent-aware Visual Cues for Medical Visual Question Answering
por: Wang, Zhisong, et al.
Publicado: (2026)
por: Wang, Zhisong, et al.
Publicado: (2026)
Embodied Intelligence for 3D Understanding: A Survey on 3D Scene Question Answering
por: Li, Zechuan, et al.
Publicado: (2025)
por: Li, Zechuan, et al.
Publicado: (2025)
Benchmarking Large Language Models for Conversational Question Answering in Multi-instructional Documents
por: Wu, Shiwei, et al.
Publicado: (2024)
por: Wu, Shiwei, et al.
Publicado: (2024)
Imagine a City: CityGenAgent for Procedural 3D City Generation
por: Liu, Zishan, et al.
Publicado: (2026)
por: Liu, Zishan, et al.
Publicado: (2026)
Ejemplares similares
-
Towards Autonomous UAV Visual Object Search in City Space: Benchmark and Agentic Methodology
por: Ji, Yatai, et al.
Publicado: (2025) -
EmbodiedCity: A Benchmark Platform for Embodied Agent in Real-world City Environment
por: Gao, Chen, et al.
Publicado: (2024) -
NoisyEQA: Benchmarking Embodied Question Answering Against Noisy Queries
por: Wu, Tao, et al.
Publicado: (2024) -
IndustryEQA: Pushing the Frontiers of Embodied Question Answering in Industrial Scenarios
por: Li, Yifan, et al.
Publicado: (2025) -
EfficientEQA: An Efficient Approach to Open-Vocabulary Embodied Question Answering
por: Cheng, Kai, et al.
Publicado: (2024)