LAVQA: A Latency-Aware Visual Question Answering Framework for Shared Autonomy in Self-Driving Vehicles
Fuente:
arXiv
Guardado en:
| Autores principales: | Xie, Shuangyu, Chen, Kaiyuan, Chen, Wenjing, Qian, Chengyuan, Juette, Christian, Ren, Liu, Song, Dezhen, Goldberg, Ken |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Energy Efficient Planning for Repetitive Heterogeneous Tasks in Precision Agriculture
por: Xie, Shuangyu, et al.
Publicado: (2025)
por: Xie, Shuangyu, et al.
Publicado: (2025)
Robo2VLM: Visual Question Answering from Large-Scale In-the-Wild Robot Manipulation Datasets
por: Chen, Kaiyuan, et al.
Publicado: (2025)
por: Chen, Kaiyuan, et al.
Publicado: (2025)
FogROS2-PLR: Probabilistic Latency-Reliability For Cloud Robotics
por: Chen, Kaiyuan, et al.
Publicado: (2024)
por: Chen, Kaiyuan, et al.
Publicado: (2024)
DriveLM: Driving with Graph Visual Question Answering
por: Sima, Chonghao, et al.
Publicado: (2023)
por: Sima, Chonghao, et al.
Publicado: (2023)
Can Large Vision Language Models Read Maps Like a Human?
por: Xing, Shuo, et al.
Publicado: (2025)
por: Xing, Shuo, et al.
Publicado: (2025)
VLM-Assisted Continual learning for Visual Question Answering in Self-Driving
por: Lin, Yuxin, et al.
Publicado: (2025)
por: Lin, Yuxin, et al.
Publicado: (2025)
LingoQA: Visual Question Answering for Autonomous Driving
por: Marcu, Ana-Maria, et al.
Publicado: (2023)
por: Marcu, Ana-Maria, et al.
Publicado: (2023)
FogROS2-FT: Fault Tolerant Cloud Robotics
por: Chen, Kaiyuan, et al.
Publicado: (2024)
por: Chen, Kaiyuan, et al.
Publicado: (2024)
NuScenes-QA: A Multi-modal Visual Question Answering Benchmark for Autonomous Driving Scenario
por: Qian, Tianwen, et al.
Publicado: (2023)
por: Qian, Tianwen, et al.
Publicado: (2023)
Exploring Diverse Methods in Visual Question Answering
por: Li, Panfeng, et al.
Publicado: (2024)
por: Li, Panfeng, et al.
Publicado: (2024)
DriveXQA: Cross-modal Visual Question Answering for Adverse Driving Scene Understanding
por: Tao, Mingzhe, et al.
Publicado: (2026)
por: Tao, Mingzhe, et al.
Publicado: (2026)
Question-Aware Gaussian Experts for Audio-Visual Question Answering
por: Kim, Hongyeob, et al.
Publicado: (2025)
por: Kim, Hongyeob, et al.
Publicado: (2025)
Privacy-Aware Document Visual Question Answering
por: Tito, Rubèn, et al.
Publicado: (2023)
por: Tito, Rubèn, et al.
Publicado: (2023)
Efficient Visual Question Answering Pipeline for Autonomous Driving via Scene Region Compression
por: Cai, Yuliang, et al.
Publicado: (2026)
por: Cai, Yuliang, et al.
Publicado: (2026)
ReasonDrive: Efficient Visual Question Answering for Autonomous Vehicles with Reasoning-Enhanced Small Vision-Language Models
por: Chahe, Amirhosein, et al.
Publicado: (2025)
por: Chahe, Amirhosein, et al.
Publicado: (2025)
FogROS2-Config: Optimizing Latency and Cost for Multi-Cloud Robot Applications
por: Chen, Kaiyuan, et al.
Publicado: (2023)
por: Chen, Kaiyuan, et al.
Publicado: (2023)
LCV2: An Efficient Pretraining-Free Framework for Grounded Visual Question Answering
por: Chen, Yuhan, et al.
Publicado: (2024)
por: Chen, Yuhan, et al.
Publicado: (2024)
Efficient Multimodal Planning Agent for Visual Question-Answering
por: Chen, Zhuo, et al.
Publicado: (2026)
por: Chen, Zhuo, et al.
Publicado: (2026)
Computed Tomography Visual Question Answering with Cross-modal Feature Graphing
por: Tian, Yuanhe, et al.
Publicado: (2025)
por: Tian, Yuanhe, et al.
Publicado: (2025)
TinyDrive: Multiscale Visual Question Answering with Selective Token Routing for Autonomous Driving
por: Hassani, Hossein, et al.
Publicado: (2025)
por: Hassani, Hossein, et al.
Publicado: (2025)
Toward Precise Robotic Weed Flaming Using a Mobile Manipulator with a Flamethrower
por: Wang, Di, et al.
Publicado: (2024)
por: Wang, Di, et al.
Publicado: (2024)
Object-centric Video Question Answering with Visual Grounding and Referring
por: Wang, Haochen, et al.
Publicado: (2025)
por: Wang, Haochen, et al.
Publicado: (2025)
Variational Visual Question Answering for Uncertainty-Aware Selective Prediction
por: Wieczorek, Tobias Jan, et al.
Publicado: (2025)
por: Wieczorek, Tobias Jan, et al.
Publicado: (2025)
Location-Aware Pretraining for Medical Difference Visual Question Answering
por: Musinguzi, Denis, et al.
Publicado: (2026)
por: Musinguzi, Denis, et al.
Publicado: (2026)
Questioning the Stability of Visual Question Answering
por: Rosenfeld, Amir, et al.
Publicado: (2025)
por: Rosenfeld, Amir, et al.
Publicado: (2025)
REAR: A Relevance-Aware Retrieval-Augmented Framework for Open-Domain Question Answering
por: Wang, Yuhao, et al.
Publicado: (2024)
por: Wang, Yuhao, et al.
Publicado: (2024)
An HMDP-MPC Decision-making Framework with Adaptive Safety Margins and Hysteresis for Autonomous Driving
por: Li, Siyuan, et al.
Publicado: (2026)
por: Li, Siyuan, et al.
Publicado: (2026)
SRA: Semantic Relation-Aware Flowchart Question Answering
por: Li, Xinyu, et al.
Publicado: (2026)
por: Li, Xinyu, et al.
Publicado: (2026)
Visual Question Answering in Ophthalmology: A Progressive and Practical Perspective
por: Chen, Xiaolan, et al.
Publicado: (2024)
por: Chen, Xiaolan, et al.
Publicado: (2024)
Selectively Answering Visual Questions
por: Eisenschlos, Julian Martin, et al.
Publicado: (2024)
por: Eisenschlos, Julian Martin, et al.
Publicado: (2024)
DocVXQA: Context-Aware Visual Explanations for Document Question Answering
por: Souibgui, Mohamed Ali, et al.
Publicado: (2025)
por: Souibgui, Mohamed Ali, et al.
Publicado: (2025)
Lifelong LERF: Local 3D Semantic Inventory Monitoring Using FogROS2
por: Rashid, Adam, et al.
Publicado: (2024)
por: Rashid, Adam, et al.
Publicado: (2024)
RVR: Retrieve-Verify-Retrieve for Comprehensive Question Answering
por: Qian, Deniz, et al.
Publicado: (2026)
por: Qian, Deniz, et al.
Publicado: (2026)
GeReA: Question-Aware Prompt Captions for Knowledge-based Visual Question Answering
por: Ma, Ziyu, et al.
Publicado: (2024)
por: Ma, Ziyu, et al.
Publicado: (2024)
VQ-VA World: Towards High-Quality Visual Question-Visual Answering
por: Gou, Chenhui, et al.
Publicado: (2025)
por: Gou, Chenhui, et al.
Publicado: (2025)
STRIDE-QA: Visual Question Answering Dataset for Spatiotemporal Reasoning in Urban Driving Scenes
por: Ishihara, Keishi, et al.
Publicado: (2025)
por: Ishihara, Keishi, et al.
Publicado: (2025)
Visual Environment-Interactive Planning for Embodied Complex-Question Answering
por: Lan, Ning, et al.
Publicado: (2025)
por: Lan, Ning, et al.
Publicado: (2025)
Knowledge Acquisition Disentanglement for Knowledge-based Visual Question Answering with Large Language Models
por: An, Wenbin, et al.
Publicado: (2024)
por: An, Wenbin, et al.
Publicado: (2024)
SAFe-Copilot: Unified Shared Autonomy Framework
por: Nguyen, Phat, et al.
Publicado: (2025)
por: Nguyen, Phat, et al.
Publicado: (2025)
Multi-Agent Reinforcement Learning with Submodular Reward
por: Chen, Wenjing, et al.
Publicado: (2026)
por: Chen, Wenjing, et al.
Publicado: (2026)
Ejemplares similares
-
Energy Efficient Planning for Repetitive Heterogeneous Tasks in Precision Agriculture
por: Xie, Shuangyu, et al.
Publicado: (2025) -
Robo2VLM: Visual Question Answering from Large-Scale In-the-Wild Robot Manipulation Datasets
por: Chen, Kaiyuan, et al.
Publicado: (2025) -
FogROS2-PLR: Probabilistic Latency-Reliability For Cloud Robotics
por: Chen, Kaiyuan, et al.
Publicado: (2024) -
DriveLM: Driving with Graph Visual Question Answering
por: Sima, Chonghao, et al.
Publicado: (2023) -
Can Large Vision Language Models Read Maps Like a Human?
por: Xing, Shuo, et al.
Publicado: (2025)