Enregistré dans:
| Auteurs principaux: | Jiang, Hongda, Zhang, Xinyuan, Garg, Siddhant, Arora, Rishab, Kuo, Shiun-Zu, Xu, Jiayang, Bansal, Ankur, Brossman, Christopher, Liu, Yue, Colak, Aaron, Aly, Ahmed, Kumar, Anuj, Dong, Xin Luna |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2509.18436 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AssoMem: Scalable Memory QA with Multi-Signal Associative Retrieval
par: Zhang, Kai, et autres
Publié: (2025)
par: Zhang, Kai, et autres
Publié: (2025)
MMToM-QA: Multimodal Theory of Mind Question Answering
par: Jin, Chuanyang, et autres
Publié: (2024)
par: Jin, Chuanyang, et autres
Publié: (2024)
DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards
par: Kartha, Aaryaman, et autres
Publié: (2025)
par: Kartha, Aaryaman, et autres
Publié: (2025)
Measuring Retrieval Complexity in Question Answering Systems
par: Gabburo, Matteo, et autres
Publié: (2024)
par: Gabburo, Matteo, et autres
Publié: (2024)
Memory-Centric Embodied Question Answering
par: Zhai, Mingliang, et autres
Publié: (2025)
par: Zhai, Mingliang, et autres
Publié: (2025)
Exploring Multimodal LMMs for Online Episodic Memory Question Answering on the Edge
par: Lando, Giuseppe, et autres
Publié: (2026)
par: Lando, Giuseppe, et autres
Publié: (2026)
MemeMQA: Multimodal Question Answering for Memes via Rationale-Based Inferencing
par: Agarwal, Siddhant, et autres
Publié: (2024)
par: Agarwal, Siddhant, et autres
Publié: (2024)
Neural at ArchEHR-QA 2025: Agentic Prompt Optimization for Evidence-Grounded Clinical Question Answering
par: Bogireddy, Sai Prasanna Teja Reddy, et autres
Publié: (2025)
par: Bogireddy, Sai Prasanna Teja Reddy, et autres
Publié: (2025)
OmniQuery: Contextually Augmenting Captured Multimodal Memory to Enable Personal Question Answering
par: Li, Jiahao Nick, et autres
Publié: (2024)
par: Li, Jiahao Nick, et autres
Publié: (2024)
InfoChartQA: A Benchmark for Multimodal Question Answering on Infographic Charts
par: Xie, Tianchi, et autres
Publié: (2025)
par: Xie, Tianchi, et autres
Publié: (2025)
GRS-QA -- Graph Reasoning-Structured Question Answering Dataset
par: Pahilajani, Anish, et autres
Publié: (2024)
par: Pahilajani, Anish, et autres
Publié: (2024)
PolQA: Polish Question Answering Dataset
par: Rybak, Piotr, et autres
Publié: (2022)
par: Rybak, Piotr, et autres
Publié: (2022)
VoQA: Visual-only Question Answering
par: An, Jianing, et autres
Publié: (2025)
par: An, Jianing, et autres
Publié: (2025)
Conditional Recall
par: Schlegel, Christoph, et autres
Publié: (2025)
par: Schlegel, Christoph, et autres
Publié: (2025)
SuperMemory-VQA: An Egocentric Visual Question-Answering Benchmark for Long-Horizon Memory
par: Alam, Samiul, et autres
Publié: (2026)
par: Alam, Samiul, et autres
Publié: (2026)
HCT-QA: A Benchmark for Question Answering on Human-Centric Tables
par: Ahmad, Mohammad S., et autres
Publié: (2025)
par: Ahmad, Mohammad S., et autres
Publié: (2025)
RoadscapesQA: A Multitask, Multimodal Dataset for Visual Question Answering on Indian Roads
par: Iyer, Vijayasri, et autres
Publié: (2026)
par: Iyer, Vijayasri, et autres
Publié: (2026)
MovieRecapsQA: A Multimodal Open-Ended Video Question-Answering Benchmark
par: Shaar, Shaden, et autres
Publié: (2026)
par: Shaar, Shaden, et autres
Publié: (2026)
MM-PhyQA: Multimodal Physics Question-Answering With Multi-Image CoT Prompting
par: Anand, Avinash, et autres
Publié: (2024)
par: Anand, Avinash, et autres
Publié: (2024)
WikiMixQA: A Multimodal Benchmark for Question Answering over Tables and Charts
par: Foroutan, Negar, et autres
Publié: (2025)
par: Foroutan, Negar, et autres
Publié: (2025)
See or Recall: A Sanity Check for the Role of Vision in Solving Visualization Question Answer Tasks with Multimodal LLMs
par: Li, Zhimin, et autres
Publié: (2025)
par: Li, Zhimin, et autres
Publié: (2025)
MovieChat+: Question-aware Sparse Memory for Long Video Question Answering
par: Song, Enxin, et autres
Publié: (2024)
par: Song, Enxin, et autres
Publié: (2024)
Continual Learning for Singing Voice Separation with Human in the Loop Adaptation
par: Gupta, Ankur, et autres
Publié: (2025)
par: Gupta, Ankur, et autres
Publié: (2025)
Evaluating Long-Term Memory for Long-Context Question Answering
par: Terranova, Alessandra, et autres
Publié: (2025)
par: Terranova, Alessandra, et autres
Publié: (2025)
NCTB-QA: A Large-Scale Bangla Educational Question Answering Dataset and Benchmarking Performance
par: Eyasir, Abrar, et autres
Publié: (2026)
par: Eyasir, Abrar, et autres
Publié: (2026)
LingoQA: Visual Question Answering for Autonomous Driving
par: Marcu, Ana-Maria, et autres
Publié: (2023)
par: Marcu, Ana-Maria, et autres
Publié: (2023)
Answering Questions in Stages: Prompt Chaining for Contract QA
par: Roegiest, Adam, et autres
Publié: (2024)
par: Roegiest, Adam, et autres
Publié: (2024)
DebateQA: Evaluating Question Answering on Debatable Knowledge
par: Xu, Rongwu, et autres
Publié: (2024)
par: Xu, Rongwu, et autres
Publié: (2024)
FoQA: A Faroese Question-Answering Dataset
par: Simonsen, Annika, et autres
Publié: (2025)
par: Simonsen, Annika, et autres
Publié: (2025)
Application of Data Virtualization
par: Siddhant Garg
Publié: (2021)
par: Siddhant Garg
Publié: (2021)
SViQA: A Unified Speech-Vision Multimodal Model for Textless Visual Question Answering
par: Li, Bingxin
Publié: (2025)
par: Li, Bingxin
Publié: (2025)
CT2C-QA: Multimodal Question Answering over Chinese Text, Table and Chart
par: Zhao, Bowen, et autres
Publié: (2024)
par: Zhao, Bowen, et autres
Publié: (2024)
CoDi: Conversational Distillation for Grounded Question Answering
par: Huber, Patrick, et autres
Publié: (2024)
par: Huber, Patrick, et autres
Publié: (2024)
Memory-Aware and Uncertainty-Guided Retrieval for Multi-Hop Question Answering
par: Ji, Yuelyu, et autres
Publié: (2025)
par: Ji, Yuelyu, et autres
Publié: (2025)
Memory Centric Power Allocation for Multi-Agent Embodied Question Answering
par: Li, Chengyang, et autres
Publié: (2026)
par: Li, Chengyang, et autres
Publié: (2026)
Glance and Focus: Memory Prompting for Multi-Event Video Question Answering
par: Bai, Ziyi, et autres
Publié: (2024)
par: Bai, Ziyi, et autres
Publié: (2024)
Long-Span Question-Answering: Automatic Question Generation and QA-System Ranking via Side-by-Side Evaluation
par: Bohnet, Bernd, et autres
Publié: (2024)
par: Bohnet, Bernd, et autres
Publié: (2024)
Stream RAG: Instant and Accurate Spoken Dialogue Systems with Streaming Tool Usage
par: Arora, Siddhant, et autres
Publié: (2025)
par: Arora, Siddhant, et autres
Publié: (2025)
ClimaQA_SLO - Slovenian Climate Question-Answering Benchmark
par: Ferk Ovčjak, Monika, et autres
Publié: (2025)
par: Ferk Ovčjak, Monika, et autres
Publié: (2025)
SyllabusQA: A Course Logistics Question Answering Dataset
par: Fernandez, Nigel, et autres
Publié: (2024)
par: Fernandez, Nigel, et autres
Publié: (2024)
Documents similaires
-
AssoMem: Scalable Memory QA with Multi-Signal Associative Retrieval
par: Zhang, Kai, et autres
Publié: (2025) -
MMToM-QA: Multimodal Theory of Mind Question Answering
par: Jin, Chuanyang, et autres
Publié: (2024) -
DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards
par: Kartha, Aaryaman, et autres
Publié: (2025) -
Measuring Retrieval Complexity in Question Answering Systems
par: Gabburo, Matteo, et autres
Publié: (2024) -
Memory-Centric Embodied Question Answering
par: Zhai, Mingliang, et autres
Publié: (2025)