Navigating the Mirage: A Dual-Path Agentic Framework for Robust Misleading Chart Question Answering
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Yanjie, Li, Yafei, Sheng, Rui, Chen, Zixin, Lin, Yanna, Qu, Huamin, Chen, Lei, Sun, Yushi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Unmasking Deceptive Visuals: Benchmarking Multimodal Large Language Models on Misleading Chart Question Answering
di: Chen, Zixin, et al.
Pubblicazione: (2025)
di: Chen, Zixin, et al.
Pubblicazione: (2025)
ChartEditor: A Reinforcement Learning Framework for Robust Chart Editing
di: Chen, Liangyu, et al.
Pubblicazione: (2025)
di: Chen, Liangyu, et al.
Pubblicazione: (2025)
SRA: Semantic Relation-Aware Flowchart Question Answering
di: Li, Xinyu, et al.
Pubblicazione: (2026)
di: Li, Xinyu, et al.
Pubblicazione: (2026)
POLYCHARTQA: Benchmarking Large Vision-Language Models with Multilingual Chart Question Answering
di: Xu, Yichen, et al.
Pubblicazione: (2025)
di: Xu, Yichen, et al.
Pubblicazione: (2025)
DMC$^3$: Dual-Modal Counterfactual Contrastive Construction for Egocentric Video Question Answering
di: Zou, Jiayi, et al.
Pubblicazione: (2025)
di: Zou, Jiayi, et al.
Pubblicazione: (2025)
Hierarchical Vision-Language Reasoning for Multimodal Multiple-Choice Question Answering
di: Zhou, Ao, et al.
Pubblicazione: (2025)
di: Zhou, Ao, et al.
Pubblicazione: (2025)
Towards Flexible Evaluation for Generative Visual Question Answering
di: Ji, Huishan, et al.
Pubblicazione: (2024)
di: Ji, Huishan, et al.
Pubblicazione: (2024)
Scene-Text Grounding for Text-Based Video Question Answering
di: Zhou, Sheng, et al.
Pubblicazione: (2024)
di: Zhou, Sheng, et al.
Pubblicazione: (2024)
BDIQA: A New Dataset for Video Question Answering to Explore Cognitive Reasoning through Theory of Mind
di: Mao, Yuanyuan, et al.
Pubblicazione: (2024)
di: Mao, Yuanyuan, et al.
Pubblicazione: (2024)
Copy-Move Forgery Detection and Question Answering for Remote Sensing Image
di: Zhang, Ze, et al.
Pubblicazione: (2024)
di: Zhang, Ze, et al.
Pubblicazione: (2024)
Memory-Centric Embodied Question Answering
di: Zhai, Mingliang, et al.
Pubblicazione: (2025)
di: Zhai, Mingliang, et al.
Pubblicazione: (2025)
Mitigating Easy Option Bias in Multiple-Choice Question Answering
di: Zhang, Hao, et al.
Pubblicazione: (2025)
di: Zhang, Hao, et al.
Pubblicazione: (2025)
TimeLogic Challenge @ CVPR 2026: Strong MLLMs Meet Evidence-Seeking Agents for Temporal-Logic Video Question Answering
di: Xu, Zhaoyang, et al.
Pubblicazione: (2026)
di: Xu, Zhaoyang, et al.
Pubblicazione: (2026)
MuKV: Multi-Grained KV Cache Compression for Long Streaming Video Question-Answering
di: Xiao, Junbin, et al.
Pubblicazione: (2026)
di: Xiao, Junbin, et al.
Pubblicazione: (2026)
Knowledge Acquisition Disentanglement for Knowledge-based Visual Question Answering with Large Language Models
di: An, Wenbin, et al.
Pubblicazione: (2024)
di: An, Wenbin, et al.
Pubblicazione: (2024)
EgoTextVQA: Towards Egocentric Scene-Text Aware Video Question Answering
di: Zhou, Sheng, et al.
Pubblicazione: (2025)
di: Zhou, Sheng, et al.
Pubblicazione: (2025)
RoSMM: A Robust and Secure Multi-Modal Watermarking Framework for Diffusion Models
di: Fang, ZhongLi, et al.
Pubblicazione: (2025)
di: Fang, ZhongLi, et al.
Pubblicazione: (2025)
ChartAdapter: Large Vision-Language Model for Chart Summarization
di: Xu, Peixin, et al.
Pubblicazione: (2024)
di: Xu, Peixin, et al.
Pubblicazione: (2024)
OpenLifelogQA: An Open-Ended Multi-Modal Lifelog Question-Answering Dataset
di: Tran, Quang-Linh, et al.
Pubblicazione: (2025)
di: Tran, Quang-Linh, et al.
Pubblicazione: (2025)
Navigating Weight Prediction with Diet Diary
di: Gui, Yinxuan, et al.
Pubblicazione: (2024)
di: Gui, Yinxuan, et al.
Pubblicazione: (2024)
SarcasmMiner: A Dual-Track Post-Training Framework for Robust Audio-Visual Sarcasm Reasoning
di: Li, Zhu, et al.
Pubblicazione: (2026)
di: Li, Zhu, et al.
Pubblicazione: (2026)
"You'll Be Alice Adventuring in Wonderland!" Processes, Challenges, and Opportunities of Creating Animated Virtual Reality Stories
di: Yuan, Lin-Ping, et al.
Pubblicazione: (2025)
di: Yuan, Lin-Ping, et al.
Pubblicazione: (2025)
Question-Answering Dense Video Events
di: Qin, Hangyu, et al.
Pubblicazione: (2024)
di: Qin, Hangyu, et al.
Pubblicazione: (2024)
PolySmart @ TRECVid 2024 Medical Video Question Answering
di: Wu, Jiaxin, et al.
Pubblicazione: (2024)
di: Wu, Jiaxin, et al.
Pubblicazione: (2024)
When Top-ranked Recommendations Fail: Modeling Multi-Granular Negative Feedback for Explainable and Robust Video Recommendation
di: Chen, Siran, et al.
Pubblicazione: (2025)
di: Chen, Siran, et al.
Pubblicazione: (2025)
Dual-Diffusional Generative Fashion Recommendation
di: Yu, Mingzhe, et al.
Pubblicazione: (2026)
di: Yu, Mingzhe, et al.
Pubblicazione: (2026)
Jamendo-MT-QA: A Benchmark for Multi-Track Comparative Music Question Answering
di: Koh, Junyoung, et al.
Pubblicazione: (2026)
di: Koh, Junyoung, et al.
Pubblicazione: (2026)
Patch-level Sounding Object Tracking for Audio-Visual Question Answering
di: Li, Zhangbin, et al.
Pubblicazione: (2024)
di: Li, Zhangbin, et al.
Pubblicazione: (2024)
Jamendo-QA: A Large-Scale Music Question Answering Dataset
di: Koh, Junyoung, et al.
Pubblicazione: (2025)
di: Koh, Junyoung, et al.
Pubblicazione: (2025)
MEGC2026: Micro-Expression Grand Challenge on Visual Question Answering
di: Fan, Xinqi, et al.
Pubblicazione: (2026)
di: Fan, Xinqi, et al.
Pubblicazione: (2026)
POVQA: Preference-Optimized Video Question Answering with Rationales for Data Efficiency
di: Dahal, Ashim, et al.
Pubblicazione: (2025)
di: Dahal, Ashim, et al.
Pubblicazione: (2025)
Anchorage: Visual Analysis of Satisfaction in Customer Service Videos via Anchor Events
di: Wong, Kam Kwai, et al.
Pubblicazione: (2023)
di: Wong, Kam Kwai, et al.
Pubblicazione: (2023)
Dual Dynamic Threshold Adjustment Strategy for Deep Metric Learning
di: Jiang, Xiruo, et al.
Pubblicazione: (2024)
di: Jiang, Xiruo, et al.
Pubblicazione: (2024)
MHier-RAG: Multi-Modal RAG for Visual-Rich Document Question-Answering via Hierarchical and Multi-Granularity Reasoning
di: Gong, Ziyu, et al.
Pubblicazione: (2025)
di: Gong, Ziyu, et al.
Pubblicazione: (2025)
VideoForest: Person-Anchored Hierarchical Reasoning for Cross-Video Question Answering
di: Meng, Yiran, et al.
Pubblicazione: (2025)
di: Meng, Yiran, et al.
Pubblicazione: (2025)
MEGC2025: Micro-Expression Grand Challenge on Spot Then Recognize and Visual Question Answering
di: Fan, Xinqi, et al.
Pubblicazione: (2025)
di: Fan, Xinqi, et al.
Pubblicazione: (2025)
Self-Adaptive Sampling for Efficient Video Question-Answering on Image--Text Models
di: Han, Wei, et al.
Pubblicazione: (2023)
di: Han, Wei, et al.
Pubblicazione: (2023)
Dual-Granularity Cross-Modal Identity Association for Weakly-Supervised Text-to-Person Image Matching
di: Zhang, Yafei, et al.
Pubblicazione: (2025)
di: Zhang, Yafei, et al.
Pubblicazione: (2025)
Towards Signboard-Oriented Visual Question Answering: ViSignVQA Dataset, Method and Benchmark
di: Nguyen, Hieu Minh, et al.
Pubblicazione: (2025)
di: Nguyen, Hieu Minh, et al.
Pubblicazione: (2025)
Enhancing Generalization in Medical Visual Question Answering Tasks via Gradient-Guided Model Perturbation
di: Liu, Gang, et al.
Pubblicazione: (2024)
di: Liu, Gang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Unmasking Deceptive Visuals: Benchmarking Multimodal Large Language Models on Misleading Chart Question Answering
di: Chen, Zixin, et al.
Pubblicazione: (2025) -
ChartEditor: A Reinforcement Learning Framework for Robust Chart Editing
di: Chen, Liangyu, et al.
Pubblicazione: (2025) -
SRA: Semantic Relation-Aware Flowchart Question Answering
di: Li, Xinyu, et al.
Pubblicazione: (2026) -
POLYCHARTQA: Benchmarking Large Vision-Language Models with Multilingual Chart Question Answering
di: Xu, Yichen, et al.
Pubblicazione: (2025) -
DMC$^3$: Dual-Modal Counterfactual Contrastive Construction for Egocentric Video Question Answering
di: Zou, Jiayi, et al.
Pubblicazione: (2025)