Variational Visual Question Answering for Uncertainty-Aware Selective Prediction
Fuente:
arXiv
Salvato in:
| Autori principali: | Wieczorek, Tobias Jan, Daun, Nathalie, Khan, Mohammad Emtiyaz, Rohrbach, Marcus |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SIEVES: Selective Prediction Generalizes through Visual Evidence Scoring
di: Rodriguez, Hector G., et al.
Pubblicazione: (2026)
di: Rodriguez, Hector G., et al.
Pubblicazione: (2026)
Evaluating the Impact of Post-Training Quantization on Reliable VQA with Multimodal LLMs
di: Kurz, Paul Jonas, et al.
Pubblicazione: (2026)
di: Kurz, Paul Jonas, et al.
Pubblicazione: (2026)
CLARIFY: A Specialist-Generalist Framework for Accurate and Lightweight Dermatological Visual Question Answering
di: Saha, Aranya, et al.
Pubblicazione: (2025)
di: Saha, Aranya, et al.
Pubblicazione: (2025)
Learning Question-Aware Keyframe Selection with Synthetic Supervision for Video Question Answering
di: Kwon, Minchan, et al.
Pubblicazione: (2026)
di: Kwon, Minchan, et al.
Pubblicazione: (2026)
Location-Aware Pretraining for Medical Difference Visual Question Answering
di: Musinguzi, Denis, et al.
Pubblicazione: (2026)
di: Musinguzi, Denis, et al.
Pubblicazione: (2026)
Privacy-Aware Document Visual Question Answering
di: Tito, Rubèn, et al.
Pubblicazione: (2023)
di: Tito, Rubèn, et al.
Pubblicazione: (2023)
VeriTaS: The First Dynamic Benchmark for Multimodal Automated Fact-Checking
di: Rothermel, Mark, et al.
Pubblicazione: (2026)
di: Rothermel, Mark, et al.
Pubblicazione: (2026)
PitVQA++: Vector Matrix-Low-Rank Adaptation for Open-Ended Visual Question Answering in Pituitary Surgery
di: He, Runlong, et al.
Pubblicazione: (2025)
di: He, Runlong, et al.
Pubblicazione: (2025)
CluMo: Cluster-based Modality Fusion Prompt for Continual Learning in Visual Question Answering
di: Cai, Yuliang, et al.
Pubblicazione: (2024)
di: Cai, Yuliang, et al.
Pubblicazione: (2024)
MaS-VQA: A Mask-and-Select Framework for Knowledge-Based Visual Question Answering
di: Mao, Xianwei, et al.
Pubblicazione: (2026)
di: Mao, Xianwei, et al.
Pubblicazione: (2026)
VoQA: Visual-only Question Answering
di: An, Jianing, et al.
Pubblicazione: (2025)
di: An, Jianing, et al.
Pubblicazione: (2025)
Object Attribute Matters in Visual Question Answering
di: Li, Peize, et al.
Pubblicazione: (2023)
di: Li, Peize, et al.
Pubblicazione: (2023)
Uncertainty-Guided Self-Questioning and Answering for Video-Language Alignment
di: Chen, Jin, et al.
Pubblicazione: (2024)
di: Chen, Jin, et al.
Pubblicazione: (2024)
Knowledge Detection by Relevant Question and Image Attributes in Visual Question Answering
di: Ahir, Param, et al.
Pubblicazione: (2023)
di: Ahir, Param, et al.
Pubblicazione: (2023)
Boosting Audio Visual Question Answering via Key Semantic-Aware Cues
di: Li, Guangyao, et al.
Pubblicazione: (2024)
di: Li, Guangyao, et al.
Pubblicazione: (2024)
LingoQA: Visual Question Answering for Autonomous Driving
di: Marcu, Ana-Maria, et al.
Pubblicazione: (2023)
di: Marcu, Ana-Maria, et al.
Pubblicazione: (2023)
Saliency Guided Longitudinal Medical Visual Question Answering
di: Wu, Jialin, et al.
Pubblicazione: (2025)
di: Wu, Jialin, et al.
Pubblicazione: (2025)
Multi-Sourced Compositional Generalization in Visual Question Answering
di: Li, Chuanhao, et al.
Pubblicazione: (2025)
di: Li, Chuanhao, et al.
Pubblicazione: (2025)
Free Form Medical Visual Question Answering in Radiology
di: Narayanan, Abhishek, et al.
Pubblicazione: (2024)
di: Narayanan, Abhishek, et al.
Pubblicazione: (2024)
Enhancing Visual Question Answering through Question-Driven Image Captions as Prompts
di: Özdemir, Övgü, et al.
Pubblicazione: (2024)
di: Özdemir, Övgü, et al.
Pubblicazione: (2024)
TM-PATHVQA:90000+ Textless Multilingual Questions for Medical Visual Question Answering
di: Rajkhowa, Tonmoy, et al.
Pubblicazione: (2024)
di: Rajkhowa, Tonmoy, et al.
Pubblicazione: (2024)
Ask and Remember: A Questions-Only Replay Strategy for Continual Visual Question Answering
di: Marouf, Imad Eddine, et al.
Pubblicazione: (2025)
di: Marouf, Imad Eddine, et al.
Pubblicazione: (2025)
MedLVR: Latent Visual Reasoning for Reliable Medical Visual Question Answering
di: Xi, Suyang, et al.
Pubblicazione: (2026)
di: Xi, Suyang, et al.
Pubblicazione: (2026)
Fine-Grained Knowledge Structuring and Retrieval for Visual Question Answering
di: Zhang, Zhengxuan, et al.
Pubblicazione: (2025)
di: Zhang, Zhengxuan, et al.
Pubblicazione: (2025)
Wasserstein Equilibrium Decoding for Reliable Medical Visual Question Answering
di: Hagen, Luca, et al.
Pubblicazione: (2026)
di: Hagen, Luca, et al.
Pubblicazione: (2026)
VQA$^2$: Visual Question Answering for Video Quality Assessment
di: Jia, Ziheng, et al.
Pubblicazione: (2024)
di: Jia, Ziheng, et al.
Pubblicazione: (2024)
Hallucination Benchmark in Medical Visual Question Answering
di: Wu, Jinge, et al.
Pubblicazione: (2024)
di: Wu, Jinge, et al.
Pubblicazione: (2024)
QA-Dragon: Query-Aware Dynamic RAG System for Knowledge-Intensive Visual Question Answering
di: Jiang, Zhuohang, et al.
Pubblicazione: (2025)
di: Jiang, Zhuohang, et al.
Pubblicazione: (2025)
CoGR-MoE: Concept-Guided Expert Routing with Consistent Selection and Flexible Reasoning for Visual Question Answering
di: Zeng, Xiyin, et al.
Pubblicazione: (2026)
di: Zeng, Xiyin, et al.
Pubblicazione: (2026)
Explicit Abstention Knobs for Predictable Reliability in Video Question Answering
di: Ortiz, Jorge
Pubblicazione: (2025)
di: Ortiz, Jorge
Pubblicazione: (2025)
Progressive Multimodal Search and Reasoning for Knowledge-Intensive Visual Question Answering
di: Choi, Changin, et al.
Pubblicazione: (2025)
di: Choi, Changin, et al.
Pubblicazione: (2025)
Hierarchical Modeling for Medical Visual Question Answering with Cross-Attention Fusion
di: Zhang, Junkai, et al.
Pubblicazione: (2025)
di: Zhang, Junkai, et al.
Pubblicazione: (2025)
Exploring the Application of Visual Question Answering (VQA) for Classroom Activity Monitoring
di: Vu, Sinh Trong, et al.
Pubblicazione: (2025)
di: Vu, Sinh Trong, et al.
Pubblicazione: (2025)
Thought-For-Food: Reasoning Chain Induced Food Visual Question Answering
di: Jain, Riddhi, et al.
Pubblicazione: (2025)
di: Jain, Riddhi, et al.
Pubblicazione: (2025)
Adapting Lightweight Vision Language Models for Radiological Visual Question Answering
di: Shourya, Aditya, et al.
Pubblicazione: (2025)
di: Shourya, Aditya, et al.
Pubblicazione: (2025)
Pyramid Coder: Hierarchical Code Generator for Compositional Visual Question Answering
di: Shen, Ruoyue, et al.
Pubblicazione: (2024)
di: Shen, Ruoyue, et al.
Pubblicazione: (2024)
IIU: Independent Inference Units for Knowledge-based Visual Question Answering
di: Li, Yili, et al.
Pubblicazione: (2024)
di: Li, Yili, et al.
Pubblicazione: (2024)
VOILA: Value-of-Information Guided Fidelity Selection for Cost-Aware Multimodal Question Answering
di: Bhope, Rahul Atul, et al.
Pubblicazione: (2026)
di: Bhope, Rahul Atul, et al.
Pubblicazione: (2026)
HiMu: Hierarchical Multimodal Frame Selection for Long Video Question Answering
di: Ben-Ami, Dan, et al.
Pubblicazione: (2026)
di: Ben-Ami, Dan, et al.
Pubblicazione: (2026)
Detecting and Understanding Hateful Contents in Memes Through Captioning and Visual Question-Answering
di: Anaissi, Ali, et al.
Pubblicazione: (2025)
di: Anaissi, Ali, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SIEVES: Selective Prediction Generalizes through Visual Evidence Scoring
di: Rodriguez, Hector G., et al.
Pubblicazione: (2026) -
Evaluating the Impact of Post-Training Quantization on Reliable VQA with Multimodal LLMs
di: Kurz, Paul Jonas, et al.
Pubblicazione: (2026) -
CLARIFY: A Specialist-Generalist Framework for Accurate and Lightweight Dermatological Visual Question Answering
di: Saha, Aranya, et al.
Pubblicazione: (2025) -
Learning Question-Aware Keyframe Selection with Synthetic Supervision for Video Question Answering
di: Kwon, Minchan, et al.
Pubblicazione: (2026) -
Location-Aware Pretraining for Medical Difference Visual Question Answering
di: Musinguzi, Denis, et al.
Pubblicazione: (2026)