Task Formulation Matters When Learning Continually: A Case Study in Visual Question Answering
Fuente:
arXiv
Salvato in:
| Autori principali: | Nikandrou, Mavina, Yu, Lu, Suglia, Alessandro, Konstas, Ioannis, Rieser, Verena |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2022
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Enhancing Continual Learning in Visual Question Answering with Modality-Aware Feature Distillation
di: Nikandrou, Malvina, et al.
Pubblicazione: (2024)
di: Nikandrou, Malvina, et al.
Pubblicazione: (2024)
Retrievit: In-context Retrieval Capabilities of Transformers, State Space Models, and Hybrid Architectures
di: Pantazopoulos, Georgios, et al.
Pubblicazione: (2026)
di: Pantazopoulos, Georgios, et al.
Pubblicazione: (2026)
CROPE: Evaluating In-Context Adaptation of Vision and Language Models to Culture-Specific Concepts
di: Nikandrou, Malvina, et al.
Pubblicazione: (2024)
di: Nikandrou, Malvina, et al.
Pubblicazione: (2024)
Investigating the Role of Instruction Variety and Task Difficulty in Robotic Manipulation Tasks
di: Parekh, Amit, et al.
Pubblicazione: (2024)
di: Parekh, Amit, et al.
Pubblicazione: (2024)
Shaking Up VLMs: Comparing Transformers and Structured State Space Models for Vision & Language Modeling
di: Pantazopoulos, Georgios, et al.
Pubblicazione: (2024)
di: Pantazopoulos, Georgios, et al.
Pubblicazione: (2024)
When Chain-of-Thought Fails, the Solution Hides in the Hidden States
di: Mehrafarin, Houman, et al.
Pubblicazione: (2026)
di: Mehrafarin, Houman, et al.
Pubblicazione: (2026)
VoyagerVision: Investigating the Role of Multi-modal Information for Open-ended Learning Systems
di: Smyth, Ethan, et al.
Pubblicazione: (2025)
di: Smyth, Ethan, et al.
Pubblicazione: (2025)
Learning To See But Forgetting To Follow: Visual Instruction Tuning Makes LLMs More Prone To Jailbreak Attacks
di: Pantazopoulos, Georgios, et al.
Pubblicazione: (2024)
di: Pantazopoulos, Georgios, et al.
Pubblicazione: (2024)
Voices in a Crowd: Searching for Clusters of Unique Perspectives
di: Vitsakis, Nikolas, et al.
Pubblicazione: (2024)
di: Vitsakis, Nikolas, et al.
Pubblicazione: (2024)
MoRFI: Monotonic Sparse Autoencoder Feature Identification
di: Dimakopoulos, Dimitris, et al.
Pubblicazione: (2026)
di: Dimakopoulos, Dimitris, et al.
Pubblicazione: (2026)
TPCL: Task Progressive Curriculum Learning for Robust Visual Question Answering
di: Akl, Ahmed, et al.
Pubblicazione: (2024)
di: Akl, Ahmed, et al.
Pubblicazione: (2024)
Knowing When to Answer: Adaptive Confidence Refinement for Reliable Audio-Visual Question Answering
di: Tran, Dinh Phu, et al.
Pubblicazione: (2026)
di: Tran, Dinh Phu, et al.
Pubblicazione: (2026)
Questioning the Stability of Visual Question Answering
di: Rosenfeld, Amir, et al.
Pubblicazione: (2025)
di: Rosenfeld, Amir, et al.
Pubblicazione: (2025)
AgriPath: A Systematic Exploration of Architectural Trade-offs for Crop Disease Classification
di: Mooraj, Hamza, et al.
Pubblicazione: (2026)
di: Mooraj, Hamza, et al.
Pubblicazione: (2026)
Electrocardiogram-Language Model for Few-Shot Question Answering with Meta Learning
di: Tang, Jialu, et al.
Pubblicazione: (2024)
di: Tang, Jialu, et al.
Pubblicazione: (2024)
OWLViz: An Open-World Benchmark for Visual Question Answering
di: Nguyen, Thuy, et al.
Pubblicazione: (2025)
di: Nguyen, Thuy, et al.
Pubblicazione: (2025)
Federated Document Visual Question Answering: A Pilot Study
di: Nguyen, Khanh, et al.
Pubblicazione: (2024)
di: Nguyen, Khanh, et al.
Pubblicazione: (2024)
MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering
di: Li, Xu, et al.
Pubblicazione: (2025)
di: Li, Xu, et al.
Pubblicazione: (2025)
BERT-VQA: Visual Question Answering on Plots
di: Vu, Tai, et al.
Pubblicazione: (2025)
di: Vu, Tai, et al.
Pubblicazione: (2025)
Learning to Compress Contexts for Efficient Knowledge-based Visual Question Answering
di: Weng, Weixi, et al.
Pubblicazione: (2024)
di: Weng, Weixi, et al.
Pubblicazione: (2024)
Retrieval-Augmented Generation for Domain-Specific Question Answering: A Case Study on Pittsburgh and CMU
di: Sun, Haojia, et al.
Pubblicazione: (2024)
di: Sun, Haojia, et al.
Pubblicazione: (2024)
Causal Question Answering with Reinforcement Learning
di: Blübaum, Lukas, et al.
Pubblicazione: (2023)
di: Blübaum, Lukas, et al.
Pubblicazione: (2023)
Theory and interpretability of Quantum Extreme Learning Machines: a Pauli-transfer matrix approach
di: Gross, Markus, et al.
Pubblicazione: (2026)
di: Gross, Markus, et al.
Pubblicazione: (2026)
PlatoLTL: Learning to Generalize Across Symbols in LTL Instructions for Multi-Task RL
di: Cloete, Jacques, et al.
Pubblicazione: (2026)
di: Cloete, Jacques, et al.
Pubblicazione: (2026)
A Curriculum Learning Approach to Reinforcement Learning: Leveraging RAG for Multimodal Question Answering
di: Zhang, Chenliang, et al.
Pubblicazione: (2025)
di: Zhang, Chenliang, et al.
Pubblicazione: (2025)
Retrieval Augmented Question Answering: When Should LLMs Admit Ignorance?
di: Wang, Dingmin, et al.
Pubblicazione: (2025)
di: Wang, Dingmin, et al.
Pubblicazione: (2025)
Privacy-Aware Document Visual Question Answering
di: Tito, Rubèn, et al.
Pubblicazione: (2023)
di: Tito, Rubèn, et al.
Pubblicazione: (2023)
Iterative In-Context Learning to Enhance LLMs Abstract Reasoning: The Case-Study of Algebraic Tasks
di: Fioravanti, Stefano, et al.
Pubblicazione: (2025)
di: Fioravanti, Stefano, et al.
Pubblicazione: (2025)
Synthesizing High-Quality Visual Question Answering from Medical Documents with Generator-Verifier LMMs
di: Huang, Xiaoke, et al.
Pubblicazione: (2025)
di: Huang, Xiaoke, et al.
Pubblicazione: (2025)
Exploring Diverse Methods in Visual Question Answering
di: Li, Panfeng, et al.
Pubblicazione: (2024)
di: Li, Panfeng, et al.
Pubblicazione: (2024)
UniPACT: A Multimodal Framework for Prognostic Question Answering on Raw ECG and Structured EHR
di: Tang, Jialu, et al.
Pubblicazione: (2026)
di: Tang, Jialu, et al.
Pubblicazione: (2026)
A Dataset for Spatiotemporal-Sensitive POI Question Answering
di: Han, Xiao, et al.
Pubblicazione: (2025)
di: Han, Xiao, et al.
Pubblicazione: (2025)
COREVQA: A Crowd Observation and Reasoning Entailment Visual Question Answering Benchmark
di: Chintapatla, Ishant, et al.
Pubblicazione: (2025)
di: Chintapatla, Ishant, et al.
Pubblicazione: (2025)
Time-MQA: Time Series Multi-Task Question Answering with Context Enhancement
di: Kong, Yaxuan, et al.
Pubblicazione: (2025)
di: Kong, Yaxuan, et al.
Pubblicazione: (2025)
DocVXQA: Context-Aware Visual Explanations for Document Question Answering
di: Souibgui, Mohamed Ali, et al.
Pubblicazione: (2025)
di: Souibgui, Mohamed Ali, et al.
Pubblicazione: (2025)
Describe Anything Model for Visual Question Answering on Text-rich Images
di: Vu, Yen-Linh, et al.
Pubblicazione: (2025)
di: Vu, Yen-Linh, et al.
Pubblicazione: (2025)
RSAdapter: Adapting Multimodal Models for Remote Sensing Visual Question Answering
di: Wang, Yuduo, et al.
Pubblicazione: (2023)
di: Wang, Yuduo, et al.
Pubblicazione: (2023)
Kernel-based optimization of measurement operators for quantum reservoir computers
di: Gross, Markus, et al.
Pubblicazione: (2026)
di: Gross, Markus, et al.
Pubblicazione: (2026)
Noncommutative Model Selection for Data Clustering and Dimension Reduction Using Relative von Neumann Entropy
di: Guzmán-Tristán, Araceli, et al.
Pubblicazione: (2024)
di: Guzmán-Tristán, Araceli, et al.
Pubblicazione: (2024)
Guiding Vision-Language Model Selection for Visual Question-Answering Across Tasks, Domains, and Knowledge Types
di: Sinha, Neelabh, et al.
Pubblicazione: (2024)
di: Sinha, Neelabh, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Enhancing Continual Learning in Visual Question Answering with Modality-Aware Feature Distillation
di: Nikandrou, Malvina, et al.
Pubblicazione: (2024) -
Retrievit: In-context Retrieval Capabilities of Transformers, State Space Models, and Hybrid Architectures
di: Pantazopoulos, Georgios, et al.
Pubblicazione: (2026) -
CROPE: Evaluating In-Context Adaptation of Vision and Language Models to Culture-Specific Concepts
di: Nikandrou, Malvina, et al.
Pubblicazione: (2024) -
Investigating the Role of Instruction Variety and Task Difficulty in Robotic Manipulation Tasks
di: Parekh, Amit, et al.
Pubblicazione: (2024) -
Shaking Up VLMs: Comparing Transformers and Structured State Space Models for Vision & Language Modeling
di: Pantazopoulos, Georgios, et al.
Pubblicazione: (2024)