A Curriculum Learning Approach to Reinforcement Learning: Leveraging RAG for Multimodal Question Answering
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Chenliang, Wang, Lin, Lu, Yuanyuan, Qi, Yusheng, Wang, Kexin, Hou, Peixu, Chen, Wenshi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Causal Question Answering with Reinforcement Learning
par: Blübaum, Lukas, et autres
Publié: (2023)
par: Blübaum, Lukas, et autres
Publié: (2023)
Reinforcement Learning for Control with Probabilistic Stability Guarantee: A Finite-Sample Approach
par: Han, Minghao, et autres
Publié: (2026)
par: Han, Minghao, et autres
Publié: (2026)
Aligning Frozen LLMs by Reinforcement Learning: An Iterative Reweight-then-Optimize Approach
par: Zhang, Xinnan, et autres
Publié: (2025)
par: Zhang, Xinnan, et autres
Publié: (2025)
W-RAG: Weakly Supervised Dense Retrieval in RAG for Open-domain Question Answering
par: Nian, Jinming, et autres
Publié: (2024)
par: Nian, Jinming, et autres
Publié: (2024)
Hierarchical Reinforcement Learning for Swarm Confrontation with High Uncertainty
par: Wu, Qizhen, et autres
Publié: (2024)
par: Wu, Qizhen, et autres
Publié: (2024)
FinSage: A Multi-aspect RAG System for Financial Filings Question Answering
par: Wang, Xinyu, et autres
Publié: (2025)
par: Wang, Xinyu, et autres
Publié: (2025)
Rational Synthesizers or Heuristic Followers? Analyzing LLMs in RAG-based Question-Answering
par: Naphade, Atharv
Publié: (2026)
par: Naphade, Atharv
Publié: (2026)
GlobalRAG: Enhancing Global Reasoning in Multi-hop Question Answering via Reinforcement Learning
par: Luo, Jinchang, et autres
Publié: (2025)
par: Luo, Jinchang, et autres
Publié: (2025)
MedTrust-RAG: Evidence Verification and Trust Alignment for Biomedical Question Answering
par: Ning, Yingpeng, et autres
Publié: (2025)
par: Ning, Yingpeng, et autres
Publié: (2025)
RadioRAG: Online Retrieval-augmented Generation for Radiology Question Answering
par: Arasteh, Soroosh Tayebi, et autres
Publié: (2024)
par: Arasteh, Soroosh Tayebi, et autres
Publié: (2024)
Dynamic Adversarial Reinforcement Learning for Robust Multimodal Large Language Models
par: Bao, Yicheng, et autres
Publié: (2026)
par: Bao, Yicheng, et autres
Publié: (2026)
Curriculum Abductive Learning
par: Hu, Wen-Chao, et autres
Publié: (2025)
par: Hu, Wen-Chao, et autres
Publié: (2025)
Augmenting Question Answering with A Hybrid RAG Approach
par: Yang, Tianyi, et autres
Publié: (2026)
par: Yang, Tianyi, et autres
Publié: (2026)
Probabilistic Curriculum Learning for Goal-Based Reinforcement Learning
par: Salt, Llewyn, et autres
Publié: (2025)
par: Salt, Llewyn, et autres
Publié: (2025)
Deep Learning Approaches for Improving Question Answering Systems in Hepatocellular Carcinoma Research
par: Huo, Shuning, et autres
Publié: (2024)
par: Huo, Shuning, et autres
Publié: (2024)
MM-PhyRLHF: Reinforcement Learning Framework for Multimodal Physics Question-Answering
par: Kapuriya, Janak, et autres
Publié: (2024)
par: Kapuriya, Janak, et autres
Publié: (2024)
Kernel-Based Distributed Q-Learning: A Scalable Reinforcement Learning Approach for Dynamic Treatment Regimes
par: Wang, Di, et autres
Publié: (2023)
par: Wang, Di, et autres
Publié: (2023)
FHBench: Towards Efficient and Personalized Federated Learning for Multimodal Healthcare
par: Wang, Penghao, et autres
Publié: (2025)
par: Wang, Penghao, et autres
Publié: (2025)
EfficientRAG: Efficient Retriever for Multi-Hop Question Answering
par: Zhuang, Ziyuan, et autres
Publié: (2024)
par: Zhuang, Ziyuan, et autres
Publié: (2024)
Hardness-Aware Dynamic Curriculum Learning for Robust Multimodal Emotion Recognition with Missing Modalities
par: Liu, Rui, et autres
Publié: (2025)
par: Liu, Rui, et autres
Publié: (2025)
OntoRAG: Enhancing Question-Answering through Automated Ontology Derivation from Unstructured Knowledge Bases
par: Tiwari, Yash, et autres
Publié: (2025)
par: Tiwari, Yash, et autres
Publié: (2025)
A$^2$Search: Ambiguity-Aware Question Answering with Reinforcement Learning
par: Zhang, Fengji, et autres
Publié: (2025)
par: Zhang, Fengji, et autres
Publié: (2025)
Training Large Language Models for Reasoning through Reverse Curriculum Reinforcement Learning
par: Xi, Zhiheng, et autres
Publié: (2024)
par: Xi, Zhiheng, et autres
Publié: (2024)
When Demonstrations Meet Generative World Models: A Maximum Likelihood Framework for Offline Inverse Reinforcement Learning
par: Zeng, Siliang, et autres
Publié: (2023)
par: Zeng, Siliang, et autres
Publié: (2023)
Robust Driving Control for Autonomous Vehicles: An Intelligent General-sum Constrained Adversarial Reinforcement Learning Approach
par: Fan, Junchao, et autres
Publié: (2025)
par: Fan, Junchao, et autres
Publié: (2025)
Human-Aware Robot Navigation via Reinforcement Learning with Hindsight Experience Replay and Curriculum Learning
par: Li, Keyu, et autres
Publié: (2021)
par: Li, Keyu, et autres
Publié: (2021)
RAG-IGBench: Innovative Evaluation for RAG-based Interleaved Generation in Open-domain Question Answering
par: Zhang, Rongyang, et autres
Publié: (2025)
par: Zhang, Rongyang, et autres
Publié: (2025)
Learning What Reinforcement Learning Can't: Interleaved Online Fine-Tuning for Hardest Questions
par: Ma, Lu, et autres
Publié: (2025)
par: Ma, Lu, et autres
Publié: (2025)
Proximal Curriculum with Task Correlations for Deep Reinforcement Learning
par: Tzannetos, Georgios, et autres
Publié: (2024)
par: Tzannetos, Georgios, et autres
Publié: (2024)
MUST-RAG: MUSical Text Question Answering with Retrieval Augmented Generation
par: Kwon, Daeyong, et autres
Publié: (2025)
par: Kwon, Daeyong, et autres
Publié: (2025)
Multi-hop Question Answering under Temporal Knowledge Editing
par: Cheng, Keyuan, et autres
Publié: (2024)
par: Cheng, Keyuan, et autres
Publié: (2024)
Curriculum-RLAIF: Curriculum Alignment with Reinforcement Learning from AI Feedback
par: Lin, Jiaye, et autres
Publié: (2025)
par: Lin, Jiaye, et autres
Publié: (2025)
HyperEyes: Dual-Grained Efficiency-Aware Reinforcement Learning for Parallel Multimodal Search Agents
par: Li, Guankai, et autres
Publié: (2026)
par: Li, Guankai, et autres
Publié: (2026)
List Replicable Reinforcement Learning
par: Zhang, Bohan, et autres
Publié: (2025)
par: Zhang, Bohan, et autres
Publié: (2025)
Reinforcement Learning with Curriculum-inspired Adaptive Direct Policy Guidance for Truck Dispatching
par: Meng, Shi, et autres
Publié: (2025)
par: Meng, Shi, et autres
Publié: (2025)
RLBayes: a Bayesian Network Structure Learning Algorithm via Reinforcement Learning-Based Search Strategy
par: Wang, Mingcan, et autres
Publié: (2025)
par: Wang, Mingcan, et autres
Publié: (2025)
Periodic Asynchrony: An On-Policy Approach for Accelerating LLM Reinforcement Learning
par: Lu, Jian
Publié: (2025)
par: Lu, Jian
Publié: (2025)
Iterative Multimodal Retrieval-Augmented Generation for Medical Question Answering
par: Chen, Xupeng, et autres
Publié: (2026)
par: Chen, Xupeng, et autres
Publié: (2026)
Merge then Realign: Simple and Effective Modality-Incremental Continual Learning for Multimodal LLMs
par: Zhang, Dingkun, et autres
Publié: (2025)
par: Zhang, Dingkun, et autres
Publié: (2025)
A Semantic-Sampling Framework for Evaluating Calibration in Open-Ended Question Answering
par: Wang, Zhanliang, et autres
Publié: (2026)
par: Wang, Zhanliang, et autres
Publié: (2026)
Documents similaires
-
Causal Question Answering with Reinforcement Learning
par: Blübaum, Lukas, et autres
Publié: (2023) -
Reinforcement Learning for Control with Probabilistic Stability Guarantee: A Finite-Sample Approach
par: Han, Minghao, et autres
Publié: (2026) -
Aligning Frozen LLMs by Reinforcement Learning: An Iterative Reweight-then-Optimize Approach
par: Zhang, Xinnan, et autres
Publié: (2025) -
W-RAG: Weakly Supervised Dense Retrieval in RAG for Open-domain Question Answering
par: Nian, Jinming, et autres
Publié: (2024) -
Hierarchical Reinforcement Learning for Swarm Confrontation with High Uncertainty
par: Wu, Qizhen, et autres
Publié: (2024)