A Curriculum Learning Approach to Reinforcement Learning: Leveraging RAG for Multimodal Question Answering
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Chenliang, Wang, Lin, Lu, Yuanyuan, Qi, Yusheng, Wang, Kexin, Hou, Peixu, Chen, Wenshi |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Causal Question Answering with Reinforcement Learning
von: Blübaum, Lukas, et al.
Veröffentlicht: (2023)
von: Blübaum, Lukas, et al.
Veröffentlicht: (2023)
Reinforcement Learning for Control with Probabilistic Stability Guarantee: A Finite-Sample Approach
von: Han, Minghao, et al.
Veröffentlicht: (2026)
von: Han, Minghao, et al.
Veröffentlicht: (2026)
Aligning Frozen LLMs by Reinforcement Learning: An Iterative Reweight-then-Optimize Approach
von: Zhang, Xinnan, et al.
Veröffentlicht: (2025)
von: Zhang, Xinnan, et al.
Veröffentlicht: (2025)
W-RAG: Weakly Supervised Dense Retrieval in RAG for Open-domain Question Answering
von: Nian, Jinming, et al.
Veröffentlicht: (2024)
von: Nian, Jinming, et al.
Veröffentlicht: (2024)
Hierarchical Reinforcement Learning for Swarm Confrontation with High Uncertainty
von: Wu, Qizhen, et al.
Veröffentlicht: (2024)
von: Wu, Qizhen, et al.
Veröffentlicht: (2024)
FinSage: A Multi-aspect RAG System for Financial Filings Question Answering
von: Wang, Xinyu, et al.
Veröffentlicht: (2025)
von: Wang, Xinyu, et al.
Veröffentlicht: (2025)
Rational Synthesizers or Heuristic Followers? Analyzing LLMs in RAG-based Question-Answering
von: Naphade, Atharv
Veröffentlicht: (2026)
von: Naphade, Atharv
Veröffentlicht: (2026)
GlobalRAG: Enhancing Global Reasoning in Multi-hop Question Answering via Reinforcement Learning
von: Luo, Jinchang, et al.
Veröffentlicht: (2025)
von: Luo, Jinchang, et al.
Veröffentlicht: (2025)
MedTrust-RAG: Evidence Verification and Trust Alignment for Biomedical Question Answering
von: Ning, Yingpeng, et al.
Veröffentlicht: (2025)
von: Ning, Yingpeng, et al.
Veröffentlicht: (2025)
RadioRAG: Online Retrieval-augmented Generation for Radiology Question Answering
von: Arasteh, Soroosh Tayebi, et al.
Veröffentlicht: (2024)
von: Arasteh, Soroosh Tayebi, et al.
Veröffentlicht: (2024)
Dynamic Adversarial Reinforcement Learning for Robust Multimodal Large Language Models
von: Bao, Yicheng, et al.
Veröffentlicht: (2026)
von: Bao, Yicheng, et al.
Veröffentlicht: (2026)
Curriculum Abductive Learning
von: Hu, Wen-Chao, et al.
Veröffentlicht: (2025)
von: Hu, Wen-Chao, et al.
Veröffentlicht: (2025)
Probabilistic Curriculum Learning for Goal-Based Reinforcement Learning
von: Salt, Llewyn, et al.
Veröffentlicht: (2025)
von: Salt, Llewyn, et al.
Veröffentlicht: (2025)
Augmenting Question Answering with A Hybrid RAG Approach
von: Yang, Tianyi, et al.
Veröffentlicht: (2026)
von: Yang, Tianyi, et al.
Veröffentlicht: (2026)
Deep Learning Approaches for Improving Question Answering Systems in Hepatocellular Carcinoma Research
von: Huo, Shuning, et al.
Veröffentlicht: (2024)
von: Huo, Shuning, et al.
Veröffentlicht: (2024)
MM-PhyRLHF: Reinforcement Learning Framework for Multimodal Physics Question-Answering
von: Kapuriya, Janak, et al.
Veröffentlicht: (2024)
von: Kapuriya, Janak, et al.
Veröffentlicht: (2024)
Kernel-Based Distributed Q-Learning: A Scalable Reinforcement Learning Approach for Dynamic Treatment Regimes
von: Wang, Di, et al.
Veröffentlicht: (2023)
von: Wang, Di, et al.
Veröffentlicht: (2023)
FHBench: Towards Efficient and Personalized Federated Learning for Multimodal Healthcare
von: Wang, Penghao, et al.
Veröffentlicht: (2025)
von: Wang, Penghao, et al.
Veröffentlicht: (2025)
EfficientRAG: Efficient Retriever for Multi-Hop Question Answering
von: Zhuang, Ziyuan, et al.
Veröffentlicht: (2024)
von: Zhuang, Ziyuan, et al.
Veröffentlicht: (2024)
Hardness-Aware Dynamic Curriculum Learning for Robust Multimodal Emotion Recognition with Missing Modalities
von: Liu, Rui, et al.
Veröffentlicht: (2025)
von: Liu, Rui, et al.
Veröffentlicht: (2025)
OntoRAG: Enhancing Question-Answering through Automated Ontology Derivation from Unstructured Knowledge Bases
von: Tiwari, Yash, et al.
Veröffentlicht: (2025)
von: Tiwari, Yash, et al.
Veröffentlicht: (2025)
A$^2$Search: Ambiguity-Aware Question Answering with Reinforcement Learning
von: Zhang, Fengji, et al.
Veröffentlicht: (2025)
von: Zhang, Fengji, et al.
Veröffentlicht: (2025)
Training Large Language Models for Reasoning through Reverse Curriculum Reinforcement Learning
von: Xi, Zhiheng, et al.
Veröffentlicht: (2024)
von: Xi, Zhiheng, et al.
Veröffentlicht: (2024)
When Demonstrations Meet Generative World Models: A Maximum Likelihood Framework for Offline Inverse Reinforcement Learning
von: Zeng, Siliang, et al.
Veröffentlicht: (2023)
von: Zeng, Siliang, et al.
Veröffentlicht: (2023)
Robust Driving Control for Autonomous Vehicles: An Intelligent General-sum Constrained Adversarial Reinforcement Learning Approach
von: Fan, Junchao, et al.
Veröffentlicht: (2025)
von: Fan, Junchao, et al.
Veröffentlicht: (2025)
Human-Aware Robot Navigation via Reinforcement Learning with Hindsight Experience Replay and Curriculum Learning
von: Li, Keyu, et al.
Veröffentlicht: (2021)
von: Li, Keyu, et al.
Veröffentlicht: (2021)
Learning What Reinforcement Learning Can't: Interleaved Online Fine-Tuning for Hardest Questions
von: Ma, Lu, et al.
Veröffentlicht: (2025)
von: Ma, Lu, et al.
Veröffentlicht: (2025)
RAG-IGBench: Innovative Evaluation for RAG-based Interleaved Generation in Open-domain Question Answering
von: Zhang, Rongyang, et al.
Veröffentlicht: (2025)
von: Zhang, Rongyang, et al.
Veröffentlicht: (2025)
Proximal Curriculum with Task Correlations for Deep Reinforcement Learning
von: Tzannetos, Georgios, et al.
Veröffentlicht: (2024)
von: Tzannetos, Georgios, et al.
Veröffentlicht: (2024)
MUST-RAG: MUSical Text Question Answering with Retrieval Augmented Generation
von: Kwon, Daeyong, et al.
Veröffentlicht: (2025)
von: Kwon, Daeyong, et al.
Veröffentlicht: (2025)
Multi-hop Question Answering under Temporal Knowledge Editing
von: Cheng, Keyuan, et al.
Veröffentlicht: (2024)
von: Cheng, Keyuan, et al.
Veröffentlicht: (2024)
Curriculum-RLAIF: Curriculum Alignment with Reinforcement Learning from AI Feedback
von: Lin, Jiaye, et al.
Veröffentlicht: (2025)
von: Lin, Jiaye, et al.
Veröffentlicht: (2025)
HyperEyes: Dual-Grained Efficiency-Aware Reinforcement Learning for Parallel Multimodal Search Agents
von: Li, Guankai, et al.
Veröffentlicht: (2026)
von: Li, Guankai, et al.
Veröffentlicht: (2026)
List Replicable Reinforcement Learning
von: Zhang, Bohan, et al.
Veröffentlicht: (2025)
von: Zhang, Bohan, et al.
Veröffentlicht: (2025)
Reinforcement Learning with Curriculum-inspired Adaptive Direct Policy Guidance for Truck Dispatching
von: Meng, Shi, et al.
Veröffentlicht: (2025)
von: Meng, Shi, et al.
Veröffentlicht: (2025)
RLBayes: a Bayesian Network Structure Learning Algorithm via Reinforcement Learning-Based Search Strategy
von: Wang, Mingcan, et al.
Veröffentlicht: (2025)
von: Wang, Mingcan, et al.
Veröffentlicht: (2025)
Periodic Asynchrony: An On-Policy Approach for Accelerating LLM Reinforcement Learning
von: Lu, Jian
Veröffentlicht: (2025)
von: Lu, Jian
Veröffentlicht: (2025)
Iterative Multimodal Retrieval-Augmented Generation for Medical Question Answering
von: Chen, Xupeng, et al.
Veröffentlicht: (2026)
von: Chen, Xupeng, et al.
Veröffentlicht: (2026)
Merge then Realign: Simple and Effective Modality-Incremental Continual Learning for Multimodal LLMs
von: Zhang, Dingkun, et al.
Veröffentlicht: (2025)
von: Zhang, Dingkun, et al.
Veröffentlicht: (2025)
A Semantic-Sampling Framework for Evaluating Calibration in Open-Ended Question Answering
von: Wang, Zhanliang, et al.
Veröffentlicht: (2026)
von: Wang, Zhanliang, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Causal Question Answering with Reinforcement Learning
von: Blübaum, Lukas, et al.
Veröffentlicht: (2023) -
Reinforcement Learning for Control with Probabilistic Stability Guarantee: A Finite-Sample Approach
von: Han, Minghao, et al.
Veröffentlicht: (2026) -
Aligning Frozen LLMs by Reinforcement Learning: An Iterative Reweight-then-Optimize Approach
von: Zhang, Xinnan, et al.
Veröffentlicht: (2025) -
W-RAG: Weakly Supervised Dense Retrieval in RAG for Open-domain Question Answering
von: Nian, Jinming, et al.
Veröffentlicht: (2024) -
Hierarchical Reinforcement Learning for Swarm Confrontation with High Uncertainty
von: Wu, Qizhen, et al.
Veröffentlicht: (2024)