PA-RAG: RAG Alignment via Multi-Perspective Preference Optimization
Fuente:
arXiv
Guardado en:
| Autores principales: | Wu, Jiayi, Cai, Hengyi, Yan, Lingyong, Sun, Hao, Li, Xiang, Wang, Shuaiqiang, Yin, Dawei, Gao, Ming |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MACPO: Weak-to-Strong Alignment via Multi-Agent Contrastive Preference Optimization
por: Lyu, Yougang, et al.
Publicado: (2024)
por: Lyu, Yougang, et al.
Publicado: (2024)
GRAF: Multi-turn Jailbreaking via Global Refinement and Active Fabrication
por: Tang, Hua, et al.
Publicado: (2025)
por: Tang, Hua, et al.
Publicado: (2025)
Mitigating Hallucinations in Large Vision-Language Models via Entity-Centric Multimodal Preference Optimization
por: Wu, Jiulong, et al.
Publicado: (2025)
por: Wu, Jiulong, et al.
Publicado: (2025)
MatchTIR: Fine-Grained Supervision for Tool-Integrated Reasoning via Bipartite Matching
por: Qu, Changle, et al.
Publicado: (2026)
por: Qu, Changle, et al.
Publicado: (2026)
Hit-RAG: Learning to Reason with Long Contexts via Preference Alignment
por: Liu, Junming, et al.
Publicado: (2026)
por: Liu, Junming, et al.
Publicado: (2026)
Divide-Then-Aggregate: An Efficient Tool Learning Method via Parallel Tool Invocation
por: Zhu, Dongsheng, et al.
Publicado: (2025)
por: Zhu, Dongsheng, et al.
Publicado: (2025)
Joint Flashback Adaptation for Forgetting-Resistant Instruction Tuning
por: Zhao, Yukun, et al.
Publicado: (2025)
por: Zhao, Yukun, et al.
Publicado: (2025)
AdaSwitch: Balancing Exploration and Guidance in Knowledge Distillation via Adaptive Switching
por: Peng, Jingyu, et al.
Publicado: (2025)
por: Peng, Jingyu, et al.
Publicado: (2025)
From Exploration to Mastery: Enabling LLMs to Master Tools via Self-Driven Interactions
por: Qu, Changle, et al.
Publicado: (2024)
por: Qu, Changle, et al.
Publicado: (2024)
Adversarial Yet Cooperative: Multi-Perspective Reasoning in Retrieved-Augmented Language Models
por: Xu, Can, et al.
Publicado: (2026)
por: Xu, Can, et al.
Publicado: (2026)
Not All Preferences Are Created Equal: Stability-Aware and Gradient-Efficient Alignment for Reasoning Models
por: Wu, Hui, et al.
Publicado: (2026)
por: Wu, Hui, et al.
Publicado: (2026)
Retrieval Models Aren't Tool-Savvy: Benchmarking Tool Retrieval for Large Language Models
por: Shi, Zhengliang, et al.
Publicado: (2025)
por: Shi, Zhengliang, et al.
Publicado: (2025)
Knowing What LLMs DO NOT Know: A Simple Yet Effective Self-Detection Method
por: Zhao, Yukun, et al.
Publicado: (2023)
por: Zhao, Yukun, et al.
Publicado: (2023)
The Real, the Better: Aligning Large Language Models with Online Human Behaviors
por: Jiang, Guanying, et al.
Publicado: (2024)
por: Jiang, Guanying, et al.
Publicado: (2024)
The Good and The Bad: Exploring Privacy Issues in Retrieval-Augmented Generation (RAG)
por: Zeng, Shenglai, et al.
Publicado: (2024)
por: Zeng, Shenglai, et al.
Publicado: (2024)
Cross-model Control: Improving Multiple Large Language Models in One-time Training
por: Wu, Jiayi, et al.
Publicado: (2024)
por: Wu, Jiayi, et al.
Publicado: (2024)
Solving the Granularity Mismatch: Hierarchical Preference Learning for Long-Horizon LLM Agents
por: Gao, Heyang, et al.
Publicado: (2025)
por: Gao, Heyang, et al.
Publicado: (2025)
Tool Learning with Large Language Models: A Survey
por: Qu, Changle, et al.
Publicado: (2024)
por: Qu, Changle, et al.
Publicado: (2024)
RAG-IGBench: Innovative Evaluation for RAG-based Interleaved Generation in Open-domain Question Answering
por: Zhang, Rongyang, et al.
Publicado: (2025)
por: Zhang, Rongyang, et al.
Publicado: (2025)
MES-RAG: Bringing Multi-modal, Entity-Storage, and Secure Enhancements to RAG
por: Wu, Pingyu, et al.
Publicado: (2025)
por: Wu, Pingyu, et al.
Publicado: (2025)
KnowTuning: Knowledge-aware Fine-tuning for Large Language Models
por: Lyu, Yougang, et al.
Publicado: (2024)
por: Lyu, Yougang, et al.
Publicado: (2024)
Retrieval is Not Enough: Enhancing RAG Reasoning through Test-Time Critique and Optimization
por: Wei, Jiaqi, et al.
Publicado: (2025)
por: Wei, Jiaqi, et al.
Publicado: (2025)
CARE-RAG - Clinical Assessment and Reasoning in RAG
por: Potluri, Deepthi, et al.
Publicado: (2025)
por: Potluri, Deepthi, et al.
Publicado: (2025)
RAG-RewardBench: Benchmarking Reward Models in Retrieval Augmented Generation for Preference Alignment
por: Jin, Zhuoran, et al.
Publicado: (2024)
por: Jin, Zhuoran, et al.
Publicado: (2024)
Beyond Monolithic Architectures: A Multi-Agent Search and Knowledge Optimization Framework for Agentic Search
por: Chen, Yiqun, et al.
Publicado: (2026)
por: Chen, Yiqun, et al.
Publicado: (2026)
Generating Leakage-Free Benchmarks for Robust RAG Evaluation
por: Liu, Jiayi, et al.
Publicado: (2026)
por: Liu, Jiayi, et al.
Publicado: (2026)
Optimizing RAG Rerankers with LLM Feedback via Reinforcement Learning
por: Wu, Yuhang, et al.
Publicado: (2026)
por: Wu, Yuhang, et al.
Publicado: (2026)
BioRAG: A RAG-LLM Framework for Biological Question Reasoning
por: Wang, Chengrui, et al.
Publicado: (2024)
por: Wang, Chengrui, et al.
Publicado: (2024)
RPO-RAG: Aligning Small LLMs with Relation-aware Preference Optimization for Knowledge Graph Question Answering
por: Um, Kaehyun, et al.
Publicado: (2026)
por: Um, Kaehyun, et al.
Publicado: (2026)
AdaFuse: Accelerating Dynamic Adapter Inference via Token-Level Pre-Gating and Fused Kernel Optimization
por: Li, Qiyang, et al.
Publicado: (2026)
por: Li, Qiyang, et al.
Publicado: (2026)
FB-RAG: Improving RAG with Forward and Backward Lookup
por: Chawla, Kushal, et al.
Publicado: (2025)
por: Chawla, Kushal, et al.
Publicado: (2025)
Towards Agentic RAG with Deep Reasoning: A Survey of RAG-Reasoning Systems in LLMs
por: Li, Yangning, et al.
Publicado: (2025)
por: Li, Yangning, et al.
Publicado: (2025)
EmoRAG: Evaluating RAG Robustness to Symbolic Perturbations
por: Zhou, Xinyun, et al.
Publicado: (2025)
por: Zhou, Xinyun, et al.
Publicado: (2025)
PrismRAG: Boosting RAG Factuality with Distractor Resilience and Strategized Reasoning
por: Kachuee, Mohammad, et al.
Publicado: (2025)
por: Kachuee, Mohammad, et al.
Publicado: (2025)
Reinforcement Learning for Optimizing RAG for Domain Chatbots
por: Kulkarni, Mandar, et al.
Publicado: (2024)
por: Kulkarni, Mandar, et al.
Publicado: (2024)
Modular RAG: Transforming RAG Systems into LEGO-like Reconfigurable Frameworks
por: Gao, Yunfan, et al.
Publicado: (2024)
por: Gao, Yunfan, et al.
Publicado: (2024)
VaccineRAG: Boosting Multimodal Large Language Models' Immunity to Harmful RAG Samples
por: Sun, Qixin, et al.
Publicado: (2025)
por: Sun, Qixin, et al.
Publicado: (2025)
First Token Probability Guided RAG for Telecom Question Answering
por: Chen, Tingwei, et al.
Publicado: (2025)
por: Chen, Tingwei, et al.
Publicado: (2025)
MARA: A Multimodal Adaptive Retrieval-Augmented Framework for Document Question Answering
por: Wu, Hui, et al.
Publicado: (2026)
por: Wu, Hui, et al.
Publicado: (2026)
From RAG to Agentic RAG for Faithful Islamic Question Answering
por: Bhatia, Gagan, et al.
Publicado: (2026)
por: Bhatia, Gagan, et al.
Publicado: (2026)
Ejemplares similares
-
MACPO: Weak-to-Strong Alignment via Multi-Agent Contrastive Preference Optimization
por: Lyu, Yougang, et al.
Publicado: (2024) -
GRAF: Multi-turn Jailbreaking via Global Refinement and Active Fabrication
por: Tang, Hua, et al.
Publicado: (2025) -
Mitigating Hallucinations in Large Vision-Language Models via Entity-Centric Multimodal Preference Optimization
por: Wu, Jiulong, et al.
Publicado: (2025) -
MatchTIR: Fine-Grained Supervision for Tool-Integrated Reasoning via Bipartite Matching
por: Qu, Changle, et al.
Publicado: (2026) -
Hit-RAG: Learning to Reason with Long Contexts via Preference Alignment
por: Liu, Junming, et al.
Publicado: (2026)