Enregistré dans:
| Auteurs principaux: | Lee, Jeongsoo, Kwon, Daeyong, Jin, Kyohoon |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2508.16994 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MHTS: Multi-Hop Tree Structure Framework for Generating Difficulty-Controllable QA Datasets for RAG Evaluation
par: Lee, Jeongsoo, et autres
Publié: (2025)
par: Lee, Jeongsoo, et autres
Publié: (2025)
SAFE: Stepwise Atomic Feedback for Error correction in Multi-hop Reasoning
par: Kwon, Daeyong, et autres
Publié: (2026)
par: Kwon, Daeyong, et autres
Publié: (2026)
MUST-RAG: MUSical Text Question Answering with Retrieval Augmented Generation
par: Kwon, Daeyong, et autres
Publié: (2025)
par: Kwon, Daeyong, et autres
Publié: (2025)
GPTs Are Multilingual Annotators for Sequence Generation Tasks
par: Choi, Juhwan, et autres
Publié: (2024)
par: Choi, Juhwan, et autres
Publié: (2024)
ArtistMus: A Globally Diverse, Artist-Centric Benchmark for Retrieval-Augmented Music Question Answering
par: Kwon, Daeyong, et autres
Publié: (2025)
par: Kwon, Daeyong, et autres
Publié: (2025)
SoftEDA: Rethinking Rule-Based Data Augmentation with Soft Labels
par: Choi, Juhwan, et autres
Publié: (2024)
par: Choi, Juhwan, et autres
Publié: (2024)
AutoAugment Is What You Need: Enhancing Rule-based Augmentation Methods in Low-resource Regimes
par: Choi, Juhwan, et autres
Publié: (2024)
par: Choi, Juhwan, et autres
Publié: (2024)
CF-RAG: A Dataset and Method for Carbon Footprint QA Using Retrieval-Augmented Generation
par: Zhao, Kaiwen, et autres
Publié: (2025)
par: Zhao, Kaiwen, et autres
Publié: (2025)
RE-RAG: Improving Open-Domain QA Performance and Interpretability with Relevance Estimator in Retrieval-Augmented Generation
par: Kim, Kiseung, et autres
Publié: (2024)
par: Kim, Kiseung, et autres
Publié: (2024)
Tackling the Inherent Difficulty of Noise Filtering in RAG
par: Liu, Jingyu, et autres
Publié: (2026)
par: Liu, Jingyu, et autres
Publié: (2026)
M$^3$KG-RAG: Multi-hop Multimodal Knowledge Graph-enhanced Retrieval-Augmented Generation
par: Park, Hyeongcheol, et autres
Publié: (2025)
par: Park, Hyeongcheol, et autres
Publié: (2025)
ChatQA: Surpassing GPT-4 on Conversational QA and RAG
par: Liu, Zihan, et autres
Publié: (2024)
par: Liu, Zihan, et autres
Publié: (2024)
CoBA: Counterbias Text Augmentation for Mitigating Various Spurious Correlations via Semantic Triples
par: Jin, Kyohoon, et autres
Publié: (2025)
par: Jin, Kyohoon, et autres
Publié: (2025)
Multi-News+: Cost-efficient Dataset Cleansing via LLM-based Data Annotation
par: Choi, Juhwan, et autres
Publié: (2024)
par: Choi, Juhwan, et autres
Publié: (2024)
Social Bias Benchmark for Generation: A Comparison of Generation and QA-Based Evaluations
par: Jin, Jiho, et autres
Publié: (2025)
par: Jin, Jiho, et autres
Publié: (2025)
Enhancing Effectiveness and Robustness in a Low-Resource Regime via Decision-Boundary-aware Data Augmentation
par: Jin, Kyohoon, et autres
Publié: (2024)
par: Jin, Kyohoon, et autres
Publié: (2024)
Exploring the Trade-Offs: Quantization Methods, Task Difficulty, and Model Size in Large Language Models From Edge to Giant
par: Lee, Jemin, et autres
Publié: (2024)
par: Lee, Jemin, et autres
Publié: (2024)
MFORT-QA: Multi-hop Few-shot Open Rich Table Question Answering
par: Guan, Che, et autres
Publié: (2024)
par: Guan, Che, et autres
Publié: (2024)
Plug-in and Fine-tuning: Bridging the Gap between Small Language Models and Large Language Models
par: Kim, Kyeonghyun, et autres
Publié: (2025)
par: Kim, Kyeonghyun, et autres
Publié: (2025)
RAG-QA Arena: Evaluating Domain Robustness for Long-form Retrieval Augmented Question Answering
par: Han, Rujun, et autres
Publié: (2024)
par: Han, Rujun, et autres
Publié: (2024)
Generating Leakage-Free Benchmarks for Robust RAG Evaluation
par: Liu, Jiayi, et autres
Publié: (2026)
par: Liu, Jiayi, et autres
Publié: (2026)
HiQA: A Hierarchical Contextual Augmentation RAG for Multi-Documents QA
par: Chen, Xinyue, et autres
Publié: (2024)
par: Chen, Xinyue, et autres
Publié: (2024)
RAG-BioQA: A Retrieval-Augmented Generation Framework for Long-Form Biomedical Question Answering
par: Panchumarthi, Lovely Yeswanth, et autres
Publié: (2025)
par: Panchumarthi, Lovely Yeswanth, et autres
Publié: (2025)
MARCH: Evaluating the Intersection of Ambiguity Interpretation and Multi-hop Inference
par: Park, Jeonghyun, et autres
Publié: (2025)
par: Park, Jeonghyun, et autres
Publié: (2025)
DO-RAG: A Domain-Specific QA Framework Using Knowledge Graph-Enhanced Retrieval-Augmented Generation
par: Opoku, David Osei, et autres
Publié: (2025)
par: Opoku, David Osei, et autres
Publié: (2025)
MedBioRAG: Semantic Search and Retrieval-Augmented Generation with Large Language Models for Medical and Biological QA
par: Kim, Seonok
Publié: (2025)
par: Kim, Seonok
Publié: (2025)
GlobalRAG: Enhancing Global Reasoning in Multi-hop Question Answering via Reinforcement Learning
par: Luo, Jinchang, et autres
Publié: (2025)
par: Luo, Jinchang, et autres
Publié: (2025)
LiteraryQA: Towards Effective Evaluation of Long-document Narrative QA
par: Bonomo, Tommaso, et autres
Publié: (2025)
par: Bonomo, Tommaso, et autres
Publié: (2025)
From Model to Classroom: Evaluating Generated MCQs for Portuguese with Narrative and Difficulty Concerns
par: Leite, Bernardo, et autres
Publié: (2025)
par: Leite, Bernardo, et autres
Publié: (2025)
Faithfulness-QA: A Counterfactual Entity Substitution Dataset for Training Context-Faithful RAG Models
par: Ju, Li, et autres
Publié: (2026)
par: Ju, Li, et autres
Publié: (2026)
Comprehensive Comparison of RAG Methods Across Multi-Domain Conversational QA
par: Alushi, Klejda, et autres
Publié: (2026)
par: Alushi, Klejda, et autres
Publié: (2026)
AirQA: A Comprehensive QA Dataset for AI Research with Instance-Level Evaluation
par: Huang, Tiancheng, et autres
Publié: (2025)
par: Huang, Tiancheng, et autres
Publié: (2025)
QuIM-RAG: Advancing Retrieval-Augmented Generation with Inverted Question Matching for Enhanced QA Performance
par: Saha, Binita, et autres
Publié: (2025)
par: Saha, Binita, et autres
Publié: (2025)
Suvach -- Generated Hindi QA benchmark
par: Narayanan, Vaishak, et autres
Publié: (2024)
par: Narayanan, Vaishak, et autres
Publié: (2024)
Diverse And Private Synthetic Datasets Generation for RAG evaluation: A multi-agent framework
par: Driouich, Ilias, et autres
Publié: (2025)
par: Driouich, Ilias, et autres
Publié: (2025)
PRIMO: Progressive Induction for Multi-hop Open Rule Generation
par: Liu, Jianyu, et autres
Publié: (2024)
par: Liu, Jianyu, et autres
Publié: (2024)
Revisiting Generalization Across Difficulty Levels: It's Not So Easy
par: Kordi, Yeganeh, et autres
Publié: (2025)
par: Kordi, Yeganeh, et autres
Publié: (2025)
M3SciQA: A Multi-Modal Multi-Document Scientific QA Benchmark for Evaluating Foundation Models
par: Li, Chuhan, et autres
Publié: (2024)
par: Li, Chuhan, et autres
Publié: (2024)
ContextRAG: Extraction-Free Hierarchical Graph Construction for Retrieval-Augmented Generation
par: Prosvirnin, Roman, et autres
Publié: (2026)
par: Prosvirnin, Roman, et autres
Publié: (2026)
Multimodal Cognitive Reframing Therapy via Multi-hop Psychotherapeutic Reasoning
par: Kim, Subin, et autres
Publié: (2025)
par: Kim, Subin, et autres
Publié: (2025)
Documents similaires
-
MHTS: Multi-Hop Tree Structure Framework for Generating Difficulty-Controllable QA Datasets for RAG Evaluation
par: Lee, Jeongsoo, et autres
Publié: (2025) -
SAFE: Stepwise Atomic Feedback for Error correction in Multi-hop Reasoning
par: Kwon, Daeyong, et autres
Publié: (2026) -
MUST-RAG: MUSical Text Question Answering with Retrieval Augmented Generation
par: Kwon, Daeyong, et autres
Publié: (2025) -
GPTs Are Multilingual Annotators for Sequence Generation Tasks
par: Choi, Juhwan, et autres
Publié: (2024) -
ArtistMus: A Globally Diverse, Artist-Centric Benchmark for Retrieval-Augmented Music Question Answering
par: Kwon, Daeyong, et autres
Publié: (2025)