LIT-RAGBench: Benchmarking Generator Capabilities of Large Language Models in Retrieval-Augmented Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Itai, Koki, Hasegawa, Shunichi, Yamamoto, Yuta, Minegishi, Gouki, Otsuki, Masaki |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
RAGBench: Explainable Benchmark for Retrieval-Augmented Generation Systems
por: Friel, Robert, et al.
Publicado: (2024)
por: Friel, Robert, et al.
Publicado: (2024)
CanLegalRAGBench: Evaluating Retrieval-Augmented Generation on Canadian Case Law
por: Zhao, Ethan, et al.
Publicado: (2026)
por: Zhao, Ethan, et al.
Publicado: (2026)
Mechanism of Task-oriented Information Removal in In-context Learning
por: Cho, Hakaze, et al.
Publicado: (2025)
por: Cho, Hakaze, et al.
Publicado: (2025)
Rethinking Evaluation of Sparse Autoencoders through the Representation of Polysemous Words
por: Minegishi, Gouki, et al.
Publicado: (2025)
por: Minegishi, Gouki, et al.
Publicado: (2025)
Steering at the Source: Style Modulation Heads for Robust Persona Control
por: Izawa, Yoshihiro, et al.
Publicado: (2026)
por: Izawa, Yoshihiro, et al.
Publicado: (2026)
Beyond Induction Heads: In-Context Meta Learning Induces Multi-Phase Circuit Emergence
por: Minegishi, Gouki, et al.
Publicado: (2025)
por: Minegishi, Gouki, et al.
Publicado: (2025)
RAGCap-Bench: Benchmarking Capabilities of LLMs in Agentic Retrieval Augmented Generation Systems
por: Lin, Jingru, et al.
Publicado: (2025)
por: Lin, Jingru, et al.
Publicado: (2025)
Boosting the Capabilities of Compact Models in Low-Data Contexts with Large Language Models and Retrieval-Augmented Generation
por: Shandilya, Bhargav, et al.
Publicado: (2024)
por: Shandilya, Bhargav, et al.
Publicado: (2024)
Benchmarking Large Language Models for Quebec Insurance: From Closed-Book to Retrieval-Augmented Generation
por: Beauchemin, David, et al.
Publicado: (2026)
por: Beauchemin, David, et al.
Publicado: (2026)
CRUD-RAG: A Comprehensive Chinese Benchmark for Retrieval-Augmented Generation of Large Language Models
por: Lyu, Yuanjie, et al.
Publicado: (2024)
por: Lyu, Yuanjie, et al.
Publicado: (2024)
Measuring and Benchmarking Large Language Models' Capabilities to Generate Persuasive Language
por: Pauli, Amalie Brogaard, et al.
Publicado: (2024)
por: Pauli, Amalie Brogaard, et al.
Publicado: (2024)
FinRAGBench-V: A Benchmark for Multimodal RAG with Visual Citation in the Financial Domain
por: Zhao, Suifeng, et al.
Publicado: (2025)
por: Zhao, Suifeng, et al.
Publicado: (2025)
RAD-Bench: Evaluating Large Language Models Capabilities in Retrieval Augmented Dialogues
por: Kuo, Tzu-Lin, et al.
Publicado: (2024)
por: Kuo, Tzu-Lin, et al.
Publicado: (2024)
Evaluating Self-Generated Documents for Enhancing Retrieval-Augmented Generation with Large Language Models
por: Li, Jiatao, et al.
Publicado: (2024)
por: Li, Jiatao, et al.
Publicado: (2024)
Auto-RAG: Autonomous Retrieval-Augmented Generation for Large Language Models
por: Yu, Tian, et al.
Publicado: (2024)
por: Yu, Tian, et al.
Publicado: (2024)
Retrieval Augmented Generation based Large Language Models for Causality Mining
por: Naduvilakandy, Thushara Manjari, et al.
Publicado: (2025)
por: Naduvilakandy, Thushara Manjari, et al.
Publicado: (2025)
A Survey on Retrieval And Structuring Augmented Generation with Large Language Models
por: Jiang, Pengcheng, et al.
Publicado: (2025)
por: Jiang, Pengcheng, et al.
Publicado: (2025)
Adapting Large Language Models for Multi-Domain Retrieval-Augmented-Generation
por: Misrahi, Alexandre, et al.
Publicado: (2025)
por: Misrahi, Alexandre, et al.
Publicado: (2025)
Towards Comprehensive Vietnamese Retrieval-Augmented Generation and Large Language Models
por: Duc, Nguyen Quang, et al.
Publicado: (2024)
por: Duc, Nguyen Quang, et al.
Publicado: (2024)
Retrieval-Augmented Generation for Large Language Models: A Survey
por: Gao, Yunfan, et al.
Publicado: (2023)
por: Gao, Yunfan, et al.
Publicado: (2023)
Evaluating Cultural Knowledge Processing in Large Language Models: A Cognitive Benchmarking Framework Integrating Retrieval-Augmented Generation
por: Lee, Hung-Shin, et al.
Publicado: (2025)
por: Lee, Hung-Shin, et al.
Publicado: (2025)
T$^2$-RAGBench: Text-and-Table Benchmark for Evaluating Retrieval-Augmented Generation
por: Strich, Jan, et al.
Publicado: (2025)
por: Strich, Jan, et al.
Publicado: (2025)
Evaluation of Attribution Bias in Generator-Aware Retrieval-Augmented Large Language Models
por: Abolghasemi, Amin, et al.
Publicado: (2024)
por: Abolghasemi, Amin, et al.
Publicado: (2024)
After Retrieval, Before Generation: Enhancing the Trustworthiness of Large Language Models in Retrieval-Augmented Generation
por: Dai, Xinbang, et al.
Publicado: (2025)
por: Dai, Xinbang, et al.
Publicado: (2025)
Benchmarking Retrieval-Augmented Generation for Medicine
por: Xiong, Guangzhi, et al.
Publicado: (2024)
por: Xiong, Guangzhi, et al.
Publicado: (2024)
Benchmarking Generation and Evaluation Capabilities of Large Language Models for Instruction Controllable Summarization
por: Liu, Yixin, et al.
Publicado: (2023)
por: Liu, Yixin, et al.
Publicado: (2023)
TritonBench: Benchmarking Large Language Model Capabilities for Generating Triton Operators
por: Li, Jianling, et al.
Publicado: (2025)
por: Li, Jianling, et al.
Publicado: (2025)
Embedding-Informed Adaptive Retrieval-Augmented Generation of Large Language Models
por: Huang, Chengkai, et al.
Publicado: (2024)
por: Huang, Chengkai, et al.
Publicado: (2024)
Coordinated Semantic Alignment and Evidence Constraints for Retrieval-Augmented Generation with Large Language Models
por: Chen, Xin, et al.
Publicado: (2026)
por: Chen, Xin, et al.
Publicado: (2026)
Enhancing Pancreatic Cancer Staging with Large Language Models: The Role of Retrieval-Augmented Generation
por: Johno, Hisashi, et al.
Publicado: (2025)
por: Johno, Hisashi, et al.
Publicado: (2025)
Retrieval Augmented Generation Evaluation in the Era of Large Language Models: A Comprehensive Survey
por: Gan, Aoran, et al.
Publicado: (2025)
por: Gan, Aoran, et al.
Publicado: (2025)
Evaluating the Generation Capabilities of Large Chinese Language Models
por: Zeng, Hui, et al.
Publicado: (2023)
por: Zeng, Hui, et al.
Publicado: (2023)
Advancing Retrieval-Augmented Generation for Persian: Development of Language Models, Comprehensive Benchmarks, and Best Practices for Optimization
por: Hosseinbeigi, Sara Bourbour, et al.
Publicado: (2025)
por: Hosseinbeigi, Sara Bourbour, et al.
Publicado: (2025)
Explainable Biomedical Hypothesis Generation via Retrieval Augmented Generation enabled Large Language Models
por: Pelletier, Alexander R., et al.
Publicado: (2024)
por: Pelletier, Alexander R., et al.
Publicado: (2024)
Deploying Large Language Models With Retrieval Augmented Generation
por: Prabhune, Sonal, et al.
Publicado: (2024)
por: Prabhune, Sonal, et al.
Publicado: (2024)
Comparison of Text-Based and Image-Based Retrieval in Multimodal Retrieval Augmented Generation Large Language Model Systems
por: Lumer, Elias, et al.
Publicado: (2025)
por: Lumer, Elias, et al.
Publicado: (2025)
Multimodal Retrieval-Augmented Generation with Large Language Models for Medical VQA
por: Karim, A H M Rezaul, et al.
Publicado: (2025)
por: Karim, A H M Rezaul, et al.
Publicado: (2025)
Contextual Compression in Retrieval-Augmented Generation for Large Language Models: A Survey
por: Verma, Sourav
Publicado: (2024)
por: Verma, Sourav
Publicado: (2024)
Towards Trustworthy Retrieval Augmented Generation for Large Language Models: A Survey
por: Ni, Bo, et al.
Publicado: (2025)
por: Ni, Bo, et al.
Publicado: (2025)
Benchmarking Retrieval-Augmented Generation for Chemistry
por: Zhong, Xianrui, et al.
Publicado: (2025)
por: Zhong, Xianrui, et al.
Publicado: (2025)
Ejemplares similares
-
RAGBench: Explainable Benchmark for Retrieval-Augmented Generation Systems
por: Friel, Robert, et al.
Publicado: (2024) -
CanLegalRAGBench: Evaluating Retrieval-Augmented Generation on Canadian Case Law
por: Zhao, Ethan, et al.
Publicado: (2026) -
Mechanism of Task-oriented Information Removal in In-context Learning
por: Cho, Hakaze, et al.
Publicado: (2025) -
Rethinking Evaluation of Sparse Autoencoders through the Representation of Polysemous Words
por: Minegishi, Gouki, et al.
Publicado: (2025) -
Steering at the Source: Style Modulation Heads for Robust Persona Control
por: Izawa, Yoshihiro, et al.
Publicado: (2026)