Evaluation of Attribution Bias in Generator-Aware Retrieval-Augmented Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Abolghasemi, Amin, Azzopardi, Leif, Hashemi, Seyyed Hadi, de Rijke, Maarten, Verberne, Suzan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Measuring Bias in a Ranked List using Term-based Representations
par: Abolghasemi, Amin, et autres
Publié: (2024)
par: Abolghasemi, Amin, et autres
Publié: (2024)
CAUSE: Counterfactual Assessment of User Satisfaction Estimation in Task-Oriented Dialogue Systems
par: Abolghasemi, Amin, et autres
Publié: (2024)
par: Abolghasemi, Amin, et autres
Publié: (2024)
Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers
par: Shi, Zhengliang, et autres
Publié: (2025)
par: Shi, Zhengliang, et autres
Publié: (2025)
The Impact of Quantization on Retrieval-Augmented Generation: An Analysis of Small LLMs
par: Yazan, Mert, et autres
Publié: (2024)
par: Yazan, Mert, et autres
Publié: (2024)
PRISM: A Methodology for Auditing Biases in Large Language Models
par: Azzopardi, Leif, et autres
Publié: (2024)
par: Azzopardi, Leif, et autres
Publié: (2024)
Self-seeding and Multi-intent Self-instructing LLMs for Generating Intent-aware Information-Seeking dialogs
par: Askari, Arian, et autres
Publié: (2024)
par: Askari, Arian, et autres
Publié: (2024)
Undesirable Memorization in Large Language Models: A Survey
par: Satvaty, Ali, et autres
Publié: (2024)
par: Satvaty, Ali, et autres
Publié: (2024)
Generate then Refine: Data Augmentation for Zero-shot Intent Detection
par: Lin, I-Fan, et autres
Publié: (2024)
par: Lin, I-Fan, et autres
Publié: (2024)
SPILL: Domain-Adaptive Intent Clustering based on Selection and Pooling with Large Language Models
par: Lin, I-Fan, et autres
Publié: (2025)
par: Lin, I-Fan, et autres
Publié: (2025)
Dataset Creation for Visual Entailment using Generative AI
par: Reijtenbach, Rob, et autres
Publié: (2025)
par: Reijtenbach, Rob, et autres
Publié: (2025)
Controlled Retrieval-augmented Context Evaluation for Long-form RAG
par: Ju, Jia-Huei, et autres
Publié: (2025)
par: Ju, Jia-Huei, et autres
Publié: (2025)
Can We Use Large Language Models to Fill Relevance Judgment Holes?
par: Abbasiantaeb, Zahra, et autres
Publié: (2024)
par: Abbasiantaeb, Zahra, et autres
Publié: (2024)
Investigating the Robustness of Modelling Decisions for Few-Shot Cross-Topic Stance Detection: A Preregistered Study
par: Reuver, Myrthe, et autres
Publié: (2024)
par: Reuver, Myrthe, et autres
Publié: (2024)
Multi-Step Semantic Reasoning in Generative Retrieval
par: Dong, Steven, et autres
Publié: (2026)
par: Dong, Steven, et autres
Publié: (2026)
Cost-Aware Retrieval-Augmentation Reasoning Models with Adaptive Retrieval Depth
par: Hashemi, Helia, et autres
Publié: (2025)
par: Hashemi, Helia, et autres
Publié: (2025)
Biomedical Entity Linking for Dutch: Fine-tuning a Self-alignment BERT Model on an Automatically Generated Wikipedia Corpus
par: Hartendorp, Fons, et autres
Publié: (2024)
par: Hartendorp, Fons, et autres
Publié: (2024)
Talent or Luck? Evaluating Attribution Bias in Large Language Models
par: Raj, Chahat, et autres
Publié: (2025)
par: Raj, Chahat, et autres
Publié: (2025)
POW: Political Overton Windows of Large Language Models
par: Azzopardi, Leif, et autres
Publié: (2025)
par: Azzopardi, Leif, et autres
Publié: (2025)
Cognitive Biases in Large Language Models for News Recommendation
par: Lyu, Yougang, et autres
Publié: (2024)
par: Lyu, Yougang, et autres
Publié: (2024)
Multi-Step Reasoning with Large Language Models, a Survey
par: Plaat, Aske, et autres
Publié: (2024)
par: Plaat, Aske, et autres
Publié: (2024)
Improving RAG for Personalization with Author Features and Contrastive Examples
par: Yazan, Mert, et autres
Publié: (2025)
par: Yazan, Mert, et autres
Publié: (2025)
Generative Retrieval with Few-shot Indexing
par: Askari, Arian, et autres
Publié: (2024)
par: Askari, Arian, et autres
Publié: (2024)
LLMs Enable Bag-of-Texts Representations for Short-Text Clustering
par: Lin, I-Fan, et autres
Publié: (2025)
par: Lin, I-Fan, et autres
Publié: (2025)
LUMI: Unsupervised Intent Clustering with Multiple Pseudo-Labels
par: Lin, I-Fan, et autres
Publié: (2025)
par: Lin, I-Fan, et autres
Publié: (2025)
Correctness is not Faithfulness in RAG Attributions
par: Wallat, Jonas, et autres
Publié: (2024)
par: Wallat, Jonas, et autres
Publié: (2024)
Evaluating Self-Generated Documents for Enhancing Retrieval-Augmented Generation with Large Language Models
par: Li, Jiatao, et autres
Publié: (2024)
par: Li, Jiatao, et autres
Publié: (2024)
SubSearch: Intermediate Rewards for Unsupervised Guided Reasoning in Complex Retrieval
par: Petcu, Roxana, et autres
Publié: (2026)
par: Petcu, Roxana, et autres
Publié: (2026)
A Comprehensive Taxonomy of Negation for NLP and Neural Retrievers
par: Petcu, Roxana, et autres
Publié: (2025)
par: Petcu, Roxana, et autres
Publié: (2025)
Rethinking the Evaluation of Dialogue Systems: Effects of User Feedback on Crowdworkers and LLMs
par: Siro, Clemencia, et autres
Publié: (2024)
par: Siro, Clemencia, et autres
Publié: (2024)
Soft-prompt Tuning for Large Language Models to Evaluate Bias
par: Tian, Jacob-Junqi, et autres
Publié: (2023)
par: Tian, Jacob-Junqi, et autres
Publié: (2023)
Equipping Retrieval-Augmented Large Language Models with Document Structure Awareness
par: Xu, Lingnan, et autres
Publié: (2025)
par: Xu, Lingnan, et autres
Publié: (2025)
Privacy-Aware Decoding: Mitigating Privacy Leakage of Large Language Models in Retrieval-Augmented Generation
par: Wang, Haoran, et autres
Publié: (2025)
par: Wang, Haoran, et autres
Publié: (2025)
Retrieval Augmented Generation Evaluation in the Era of Large Language Models: A Comprehensive Survey
par: Gan, Aoran, et autres
Publié: (2025)
par: Gan, Aoran, et autres
Publié: (2025)
All Claims Are Equal, but Some Claims Are More Equal Than Others: Importance-Sensitive Factuality Evaluation of LLM Generations
par: Wanner, Miriam, et autres
Publié: (2025)
par: Wanner, Miriam, et autres
Publié: (2025)
Self-Adaptive Cognitive Debiasing for Large Language Models in Decision-Making
par: Lyu, Yougang, et autres
Publié: (2025)
par: Lyu, Yougang, et autres
Publié: (2025)
DeIDClinic: A Risk-Aware Pseudonymization Framework for Clinical Text De-identification and Re-identification Risk Assessment
par: Paul, Angel, et autres
Publié: (2024)
par: Paul, Angel, et autres
Publié: (2024)
Query Performance Prediction using Relevance Judgments Generated by Large Language Models
par: Meng, Chuan, et autres
Publié: (2024)
par: Meng, Chuan, et autres
Publié: (2024)
RARE: Retrieval-Aware Robustness Evaluation for Retrieval-Augmented Generation Systems
par: Zeng, Yixiao, et autres
Publié: (2025)
par: Zeng, Yixiao, et autres
Publié: (2025)
Context Does Matter: Implications for Crowdsourced Evaluation Labels in Task-Oriented Dialogue Systems
par: Siro, Clemencia, et autres
Publié: (2024)
par: Siro, Clemencia, et autres
Publié: (2024)
A Parametric Memory Head for Continual Generative Retrieval
par: Mekonnen, Kidist Amde, et autres
Publié: (2026)
par: Mekonnen, Kidist Amde, et autres
Publié: (2026)
Documents similaires
-
Measuring Bias in a Ranked List using Term-based Representations
par: Abolghasemi, Amin, et autres
Publié: (2024) -
CAUSE: Counterfactual Assessment of User Satisfaction Estimation in Task-Oriented Dialogue Systems
par: Abolghasemi, Amin, et autres
Publié: (2024) -
Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers
par: Shi, Zhengliang, et autres
Publié: (2025) -
The Impact of Quantization on Retrieval-Augmented Generation: An Analysis of Small LLMs
par: Yazan, Mert, et autres
Publié: (2024) -
PRISM: A Methodology for Auditing Biases in Large Language Models
par: Azzopardi, Leif, et autres
Publié: (2024)