Towards Fine-Grained Citation Evaluation in Generated Text: A Comparative Analysis of Faithfulness Metrics
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Weijia, Aliannejadi, Mohammad, Yuan, Yifei, Pei, Jiahuan, Huang, Jia-Hong, Kanoulas, Evangelos |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Comparative Analysis of Faithfulness Metrics and Humans in Citation Evaluation
di: Zhang, Weijia, et al.
Pubblicazione: (2024)
di: Zhang, Weijia, et al.
Pubblicazione: (2024)
ChatR1: Reinforcement Learning for Conversational Reasoning and Retrieval Augmented Question Answering
di: Lupart, Simon, et al.
Pubblicazione: (2025)
di: Lupart, Simon, et al.
Pubblicazione: (2025)
DiSCo: LLM Knowledge Distillation for Efficient Sparse Retrieval in Conversational Search
di: Lupart, Simon, et al.
Pubblicazione: (2024)
di: Lupart, Simon, et al.
Pubblicazione: (2024)
A Novel Evaluation Framework for Image2Text Generation
di: Huang, Jia-Hong, et al.
Pubblicazione: (2024)
di: Huang, Jia-Hong, et al.
Pubblicazione: (2024)
Beyond Relevant Documents: A Knowledge-Intensive Approach for Query-Focused Summarization using Large Language Models
di: Zhang, Weijia, et al.
Pubblicazione: (2024)
di: Zhang, Weijia, et al.
Pubblicazione: (2024)
Improving the Robustness of Dense Retrievers Against Typos via Multi-Positive Contrastive Learning
di: Sidiropoulos, Georgios, et al.
Pubblicazione: (2024)
di: Sidiropoulos, Georgios, et al.
Pubblicazione: (2024)
Why Uncertainty Estimation Methods Fall Short in RAG: An Axiomatic Analysis
di: Soudani, Heydar, et al.
Pubblicazione: (2025)
di: Soudani, Heydar, et al.
Pubblicazione: (2025)
AGENT-CQ: Automatic Generation and Evaluation of Clarifying Questions for Conversational Search with LLMs
di: Siro, Clemencia, et al.
Pubblicazione: (2024)
di: Siro, Clemencia, et al.
Pubblicazione: (2024)
Corpus-informed Retrieval Augmented Generation of Clarifying Questions
di: Krasakis, Antonios Minas, et al.
Pubblicazione: (2024)
di: Krasakis, Antonios Minas, et al.
Pubblicazione: (2024)
Generative Retrieval with Few-shot Indexing
di: Askari, Arian, et al.
Pubblicazione: (2024)
di: Askari, Arian, et al.
Pubblicazione: (2024)
A Multimodal Dense Retrieval Approach for Speech-Based Open-Domain Question Answering
di: Sidiropoulos, Georgios, et al.
Pubblicazione: (2024)
di: Sidiropoulos, Georgios, et al.
Pubblicazione: (2024)
Repeat-bias-aware Optimization of Beyond-accuracy Metrics for Next Basket Recommendation
di: Liu, Yuanna, et al.
Pubblicazione: (2025)
di: Liu, Yuanna, et al.
Pubblicazione: (2025)
Interactions with Generative Information Retrieval Systems
di: Aliannejadi, Mohammad, et al.
Pubblicazione: (2024)
di: Aliannejadi, Mohammad, et al.
Pubblicazione: (2024)
Generating Multi-Aspect Queries for Conversational Search
di: Abbasiantaeb, Zahra, et al.
Pubblicazione: (2024)
di: Abbasiantaeb, Zahra, et al.
Pubblicazione: (2024)
Constructing Set-Compositional and Negated Representations for First-Stage Ranking
di: Krasakis, Antonios Minas, et al.
Pubblicazione: (2025)
di: Krasakis, Antonios Minas, et al.
Pubblicazione: (2025)
Reproducibility, Replicability, and Insights into Visual Document Retrieval with Late Interaction
di: Qiao, Jingfen, et al.
Pubblicazione: (2025)
di: Qiao, Jingfen, et al.
Pubblicazione: (2025)
On the Robustness of LLM-Based Dense Retrievers: A Systematic Analysis of Generalizability and Stability
di: Li, Yongkang, et al.
Pubblicazione: (2026)
di: Li, Yongkang, et al.
Pubblicazione: (2026)
Leveraging Decoder Architectures for Learned Sparse Retrieval
di: Qiao, Jingfen, et al.
Pubblicazione: (2025)
di: Qiao, Jingfen, et al.
Pubblicazione: (2025)
PSCon: Product Search Through Conversations
di: Zou, Jie, et al.
Pubblicazione: (2025)
di: Zou, Jie, et al.
Pubblicazione: (2025)
Data Augmentation for Conversational AI
di: Soudani, Heydar, et al.
Pubblicazione: (2023)
di: Soudani, Heydar, et al.
Pubblicazione: (2023)
Reproducing HotFlip for Corpus Poisoning Attacks in Dense Retrieval
di: Li, Yongkang, et al.
Pubblicazione: (2025)
di: Li, Yongkang, et al.
Pubblicazione: (2025)
Citation Structural Diversity: A Novel and Concise Metric Combining Structure and Semantics for Literature Evaluation
di: Kong, Mingyue, et al.
Pubblicazione: (2025)
di: Kong, Mingyue, et al.
Pubblicazione: (2025)
FineRef: Fine-Grained Error Reflection and Correction for Long-Form Generation with Citations
di: Peng, Yixing, et al.
Pubblicazione: (2025)
di: Peng, Yixing, et al.
Pubblicazione: (2025)
Analyzing Coherency in Facet-based Clarification Prompt Generation for Search
di: Litvinov, Oleg, et al.
Pubblicazione: (2024)
di: Litvinov, Oleg, et al.
Pubblicazione: (2024)
Rethinking the Evaluation of Dialogue Systems: Effects of User Feedback on Crowdworkers and LLMs
di: Siro, Clemencia, et al.
Pubblicazione: (2024)
di: Siro, Clemencia, et al.
Pubblicazione: (2024)
IRLab@iKAT24: Learned Sparse Retrieval with Multi-aspect LLM Query Generation for Conversational Search
di: Lupart, Simon, et al.
Pubblicazione: (2024)
di: Lupart, Simon, et al.
Pubblicazione: (2024)
Conversational Gold: Evaluating Personalized Conversational Search System using Gold Nuggets
di: Abbasiantaeb, Zahra, et al.
Pubblicazione: (2025)
di: Abbasiantaeb, Zahra, et al.
Pubblicazione: (2025)
A Survey on Recent Advances in Conversational Data Generation
di: Soudani, Heydar, et al.
Pubblicazione: (2024)
di: Soudani, Heydar, et al.
Pubblicazione: (2024)
Towards Fair Rankings: Leveraging LLMs for Gender Bias Detection and Measurement
di: Mousavian, Maryam, et al.
Pubblicazione: (2025)
di: Mousavian, Maryam, et al.
Pubblicazione: (2025)
Spectral Tempering for Embedding Compression in Dense Passage Retrieval
di: Li, Yongkang, et al.
Pubblicazione: (2026)
di: Li, Yongkang, et al.
Pubblicazione: (2026)
Unsupervised Corpus Poisoning Attacks in Continuous Space for Dense Retrieval
di: Li, Yongkang, et al.
Pubblicazione: (2025)
di: Li, Yongkang, et al.
Pubblicazione: (2025)
Knowledge-Enhanced Conversational Recommendation via Transformer-based Sequential Modelling
di: Zou, Jie, et al.
Pubblicazione: (2024)
di: Zou, Jie, et al.
Pubblicazione: (2024)
LLM-based Listwise Reranking under the Effect of Positional Bias
di: Qiao, Jingfen, et al.
Pubblicazione: (2026)
di: Qiao, Jingfen, et al.
Pubblicazione: (2026)
Total Recall QA: A Verifiable Evaluation Suite for Deep Research Agents
di: Rafiee, Mahta, et al.
Pubblicazione: (2026)
di: Rafiee, Mahta, et al.
Pubblicazione: (2026)
Improving the Reusability of Conversational Search Test Collections
di: Abbasiantaeb, Zahra, et al.
Pubblicazione: (2025)
di: Abbasiantaeb, Zahra, et al.
Pubblicazione: (2025)
A Comprehensive Taxonomy of Negation for NLP and Neural Retrievers
di: Petcu, Roxana, et al.
Pubblicazione: (2025)
di: Petcu, Roxana, et al.
Pubblicazione: (2025)
SubSearch: Intermediate Rewards for Unsupervised Guided Reasoning in Complex Retrieval
di: Petcu, Roxana, et al.
Pubblicazione: (2026)
di: Petcu, Roxana, et al.
Pubblicazione: (2026)
Learning to Ask: Conversational Product Search via Representation Learning
di: Zou, Jie, et al.
Pubblicazione: (2024)
di: Zou, Jie, et al.
Pubblicazione: (2024)
Do Images Clarify? A Study on the Effect of Images on Clarifying Questions in Conversational Search
di: Siro, Clemencia, et al.
Pubblicazione: (2026)
di: Siro, Clemencia, et al.
Pubblicazione: (2026)
Understanding Visual Saliency of Outlier Items in Product Search
di: Sarvi, Fatemeh, et al.
Pubblicazione: (2025)
di: Sarvi, Fatemeh, et al.
Pubblicazione: (2025)
Documenti analoghi
-
A Comparative Analysis of Faithfulness Metrics and Humans in Citation Evaluation
di: Zhang, Weijia, et al.
Pubblicazione: (2024) -
ChatR1: Reinforcement Learning for Conversational Reasoning and Retrieval Augmented Question Answering
di: Lupart, Simon, et al.
Pubblicazione: (2025) -
DiSCo: LLM Knowledge Distillation for Efficient Sparse Retrieval in Conversational Search
di: Lupart, Simon, et al.
Pubblicazione: (2024) -
A Novel Evaluation Framework for Image2Text Generation
di: Huang, Jia-Hong, et al.
Pubblicazione: (2024) -
Beyond Relevant Documents: A Knowledge-Intensive Approach for Query-Focused Summarization using Large Language Models
di: Zhang, Weijia, et al.
Pubblicazione: (2024)