ExPerT: Effective and Explainable Evaluation of Personalized Long-Form Text Generation
Fuente:
arXiv
Saved in:
| Main Authors: | Salemi, Alireza, Killingback, Julian, Zamani, Hamed |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Benchmarking Information Retrieval Models on Complex Retrieval Tasks
by: Killingback, Julian, et al.
Published: (2025)
by: Killingback, Julian, et al.
Published: (2025)
Learning from Natural Language Feedback for Personalized Question Answering
by: Salemi, Alireza, et al.
Published: (2025)
by: Salemi, Alireza, et al.
Published: (2025)
Improving User Privacy in Personalized Generation: Client-Side Retrieval-Augmented Modification of Server-Side Generated Speculations
by: Salemi, Alireza, et al.
Published: (2026)
by: Salemi, Alireza, et al.
Published: (2026)
Reasoning-Enhanced Self-Training for Long-Form Personalized Text Generation
by: Salemi, Alireza, et al.
Published: (2025)
by: Salemi, Alireza, et al.
Published: (2025)
Learning to Reason for Multi-Step Retrieval of Personal Context in Personalized Question Answering
by: Amirizaniani, Maryam, et al.
Published: (2026)
by: Amirizaniani, Maryam, et al.
Published: (2026)
Evaluating Retrieval Quality in Retrieval-Augmented Generation
by: Salemi, Alireza, et al.
Published: (2024)
by: Salemi, Alireza, et al.
Published: (2024)
LaMP-QA: A Benchmark for Personalized Long-form Question Answering
by: Salemi, Alireza, et al.
Published: (2025)
by: Salemi, Alireza, et al.
Published: (2025)
Beyond a Million Tokens: Benchmarking and Enhancing Long-Term Memory in LLMs
by: Tavakoli, Mohammad, et al.
Published: (2025)
by: Tavakoli, Mohammad, et al.
Published: (2025)
Optimization Methods for Personalizing Large Language Models through Retrieval Augmentation
by: Salemi, Alireza, et al.
Published: (2024)
by: Salemi, Alireza, et al.
Published: (2024)
Towards a Search Engine for Machines: Unified Ranking for Multiple Retrieval-Augmented Large Language Models
by: Salemi, Alireza, et al.
Published: (2024)
by: Salemi, Alireza, et al.
Published: (2024)
Learning to Rank for Multiple Retrieval-Augmented Models through Iterative Utility Maximization
by: Salemi, Alireza, et al.
Published: (2024)
by: Salemi, Alireza, et al.
Published: (2024)
Pathways of Thoughts: Multi-Directional Thinking for Long-form Personalized Question Answering
by: Salemi, Alireza, et al.
Published: (2025)
by: Salemi, Alireza, et al.
Published: (2025)
Plan-and-Refine: Diverse and Comprehensive Retrieval-Augmented Generation
by: Salemi, Alireza, et al.
Published: (2025)
by: Salemi, Alireza, et al.
Published: (2025)
CIIR@LiveRAG 2025: Optimizing Multi-Agent Retrieval Augmented Generation through Self-Training
by: Salemi, Alireza, et al.
Published: (2025)
by: Salemi, Alireza, et al.
Published: (2025)
Evaluation of Agents under Simulated AI Marketplace Dynamics
by: Kim, To Eun, et al.
Published: (2026)
by: Kim, To Eun, et al.
Published: (2026)
Critic-R: Improving Agentic Search using Instruction-tuned Retrievers with Natural Language Introspective Feedback
by: Alam, Md Zarif Ul, et al.
Published: (2026)
by: Alam, Md Zarif Ul, et al.
Published: (2026)
Accelerating Retrieval-Augmented Generation
by: Quinn, Derrick, et al.
Published: (2024)
by: Quinn, Derrick, et al.
Published: (2024)
PerLTQA: A Personal Long-Term Memory Dataset for Memory Classification, Retrieval, and Synthesis in Question Answering
by: Du, Yiming, et al.
Published: (2024)
by: Du, Yiming, et al.
Published: (2024)
LLM-Based Multi-Agent Blackboard System for Information Discovery in Data Science
by: Salemi, Alireza, et al.
Published: (2025)
by: Salemi, Alireza, et al.
Published: (2025)
Evaluating Structured Decoding for Text-to-Table Generation: Evidence from Three Datasets
by: Oestreich, Julian, et al.
Published: (2025)
by: Oestreich, Julian, et al.
Published: (2025)
LongRecall: A Structured Approach for Robust Recall Evaluation in Long-Form Text
by: Ardestani, MohamamdJavad, et al.
Published: (2025)
by: Ardestani, MohamamdJavad, et al.
Published: (2025)
Scaling Sparse and Dense Retrieval in Decoder-Only LLMs
by: Zeng, Hansi, et al.
Published: (2025)
by: Zeng, Hansi, et al.
Published: (2025)
CoSearch: Joint Training of Reasoning and Document Ranking via Reinforcement Learning for Agentic Search
by: Zeng, Hansi, et al.
Published: (2026)
by: Zeng, Hansi, et al.
Published: (2026)
Disentangling Likes and Dislikes in Personalized Generative Explainable Recommendation
by: Shimizu, Ryotaro, et al.
Published: (2024)
by: Shimizu, Ryotaro, et al.
Published: (2024)
Retrieval-Enhanced Machine Learning: Synthesis and Opportunities
by: Kim, To Eun, et al.
Published: (2024)
by: Kim, To Eun, et al.
Published: (2024)
Deep-Reporter: Deep Research for Grounded Multimodal Long-Form Generation
by: Ye, Fangda, et al.
Published: (2026)
by: Ye, Fangda, et al.
Published: (2026)
Pctx: Tokenizing Personalized Context for Generative Recommendation
by: Zhong, Qiyong, et al.
Published: (2025)
by: Zhong, Qiyong, et al.
Published: (2025)
Explainability of Text Processing and Retrieval Methods: A Survey
by: Saha, Sourav, et al.
Published: (2022)
by: Saha, Sourav, et al.
Published: (2022)
Hypencoder: Hypernetworks for Information Retrieval
by: Killingback, Julian, et al.
Published: (2025)
by: Killingback, Julian, et al.
Published: (2025)
Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning
by: Jin, Bowen, et al.
Published: (2025)
by: Jin, Bowen, et al.
Published: (2025)
CLEF HIPE-2026: Evaluating Accurate and Efficient Person-Place Relation Extraction from Multilingual Historical Texts
by: Opitz, Juri, et al.
Published: (2026)
by: Opitz, Juri, et al.
Published: (2026)
Towards Personalized Deep Research: Benchmarks and Evaluations
by: Liang, Yuan, et al.
Published: (2025)
by: Liang, Yuan, et al.
Published: (2025)
Evaluating Large Language Models as Generative User Simulators for Conversational Recommendation
by: Yoon, Se-eun, et al.
Published: (2024)
by: Yoon, Se-eun, et al.
Published: (2024)
Use of Retrieval-Augmented Large Language Model Agent for Long-Form COVID-19 Fact-Checking
by: Huang, Jingyi, et al.
Published: (2025)
by: Huang, Jingyi, et al.
Published: (2025)
Open-Source Reproduction and Explainability Analysis of Corrective Retrieval Augmented Generation
by: Yalavarthi, Surya Vardhan
Published: (2026)
by: Yalavarthi, Surya Vardhan
Published: (2026)
LFQA-HP-1M: A Large-Scale Human Preference Dataset for Long-Form Question Answering
by: Jahan, Rafid Ishrak, et al.
Published: (2026)
by: Jahan, Rafid Ishrak, et al.
Published: (2026)
A Unified Model and Document Representation for On-Device Retrieval-Augmented Generation
by: Killingback, Julian, et al.
Published: (2026)
by: Killingback, Julian, et al.
Published: (2026)
StructText: A Synthetic Table-to-Text Approach for Benchmark Generation with Multi-Dimensional Evaluation
by: Kashyap, Satyananda, et al.
Published: (2025)
by: Kashyap, Satyananda, et al.
Published: (2025)
PMG : Personalized Multimodal Generation with Large Language Models
by: Shen, Xiaoteng, et al.
Published: (2024)
by: Shen, Xiaoteng, et al.
Published: (2024)
E2Rank: Your Text Embedding can Also be an Effective and Efficient Listwise Reranker
by: Liu, Qi, et al.
Published: (2025)
by: Liu, Qi, et al.
Published: (2025)
Similar Items
-
Benchmarking Information Retrieval Models on Complex Retrieval Tasks
by: Killingback, Julian, et al.
Published: (2025) -
Learning from Natural Language Feedback for Personalized Question Answering
by: Salemi, Alireza, et al.
Published: (2025) -
Improving User Privacy in Personalized Generation: Client-Side Retrieval-Augmented Modification of Server-Side Generated Speculations
by: Salemi, Alireza, et al.
Published: (2026) -
Reasoning-Enhanced Self-Training for Long-Form Personalized Text Generation
by: Salemi, Alireza, et al.
Published: (2025) -
Learning to Reason for Multi-Step Retrieval of Personal Context in Personalized Question Answering
by: Amirizaniani, Maryam, et al.
Published: (2026)