Mitigating the Threshold Priming Effect in Large Language Model-Based Relevance Judgments via Personality Infusing
Fuente:
arXiv
Saved in:
| Main Authors: | Chen, Nuo, Fang, Hanpei, Liu, Jiqun, Wei, Wilson, Sakai, Tetsuya, Wu, Xiao-Ming |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Judging with Personality and Confidence: A Study on Personality-Conditioned LLM Relevance Assessment
by: Chen, Nuo, et al.
Published: (2026)
by: Chen, Nuo, et al.
Published: (2026)
Decoy Effect In Search Interaction: Understanding User Behavior and Measuring System Vulnerability
by: Chen, Nuo, et al.
Published: (2024)
by: Chen, Nuo, et al.
Published: (2024)
Do Large Language Models Favor Recent Content? A Study on Recency Bias in LLM-Based Reranking
by: Fang, Hanpei, et al.
Published: (2025)
by: Fang, Hanpei, et al.
Published: (2025)
Decoy Effect in Search Interaction: A Pilot Study
by: Chen, Nuo, et al.
Published: (2023)
by: Chen, Nuo, et al.
Published: (2023)
Plans for Evaluating Structured Generative Search Summaries
by: Sakai, Tetsuya, et al.
Published: (2026)
by: Sakai, Tetsuya, et al.
Published: (2026)
TRUE: A Reproducible Framework for LLM-Driven Relevance Judgment in Information Retrieval
by: Dewan, Mouly, et al.
Published: (2025)
by: Dewan, Mouly, et al.
Published: (2025)
Exploring Large Language Models for Relevance Judgments in Tetun
by: de Jesus, Gabriel, et al.
Published: (2024)
by: de Jesus, Gabriel, et al.
Published: (2024)
LLM-Driven Usefulness Judgment for Web Search Evaluation
by: Dewan, Mouly, et al.
Published: (2025)
by: Dewan, Mouly, et al.
Published: (2025)
AI Can Be Cognitively Biased: An Exploratory Study on Threshold Priming in LLM-Based Batch Relevance Assessment
by: Chen, Nuo, et al.
Published: (2024)
by: Chen, Nuo, et al.
Published: (2024)
LLMJudge: LLMs for Relevance Judgments
by: Rahmani, Hossein A., et al.
Published: (2024)
by: Rahmani, Hossein A., et al.
Published: (2024)
Vector Quantization for Recommender Systems: A Review and Outlook
by: Liu, Qijiong, et al.
Published: (2024)
by: Liu, Qijiong, et al.
Published: (2024)
Leveraging Large Language Models for Relevance Judgments in Legal Case Retrieval
by: Ma, Shengjie, et al.
Published: (2024)
by: Ma, Shengjie, et al.
Published: (2024)
The Effect of Document Summarization on LLM-Based Relevance Judgments
by: Mohtadi, Samaneh, et al.
Published: (2025)
by: Mohtadi, Samaneh, et al.
Published: (2025)
Task Supportive and Personalized Human-Large Language Model Interaction: A User Study
by: Wang, Ben, et al.
Published: (2024)
by: Wang, Ben, et al.
Published: (2024)
Can We Use Large Language Models to Fill Relevance Judgment Holes?
by: Abbasiantaeb, Zahra, et al.
Published: (2024)
by: Abbasiantaeb, Zahra, et al.
Published: (2024)
Don't Use LLMs to Make Relevance Judgments
by: Soboroff, Ian
Published: (2024)
by: Soboroff, Ian
Published: (2024)
Formalized Information Needs Improve Large-Language-Model Relevance Judgments
by: Keller, Jüri, et al.
Published: (2026)
by: Keller, Jüri, et al.
Published: (2026)
Multimodal Item Scoring for Natural Language Recommendation via Gaussian Process Regression with LLM Relevance Judgments
by: Liu, Yifan, et al.
Published: (2025)
by: Liu, Yifan, et al.
Published: (2025)
Evaluating Conversational Recommender Systems via Large Language Models: A User-Centric Framework
by: Chen, Nuo, et al.
Published: (2025)
by: Chen, Nuo, et al.
Published: (2025)
Variations in Relevance Judgments and the Shelf Life of Test Collections
by: Parry, Andrew, et al.
Published: (2025)
by: Parry, Andrew, et al.
Published: (2025)
JudgeBlender: Ensembling Judgments for Automatic Relevance Assessment
by: Rahmani, Hossein A., et al.
Published: (2024)
by: Rahmani, Hossein A., et al.
Published: (2024)
LLMs Can Patch Up Missing Relevance Judgments in Evaluation
by: Upadhyay, Shivani, et al.
Published: (2024)
by: Upadhyay, Shivani, et al.
Published: (2024)
An Exam-based Evaluation Approach Beyond Traditional Relevance Judgments
by: Farzi, Naghmeh, et al.
Published: (2024)
by: Farzi, Naghmeh, et al.
Published: (2024)
Are Large Language Models Good at Utility Judgments?
by: Zhang, Hengran, et al.
Published: (2024)
by: Zhang, Hengran, et al.
Published: (2024)
Benchmarking LLM-based Relevance Judgment Methods
by: Arabzadeh, Negar, et al.
Published: (2025)
by: Arabzadeh, Negar, et al.
Published: (2025)
Leveraging Large Language Models to Enhance Personalized Recommendations in E-commerce
by: Xu, Wei, et al.
Published: (2024)
by: Xu, Wei, et al.
Published: (2024)
A Study of Relevance Judgments.
by: Cuadra, Carlos A.
Published: (1968)
by: Cuadra, Carlos A.
Published: (1968)
Impact of Shallow vs. Deep Relevance Judgments on BERT-based Reranking Models
by: Iturra-Bocaz, Gabriel, et al.
Published: (2025)
by: Iturra-Bocaz, Gabriel, et al.
Published: (2025)
Large Language Models for Relevance Judgment in Product Search
by: Mehrdad, Navid, et al.
Published: (2024)
by: Mehrdad, Navid, et al.
Published: (2024)
Criteria-Based LLM Relevance Judgments
by: Farzi, Naghmeh, et al.
Published: (2025)
by: Farzi, Naghmeh, et al.
Published: (2025)
Aligning Query Representation with Rewritten Query and Relevance Judgments in Conversational Search
by: Mo, Fengran, et al.
Published: (2024)
by: Mo, Fengran, et al.
Published: (2024)
Beyond Relevance: An Adaptive Exploration-Based Framework for Personalized Recommendations
by: Bianchi, Edoardo
Published: (2025)
by: Bianchi, Edoardo
Published: (2025)
The Overlooked Role of Graded Relevance Thresholds in Multilingual Dense Retrieval
by: Wullach, Tomer, et al.
Published: (2026)
by: Wullach, Tomer, et al.
Published: (2026)
A Human-AI Comparative Analysis of Prompt Sensitivity in LLM-Based Relevance Judgment
by: Arabzadeh, Negar, et al.
Published: (2025)
by: Arabzadeh, Negar, et al.
Published: (2025)
Query-driven Relevant Paragraph Extraction from Legal Judgments
by: Santosh, T. Y. S. S, et al.
Published: (2024)
by: Santosh, T. Y. S. S, et al.
Published: (2024)
LUCid: Redefining Relevance For Lifelong Personalization
by: Okite, Chimaobi, et al.
Published: (2026)
by: Okite, Chimaobi, et al.
Published: (2026)
LLM-Driven Usefulness Labeling for IR Evaluation
by: Dewan, Mouly, et al.
Published: (2025)
by: Dewan, Mouly, et al.
Published: (2025)
LLM-Assisted Relevance Assessments: When Should We Ask LLMs for Help?
by: Takehi, Rikiya, et al.
Published: (2024)
by: Takehi, Rikiya, et al.
Published: (2024)
Finetuning Large Language Model for Personalized Ranking
by: Bai, Zhuoxi, et al.
Published: (2024)
by: Bai, Zhuoxi, et al.
Published: (2024)
Accelerating Generative Recommendation via Simple Categorical User Sequence Compression
by: Liu, Qijiong, et al.
Published: (2026)
by: Liu, Qijiong, et al.
Published: (2026)
Similar Items
-
Judging with Personality and Confidence: A Study on Personality-Conditioned LLM Relevance Assessment
by: Chen, Nuo, et al.
Published: (2026) -
Decoy Effect In Search Interaction: Understanding User Behavior and Measuring System Vulnerability
by: Chen, Nuo, et al.
Published: (2024) -
Do Large Language Models Favor Recent Content? A Study on Recency Bias in LLM-Based Reranking
by: Fang, Hanpei, et al.
Published: (2025) -
Decoy Effect in Search Interaction: A Pilot Study
by: Chen, Nuo, et al.
Published: (2023) -
Plans for Evaluating Structured Generative Search Summaries
by: Sakai, Tetsuya, et al.
Published: (2026)