Large Language Models for Stemming: Promises, Pitfalls and Failures
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Shuai, Zhuang, Shengyao, Zuccon, Guido |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Zero-shot Generative Large Language Models for Systematic Review Screening Automation
par: Wang, Shuai, et autres
Publié: (2024)
par: Wang, Shuai, et autres
Publié: (2024)
2D Matryoshka Training for Information Retrieval
par: Wang, Shuai, et autres
Publié: (2024)
par: Wang, Shuai, et autres
Publié: (2024)
An Investigation of Prompt Variations for Zero-shot LLM-based Rankers
par: Sun, Shuoqi, et autres
Publié: (2024)
par: Sun, Shuoqi, et autres
Publié: (2024)
FeB4RAG: Evaluating Federated Search in the Context of Retrieval Augmented Generation
par: Wang, Shuai, et autres
Publié: (2024)
par: Wang, Shuai, et autres
Publié: (2024)
Understanding and Mitigating the Threat of Vec2Text to Dense Retrieval Systems
par: Zhuang, Shengyao, et autres
Publié: (2024)
par: Zhuang, Shengyao, et autres
Publié: (2024)
Reassessing Large Language Model Boolean Query Generation for Systematic Reviews
par: Wang, Shuai, et autres
Publié: (2025)
par: Wang, Shuai, et autres
Publié: (2025)
ReSLLM: Large Language Models are Strong Resource Selectors for Federated Search
par: Wang, Shuai, et autres
Publié: (2024)
par: Wang, Shuai, et autres
Publié: (2024)
Rank-R1: Enhancing Reasoning in LLM-based Document Rerankers via Reinforcement Learning
par: Zhuang, Shengyao, et autres
Publié: (2025)
par: Zhuang, Shengyao, et autres
Publié: (2025)
Team IELAB at TREC Clinical Trial Track 2023: Enhancing Clinical Trial Retrieval with Neural Rankers and Large Language Models
par: Zhuang, Shengyao, et autres
Publié: (2024)
par: Zhuang, Shengyao, et autres
Publié: (2024)
Pre-training vs. Fine-tuning: A Reproducibility Study on Dense Retrieval Knowledge Acquisition
par: Yao, Zheng, et autres
Publié: (2025)
par: Yao, Zheng, et autres
Publié: (2025)
A Setwise Approach for Effective and Highly Efficient Zero-shot Ranking with Large Language Models
par: Zhuang, Shengyao, et autres
Publié: (2023)
par: Zhuang, Shengyao, et autres
Publié: (2023)
LLM-VPRF: Large Language Model Based Vector Pseudo Relevance Feedback
par: Li, Hang, et autres
Publié: (2025)
par: Li, Hang, et autres
Publié: (2025)
Does Vec2Text Pose a New Corpus Poisoning Threat?
par: Zhuang, Shengyao, et autres
Publié: (2024)
par: Zhuang, Shengyao, et autres
Publié: (2024)
PromptReps: Prompting Large Language Models to Generate Dense and Sparse Representations for Zero-Shot Document Retrieval
par: Zhuang, Shengyao, et autres
Publié: (2024)
par: Zhuang, Shengyao, et autres
Publié: (2024)
Starbucks-v2: Improved Training for 2D Matryoshka Embeddings
par: Zhuang, Shengyao, et autres
Publié: (2024)
par: Zhuang, Shengyao, et autres
Publié: (2024)
Leveraging LLMs for Unsupervised Dense Retriever Ranking
par: Khramtsova, Ekaterina, et autres
Publié: (2024)
par: Khramtsova, Ekaterina, et autres
Publié: (2024)
Dense Retrieval with Continuous Explicit Feedback for Systematic Review Screening Prioritisation
par: Mao, Xinyu, et autres
Publié: (2024)
par: Mao, Xinyu, et autres
Publié: (2024)
Inferential Question Answering
par: Mozafari, Jamshid, et autres
Publié: (2026)
par: Mozafari, Jamshid, et autres
Publié: (2026)
Embark on DenseQuest: A System for Selecting the Best Dense Retriever for a Custom Collection
par: Khramtsova, Ekaterina, et autres
Publié: (2024)
par: Khramtsova, Ekaterina, et autres
Publié: (2024)
Distillation versus Contrastive Learning: How to Train Your Rerankers
par: Xu, Zhichao, et autres
Publié: (2025)
par: Xu, Zhichao, et autres
Publié: (2025)
VISA: Retrieval Augmented Generation with Visual Source Attribution
par: Ma, Xueguang, et autres
Publié: (2024)
par: Ma, Xueguang, et autres
Publié: (2024)
Document Screenshot Retrievers are Vulnerable to Pixel Poisoning Attacks
par: Zhuang, Shengyao, et autres
Publié: (2025)
par: Zhuang, Shengyao, et autres
Publié: (2025)
Where Relevance Emerges: A Layer-Wise Study of Internal Attention for Zero-Shot Re-Ranking
par: Chen, Haodong, et autres
Publié: (2026)
par: Chen, Haodong, et autres
Publié: (2026)
Evaluating Generative Ad Hoc Information Retrieval
par: Gienapp, Lukas, et autres
Publié: (2023)
par: Gienapp, Lukas, et autres
Publié: (2023)
On the impact of retrieved content representations in RAG Pipelines
par: Ross, Jonathan J, et autres
Publié: (2026)
par: Ross, Jonathan J, et autres
Publié: (2026)
LACONIC: Dense-Level Effectiveness for Scalable Sparse Retrieval via a Two-Phase Training Curriculum
par: Xu, Zhichao, et autres
Publié: (2026)
par: Xu, Zhichao, et autres
Publié: (2026)
Rethinking On-policy Optimization for Query Augmentation
par: Xu, Zhichao, et autres
Publié: (2025)
par: Xu, Zhichao, et autres
Publié: (2025)
Enhance Graph Alignment for Large Language Models
par: Luo, Haitong, et autres
Publié: (2024)
par: Luo, Haitong, et autres
Publié: (2024)
Hallucination Detection and Evaluation of Large Language Model
par: Zhang, Chenggong, et autres
Publié: (2025)
par: Zhang, Chenggong, et autres
Publié: (2025)
Beyond Chunk-Then-Embed: A Comprehensive Taxonomy and Evaluation of Document Chunking Strategies for Information Retrieval
par: Zhou, Yongjie, et autres
Publié: (2026)
par: Zhou, Yongjie, et autres
Publié: (2026)
AutoBool: An Reinforcement-Learning trained LLM for Effective Automated Boolean Query Generation for Systematic Reviews
par: Wang, Shuai, et autres
Publié: (2025)
par: Wang, Shuai, et autres
Publié: (2025)
Improving Text Embeddings with Large Language Models
par: Wang, Liang, et autres
Publié: (2023)
par: Wang, Liang, et autres
Publié: (2023)
Learning to Retrieve In-Context Examples for Large Language Models
par: Wang, Liang, et autres
Publié: (2023)
par: Wang, Liang, et autres
Publié: (2023)
Large Language Models as Evaluators for Recommendation Explanations
par: Zhang, Xiaoyu, et autres
Publié: (2024)
par: Zhang, Xiaoyu, et autres
Publié: (2024)
Self-Calibrated Listwise Reranking with Large Language Models
par: Ren, Ruiyang, et autres
Publié: (2024)
par: Ren, Ruiyang, et autres
Publié: (2024)
The Pitfalls of Growing Group Complexity: LLMs and Social Choice-Based Aggregation for Group Recommendations
par: Waterschoot, Cedric, et autres
Publié: (2025)
par: Waterschoot, Cedric, et autres
Publié: (2025)
Rethinking the Evaluation for Conversational Recommendation in the Era of Large Language Models
par: Wang, Xiaolei, et autres
Publié: (2023)
par: Wang, Xiaolei, et autres
Publié: (2023)
Leveraging Passage Embeddings for Efficient Listwise Reranking with Large Language Models
par: Liu, Qi, et autres
Publié: (2024)
par: Liu, Qi, et autres
Publié: (2024)
Mitigating Entity-Level Hallucination in Large Language Models
par: Su, Weihang, et autres
Publié: (2024)
par: Su, Weihang, et autres
Publié: (2024)
Can Large Language Models Detect Rumors on Social Media?
par: Liu, Qiang, et autres
Publié: (2024)
par: Liu, Qiang, et autres
Publié: (2024)
Documents similaires
-
Zero-shot Generative Large Language Models for Systematic Review Screening Automation
par: Wang, Shuai, et autres
Publié: (2024) -
2D Matryoshka Training for Information Retrieval
par: Wang, Shuai, et autres
Publié: (2024) -
An Investigation of Prompt Variations for Zero-shot LLM-based Rankers
par: Sun, Shuoqi, et autres
Publié: (2024) -
FeB4RAG: Evaluating Federated Search in the Context of Retrieval Augmented Generation
par: Wang, Shuai, et autres
Publié: (2024) -
Understanding and Mitigating the Threat of Vec2Text to Dense Retrieval Systems
par: Zhuang, Shengyao, et autres
Publié: (2024)