Retrieval Capabilities of Large Language Models Scale with Pretraining FLOPs
Fuente:
arXiv
Saved in:
| Main Authors: | Portes, Jacob, Jennings, Connor, Yuen, Erica Ji, Doubov, Sasha, Carbin, Michael |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Scaling Laws for Online Advertisement Retrieval
by: Wang, Yunli, et al.
Published: (2024)
by: Wang, Yunli, et al.
Published: (2024)
Retrieval meets Long Context Large Language Models
by: Xu, Peng, et al.
Published: (2023)
by: Xu, Peng, et al.
Published: (2023)
Large Language Model Augmented Exercise Retrieval for Personalized Language Learning
by: Xu, Austin, et al.
Published: (2024)
by: Xu, Austin, et al.
Published: (2024)
Scaling Retrieval-Based Language Models with a Trillion-Token Datastore
by: Shao, Rulin, et al.
Published: (2024)
by: Shao, Rulin, et al.
Published: (2024)
LLaTTE: Scaling Laws for Multi-Stage Sequence Modeling in Large-Scale Ads Recommendation
by: Xiong, Lee, et al.
Published: (2026)
by: Xiong, Lee, et al.
Published: (2026)
Large Language Model Distilling Medication Recommendation Model
by: Liu, Qidong, et al.
Published: (2024)
by: Liu, Qidong, et al.
Published: (2024)
InstructRetro: Instruction Tuning post Retrieval-Augmented Pretraining
by: Wang, Boxin, et al.
Published: (2023)
by: Wang, Boxin, et al.
Published: (2023)
PathGPT: Reframing Path Recommendation as a Natural Language Generation Task with Retrieval-Augmented Language Models
by: Marcelyn, Steeve Cuthbert, et al.
Published: (2025)
by: Marcelyn, Steeve Cuthbert, et al.
Published: (2025)
Test-Time Scaling Strategies for Generative Retrieval in Multimodal Conversational Recommendations
by: Hsu, Hung-Chun, et al.
Published: (2025)
by: Hsu, Hung-Chun, et al.
Published: (2025)
Robust Uplift Modeling with Large-Scale Contexts for Real-time Marketing
by: Sun, Zexu, et al.
Published: (2025)
by: Sun, Zexu, et al.
Published: (2025)
Metadata Extraction Leveraging Large Language Models
by: Han, Cuize, et al.
Published: (2025)
by: Han, Cuize, et al.
Published: (2025)
Soft Prompt Tuning for Augmenting Dense Retrieval with Large Language Models
by: Peng, Zhiyuan, et al.
Published: (2023)
by: Peng, Zhiyuan, et al.
Published: (2023)
Eliciting In-context Retrieval and Reasoning for Long-context Large Language Models
by: Qiu, Yifu, et al.
Published: (2025)
by: Qiu, Yifu, et al.
Published: (2025)
Combining Open-box Simulation and Importance Sampling for Tuning Large-Scale Recommenders
by: Paneri, Kaushal, et al.
Published: (2024)
by: Paneri, Kaushal, et al.
Published: (2024)
Large Language Models for Next Point-of-Interest Recommendation
by: Li, Peibo, et al.
Published: (2024)
by: Li, Peibo, et al.
Published: (2024)
EB-NeRD: A Large-Scale Dataset for News Recommendation
by: Kruse, Johannes, et al.
Published: (2024)
by: Kruse, Johannes, et al.
Published: (2024)
Learning Retrieval Models with Sparse Autoencoders
by: Formal, Thibault, et al.
Published: (2026)
by: Formal, Thibault, et al.
Published: (2026)
PAP-REC: Personalized Automatic Prompt for Recommendation Language Model
by: Li, Zelong, et al.
Published: (2024)
by: Li, Zelong, et al.
Published: (2024)
Large Language Models as Recommender Systems: A Study of Popularity Bias
by: Lichtenberg, Jan Malte, et al.
Published: (2024)
by: Lichtenberg, Jan Malte, et al.
Published: (2024)
Rethinking ANN-based Retrieval: Multifaceted Learnable Index for Large-scale Recommendation System
by: Zhang, Jiang, et al.
Published: (2026)
by: Zhang, Jiang, et al.
Published: (2026)
When Search Engine Services meet Large Language Models: Visions and Challenges
by: Xiong, Haoyi, et al.
Published: (2024)
by: Xiong, Haoyi, et al.
Published: (2024)
BEAR: Towards Beam-Search-Aware Optimization for Recommendation with Large Language Models
by: Yang, Weiqin, et al.
Published: (2026)
by: Yang, Weiqin, et al.
Published: (2026)
Lookahead: An Inference Acceleration Framework for Large Language Model with Lossless Generation Accuracy
by: Zhao, Yao, et al.
Published: (2023)
by: Zhao, Yao, et al.
Published: (2023)
Long Context Modeling with Ranked Memory-Augmented Retrieval
by: Alselwi, Ghadir, et al.
Published: (2025)
by: Alselwi, Ghadir, et al.
Published: (2025)
$\mathbb{R}^{2k}$ is Theoretically Large Enough for Embedding-based Top-$k$ Retrieval
by: Wang, Zihao, et al.
Published: (2026)
by: Wang, Zihao, et al.
Published: (2026)
Exploring the Potential of Large Language Models in Public Transportation: San Antonio Case Study
by: Jonnala, Ramya, et al.
Published: (2025)
by: Jonnala, Ramya, et al.
Published: (2025)
STAR: A Simple Training-free Approach for Recommendations using Large Language Models
by: Lee, Dong-Ho, et al.
Published: (2024)
by: Lee, Dong-Ho, et al.
Published: (2024)
Bridging Stepwise Lab-Informed Pretraining and Knowledge-Guided Learning for Diagnostic Reasoning
by: Hu, Pengfei, et al.
Published: (2024)
by: Hu, Pengfei, et al.
Published: (2024)
Temporal Information Retrieval via Time-Specifier Model Merging
by: Han, SeungYoon, et al.
Published: (2025)
by: Han, SeungYoon, et al.
Published: (2025)
AmazonQAC: A Large-Scale, Naturalistic Query Autocomplete Dataset
by: Everaert, Dante, et al.
Published: (2024)
by: Everaert, Dante, et al.
Published: (2024)
SimRAG: Self-Improving Retrieval-Augmented Generation for Adapting Large Language Models to Specialized Domains
by: Xu, Ran, et al.
Published: (2024)
by: Xu, Ran, et al.
Published: (2024)
Superintelligent Retrieval Agent: The Next Frontier of Information Retrieval
by: Yang, Zeyu, et al.
Published: (2026)
by: Yang, Zeyu, et al.
Published: (2026)
Refine-POI: Reinforcement Fine-Tuned Large Language Models for Next Point-of-Interest Recommendation
by: Li, Peibo, et al.
Published: (2025)
by: Li, Peibo, et al.
Published: (2025)
LegalPro-BERT: Classification of Legal Provisions by fine-tuning BERT Large Language Model
by: Tewari, Amit
Published: (2024)
by: Tewari, Amit
Published: (2024)
GAugLLM: Improving Graph Contrastive Learning for Text-Attributed Graphs with Large Language Models
by: Fang, Yi, et al.
Published: (2024)
by: Fang, Yi, et al.
Published: (2024)
Enhancing Performance and Scalability of Large-Scale Recommendation Systems with Jagged Flash Attention
by: Xu, Rengan, et al.
Published: (2024)
by: Xu, Rengan, et al.
Published: (2024)
VALUE: Value-Aware Large Language Model for Query Rewriting via Weighted Trie in Sponsored Search
by: Zhang, Xiao, et al.
Published: (2025)
by: Zhang, Xiao, et al.
Published: (2025)
Semantic Retrieval at Walmart
by: Magnani, Alessandro, et al.
Published: (2024)
by: Magnani, Alessandro, et al.
Published: (2024)
Hybrid Intent-Aware Personalization with Machine Learning and RAG-Enabled Large Language Models for Financial Services Marketing
by: Shanivendra, Akhil Chandra
Published: (2026)
by: Shanivendra, Akhil Chandra
Published: (2026)
Link, Synthesize, Retrieve: Universal Document Linking for Zero-Shot Information Retrieval
by: Hwang, Dae Yon, et al.
Published: (2024)
by: Hwang, Dae Yon, et al.
Published: (2024)
Similar Items
-
Scaling Laws for Online Advertisement Retrieval
by: Wang, Yunli, et al.
Published: (2024) -
Retrieval meets Long Context Large Language Models
by: Xu, Peng, et al.
Published: (2023) -
Large Language Model Augmented Exercise Retrieval for Personalized Language Learning
by: Xu, Austin, et al.
Published: (2024) -
Scaling Retrieval-Based Language Models with a Trillion-Token Datastore
by: Shao, Rulin, et al.
Published: (2024) -
LLaTTE: Scaling Laws for Multi-Stage Sequence Modeling in Large-Scale Ads Recommendation
by: Xiong, Lee, et al.
Published: (2026)