Reranking Laws for Language Generation: A Communication-Theoretic Perspective
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Farinhas, António, Li, Haau-Sing, Martins, André F. T. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Conformal Prediction for Natural Language Processing: A Survey
par: Campos, Margarida M., et autres
Publié: (2024)
par: Campos, Margarida M., et autres
Publié: (2024)
DOCE: Finding the Sweet Spot for Execution-Based Code Generation
par: Li, Haau-Sing, et autres
Publié: (2024)
par: Li, Haau-Sing, et autres
Publié: (2024)
Translate Smart, not Hard: Cascaded Translation Systems with Quality-Aware Deferral
par: Farinhas, António, et autres
Publié: (2025)
par: Farinhas, António, et autres
Publié: (2025)
QUEST: Quality-Aware Metropolis-Hastings Sampling for Machine Translation
par: Faria, Gonçalo R. A., et autres
Publié: (2024)
par: Faria, Gonçalo R. A., et autres
Publié: (2024)
Non-Exchangeable Conformal Language Generation with Nearest Neighbors
par: Ulmer, Dennis, et autres
Publié: (2024)
par: Ulmer, Dennis, et autres
Publié: (2024)
Misconception Diagnosis From Student-Tutor Dialogue: Generate, Retrieve, Rerank
par: Mitton, Joshua, et autres
Publié: (2026)
par: Mitton, Joshua, et autres
Publié: (2026)
Efficiency-Effectiveness Reranking FLOPs for LLM-based Rerankers
par: Peng, Zhiyuan, et autres
Publié: (2025)
par: Peng, Zhiyuan, et autres
Publié: (2025)
MemRerank: Preference Memory for Personalized Product Reranking
par: Peng, Zhiyuan, et autres
Publié: (2026)
par: Peng, Zhiyuan, et autres
Publié: (2026)
Power-Law Decay Loss for Large Language Model Finetuning: A Theory Perspective
par: Shao, Jintian
Publié: (2025)
par: Shao, Jintian
Publié: (2025)
$\infty$-Video: A Training-Free Approach to Long Video Understanding via Continuous-Time Memory Consolidation
par: Santos, Saul, et autres
Publié: (2025)
par: Santos, Saul, et autres
Publié: (2025)
MLLM Is a Strong Reranker: Advancing Multimodal Retrieval-augmented Generation via Knowledge-enhanced Reranking and Noise-injected Training
par: Chen, Zhanpeng, et autres
Publié: (2024)
par: Chen, Zhanpeng, et autres
Publié: (2024)
Beyond Sequential Reranking: Reranker-Guided Search Improves Reasoning Intensive Retrieval
par: Xu, Haike, et autres
Publié: (2025)
par: Xu, Haike, et autres
Publié: (2025)
Benefits and Pitfalls of Reinforcement Learning for Language Model Planning: A Theoretical Perspective
par: Wang, Siwei, et autres
Publié: (2025)
par: Wang, Siwei, et autres
Publié: (2025)
Theoretical Foundations of Scaling Law in Familial Models
par: Song, Huan, et autres
Publié: (2025)
par: Song, Huan, et autres
Publié: (2025)
Can Automatic Metrics Assess High-Quality Translations?
par: Agrawal, Sweta, et autres
Publié: (2024)
par: Agrawal, Sweta, et autres
Publié: (2024)
Promises and Pitfalls of Generative Masked Language Modeling: Theoretical Framework and Practical Guidelines
par: Li, Yuchen, et autres
Publié: (2024)
par: Li, Yuchen, et autres
Publié: (2024)
Towards Analyzing and Understanding the Limitations of VAPO: A Theoretical Perspective
par: Shao, Jintian, et autres
Publié: (2025)
par: Shao, Jintian, et autres
Publié: (2025)
GraphER: An Efficient Graph-Based Enrichment and Reranking Method for Retrieval-Augmented Generation
par: Miao, Ruizhong, et autres
Publié: (2026)
par: Miao, Ruizhong, et autres
Publié: (2026)
Efficient Rationale-based Retrieval: On-policy Distillation from Generative Rerankers based on JEPA
par: Chen, Teng, et autres
Publié: (2026)
par: Chen, Teng, et autres
Publié: (2026)
Non-Exchangeable Conformal Risk Control
par: Farinhas, António, et autres
Publié: (2023)
par: Farinhas, António, et autres
Publié: (2023)
Active Learners as Efficient PRP Rerankers
par: Paschmann, Jeremías Figueiredo, et autres
Publié: (2026)
par: Paschmann, Jeremías Figueiredo, et autres
Publié: (2026)
Scaling Laws for Discriminative Classification in Large Language Models
par: Wyatte, Dean, et autres
Publié: (2024)
par: Wyatte, Dean, et autres
Publié: (2024)
Aligning Neural Machine Translation Models: Human Feedback in Training and Inference
par: Ramos, Miguel Moura, et autres
Publié: (2023)
par: Ramos, Miguel Moura, et autres
Publié: (2023)
A Theoretical Perspective for Speculative Decoding Algorithm
par: Yin, Ming, et autres
Publié: (2024)
par: Yin, Ming, et autres
Publié: (2024)
Drowning in Documents: Consequences of Scaling Reranker Inference
par: Jacob, Mathew, et autres
Publié: (2024)
par: Jacob, Mathew, et autres
Publié: (2024)
AdaSplash: Adaptive Sparse Flash Attention
par: Gonçalves, Nuno, et autres
Publié: (2025)
par: Gonçalves, Nuno, et autres
Publié: (2025)
Scaling Laws for Multilingual Language Models
par: He, Yifei, et autres
Publié: (2024)
par: He, Yifei, et autres
Publié: (2024)
Performance Law of Large Language Models
par: Wu, Chuhan, et autres
Publié: (2024)
par: Wu, Chuhan, et autres
Publié: (2024)
Parallel Scaling Law for Language Models
par: Chen, Mouxiang, et autres
Publié: (2025)
par: Chen, Mouxiang, et autres
Publié: (2025)
LangFIR: Discovering Sparse Language-Specific Features from Monolingual Data for Language Steering
par: Wong, Sing Hieng, et autres
Publié: (2026)
par: Wong, Sing Hieng, et autres
Publié: (2026)
Training Nonlinear Transformers for Chain-of-Thought Inference: A Theoretical Generalization Analysis
par: Li, Hongkang, et autres
Publié: (2024)
par: Li, Hongkang, et autres
Publié: (2024)
Why Code, Why Now: An Information-Theoretic Perspective on the Limits of Machine Learning
par: Zhao, Zhimin
Publié: (2026)
par: Zhao, Zhimin
Publié: (2026)
Theoretical Analysis of Weak-to-Strong Generalization
par: Lang, Hunter, et autres
Publié: (2024)
par: Lang, Hunter, et autres
Publié: (2024)
Demystifying Low-Rank Knowledge Distillation in Large Language Models: Convergence, Generalization, and Information-Theoretic Guarantees
par: Soarez, Alberlucia Rafael, et autres
Publié: (2026)
par: Soarez, Alberlucia Rafael, et autres
Publié: (2026)
CroissantLLM: A Truly Bilingual French-English Language Model
par: Faysse, Manuel, et autres
Publié: (2024)
par: Faysse, Manuel, et autres
Publié: (2024)
LIBRA: Measuring Bias of Large Language Model from a Local Context
par: Pang, Bo, et autres
Publié: (2025)
par: Pang, Bo, et autres
Publié: (2025)
Diagnosing LLM Reranker Behavior Under Fixed Evidence Pools
par: Arat, Baris, et autres
Publié: (2026)
par: Arat, Baris, et autres
Publié: (2026)
Rank1: Test-Time Compute for Reranking in Information Retrieval
par: Weller, Orion, et autres
Publié: (2025)
par: Weller, Orion, et autres
Publié: (2025)
HUKUKBERT: Domain-Specific Language Model for Turkish Law
par: Öztürk, Mehmet Utku, et autres
Publié: (2026)
par: Öztürk, Mehmet Utku, et autres
Publié: (2026)
Scaling Laws for Upcycling Mixture-of-Experts Language Models
par: Liew, Seng Pei, et autres
Publié: (2025)
par: Liew, Seng Pei, et autres
Publié: (2025)
Documents similaires
-
Conformal Prediction for Natural Language Processing: A Survey
par: Campos, Margarida M., et autres
Publié: (2024) -
DOCE: Finding the Sweet Spot for Execution-Based Code Generation
par: Li, Haau-Sing, et autres
Publié: (2024) -
Translate Smart, not Hard: Cascaded Translation Systems with Quality-Aware Deferral
par: Farinhas, António, et autres
Publié: (2025) -
QUEST: Quality-Aware Metropolis-Hastings Sampling for Machine Translation
par: Faria, Gonçalo R. A., et autres
Publié: (2024) -
Non-Exchangeable Conformal Language Generation with Nearest Neighbors
par: Ulmer, Dennis, et autres
Publié: (2024)