Let your LLM generate a few tokens and you will reduce the need for retrieval
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Déjean, Hervé |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
100 instances is all you need: predicting the success of a new LLM on unseen data by testing on a few instances
par: Pacchiardi, Lorenzo, et autres
Publié: (2024)
par: Pacchiardi, Lorenzo, et autres
Publié: (2024)
Getting the most out of your tokenizer for pre-training and domain adaptation
par: Dagan, Gautier, et autres
Publié: (2024)
par: Dagan, Gautier, et autres
Publié: (2024)
Retrieval-augmented generation in multilingual settings
par: Chirkova, Nadezhda, et autres
Publié: (2024)
par: Chirkova, Nadezhda, et autres
Publié: (2024)
Practical token pruning for foundation models in few-shot conversational virtual assistant systems
par: Qi, Haode, et autres
Publié: (2024)
par: Qi, Haode, et autres
Publié: (2024)
Retrieval-Augmented LLM Agents: Learning to Learn from Experience
par: Ferraz, Thomas Palmeira, et autres
Publié: (2026)
par: Ferraz, Thomas Palmeira, et autres
Publié: (2026)
PISCO: Pretty Simple Compression for Retrieval-Augmented Generation
par: Louis, Maxime, et autres
Publié: (2025)
par: Louis, Maxime, et autres
Publié: (2025)
Ambiguity is the last thing you need
par: Chivers, Emily, et autres
Publié: (2024)
par: Chivers, Emily, et autres
Publié: (2024)
Context Embeddings for Efficient Answer Generation in RAG
par: Rau, David, et autres
Publié: (2024)
par: Rau, David, et autres
Publié: (2024)
SPLADE-v3: New baselines for SPLADE
par: Lassance, Carlos, et autres
Publié: (2024)
par: Lassance, Carlos, et autres
Publié: (2024)
Downstream bias mitigation is all you need
par: Baksi, Arkadeep, et autres
Publié: (2024)
par: Baksi, Arkadeep, et autres
Publié: (2024)
Good Parenting is all you need -- Multi-agentic LLM Hallucination Mitigation
par: Kwartler, Ted, et autres
Publié: (2024)
par: Kwartler, Ted, et autres
Publié: (2024)
Collaboration is all you need: LLM Assisted Safe Code Translation
par: Karanjai, Rabimba, et autres
Publié: (2025)
par: Karanjai, Rabimba, et autres
Publié: (2025)
Reddit is all you need: Authorship profiling for Romanian
par: Ştefănescu, Ecaterina, et autres
Publié: (2024)
par: Ştefănescu, Ecaterina, et autres
Publié: (2024)
Unused information in token probability distribution of generative LLM: improving LLM reading comprehension through calculation of expected values
par: Zawistowski, Krystian
Publié: (2024)
par: Zawistowski, Krystian
Publié: (2024)
OSCAR: Online Soft Compression And Reranking
par: Louis, Maxime, et autres
Publié: (2025)
par: Louis, Maxime, et autres
Publié: (2025)
On multi-token prediction for efficient LLM inference
par: Mehra, Somesh, et autres
Publié: (2025)
par: Mehra, Somesh, et autres
Publié: (2025)
À la recherche du sens perdu: your favourite LLM might have more to say than you can understand
par: Erziev, K. O. T.
Publié: (2025)
par: Erziev, K. O. T.
Publié: (2025)
When retrieval outperforms generation: Dense evidence retrieval for scalable fake news detection
par: Qazi, Alamgir Munir, et autres
Publié: (2025)
par: Qazi, Alamgir Munir, et autres
Publié: (2025)
On the Challenges and Opportunities of Learned Sparse Retrieval for Code
par: Lupart, Simon, et autres
Publié: (2026)
par: Lupart, Simon, et autres
Publié: (2026)
Steps are all you need: Rethinking STEM Education with Prompt Engineering
par: Addala, Krishnasai, et autres
Publié: (2024)
par: Addala, Krishnasai, et autres
Publié: (2024)
Multimodal LLMs are not all you need for Pediatric Speech Language Pathology
par: Fürst, Darren, et autres
Publié: (2026)
par: Fürst, Darren, et autres
Publié: (2026)
Roll the dice & look before you leap: Going beyond the creative limits of next-token prediction
par: Nagarajan, Vaishnavh, et autres
Publié: (2025)
par: Nagarajan, Vaishnavh, et autres
Publié: (2025)
Knowledge Graphs are all you need: Leveraging KGs in Physics Question Answering
par: Addala, Krishnasai, et autres
Publié: (2024)
par: Addala, Krishnasai, et autres
Publié: (2024)
AUEB-Archimedes at RIRAG-2025: Is obligation concatenation really all you need?
par: Chasandras, Ioannis, et autres
Publié: (2024)
par: Chasandras, Ioannis, et autres
Publié: (2024)
You only need 4 extra tokens: Synergistic Test-time Adaptation for LLMs
par: Xu, Yijie, et autres
Publié: (2025)
par: Xu, Yijie, et autres
Publié: (2025)
Large Language Models aren't all that you need
par: Holla, Kiran Voderhobli, et autres
Publié: (2024)
par: Holla, Kiran Voderhobli, et autres
Publié: (2024)
Don't lie to your friends: Learning what you know from collaborative self-play
par: Eisenstein, Jacob, et autres
Publié: (2025)
par: Eisenstein, Jacob, et autres
Publié: (2025)
BSBench: will your LLM find the largest prime number?
par: Erziev, K. O. T.
Publié: (2025)
par: Erziev, K. O. T.
Publié: (2025)
Not all tokens are created equal: Perplexity Attention Weighted Networks for AI generated text detection
par: Miralles-González, Pablo, et autres
Publié: (2025)
par: Miralles-González, Pablo, et autres
Publié: (2025)
Instructions are all you need: Self-supervised Reinforcement Learning for Instruction Following
par: Ren, Qingyu, et autres
Publié: (2025)
par: Ren, Qingyu, et autres
Publié: (2025)
‛Until you're in the chair and executing your role, you don't know’: A qualitative study of the needs and perspectives of people with stroke‐related communication disabilities when returning to vocational activity
par: Lucette Lanyon, et autres
Publié: (2024)
par: Lucette Lanyon, et autres
Publié: (2024)
Camouflage is all you need: Evaluating and Enhancing Language Model Robustness Against Camouflage Adversarial Attacks
par: Huertas-García, Álvaro, et autres
Publié: (2024)
par: Huertas-García, Álvaro, et autres
Publié: (2024)
Why do LLMs attend to the first token?
par: Barbero, Federico, et autres
Publié: (2025)
par: Barbero, Federico, et autres
Publié: (2025)
Where is the signal in tokenization space?
par: Geh, Renato Lui, et autres
Publié: (2024)
par: Geh, Renato Lui, et autres
Publié: (2024)
Solving morphological analogies: from retrieval to generation
par: Marquer, Esteban, et autres
Publié: (2023)
par: Marquer, Esteban, et autres
Publié: (2023)
Provence: efficient and robust context pruning for retrieval-augmented generation
par: Chirkova, Nadezhda, et autres
Publié: (2025)
par: Chirkova, Nadezhda, et autres
Publié: (2025)
Multilingual Natural Language Processing Model for Radiology Reports -- The Summary is all you need!
par: Lindo, Mariana, et autres
Publié: (2023)
par: Lindo, Mariana, et autres
Publié: (2023)
Cross-Modal Safety Alignment: Is textual unlearning all you need?
par: Chakraborty, Trishna, et autres
Publié: (2024)
par: Chakraborty, Trishna, et autres
Publié: (2024)
BERGEN: A Benchmarking Library for Retrieval-Augmented Generation
par: Rau, David, et autres
Publié: (2024)
par: Rau, David, et autres
Publié: (2024)
Diffusion LLM with Native Variable Generation Lengths: Let [EOS] Lead the Way
par: Yang, Yicun, et autres
Publié: (2025)
par: Yang, Yicun, et autres
Publié: (2025)
Documents similaires
-
100 instances is all you need: predicting the success of a new LLM on unseen data by testing on a few instances
par: Pacchiardi, Lorenzo, et autres
Publié: (2024) -
Getting the most out of your tokenizer for pre-training and domain adaptation
par: Dagan, Gautier, et autres
Publié: (2024) -
Retrieval-augmented generation in multilingual settings
par: Chirkova, Nadezhda, et autres
Publié: (2024) -
Practical token pruning for foundation models in few-shot conversational virtual assistant systems
par: Qi, Haode, et autres
Publié: (2024) -
Retrieval-Augmented LLM Agents: Learning to Learn from Experience
par: Ferraz, Thomas Palmeira, et autres
Publié: (2026)