Optimising Calls to Large Language Models with Uncertainty-Based Two-Tier Selection
Fuente:
arXiv
Salvato in:
| Autori principali: | Ramírez, Guillem, Birch, Alexandra, Titov, Ivan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Cache & Distil: Optimising API Calls to Large Language Models
di: Ramírez, Guillem, et al.
Pubblicazione: (2023)
di: Ramírez, Guillem, et al.
Pubblicazione: (2023)
Controlling What You Share: Assessing Language Model Adherence to Privacy Preferences
di: Ramírez, Guillem, et al.
Pubblicazione: (2025)
di: Ramírez, Guillem, et al.
Pubblicazione: (2025)
Anthropomimetic Uncertainty: What Verbalized Uncertainty in Language Models is Missing
di: Ulmer, Dennis, et al.
Pubblicazione: (2025)
di: Ulmer, Dennis, et al.
Pubblicazione: (2025)
Unlearning Traces the Influential Training Data of Language Models
di: Isonuma, Masaru, et al.
Pubblicazione: (2024)
di: Isonuma, Masaru, et al.
Pubblicazione: (2024)
The Ups and Downs of Large Language Model Inference with Vocabulary Trimming by Language Heuristics
di: Bogoychev, Nikolay, et al.
Pubblicazione: (2023)
di: Bogoychev, Nikolay, et al.
Pubblicazione: (2023)
Bridging the Language Gaps in Large Language Models with Inference-Time Cross-Lingual Intervention
di: Wang, Weixuan, et al.
Pubblicazione: (2024)
di: Wang, Weixuan, et al.
Pubblicazione: (2024)
Detecting and Pruning Prominent but Detrimental Neurons in Large Language Models
di: Ali, Ameen, et al.
Pubblicazione: (2025)
di: Ali, Ameen, et al.
Pubblicazione: (2025)
Generalisation First, Memorisation Second? Memorisation Localisation for Natural Language Classification Tasks
di: Dankers, Verna, et al.
Pubblicazione: (2024)
di: Dankers, Verna, et al.
Pubblicazione: (2024)
HBO: Hierarchical Balancing Optimization for Fine-Tuning Large Language Models
di: Wang, Weixuan, et al.
Pubblicazione: (2025)
di: Wang, Weixuan, et al.
Pubblicazione: (2025)
OpenCoder: The Open Cookbook for Top-Tier Code Large Language Models
di: Huang, Siming, et al.
Pubblicazione: (2024)
di: Huang, Siming, et al.
Pubblicazione: (2024)
No Train but Gain: Language Arithmetic for training-free Language Adapters enhancement
di: Klimaszewski, Mateusz, et al.
Pubblicazione: (2024)
di: Klimaszewski, Mateusz, et al.
Pubblicazione: (2024)
Shared Doubt: Zero-shot Cross-Lingual Confidence Estimation for Language Models
di: Kyriakou, Athina, et al.
Pubblicazione: (2026)
di: Kyriakou, Athina, et al.
Pubblicazione: (2026)
SIP: Injecting a Structural Inductive Bias into a Seq2Seq Model by Simulation
di: Lindemann, Matthias, et al.
Pubblicazione: (2023)
di: Lindemann, Matthias, et al.
Pubblicazione: (2023)
Quality or Quantity? On Data Scale and Diversity in Adapting Large Language Models for Low-Resource Translation
di: Iyer, Vivek, et al.
Pubblicazione: (2024)
di: Iyer, Vivek, et al.
Pubblicazione: (2024)
Alignment for Efficient Tool Calling of Large Language Models
di: Xu, Hongshen, et al.
Pubblicazione: (2025)
di: Xu, Hongshen, et al.
Pubblicazione: (2025)
Token-Level Density-Based Uncertainty Quantification Methods for Eliciting Truthfulness of Large Language Models
di: Vazhentsev, Artem, et al.
Pubblicazione: (2025)
di: Vazhentsev, Artem, et al.
Pubblicazione: (2025)
Finding Culture-Sensitive Neurons in Vision-Language Models
di: Zhao, Xiutian, et al.
Pubblicazione: (2025)
di: Zhao, Xiutian, et al.
Pubblicazione: (2025)
M-Wanda: Improving One-Shot Pruning for Multilingual LLMs
di: Choenni, Rochelle, et al.
Pubblicazione: (2025)
di: Choenni, Rochelle, et al.
Pubblicazione: (2025)
Automatic Transmission for LLM Tiers: Optimizing Cost and Accuracy in Large Language Models
di: Na, Injae, et al.
Pubblicazione: (2025)
di: Na, Injae, et al.
Pubblicazione: (2025)
Uncertainty is Fragile: Manipulating Uncertainty in Large Language Models
di: Zeng, Qingcheng, et al.
Pubblicazione: (2024)
di: Zeng, Qingcheng, et al.
Pubblicazione: (2024)
Unconditional Truthfulness: Learning Unconditional Uncertainty of Large Language Models
di: Vazhentsev, Artem, et al.
Pubblicazione: (2024)
di: Vazhentsev, Artem, et al.
Pubblicazione: (2024)
Explanation Regularisation through the Lens of Attributions
di: Ferreira, Pedro, et al.
Pubblicazione: (2024)
di: Ferreira, Pedro, et al.
Pubblicazione: (2024)
Strengthening Structural Inductive Biases by Pre-training to Perform Syntactic Transformations
di: Lindemann, Matthias, et al.
Pubblicazione: (2024)
di: Lindemann, Matthias, et al.
Pubblicazione: (2024)
Truthful or Fabricated? Using Causal Attribution to Mitigate Reward Hacking in Explanations
di: Ferreira, Pedro, et al.
Pubblicazione: (2025)
di: Ferreira, Pedro, et al.
Pubblicazione: (2025)
Ethics Whitepaper: Whitepaper on Ethical Research into Large Language Models
di: Ungless, Eddie L., et al.
Pubblicazione: (2024)
di: Ungless, Eddie L., et al.
Pubblicazione: (2024)
Uncertainty Quantification for LLM Function-Calling
di: Ye, Zihuiwen, et al.
Pubblicazione: (2026)
di: Ye, Zihuiwen, et al.
Pubblicazione: (2026)
What's New in My Data? Novelty Exploration via Contrastive Generation
di: Isonuma, Masaru, et al.
Pubblicazione: (2024)
di: Isonuma, Masaru, et al.
Pubblicazione: (2024)
ToolRM: Outcome Reward Models for Tool-Calling Large Language Models
di: Agarwal, Mayank, et al.
Pubblicazione: (2025)
di: Agarwal, Mayank, et al.
Pubblicazione: (2025)
SConU: Selective Conformal Uncertainty in Large Language Models
di: Wang, Zhiyuan, et al.
Pubblicazione: (2025)
di: Wang, Zhiyuan, et al.
Pubblicazione: (2025)
Improving Multilingual Retrieval-Augmented Language Models through Dialectic Reasoning Argumentations
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025)
di: Ranaldi, Leonardo, et al.
Pubblicazione: (2025)
Better Call GPT, Comparing Large Language Models Against Lawyers
di: Martin, Lauren, et al.
Pubblicazione: (2024)
di: Martin, Lauren, et al.
Pubblicazione: (2024)
A Controllable Examination for Long-Context Language Models
di: Yang, Yijun, et al.
Pubblicazione: (2025)
di: Yang, Yijun, et al.
Pubblicazione: (2025)
Code-Switched Language Identification is Harder Than You Think
di: Burchell, Laurie, et al.
Pubblicazione: (2024)
di: Burchell, Laurie, et al.
Pubblicazione: (2024)
Two Spelling Normalization Approaches Based on Large Language Models
di: Domingo, Miguel, et al.
Pubblicazione: (2025)
di: Domingo, Miguel, et al.
Pubblicazione: (2025)
SPUQ: Perturbation-Based Uncertainty Quantification for Large Language Models
di: Gao, Xiang, et al.
Pubblicazione: (2024)
di: Gao, Xiang, et al.
Pubblicazione: (2024)
Query-Level Uncertainty in Large Language Models
di: Chen, Lihu, et al.
Pubblicazione: (2025)
di: Chen, Lihu, et al.
Pubblicazione: (2025)
Uncertainty Quantification for Large Language Diffusion Models
di: Vazhentsev, Artem, et al.
Pubblicazione: (2026)
di: Vazhentsev, Artem, et al.
Pubblicazione: (2026)
Demystifying Multilingual Chain-of-Thought in Process Reward Modeling
di: Wang, Weixuan, et al.
Pubblicazione: (2025)
di: Wang, Weixuan, et al.
Pubblicazione: (2025)
The Only Way is Ethics: A Guide to Ethical Research with Large Language Models
di: Ungless, Eddie L., et al.
Pubblicazione: (2024)
di: Ungless, Eddie L., et al.
Pubblicazione: (2024)
When Does Monolingual Data Help Multilingual Translation: The Role of Domain and Model Scale
di: Baziotis, Christos, et al.
Pubblicazione: (2023)
di: Baziotis, Christos, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Cache & Distil: Optimising API Calls to Large Language Models
di: Ramírez, Guillem, et al.
Pubblicazione: (2023) -
Controlling What You Share: Assessing Language Model Adherence to Privacy Preferences
di: Ramírez, Guillem, et al.
Pubblicazione: (2025) -
Anthropomimetic Uncertainty: What Verbalized Uncertainty in Language Models is Missing
di: Ulmer, Dennis, et al.
Pubblicazione: (2025) -
Unlearning Traces the Influential Training Data of Language Models
di: Isonuma, Masaru, et al.
Pubblicazione: (2024) -
The Ups and Downs of Large Language Model Inference with Vocabulary Trimming by Language Heuristics
di: Bogoychev, Nikolay, et al.
Pubblicazione: (2023)