Cost-Aware Model Selection for Text Classification: Multi-Objective Trade-offs Between Fine-Tuned Encoders and LLM Prompting in Production
Fuente:
arXiv
Salvato in:
| Autore principale: | Gonzalez, Alberto Andres Valdes |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Listwise Direct Preference Optimization with Multi-Dimensional Preference Mixing
di: Sun, Yuhui, et al.
Pubblicazione: (2025)
di: Sun, Yuhui, et al.
Pubblicazione: (2025)
Computational Economics in Large Language Models: Exploring Model Behavior and Incentive Design under Resource Constraints
di: Reddy, Sandeep, et al.
Pubblicazione: (2025)
di: Reddy, Sandeep, et al.
Pubblicazione: (2025)
Efficient Strategy for Improving Large Language Model (LLM) Capabilities
di: Gutiérrez, Julián Camilo Velandia
Pubblicazione: (2025)
di: Gutiérrez, Julián Camilo Velandia
Pubblicazione: (2025)
Synergy over Discrepancy: A Partition-Based Approach to Multi-Domain LLM Fine-Tuning
di: Ye, Hua, et al.
Pubblicazione: (2025)
di: Ye, Hua, et al.
Pubblicazione: (2025)
LLM Performance Predictors: Learning When to Escalate in Hybrid Human-AI Moderation Systems
di: Bachar, Or, et al.
Pubblicazione: (2026)
di: Bachar, Or, et al.
Pubblicazione: (2026)
Layer-Aware Embedding Fusion for LLMs in Text Classifications
di: Gwak, Jiho, et al.
Pubblicazione: (2025)
di: Gwak, Jiho, et al.
Pubblicazione: (2025)
KerZOO: Kernel Function Informed Zeroth-Order Optimization for Accurate and Accelerated LLM Fine-Tuning
di: Mi, Zhendong, et al.
Pubblicazione: (2025)
di: Mi, Zhendong, et al.
Pubblicazione: (2025)
When is dataset cartography ineffective? Using training dynamics does not improve robustness against Adversarial SQuAD
di: Mandal, Paul K.
Pubblicazione: (2025)
di: Mandal, Paul K.
Pubblicazione: (2025)
Less is More: Learning Graph Tasks with Just LLMs
di: Shirai, Sola, et al.
Pubblicazione: (2025)
di: Shirai, Sola, et al.
Pubblicazione: (2025)
Beyond Subtokens: A Rich Character Embedding for Low-resource and Morphologically Complex Languages
di: Schneider, Felix, et al.
Pubblicazione: (2026)
di: Schneider, Felix, et al.
Pubblicazione: (2026)
A Multi-Encoder Frozen-Decoder Approach for Fine-Tuning Large Language Models
di: Dhole, Kaustubh D.
Pubblicazione: (2025)
di: Dhole, Kaustubh D.
Pubblicazione: (2025)
A Comparative Study of Feature Selection in Tsetlin Machines
di: Halenka, Vojtech, et al.
Pubblicazione: (2025)
di: Halenka, Vojtech, et al.
Pubblicazione: (2025)
Why LoRA Resists Label Noise: A Theoretical Framework for Noise-Robust Parameter-Efficient Fine-Tuning
di: Steele, Brady
Pubblicazione: (2026)
di: Steele, Brady
Pubblicazione: (2026)
Automated Bug Triaging using Instruction-Tuned Large Language Models
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025)
di: Kiashemshaki, Kiana, et al.
Pubblicazione: (2025)
Emergent Lexical Semantics in Neural Language Models: Testing Martin's Law on LLM-Generated Text
di: Kugler, Kai
Pubblicazione: (2025)
di: Kugler, Kai
Pubblicazione: (2025)
Exploring Model Invariance with Discrete Search for Ultra-Low-Bit Quantization
di: Wen, Yuqiao, et al.
Pubblicazione: (2025)
di: Wen, Yuqiao, et al.
Pubblicazione: (2025)
EBBS: An Ensemble with Bi-Level Beam Search for Zero-Shot Machine Translation
di: Wen, Yuqiao, et al.
Pubblicazione: (2024)
di: Wen, Yuqiao, et al.
Pubblicazione: (2024)
LLM-Rubric: A Multidimensional, Calibrated Approach to Automated Evaluation of Natural Language Texts
di: Hashemi, Helia, et al.
Pubblicazione: (2024)
di: Hashemi, Helia, et al.
Pubblicazione: (2024)
The Reasoning-Creativity Trade-off: Toward Creativity-Driven Problem Solving
di: Luyten, Max Ruiz, et al.
Pubblicazione: (2026)
di: Luyten, Max Ruiz, et al.
Pubblicazione: (2026)
CoE: Collaborative Entropy for Uncertainty Quantification in Agentic Multi-LLM Systems
di: Sun, Kangkang, et al.
Pubblicazione: (2026)
di: Sun, Kangkang, et al.
Pubblicazione: (2026)
MODP: Multi Objective Directional Prompting
di: Nema, Aashutosh, et al.
Pubblicazione: (2025)
di: Nema, Aashutosh, et al.
Pubblicazione: (2025)
Adaptive Activation Cancellation for Hallucination Mitigation in Large Language Models
di: Yocam, Eric, et al.
Pubblicazione: (2026)
di: Yocam, Eric, et al.
Pubblicazione: (2026)
Predictive Analytics for Collaborators Answers, Code Quality, and Dropout on Stack Overflow
di: Zolduoarrati, Elijah, et al.
Pubblicazione: (2025)
di: Zolduoarrati, Elijah, et al.
Pubblicazione: (2025)
Neural Attention: A Novel Mechanism for Enhanced Expressive Power in Transformer Models
di: DiGiugno, Andrew, et al.
Pubblicazione: (2025)
di: DiGiugno, Andrew, et al.
Pubblicazione: (2025)
Adversarially Probing Cross-Family Sound Symbolism in 27 Languages
di: Sharma, Anika, et al.
Pubblicazione: (2025)
di: Sharma, Anika, et al.
Pubblicazione: (2025)
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
di: Fadli, Samih
Pubblicazione: (2025)
di: Fadli, Samih
Pubblicazione: (2025)
TwinVoice: A Multi-dimensional Benchmark Towards Digital Twins via LLM Persona Simulation
di: Du, Bangde, et al.
Pubblicazione: (2025)
di: Du, Bangde, et al.
Pubblicazione: (2025)
On the Influence of Discourse Relations in Persuasive Texts
di: Turk, Nawar, et al.
Pubblicazione: (2025)
di: Turk, Nawar, et al.
Pubblicazione: (2025)
Towards Alignment-Centric Paradigm: A Survey of Instruction Tuning in Large Language Models
di: Han, Xudong, et al.
Pubblicazione: (2025)
di: Han, Xudong, et al.
Pubblicazione: (2025)
Cytoarchitecture in Words: Weakly Supervised Vision-Language Modeling for Human Brain Microscopy
di: Sutton, Matthew, et al.
Pubblicazione: (2026)
di: Sutton, Matthew, et al.
Pubblicazione: (2026)
Bridging the Gap: An Intermediate Language for Enhanced and Cost-Effective Grapheme-to-Phoneme Conversion with Homographs with Multiple Pronunciations Disambiguation
di: Bertina, Abbas, et al.
Pubblicazione: (2025)
di: Bertina, Abbas, et al.
Pubblicazione: (2025)
Exploring LLM-based Verilog Code Generation with Data-Efficient Fine-Tuning and Testbench Automation
di: Chen, Mu-Chi, et al.
Pubblicazione: (2026)
di: Chen, Mu-Chi, et al.
Pubblicazione: (2026)
Latent Cache Flow: Model-to-Model Communication Without Text
di: Rossi, Maximillian, et al.
Pubblicazione: (2026)
di: Rossi, Maximillian, et al.
Pubblicazione: (2026)
propella-1: Multi-Property Document Annotation for LLM Data Curation at Scale
di: Idahl, Maximilian, et al.
Pubblicazione: (2026)
di: Idahl, Maximilian, et al.
Pubblicazione: (2026)
Automated Circuit Interpretation via Probe Prompting
di: Birardi, Giuseppe
Pubblicazione: (2025)
di: Birardi, Giuseppe
Pubblicazione: (2025)
On Semantic Loss Fine-Tuning Approach for Preventing Model Collapse in Causal Reasoning
di: Deshmukh, Pratik, et al.
Pubblicazione: (2026)
di: Deshmukh, Pratik, et al.
Pubblicazione: (2026)
Let Your Graph Do the Talking: Encoding Structured Data for LLMs
di: Perozzi, Bryan, et al.
Pubblicazione: (2024)
di: Perozzi, Bryan, et al.
Pubblicazione: (2024)
Combining Language and Topic Models for Hierarchical Text Classification
di: Toit, Jaco du, et al.
Pubblicazione: (2025)
di: Toit, Jaco du, et al.
Pubblicazione: (2025)
Automated CAD Modeling Sequence Generation from Text Descriptions via Transformer-Based Large Language Models
di: Liao, Jianxing, et al.
Pubblicazione: (2025)
di: Liao, Jianxing, et al.
Pubblicazione: (2025)
SAGE: A Strategy-Aware Graph-Enhanced Generation Framework For Online Counseling
di: Aharon, Eliya Naomi, et al.
Pubblicazione: (2026)
di: Aharon, Eliya Naomi, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Listwise Direct Preference Optimization with Multi-Dimensional Preference Mixing
di: Sun, Yuhui, et al.
Pubblicazione: (2025) -
Computational Economics in Large Language Models: Exploring Model Behavior and Incentive Design under Resource Constraints
di: Reddy, Sandeep, et al.
Pubblicazione: (2025) -
Efficient Strategy for Improving Large Language Model (LLM) Capabilities
di: Gutiérrez, Julián Camilo Velandia
Pubblicazione: (2025) -
Synergy over Discrepancy: A Partition-Based Approach to Multi-Domain LLM Fine-Tuning
di: Ye, Hua, et al.
Pubblicazione: (2025) -
LLM Performance Predictors: Learning When to Escalate in Hybrid Human-AI Moderation Systems
di: Bachar, Or, et al.
Pubblicazione: (2026)