Large Language Model Selection with Limited Annotations
Fuente:
arXiv
Guardado en:
| Autores principales: | Durmazkeser, Yavuz, Okanovic, Patrik, Kirsch, Andreas, Hoefler, Torsten, Gürel, Nezihe Merve |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Active Model Selection for Large Language Models
por: Durmazkeser, Yavuz, et al.
Publicado: (2025)
por: Durmazkeser, Yavuz, et al.
Publicado: (2025)
All models are wrong, some are useful: Model Selection with Limited Labels
por: Okanovic, Patrik, et al.
Publicado: (2024)
por: Okanovic, Patrik, et al.
Publicado: (2024)
Evaluating the Limits of Large Language Models in Multilingual Legal Reasoning
por: Ioannou, Antreas, et al.
Publicado: (2025)
por: Ioannou, Antreas, et al.
Publicado: (2025)
EntryPrune: Neural Network Feature Selection using First Impressions
por: Zimmer, Felix, et al.
Publicado: (2024)
por: Zimmer, Felix, et al.
Publicado: (2024)
Epidemiology of Large Language Models: A Benchmark for Observational Distribution Knowledge
por: Plecko, Drago, et al.
Publicado: (2025)
por: Plecko, Drago, et al.
Publicado: (2025)
Confounder Detection via Treatment Intent: A New Observational Study Design
por: Plecko, Drago, et al.
Publicado: (2026)
por: Plecko, Drago, et al.
Publicado: (2026)
A Systematic Review on the Evaluation of Large Language Models in Theory of Mind Tasks
por: Sarıtaş, Karahan, et al.
Publicado: (2025)
por: Sarıtaş, Karahan, et al.
Publicado: (2025)
SliceGPT: Compress Large Language Models by Deleting Rows and Columns
por: Ashkboos, Saleh, et al.
Publicado: (2024)
por: Ashkboos, Saleh, et al.
Publicado: (2024)
Collaboratively Learning Federated Models from Noisy Decentralized Data
por: Li, Haoyuan, et al.
Publicado: (2024)
por: Li, Haoyuan, et al.
Publicado: (2024)
C-RAG: Certified Generation Risks for Retrieval-Augmented Language Models
por: Kang, Mintong, et al.
Publicado: (2024)
por: Kang, Mintong, et al.
Publicado: (2024)
COLEP: Certifiably Robust Learning-Reasoning Conformal Prediction via Probabilistic Circuits
por: Kang, Mintong, et al.
Publicado: (2024)
por: Kang, Mintong, et al.
Publicado: (2024)
On Limitations of LLM as Annotator for Low Resource Languages
por: Jadhav, Suramya, et al.
Publicado: (2024)
por: Jadhav, Suramya, et al.
Publicado: (2024)
Chameleon: a Heterogeneous and Disaggregated Accelerator System for Retrieval-Augmented Language Models
por: Jiang, Wenqi, et al.
Publicado: (2023)
por: Jiang, Wenqi, et al.
Publicado: (2023)
Graph of Thoughts: Solving Elaborate Problems with Large Language Models
por: Besta, Maciej, et al.
Publicado: (2023)
por: Besta, Maciej, et al.
Publicado: (2023)
Model Hemorrhage and the Robustness Limits of Large Language Models
por: Ma, Ziyang, et al.
Publicado: (2025)
por: Ma, Ziyang, et al.
Publicado: (2025)
Rethinking Suicidal Ideation Detection: A Trustworthy Annotation Framework and Cross-Lingual Model Evaluation
por: Dzafic, Amina, et al.
Publicado: (2025)
por: Dzafic, Amina, et al.
Publicado: (2025)
RadAnnotate: Large Language Models for Efficient and Reliable Radiology Report Annotation
por: Shetty, Saisha Pradeep, et al.
Publicado: (2026)
por: Shetty, Saisha Pradeep, et al.
Publicado: (2026)
CoLoR-Filter: Conditional Loss Reduction Filtering for Targeted Language Model Pre-training
por: Brandfonbrener, David, et al.
Publicado: (2024)
por: Brandfonbrener, David, et al.
Publicado: (2024)
Automatic Prompt Selection for Large Language Models
por: Do, Viet-Tung, et al.
Publicado: (2024)
por: Do, Viet-Tung, et al.
Publicado: (2024)
LIDAO: Towards Limited Interventions for Debiasing (Large) Language Models
por: Liu, Tianci, et al.
Publicado: (2024)
por: Liu, Tianci, et al.
Publicado: (2024)
Bias in LLMs as Annotators: The Effect of Party Cues on Labelling Decision by Large Language Models
por: Vera, Sebastian Vallejo, et al.
Publicado: (2024)
por: Vera, Sebastian Vallejo, et al.
Publicado: (2024)
SFT-then-RL Outperforms Mixed-Policy Methods for LLM Reasoning
por: Limozin, Alexis, et al.
Publicado: (2026)
por: Limozin, Alexis, et al.
Publicado: (2026)
When Data Is Scarce: Scaling Sparse Language Models with Repeated Training
por: Wu, Boqian, et al.
Publicado: (2026)
por: Wu, Boqian, et al.
Publicado: (2026)
Limits to Predicting Online Speech Using Large Language Models
por: Remeli, Mina, et al.
Publicado: (2024)
por: Remeli, Mina, et al.
Publicado: (2024)
Analogical Reasoning Inside Large Language Models: Concept Vectors and the Limits of Abstraction
por: Opiełka, Gustaw, et al.
Publicado: (2025)
por: Opiełka, Gustaw, et al.
Publicado: (2025)
Investigating Annotator Bias in Large Language Models for Hate Speech Detection
por: Das, Amit, et al.
Publicado: (2024)
por: Das, Amit, et al.
Publicado: (2024)
Rule Extrapolation in Language Models: A Study of Compositional Generalization on OOD Prompts
por: Mészáros, Anna, et al.
Publicado: (2024)
por: Mészáros, Anna, et al.
Publicado: (2024)
LLM-Select: Feature Selection with Large Language Models
por: Jeong, Daniel P., et al.
Publicado: (2024)
por: Jeong, Daniel P., et al.
Publicado: (2024)
Beyond the Limits: A Survey of Techniques to Extend the Context Length in Large Language Models
por: Wang, Xindi, et al.
Publicado: (2024)
por: Wang, Xindi, et al.
Publicado: (2024)
Hallucination is Inevitable: An Innate Limitation of Large Language Models
por: Xu, Ziwei, et al.
Publicado: (2024)
por: Xu, Ziwei, et al.
Publicado: (2024)
Exploring Multi-Grained Concept Annotations for Multimodal Large Language Models
por: Xu, Xiao, et al.
Publicado: (2024)
por: Xu, Xiao, et al.
Publicado: (2024)
The Limited Impact of Medical Adaptation of Large Language and Vision-Language Models
por: Jeong, Daniel P., et al.
Publicado: (2024)
por: Jeong, Daniel P., et al.
Publicado: (2024)
Augmenting Human-Annotated Training Data with Large Language Model Generation and Distillation in Open-Response Assessment
por: Borchers, Conrad, et al.
Publicado: (2025)
por: Borchers, Conrad, et al.
Publicado: (2025)
CS-Sum: A Benchmark for Code-Switching Dialogue Summarization and the Limits of Large Language Models
por: Suresh, Sathya Krishnan, et al.
Publicado: (2025)
por: Suresh, Sathya Krishnan, et al.
Publicado: (2025)
Large Language Model-Enhanced Algorithm Selection: Towards Comprehensive Algorithm Representation
por: Wu, Xingyu, et al.
Publicado: (2023)
por: Wu, Xingyu, et al.
Publicado: (2023)
SSR: Socratic Self-Refine for Large Language Model Reasoning
por: Shi, Haizhou, et al.
Publicado: (2025)
por: Shi, Haizhou, et al.
Publicado: (2025)
BLaST: High Performance Inference and Pretraining using BLock Sparse Transformers
por: Okanovic, Patrik, et al.
Publicado: (2025)
por: Okanovic, Patrik, et al.
Publicado: (2025)
Automating Governing Knowledge Commons and Contextual Integrity (GKC-CI) Privacy Policy Annotations with Large Language Models
por: Chanenson, Jake, et al.
Publicado: (2023)
por: Chanenson, Jake, et al.
Publicado: (2023)
SEEKR: Selective Attention-Guided Knowledge Retention for Continual Learning of Large Language Models
por: He, Jinghan, et al.
Publicado: (2024)
por: He, Jinghan, et al.
Publicado: (2024)
Large Language Model Hacking: Quantifying the Hidden Risks of Using LLMs for Text Annotation
por: Baumann, Joachim, et al.
Publicado: (2025)
por: Baumann, Joachim, et al.
Publicado: (2025)
Ejemplares similares
-
Active Model Selection for Large Language Models
por: Durmazkeser, Yavuz, et al.
Publicado: (2025) -
All models are wrong, some are useful: Model Selection with Limited Labels
por: Okanovic, Patrik, et al.
Publicado: (2024) -
Evaluating the Limits of Large Language Models in Multilingual Legal Reasoning
por: Ioannou, Antreas, et al.
Publicado: (2025) -
EntryPrune: Neural Network Feature Selection using First Impressions
por: Zimmer, Felix, et al.
Publicado: (2024) -
Epidemiology of Large Language Models: A Benchmark for Observational Distribution Knowledge
por: Plecko, Drago, et al.
Publicado: (2025)