Using tournaments to calculate AUROC for zero-shot classification with LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yoon, WonJin, Bulovic, Ian, Miller, Timothy A. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CLSGen: A Dual-Head Fine-Tuning Framework for Joint Probabilistic Classification and Verbalized Explanation
par: Yoon, WonJin, et autres
Publié: (2026)
par: Yoon, WonJin, et autres
Publié: (2026)
Aspect-Oriented Summarization for Psychiatric Short-Term Readmission Prediction
par: Yoon, WonJin, et autres
Publié: (2025)
par: Yoon, WonJin, et autres
Publié: (2025)
LAMPER: LanguAge Model and Prompt EngineeRing for zero-shot time series classification
par: Du, Zhicheng, et autres
Publié: (2024)
par: Du, Zhicheng, et autres
Publié: (2024)
A comparative study of zero-shot inference with large language models and supervised modeling in breast cancer pathology classification
par: Sushil, Madhumita, et autres
Publié: (2024)
par: Sushil, Madhumita, et autres
Publié: (2024)
CCQA: Generating Question from Solution Can Improve Inference-Time Reasoning in SLMs
par: Kim, Jin Young, et autres
Publié: (2025)
par: Kim, Jin Young, et autres
Publié: (2025)
Zero-shot data citation function classification using transformer-based large language models (LLMs)
par: Byers, Neil, et autres
Publié: (2025)
par: Byers, Neil, et autres
Publié: (2025)
Zero-shot Sentiment Analysis in Low-Resource Languages Using a Multilingual Sentiment Lexicon
par: Koto, Fajri, et autres
Publié: (2024)
par: Koto, Fajri, et autres
Publié: (2024)
DiZiNER: Disagreement-guided Instruction Refinement via Pilot Annotation Simulation for Zero-shot Named Entity Recognition
par: Kim, Siun, et autres
Publié: (2026)
par: Kim, Siun, et autres
Publié: (2026)
Empirical study of pretrained multilingual language models for zero-shot cross-lingual knowledge transfer in generation
par: Chirkova, Nadezhda, et autres
Publié: (2023)
par: Chirkova, Nadezhda, et autres
Publié: (2023)
Effectiveness of Zero-shot-CoT in Japanese Prompts
par: Takayama, Shusuke, et autres
Publié: (2025)
par: Takayama, Shusuke, et autres
Publié: (2025)
Zero-shot Slot Filling in the Age of LLMs for Dialogue Systems
par: Rana, Mansi, et autres
Publié: (2024)
par: Rana, Mansi, et autres
Publié: (2024)
Evaluating and explaining training strategies for zero-shot cross-lingual news sentiment analysis
par: Andrenšek, Luka, et autres
Publié: (2024)
par: Andrenšek, Luka, et autres
Publié: (2024)
Key ingredients for effective zero-shot cross-lingual knowledge transfer in generative tasks
par: Chirkova, Nadezhda, et autres
Publié: (2024)
par: Chirkova, Nadezhda, et autres
Publié: (2024)
Analysing zero-shot temporal relation extraction on clinical notes using temporal consistency
par: Kougia, Vasiliki, et autres
Publié: (2024)
par: Kougia, Vasiliki, et autres
Publié: (2024)
Prefill-Guided Thinking for zero-shot detection of AI-generated images
par: Kachwala, Zoher, et autres
Publié: (2025)
par: Kachwala, Zoher, et autres
Publié: (2025)
Scalable and consistent few-shot classification of survey responses using text embeddings
par: Mjaaland, Jonas Timmann, et autres
Publié: (2025)
par: Mjaaland, Jonas Timmann, et autres
Publié: (2025)
Scaling few-shot spoken word classification with generative meta-continual learning
par: Beyers, Louise, et autres
Publié: (2026)
par: Beyers, Louise, et autres
Publié: (2026)
PETapter: Leveraging PET-style classification heads for modular few-shot parameter-efficient fine-tuning
par: Rieger, Jonas, et autres
Publié: (2024)
par: Rieger, Jonas, et autres
Publié: (2024)
Can Prompting LLMs Unlock Hate Speech Detection across Languages? A Zero-shot and Few-shot Study
par: Ghorbanpour, Faeze, et autres
Publié: (2025)
par: Ghorbanpour, Faeze, et autres
Publié: (2025)
Zero-shot and Few-shot Learning with Instruction-following LLMs for Claim Matching in Automated Fact-checking
par: Pisarevskaya, Dina, et autres
Publié: (2025)
par: Pisarevskaya, Dina, et autres
Publié: (2025)
Assessing LLMs for Zero-shot Abstractive Summarization Through the Lens of Relevance Paraphrasing
par: Askari, Hadi, et autres
Publié: (2024)
par: Askari, Hadi, et autres
Publié: (2024)
SEPS: A Separability Measure for Robust Unlearning in LLMs
par: Jeung, Wonje, et autres
Publié: (2025)
par: Jeung, Wonje, et autres
Publié: (2025)
Zero-shot prompt-based classification: topic labeling in times of foundation models in German Tweets
par: Münker, Simon, et autres
Publié: (2024)
par: Münker, Simon, et autres
Publié: (2024)
Team LA at SCIDOCA shared task 2025: Citation Discovery via relation-based zero-shot retrieval
par: An, Trieu, et autres
Publié: (2025)
par: An, Trieu, et autres
Publié: (2025)
KG-HTC: Integrating Knowledge Graphs into LLMs for Effective Zero-shot Hierarchical Text Classification
par: Zang, Qianbo, et autres
Publié: (2025)
par: Zang, Qianbo, et autres
Publié: (2025)
Evaluating the fairness of task-adaptive pretraining on unlabeled test data before few-shot text classification
par: Dubey, Kush
Publié: (2024)
par: Dubey, Kush
Publié: (2024)
Can Video LLMs Refuse to Answer? Alignment for Answerability in Video Large Language Models
par: Yoon, Eunseop, et autres
Publié: (2025)
par: Yoon, Eunseop, et autres
Publié: (2025)
SpeechLLMs for Large-scale Contextualized Zero-shot Slot Filling
par: Hacioglu, Kadri, et autres
Publié: (2025)
par: Hacioglu, Kadri, et autres
Publié: (2025)
Zero-shot Graph Reasoning via Retrieval Augmented Framework with LLMs
par: Li, Hanqing, et autres
Publié: (2025)
par: Li, Hanqing, et autres
Publié: (2025)
Surrogate modeling for interpreting black-box LLMs in medical predictions
par: Han, Changho, et autres
Publié: (2026)
par: Han, Changho, et autres
Publié: (2026)
Few-shot Personalization of LLMs with Mis-aligned Responses
par: Kim, Jaehyung, et autres
Publié: (2024)
par: Kim, Jaehyung, et autres
Publié: (2024)
LLM economicus? Mapping the Behavioral Biases of LLMs via Utility Theory
par: Ross, Jillian, et autres
Publié: (2024)
par: Ross, Jillian, et autres
Publié: (2024)
AdpQ: A Zero-shot Calibration Free Adaptive Post Training Quantization Method for LLMs
par: Ghaffari, Alireza, et autres
Publié: (2024)
par: Ghaffari, Alireza, et autres
Publié: (2024)
Few shot chain-of-thought driven reasoning to prompt LLMs for open ended medical question answering
par: Nachane, Saeel Sandeep, et autres
Publié: (2024)
par: Nachane, Saeel Sandeep, et autres
Publié: (2024)
Consistency Guided Knowledge Retrieval and Denoising in LLMs for Zero-shot Document-level Relation Triplet Extraction
par: Sun, Qi, et autres
Publié: (2024)
par: Sun, Qi, et autres
Publié: (2024)
Identifying Task Groupings for Multi-Task Learning Using Pointwise V-Usable Information
par: Li, Yingya, et autres
Publié: (2024)
par: Li, Yingya, et autres
Publié: (2024)
Social Construction of Urban Space: Using LLMs to Identify Neighborhood Boundaries From Craigslist Ads
par: Visokay, Adam, et autres
Publié: (2025)
par: Visokay, Adam, et autres
Publié: (2025)
EHRNoteQA: An LLM Benchmark for Real-World Clinical Practice Using Discharge Summaries
par: Kweon, Sunjun, et autres
Publié: (2024)
par: Kweon, Sunjun, et autres
Publié: (2024)
Exploring the Potential of LLMs as Personalized Assistants: Dataset, Evaluation, and Analysis
par: Mok, Jisoo, et autres
Publié: (2025)
par: Mok, Jisoo, et autres
Publié: (2025)
Long-Context LLMs Meet RAG: Overcoming Challenges for Long Inputs in RAG
par: Jin, Bowen, et autres
Publié: (2024)
par: Jin, Bowen, et autres
Publié: (2024)
Documents similaires
-
CLSGen: A Dual-Head Fine-Tuning Framework for Joint Probabilistic Classification and Verbalized Explanation
par: Yoon, WonJin, et autres
Publié: (2026) -
Aspect-Oriented Summarization for Psychiatric Short-Term Readmission Prediction
par: Yoon, WonJin, et autres
Publié: (2025) -
LAMPER: LanguAge Model and Prompt EngineeRing for zero-shot time series classification
par: Du, Zhicheng, et autres
Publié: (2024) -
A comparative study of zero-shot inference with large language models and supervised modeling in breast cancer pathology classification
par: Sushil, Madhumita, et autres
Publié: (2024) -
CCQA: Generating Question from Solution Can Improve Inference-Time Reasoning in SLMs
par: Kim, Jin Young, et autres
Publié: (2025)