In-Context Learning on a Budget: A Case Study in Token Classification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Berger, Uri, Baumel, Tal, Stanovsky, Gabriel |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Time to Talk: LLM Agents for Asynchronous Group Communication in Mafia Games
par: Eckhaus, Niv, et autres
Publié: (2025)
par: Eckhaus, Niv, et autres
Publié: (2025)
Surveying the Landscape of Image Captioning Evaluation: A Comprehensive Taxonomy, Trends and Metrics Analysis
par: Berger, Uri, et autres
Publié: (2024)
par: Berger, Uri, et autres
Publié: (2024)
Improving Image Captioning by Mimicking Human Reformulation Feedback at Inference-time
par: Berger, Uri, et autres
Publié: (2025)
par: Berger, Uri, et autres
Publié: (2025)
SAUCE: Synchronous and Asynchronous User-Customizable Environment for Multi-Agent LLM Interaction
par: Neuberger, Shlomo, et autres
Publié: (2024)
par: Neuberger, Shlomo, et autres
Publié: (2024)
Planted in Pretraining, Swayed by Finetuning: A Case Study on the Origins of Cognitive Biases in LLMs
par: Itzhak, Itay, et autres
Publié: (2025)
par: Itzhak, Itay, et autres
Publié: (2025)
The State and Fate of Summarization Datasets: A Survey
par: Dahan, Noam, et autres
Publié: (2024)
par: Dahan, Noam, et autres
Publié: (2024)
Do Zombies Understand? A Choose-Your-Own-Adventure Exploration of Machine Cognition
par: Goldstein, Ariel, et autres
Publié: (2024)
par: Goldstein, Ariel, et autres
Publié: (2024)
Comparing Humans and Models on a Similar Scale: Towards Cognitive Gender Bias Evaluation in Coreference Resolution
par: Lior, Gili, et autres
Publié: (2023)
par: Lior, Gili, et autres
Publié: (2023)
Looking Beyond The Top-1: Transformers Determine Top Tokens In Order
par: Lioubashevski, Daria, et autres
Publié: (2024)
par: Lioubashevski, Daria, et autres
Publié: (2024)
Leveraging Collection-Wide Similarities for Unsupervised Document Structure Extraction
par: Lior, Gili, et autres
Publié: (2024)
par: Lior, Gili, et autres
Publié: (2024)
Leveraging Digitized Newspapers to Collect Summarization Data in Low-Resource Languages
par: Dahan, Noam, et autres
Publié: (2025)
par: Dahan, Noam, et autres
Publié: (2025)
Beyond Memorization: Distinguishing between Reductive and Epistemic Reasoning in LLMs using Classic Logic Puzzles
par: Gabay, Adi, et autres
Publié: (2026)
par: Gabay, Adi, et autres
Publié: (2026)
Multilingual Large Language Models and Curse of Multilinguality
par: Gurgurov, Daniil, et autres
Publié: (2024)
par: Gurgurov, Daniil, et autres
Publié: (2024)
PromptSuite: A Task-Agnostic Framework for Multi-Prompt Generation
par: Habba, Eliya, et autres
Publié: (2025)
par: Habba, Eliya, et autres
Publié: (2025)
Comparing the Framing Effect in Humans and LLMs on Naturally Occurring Texts
par: Lior, Gili, et autres
Publié: (2025)
par: Lior, Gili, et autres
Publié: (2025)
Controllable Synthetic Clinical Note Generation with Privacy Guarantees
par: Baumel, Tal, et autres
Publié: (2024)
par: Baumel, Tal, et autres
Publié: (2024)
PRISM: PRIor from corpus Statistics for topic Modeling
par: Ishon, Tal, et autres
Publié: (2026)
par: Ishon, Tal, et autres
Publié: (2026)
Applying Intrinsic Debiasing on Downstream Tasks: Challenges and Considerations for Machine Translation
par: Iluz, Bar, et autres
Publié: (2024)
par: Iluz, Bar, et autres
Publié: (2024)
Cross-Lingual and Cross-Cultural Variation in Image Descriptions
par: Berger, Uri, et autres
Publié: (2024)
par: Berger, Uri, et autres
Publié: (2024)
ReliableEval: A Recipe for Stochastic LLM Evaluation via Method of Moments
par: Lior, Gili, et autres
Publié: (2025)
par: Lior, Gili, et autres
Publié: (2025)
In-Context Learning with Long-Context Models: An In-Depth Exploration
par: Bertsch, Amanda, et autres
Publié: (2024)
par: Bertsch, Amanda, et autres
Publié: (2024)
More Documents, Same Length: Isolating the Challenge of Multiple Documents in RAG
par: Levy, Shahar, et autres
Publié: (2025)
par: Levy, Shahar, et autres
Publié: (2025)
Can LLMs Help Uncover Insights about LLMs? A Large-Scale, Evolving Literature Analysis of Frontier LLMs
par: Park, Jungsoo, et autres
Publié: (2025)
par: Park, Jungsoo, et autres
Publié: (2025)
Learning Metadata-Agnostic Representations for Text-to-SQL In-Context Example Selection
par: Mai, Chuhong, et autres
Publié: (2024)
par: Mai, Chuhong, et autres
Publié: (2024)
SEAM: A Stochastic Benchmark for Multi-Document Tasks
par: Lior, Gili, et autres
Publié: (2024)
par: Lior, Gili, et autres
Publié: (2024)
State of What Art? A Call for Multi-Prompt LLM Evaluation
par: Mizrahi, Moran, et autres
Publié: (2023)
par: Mizrahi, Moran, et autres
Publié: (2023)
Emotion Classification In-Context in Spanish
par: Thapa, Bipul, et autres
Publié: (2025)
par: Thapa, Bipul, et autres
Publié: (2025)
Anticipatory Evaluation of Language Models
par: Park, Jungsoo, et autres
Publié: (2025)
par: Park, Jungsoo, et autres
Publié: (2025)
Beyond Benchmarks: On The False Promise of AI Regulation
par: Stanovsky, Gabriel, et autres
Publié: (2025)
par: Stanovsky, Gabriel, et autres
Publié: (2025)
From Feelings to Metrics: Understanding and Formalizing How Users Vibe-Test LLMs
par: Itzhak, Itay, et autres
Publié: (2026)
par: Itzhak, Itay, et autres
Publié: (2026)
Token-Budget-Aware LLM Reasoning
par: Han, Tingxu, et autres
Publié: (2024)
par: Han, Tingxu, et autres
Publié: (2024)
In-context Learning Generalizes, But Not Always Robustly: The Case of Syntax
par: Mueller, Aaron, et autres
Publié: (2023)
par: Mueller, Aaron, et autres
Publié: (2023)
Reasoning in Token Economies: Budget-Aware Evaluation of LLM Reasoning Strategies
par: Wang, Junlin, et autres
Publié: (2024)
par: Wang, Junlin, et autres
Publié: (2024)
ScheMatiQ: From Research Question to Structured Data through Interactive Schema Discovery
par: Levy, Shahar, et autres
Publié: (2026)
par: Levy, Shahar, et autres
Publié: (2026)
Schema-Driven Information Extraction from Heterogeneous Tables
par: Bai, Fan, et autres
Publié: (2023)
par: Bai, Fan, et autres
Publié: (2023)
Evaluating In-Context Translation with Synchronous Context-Free Grammar Transduction
par: Petty, Jackson, et autres
Publié: (2026)
par: Petty, Jackson, et autres
Publié: (2026)
AdaGReS:Adaptive Greedy Context Selection via Redundancy-Aware Scoring for Token-Budgeted RAG
par: Peng, Chao, et autres
Publié: (2025)
par: Peng, Chao, et autres
Publié: (2025)
Language Models Struggle to Use Representations Learned In-Context
par: Lepori, Michael A., et autres
Publié: (2026)
par: Lepori, Michael A., et autres
Publié: (2026)
A Nurse is Blue and Elephant is Rugby: Cross Domain Alignment in Large Language Models Reveal Human-like Patterns
par: Yehudai, Asaf, et autres
Publié: (2024)
par: Yehudai, Asaf, et autres
Publié: (2024)
Dual-Pool Token-Budget Routing for Cost-Efficient and Reliable LLM Serving
par: Liu, Xunzhuo, et autres
Publié: (2026)
par: Liu, Xunzhuo, et autres
Publié: (2026)
Documents similaires
-
Time to Talk: LLM Agents for Asynchronous Group Communication in Mafia Games
par: Eckhaus, Niv, et autres
Publié: (2025) -
Surveying the Landscape of Image Captioning Evaluation: A Comprehensive Taxonomy, Trends and Metrics Analysis
par: Berger, Uri, et autres
Publié: (2024) -
Improving Image Captioning by Mimicking Human Reformulation Feedback at Inference-time
par: Berger, Uri, et autres
Publié: (2025) -
SAUCE: Synchronous and Asynchronous User-Customizable Environment for Multi-Agent LLM Interaction
par: Neuberger, Shlomo, et autres
Publié: (2024) -
Planted in Pretraining, Swayed by Finetuning: A Case Study on the Origins of Cognitive Biases in LLMs
par: Itzhak, Itay, et autres
Publié: (2025)