On the Limits of LLM Adaptability: Impact of Model-Internalized Priors on Annotation Task Performance
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Casanova, Etienne, Kocielnik, Rafal, Alvarez, R. Michael |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
$δ$-STEAL: LLM Stealing Attack with Local Differential Privacy
par: Dang, Kieu, et autres
Publié: (2025)
par: Dang, Kieu, et autres
Publié: (2025)
Detecting Sleeper Agents in Large Language Models via Semantic Drift Analysis
par: Zanbaghi, Shahin, et autres
Publié: (2025)
par: Zanbaghi, Shahin, et autres
Publié: (2025)
Natural Language Processing: A Comprehensive Practical Guide from Tokenisation to RLHF
par: Arabov, Mullosharaf K.
Publié: (2026)
par: Arabov, Mullosharaf K.
Publié: (2026)
LLM-Guided Task- and Affordance-Level Exploration in Reinforcement Learning
par: Luijkx, Jelle, et autres
Publié: (2025)
par: Luijkx, Jelle, et autres
Publié: (2025)
From Noise to Diversity: Random Embedding Injection in LLM Reasoning
par: Kim, Heejun, et autres
Publié: (2026)
par: Kim, Heejun, et autres
Publié: (2026)
Causal Dimensionality of Transformer Representations: Measurement, Scaling, and Layer Structure
par: Sarkar, Nilesh, et autres
Publié: (2026)
par: Sarkar, Nilesh, et autres
Publié: (2026)
IFMTBench: A Comprehensive Benchmark for Multilingual Translation Instruction Following
par: Sun, Mingrui, et autres
Publié: (2026)
par: Sun, Mingrui, et autres
Publié: (2026)
Fine-tuning of Large Language Models for Constituency Parsing Using a Sequence to Sequence Approach
par: Delgado, Francisco Jose Cortes, et autres
Publié: (2025)
par: Delgado, Francisco Jose Cortes, et autres
Publié: (2025)
Doğal Dil İşlemede Tokenizasyon Standartları ve Ölçümü: Türkçe Üzerinden Büyük Dil Modellerinin Karşılaştırmalı Analizi
par: Bayram, M. Ali, et autres
Publié: (2025)
par: Bayram, M. Ali, et autres
Publié: (2025)
Büyük Dil Modelleri için TR-MMLU Benchmarkı: Performans Değerlendirmesi, Zorluklar ve İyileştirme Fırsatları
par: Bayram, M. Ali, et autres
Publié: (2025)
par: Bayram, M. Ali, et autres
Publié: (2025)
Targeted Lexical Injection: Unlocking Latent Cross-Lingual Alignment in Lugha-Llama via Early-Layer LoRA Fine-Tuning
par: Ngugi, Stanley
Publié: (2025)
par: Ngugi, Stanley
Publié: (2025)
How Human-Like Are Large Language Models? A Register-Aware Linguistic Evaluation Framework
par: Nieth, Björn, et autres
Publié: (2026)
par: Nieth, Björn, et autres
Publié: (2026)
Feature Selection Based on Reinforcement Learning and Hazard State Classification for Magnetic Adhesion Wall-Climbing Robots
par: Ma, Zhen, et autres
Publié: (2025)
par: Ma, Zhen, et autres
Publié: (2025)
SafeAnchor: Preventing Cumulative Safety Erosion in Continual Domain Adaptation of Large Language Models
par: Guo, Dongxin, et autres
Publié: (2026)
par: Guo, Dongxin, et autres
Publié: (2026)
From Prompting to Preference Optimization: A Comparative Study of LLM-based Automated Essay Scoring
par: Nguyen, Minh Hoang, et autres
Publié: (2026)
par: Nguyen, Minh Hoang, et autres
Publié: (2026)
How much do LLMs learn from negative examples?
par: Hamdan, Shadi, et autres
Publié: (2025)
par: Hamdan, Shadi, et autres
Publié: (2025)
Communicative Agents for Slideshow Storytelling Video Generation based on LLMs
par: Fan, Jingxing, et autres
Publié: (2025)
par: Fan, Jingxing, et autres
Publié: (2025)
When Does Content-Based Routing Work? Representation Requirements for Selective Attention in Hybrid Sequence Models
par: Basu, Abhinaba
Publié: (2026)
par: Basu, Abhinaba
Publié: (2026)
NOTAI.AI: Explainable Detection of Machine-Generated Text via Curvature and Feature Attribution
par: Breneur, Oleksandr Marchenko, et autres
Publié: (2026)
par: Breneur, Oleksandr Marchenko, et autres
Publié: (2026)
Rethinking the Multilingual Reasoning Gap with Layer Swap
par: Lasbordes, Maxence, et autres
Publié: (2026)
par: Lasbordes, Maxence, et autres
Publié: (2026)
A Confidence-Diversity Framework for Calibrating AI Judgement in Accessible Qualitative Coding Tasks
par: Zhao, Zhilong, et autres
Publié: (2025)
par: Zhao, Zhilong, et autres
Publié: (2025)
CLEV: LLM-Based Evaluation Through Lightweight Efficient Voting for Free-Form Question-Answering
par: Badshah, Sher, et autres
Publié: (2025)
par: Badshah, Sher, et autres
Publié: (2025)
Mubeen AI: A Specialized Arabic Language Model for Heritage Preservation and User Intent Understanding
par: Aljafari, Mohammed, et autres
Publié: (2025)
par: Aljafari, Mohammed, et autres
Publié: (2025)
NeuroState-Bench: A Human-Calibrated Benchmark for Commitment Integrity in LLM Agent Profiles
par: Jia, Xiao
Publié: (2026)
par: Jia, Xiao
Publié: (2026)
Tool-Genesis: A Task-Driven Tool Creation Benchmark for Self-Evolving Language Agent
par: Xia, Bowei, et autres
Publié: (2026)
par: Xia, Bowei, et autres
Publié: (2026)
lmfaoooo at SemEval-2026 Task 1: Humor Is an Audience. Preference Modeling for Constrained Humor Generation
par: Tikhonov, Alexey, et autres
Publié: (2026)
par: Tikhonov, Alexey, et autres
Publié: (2026)
Constitution or Collapse? Exploring Constitutional AI with Llama 3-8B
par: Zhang, Xue
Publié: (2025)
par: Zhang, Xue
Publié: (2025)
XAutoLM: Efficient Fine-Tuning of Language Models via Meta-Learning and AutoML
par: Estevanell-Valladares, Ernesto L., et autres
Publié: (2025)
par: Estevanell-Valladares, Ernesto L., et autres
Publié: (2025)
Improved ICNN-LSTM Model Classification Based on Attitude Sensor Data for Hazardous State Assessment of Magnetic Adhesion Climbing Wall Robots
par: Ma, Zhen, et autres
Publié: (2024)
par: Ma, Zhen, et autres
Publié: (2024)
Learning What Matters: Probabilistic Task Selection via Mutual Information for Model Finetuning
par: Chanda, Prateek, et autres
Publié: (2025)
par: Chanda, Prateek, et autres
Publié: (2025)
Structure and Destructure: Dual Forces in the Making of Knowledge Engines
par: Chen, Yihong
Publié: (2025)
par: Chen, Yihong
Publié: (2025)
Beyond Subtokens: A Rich Character Embedding for Low-resource and Morphologically Complex Languages
par: Schneider, Felix, et autres
Publié: (2026)
par: Schneider, Felix, et autres
Publié: (2026)
Harnessing non-adversarial robustness in large language models
par: Zhou, Qinghua, et autres
Publié: (2026)
par: Zhou, Qinghua, et autres
Publié: (2026)
CLMN: Concept based Language Models via Neural Symbolic Reasoning
par: Yang, Yibo
Publié: (2025)
par: Yang, Yibo
Publié: (2025)
Word Overuse and Alignment in Large Language Models: The Influence of Learning from Human Feedback
par: Juzek, Tom S., et autres
Publié: (2025)
par: Juzek, Tom S., et autres
Publié: (2025)
Breaking to Build: A Threat Model of Prompt-Based Attacks for Securing LLMs
par: Hill, Brennen, et autres
Publié: (2025)
par: Hill, Brennen, et autres
Publié: (2025)
Improving Commonsense Bias Classification by Mitigating the Influence of Demographic Terms
par: Lee, JinKyu, et autres
Publié: (2024)
par: Lee, JinKyu, et autres
Publié: (2024)
Causally Grounded Mechanistic Interpretability for LLMs with Faithful Natural-Language Explanations
par: Mahale, Ajay Pravin
Publié: (2026)
par: Mahale, Ajay Pravin
Publié: (2026)
Semantic Convergence: Investigating Shared Representations Across Scaled LLMs
par: Son, Daniel, et autres
Publié: (2025)
par: Son, Daniel, et autres
Publié: (2025)
Towards Ontology-Enhanced Representation Learning for Large Language Models
par: Ronzano, Francesco, et autres
Publié: (2024)
par: Ronzano, Francesco, et autres
Publié: (2024)
Documents similaires
-
$δ$-STEAL: LLM Stealing Attack with Local Differential Privacy
par: Dang, Kieu, et autres
Publié: (2025) -
Detecting Sleeper Agents in Large Language Models via Semantic Drift Analysis
par: Zanbaghi, Shahin, et autres
Publié: (2025) -
Natural Language Processing: A Comprehensive Practical Guide from Tokenisation to RLHF
par: Arabov, Mullosharaf K.
Publié: (2026) -
LLM-Guided Task- and Affordance-Level Exploration in Reinforcement Learning
par: Luijkx, Jelle, et autres
Publié: (2025) -
From Noise to Diversity: Random Embedding Injection in LLM Reasoning
par: Kim, Heejun, et autres
Publié: (2026)