Compact Example-Based Explanations for Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Schoenegger, Loris, Roth, Benjamin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Select or Project? Evaluating Lower-dimensional Vectors for LLM Training Data Explanations
par: Hinterleitner, Lukas, et autres
Publié: (2026)
par: Hinterleitner, Lukas, et autres
Publié: (2026)
Influence-driven Curriculum Learning for Pre-training on Limited Data
par: Schoenegger, Loris, et autres
Publié: (2025)
par: Schoenegger, Loris, et autres
Publié: (2025)
Large Language Model (LLM) Bias Index -- LLMBI
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)
Engineering A Large Language Model From Scratch
par: Oketunji, Abiodun Finbarrs
Publié: (2024)
par: Oketunji, Abiodun Finbarrs
Publié: (2024)
Integrating Expert Labels into LLM-based Emission Goal Detection: Example Selection vs Automatic Prompt Design
par: Wrzalik, Marco, et autres
Publié: (2024)
par: Wrzalik, Marco, et autres
Publié: (2024)
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
par: Fadli, Samih
Publié: (2025)
par: Fadli, Samih
Publié: (2025)
Annotation Entropy Predicts Per-Example Learning Dynamics in LoRA Fine-Tuning
par: Steele, Brady
Publié: (2026)
par: Steele, Brady
Publié: (2026)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
par: Oketunji, Abiodun Finbarrs
Publié: (2023)
par: Oketunji, Abiodun Finbarrs
Publié: (2023)
RBCorr: Response Bias Correction in Language Models
par: Bhatt, Om, et autres
Publié: (2026)
par: Bhatt, Om, et autres
Publié: (2026)
Ensemble Language Models for Multilingual Sentiment Analysis
par: Hasan, Md Arid
Publié: (2024)
par: Hasan, Md Arid
Publié: (2024)
On the Effect of (Near) Duplicate Subwords in Language Modelling
par: Schäfer, Anton, et autres
Publié: (2024)
par: Schäfer, Anton, et autres
Publié: (2024)
Constraint-Driven Small Language Models Based on Agent and OpenAlex Knowledge Graph: Mining Conceptual Pathways and Discovering Innovation Points in Academic Papers
par: Xia, Ziye, et autres
Publié: (2025)
par: Xia, Ziye, et autres
Publié: (2025)
The Open Source Advantage in Large Language Models (LLMs)
par: Manchanda, Jiya, et autres
Publié: (2024)
par: Manchanda, Jiya, et autres
Publié: (2024)
HYPEROFA: Expanding LLM Vocabulary to New Languages via Hypernetwork-Based Embedding Initialization
par: Özeren, Enes, et autres
Publié: (2025)
par: Özeren, Enes, et autres
Publié: (2025)
Improving the Capabilities of Large Language Model Based Marketing Analytics Copilots With Semantic Search And Fine-Tuning
par: Gao, Yilin, et autres
Publié: (2024)
par: Gao, Yilin, et autres
Publié: (2024)
MMSciBench: Benchmarking Language Models on Chinese Multimodal Scientific Problems
par: Ye, Xinwu, et autres
Publié: (2025)
par: Ye, Xinwu, et autres
Publié: (2025)
Scaling Laws for Forgetting When Fine-Tuning Large Language Models
par: Kalajdzievski, Damjan
Publié: (2024)
par: Kalajdzievski, Damjan
Publié: (2024)
Distilling Robustness into Natural Language Inference Models with Domain-Targeted Augmentation
par: Stacey, Joe, et autres
Publié: (2023)
par: Stacey, Joe, et autres
Publié: (2023)
Sparsing Law: Towards Large Language Models with Greater Activation Sparsity
par: Luo, Yuqi, et autres
Publié: (2024)
par: Luo, Yuqi, et autres
Publié: (2024)
MedFuzz: Exploring the Robustness of Large Language Models in Medical Question Answering
par: Ness, Robert Osazuwa, et autres
Publié: (2024)
par: Ness, Robert Osazuwa, et autres
Publié: (2024)
From Facts to Folklore: Evaluating Large Language Models on Bengali Cultural Knowledge
par: Chowdhury, Nafis, et autres
Publié: (2025)
par: Chowdhury, Nafis, et autres
Publié: (2025)
Language Models Are Implicitly Continuous
par: Marro, Samuele, et autres
Publié: (2025)
par: Marro, Samuele, et autres
Publié: (2025)
Where Should LoRA Go? Component-Type Placement in Hybrid Language Models
par: Borobia, Hector, et autres
Publié: (2026)
par: Borobia, Hector, et autres
Publié: (2026)
Context-Aware Clustering using Large Language Models
par: Tipirneni, Sindhu, et autres
Publié: (2024)
par: Tipirneni, Sindhu, et autres
Publié: (2024)
Combining Language and Topic Models for Hierarchical Text Classification
par: Toit, Jaco du, et autres
Publié: (2025)
par: Toit, Jaco du, et autres
Publié: (2025)
The Role of Language Imbalance in Cross-lingual Generalisation: Insights from Cloned Language Experiments
par: Schäfer, Anton, et autres
Publié: (2024)
par: Schäfer, Anton, et autres
Publié: (2024)
Memory Bank Compression for Continual Adaptation of Large Language Models
par: Katraouras, Thomas, et autres
Publié: (2026)
par: Katraouras, Thomas, et autres
Publié: (2026)
RightNow-Arabic-0.5B-Turbo: An Open Sub-1B Arabic Language Model via Vocabulary Injection and Edge-First Deployment
par: Jaber, Jaber, et autres
Publié: (2026)
par: Jaber, Jaber, et autres
Publié: (2026)
Rethinking Addressing in Language Models via Contexualized Equivariant Positional Encoding
par: Zhu, Jiajun, et autres
Publié: (2025)
par: Zhu, Jiajun, et autres
Publié: (2025)
Kronecker Embeddings: Byte-Level Structured Token Representations for Parameter-Efficient Language Models
par: Shravan, Rohan
Publié: (2026)
par: Shravan, Rohan
Publié: (2026)
How Language Models Process Out-of-Distribution Inputs: A Two-Pathway Framework
par: Saghir, Hamidreza
Publié: (2026)
par: Saghir, Hamidreza
Publié: (2026)
Efficacy of ByT5 in Multilingual Translation of Biblical Texts for Underrepresented Languages
par: Aars, Corinne, et autres
Publié: (2024)
par: Aars, Corinne, et autres
Publié: (2024)
Linguistically-Informed Multilingual Instruction Tuning: Is There an Optimal Set of Languages to Tune?
par: Soykan, Gürkan, et autres
Publié: (2024)
par: Soykan, Gürkan, et autres
Publié: (2024)
Neural Activation Patterns Across Language Model Architectures: A Comprehensive Analysis of Cognitive Task Performance
par: Naser-Moghadasi, Mahdi, et autres
Publié: (2026)
par: Naser-Moghadasi, Mahdi, et autres
Publié: (2026)
KenSwQuAD -- A Question Answering Dataset for Swahili Low Resource Language
par: Wanjawa, Barack W., et autres
Publié: (2022)
par: Wanjawa, Barack W., et autres
Publié: (2022)
Adversarial Lens: Exploiting Attention Layers to Generate Adversarial Examples for Evaluation
par: Dhole, Kaustubh
Publié: (2025)
par: Dhole, Kaustubh
Publié: (2025)
Future Token Prediction -- Causal Language Modelling with Per-Token Semantic State Vector for Multi-Token Prediction
par: Walker, Nicholas
Publié: (2024)
par: Walker, Nicholas
Publié: (2024)
Robust Explanations for User Trust in Enterprise NLP Systems
par: Zhang, Guilin, et autres
Publié: (2026)
par: Zhang, Guilin, et autres
Publié: (2026)
Your Pretrained Model Tells the Difficulty Itself: A Self-Adaptive Curriculum Learning Paradigm for Natural Language Understanding
par: Feng, Qi, et autres
Publié: (2025)
par: Feng, Qi, et autres
Publié: (2025)
KyrgyzBERT: A Compact, Efficient Language Model for Kyrgyz NLP
par: Metinov, Adilet, et autres
Publié: (2025)
par: Metinov, Adilet, et autres
Publié: (2025)
Documents similaires
-
Select or Project? Evaluating Lower-dimensional Vectors for LLM Training Data Explanations
par: Hinterleitner, Lukas, et autres
Publié: (2026) -
Influence-driven Curriculum Learning for Pre-training on Limited Data
par: Schoenegger, Loris, et autres
Publié: (2025) -
Large Language Model (LLM) Bias Index -- LLMBI
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023) -
Engineering A Large Language Model From Scratch
par: Oketunji, Abiodun Finbarrs
Publié: (2024) -
Integrating Expert Labels into LLM-based Emission Goal Detection: Example Selection vs Automatic Prompt Design
par: Wrzalik, Marco, et autres
Publié: (2024)