Context Parametrization with Compositional Adapters
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jukić, Josip, Tutek, Martin, Šnajder, Jan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Disentangling Latent Shifts of In-Context Learning with Weak Supervision
par: Jukić, Josip, et autres
Publié: (2024)
par: Jukić, Josip, et autres
Publié: (2024)
From Robustness to Improved Generalization and Calibration in Pre-trained Language Models
par: Jukić, Josip, et autres
Publié: (2024)
par: Jukić, Josip, et autres
Publié: (2024)
Out-of-Distribution Detection by Leveraging Between-Layer Transformation Smoothness
par: Jelenić, Fran, et autres
Publié: (2023)
par: Jelenić, Fran, et autres
Publié: (2023)
Characterizing Linguistic Shifts in Croatian News via Diachronic Word Embeddings
par: Dukić, David, et autres
Publié: (2025)
par: Dukić, David, et autres
Publié: (2025)
Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis
par: Jukić, Josip
Publié: (2025)
par: Jukić, Josip
Publié: (2025)
Sequence Repetition Enhances Token Embeddings and Improves Sequence Labeling with Decoder-only Language Models
par: Kukić, Matija Luka, et autres
Publié: (2026)
par: Kukić, Matija Luka, et autres
Publié: (2026)
Supervised In-Context Fine-Tuning for Generative Sequence Labeling
par: Dukić, David, et autres
Publié: (2025)
par: Dukić, David, et autres
Publié: (2025)
Claim Check-Worthiness Detection: How Well do LLMs Grasp Annotation Guidelines?
par: Majer, Laura, et autres
Publié: (2024)
par: Majer, Laura, et autres
Publié: (2024)
Looking Right is Sometimes Right: Investigating the Capabilities of Decoder-only LLMs for Sequence Labeling
par: Dukić, David, et autres
Publié: (2024)
par: Dukić, David, et autres
Publié: (2024)
Are ELECTRA's Sentence Embeddings Beyond Repair? The Case of Semantic Textual Similarity
par: Rep, Ivan, et autres
Publié: (2024)
par: Rep, Ivan, et autres
Publié: (2024)
LLMs for Targeted Sentiment in News Headlines: Exploring the Descriptive-Prescriptive Dilemma
par: Juroš, Jana, et autres
Publié: (2024)
par: Juroš, Jana, et autres
Publié: (2024)
CATfOOD: Counterfactual Augmented Training for Improving Out-of-Domain Performance and Calibration
par: Sachdeva, Rachneet, et autres
Publié: (2023)
par: Sachdeva, Rachneet, et autres
Publié: (2023)
What Makes You CLIC: Detection of Croatian Clickbait Headlines
par: Anđelić, Marija, et autres
Publié: (2025)
par: Anđelić, Marija, et autres
Publié: (2025)
REVS: Unlearning Sensitive Information in Language Models via Rank Editing in the Vocabulary Space
par: Ashuach, Tomer, et autres
Publié: (2024)
par: Ashuach, Tomer, et autres
Publié: (2024)
Leveraging Open Information Extraction for More Robust Domain Transfer of Event Trigger Detection
par: Dukić, David, et autres
Publié: (2023)
par: Dukić, David, et autres
Publié: (2023)
TakeLab Retriever: AI-Driven Search Engine for Articles from Croatian News Outlets
par: Dukić, David, et autres
Publié: (2024)
par: Dukić, David, et autres
Publié: (2024)
Measuring Chain of Thought Faithfulness by Unlearning Reasoning Steps
par: Tutek, Martin, et autres
Publié: (2025)
par: Tutek, Martin, et autres
Publié: (2025)
FedMosaic: Federated Retrieval-Augmented Generation via Parametric Adapters
par: Liang, Zhilin, et autres
Publié: (2026)
par: Liang, Zhilin, et autres
Publié: (2026)
Code Prompting Elicits Conditional Reasoning Abilities in Text+Code LLMs
par: Puerto, Haritz, et autres
Publié: (2024)
par: Puerto, Haritz, et autres
Publié: (2024)
PragWorld: A Benchmark Evaluating LLMs' Local World Model under Minimal Linguistic Alterations and Conversational Dynamics
par: Vashistha, Sachin, et autres
Publié: (2025)
par: Vashistha, Sachin, et autres
Publié: (2025)
Reasoning Models Know What's Important, and Encode It in Their Activations
par: Nikankin, Yaniv, et autres
Publié: (2026)
par: Nikankin, Yaniv, et autres
Publié: (2026)
ManagerBench: Evaluating the Safety-Pragmatism Trade-off in Autonomous LLMs
par: Simhi, Adi, et autres
Publié: (2025)
par: Simhi, Adi, et autres
Publié: (2025)
CRISP: Persistent Concept Unlearning via Sparse Autoencoders
par: Ashuach, Tomer, et autres
Publié: (2025)
par: Ashuach, Tomer, et autres
Publié: (2025)
Old Habits Die Hard: How Conversational History Geometrically Traps LLMs
par: Simhi, Adi, et autres
Publié: (2026)
par: Simhi, Adi, et autres
Publié: (2026)
Fixed and Adaptive Simultaneous Machine Translation Strategies Using Adapters
par: Issam, Abderrahmane, et autres
Publié: (2024)
par: Issam, Abderrahmane, et autres
Publié: (2024)
Performance Trade-offs of Optimizing Small Language Models for E-Commerce
par: Licardo, Josip Tomo, et autres
Publié: (2025)
par: Licardo, Josip Tomo, et autres
Publié: (2025)
Context-Parametric Inversion: Why Instruction Finetuning Can Worsen Context Reliance
par: Goyal, Sachin, et autres
Publié: (2024)
par: Goyal, Sachin, et autres
Publié: (2024)
On the Efficacy of Sampling Adapters
par: Meister, Clara, et autres
Publié: (2023)
par: Meister, Clara, et autres
Publié: (2023)
Context Copying Modulation: The Role of Entropy Neurons in Managing Parametric and Contextual Knowledge Conflicts
par: Tighidet, Zineddine, et autres
Publié: (2025)
par: Tighidet, Zineddine, et autres
Publié: (2025)
CLIP-Adapter: Better Vision-Language Models with Feature Adapters
par: Gao, Peng, et autres
Publié: (2021)
par: Gao, Peng, et autres
Publié: (2021)
Findings of the BlackboxNLP 2025 Shared Task: Localizing Circuits and Causal Variables in Language Models
par: Arad, Dana, et autres
Publié: (2025)
par: Arad, Dana, et autres
Publié: (2025)
Learning to Route for Dynamic Adapter Composition in Continual Learning with Language Models
par: Araujo, Vladimir, et autres
Publié: (2024)
par: Araujo, Vladimir, et autres
Publié: (2024)
When Context Leads but Parametric Memory Follows in Large Language Models
par: Tao, Yufei, et autres
Publié: (2024)
par: Tao, Yufei, et autres
Publié: (2024)
Updating Parametric Knowledge with Context Distillation Retains Post-Training Capabilities
par: Padmanabhan, Shankar, et autres
Publié: (2026)
par: Padmanabhan, Shankar, et autres
Publié: (2026)
Limited-Resource Adapters Are Regularizers, Not Linguists
par: Fekete, Marcell, et autres
Publié: (2025)
par: Fekete, Marcell, et autres
Publié: (2025)
The Hidden Space of Transformer Language Adapters
par: Alabi, Jesujoba O., et autres
Publié: (2024)
par: Alabi, Jesujoba O., et autres
Publié: (2024)
Adapters Mixup: Mixing Parameter-Efficient Adapters to Enhance the Adversarial Robustness of Fine-tuned Pre-trained Text Classifiers
par: Nguyen, Tuc, et autres
Publié: (2024)
par: Nguyen, Tuc, et autres
Publié: (2024)
How Training Data Shapes the Use of Parametric and In-Context Knowledge in Language Models
par: Kim, Minsung, et autres
Publié: (2025)
par: Kim, Minsung, et autres
Publié: (2025)
Task-Aware LoRA Adapter Composition via Similarity Retrieval in Vector Databases
par: Adsul, Riya, et autres
Publié: (2026)
par: Adsul, Riya, et autres
Publié: (2026)
Hadamard Adapter: An Extreme Parameter-Efficient Adapter Tuning Method for Pre-trained Language Models
par: Chen, Yuyan, et autres
Publié: (2024)
par: Chen, Yuyan, et autres
Publié: (2024)
Documents similaires
-
Disentangling Latent Shifts of In-Context Learning with Weak Supervision
par: Jukić, Josip, et autres
Publié: (2024) -
From Robustness to Improved Generalization and Calibration in Pre-trained Language Models
par: Jukić, Josip, et autres
Publié: (2024) -
Out-of-Distribution Detection by Leveraging Between-Layer Transformation Smoothness
par: Jelenić, Fran, et autres
Publié: (2023) -
Characterizing Linguistic Shifts in Croatian News via Diachronic Word Embeddings
par: Dukić, David, et autres
Publié: (2025) -
Improving Data and Parameter Efficiency of Neural Language Models Using Representation Analysis
par: Jukić, Josip
Publié: (2025)