CANARY: Zero-Label Detection of Fine-Tuning Contamination in Language Models
Fuente:
arXiv
Saved in:
| Main Author: | Parekh, Swapnil |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Drop the Act: Probe-Filtered RL for Faithful Chain-of-Thought Reasoning
by: Parekh, Swapnil
Published: (2026)
by: Parekh, Swapnil
Published: (2026)
Thinking Wrong in Silence: Backdoor Attacks on Continuous Latent Reasoning
by: Parekh, Swapnil
Published: (2026)
by: Parekh, Swapnil
Published: (2026)
CIRCUS: Circuit Consensus under Uncertainty via Stability Ensembles
by: Parekh, Swapnil
Published: (2026)
by: Parekh, Swapnil
Published: (2026)
Scaling Pretrained Representations Enables Label-Free Out-of-Distribution Detection Without Fine-Tuning
by: Barkley, Brett, et al.
Published: (2026)
by: Barkley, Brett, et al.
Published: (2026)
Fine-Tuning Pre-trained Language Models to Detect In-Game Trash Talks
by: Fesalbon, Daniel, et al.
Published: (2024)
by: Fesalbon, Daniel, et al.
Published: (2024)
Efficient and Versatile Robust Fine-Tuning of Zero-shot Models
by: Kim, Sungyeon, et al.
Published: (2024)
by: Kim, Sungyeon, et al.
Published: (2024)
Data Contamination Quiz: A Tool to Detect and Estimate Contamination in Large Language Models
by: Golchin, Shahriar, et al.
Published: (2023)
by: Golchin, Shahriar, et al.
Published: (2023)
Domain-Adapted Fine-Tuning of ECG Foundation Models for Multi-Label Structural Heart Disease Screening
by: Do, Duc N., et al.
Published: (2026)
by: Do, Duc N., et al.
Published: (2026)
Self-Generative Adversarial Fine-Tuning for Large Language Models
by: Wu, Shiguang, et al.
Published: (2026)
by: Wu, Shiguang, et al.
Published: (2026)
Diversity in Large Language Models under Supervised Fine-Tuning
by: Klypa, Roman, et al.
Published: (2026)
by: Klypa, Roman, et al.
Published: (2026)
Decentralized Low-Rank Fine-Tuning of Large Language Models
by: Ghiasvand, Sajjad, et al.
Published: (2025)
by: Ghiasvand, Sajjad, et al.
Published: (2025)
Sparse Gradient Compression for Fine-Tuning Large Language Models
by: Yang, David H., et al.
Published: (2025)
by: Yang, David H., et al.
Published: (2025)
Less but Better: Parameter-Efficient Fine-Tuning of Large Language Models for Personality Detection
by: Shen, Lingzhi, et al.
Published: (2025)
by: Shen, Lingzhi, et al.
Published: (2025)
Beyond Zero Initialization: Investigating the Impact of Non-Zero Initialization on LoRA Fine-Tuning Dynamics
by: Li, Shiwei, et al.
Published: (2025)
by: Li, Shiwei, et al.
Published: (2025)
Keeping Code-Aware LLMs Fresh: Full Refresh, In-Context Deltas, and Incremental Fine-Tuning
by: Sharma, Pradeep Kumar, et al.
Published: (2025)
by: Sharma, Pradeep Kumar, et al.
Published: (2025)
Linearization Explains Fine-Tuning in Large Language Models
by: Afzal, Zahra Rahimi, et al.
Published: (2026)
by: Afzal, Zahra Rahimi, et al.
Published: (2026)
Continual Fine-Tuning of Large Language Models via Program Memory
by: Le, Hung, et al.
Published: (2026)
by: Le, Hung, et al.
Published: (2026)
Matching Features, Not Tokens: Energy-Based Fine-Tuning of Language Models
by: Jelassi, Samy, et al.
Published: (2026)
by: Jelassi, Samy, et al.
Published: (2026)
Fine-Tuned Language Models as Space Systems Controllers
by: Zucchelli, Enrico M., et al.
Published: (2025)
by: Zucchelli, Enrico M., et al.
Published: (2025)
Fine-Tuning Language Models with Just Forward Passes
by: Malladi, Sadhika, et al.
Published: (2023)
by: Malladi, Sadhika, et al.
Published: (2023)
Dissecting Fine-Tuning Unlearning in Large Language Models
by: Hong, Yihuai, et al.
Published: (2024)
by: Hong, Yihuai, et al.
Published: (2024)
Security Vulnerability Detection with Multitask Self-Instructed Fine-Tuning of Large Language Models
by: Yang, Aidan Z. H., et al.
Published: (2024)
by: Yang, Aidan Z. H., et al.
Published: (2024)
Goal-Driven Adaptive Sampling Strategies for Machine Learning Models Predicting Fields
by: Parekh, Jigar, et al.
Published: (2026)
by: Parekh, Jigar, et al.
Published: (2026)
Tangent Space Fine-Tuning for Directional Preference Alignment in Large Language Models
by: Erdogan, Mete
Published: (2026)
by: Erdogan, Mete
Published: (2026)
Generalization Boundaries of Fine-Tuned Small Language Models for Graph Structural Inference
by: Podstawski, Michal
Published: (2026)
by: Podstawski, Michal
Published: (2026)
Resource-Efficient Federated Fine-Tuning Large Language Models for Heterogeneous Data
by: Liu, Jun, et al.
Published: (2025)
by: Liu, Jun, et al.
Published: (2025)
Testing the Limits of Fine-Tuning for Improving Visual Cognition in Vision Language Models
by: Buschoff, Luca M. Schulze, et al.
Published: (2025)
by: Buschoff, Luca M. Schulze, et al.
Published: (2025)
Few-Shot Adversarial Low-Rank Fine-Tuning of Vision-Language Models
by: Ghiasvand, Sajjad, et al.
Published: (2025)
by: Ghiasvand, Sajjad, et al.
Published: (2025)
Differentially Private Subspace Fine-Tuning for Large Language Models
by: Zheng, Lele, et al.
Published: (2026)
by: Zheng, Lele, et al.
Published: (2026)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
by: Wang, Shumin, et al.
Published: (2026)
by: Wang, Shumin, et al.
Published: (2026)
Task-Centric Personalized Federated Fine-Tuning of Language Models
by: Talasso, Gabriel U., et al.
Published: (2026)
by: Talasso, Gabriel U., et al.
Published: (2026)
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
by: Li, Ziniu, et al.
Published: (2024)
by: Li, Ziniu, et al.
Published: (2024)
Personalized Collaborative Fine-Tuning for On-Device Large Language Models
by: Wagner, Nicolas, et al.
Published: (2024)
by: Wagner, Nicolas, et al.
Published: (2024)
In-Context Probing for Membership Inference in Fine-Tuned Language Models
by: Lu, Zhexi, et al.
Published: (2025)
by: Lu, Zhexi, et al.
Published: (2025)
How Multilingual Are Large Language Models Fine-Tuned for Translation?
by: Richburg, Aquia, et al.
Published: (2024)
by: Richburg, Aquia, et al.
Published: (2024)
LAPT: Label-driven Automated Prompt Tuning for OOD Detection with Vision-Language Models
by: Zhang, Yabin, et al.
Published: (2024)
by: Zhang, Yabin, et al.
Published: (2024)
Label Propagation for Zero-shot Classification with Vision-Language Models
by: Stojnić, Vladan, et al.
Published: (2024)
by: Stojnić, Vladan, et al.
Published: (2024)
Fine-Tuning Improves Information Conveyance in Language Models
by: Cheng, Yuwei, et al.
Published: (2026)
by: Cheng, Yuwei, et al.
Published: (2026)
REALM: Reliable Expertise-Aware Language Model Fine-Tuning from Noisy Annotations
by: Ghiasvand, Sajjad, et al.
Published: (2026)
by: Ghiasvand, Sajjad, et al.
Published: (2026)
Efficient Fine-Tuning of Single-Cell Foundation Models Enables Zero-Shot Molecular Perturbation Prediction
by: Maleki, Sepideh, et al.
Published: (2024)
by: Maleki, Sepideh, et al.
Published: (2024)
Similar Items
-
Drop the Act: Probe-Filtered RL for Faithful Chain-of-Thought Reasoning
by: Parekh, Swapnil
Published: (2026) -
Thinking Wrong in Silence: Backdoor Attacks on Continuous Latent Reasoning
by: Parekh, Swapnil
Published: (2026) -
CIRCUS: Circuit Consensus under Uncertainty via Stability Ensembles
by: Parekh, Swapnil
Published: (2026) -
Scaling Pretrained Representations Enables Label-Free Out-of-Distribution Detection Without Fine-Tuning
by: Barkley, Brett, et al.
Published: (2026) -
Fine-Tuning Pre-trained Language Models to Detect In-Game Trash Talks
by: Fesalbon, Daniel, et al.
Published: (2024)