Data Contamination Quiz: A Tool to Detect and Estimate Contamination in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Golchin, Shahriar, Surdeanu, Mihai |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Time Travel in LLMs: Tracing Data Contamination in Large Language Models
di: Golchin, Shahriar, et al.
Pubblicazione: (2023)
di: Golchin, Shahriar, et al.
Pubblicazione: (2023)
Memorization in In-Context Learning
di: Golchin, Shahriar, et al.
Pubblicazione: (2024)
di: Golchin, Shahriar, et al.
Pubblicazione: (2024)
Detecting Data Contamination from Reinforcement Learning Post-training for Large Language Models
di: Tao, Yongding, et al.
Pubblicazione: (2025)
di: Tao, Yongding, et al.
Pubblicazione: (2025)
Investigating Data Contamination for Pre-training Language Models
di: Jiang, Minhao, et al.
Pubblicazione: (2024)
di: Jiang, Minhao, et al.
Pubblicazione: (2024)
Evading Data Contamination Detection for Language Models is (too) Easy
di: Dekoninck, Jasper, et al.
Pubblicazione: (2024)
di: Dekoninck, Jasper, et al.
Pubblicazione: (2024)
Intent Laundering: AI Safety Datasets Are Not What They Seem
di: Golchin, Shahriar, et al.
Pubblicazione: (2026)
di: Golchin, Shahriar, et al.
Pubblicazione: (2026)
Towards Compute-Optimal Many-Shot In-Context Learning
di: Golchin, Shahriar, et al.
Pubblicazione: (2025)
di: Golchin, Shahriar, et al.
Pubblicazione: (2025)
Pretraining Data Exposure in Large Language Models: A Survey of Membership Inference, Data Contamination, and Security Implications
di: Tong, Ziyi, et al.
Pubblicazione: (2026)
di: Tong, Ziyi, et al.
Pubblicazione: (2026)
Say Less, Mean More: Leveraging Pragmatics in Retrieval-Augmented Generation
di: Riaz, Haris, et al.
Pubblicazione: (2025)
di: Riaz, Haris, et al.
Pubblicazione: (2025)
BeyondBench: Contamination-Resistant Evaluation of Reasoning in Language Models
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
MemGuard: Preventing Memory Contamination in Long-Term Memory-Augmented Large Language Models
di: Ha, Hyeonjeong, et al.
Pubblicazione: (2026)
di: Ha, Hyeonjeong, et al.
Pubblicazione: (2026)
How Contaminated Is Your Benchmark? Quantifying Dataset Leakage in Large Language Models with Kernel Divergence
di: Choi, Hyeong Kyu, et al.
Pubblicazione: (2025)
di: Choi, Hyeong Kyu, et al.
Pubblicazione: (2025)
ELLEN: Extremely Lightly Supervised Learning For Efficient Named Entity Recognition
di: Riaz, Haris, et al.
Pubblicazione: (2024)
di: Riaz, Haris, et al.
Pubblicazione: (2024)
Generalization or Memorization: Data Contamination and Trustworthy Evaluation for Large Language Models
di: Dong, Yihong, et al.
Pubblicazione: (2024)
di: Dong, Yihong, et al.
Pubblicazione: (2024)
Recent Advances in Large Langauge Model Benchmarks against Data Contamination: From Static to Dynamic Evaluation
di: Chen, Simin, et al.
Pubblicazione: (2025)
di: Chen, Simin, et al.
Pubblicazione: (2025)
How Much Can We Forget about Data Contamination?
di: Bordt, Sebastian, et al.
Pubblicazione: (2024)
di: Bordt, Sebastian, et al.
Pubblicazione: (2024)
Language Generation with Infinite Contamination
di: Mehrotra, Anay, et al.
Pubblicazione: (2025)
di: Mehrotra, Anay, et al.
Pubblicazione: (2025)
Reasoning or Memorization? Unreliable Results of Reinforcement Learning Due to Data Contamination
di: Wu, Mingqi, et al.
Pubblicazione: (2025)
di: Wu, Mingqi, et al.
Pubblicazione: (2025)
Large Language Models As MOOCs Graders
di: Golchin, Shahriar, et al.
Pubblicazione: (2024)
di: Golchin, Shahriar, et al.
Pubblicazione: (2024)
Preference Leakage: A Contamination Problem in LLM-as-a-judge
di: Li, Dawei, et al.
Pubblicazione: (2025)
di: Li, Dawei, et al.
Pubblicazione: (2025)
LiveBench: A Challenging, Contamination-Limited LLM Benchmark
di: White, Colin, et al.
Pubblicazione: (2024)
di: White, Colin, et al.
Pubblicazione: (2024)
MMLU-CF: A Contamination-free Multi-task Language Understanding Benchmark
di: Zhao, Qihao, et al.
Pubblicazione: (2024)
di: Zhao, Qihao, et al.
Pubblicazione: (2024)
Data Contamination Report from the 2024 CONDA Shared Task
di: Sainz, Oscar, et al.
Pubblicazione: (2024)
di: Sainz, Oscar, et al.
Pubblicazione: (2024)
The Emperor's New Clothes in Benchmarking? A Rigorous Examination of Mitigation Strategies for LLM Benchmark Data Contamination
di: Sun, Yifan, et al.
Pubblicazione: (2025)
di: Sun, Yifan, et al.
Pubblicazione: (2025)
Grading Massive Open Online Courses Using Large Language Models
di: Golchin, Shahriar, et al.
Pubblicazione: (2024)
di: Golchin, Shahriar, et al.
Pubblicazione: (2024)
The Heap: A Contamination-Free Multilingual Code Dataset for Evaluating Large Language Models
di: Katzy, Jonathan, et al.
Pubblicazione: (2025)
di: Katzy, Jonathan, et al.
Pubblicazione: (2025)
How Is LLM Reasoning Distracted by Irrelevant Context? An Analysis Using a Controlled Benchmark
di: Yang, Minglai, et al.
Pubblicazione: (2025)
di: Yang, Minglai, et al.
Pubblicazione: (2025)
An Open Source Data Contamination Report for Large Language Models
di: Li, Yucheng, et al.
Pubblicazione: (2023)
di: Li, Yucheng, et al.
Pubblicazione: (2023)
Investigating Data Contamination in Modern Benchmarks for Large Language Models
di: Deng, Chunyuan, et al.
Pubblicazione: (2023)
di: Deng, Chunyuan, et al.
Pubblicazione: (2023)
Leveraging Online Olympiad-Level Math Problems for LLMs Training and Contamination-Resistant Evaluation
di: Mahdavi, Sadegh, et al.
Pubblicazione: (2025)
di: Mahdavi, Sadegh, et al.
Pubblicazione: (2025)
Large Language Models as Tool Makers
di: Cai, Tianle, et al.
Pubblicazione: (2023)
di: Cai, Tianle, et al.
Pubblicazione: (2023)
Less Diverse, Less Safe: The Indirect But Pervasive Risk of Test-Time Scaling in Large Language Models
di: Nahin, Shahriar Kabir, et al.
Pubblicazione: (2025)
di: Nahin, Shahriar Kabir, et al.
Pubblicazione: (2025)
Towards Data Contamination Detection for Modern Large Language Models: Limitations, Inconsistencies, and Oracle Challenges
di: Samuel, Vinay, et al.
Pubblicazione: (2024)
di: Samuel, Vinay, et al.
Pubblicazione: (2024)
Large Multimodal Models for Low-Resource Languages: A Survey
di: Lupascu, Marian, et al.
Pubblicazione: (2025)
di: Lupascu, Marian, et al.
Pubblicazione: (2025)
Enhancing Transformer RNNs with Multiple Temporal Perspectives
di: Dumitru, Razvan-Gabriel, et al.
Pubblicazione: (2024)
di: Dumitru, Razvan-Gabriel, et al.
Pubblicazione: (2024)
From Words to Numbers: Your Large Language Model Is Secretly A Capable Regressor When Given In-Context Examples
di: Vacareanu, Robert, et al.
Pubblicazione: (2024)
di: Vacareanu, Robert, et al.
Pubblicazione: (2024)
MetaTool: Facilitating Large Language Models to Master Tools with Meta-task Augmentation
di: Wang, Xiaohan, et al.
Pubblicazione: (2024)
di: Wang, Xiaohan, et al.
Pubblicazione: (2024)
HU at SemEval-2024 Task 8A: Can Contrastive Learning Learn Embeddings to Detect Machine-Generated Text?
di: Dipta, Shubhashis Roy, et al.
Pubblicazione: (2024)
di: Dipta, Shubhashis Roy, et al.
Pubblicazione: (2024)
PortLLM: Personalizing Evolving Large Language Models with Training-Free and Portable Model Patches
di: Khan, Rana Muhammad Shahroz, et al.
Pubblicazione: (2024)
di: Khan, Rana Muhammad Shahroz, et al.
Pubblicazione: (2024)
A Lightweight Explainable Guardrail for Prompt Safety
di: Islam, Md Asiful, et al.
Pubblicazione: (2026)
di: Islam, Md Asiful, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Time Travel in LLMs: Tracing Data Contamination in Large Language Models
di: Golchin, Shahriar, et al.
Pubblicazione: (2023) -
Memorization in In-Context Learning
di: Golchin, Shahriar, et al.
Pubblicazione: (2024) -
Detecting Data Contamination from Reinforcement Learning Post-training for Large Language Models
di: Tao, Yongding, et al.
Pubblicazione: (2025) -
Investigating Data Contamination for Pre-training Language Models
di: Jiang, Minhao, et al.
Pubblicazione: (2024) -
Evading Data Contamination Detection for Language Models is (too) Easy
di: Dekoninck, Jasper, et al.
Pubblicazione: (2024)