An Open Source Data Contamination Report for Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Yucheng, Guerin, Frank, Lin, Chenghua |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LatestEval: Addressing Data Contamination in Language Model Evaluation through Dynamic and Time-Sensitive Test Construction
di: Li, Yucheng, et al.
Pubblicazione: (2023)
di: Li, Yucheng, et al.
Pubblicazione: (2023)
Evaluating Large Language Models for Generalization and Robustness via Data Compression
di: Li, Yucheng, et al.
Pubblicazione: (2024)
di: Li, Yucheng, et al.
Pubblicazione: (2024)
Finding Challenging Metaphors that Confuse Pretrained Language Models
di: Li, Yucheng, et al.
Pubblicazione: (2024)
di: Li, Yucheng, et al.
Pubblicazione: (2024)
Investigating Data Contamination in Modern Benchmarks for Large Language Models
di: Deng, Chunyuan, et al.
Pubblicazione: (2023)
di: Deng, Chunyuan, et al.
Pubblicazione: (2023)
WisdomInterrogatory (LuWen): An Open-Source Legal Large Language Model Technical Report
di: Wu, Yiquan, et al.
Pubblicazione: (2026)
di: Wu, Yiquan, et al.
Pubblicazione: (2026)
Performance Evaluation of Open-Source Large Language Models for Assisting Pathology Report Writing in Japanese
di: Kawai, Masataka, et al.
Pubblicazione: (2026)
di: Kawai, Masataka, et al.
Pubblicazione: (2026)
Data Contamination Quiz: A Tool to Detect and Estimate Contamination in Large Language Models
di: Golchin, Shahriar, et al.
Pubblicazione: (2023)
di: Golchin, Shahriar, et al.
Pubblicazione: (2023)
OpenR: An Open Source Framework for Advanced Reasoning with Large Language Models
di: Wang, Jun, et al.
Pubblicazione: (2024)
di: Wang, Jun, et al.
Pubblicazione: (2024)
PFME: A Modular Approach for Fine-grained Hallucination Detection and Editing of Large Language Models
di: Deng, Kunquan, et al.
Pubblicazione: (2024)
di: Deng, Kunquan, et al.
Pubblicazione: (2024)
Tougher Text, Smarter Models: Raising the Bar for Adversarial Defence Benchmarks
di: Wang, Yang, et al.
Pubblicazione: (2025)
di: Wang, Yang, et al.
Pubblicazione: (2025)
Agent-Based Uncertainty Awareness Improves Automated Radiology Report Labeling with an Open-Source Large Language Model
di: Ben-Atya, Hadas, et al.
Pubblicazione: (2025)
di: Ben-Atya, Hadas, et al.
Pubblicazione: (2025)
Classifying Cancer Stage with Open-Source Clinical Large Language Models
di: Chang, Chia-Hsuan, et al.
Pubblicazione: (2024)
di: Chang, Chia-Hsuan, et al.
Pubblicazione: (2024)
Towards Data Contamination Detection for Modern Large Language Models: Limitations, Inconsistencies, and Oracle Challenges
di: Samuel, Vinay, et al.
Pubblicazione: (2024)
di: Samuel, Vinay, et al.
Pubblicazione: (2024)
AdEval: Alignment-based Dynamic Evaluation to Mitigate Data Contamination in Large Language Models
di: Fan, Yang
Pubblicazione: (2025)
di: Fan, Yang
Pubblicazione: (2025)
Observing Micromotives and Macrobehavior of Large Language Models
di: Cheng, Yuyang, et al.
Pubblicazione: (2024)
di: Cheng, Yuyang, et al.
Pubblicazione: (2024)
AuditWen:An Open-Source Large Language Model for Audit
di: Huang, Jiajia, et al.
Pubblicazione: (2024)
di: Huang, Jiajia, et al.
Pubblicazione: (2024)
PaCoST: Paired Confidence Significance Testing for Benchmark Contamination Detection in Large Language Models
di: Zhang, Huixuan, et al.
Pubblicazione: (2024)
di: Zhang, Huixuan, et al.
Pubblicazione: (2024)
Sensitivity of Small Language Models to Fine-tuning Data Contamination
di: Scaria, Nicy, et al.
Pubblicazione: (2025)
di: Scaria, Nicy, et al.
Pubblicazione: (2025)
Prompting and Fine-Tuning Open-Sourced Large Language Models for Stance Classification
di: Cruickshank, Iain J., et al.
Pubblicazione: (2023)
di: Cruickshank, Iain J., et al.
Pubblicazione: (2023)
Benchmarking Open-Source Large Language Models on Healthcare Text Classification Tasks
di: Guo, Yuting, et al.
Pubblicazione: (2025)
di: Guo, Yuting, et al.
Pubblicazione: (2025)
Vikhr: The Family of Open-Source Instruction-Tuned Large Language Models for Russian
di: Nikolich, Aleksandr, et al.
Pubblicazione: (2024)
di: Nikolich, Aleksandr, et al.
Pubblicazione: (2024)
Detecting Data Contamination from Reinforcement Learning Post-training for Large Language Models
di: Tao, Yongding, et al.
Pubblicazione: (2025)
di: Tao, Yongding, et al.
Pubblicazione: (2025)
LlamaTurk: Adapting Open-Source Generative Large Language Models for Low-Resource Language
di: Toraman, Cagri
Pubblicazione: (2024)
di: Toraman, Cagri
Pubblicazione: (2024)
Data Contamination Can Cross Language Barriers
di: Yao, Feng, et al.
Pubblicazione: (2024)
di: Yao, Feng, et al.
Pubblicazione: (2024)
Dataverse: Open-Source ETL (Extract, Transform, Load) Pipeline for Large Language Models
di: Park, Hyunbyung, et al.
Pubblicazione: (2024)
di: Park, Hyunbyung, et al.
Pubblicazione: (2024)
Leak, Cheat, Repeat: Data Contamination and Evaluation Malpractices in Closed-Source LLMs
di: Balloccu, Simone, et al.
Pubblicazione: (2024)
di: Balloccu, Simone, et al.
Pubblicazione: (2024)
Evaluating Open-Weight Large Language Models for Structured Data Extraction from Narrative Medical Reports Across Multiple Use Cases and Languages
di: Spaanderman, Douwe J., et al.
Pubblicazione: (2025)
di: Spaanderman, Douwe J., et al.
Pubblicazione: (2025)
LOLA -- An Open-Source Massively Multilingual Large Language Model
di: Srivastava, Nikit, et al.
Pubblicazione: (2024)
di: Srivastava, Nikit, et al.
Pubblicazione: (2024)
Benchmarking Open-Source Large Language Models for Persian in Zero-Shot and Few-Shot Learning
di: Cherakhloo, Mahdi, et al.
Pubblicazione: (2025)
di: Cherakhloo, Mahdi, et al.
Pubblicazione: (2025)
Dynamic Benchmarking of Reasoning Capabilities in Code Large Language Models Under Data Contamination
di: Chen, Simin, et al.
Pubblicazione: (2025)
di: Chen, Simin, et al.
Pubblicazione: (2025)
TinyLlama: An Open-Source Small Language Model
di: Zhang, Peiyuan, et al.
Pubblicazione: (2024)
di: Zhang, Peiyuan, et al.
Pubblicazione: (2024)
Open-RAG: Enhanced Retrieval-Augmented Reasoning with Open-Source Large Language Models
di: Islam, Shayekh Bin, et al.
Pubblicazione: (2024)
di: Islam, Shayekh Bin, et al.
Pubblicazione: (2024)
Aqulia-Med LLM: Pioneering Full-Process Open-Source Medical Language Models
di: Zhao, Lulu, et al.
Pubblicazione: (2024)
di: Zhao, Lulu, et al.
Pubblicazione: (2024)
Investigating Data Contamination for Pre-training Language Models
di: Jiang, Minhao, et al.
Pubblicazione: (2024)
di: Jiang, Minhao, et al.
Pubblicazione: (2024)
The Heap: A Contamination-Free Multilingual Code Dataset for Evaluating Large Language Models
di: Katzy, Jonathan, et al.
Pubblicazione: (2025)
di: Katzy, Jonathan, et al.
Pubblicazione: (2025)
Exploring Solution Divergence and Its Effect on Large Language Model Problem Solving
di: Li, Hang, et al.
Pubblicazione: (2025)
di: Li, Hang, et al.
Pubblicazione: (2025)
Hippocrates: An Open-Source Framework for Advancing Large Language Models in Healthcare
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2024)
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2024)
Measuring Stability Beyond Accuracy in Small Open-Source Medical Large Language Models for Pediatric Endocrinology
di: D'Amario, Vanessa, et al.
Pubblicazione: (2025)
di: D'Amario, Vanessa, et al.
Pubblicazione: (2025)
Self-Reported Confidence of Large Language Models in Gastroenterology: Analysis of Commercial, Open-Source, and Quantized Models
di: Naderi, Nariman, et al.
Pubblicazione: (2025)
di: Naderi, Nariman, et al.
Pubblicazione: (2025)
Time Travel in LLMs: Tracing Data Contamination in Large Language Models
di: Golchin, Shahriar, et al.
Pubblicazione: (2023)
di: Golchin, Shahriar, et al.
Pubblicazione: (2023)
Documenti analoghi
-
LatestEval: Addressing Data Contamination in Language Model Evaluation through Dynamic and Time-Sensitive Test Construction
di: Li, Yucheng, et al.
Pubblicazione: (2023) -
Evaluating Large Language Models for Generalization and Robustness via Data Compression
di: Li, Yucheng, et al.
Pubblicazione: (2024) -
Finding Challenging Metaphors that Confuse Pretrained Language Models
di: Li, Yucheng, et al.
Pubblicazione: (2024) -
Investigating Data Contamination in Modern Benchmarks for Large Language Models
di: Deng, Chunyuan, et al.
Pubblicazione: (2023) -
WisdomInterrogatory (LuWen): An Open-Source Legal Large Language Model Technical Report
di: Wu, Yiquan, et al.
Pubblicazione: (2026)