How Much Can We Forget about Data Contamination?
Fuente:
arXiv
Guardado en:
| Autores principales: | Bordt, Sebastian, Srinivas, Suraj, Boreiko, Valentyn, von Luxburg, Ulrike |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Elephants Never Forget: Memorization and Learning of Tabular Data in Large Language Models
por: Bordt, Sebastian, et al.
Publicado: (2024)
por: Bordt, Sebastian, et al.
Publicado: (2024)
On the Surprising Effectiveness of Large Learning Rates under Standard Width Scaling
por: Haas, Moritz, et al.
Publicado: (2025)
por: Haas, Moritz, et al.
Publicado: (2025)
Informative Post-Hoc Explanations Only Exist for Simple Functions
por: Günther, Eric, et al.
Publicado: (2025)
por: Günther, Eric, et al.
Publicado: (2025)
Train Once, Answer All: Many Pretraining Experiments for the Cost of One
por: Bordt, Sebastian, et al.
Publicado: (2025)
por: Bordt, Sebastian, et al.
Publicado: (2025)
An Interpretable N-gram Perplexity Threat Model for Large Language Model Jailbreaks
por: Boreiko, Valentyn, et al.
Publicado: (2024)
por: Boreiko, Valentyn, et al.
Publicado: (2024)
Elephants Never Forget: Testing Language Models for Memorization of Tabular Data
por: Bordt, Sebastian, et al.
Publicado: (2024)
por: Bordt, Sebastian, et al.
Publicado: (2024)
How to safely discard features based on aggregate SHAP values
por: Bhattacharjee, Robi, et al.
Publicado: (2025)
por: Bhattacharjee, Robi, et al.
Publicado: (2025)
Rethinking Explainable Machine Learning as Applied Statistics
por: Bordt, Sebastian, et al.
Publicado: (2024)
por: Bordt, Sebastian, et al.
Publicado: (2024)
How Can We Synthesize High-Quality Pretraining Data? A Systematic Study of Prompt Design, Generator Model, and Source Data
por: Niklaus, Joel, et al.
Publicado: (2026)
por: Niklaus, Joel, et al.
Publicado: (2026)
The Manifold Hypothesis for Gradient-Based Explanations
por: Bordt, Sebastian, et al.
Publicado: (2022)
por: Bordt, Sebastian, et al.
Publicado: (2022)
How Much is Too Much? Exploring LoRA Rank Trade-offs for Retaining Knowledge and Domain Robustness
por: Rathore, Darshita, et al.
Publicado: (2025)
por: Rathore, Darshita, et al.
Publicado: (2025)
Do Large Language Models Know How Much They Know?
por: Prato, Gabriele, et al.
Publicado: (2025)
por: Prato, Gabriele, et al.
Publicado: (2025)
Evaluating Adversarial Robustness of Concept Representations in Sparse Autoencoders
por: Li, Aaron J., et al.
Publicado: (2025)
por: Li, Aaron J., et al.
Publicado: (2025)
Using predictive multiplicity to measure individual performance within the AI Act
por: Frohnapfel, Karolin, et al.
Publicado: (2026)
por: Frohnapfel, Karolin, et al.
Publicado: (2026)
Forget What You Know about LLMs Evaluations -- LLMs are Like a Chameleon
por: Cohen-Inger, Nurit, et al.
Publicado: (2025)
por: Cohen-Inger, Nurit, et al.
Publicado: (2025)
BertaQA: How Much Do Language Models Know About Local Culture?
por: Etxaniz, Julen, et al.
Publicado: (2024)
por: Etxaniz, Julen, et al.
Publicado: (2024)
Data Contamination Quiz: A Tool to Detect and Estimate Contamination in Large Language Models
por: Golchin, Shahriar, et al.
Publicado: (2023)
por: Golchin, Shahriar, et al.
Publicado: (2023)
Which Models have Perceptually-Aligned Gradients? An Explanation via Off-Manifold Robustness
por: Srinivas, Suraj, et al.
Publicado: (2023)
por: Srinivas, Suraj, et al.
Publicado: (2023)
Forgetting Transformer: Softmax Attention with a Forget Gate
por: Lin, Zhixuan, et al.
Publicado: (2025)
por: Lin, Zhixuan, et al.
Publicado: (2025)
Investigating Data Contamination for Pre-training Language Models
por: Jiang, Minhao, et al.
Publicado: (2024)
por: Jiang, Minhao, et al.
Publicado: (2024)
LLM Unlearning via Loss Adjustment with Only Forget Data
por: Wang, Yaxuan, et al.
Publicado: (2024)
por: Wang, Yaxuan, et al.
Publicado: (2024)
Reasoning or Memorization? Unreliable Results of Reinforcement Learning Due to Data Contamination
por: Wu, Mingqi, et al.
Publicado: (2025)
por: Wu, Mingqi, et al.
Publicado: (2025)
How Far Are We From AGI: Are LLMs All We Need?
por: Feng, Tao, et al.
Publicado: (2024)
por: Feng, Tao, et al.
Publicado: (2024)
How Contaminated Is Your Benchmark? Quantifying Dataset Leakage in Large Language Models with Kernel Divergence
por: Choi, Hyeong Kyu, et al.
Publicado: (2025)
por: Choi, Hyeong Kyu, et al.
Publicado: (2025)
Learn More, Forget Less: A Gradient-Aware Data Selection Approach for LLM
por: Liu, Yibai, et al.
Publicado: (2025)
por: Liu, Yibai, et al.
Publicado: (2025)
Can We Count on LLMs? The Fixed-Effect Fallacy and Claims of GPT-4 Capabilities
por: Ball, Thomas, et al.
Publicado: (2024)
por: Ball, Thomas, et al.
Publicado: (2024)
Retrieval-Augmented Generation Meets Data-Driven Tabula Rasa Approach for Temporal Knowledge Graph Forecasting
por: Sannidhi, Geethan, et al.
Publicado: (2024)
por: Sannidhi, Geethan, et al.
Publicado: (2024)
Detecting Data Contamination from Reinforcement Learning Post-training for Large Language Models
por: Tao, Yongding, et al.
Publicado: (2025)
por: Tao, Yongding, et al.
Publicado: (2025)
Pretraining Data Exposure in Large Language Models: A Survey of Membership Inference, Data Contamination, and Security Implications
por: Tong, Ziyi, et al.
Publicado: (2026)
por: Tong, Ziyi, et al.
Publicado: (2026)
Adaptive Computation Pruning for the Forgetting Transformer
por: Lin, Zhixuan, et al.
Publicado: (2025)
por: Lin, Zhixuan, et al.
Publicado: (2025)
Graceful Forgetting in Generative Language Models
por: Jiang, Chunyang, et al.
Publicado: (2025)
por: Jiang, Chunyang, et al.
Publicado: (2025)
Can We Predict Alignment Before Models Finish Thinking? Towards Monitoring Misaligned Reasoning Models
por: Chan, Yik Siu, et al.
Publicado: (2025)
por: Chan, Yik Siu, et al.
Publicado: (2025)
LoRA Learns Less and Forgets Less
por: Biderman, Dan, et al.
Publicado: (2024)
por: Biderman, Dan, et al.
Publicado: (2024)
Evolutionary Strategies lead to Catastrophic Forgetting in LLMs
por: Abdi, Immanuel, et al.
Publicado: (2026)
por: Abdi, Immanuel, et al.
Publicado: (2026)
The Emperor's New Clothes in Benchmarking? A Rigorous Examination of Mitigation Strategies for LLM Benchmark Data Contamination
por: Sun, Yifan, et al.
Publicado: (2025)
por: Sun, Yifan, et al.
Publicado: (2025)
Recent Advances in Large Langauge Model Benchmarks against Data Contamination: From Static to Dynamic Evaluation
por: Chen, Simin, et al.
Publicado: (2025)
por: Chen, Simin, et al.
Publicado: (2025)
Certifying LLM Safety against Adversarial Prompting
por: Kumar, Aounon, et al.
Publicado: (2023)
por: Kumar, Aounon, et al.
Publicado: (2023)
Unveiling and Addressing Pseudo Forgetting in Large Language Models
por: Sun, Huashan, et al.
Publicado: (2024)
por: Sun, Huashan, et al.
Publicado: (2024)
Stuffed Mamba: Oversized States Lead to the Inability to Forget
por: Chen, Yingfa, et al.
Publicado: (2024)
por: Chen, Yingfa, et al.
Publicado: (2024)
Analyzing and Reducing Catastrophic Forgetting in Parameter Efficient Tuning
por: Ren, Weijieying, et al.
Publicado: (2024)
por: Ren, Weijieying, et al.
Publicado: (2024)
Ejemplares similares
-
Elephants Never Forget: Memorization and Learning of Tabular Data in Large Language Models
por: Bordt, Sebastian, et al.
Publicado: (2024) -
On the Surprising Effectiveness of Large Learning Rates under Standard Width Scaling
por: Haas, Moritz, et al.
Publicado: (2025) -
Informative Post-Hoc Explanations Only Exist for Simple Functions
por: Günther, Eric, et al.
Publicado: (2025) -
Train Once, Answer All: Many Pretraining Experiments for the Cost of One
por: Bordt, Sebastian, et al.
Publicado: (2025) -
An Interpretable N-gram Perplexity Threat Model for Large Language Model Jailbreaks
por: Boreiko, Valentyn, et al.
Publicado: (2024)