Salvato in:
| Autori principali: | Kocyigit, Muhammed Yusuf, Yildirim, Caglar |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2601.06103 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Overestimation in LLM Evaluation: A Controlled Large-Scale Study on Data Contamination's Impact on Machine Translation
di: Kocyigit, Muhammed Yusuf, et al.
Pubblicazione: (2025)
di: Kocyigit, Muhammed Yusuf, et al.
Pubblicazione: (2025)
Detecting Data Contamination from Reinforcement Learning Post-training for Large Language Models
di: Tao, Yongding, et al.
Pubblicazione: (2025)
di: Tao, Yongding, et al.
Pubblicazione: (2025)
Investigating Data Contamination for Pre-training Language Models
di: Jiang, Minhao, et al.
Pubblicazione: (2024)
di: Jiang, Minhao, et al.
Pubblicazione: (2024)
LaRA: Layer-wise Representation Analysis for Detecting Data Contamination in RL Post-Training
di: Gwak, Minju, et al.
Pubblicazione: (2026)
di: Gwak, Minju, et al.
Pubblicazione: (2026)
Search-Time Data Contamination
di: Han, Ziwen, et al.
Pubblicazione: (2025)
di: Han, Ziwen, et al.
Pubblicazione: (2025)
In Search for Architectures and Loss Functions in Multi-Objective Reinforcement Learning
di: Terekhov, Mikhail, et al.
Pubblicazione: (2024)
di: Terekhov, Mikhail, et al.
Pubblicazione: (2024)
Impact of Inaccurate Contamination Ratio on Robust Unsupervised Anomaly Detection
di: Masakuna, Jordan F., et al.
Pubblicazione: (2024)
di: Masakuna, Jordan F., et al.
Pubblicazione: (2024)
Differential Harm Propensity in Personalized LLM Agents: The Curious Case of Mental Health Disclosure
di: Yildirim, Caglar
Pubblicazione: (2026)
di: Yildirim, Caglar
Pubblicazione: (2026)
Deep Positive-Unlabeled Anomaly Detection for Contaminated Unlabeled Data
di: Takahashi, Hiroshi, et al.
Pubblicazione: (2024)
di: Takahashi, Hiroshi, et al.
Pubblicazione: (2024)
RADAR: Mechanistic Pathways for Detecting Data Contamination in LLM Evaluation
di: Kattamuri, Ashish, et al.
Pubblicazione: (2025)
di: Kattamuri, Ashish, et al.
Pubblicazione: (2025)
Anomaly Detection with Adaptive and Aggressive Rejection for Contaminated Training Data
di: Lee, Jungi, et al.
Pubblicazione: (2025)
di: Lee, Jungi, et al.
Pubblicazione: (2025)
Data Contamination Quiz: A Tool to Detect and Estimate Contamination in Large Language Models
di: Golchin, Shahriar, et al.
Pubblicazione: (2023)
di: Golchin, Shahriar, et al.
Pubblicazione: (2023)
The Role of Deep Learning Regularizations on Actors in Offline RL
di: Tarasov, Denis, et al.
Pubblicazione: (2024)
di: Tarasov, Denis, et al.
Pubblicazione: (2024)
TSFMAudit: Data Contamination Auditing in Forecasting Time Series Foundation Models
di: Li, Hongkai, et al.
Pubblicazione: (2026)
di: Li, Hongkai, et al.
Pubblicazione: (2026)
Prioritized Replay for RL Post-training
di: Fatemi, Mehdi
Pubblicazione: (2026)
di: Fatemi, Mehdi
Pubblicazione: (2026)
Efficient Learning of Fuzzy Logic Systems for Large-Scale Data Using Deep Learning
di: Koklu, Ata, et al.
Pubblicazione: (2024)
di: Koklu, Ata, et al.
Pubblicazione: (2024)
Can Generative Artificial Intelligence Survive Data Contamination? Theoretical Guarantees under Contaminated Recursive Training
di: Wang, Kevin, et al.
Pubblicazione: (2026)
di: Wang, Kevin, et al.
Pubblicazione: (2026)
Generative Modeling of Networked Time-Series via Transformer Architectures
di: Elnady, Yusuf
Pubblicazione: (2025)
di: Elnady, Yusuf
Pubblicazione: (2025)
AutoOR: Scalably Post-training LLMs to Autoformalize Operations Research Problems
di: Motwani, Sumeet Ramesh, et al.
Pubblicazione: (2026)
di: Motwani, Sumeet Ramesh, et al.
Pubblicazione: (2026)
Guiding LLM Post-training Data Engineering with Model Internals from Sparse Autoencoders
di: Jing, Yi, et al.
Pubblicazione: (2026)
di: Jing, Yi, et al.
Pubblicazione: (2026)
BoA: Attention-aware Post-training Quantization without Backpropagation
di: Kim, Junhan, et al.
Pubblicazione: (2024)
di: Kim, Junhan, et al.
Pubblicazione: (2024)
Bayesian Kolmogorov Arnold Networks (Bayesian_KANs): A Probabilistic Approach to Enhance Accuracy and Interpretability
di: Hassan, Masoud Muhammed
Pubblicazione: (2024)
di: Hassan, Masoud Muhammed
Pubblicazione: (2024)
Automatic Pair Construction for Contrastive Post-training
di: Xu, Canwen, et al.
Pubblicazione: (2023)
di: Xu, Canwen, et al.
Pubblicazione: (2023)
The Illusion of Reasoning: Exposing Evasive Data Contamination in LLMs via Zero-CoT Truncation
di: Lan, Yifan, et al.
Pubblicazione: (2026)
di: Lan, Yifan, et al.
Pubblicazione: (2026)
A Generic Machine Learning Framework for Fully-Unsupervised Anomaly Detection with Contaminated Data
di: Ulmer, Markus, et al.
Pubblicazione: (2023)
di: Ulmer, Markus, et al.
Pubblicazione: (2023)
Beneficial Reasoning Behaviors in Agentic Search and Effective Post-training to Obtain Them
di: Jin, Jiahe, et al.
Pubblicazione: (2025)
di: Jin, Jiahe, et al.
Pubblicazione: (2025)
AdamS: Momentum Itself Can Be A Normalizer for LLM Pretraining and Post-training
di: Zhang, Huishuai, et al.
Pubblicazione: (2025)
di: Zhang, Huishuai, et al.
Pubblicazione: (2025)
Arena Learning: Build Data Flywheel for LLMs Post-training via Simulated Chatbot Arena
di: Luo, Haipeng, et al.
Pubblicazione: (2024)
di: Luo, Haipeng, et al.
Pubblicazione: (2024)
Towards Effective Theory of LLMs: A Representation Learning Approach
di: Ustaomeroglu, Muhammed, et al.
Pubblicazione: (2026)
di: Ustaomeroglu, Muhammed, et al.
Pubblicazione: (2026)
RoCA: Robust Contrastive One-class Time Series Anomaly Detection with Contaminated Data
di: Mou, Xudong, et al.
Pubblicazione: (2025)
di: Mou, Xudong, et al.
Pubblicazione: (2025)
Beyond Surface-Level Similarity: Hierarchical Contamination Detection for Synthetic Training Data in Foundation Models
di: Mehta, Sushant
Pubblicazione: (2025)
di: Mehta, Sushant
Pubblicazione: (2025)
From Simulation to Enaction: Post-trained language models recognize and react to their own generations
di: G., Asvin, et al.
Pubblicazione: (2026)
di: G., Asvin, et al.
Pubblicazione: (2026)
PBP: Post-training Backdoor Purification for Malware Classifiers
di: Nguyen, Dung Thuy, et al.
Pubblicazione: (2024)
di: Nguyen, Dung Thuy, et al.
Pubblicazione: (2024)
Post-training for Efficient Communication via Convention Formation
di: Hua, Yilun, et al.
Pubblicazione: (2025)
di: Hua, Yilun, et al.
Pubblicazione: (2025)
Efficient Post-training Quantization with FP8 Formats
di: Shen, Haihao, et al.
Pubblicazione: (2023)
di: Shen, Haihao, et al.
Pubblicazione: (2023)
How Much Can We Forget about Data Contamination?
di: Bordt, Sebastian, et al.
Pubblicazione: (2024)
di: Bordt, Sebastian, et al.
Pubblicazione: (2024)
On the dimension of pullback attractors in recurrent neural networks
di: Fadera, Muhammed
Pubblicazione: (2025)
di: Fadera, Muhammed
Pubblicazione: (2025)
State Contamination in Memory-Augmented LLM Agents
di: Wang, Yian, et al.
Pubblicazione: (2026)
di: Wang, Yian, et al.
Pubblicazione: (2026)
Dr. Post-Training: A Data Regularization Perspective on LLM Post-Training
di: Hu, Pingbang, et al.
Pubblicazione: (2026)
di: Hu, Pingbang, et al.
Pubblicazione: (2026)
Reasoning or Memorization? Unreliable Results of Reinforcement Learning Due to Data Contamination
di: Wu, Mingqi, et al.
Pubblicazione: (2025)
di: Wu, Mingqi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Overestimation in LLM Evaluation: A Controlled Large-Scale Study on Data Contamination's Impact on Machine Translation
di: Kocyigit, Muhammed Yusuf, et al.
Pubblicazione: (2025) -
Detecting Data Contamination from Reinforcement Learning Post-training for Large Language Models
di: Tao, Yongding, et al.
Pubblicazione: (2025) -
Investigating Data Contamination for Pre-training Language Models
di: Jiang, Minhao, et al.
Pubblicazione: (2024) -
LaRA: Layer-wise Representation Analysis for Detecting Data Contamination in RL Post-Training
di: Gwak, Minju, et al.
Pubblicazione: (2026) -
Search-Time Data Contamination
di: Han, Ziwen, et al.
Pubblicazione: (2025)