No Memorization, No Detection: Output Distribution-Based Contamination Detection in Small Language Models
Fuente:
arXiv
Guardado en:
| Autor principal: | Sela, Omer |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
lmfaoooo at SemEval-2026 Task 1: Humor Is an Audience. Preference Modeling for Constrained Humor Generation
por: Tikhonov, Alexey, et al.
Publicado: (2026)
por: Tikhonov, Alexey, et al.
Publicado: (2026)
Manipulating Transformer-Based Models: Controllability, Steerability, and Robust Interventions
por: Alpay, Faruk, et al.
Publicado: (2025)
por: Alpay, Faruk, et al.
Publicado: (2025)
Multi-Model Synthetic Training for Mission-Critical Small Language Models
por: Platt, Nolan, et al.
Publicado: (2025)
por: Platt, Nolan, et al.
Publicado: (2025)
CLMN: Concept based Language Models via Neural Symbolic Reasoning
por: Yang, Yibo
Publicado: (2025)
por: Yang, Yibo
Publicado: (2025)
From Noise to Diversity: Random Embedding Injection in LLM Reasoning
por: Kim, Heejun, et al.
Publicado: (2026)
por: Kim, Heejun, et al.
Publicado: (2026)
How much do LLMs learn from negative examples?
por: Hamdan, Shadi, et al.
Publicado: (2025)
por: Hamdan, Shadi, et al.
Publicado: (2025)
XAutoLM: Efficient Fine-Tuning of Language Models via Meta-Learning and AutoML
por: Estevanell-Valladares, Ernesto L., et al.
Publicado: (2025)
por: Estevanell-Valladares, Ernesto L., et al.
Publicado: (2025)
AIPsy-Affect: A Keyword-Free Clinical Stimulus Battery for Mechanistic Interpretability of Emotion in Language Models
por: Keeman, Michael
Publicado: (2026)
por: Keeman, Michael
Publicado: (2026)
mHC-SSM: Manifold-Constrained Hyper-Connections for State Space Language Models with Stream-Specialized Adapters
por: Mutlu, Abdulvahap, et al.
Publicado: (2026)
por: Mutlu, Abdulvahap, et al.
Publicado: (2026)
Towards Ontology-Enhanced Representation Learning for Large Language Models
por: Ronzano, Francesco, et al.
Publicado: (2024)
por: Ronzano, Francesco, et al.
Publicado: (2024)
Harnessing non-adversarial robustness in large language models
por: Zhou, Qinghua, et al.
Publicado: (2026)
por: Zhou, Qinghua, et al.
Publicado: (2026)
The Geometry of Persona: Disentangling Personality from Reasoning in Large Language Models
por: Wang, Zhixiang
Publicado: (2025)
por: Wang, Zhixiang
Publicado: (2025)
Product-of-Experts Training Reduces Dataset Artifacts in Natural Language Inference
por: Mathew, Aby Mammen
Publicado: (2026)
por: Mathew, Aby Mammen
Publicado: (2026)
Hybrid Gated Flow (HGF): Stabilizing 1.58-bit LLMs via Selective Low-Rank Correction
por: Pizzo, David Alejandro Trejo
Publicado: (2026)
por: Pizzo, David Alejandro Trejo
Publicado: (2026)
Measuring and curing reasoning rigidity: from decorative chain-of-thought to genuine faithfulness
por: Basu, Abhinaba, et al.
Publicado: (2026)
por: Basu, Abhinaba, et al.
Publicado: (2026)
ReFactor GNNs: Revisiting Factorisation-based Models from a Message-Passing Perspective
por: Chen, Yihong, et al.
Publicado: (2022)
por: Chen, Yihong, et al.
Publicado: (2022)
Causally Grounded Mechanistic Interpretability for LLMs with Faithful Natural-Language Explanations
por: Mahale, Ajay Pravin
Publicado: (2026)
por: Mahale, Ajay Pravin
Publicado: (2026)
Constitution or Collapse? Exploring Constitutional AI with Llama 3-8B
por: Zhang, Xue
Publicado: (2025)
por: Zhang, Xue
Publicado: (2025)
NOTAI.AI: Explainable Detection of Machine-Generated Text via Curvature and Feature Attribution
por: Breneur, Oleksandr Marchenko, et al.
Publicado: (2026)
por: Breneur, Oleksandr Marchenko, et al.
Publicado: (2026)
Word Overuse and Alignment in Large Language Models: The Influence of Learning from Human Feedback
por: Juzek, Tom S., et al.
Publicado: (2025)
por: Juzek, Tom S., et al.
Publicado: (2025)
Tool-Genesis: A Task-Driven Tool Creation Benchmark for Self-Evolving Language Agent
por: Xia, Bowei, et al.
Publicado: (2026)
por: Xia, Bowei, et al.
Publicado: (2026)
ProbeScale: Probing Analysis to Optimize Neural Scaling Laws for Efficient Small Language Model Inference
por: Das, Sourav
Publicado: (2026)
por: Das, Sourav
Publicado: (2026)
Mitigating Position-Shift Failures in Text-Based Modular Arithmetic via Position Curriculum and Template Diversity
por: Yudin, Nikolay
Publicado: (2026)
por: Yudin, Nikolay
Publicado: (2026)
Monotonicity as an Architectural Bias for Robust Language Models
por: Cooper, Patrick, et al.
Publicado: (2026)
por: Cooper, Patrick, et al.
Publicado: (2026)
Mechanistic Analysis of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning
por: Imanov, Olaf Yunus Laitinen
Publicado: (2026)
por: Imanov, Olaf Yunus Laitinen
Publicado: (2026)
Strategic Doctrine Language Models (sdLM): A Learning-System Framework for Doctrinal Consistency and Geopolitical Forecasting
por: Imanov, Olaf Yunus Laitinen, et al.
Publicado: (2026)
por: Imanov, Olaf Yunus Laitinen, et al.
Publicado: (2026)
NeuroState-Bench: A Human-Calibrated Benchmark for Commitment Integrity in LLM Agent Profiles
por: Jia, Xiao
Publicado: (2026)
por: Jia, Xiao
Publicado: (2026)
Improving Commonsense Bias Classification by Mitigating the Influence of Demographic Terms
por: Lee, JinKyu, et al.
Publicado: (2024)
por: Lee, JinKyu, et al.
Publicado: (2024)
Think-at-Hard: Selective Latent Iterations to Improve Reasoning Language Models
por: Fu, Tianyu, et al.
Publicado: (2025)
por: Fu, Tianyu, et al.
Publicado: (2025)
How Human-Like Are Large Language Models? A Register-Aware Linguistic Evaluation Framework
por: Nieth, Björn, et al.
Publicado: (2026)
por: Nieth, Björn, et al.
Publicado: (2026)
Fine-tuning of Large Language Models for Constituency Parsing Using a Sequence to Sequence Approach
por: Delgado, Francisco Jose Cortes, et al.
Publicado: (2025)
por: Delgado, Francisco Jose Cortes, et al.
Publicado: (2025)
Transactional Attention: Semantic Sponsorship for KV-Cache Retention
por: Basu, Abhinaba
Publicado: (2026)
por: Basu, Abhinaba
Publicado: (2026)
HEFT: A Coarse-to-Fine Hierarchy for Enhancing the Efficiency and Accuracy of Language Model Reasoning
por: Hill, Brennen
Publicado: (2025)
por: Hill, Brennen
Publicado: (2025)
SafeAnchor: Preventing Cumulative Safety Erosion in Continual Domain Adaptation of Large Language Models
por: Guo, Dongxin, et al.
Publicado: (2026)
por: Guo, Dongxin, et al.
Publicado: (2026)
Fact Grounded Attention: Eliminating Hallucination in Large Language Models Through Attention Level Knowledge Integration
por: Gupta, Aayush
Publicado: (2025)
por: Gupta, Aayush
Publicado: (2025)
Detecting Sleeper Agents in Large Language Models via Semantic Drift Analysis
por: Zanbaghi, Shahin, et al.
Publicado: (2025)
por: Zanbaghi, Shahin, et al.
Publicado: (2025)
Measuring Intent Comprehension in LLMs
por: Kunievsky, Nadav, et al.
Publicado: (2025)
por: Kunievsky, Nadav, et al.
Publicado: (2025)
Communicative Agents for Slideshow Storytelling Video Generation based on LLMs
por: Fan, Jingxing, et al.
Publicado: (2025)
por: Fan, Jingxing, et al.
Publicado: (2025)
Latent Object Permanence: Topological Phase Transitions, Free-Energy Principles, and Renormalization Group Flows in Deep Transformer Manifolds
por: Alpay, Faruk, et al.
Publicado: (2026)
por: Alpay, Faruk, et al.
Publicado: (2026)
Inference acceleration for large language models using "stairs" assisted greedy generation
por: Grigaliūnas, Domas, et al.
Publicado: (2024)
por: Grigaliūnas, Domas, et al.
Publicado: (2024)
Ejemplares similares
-
lmfaoooo at SemEval-2026 Task 1: Humor Is an Audience. Preference Modeling for Constrained Humor Generation
por: Tikhonov, Alexey, et al.
Publicado: (2026) -
Manipulating Transformer-Based Models: Controllability, Steerability, and Robust Interventions
por: Alpay, Faruk, et al.
Publicado: (2025) -
Multi-Model Synthetic Training for Mission-Critical Small Language Models
por: Platt, Nolan, et al.
Publicado: (2025) -
CLMN: Concept based Language Models via Neural Symbolic Reasoning
por: Yang, Yibo
Publicado: (2025) -
From Noise to Diversity: Random Embedding Injection in LLM Reasoning
por: Kim, Heejun, et al.
Publicado: (2026)