LNE-Blocking: An Efficient Framework for Contamination Mitigation Evaluation on Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Hou, Ruijie, Jiao, Yueyang, Hu, Hanxu, Li, Yingming, Lam, Wai, Zhang, Huajian, Lu, Hongyuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Chain-of-Symbol Prompting Elicits Planning in Large Langauge Models
di: Hu, Hanxu, et al.
Pubblicazione: (2023)
di: Hu, Hanxu, et al.
Pubblicazione: (2023)
Clean Evaluations on Contaminated Visual Language Models
di: Lu, Hongyuan, et al.
Pubblicazione: (2024)
di: Lu, Hongyuan, et al.
Pubblicazione: (2024)
CLEAN-EVAL: Clean Evaluation on Contaminated Large Language Models
di: Zhu, Wenhong, et al.
Pubblicazione: (2023)
di: Zhu, Wenhong, et al.
Pubblicazione: (2023)
Dictionary Insertion Prompting for Multilingual Reasoning on Multilingual Large Language Models
di: Lu, Hongyuan, et al.
Pubblicazione: (2024)
di: Lu, Hongyuan, et al.
Pubblicazione: (2024)
SLoW: Select Low-frequency Words! Automatic Dictionary Selection for Translation on Large Language Models
di: Lu, Hongyuan, et al.
Pubblicazione: (2025)
di: Lu, Hongyuan, et al.
Pubblicazione: (2025)
Chain-of-Dictionary Prompting Elicits Translation in Large Language Models
di: Lu, Hongyuan, et al.
Pubblicazione: (2023)
di: Lu, Hongyuan, et al.
Pubblicazione: (2023)
Unveiling the Generalization Power of Fine-Tuned Large Language Models
di: Yang, Haoran, et al.
Pubblicazione: (2024)
di: Yang, Haoran, et al.
Pubblicazione: (2024)
Adam's Law: Textual Frequency Law on Large Language Models
di: Lu, Hongyuan Adam, et al.
Pubblicazione: (2026)
di: Lu, Hongyuan Adam, et al.
Pubblicazione: (2026)
Source-primed Multi-turn Conversation Helps Large Language Models Translate Documents
di: Hu, Hanxu, et al.
Pubblicazione: (2025)
di: Hu, Hanxu, et al.
Pubblicazione: (2025)
BenchMAX: A Comprehensive Multilingual Evaluation Suite for Large Language Models
di: Huang, Xu, et al.
Pubblicazione: (2025)
di: Huang, Xu, et al.
Pubblicazione: (2025)
Fine-tuning Large Language Models with Sequential Instructions
di: Hu, Hanxu, et al.
Pubblicazione: (2024)
di: Hu, Hanxu, et al.
Pubblicazione: (2024)
Consecutive Batch Model Editing with HooK Layers
di: Li, Shuaiyi, et al.
Pubblicazione: (2024)
di: Li, Shuaiyi, et al.
Pubblicazione: (2024)
AdEval: Alignment-based Dynamic Evaluation to Mitigate Data Contamination in Large Language Models
di: Fan, Yang
Pubblicazione: (2025)
di: Fan, Yang
Pubblicazione: (2025)
An Efficient Inference Framework for Early-exit Large Language Models
di: Miao, Ruijie, et al.
Pubblicazione: (2024)
di: Miao, Ruijie, et al.
Pubblicazione: (2024)
StrategyLLM: Large Language Models as Strategy Generators, Executors, Optimizers, and Evaluators for Problem Solving
di: Gao, Chang, et al.
Pubblicazione: (2023)
di: Gao, Chang, et al.
Pubblicazione: (2023)
C$^2$LEVA: Toward Comprehensive and Contamination-Free Language Model Evaluation
di: Li, Yanyang, et al.
Pubblicazione: (2024)
di: Li, Yanyang, et al.
Pubblicazione: (2024)
When Long Helps Short: How Context Length in Supervised Fine-tuning Affects Behavior of Large Language Models
di: Zheng, Yingming, et al.
Pubblicazione: (2025)
di: Zheng, Yingming, et al.
Pubblicazione: (2025)
A Comprehensive Survey of Contamination Detection Methods in Large Language Models
di: Ravaut, Mathieu, et al.
Pubblicazione: (2024)
di: Ravaut, Mathieu, et al.
Pubblicazione: (2024)
On the Worst Prompt Performance of Large Language Models
di: Cao, Bowen, et al.
Pubblicazione: (2024)
di: Cao, Bowen, et al.
Pubblicazione: (2024)
RALLRec: Improving Retrieval Augmented Large Language Model Recommendation with Representation Learning
di: Xu, Jian, et al.
Pubblicazione: (2025)
di: Xu, Jian, et al.
Pubblicazione: (2025)
Reasoning Meets Personalization: Unleashing the Potential of Large Reasoning Model for Personalized Generation
di: Luo, Sichun, et al.
Pubblicazione: (2025)
di: Luo, Sichun, et al.
Pubblicazione: (2025)
Spoken Language Intelligence of Large Language Models for Language Learning
di: Peng, Linkai, et al.
Pubblicazione: (2023)
di: Peng, Linkai, et al.
Pubblicazione: (2023)
Towards Resource Efficient and Interpretable Bias Mitigation in Large Language Models
di: Tong, Schrasing, et al.
Pubblicazione: (2024)
di: Tong, Schrasing, et al.
Pubblicazione: (2024)
Large Language Model Powered Symbolic Execution
di: Li, Yihe, et al.
Pubblicazione: (2025)
di: Li, Yihe, et al.
Pubblicazione: (2025)
Mitigating the Bias of Large Language Model Evaluation
di: Zhou, Hongli, et al.
Pubblicazione: (2024)
di: Zhou, Hongli, et al.
Pubblicazione: (2024)
Fine-Grained Natural Language Inference Based Faithfulness Evaluation for Diverse Summarisation Tasks
di: Zhang, Huajian, et al.
Pubblicazione: (2024)
di: Zhang, Huajian, et al.
Pubblicazione: (2024)
Towards Generalization of Block Attention via Automatic Segmentation and Block Distillation
di: Li, Shuaiyi, et al.
Pubblicazione: (2026)
di: Li, Shuaiyi, et al.
Pubblicazione: (2026)
Large Language Models Penetration in Scholarly Writing and Peer Review
di: Zhou, Li, et al.
Pubblicazione: (2025)
di: Zhou, Li, et al.
Pubblicazione: (2025)
EFUF: Efficient Fine-grained Unlearning Framework for Mitigating Hallucinations in Multimodal Large Language Models
di: Xing, Shangyu, et al.
Pubblicazione: (2024)
di: Xing, Shangyu, et al.
Pubblicazione: (2024)
CreativityPrism: A Holistic Evaluation Framework for Large Language Model Creativity
di: Hou, Zhaoyi Joey, et al.
Pubblicazione: (2025)
di: Hou, Zhaoyi Joey, et al.
Pubblicazione: (2025)
LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code
di: Jain, Naman, et al.
Pubblicazione: (2024)
di: Jain, Naman, et al.
Pubblicazione: (2024)
Bias in Large Language Models: Origin, Evaluation, and Mitigation
di: Guo, Yufei, et al.
Pubblicazione: (2024)
di: Guo, Yufei, et al.
Pubblicazione: (2024)
SmartThinker: Progressive Chain-of-Thought Length Calibration for Efficient Large Language Model Reasoning
di: Hu, Chenzhi, et al.
Pubblicazione: (2026)
di: Hu, Chenzhi, et al.
Pubblicazione: (2026)
Plug-and-Play Policy Planner for Large Language Model Powered Dialogue Agents
di: Deng, Yang, et al.
Pubblicazione: (2023)
di: Deng, Yang, et al.
Pubblicazione: (2023)
LLM2: Let Large Language Models Harness System 2 Reasoning
di: Yang, Cheng, et al.
Pubblicazione: (2024)
di: Yang, Cheng, et al.
Pubblicazione: (2024)
Auffusion: Leveraging the Power of Diffusion and Large Language Models for Text-to-Audio Generation
di: Xue, Jinlong, et al.
Pubblicazione: (2024)
di: Xue, Jinlong, et al.
Pubblicazione: (2024)
Mitigating Hallucinations in Large Vision-Language Models by Self-Injecting Hallucinations
di: Lu, Yifan, et al.
Pubblicazione: (2025)
di: Lu, Yifan, et al.
Pubblicazione: (2025)
A Taxonomy for Data Contamination in Large Language Models
di: Palavalli, Medha, et al.
Pubblicazione: (2024)
di: Palavalli, Medha, et al.
Pubblicazione: (2024)
A Survey on Data Contamination for Large Language Models
di: Cheng, Yuxing, et al.
Pubblicazione: (2025)
di: Cheng, Yuxing, et al.
Pubblicazione: (2025)
Mitigating Social Bias in Large Language Models: A Multi-Objective Approach within a Multi-Agent Framework
di: Xu, Zhenjie, et al.
Pubblicazione: (2024)
di: Xu, Zhenjie, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Chain-of-Symbol Prompting Elicits Planning in Large Langauge Models
di: Hu, Hanxu, et al.
Pubblicazione: (2023) -
Clean Evaluations on Contaminated Visual Language Models
di: Lu, Hongyuan, et al.
Pubblicazione: (2024) -
CLEAN-EVAL: Clean Evaluation on Contaminated Large Language Models
di: Zhu, Wenhong, et al.
Pubblicazione: (2023) -
Dictionary Insertion Prompting for Multilingual Reasoning on Multilingual Large Language Models
di: Lu, Hongyuan, et al.
Pubblicazione: (2024) -
SLoW: Select Low-frequency Words! Automatic Dictionary Selection for Translation on Large Language Models
di: Lu, Hongyuan, et al.
Pubblicazione: (2025)