Rethinking Data Mixing from the Perspective of Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Xu, Yuanjian, Sun, Tianze, Xu, Changwei, Zhao, XinLong, Hao, Jianing, Chen, Ran, Liu, Yang, Xu, Ruijie, Chen, Stephen, Zhang, Guang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
D$^3$: Dynamic Directional Graph-Constrained Data Scheduling for LLM Training
por: Xu, Yuanjian, et al.
Publicado: (2026)
por: Xu, Yuanjian, et al.
Publicado: (2026)
Towards Efficient LLMs Annealing with Principled Sample Selection
por: Xu, Yuanjian, et al.
Publicado: (2026)
por: Xu, Yuanjian, et al.
Publicado: (2026)
Rethinking Data Mixture for Large Language Models: A Comprehensive Survey and New Perspectives
por: Liu, Yajiao, et al.
Publicado: (2025)
por: Liu, Yajiao, et al.
Publicado: (2025)
Rethinking Toxicity Evaluation in Large Language Models: A Multi-Label Perspective
por: Kou, Zhiqiang, et al.
Publicado: (2025)
por: Kou, Zhiqiang, et al.
Publicado: (2025)
Game-Theoretic Lens on LLM-based Multi-Agent Systems
por: Hao, Jianing, et al.
Publicado: (2026)
por: Hao, Jianing, et al.
Publicado: (2026)
FinRipple: Aligning Large Language Models with Financial Market for Event Ripple Effect Awareness
por: Xu, Yuanjian, et al.
Publicado: (2025)
por: Xu, Yuanjian, et al.
Publicado: (2025)
Data Augmentation using Large Language Models: Data Perspectives, Learning Paradigms and Challenges
por: Ding, Bosheng, et al.
Publicado: (2024)
por: Ding, Bosheng, et al.
Publicado: (2024)
Mixed-R1: Unified Reward Perspective For Reasoning Capability in Multimodal Large Language Models
por: Xu, Shilin, et al.
Publicado: (2025)
por: Xu, Shilin, et al.
Publicado: (2025)
HGAN-SDEs: Learning Neural Stochastic Differential Equations with Hermite-Guided Adversarial Training
por: Xu, Yuanjian, et al.
Publicado: (2025)
por: Xu, Yuanjian, et al.
Publicado: (2025)
Automatic Instruction Evolving for Large Language Models
por: Zeng, Weihao, et al.
Publicado: (2024)
por: Zeng, Weihao, et al.
Publicado: (2024)
LLMsPark: A Benchmark for Evaluating Large Language Models in Strategic Gaming Contexts
por: Chen, Junhao, et al.
Publicado: (2025)
por: Chen, Junhao, et al.
Publicado: (2025)
Are Large Language Models a Good Replacement of Taxonomies?
por: Sun, Yushi, et al.
Publicado: (2024)
por: Sun, Yushi, et al.
Publicado: (2024)
Multi-Agent Causal Discovery Using Large Language Models
por: Le, Hao Duong, et al.
Publicado: (2024)
por: Le, Hao Duong, et al.
Publicado: (2024)
DLLMQuant: Quantizing Diffusion-based Large Language Models
por: Xu, Chen, et al.
Publicado: (2025)
por: Xu, Chen, et al.
Publicado: (2025)
CLaw: Benchmarking Chinese Legal Knowledge in Large Language Models - A Fine-grained Corpus and Reasoning Analysis
por: Xu, Xinzhe, et al.
Publicado: (2025)
por: Xu, Xinzhe, et al.
Publicado: (2025)
Lost in Benchmarks? Rethinking Large Language Model Benchmarking with Item Response Theory
por: Zhou, Hongli, et al.
Publicado: (2025)
por: Zhou, Hongli, et al.
Publicado: (2025)
Benchmarking and Rethinking Knowledge Editing for Large Language Models
por: He, Guoxiu, et al.
Publicado: (2025)
por: He, Guoxiu, et al.
Publicado: (2025)
Delta-CoMe: Training-Free Delta-Compression with Mixed-Precision for Large Language Models
por: Ping, Bowen, et al.
Publicado: (2024)
por: Ping, Bowen, et al.
Publicado: (2024)
Benchmarking Benchmark Leakage in Large Language Models
por: Xu, Ruijie, et al.
Publicado: (2024)
por: Xu, Ruijie, et al.
Publicado: (2024)
Rethinking Machine Unlearning for Large Language Models
por: Liu, Sijia, et al.
Publicado: (2024)
por: Liu, Sijia, et al.
Publicado: (2024)
Unveiling the Misuse Potential of Base Large Language Models via In-Context Learning
por: Wang, Xiao, et al.
Publicado: (2024)
por: Wang, Xiao, et al.
Publicado: (2024)
Composition-RL: Compose Your Verifiable Prompts for Reinforcement Learning of Large Language Models
por: Xu, Xin, et al.
Publicado: (2026)
por: Xu, Xin, et al.
Publicado: (2026)
Token-wise Influential Training Data Retrieval for Large Language Models
por: Lin, Huawei, et al.
Publicado: (2024)
por: Lin, Huawei, et al.
Publicado: (2024)
Contrastive Knowledge Transfer and Robust Optimization for Secure Alignment of Large Language Models
por: Zheng, Jiasen, et al.
Publicado: (2025)
por: Zheng, Jiasen, et al.
Publicado: (2025)
Can Large Language Models Match Tutoring System Adaptivity? A Benchmarking Study
por: Borchers, Conrad, et al.
Publicado: (2025)
por: Borchers, Conrad, et al.
Publicado: (2025)
Towards Distillation-Resistant Large Language Models: An Information-Theoretic Perspective
por: Fang, Hao, et al.
Publicado: (2026)
por: Fang, Hao, et al.
Publicado: (2026)
Progressive Residual Warmup for Language Model Pretraining
por: Chen, Tianhao, et al.
Publicado: (2026)
por: Chen, Tianhao, et al.
Publicado: (2026)
LLaSA: Large Language and Structured Data Assistant
por: Xu, Yao, et al.
Publicado: (2024)
por: Xu, Yao, et al.
Publicado: (2024)
Spatial-Temporal Large Language Model for Traffic Prediction
por: Liu, Chenxi, et al.
Publicado: (2024)
por: Liu, Chenxi, et al.
Publicado: (2024)
LENS: Large Pre-trained Transformer for Exploring Financial Time Series Regularities
por: Xu, Yuanjian, et al.
Publicado: (2024)
por: Xu, Yuanjian, et al.
Publicado: (2024)
Rethinking LLM Ensembling from the Perspective of Mixture Models
por: Fu, Jiale, et al.
Publicado: (2026)
por: Fu, Jiale, et al.
Publicado: (2026)
Large Language Models for Generative Information Extraction: A Survey
por: Xu, Derong, et al.
Publicado: (2023)
por: Xu, Derong, et al.
Publicado: (2023)
Large Language Model based Situational Dialogues for Second Language Learning
por: Xu, Shuyao, et al.
Publicado: (2024)
por: Xu, Shuyao, et al.
Publicado: (2024)
Mitigating Hidden Confounding by Progressive Confounder Imputation via Large Language Models
por: Yang, Hao, et al.
Publicado: (2025)
por: Yang, Hao, et al.
Publicado: (2025)
Enhancing Large Language Model Reasoning with Reward Models: An Analytical Survey
por: Liu, Qiyuan, et al.
Publicado: (2025)
por: Liu, Qiyuan, et al.
Publicado: (2025)
Deep Learning and Large Language Models for Audio and Text Analysis in Predicting Suicidal Acts in Chinese Psychological Support Hotlines
por: Chen, Yining, et al.
Publicado: (2024)
por: Chen, Yining, et al.
Publicado: (2024)
VisEval: A Benchmark for Data Visualization in the Era of Large Language Models
por: Chen, Nan, et al.
Publicado: (2024)
por: Chen, Nan, et al.
Publicado: (2024)
Lens: Rethinking Multilingual Enhancement for Large Language Models
por: Zhao, Weixiang, et al.
Publicado: (2024)
por: Zhao, Weixiang, et al.
Publicado: (2024)
Rethinking Mixture-of-Agents: Is Mixing Different Large Language Models Beneficial?
por: Li, Wenzhe, et al.
Publicado: (2025)
por: Li, Wenzhe, et al.
Publicado: (2025)
Robust and Scalable Model Editing for Large Language Models
por: Chen, Yingfa, et al.
Publicado: (2024)
por: Chen, Yingfa, et al.
Publicado: (2024)
Ejemplares similares
-
D$^3$: Dynamic Directional Graph-Constrained Data Scheduling for LLM Training
por: Xu, Yuanjian, et al.
Publicado: (2026) -
Towards Efficient LLMs Annealing with Principled Sample Selection
por: Xu, Yuanjian, et al.
Publicado: (2026) -
Rethinking Data Mixture for Large Language Models: A Comprehensive Survey and New Perspectives
por: Liu, Yajiao, et al.
Publicado: (2025) -
Rethinking Toxicity Evaluation in Large Language Models: A Multi-Label Perspective
por: Kou, Zhiqiang, et al.
Publicado: (2025) -
Game-Theoretic Lens on LLM-based Multi-Agent Systems
por: Hao, Jianing, et al.
Publicado: (2026)