Data Management For Training Large Language Models: A Survey
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Zige, Zhong, Wanjun, Wang, Yufei, Zhu, Qi, Mi, Fei, Wang, Baojun, Shang, Lifeng, Jiang, Xin, Liu, Qun |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
YODA: Teacher-Student Progressive Learning for Language Models
par: Lu, Jianqiao, et autres
Publié: (2024)
par: Lu, Jianqiao, et autres
Publié: (2024)
SELF: Self-Evolution with Language Feedback
par: Lu, Jianqiao, et autres
Publié: (2023)
par: Lu, Jianqiao, et autres
Publié: (2023)
FollowBench: A Multi-level Fine-grained Constraints Following Benchmark for Large Language Models
par: Jiang, Yuxin, et autres
Publié: (2023)
par: Jiang, Yuxin, et autres
Publié: (2023)
EssayBench: Evaluating Large Language Models in Multi-Genre Chinese Essay Writing
par: Gao, Fan, et autres
Publié: (2025)
par: Gao, Fan, et autres
Publié: (2025)
ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs
par: Wang, Zige, et autres
Publié: (2025)
par: Wang, Zige, et autres
Publié: (2025)
DAST: Difficulty-Aware Self-Training on Large Language Models
par: Xue, Boyang, et autres
Publié: (2025)
par: Xue, Boyang, et autres
Publié: (2025)
ToolACE-MT: Non-Autoregressive Generation for Agentic Multi-Turn Interaction
par: Zeng, Xingshan, et autres
Publié: (2025)
par: Zeng, Xingshan, et autres
Publié: (2025)
Adaptive-Solver Framework for Dynamic Strategy Selection in Large Language Model Reasoning
par: Zhou, Jianpeng, et autres
Publié: (2023)
par: Zhou, Jianpeng, et autres
Publié: (2023)
Gaining Wisdom from Setbacks: Aligning Large Language Models via Mistake Analysis
par: Chen, Kai, et autres
Publié: (2023)
par: Chen, Kai, et autres
Publié: (2023)
ReliableMath: Benchmark of Reliable Mathematical Reasoning on Large Language Models
par: Xue, Boyang, et autres
Publié: (2025)
par: Xue, Boyang, et autres
Publié: (2025)
Self-Error-Instruct: Generalizing from Errors for LLMs Mathematical Reasoning
par: Yu, Erxin, et autres
Publié: (2025)
par: Yu, Erxin, et autres
Publié: (2025)
ToolACE-R: Model-aware Iterative Training and Adaptive Refinement for Tool Learning
par: Zeng, Xingshan, et autres
Publié: (2025)
par: Zeng, Xingshan, et autres
Publié: (2025)
Prompt-Based Length Controlled Generation with Multiple Control Types
par: Jie, Renlong, et autres
Publié: (2024)
par: Jie, Renlong, et autres
Publié: (2024)
KDRL: Post-Training Reasoning LLMs via Unified Knowledge Distillation and Reinforcement Learning
par: Xu, Hongling, et autres
Publié: (2025)
par: Xu, Hongling, et autres
Publié: (2025)
Efficient Large Language Models: A Survey
par: Wan, Zhongwei, et autres
Publié: (2023)
par: Wan, Zhongwei, et autres
Publié: (2023)
Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification
par: Liu, Chengwu, et autres
Publié: (2025)
par: Liu, Chengwu, et autres
Publié: (2025)
MT-Eval: A Multi-Turn Capabilities Evaluation Benchmark for Large Language Models
par: Kwan, Wai-Chung, et autres
Publié: (2024)
par: Kwan, Wai-Chung, et autres
Publié: (2024)
Retrieval-based Disentangled Representation Learning with Natural Language Supervision
par: Zhou, Jiawei, et autres
Publié: (2022)
par: Zhou, Jiawei, et autres
Publié: (2022)
Learning to Edit: Aligning LLMs with Knowledge Editing
par: Jiang, Yuxin, et autres
Publié: (2024)
par: Jiang, Yuxin, et autres
Publié: (2024)
PROXYQA: An Alternative Framework for Evaluating Long-Form Text Generation with Large Language Models
par: Tan, Haochen, et autres
Publié: (2024)
par: Tan, Haochen, et autres
Publié: (2024)
Evaluating the External and Parametric Knowledge Fusion of Large Language Models
par: Zhang, Hao, et autres
Publié: (2024)
par: Zhang, Hao, et autres
Publié: (2024)
Factuality of Large Language Models: A Survey
par: Wang, Yuxia, et autres
Publié: (2024)
par: Wang, Yuxia, et autres
Publié: (2024)
A Survey of the Evolution of Language Model-Based Dialogue Systems: Data, Task and Models
par: Wang, Hongru, et autres
Publié: (2023)
par: Wang, Hongru, et autres
Publié: (2023)
A Survey on Fairness in Large Language Models
par: Li, Yingji, et autres
Publié: (2023)
par: Li, Yingji, et autres
Publié: (2023)
Entropy Centroids as Intrinsic Rewards for Test-Time Scaling
par: Zhao, Wenshuo, et autres
Publié: (2026)
par: Zhao, Wenshuo, et autres
Publié: (2026)
A Survey on Model Compression for Large Language Models
par: Zhu, Xunyu, et autres
Publié: (2023)
par: Zhu, Xunyu, et autres
Publié: (2023)
A Survey of Large Language Models on Generative Graph Analytics: Query, Learning, and Applications
par: Shang, Wenbo, et autres
Publié: (2024)
par: Shang, Wenbo, et autres
Publié: (2024)
Teaching LLMs According to Their Aptitude: Adaptive Reasoning for Mathematical Problem Solving
par: Xu, Xin, et autres
Publié: (2025)
par: Xu, Xin, et autres
Publié: (2025)
PerLTQA: A Personal Long-Term Memory Dataset for Memory Classification, Retrieval, and Synthesis in Question Answering
par: Du, Yiming, et autres
Publié: (2024)
par: Du, Yiming, et autres
Publié: (2024)
Gradually Excavating External Knowledge for Implicit Complex Question Answering
par: Liu, Chang, et autres
Publié: (2026)
par: Liu, Chang, et autres
Publié: (2026)
Knowledge Editing for Large Language Models: A Survey
par: Wang, Song, et autres
Publié: (2023)
par: Wang, Song, et autres
Publié: (2023)
A Survey on Large Language Models for Mathematical Reasoning
par: Wang, Peng-Yuan, et autres
Publié: (2025)
par: Wang, Peng-Yuan, et autres
Publié: (2025)
Teaching Large Reasoning Models Effective Reflection
par: Wang, Hanbin, et autres
Publié: (2026)
par: Wang, Hanbin, et autres
Publié: (2026)
A Survey on Evaluation of Large Language Models
par: Chang, Yupeng, et autres
Publié: (2023)
par: Chang, Yupeng, et autres
Publié: (2023)
Large Language Model Enhanced Knowledge Representation Learning: A Survey
par: Wang, Xin, et autres
Publié: (2024)
par: Wang, Xin, et autres
Publié: (2024)
Debug like a Human: A Large Language Model Debugger via Verifying Runtime Execution Step-by-step
par: Zhong, Li, et autres
Publié: (2024)
par: Zhong, Li, et autres
Publié: (2024)
Large Language Model Safety: A Holistic Survey
par: Shi, Dan, et autres
Publié: (2024)
par: Shi, Dan, et autres
Publié: (2024)
Survey of Specialized Large Language Model
par: Yang, Chenghan, et autres
Publié: (2025)
par: Yang, Chenghan, et autres
Publié: (2025)
A Survey of Large Language Models
par: Zhao, Wayne Xin, et autres
Publié: (2023)
par: Zhao, Wayne Xin, et autres
Publié: (2023)
Planning, Creation, Usage: Benchmarking LLMs for Comprehensive Tool Utilization in Real-World Complex Scenarios
par: Huang, Shijue, et autres
Publié: (2024)
par: Huang, Shijue, et autres
Publié: (2024)
Documents similaires
-
YODA: Teacher-Student Progressive Learning for Language Models
par: Lu, Jianqiao, et autres
Publié: (2024) -
SELF: Self-Evolution with Language Feedback
par: Lu, Jianqiao, et autres
Publié: (2023) -
FollowBench: A Multi-level Fine-grained Constraints Following Benchmark for Large Language Models
par: Jiang, Yuxin, et autres
Publié: (2023) -
EssayBench: Evaluating Large Language Models in Multi-Genre Chinese Essay Writing
par: Gao, Fan, et autres
Publié: (2025) -
ClusterUCB: Efficient Gradient-Based Data Selection for Targeted Fine-Tuning of LLMs
par: Wang, Zige, et autres
Publié: (2025)