Data-Efficient Training by Evolved Sampling
Fuente:
arXiv
Saved in:
| Main Authors: | Cheng, Ziheng, Li, Zhong, Bian, Jiang |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DeepSpeed Data Efficiency: Improving Deep Learning Model Quality and Training Efficiency via Efficient Data Sampling and Routing
by: Li, Conglong, et al.
Published: (2022)
by: Li, Conglong, et al.
Published: (2022)
Easy Samples Are All You Need: Self-Evolving LLMs via Data-Efficient Reinforcement Learning
by: Yu, Zhiyin, et al.
Published: (2026)
by: Yu, Zhiyin, et al.
Published: (2026)
Experience-Evolving Multi-Turn Tool-Use Agent with Hybrid Episodic-Procedural Memory
by: Li, Sijia, et al.
Published: (2025)
by: Li, Sijia, et al.
Published: (2025)
How Reasoning Evolves from Post-Training Data: An Empirical Study Using Chess
by: Dionisopoulos, Lucas, et al.
Published: (2026)
by: Dionisopoulos, Lucas, et al.
Published: (2026)
Xmodel-2.5: 1.3B Data-Efficient Reasoning SLM
by: Liu, Yang, et al.
Published: (2025)
by: Liu, Yang, et al.
Published: (2025)
Efficient Ensembles Improve Training Data Attribution
by: Deng, Junwei, et al.
Published: (2024)
by: Deng, Junwei, et al.
Published: (2024)
BatteryML:An Open-source platform for Machine Learning on Battery Degradation
by: Zhang, Han, et al.
Published: (2023)
by: Zhang, Han, et al.
Published: (2023)
How to Train Data-Efficient LLMs
by: Sachdeva, Noveen, et al.
Published: (2024)
by: Sachdeva, Noveen, et al.
Published: (2024)
PolicyEvolve: Evolving Programmatic Policies by LLMs for multi-player games via Population-Based Training
by: Lv, Mingrui, et al.
Published: (2025)
by: Lv, Mingrui, et al.
Published: (2025)
Outlier Gradient Analysis: Efficiently Identifying Detrimental Training Samples for Deep Learning Models
by: Chhabra, Anshuman, et al.
Published: (2024)
by: Chhabra, Anshuman, et al.
Published: (2024)
Back To The Future: A Hybrid Transformer-XGBoost Model for Action-oriented Future-proofing Nowcasting
by: Sun, Ziheng
Published: (2024)
by: Sun, Ziheng
Published: (2024)
Info-Coevolution: An Efficient Framework for Data Model Coevolution
by: Qin, Ziheng, et al.
Published: (2025)
by: Qin, Ziheng, et al.
Published: (2025)
Synthetic Data Generation for Residential Load Patterns via Recurrent GAN and Ensemble Method
by: Liang, Xinyu, et al.
Published: (2024)
by: Liang, Xinyu, et al.
Published: (2024)
On Sample-Efficient Offline Reinforcement Learning: Data Diversity, Posterior Sampling, and Beyond
by: Nguyen-Tang, Thanh, et al.
Published: (2024)
by: Nguyen-Tang, Thanh, et al.
Published: (2024)
InvEvolve: Evolving White-Box Inventory Policies via Large Language Models with Performance Guarantees
by: Huang, Chenyu, et al.
Published: (2026)
by: Huang, Chenyu, et al.
Published: (2026)
Distributional Training Data Attribution: What do Influence Functions Sample?
by: Mlodozeniec, Bruno, et al.
Published: (2025)
by: Mlodozeniec, Bruno, et al.
Published: (2025)
GraphProp: Training the Graph Foundation Models using Graph Properties
by: Sun, Ziheng, et al.
Published: (2025)
by: Sun, Ziheng, et al.
Published: (2025)
Higher Replay Ratio Empowers Sample-Efficient Multi-Agent Reinforcement Learning
by: Xu, Linjie, et al.
Published: (2024)
by: Xu, Linjie, et al.
Published: (2024)
Evaluation for Regression Analyses on Evolving Data Streams
by: Sun, Yibin, et al.
Published: (2025)
by: Sun, Yibin, et al.
Published: (2025)
Entropy-Guided Data-Efficient Training for Multimodal Reasoning Reward Models
by: Yang, Shidong, et al.
Published: (2026)
by: Yang, Shidong, et al.
Published: (2026)
Efficient Reinforcement Learning for Zero-Shot Coordination in Evolving Games
by: Hui, Bingyu, et al.
Published: (2025)
by: Hui, Bingyu, et al.
Published: (2025)
A Survey on Memory-Efficient Transformer-Based Model Training in AI for Science
by: Tian, Kaiyuan, et al.
Published: (2025)
by: Tian, Kaiyuan, et al.
Published: (2025)
Topology-Aware Revival for Efficient Sparse Training
by: Jin, Meiling, et al.
Published: (2026)
by: Jin, Meiling, et al.
Published: (2026)
ssProp: Energy-Efficient Training for Convolutional Neural Networks with Scheduled Sparse Back Propagation
by: Zhong, Lujia, et al.
Published: (2024)
by: Zhong, Lujia, et al.
Published: (2024)
Intrinsic Lorentz Neural Network
by: Shi, Xianglong, et al.
Published: (2026)
by: Shi, Xianglong, et al.
Published: (2026)
Efficient Multi-Task Modeling through Automated Fusion of Trained Models
by: Zhou, Jingxuan, et al.
Published: (2025)
by: Zhou, Jingxuan, et al.
Published: (2025)
Training Data Selection with Gradient Orthogonality for Efficient Domain Adaptation
by: Zhang, Xiyang, et al.
Published: (2026)
by: Zhang, Xiyang, et al.
Published: (2026)
Data Warmup: Complexity-Aware Curricula for Efficient Diffusion Training
by: Lin, Jinhong, et al.
Published: (2026)
by: Lin, Jinhong, et al.
Published: (2026)
AgentEvolver: Towards Efficient Self-Evolving Agent System
by: Zhai, Yunpeng, et al.
Published: (2025)
by: Zhai, Yunpeng, et al.
Published: (2025)
FlashSampling: Fast and Memory-Efficient Exact Sampling
by: Ruiz, Tomas, et al.
Published: (2026)
by: Ruiz, Tomas, et al.
Published: (2026)
Evaluating Sample Utility for Efficient Data Selection by Mimicking Model Weights
by: Huang, Tzu-Heng, et al.
Published: (2025)
by: Huang, Tzu-Heng, et al.
Published: (2025)
Scalable Power Sampling: Unlocking Efficient, Training-Free Reasoning for LLMs via Distribution Sharpening
by: Ji, Xiaotong, et al.
Published: (2026)
by: Ji, Xiaotong, et al.
Published: (2026)
In-context Learning of Evolving Data Streams with Tabular Foundational Models
by: Lourenço, Afonso, et al.
Published: (2025)
by: Lourenço, Afonso, et al.
Published: (2025)
Could Chemical LLMs benefit from Message Passing
by: Xie, Jiaqing, et al.
Published: (2024)
by: Xie, Jiaqing, et al.
Published: (2024)
SPaCe: Unlocking Sample-Efficient Large Language Models Training With Self-Pace Curriculum Learning
by: Do, Dai, et al.
Published: (2025)
by: Do, Dai, et al.
Published: (2025)
FairSample: Training Fair and Accurate Graph Convolutional Neural Networks Efficiently
by: Cong, Zicun, et al.
Published: (2024)
by: Cong, Zicun, et al.
Published: (2024)
Rebalanced Multimodal Learning with Data-aware Unimodal Sampling
by: Jiang, Qingyuan, et al.
Published: (2025)
by: Jiang, Qingyuan, et al.
Published: (2025)
Diving into Self-Evolving Training for Multimodal Reasoning
by: Liu, Wei, et al.
Published: (2024)
by: Liu, Wei, et al.
Published: (2024)
DeltaEvolve: Accelerating Scientific Discovery through Momentum-Driven Evolution
by: Jiang, Jiachen, et al.
Published: (2026)
by: Jiang, Jiachen, et al.
Published: (2026)
Open-Medical-R1: How to Choose Data for RLVR Training at Medicine Domain
by: Qiu, Zhongxi, et al.
Published: (2025)
by: Qiu, Zhongxi, et al.
Published: (2025)
Similar Items
-
DeepSpeed Data Efficiency: Improving Deep Learning Model Quality and Training Efficiency via Efficient Data Sampling and Routing
by: Li, Conglong, et al.
Published: (2022) -
Easy Samples Are All You Need: Self-Evolving LLMs via Data-Efficient Reinforcement Learning
by: Yu, Zhiyin, et al.
Published: (2026) -
Experience-Evolving Multi-Turn Tool-Use Agent with Hybrid Episodic-Procedural Memory
by: Li, Sijia, et al.
Published: (2025) -
How Reasoning Evolves from Post-Training Data: An Empirical Study Using Chess
by: Dionisopoulos, Lucas, et al.
Published: (2026) -
Xmodel-2.5: 1.3B Data-Efficient Reasoning SLM
by: Liu, Yang, et al.
Published: (2025)