Gespeichert in:
| Hauptverfasser: | Gupta, Devaansh, Li, Boyang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2407.09985 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
UniDEC : Unified Dual Encoder and Classifier Training for Extreme Multi-Label Classification
von: Kharbanda, Siddhant, et al.
Veröffentlicht: (2024)
von: Kharbanda, Siddhant, et al.
Veröffentlicht: (2024)
InceptionXML: A Lightweight Framework with Synchronized Negative Sampling for Short Text Extreme Classification
von: Kharbanda, Siddhant, et al.
Veröffentlicht: (2021)
von: Kharbanda, Siddhant, et al.
Veröffentlicht: (2021)
HARNESS-LM: A Three-Phase Training Recipe for Harnessing SLMs in Sponsored Search Retrieval
von: Gupta, Vipul, et al.
Veröffentlicht: (2026)
von: Gupta, Vipul, et al.
Veröffentlicht: (2026)
Quamba: A Post-Training Quantization Recipe for Selective State Space Models
von: Chiang, Hung-Yueh, et al.
Veröffentlicht: (2024)
von: Chiang, Hung-Yueh, et al.
Veröffentlicht: (2024)
CAT Merging: A Training-Free Approach for Resolving Conflicts in Model Merging
von: Sun, Wenju, et al.
Veröffentlicht: (2025)
von: Sun, Wenju, et al.
Veröffentlicht: (2025)
Task Arithmetic in Trust Region: A Training-Free Model Merging Approach to Navigate Knowledge Conflicts
von: Sun, Wenju, et al.
Veröffentlicht: (2025)
von: Sun, Wenju, et al.
Veröffentlicht: (2025)
Sim-and-Real Co-Training: A Simple Recipe for Vision-Based Robotic Manipulation
von: Maddukuri, Abhiram, et al.
Veröffentlicht: (2025)
von: Maddukuri, Abhiram, et al.
Veröffentlicht: (2025)
On the Difficulty of Learning a Meta-network for Training Data Selection
von: Du, Zilin, et al.
Veröffentlicht: (2026)
von: Du, Zilin, et al.
Veröffentlicht: (2026)
Sparse Model Soups: A Recipe for Improved Pruning via Model Averaging
von: Zimmer, Max, et al.
Veröffentlicht: (2023)
von: Zimmer, Max, et al.
Veröffentlicht: (2023)
Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mechanism, and Recipe
von: Li, Yaxuan, et al.
Veröffentlicht: (2026)
von: Li, Yaxuan, et al.
Veröffentlicht: (2026)
MoE-DisCo:Low Economy Cost Training Mixture-of-Experts Models
von: Ye, Xin, et al.
Veröffentlicht: (2026)
von: Ye, Xin, et al.
Veröffentlicht: (2026)
SFTMix: Elevating Language Model Instruction Tuning with Mixup Recipe
von: Xiao, Yuxin, et al.
Veröffentlicht: (2024)
von: Xiao, Yuxin, et al.
Veröffentlicht: (2024)
Paint Outside the Box: Synthesizing and Selecting Training Data for Visual Grounding
von: Du, Zilin, et al.
Veröffentlicht: (2024)
von: Du, Zilin, et al.
Veröffentlicht: (2024)
VALUE: Value-Aware Large Language Model for Query Rewriting via Weighted Trie in Sponsored Search
von: Zhang, Xiao, et al.
Veröffentlicht: (2025)
von: Zhang, Xiao, et al.
Veröffentlicht: (2025)
Efficient Training of Large-Scale AI Models Through Federated Mixture-of-Experts: A System-Level Approach
von: Chen, Xiaobing, et al.
Veröffentlicht: (2025)
von: Chen, Xiaobing, et al.
Veröffentlicht: (2025)
Native Reasoning Models: Training Language Models to Reason on Unverifiable Data
von: Wang, Yuanfu, et al.
Veröffentlicht: (2026)
von: Wang, Yuanfu, et al.
Veröffentlicht: (2026)
Understanding and Accelerating the Training of Masked Diffusion Language Models
von: Hong, Chunsan, et al.
Veröffentlicht: (2026)
von: Hong, Chunsan, et al.
Veröffentlicht: (2026)
A Novel Approach to Balance Convenience and Nutrition in Meals With Long-Term Group Recommendations and Reasoning on Multimodal Recipes and its Implementation in BEACON
von: Nagpal, Vansh, et al.
Veröffentlicht: (2024)
von: Nagpal, Vansh, et al.
Veröffentlicht: (2024)
A Cross Modal Knowledge Distillation & Data Augmentation Recipe for Improving Transcriptomics Representations through Morphological Features
von: Bendidi, Ihab, et al.
Veröffentlicht: (2025)
von: Bendidi, Ihab, et al.
Veröffentlicht: (2025)
Data Efficacy for Language Model Training
von: Dai, Yalun, et al.
Veröffentlicht: (2025)
von: Dai, Yalun, et al.
Veröffentlicht: (2025)
Exploiting Block Coordinate Descent for Cost-Effective LLM Model Training
von: Liu, Zeyu, et al.
Veröffentlicht: (2025)
von: Liu, Zeyu, et al.
Veröffentlicht: (2025)
Provable Training Data Identification for Large Language Models
von: Liu, Zhenlong, et al.
Veröffentlicht: (2025)
von: Liu, Zhenlong, et al.
Veröffentlicht: (2025)
PeopleSearchBench: A Multi-Dimensional Benchmark for Evaluating AI-Powered People Search Platforms
von: Wang, Wei, et al.
Veröffentlicht: (2026)
von: Wang, Wei, et al.
Veröffentlicht: (2026)
Generating Realistic Tabular Data with Large Language Models
von: Nguyen, Dang, et al.
Veröffentlicht: (2024)
von: Nguyen, Dang, et al.
Veröffentlicht: (2024)
EvoLM: In Search of Lost Language Model Training Dynamics
von: Qi, Zhenting, et al.
Veröffentlicht: (2025)
von: Qi, Zhenting, et al.
Veröffentlicht: (2025)
A Recipe for Causal Graph Regression: Confounding Effects Revisited
von: Yin, Yujia, et al.
Veröffentlicht: (2025)
von: Yin, Yujia, et al.
Veröffentlicht: (2025)
A Recipe for Stable Offline Multi-agent Reinforcement Learning
von: Lee, Dongsu, et al.
Veröffentlicht: (2026)
von: Lee, Dongsu, et al.
Veröffentlicht: (2026)
Reset & Distill: A Recipe for Overcoming Negative Transfer in Continual Reinforcement Learning
von: Ahn, Hongjoon, et al.
Veröffentlicht: (2024)
von: Ahn, Hongjoon, et al.
Veröffentlicht: (2024)
The Sharpness Disparity Principle in Transformers for Accelerating Language Model Pre-Training
von: Wang, Jinbo, et al.
Veröffentlicht: (2025)
von: Wang, Jinbo, et al.
Veröffentlicht: (2025)
Over-Searching in Search-Augmented Large Language Models
von: Xie, Roy, et al.
Veröffentlicht: (2026)
von: Xie, Roy, et al.
Veröffentlicht: (2026)
NASH: Neural Architecture and Accelerator Search for Multiplication-Reduced Hybrid Models
von: Xu, Yang, et al.
Veröffentlicht: (2024)
von: Xu, Yang, et al.
Veröffentlicht: (2024)
When Data Is Scarce: Scaling Sparse Language Models with Repeated Training
von: Wu, Boqian, et al.
Veröffentlicht: (2026)
von: Wu, Boqian, et al.
Veröffentlicht: (2026)
Bootstrapped Mixed Rewards for RL Post-Training: Injecting Canonical Action Order
von: Gupta, Prakhar, et al.
Veröffentlicht: (2025)
von: Gupta, Prakhar, et al.
Veröffentlicht: (2025)
Can Large Language Models Learn Formal Logic? A Data-Driven Training and Evaluation Framework
von: Xia, Yuan, et al.
Veröffentlicht: (2025)
von: Xia, Yuan, et al.
Veröffentlicht: (2025)
d1: Scaling Reasoning in Diffusion Large Language Models via Reinforcement Learning
von: Zhao, Siyan, et al.
Veröffentlicht: (2025)
von: Zhao, Siyan, et al.
Veröffentlicht: (2025)
Optimizing the Training Diet: Data Mixture Search for Robust Time Series Forecasting
von: Pennino, Federico, et al.
Veröffentlicht: (2025)
von: Pennino, Federico, et al.
Veröffentlicht: (2025)
Regurgitative Training: The Value of Real Data in Training Large Language Models
von: Zhang, Jinghui, et al.
Veröffentlicht: (2024)
von: Zhang, Jinghui, et al.
Veröffentlicht: (2024)
Fast-DataShapley: Neural Modeling for Training Data Valuation
von: Sun, Haifeng, et al.
Veröffentlicht: (2025)
von: Sun, Haifeng, et al.
Veröffentlicht: (2025)
ADMIRE-BayesOpt: Accelerated Data MIxture RE-weighting for Language Models with Bayesian Optimization
von: Chen, Shengzhuang, et al.
Veröffentlicht: (2025)
von: Chen, Shengzhuang, et al.
Veröffentlicht: (2025)
Actor-Critic based Online Data Mixing For Language Model Pre-Training
von: Ma, Jing, et al.
Veröffentlicht: (2025)
von: Ma, Jing, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
UniDEC : Unified Dual Encoder and Classifier Training for Extreme Multi-Label Classification
von: Kharbanda, Siddhant, et al.
Veröffentlicht: (2024) -
InceptionXML: A Lightweight Framework with Synchronized Negative Sampling for Short Text Extreme Classification
von: Kharbanda, Siddhant, et al.
Veröffentlicht: (2021) -
HARNESS-LM: A Three-Phase Training Recipe for Harnessing SLMs in Sponsored Search Retrieval
von: Gupta, Vipul, et al.
Veröffentlicht: (2026) -
Quamba: A Post-Training Quantization Recipe for Selective State Space Models
von: Chiang, Hung-Yueh, et al.
Veröffentlicht: (2024) -
CAT Merging: A Training-Free Approach for Resolving Conflicts in Model Merging
von: Sun, Wenju, et al.
Veröffentlicht: (2025)