Enregistré dans:
| Auteurs principaux: | Gupta, Devaansh, Li, Boyang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2407.09985 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
UniDEC : Unified Dual Encoder and Classifier Training for Extreme Multi-Label Classification
par: Kharbanda, Siddhant, et autres
Publié: (2024)
par: Kharbanda, Siddhant, et autres
Publié: (2024)
InceptionXML: A Lightweight Framework with Synchronized Negative Sampling for Short Text Extreme Classification
par: Kharbanda, Siddhant, et autres
Publié: (2021)
par: Kharbanda, Siddhant, et autres
Publié: (2021)
HARNESS-LM: A Three-Phase Training Recipe for Harnessing SLMs in Sponsored Search Retrieval
par: Gupta, Vipul, et autres
Publié: (2026)
par: Gupta, Vipul, et autres
Publié: (2026)
Quamba: A Post-Training Quantization Recipe for Selective State Space Models
par: Chiang, Hung-Yueh, et autres
Publié: (2024)
par: Chiang, Hung-Yueh, et autres
Publié: (2024)
CAT Merging: A Training-Free Approach for Resolving Conflicts in Model Merging
par: Sun, Wenju, et autres
Publié: (2025)
par: Sun, Wenju, et autres
Publié: (2025)
Task Arithmetic in Trust Region: A Training-Free Model Merging Approach to Navigate Knowledge Conflicts
par: Sun, Wenju, et autres
Publié: (2025)
par: Sun, Wenju, et autres
Publié: (2025)
Sim-and-Real Co-Training: A Simple Recipe for Vision-Based Robotic Manipulation
par: Maddukuri, Abhiram, et autres
Publié: (2025)
par: Maddukuri, Abhiram, et autres
Publié: (2025)
On the Difficulty of Learning a Meta-network for Training Data Selection
par: Du, Zilin, et autres
Publié: (2026)
par: Du, Zilin, et autres
Publié: (2026)
Sparse Model Soups: A Recipe for Improved Pruning via Model Averaging
par: Zimmer, Max, et autres
Publié: (2023)
par: Zimmer, Max, et autres
Publié: (2023)
Rethinking On-Policy Distillation of Large Language Models: Phenomenology, Mechanism, and Recipe
par: Li, Yaxuan, et autres
Publié: (2026)
par: Li, Yaxuan, et autres
Publié: (2026)
MoE-DisCo:Low Economy Cost Training Mixture-of-Experts Models
par: Ye, Xin, et autres
Publié: (2026)
par: Ye, Xin, et autres
Publié: (2026)
SFTMix: Elevating Language Model Instruction Tuning with Mixup Recipe
par: Xiao, Yuxin, et autres
Publié: (2024)
par: Xiao, Yuxin, et autres
Publié: (2024)
Paint Outside the Box: Synthesizing and Selecting Training Data for Visual Grounding
par: Du, Zilin, et autres
Publié: (2024)
par: Du, Zilin, et autres
Publié: (2024)
VALUE: Value-Aware Large Language Model for Query Rewriting via Weighted Trie in Sponsored Search
par: Zhang, Xiao, et autres
Publié: (2025)
par: Zhang, Xiao, et autres
Publié: (2025)
Efficient Training of Large-Scale AI Models Through Federated Mixture-of-Experts: A System-Level Approach
par: Chen, Xiaobing, et autres
Publié: (2025)
par: Chen, Xiaobing, et autres
Publié: (2025)
Native Reasoning Models: Training Language Models to Reason on Unverifiable Data
par: Wang, Yuanfu, et autres
Publié: (2026)
par: Wang, Yuanfu, et autres
Publié: (2026)
Understanding and Accelerating the Training of Masked Diffusion Language Models
par: Hong, Chunsan, et autres
Publié: (2026)
par: Hong, Chunsan, et autres
Publié: (2026)
A Novel Approach to Balance Convenience and Nutrition in Meals With Long-Term Group Recommendations and Reasoning on Multimodal Recipes and its Implementation in BEACON
par: Nagpal, Vansh, et autres
Publié: (2024)
par: Nagpal, Vansh, et autres
Publié: (2024)
A Cross Modal Knowledge Distillation & Data Augmentation Recipe for Improving Transcriptomics Representations through Morphological Features
par: Bendidi, Ihab, et autres
Publié: (2025)
par: Bendidi, Ihab, et autres
Publié: (2025)
Data Efficacy for Language Model Training
par: Dai, Yalun, et autres
Publié: (2025)
par: Dai, Yalun, et autres
Publié: (2025)
Exploiting Block Coordinate Descent for Cost-Effective LLM Model Training
par: Liu, Zeyu, et autres
Publié: (2025)
par: Liu, Zeyu, et autres
Publié: (2025)
Provable Training Data Identification for Large Language Models
par: Liu, Zhenlong, et autres
Publié: (2025)
par: Liu, Zhenlong, et autres
Publié: (2025)
PeopleSearchBench: A Multi-Dimensional Benchmark for Evaluating AI-Powered People Search Platforms
par: Wang, Wei, et autres
Publié: (2026)
par: Wang, Wei, et autres
Publié: (2026)
Generating Realistic Tabular Data with Large Language Models
par: Nguyen, Dang, et autres
Publié: (2024)
par: Nguyen, Dang, et autres
Publié: (2024)
EvoLM: In Search of Lost Language Model Training Dynamics
par: Qi, Zhenting, et autres
Publié: (2025)
par: Qi, Zhenting, et autres
Publié: (2025)
A Recipe for Causal Graph Regression: Confounding Effects Revisited
par: Yin, Yujia, et autres
Publié: (2025)
par: Yin, Yujia, et autres
Publié: (2025)
A Recipe for Stable Offline Multi-agent Reinforcement Learning
par: Lee, Dongsu, et autres
Publié: (2026)
par: Lee, Dongsu, et autres
Publié: (2026)
Reset & Distill: A Recipe for Overcoming Negative Transfer in Continual Reinforcement Learning
par: Ahn, Hongjoon, et autres
Publié: (2024)
par: Ahn, Hongjoon, et autres
Publié: (2024)
The Sharpness Disparity Principle in Transformers for Accelerating Language Model Pre-Training
par: Wang, Jinbo, et autres
Publié: (2025)
par: Wang, Jinbo, et autres
Publié: (2025)
Over-Searching in Search-Augmented Large Language Models
par: Xie, Roy, et autres
Publié: (2026)
par: Xie, Roy, et autres
Publié: (2026)
NASH: Neural Architecture and Accelerator Search for Multiplication-Reduced Hybrid Models
par: Xu, Yang, et autres
Publié: (2024)
par: Xu, Yang, et autres
Publié: (2024)
When Data Is Scarce: Scaling Sparse Language Models with Repeated Training
par: Wu, Boqian, et autres
Publié: (2026)
par: Wu, Boqian, et autres
Publié: (2026)
Bootstrapped Mixed Rewards for RL Post-Training: Injecting Canonical Action Order
par: Gupta, Prakhar, et autres
Publié: (2025)
par: Gupta, Prakhar, et autres
Publié: (2025)
Can Large Language Models Learn Formal Logic? A Data-Driven Training and Evaluation Framework
par: Xia, Yuan, et autres
Publié: (2025)
par: Xia, Yuan, et autres
Publié: (2025)
d1: Scaling Reasoning in Diffusion Large Language Models via Reinforcement Learning
par: Zhao, Siyan, et autres
Publié: (2025)
par: Zhao, Siyan, et autres
Publié: (2025)
Optimizing the Training Diet: Data Mixture Search for Robust Time Series Forecasting
par: Pennino, Federico, et autres
Publié: (2025)
par: Pennino, Federico, et autres
Publié: (2025)
Regurgitative Training: The Value of Real Data in Training Large Language Models
par: Zhang, Jinghui, et autres
Publié: (2024)
par: Zhang, Jinghui, et autres
Publié: (2024)
Fast-DataShapley: Neural Modeling for Training Data Valuation
par: Sun, Haifeng, et autres
Publié: (2025)
par: Sun, Haifeng, et autres
Publié: (2025)
ADMIRE-BayesOpt: Accelerated Data MIxture RE-weighting for Language Models with Bayesian Optimization
par: Chen, Shengzhuang, et autres
Publié: (2025)
par: Chen, Shengzhuang, et autres
Publié: (2025)
Actor-Critic based Online Data Mixing For Language Model Pre-Training
par: Ma, Jing, et autres
Publié: (2025)
par: Ma, Jing, et autres
Publié: (2025)
Documents similaires
-
UniDEC : Unified Dual Encoder and Classifier Training for Extreme Multi-Label Classification
par: Kharbanda, Siddhant, et autres
Publié: (2024) -
InceptionXML: A Lightweight Framework with Synchronized Negative Sampling for Short Text Extreme Classification
par: Kharbanda, Siddhant, et autres
Publié: (2021) -
HARNESS-LM: A Three-Phase Training Recipe for Harnessing SLMs in Sponsored Search Retrieval
par: Gupta, Vipul, et autres
Publié: (2026) -
Quamba: A Post-Training Quantization Recipe for Selective State Space Models
par: Chiang, Hung-Yueh, et autres
Publié: (2024) -
CAT Merging: A Training-Free Approach for Resolving Conflicts in Model Merging
par: Sun, Wenju, et autres
Publié: (2025)