Salvato in:
| Autori principali: | Ozkara, Kaan, Yu, Tao, Park, Youngsuk |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2502.20566 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MuonBP: Faster Muon via Block-Periodic Orthogonalization
di: Khaled, Ahmed, et al.
Pubblicazione: (2025)
di: Khaled, Ahmed, et al.
Pubblicazione: (2025)
Directional Alignment Mitigates Reward Hacking in Reinforcement Learning for Language Models
di: Deng, Wenlong, et al.
Pubblicazione: (2026)
di: Deng, Wenlong, et al.
Pubblicazione: (2026)
Training LLMs with MXFP4
di: Tseng, Albert, et al.
Pubblicazione: (2025)
di: Tseng, Albert, et al.
Pubblicazione: (2025)
SPIRE: Conditional Personalization for Federated Diffusion Generative Models
di: Ozkara, Kaan, et al.
Pubblicazione: (2025)
di: Ozkara, Kaan, et al.
Pubblicazione: (2025)
ADEPT: Hierarchical Bayes Approach to Personalized Federated Unsupervised Learning
di: Ozkara, Kaan, et al.
Pubblicazione: (2024)
di: Ozkara, Kaan, et al.
Pubblicazione: (2024)
Collage: Light-Weight Low-Precision Strategy for LLM Training
di: Yu, Tao, et al.
Pubblicazione: (2024)
di: Yu, Tao, et al.
Pubblicazione: (2024)
Scaling Laws Meet Model Architecture: Toward Inference-Efficient LLMs
di: Bian, Song, et al.
Pubblicazione: (2025)
di: Bian, Song, et al.
Pubblicazione: (2025)
MADA: Meta-Adaptive Optimizers through hyper-gradient Descent
di: Ozkara, Kaan, et al.
Pubblicazione: (2024)
di: Ozkara, Kaan, et al.
Pubblicazione: (2024)
Direct Quantized Training of Language Models with Stochastic Rounding
di: Zhao, Kaiyan, et al.
Pubblicazione: (2024)
di: Zhao, Kaiyan, et al.
Pubblicazione: (2024)
TritonRL: Training LLMs to Think and Code Triton Without Cheating
di: Woo, Jiin, et al.
Pubblicazione: (2025)
di: Woo, Jiin, et al.
Pubblicazione: (2025)
Training with Fewer Bits: Unlocking Edge LLMs Training with Stochastic Rounding
di: Liu, Taowen, et al.
Pubblicazione: (2025)
di: Liu, Taowen, et al.
Pubblicazione: (2025)
MEL: Multi-level Ensemble Learning for Resource-Constrained Environments
di: Gudipaty, Krishna Praneet, et al.
Pubblicazione: (2025)
di: Gudipaty, Krishna Praneet, et al.
Pubblicazione: (2025)
Not-a-Bandit: Provably No-Regret Drafter Selection in Speculative Decoding for LLMs
di: Liu, Hongyi, et al.
Pubblicazione: (2025)
di: Liu, Hongyi, et al.
Pubblicazione: (2025)
Stochastic Rounding Increases Small Singular Values
di: Ma, Linkai, et al.
Pubblicazione: (2026)
di: Ma, Linkai, et al.
Pubblicazione: (2026)
Online Posterior Sampling with a Diffusion Prior
di: Kveton, Branislav, et al.
Pubblicazione: (2024)
di: Kveton, Branislav, et al.
Pubblicazione: (2024)
Theoretical Guarantees of Learning Ensembling Strategies with Applications to Time Series Forecasting
di: Hasson, Hilaf, et al.
Pubblicazione: (2023)
di: Hasson, Hilaf, et al.
Pubblicazione: (2023)
Variance-reduced Zeroth-Order Methods for Fine-Tuning Language Models
di: Gautam, Tanmay, et al.
Pubblicazione: (2024)
di: Gautam, Tanmay, et al.
Pubblicazione: (2024)
On Stochastic Rounding with Few Random Bits
di: Fitzgibbon, Andrew, et al.
Pubblicazione: (2025)
di: Fitzgibbon, Andrew, et al.
Pubblicazione: (2025)
FlexRound: Learnable Rounding based on Element-wise Division for Post-Training Quantization
di: Lee, Jung Hyun, et al.
Pubblicazione: (2023)
di: Lee, Jung Hyun, et al.
Pubblicazione: (2023)
ProxSparse: Regularized Learning of Semi-Structured Sparsity Masks for Pretrained LLMs
di: Liu, Hongyi, et al.
Pubblicazione: (2025)
di: Liu, Hongyi, et al.
Pubblicazione: (2025)
Beyond Fixed Rounds: Data-Free Early Stopping for Practical Federated Learning
di: Lee, Youngjoon, et al.
Pubblicazione: (2026)
di: Lee, Youngjoon, et al.
Pubblicazione: (2026)
Stochastic Deep Graph Clustering for Practical Group Formation
di: Park, Junhyung, et al.
Pubblicazione: (2025)
di: Park, Junhyung, et al.
Pubblicazione: (2025)
Revisiting Adaptive Rounding with Vectorized Reparameterization for LLM Quantization
di: Zhou, Yuli, et al.
Pubblicazione: (2026)
di: Zhou, Yuli, et al.
Pubblicazione: (2026)
Round-trip Reinforcement Learning: Self-Consistent Training for Better Chemical LLMs
di: Kong, Lecheng, et al.
Pubblicazione: (2025)
di: Kong, Lecheng, et al.
Pubblicazione: (2025)
Superpositional Gradient Descent: Harnessing Quantum Principles for Model Training
di: Pamuk, Ahmet Erdem, et al.
Pubblicazione: (2025)
di: Pamuk, Ahmet Erdem, et al.
Pubblicazione: (2025)
RoSTE: An Efficient Quantization-Aware Supervised Fine-Tuning Approach for Large Language Models
di: Wei, Quan, et al.
Pubblicazione: (2025)
di: Wei, Quan, et al.
Pubblicazione: (2025)
Verifier-free Test-Time Sampling for Vision Language Action Models
di: Jang, Suhyeok, et al.
Pubblicazione: (2025)
di: Jang, Suhyeok, et al.
Pubblicazione: (2025)
Elucidating Subspace Perturbation in Zeroth-Order Optimization: Theory and Practice at Scale
di: Park, Sihwan, et al.
Pubblicazione: (2025)
di: Park, Sihwan, et al.
Pubblicazione: (2025)
Efficient Training on Multiple Consumer GPUs with RoundPipe
di: Luo, Yibin, et al.
Pubblicazione: (2026)
di: Luo, Yibin, et al.
Pubblicazione: (2026)
Optimal Scheduling Algorithms for LLM Inference: Theory and Practice
di: Bari, Agrim, et al.
Pubblicazione: (2025)
di: Bari, Agrim, et al.
Pubblicazione: (2025)
A Universal Banach--Bregman Framework for Stochastic Iterations: Unifying Stochastic Mirror Descent, Learning and LLM Training
di: Zhang, Johnny R., et al.
Pubblicazione: (2025)
di: Zhang, Johnny R., et al.
Pubblicazione: (2025)
Bridging Theory and Practice: A Stochastic Learning-Optimization Model for Resilient Automotive Supply Chains
di: Shahnawaz, Muhammad, et al.
Pubblicazione: (2025)
di: Shahnawaz, Muhammad, et al.
Pubblicazione: (2025)
QuChaTeR: A Hybrid Quantum-Chaotic Temporal Framework for Earthquake Prediction
di: Özdemir, Emir Kaan
Pubblicazione: (2026)
di: Özdemir, Emir Kaan
Pubblicazione: (2026)
Random Matrix Theory for Stochastic Gradient Descent
di: Park, Chanju, et al.
Pubblicazione: (2024)
di: Park, Chanju, et al.
Pubblicazione: (2024)
Round and Round We Go! What makes Rotary Positional Encodings useful?
di: Barbero, Federico, et al.
Pubblicazione: (2024)
di: Barbero, Federico, et al.
Pubblicazione: (2024)
Stochastic Forward-Backward Deconvolution: Training Diffusion Models with Finite Noisy Datasets
di: Lu, Haoye, et al.
Pubblicazione: (2025)
di: Lu, Haoye, et al.
Pubblicazione: (2025)
A Reduction Algorithm for Markovian Contextual Linear Bandits
di: Buyukkalayci, Kaan, et al.
Pubblicazione: (2026)
di: Buyukkalayci, Kaan, et al.
Pubblicazione: (2026)
Inference Optimization of Foundation Models on AI Accelerators
di: Park, Youngsuk, et al.
Pubblicazione: (2024)
di: Park, Youngsuk, et al.
Pubblicazione: (2024)
Memory-Efficient LLM Training with Dynamic Sparsity: From Stability to Practical Scaling
di: Xiao, Qiao, et al.
Pubblicazione: (2026)
di: Xiao, Qiao, et al.
Pubblicazione: (2026)
Towards Best Practices for Open Datasets for LLM Training
di: Baack, Stefan, et al.
Pubblicazione: (2025)
di: Baack, Stefan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MuonBP: Faster Muon via Block-Periodic Orthogonalization
di: Khaled, Ahmed, et al.
Pubblicazione: (2025) -
Directional Alignment Mitigates Reward Hacking in Reinforcement Learning for Language Models
di: Deng, Wenlong, et al.
Pubblicazione: (2026) -
Training LLMs with MXFP4
di: Tseng, Albert, et al.
Pubblicazione: (2025) -
SPIRE: Conditional Personalization for Federated Diffusion Generative Models
di: Ozkara, Kaan, et al.
Pubblicazione: (2025) -
ADEPT: Hierarchical Bayes Approach to Personalized Federated Unsupervised Learning
di: Ozkara, Kaan, et al.
Pubblicazione: (2024)