ReALLM: A general framework for LLM compression and fine-tuning
Fuente:
arXiv
Salvato in:
| Autori principali: | Leconte, Louis, Bedin, Lisa, Nguyen, Van Minh, Moulines, Eric |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Queuing dynamics of asynchronous Federated Learning
di: Leconte, Louis, et al.
Pubblicazione: (2024)
di: Leconte, Louis, et al.
Pubblicazione: (2024)
Bayesian ECG reconstruction using denoising diffusion generative models
di: Cardoso, Gabriel V., et al.
Pubblicazione: (2023)
di: Cardoso, Gabriel V., et al.
Pubblicazione: (2023)
Boolean Logic as an Error feedback mechanism
di: Leconte, Louis
Pubblicazione: (2024)
di: Leconte, Louis
Pubblicazione: (2024)
BOLD: Boolean Logic Deep Learning
di: Nguyen, Van Minh, et al.
Pubblicazione: (2024)
di: Nguyen, Van Minh, et al.
Pubblicazione: (2024)
Variational Diffusion Posterior Sampling with Midpoint Guidance
di: Moufad, Badr, et al.
Pubblicazione: (2024)
di: Moufad, Badr, et al.
Pubblicazione: (2024)
Balanced Training of Energy-Based Models with Adaptive Flow Sampling
di: Grenioux, Louis, et al.
Pubblicazione: (2023)
di: Grenioux, Louis, et al.
Pubblicazione: (2023)
On Sampling with Approximate Transport Maps
di: Grenioux, Louis, et al.
Pubblicazione: (2023)
di: Grenioux, Louis, et al.
Pubblicazione: (2023)
Convergence Guarantees for Federated SARSA with Local Training and Heterogeneous Agents
di: Mangold, Paul, et al.
Pubblicazione: (2025)
di: Mangold, Paul, et al.
Pubblicazione: (2025)
Revisiting Prefix-tuning: Statistical Benefits of Reparameterization among Prompts
di: Le, Minh, et al.
Pubblicazione: (2024)
di: Le, Minh, et al.
Pubblicazione: (2024)
Scores as Actions: a framework of fine-tuning diffusion models by continuous-time reinforcement learning
di: Zhao, Hanyang, et al.
Pubblicazione: (2024)
di: Zhao, Hanyang, et al.
Pubblicazione: (2024)
Complexity-aware fine-tuning
di: Goncharov, Andrey, et al.
Pubblicazione: (2025)
di: Goncharov, Andrey, et al.
Pubblicazione: (2025)
Theoretical Guarantees for Variational Inference with Fixed-Variance Mixture of Gaussians
di: Huix, Tom, et al.
Pubblicazione: (2024)
di: Huix, Tom, et al.
Pubblicazione: (2024)
Briding Diffusion Posterior Sampling and Monte Carlo methods: a survey
di: Janati, Yazid, et al.
Pubblicazione: (2025)
di: Janati, Yazid, et al.
Pubblicazione: (2025)
Refined Analysis of Entropy-Regularized Actor-Critic
di: Labbi, Safwan, et al.
Pubblicazione: (2026)
di: Labbi, Safwan, et al.
Pubblicazione: (2026)
On Global Convergence Rates for Federated Softmax Policy Gradient under Heterogeneous Environments
di: Labbi, Safwan, et al.
Pubblicazione: (2025)
di: Labbi, Safwan, et al.
Pubblicazione: (2025)
Beyond Softmax and Entropy: Convergence Rates of Policy Gradients with f-SoftArgmax Parameterization & Coupled Regularization
di: Labbi, Safwan, et al.
Pubblicazione: (2026)
di: Labbi, Safwan, et al.
Pubblicazione: (2026)
PACE: Marrying generalization in PArameter-efficient fine-tuning with Consistency rEgularization
di: Ni, Yao, et al.
Pubblicazione: (2024)
di: Ni, Yao, et al.
Pubblicazione: (2024)
Entropy-guided sequence weighting for efficient exploration in RL-based LLM fine-tuning
di: Vanlioglu, Abdullah
Pubblicazione: (2025)
di: Vanlioglu, Abdullah
Pubblicazione: (2025)
Highly Efficient and Effective LLMs with Multi-Boolean Architectures
di: Tran, Ba-Hien, et al.
Pubblicazione: (2025)
di: Tran, Ba-Hien, et al.
Pubblicazione: (2025)
Quantum-PEFT: Ultra parameter-efficient fine-tuning
di: Koike-Akino, Toshiaki, et al.
Pubblicazione: (2025)
di: Koike-Akino, Toshiaki, et al.
Pubblicazione: (2025)
Boolean Variation and Boolean Logic BackPropagation
di: Nguyen, Van Minh
Pubblicazione: (2023)
di: Nguyen, Van Minh
Pubblicazione: (2023)
Generalized knowledge-enhanced framework for biomedical entity and relation extraction
di: Nguyen, Minh, et al.
Pubblicazione: (2024)
di: Nguyen, Minh, et al.
Pubblicazione: (2024)
RePCS: Diagnosing Data Memorization in LLM-Powered Retrieval-Augmented Generation
di: Anh, Le Vu, et al.
Pubblicazione: (2025)
di: Anh, Le Vu, et al.
Pubblicazione: (2025)
Empirical Comparison of Lightweight Forecasting Models for Seasonal and Non-Seasonal Time Series
di: Nguyen, Thanh Son, et al.
Pubblicazione: (2025)
di: Nguyen, Thanh Son, et al.
Pubblicazione: (2025)
Learning from models beyond fine-tuning
di: Zheng, Hongling, et al.
Pubblicazione: (2023)
di: Zheng, Hongling, et al.
Pubblicazione: (2023)
Mechanistically analyzing the effects of fine-tuning on procedurally defined tasks
di: Jain, Samyak, et al.
Pubblicazione: (2023)
di: Jain, Samyak, et al.
Pubblicazione: (2023)
Inexact subgradient methods for semialgebraic functions
di: Bolte, Jérôme, et al.
Pubblicazione: (2024)
di: Bolte, Jérôme, et al.
Pubblicazione: (2024)
Scaffold with Stochastic Gradients: New Analysis with Linear Speed-Up
di: Mangold, Paul, et al.
Pubblicazione: (2025)
di: Mangold, Paul, et al.
Pubblicazione: (2025)
Fast and Robust Likelihood-Guided Diffusion Posterior Sampling with Amortized Variational Inference
di: Zheng, Léon, et al.
Pubblicazione: (2026)
di: Zheng, Léon, et al.
Pubblicazione: (2026)
Federated UCBVI: Communication-Efficient Federated Regret Minimization with Heterogeneous Agents
di: Labbi, Safwan, et al.
Pubblicazione: (2024)
di: Labbi, Safwan, et al.
Pubblicazione: (2024)
Piecewise deterministic generative models
di: Bertazzi, Andrea, et al.
Pubblicazione: (2024)
di: Bertazzi, Andrea, et al.
Pubblicazione: (2024)
Divide-and-Conquer Posterior Sampling for Denoising Diffusion Priors
di: Janati, Yazid, et al.
Pubblicazione: (2024)
di: Janati, Yazid, et al.
Pubblicazione: (2024)
From Risk to Uncertainty: Generating Predictive Uncertainty Measures via Bayesian Estimation
di: Kotelevskii, Nikita, et al.
Pubblicazione: (2024)
di: Kotelevskii, Nikita, et al.
Pubblicazione: (2024)
Adaptive Set-Mass Calibration with Conformal Prediction
di: Kazantsev, Daniil, et al.
Pubblicazione: (2025)
di: Kazantsev, Daniil, et al.
Pubblicazione: (2025)
Categorical Reparameterization with Denoising Diffusion models
di: Gourevitch, Samson, et al.
Pubblicazione: (2026)
di: Gourevitch, Samson, et al.
Pubblicazione: (2026)
Loss-Guided Auxiliary Agents for Overcoming Mode Collapse in GFlowNets
di: Malek, Idriss, et al.
Pubblicazione: (2025)
di: Malek, Idriss, et al.
Pubblicazione: (2025)
Regret and Sample Complexity of Online Q-Learning via Concentration of Stochastic Approximation with Time-Inhomogeneous Markov Chains
di: Singh, Rahul, et al.
Pubblicazione: (2026)
di: Singh, Rahul, et al.
Pubblicazione: (2026)
On Gaussian approximation for entropy-regularized Q-learning with function approximation
di: Rubtsov, Artemy, et al.
Pubblicazione: (2026)
di: Rubtsov, Artemy, et al.
Pubblicazione: (2026)
Optimizing Asynchronous Federated Learning: A Delicate Trade-Off Between Model-Parameter Staleness and Update Frequency
di: Alahyane, Abdelkrim, et al.
Pubblicazione: (2025)
di: Alahyane, Abdelkrim, et al.
Pubblicazione: (2025)
Avoiding mode collapse in diffusion models fine-tuned with reinforcement learning
di: Barceló, Roberto, et al.
Pubblicazione: (2024)
di: Barceló, Roberto, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Queuing dynamics of asynchronous Federated Learning
di: Leconte, Louis, et al.
Pubblicazione: (2024) -
Bayesian ECG reconstruction using denoising diffusion generative models
di: Cardoso, Gabriel V., et al.
Pubblicazione: (2023) -
Boolean Logic as an Error feedback mechanism
di: Leconte, Louis
Pubblicazione: (2024) -
BOLD: Boolean Logic Deep Learning
di: Nguyen, Van Minh, et al.
Pubblicazione: (2024) -
Variational Diffusion Posterior Sampling with Midpoint Guidance
di: Moufad, Badr, et al.
Pubblicazione: (2024)