Thinking Forward: Memory-Efficient Federated Finetuning of Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Panchal, Kunjal, Parikh, Nisarg, Choudhary, Sunav, Zhang, Lijun, Brun, Yuriy, Guan, Hui |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Flow: Per-Instance Personalized Federated Learning Through Dynamic Routing
por: Panchal, Kunjal, et al.
Publicado: (2022)
por: Panchal, Kunjal, et al.
Publicado: (2022)
The Cost of Avoiding Backpropagation
por: Panchal, Kunjal, et al.
Publicado: (2025)
por: Panchal, Kunjal, et al.
Publicado: (2025)
CATTO: Balancing Preferences and Confidence in Language Models
por: Parikh, Nisarg, et al.
Publicado: (2026)
por: Parikh, Nisarg, et al.
Publicado: (2026)
Atom: Efficient On-Device Video-Language Pipelines Through Modular Reuse
por: Panchal, Kunjal, et al.
Publicado: (2025)
por: Panchal, Kunjal, et al.
Publicado: (2025)
Fake or Compromised? Making Sense of Malicious Clients in Federated Learning
por: Mozaffari, Hamid, et al.
Publicado: (2024)
por: Mozaffari, Hamid, et al.
Publicado: (2024)
Sequential Causal Discovery with Noisy Language Model Priors
por: Verma, Prakhar, et al.
Publicado: (2025)
por: Verma, Prakhar, et al.
Publicado: (2025)
Improving Selective Classification with Pairwise Queries for Binary Classification
por: Vardhan, Harsh, et al.
Publicado: (2026)
por: Vardhan, Harsh, et al.
Publicado: (2026)
Efficient Zero-Order Federated Finetuning of Language Models for Resource-Constrained Devices
por: Ahmed, Mohamed Aboelenien, et al.
Publicado: (2025)
por: Ahmed, Mohamed Aboelenien, et al.
Publicado: (2025)
Sparse Linear Bandits with Blocking Constraints
por: Jain, Adit, et al.
Publicado: (2024)
por: Jain, Adit, et al.
Publicado: (2024)
LookAlike: Consistent Distractor Generation in Math MCQs
por: Parikh, Nisarg, et al.
Publicado: (2025)
por: Parikh, Nisarg, et al.
Publicado: (2025)
Driving Privacy Forward: Mitigating Information Leakage within Smart Vehicles through Synthetic Data Generation
por: Parikh, Krish
Publicado: (2024)
por: Parikh, Krish
Publicado: (2024)
Reimagining Parameter Space Exploration with Diffusion Models
por: Zhang, Lijun, et al.
Publicado: (2025)
por: Zhang, Lijun, et al.
Publicado: (2025)
ASTRA: Communication-Efficient Acceleration for Multi-Device Transformer Inference
por: Liu, Xiao, et al.
Publicado: (2025)
por: Liu, Xiao, et al.
Publicado: (2025)
Thinking Forward and Backward: Effective Backward Planning with Large Language Models
por: Ren, Allen Z., et al.
Publicado: (2024)
por: Ren, Allen Z., et al.
Publicado: (2024)
OASIS: Online Activation Subspace Learning for Memory-Efficient Training
por: Choudhary, Sakshi, et al.
Publicado: (2026)
por: Choudhary, Sakshi, et al.
Publicado: (2026)
Improving Sparse Memory Finetuning
por: Goyal, Satyam, et al.
Publicado: (2026)
por: Goyal, Satyam, et al.
Publicado: (2026)
MuonAll: Muon Variant for Efficient Finetuning of Large Language Models
por: Page, Saurabh, et al.
Publicado: (2025)
por: Page, Saurabh, et al.
Publicado: (2025)
An Efficient Compression of Deep Neural Network Checkpoints Based on Prediction and Context Modeling
por: Kim, Yuriy, et al.
Publicado: (2025)
por: Kim, Yuriy, et al.
Publicado: (2025)
FedHFT: Efficient Federated Finetuning with Heterogeneous Edge Clients
por: Ilhan, Fatih, et al.
Publicado: (2025)
por: Ilhan, Fatih, et al.
Publicado: (2025)
Learning to Reason in LLMs by Expectation Maximization
por: Lee, Junghyun, et al.
Publicado: (2025)
por: Lee, Junghyun, et al.
Publicado: (2025)
Sparse Memory Finetuning as a Low-Forgetting Alternative to LoRA and Full Finetuning
por: Gupta, Prakhar, et al.
Publicado: (2026)
por: Gupta, Prakhar, et al.
Publicado: (2026)
RL-Guided Data Selection for Language Model Finetuning
por: Jha, Animesh, et al.
Publicado: (2025)
por: Jha, Animesh, et al.
Publicado: (2025)
On-device Semantic Selection Made Low Latency and Memory Efficient with Monolithic Forwarding
por: Zhou, Jiahao, et al.
Publicado: (2025)
por: Zhou, Jiahao, et al.
Publicado: (2025)
An Experimental Design Framework for Label-Efficient Supervised Finetuning of Large Language Models
por: Bhatt, Gantavya, et al.
Publicado: (2024)
por: Bhatt, Gantavya, et al.
Publicado: (2024)
Efficient Federated Finetuning of Tiny Transformers with Resource-Constrained Devices
por: Pfeiffer, Kilian, et al.
Publicado: (2024)
por: Pfeiffer, Kilian, et al.
Publicado: (2024)
Ensembling Finetuned Language Models for Text Classification
por: Arango, Sebastian Pineda, et al.
Publicado: (2024)
por: Arango, Sebastian Pineda, et al.
Publicado: (2024)
Transfer Learning for Finetuning Large Language Models
por: Strangmann, Tobias, et al.
Publicado: (2024)
por: Strangmann, Tobias, et al.
Publicado: (2024)
Reinforcement Learning Finetunes Small Subnetworks in Large Language Models
por: Mukherjee, Sagnik, et al.
Publicado: (2025)
por: Mukherjee, Sagnik, et al.
Publicado: (2025)
Mixture of Thoughts: Learning to Aggregate What Experts Think, Not Just What They Say
por: Fein-Ashley, Jacob, et al.
Publicado: (2025)
por: Fein-Ashley, Jacob, et al.
Publicado: (2025)
FedKRSO: Communication and Memory Efficient Federated Fine-Tuning of Large Language Models
por: Yang, Guohao, et al.
Publicado: (2026)
por: Yang, Guohao, et al.
Publicado: (2026)
Large Language Models to Diffusion Finetuning
por: Cetin, Edoardo, et al.
Publicado: (2025)
por: Cetin, Edoardo, et al.
Publicado: (2025)
When Scaling Meets LLM Finetuning: The Effect of Data, Model and Finetuning Method
por: Zhang, Biao, et al.
Publicado: (2024)
por: Zhang, Biao, et al.
Publicado: (2024)
Attacking All Tasks at Once Using Adversarial Examples in Multi-Task Learning
por: Zhang, Lijun, et al.
Publicado: (2023)
por: Zhang, Lijun, et al.
Publicado: (2023)
On Finetuning Tabular Foundation Models
por: Rubachev, Ivan, et al.
Publicado: (2025)
por: Rubachev, Ivan, et al.
Publicado: (2025)
Navigating the Safety Landscape: Measuring Risks in Finetuning Large Language Models
por: Peng, ShengYun, et al.
Publicado: (2024)
por: Peng, ShengYun, et al.
Publicado: (2024)
Uncertainty-Guided Checkpoint Selection for Reinforcement Finetuning of Large Language Models
por: Nguyen, Manh, et al.
Publicado: (2025)
por: Nguyen, Manh, et al.
Publicado: (2025)
Finetuning Language Models to Emit Linguistic Expressions of Uncertainty
por: Chaudhry, Arslan, et al.
Publicado: (2024)
por: Chaudhry, Arslan, et al.
Publicado: (2024)
GPTAQ: Efficient Finetuning-Free Quantization for Asymmetric Calibration
por: Li, Yuhang, et al.
Publicado: (2025)
por: Li, Yuhang, et al.
Publicado: (2025)
Squeeze the Soaked Sponge: Efficient Off-policy Reinforcement Finetuning for Large Language Model
por: Liang, Jing, et al.
Publicado: (2025)
por: Liang, Jing, et al.
Publicado: (2025)
LQ-LoRA: Low-rank Plus Quantized Matrix Decomposition for Efficient Language Model Finetuning
por: Guo, Han, et al.
Publicado: (2023)
por: Guo, Han, et al.
Publicado: (2023)
Ejemplares similares
-
Flow: Per-Instance Personalized Federated Learning Through Dynamic Routing
por: Panchal, Kunjal, et al.
Publicado: (2022) -
The Cost of Avoiding Backpropagation
por: Panchal, Kunjal, et al.
Publicado: (2025) -
CATTO: Balancing Preferences and Confidence in Language Models
por: Parikh, Nisarg, et al.
Publicado: (2026) -
Atom: Efficient On-Device Video-Language Pipelines Through Modular Reuse
por: Panchal, Kunjal, et al.
Publicado: (2025) -
Fake or Compromised? Making Sense of Malicious Clients in Federated Learning
por: Mozaffari, Hamid, et al.
Publicado: (2024)