APT: Adaptive Pruning and Tuning Pretrained Language Models for Efficient Training and Inference
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhao, Bowen, Hajishirzi, Hannaneh, Cao, Qingqing |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
EvalTree: Profiling Language Model Weaknesses via Hierarchical Capability Trees
por: Zeng, Zhiyuan, et al.
Publicado: (2025)
por: Zeng, Zhiyuan, et al.
Publicado: (2025)
Merge to Learn: Efficiently Adding Skills to Language Models with Model Merging
por: Morrison, Jacob, et al.
Publicado: (2024)
por: Morrison, Jacob, et al.
Publicado: (2024)
Learning to Detect Language Model Training Data via Active Reconstruction
por: Yin, Junjie Oscar, et al.
Publicado: (2026)
por: Yin, Junjie Oscar, et al.
Publicado: (2026)
BTR: Binary Token Representations for Efficient Retrieval Augmented Language Models
por: Cao, Qingqing, et al.
Publicado: (2023)
por: Cao, Qingqing, et al.
Publicado: (2023)
Train for Truth, Keep the Skills: Binary Retrieval-Augmented Reward Mitigates Hallucinations
por: Chen, Tong, et al.
Publicado: (2025)
por: Chen, Tong, et al.
Publicado: (2025)
Set the Clock: Temporal Alignment of Pretrained Language Models
por: Zhao, Bowen, et al.
Publicado: (2024)
por: Zhao, Bowen, et al.
Publicado: (2024)
Husky: A Unified, Open-Source Language Agent for Multi-Step Reasoning
por: Kim, Joongwon, et al.
Publicado: (2024)
por: Kim, Joongwon, et al.
Publicado: (2024)
IDEA Prune: An Integrated Enlarge-and-Prune Pipeline in Generative Language Model Pretraining
por: Li, Yixiao, et al.
Publicado: (2025)
por: Li, Yixiao, et al.
Publicado: (2025)
Adapt-Pruner: Adaptive Structural Pruning for Efficient Small Language Model Training
por: Pan, Rui, et al.
Publicado: (2025)
por: Pan, Rui, et al.
Publicado: (2025)
Signal and Noise: A Framework for Reducing Uncertainty in Language Model Evaluation
por: Heineman, David, et al.
Publicado: (2025)
por: Heineman, David, et al.
Publicado: (2025)
RL Grokking Recipe: How Does RL Unlock and Transfer New Algorithms in LLMs?
por: Sun, Yiyou, et al.
Publicado: (2025)
por: Sun, Yiyou, et al.
Publicado: (2025)
OpenELM: An Efficient Language Model Family with Open Training and Inference Framework
por: Mehta, Sachin, et al.
Publicado: (2024)
por: Mehta, Sachin, et al.
Publicado: (2024)
Efficient Post-Training Pruning of Large Language Models with Statistical Correction
por: Yu, Peiqi, et al.
Publicado: (2026)
por: Yu, Peiqi, et al.
Publicado: (2026)
SILO Language Models: Isolating Legal Risk In a Nonparametric Datastore
por: Min, Sewon, et al.
Publicado: (2023)
por: Min, Sewon, et al.
Publicado: (2023)
Reliable, Adaptable, and Attributable Language Models with Retrieval
por: Asai, Akari, et al.
Publicado: (2024)
por: Asai, Akari, et al.
Publicado: (2024)
CopyBench: Measuring Literal and Non-Literal Reproduction of Copyright-Protected Text in Language Model Generation
por: Chen, Tong, et al.
Publicado: (2024)
por: Chen, Tong, et al.
Publicado: (2024)
RLVE: Scaling Up Reinforcement Learning for Language Models with Adaptive Verifiable Environments
por: Zeng, Zhiyuan, et al.
Publicado: (2025)
por: Zeng, Zhiyuan, et al.
Publicado: (2025)
Mortgage Language Model: Domain-Adaptive Pretraining with Residual Instruction, Alignment Tuning, and Task-Specific Routing
por: Jain, Manish, et al.
Publicado: (2025)
por: Jain, Manish, et al.
Publicado: (2025)
Text Quality-Based Pruning for Efficient Training of Language Models
por: Sharma, Vasu, et al.
Publicado: (2024)
por: Sharma, Vasu, et al.
Publicado: (2024)
BIPEFT: Budget-Guided Iterative Search for Parameter Efficient Fine-Tuning of Large Pretrained Language Models
por: Chang, Aofei, et al.
Publicado: (2024)
por: Chang, Aofei, et al.
Publicado: (2024)
ParaPO: Aligning Language Models to Reduce Verbatim Reproduction of Pre-training Data
por: Chen, Tong, et al.
Publicado: (2025)
por: Chen, Tong, et al.
Publicado: (2025)
Parameter-Efficient Tuning Large Language Models for Graph Representation Learning
por: Zhu, Qi, et al.
Publicado: (2024)
por: Zhu, Qi, et al.
Publicado: (2024)
EfficientXpert: Efficient Domain Adaptation for Large Language Models via Propagation-Aware Pruning
por: Zhao, Songlin, et al.
Publicado: (2025)
por: Zhao, Songlin, et al.
Publicado: (2025)
Don't throw away your value model! Generating more preferable text with Value-Guided Monte-Carlo Tree Search decoding
por: Liu, Jiacheng, et al.
Publicado: (2023)
por: Liu, Jiacheng, et al.
Publicado: (2023)
Fluid Language Model Benchmarking
por: Hofmann, Valentin, et al.
Publicado: (2025)
por: Hofmann, Valentin, et al.
Publicado: (2025)
MatFormer: Nested Transformer for Elastic Inference
por: Devvrit, et al.
Publicado: (2023)
por: Devvrit, et al.
Publicado: (2023)
PAT: Pruning-Aware Tuning for Large Language Models
por: Liu, Yijiang, et al.
Publicado: (2024)
por: Liu, Yijiang, et al.
Publicado: (2024)
HMI: Hierarchical Knowledge Management for Efficient Multi-Tenant Inference in Pretrained Language Models
por: Zhang, Jun, et al.
Publicado: (2025)
por: Zhang, Jun, et al.
Publicado: (2025)
Megalodon: Efficient LLM Pretraining and Inference with Unlimited Context Length
por: Ma, Xuezhe, et al.
Publicado: (2024)
por: Ma, Xuezhe, et al.
Publicado: (2024)
Task-Adaptive Pretrained Language Models via Clustered-Importance Sampling
por: Grangier, David, et al.
Publicado: (2024)
por: Grangier, David, et al.
Publicado: (2024)
RePro: Training Language Models to Faithfully Recycle the Web for Pretraining
por: Yu, Zichun, et al.
Publicado: (2025)
por: Yu, Zichun, et al.
Publicado: (2025)
Dense Training, Sparse Inference: Rethinking Training of Mixture-of-Experts Language Models
por: Pan, Bowen, et al.
Publicado: (2024)
por: Pan, Bowen, et al.
Publicado: (2024)
Empirical Analysis of Efficient Fine-Tuning Methods for Large Pre-Trained Language Models
por: Doering, Nigel, et al.
Publicado: (2024)
por: Doering, Nigel, et al.
Publicado: (2024)
ESLM: Risk-Averse Selective Language Modeling for Efficient Pretraining
por: Bal, Melis Ilayda, et al.
Publicado: (2025)
por: Bal, Melis Ilayda, et al.
Publicado: (2025)
Efficient Vision-Language Reasoning via Adaptive Token Pruning
por: Li, Xue, et al.
Publicado: (2025)
por: Li, Xue, et al.
Publicado: (2025)
Critical Batch Size Revisited: A Simple Empirical Approach to Large-Batch Language Model Training
por: Merrill, William, et al.
Publicado: (2025)
por: Merrill, William, et al.
Publicado: (2025)
Dynamic Subset Tuning: Expanding the Operational Range of Parameter-Efficient Training for Large Language Models
por: Stahlberg, Felix, et al.
Publicado: (2024)
por: Stahlberg, Felix, et al.
Publicado: (2024)
Language Model-Driven Data Pruning Enables Efficient Active Learning
por: Azeemi, Abdul Hameed, et al.
Publicado: (2024)
por: Azeemi, Abdul Hameed, et al.
Publicado: (2024)
Olica: Efficient Structured Pruning of Large Language Models without Retraining
por: He, Jiujun, et al.
Publicado: (2025)
por: He, Jiujun, et al.
Publicado: (2025)
AdaZeta: Adaptive Zeroth-Order Tensor-Train Adaption for Memory-Efficient Large Language Models Fine-Tuning
por: Yang, Yifan, et al.
Publicado: (2024)
por: Yang, Yifan, et al.
Publicado: (2024)
Ejemplares similares
-
EvalTree: Profiling Language Model Weaknesses via Hierarchical Capability Trees
por: Zeng, Zhiyuan, et al.
Publicado: (2025) -
Merge to Learn: Efficiently Adding Skills to Language Models with Model Merging
por: Morrison, Jacob, et al.
Publicado: (2024) -
Learning to Detect Language Model Training Data via Active Reconstruction
por: Yin, Junjie Oscar, et al.
Publicado: (2026) -
BTR: Binary Token Representations for Efficient Retrieval Augmented Language Models
por: Cao, Qingqing, et al.
Publicado: (2023) -
Train for Truth, Keep the Skills: Binary Retrieval-Augmented Reward Mitigates Hallucinations
por: Chen, Tong, et al.
Publicado: (2025)