FLAT-LLM: Fine-grained Low-rank Activation Space Transformation for Large Language Model Compression
Fuente:
arXiv
Guardado en:
| Autores principales: | Tian, Jiayi, Solgi, Ryan, Lu, Jinming, Yang, Yifan, Li, Hai, Zhang, Zheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Activation-Informed Pareto-Guided Low-Rank Compression for Efficient LLM/VLM
por: Solgi, Ryan, et al.
Publicado: (2025)
por: Solgi, Ryan, et al.
Publicado: (2025)
Ultra Memory-Efficient On-FPGA Training of Transformers via Tensor-Compressed Optimization
por: Tian, Jiayi, et al.
Publicado: (2025)
por: Tian, Jiayi, et al.
Publicado: (2025)
Saten: Sparse Augmented Tensor Networks for Post-Training Compression of Large Language Models
por: Solgi, Ryan, et al.
Publicado: (2025)
por: Solgi, Ryan, et al.
Publicado: (2025)
FLAT: Formal Languages as Types
por: Zhu, Fengmin, et al.
Publicado: (2025)
por: Zhu, Fengmin, et al.
Publicado: (2025)
LoRETTA: Low-Rank Economic Tensor-Train Adaptation for Ultra-Low-Parameter Fine-Tuning of Large Language Models
por: Yang, Yifan, et al.
Publicado: (2024)
por: Yang, Yifan, et al.
Publicado: (2024)
Pruning Large Language Models to Intra-module Low-rank Architecture with Transitional Activations
por: Shen, Bowen, et al.
Publicado: (2024)
por: Shen, Bowen, et al.
Publicado: (2024)
FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing
por: Li, Zekai, et al.
Publicado: (2024)
por: Li, Zekai, et al.
Publicado: (2024)
FALCON: Fine-grained Activation Manipulation by Contrastive Orthogonal Unalignment for Large Language Model
por: Hu, Jinwei, et al.
Publicado: (2025)
por: Hu, Jinwei, et al.
Publicado: (2025)
RefChecker: Reference-based Fine-grained Hallucination Checker and Benchmark for Large Language Models
por: Hu, Xiangkun, et al.
Publicado: (2024)
por: Hu, Xiangkun, et al.
Publicado: (2024)
Astra: Activation-Space Tail-Eigenvector Low-Rank Adaptation of Large Language Models
por: Liu, Kainan, et al.
Publicado: (2026)
por: Liu, Kainan, et al.
Publicado: (2026)
Communication-Efficient and Tensorized Federated Fine-Tuning of Large Language Models
por: Ghiasvand, Sajjad, et al.
Publicado: (2024)
por: Ghiasvand, Sajjad, et al.
Publicado: (2024)
MiLoRA: Efficient Mixture of Low-Rank Adaptation for Large Language Models Fine-tuning
por: Zhang, Jingfan, et al.
Publicado: (2024)
por: Zhang, Jingfan, et al.
Publicado: (2024)
Expressive and Generalizable Low-rank Adaptation for Large Models via Slow Cascaded Learning
por: Li, Siwei, et al.
Publicado: (2024)
por: Li, Siwei, et al.
Publicado: (2024)
Tensor-Compressed and Fully-Quantized Training of Neural PDE Solvers
por: Lu, Jinming, et al.
Publicado: (2025)
por: Lu, Jinming, et al.
Publicado: (2025)
FLRC: Fine-grained Low-Rank Compressor for Efficient LLM Inference
por: Lu, Yu-Chen, et al.
Publicado: (2025)
por: Lu, Yu-Chen, et al.
Publicado: (2025)
Distilling Fine-grained Sentiment Understanding from Large Language Models
por: Zhang, Yice, et al.
Publicado: (2024)
por: Zhang, Yice, et al.
Publicado: (2024)
BlockPruner: Fine-grained Pruning for Large Language Models
por: Zhong, Longguang, et al.
Publicado: (2024)
por: Zhong, Longguang, et al.
Publicado: (2024)
Examining the Robustness of Large Language Models across Language Complexity
por: Zhang, Jiayi
Publicado: (2025)
por: Zhang, Jiayi
Publicado: (2025)
From Chaos to Order: The Atomic Reasoner Framework for Fine-grained Reasoning in Large Language Models
por: Liu, Jinyi, et al.
Publicado: (2025)
por: Liu, Jinyi, et al.
Publicado: (2025)
ASVD: Activation-aware Singular Value Decomposition for Compressing Large Language Models
por: Yuan, Zhihang, et al.
Publicado: (2023)
por: Yuan, Zhihang, et al.
Publicado: (2023)
SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression
por: Wang, Xin, et al.
Publicado: (2024)
por: Wang, Xin, et al.
Publicado: (2024)
Mitigating Outlier Activations in Low-Precision Fine-Tuning of Language Models
por: Ghaffari, Alireza, et al.
Publicado: (2023)
por: Ghaffari, Alireza, et al.
Publicado: (2023)
Fine-grained Gender Control in Machine Translation with Large Language Models
por: Lee, Minwoo, et al.
Publicado: (2024)
por: Lee, Minwoo, et al.
Publicado: (2024)
LoRA$^2$ : Multi-Scale Low-Rank Approximations for Fine-Tuning Large Language Models
por: Zhang, Jia-Chen, et al.
Publicado: (2024)
por: Zhang, Jia-Chen, et al.
Publicado: (2024)
RetroLLM: Empowering Large Language Models to Retrieve Fine-grained Evidence within Generation
por: Li, Xiaoxi, et al.
Publicado: (2024)
por: Li, Xiaoxi, et al.
Publicado: (2024)
PocketLLM: Ultimate Compression of Large Language Models via Meta Networks
por: Tian, Ye, et al.
Publicado: (2025)
por: Tian, Ye, et al.
Publicado: (2025)
SoLA: Leveraging Soft Activation Sparsity and Low-Rank Decomposition for Large Language Model Compression
por: Huang, Xinhao, et al.
Publicado: (2026)
por: Huang, Xinhao, et al.
Publicado: (2026)
ALoRA: Allocating Low-Rank Adaptation for Fine-tuning Large Language Models
por: Liu, Zequan, et al.
Publicado: (2024)
por: Liu, Zequan, et al.
Publicado: (2024)
Improving Large Language Models via Fine-grained Reinforcement Learning with Minimum Editing Constraint
por: Chen, Zhipeng, et al.
Publicado: (2024)
por: Chen, Zhipeng, et al.
Publicado: (2024)
AdaZeta: Adaptive Zeroth-Order Tensor-Train Adaption for Memory-Efficient Large Language Models Fine-Tuning
por: Yang, Yifan, et al.
Publicado: (2024)
por: Yang, Yifan, et al.
Publicado: (2024)
Adapting Large Language Models to Low-Resource Tibetan: A Two-Stage Continual and Supervised Fine-Tuning Study
por: Chen, Lifeng, et al.
Publicado: (2025)
por: Chen, Lifeng, et al.
Publicado: (2025)
Aligning Large Language Models via Fine-grained Supervision
por: Xu, Dehong, et al.
Publicado: (2024)
por: Xu, Dehong, et al.
Publicado: (2024)
Unveiling the Generalization Power of Fine-Tuned Large Language Models
por: Yang, Haoran, et al.
Publicado: (2024)
por: Yang, Haoran, et al.
Publicado: (2024)
VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits
por: Shao, Jintian, et al.
Publicado: (2025)
por: Shao, Jintian, et al.
Publicado: (2025)
InsCL: A Data-efficient Continual Learning Paradigm for Fine-tuning Large Language Models with Instructions
por: Wang, Yifan, et al.
Publicado: (2024)
por: Wang, Yifan, et al.
Publicado: (2024)
BriLLM: Brain-inspired Large Language Model
por: Zhao, Hai, et al.
Publicado: (2025)
por: Zhao, Hai, et al.
Publicado: (2025)
TableLoRA: Low-rank Adaptation on Table Structure Understanding for Large Language Models
por: He, Xinyi, et al.
Publicado: (2025)
por: He, Xinyi, et al.
Publicado: (2025)
RankGuide: Tensor-Rank-Guided Routing and Steering for Efficient Reasoning
por: Tian, Jiayi, et al.
Publicado: (2026)
por: Tian, Jiayi, et al.
Publicado: (2026)
Switch Attention: Towards Dynamic and Fine-grained Hybrid Transformers
por: Zhao, Yusheng, et al.
Publicado: (2026)
por: Zhao, Yusheng, et al.
Publicado: (2026)
Fine-grained Hallucination Detection and Editing for Language Models
por: Mishra, Abhika, et al.
Publicado: (2024)
por: Mishra, Abhika, et al.
Publicado: (2024)
Ejemplares similares
-
Activation-Informed Pareto-Guided Low-Rank Compression for Efficient LLM/VLM
por: Solgi, Ryan, et al.
Publicado: (2025) -
Ultra Memory-Efficient On-FPGA Training of Transformers via Tensor-Compressed Optimization
por: Tian, Jiayi, et al.
Publicado: (2025) -
Saten: Sparse Augmented Tensor Networks for Post-Training Compression of Large Language Models
por: Solgi, Ryan, et al.
Publicado: (2025) -
FLAT: Formal Languages as Types
por: Zhu, Fengmin, et al.
Publicado: (2025) -
LoRETTA: Low-Rank Economic Tensor-Train Adaptation for Ultra-Low-Parameter Fine-Tuning of Large Language Models
por: Yang, Yifan, et al.
Publicado: (2024)