Saten: Sparse Augmented Tensor Networks for Post-Training Compression of Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Solgi, Ryan, Zhen, Kai, Swaminathan, Rupak Vignesh, Susanj, Nathan, Mouchtaris, Athanasios, Kunzmann, Siegfried, Zhang, Zheng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MaZO: Masked Zeroth-Order Optimization for Multi-Task Fine-Tuning of Large Language Models
par: Zhang, Zhen, et autres
Publié: (2025)
par: Zhang, Zhen, et autres
Publié: (2025)
Activation-Informed Pareto-Guided Low-Rank Compression for Efficient LLM/VLM
par: Solgi, Ryan, et autres
Publié: (2025)
par: Solgi, Ryan, et autres
Publié: (2025)
SharpZO: Hybrid Sharpness-Aware Vision Language Model Prompt Tuning via Forward-Only Passes
par: Yang, Yifan, et autres
Publié: (2025)
par: Yang, Yifan, et autres
Publié: (2025)
AdaZeta: Adaptive Zeroth-Order Tensor-Train Adaption for Memory-Efficient Large Language Models Fine-Tuning
par: Yang, Yifan, et autres
Publié: (2024)
par: Yang, Yifan, et autres
Publié: (2024)
Wanda++: Pruning Large Language Models via Regional Gradients
par: Yang, Yifan, et autres
Publié: (2025)
par: Yang, Yifan, et autres
Publié: (2025)
Quantization-Aware and Tensor-Compressed Training of Transformers for Natural Language Understanding
par: Yang, Zi, et autres
Publié: (2023)
par: Yang, Zi, et autres
Publié: (2023)
FLAT-LLM: Fine-grained Low-rank Activation Space Transformation for Large Language Model Compression
par: Tian, Jiayi, et autres
Publié: (2025)
par: Tian, Jiayi, et autres
Publié: (2025)
Aggressive Post-Training Compression on Extremely Large Language Models
par: Zhang, Zining, et autres
Publié: (2024)
par: Zhang, Zining, et autres
Publié: (2024)
TensorGPT: Efficient Compression of Large Language Models based on Tensor-Train Decomposition
par: Xu, Mingxue, et autres
Publié: (2023)
par: Xu, Mingxue, et autres
Publié: (2023)
SIFT-50M: A Large-Scale Multilingual Dataset for Speech Instruction Fine-Tuning
par: Pandey, Prabhat, et autres
Publié: (2025)
par: Pandey, Prabhat, et autres
Publié: (2025)
Post-Training Sparse Attention with Double Sparsity
par: Yang, Shuo, et autres
Publié: (2024)
par: Yang, Shuo, et autres
Publié: (2024)
Pula: Training Large Language Models for Setswana
par: Brown, Nathan, et autres
Publié: (2024)
par: Brown, Nathan, et autres
Publié: (2024)
1+1>2: A Synergistic Sparse and Low-Rank Compression Method for Large Language Models
par: Zong, Zeliang, et autres
Publié: (2025)
par: Zong, Zeliang, et autres
Publié: (2025)
PASER: Post-Training Data Selection for Efficient Pruned Large Language Model Recovery
par: He, Bowei, et autres
Publié: (2025)
par: He, Bowei, et autres
Publié: (2025)
AdaComp: Extractive Context Compression with Adaptive Predictor for Retrieval-Augmented Large Language Models
par: Zhang, Qianchi, et autres
Publié: (2024)
par: Zhang, Qianchi, et autres
Publié: (2024)
QuZO: Quantized Zeroth-Order Fine-Tuning for Large Language Models
par: Zhou, Jiajun, et autres
Publié: (2025)
par: Zhou, Jiajun, et autres
Publié: (2025)
Do Tensorized Large-Scale Spatiotemporal Dynamic Atmospheric Data Exhibit Low-Rank Properties?
par: Solgi, Ryan, et autres
Publié: (2025)
par: Solgi, Ryan, et autres
Publié: (2025)
Feature Alignment-Based Knowledge Distillation for Efficient Compression of Large Language Models
par: Wang, Shuo, et autres
Publié: (2024)
par: Wang, Shuo, et autres
Publié: (2024)
CompactifAI: Extreme Compression of Large Language Models using Quantum-Inspired Tensor Networks
par: Tomut, Andrei, et autres
Publié: (2024)
par: Tomut, Andrei, et autres
Publié: (2024)
Post-Training Language Models for Crosslingual Consistency
par: Liu, Tianyu, et autres
Publié: (2026)
par: Liu, Tianyu, et autres
Publié: (2026)
S-GRPO: Unified Post-Training for Large Vision-Language Models
par: Yan, Yuming, et autres
Publié: (2026)
par: Yan, Yuming, et autres
Publié: (2026)
Ultra Memory-Efficient On-FPGA Training of Transformers via Tensor-Compressed Optimization
par: Tian, Jiayi, et autres
Publié: (2025)
par: Tian, Jiayi, et autres
Publié: (2025)
PocketLLM: Ultimate Compression of Large Language Models via Meta Networks
par: Tian, Ye, et autres
Publié: (2025)
par: Tian, Ye, et autres
Publié: (2025)
Benchmarking Post-Training Quantization of Large Language Models under Microscaling Floating Point Formats
par: Zhang, Manyi, et autres
Publié: (2026)
par: Zhang, Manyi, et autres
Publié: (2026)
PHEONA: An Evaluation Framework for Large Language Model-based Approaches to Computational Phenotyping
par: Pungitore, Sarah, et autres
Publié: (2025)
par: Pungitore, Sarah, et autres
Publié: (2025)
Decomposition-Enhanced Training for Post-Hoc Attributions In Language Models
par: Balasubramanian, Sriram, et autres
Publié: (2025)
par: Balasubramanian, Sriram, et autres
Publié: (2025)
Scalable In-Context Learning on Tabular Data via Retrieval-Augmented Large Language Models
par: Wen, Xumeng, et autres
Publié: (2025)
par: Wen, Xumeng, et autres
Publié: (2025)
Language Modeling Using Tensor Trains
par: Su, Zhan, et autres
Publié: (2024)
par: Su, Zhan, et autres
Publié: (2024)
Scaling Laws for Post Training Quantized Large Language Models
par: Xu, Zifei, et autres
Publié: (2024)
par: Xu, Zifei, et autres
Publié: (2024)
Multilingual Brain Surgeon: Large Language Models Can be Compressed Leaving No Language Behind
par: Zeng, Hongchuan, et autres
Publié: (2024)
par: Zeng, Hongchuan, et autres
Publié: (2024)
CoMERA: Computing- and Memory-Efficient Training via Rank-Adaptive Tensor Optimization
par: Yang, Zi, et autres
Publié: (2024)
par: Yang, Zi, et autres
Publié: (2024)
Compressing Large Language Models with Automated Sub-Network Search
par: Sukthanker, Rhea Sanjay, et autres
Publié: (2024)
par: Sukthanker, Rhea Sanjay, et autres
Publié: (2024)
Contextual Compression in Retrieval-Augmented Generation for Large Language Models: A Survey
par: Verma, Sourav
Publié: (2024)
par: Verma, Sourav
Publié: (2024)
Pruning Large Language Models with Semi-Structural Adaptive Sparse Training
par: Huang, Weiyu, et autres
Publié: (2024)
par: Huang, Weiyu, et autres
Publié: (2024)
CoNST: Code Generator for Sparse Tensor Networks
par: Raje, Saurabh, et autres
Publié: (2024)
par: Raje, Saurabh, et autres
Publié: (2024)
RankGuide: Tensor-Rank-Guided Routing and Steering for Efficient Reasoning
par: Tian, Jiayi, et autres
Publié: (2026)
par: Tian, Jiayi, et autres
Publié: (2026)
Typhoon-S: Minimal Open Post-Training for Sovereign Large Language Models
par: Pipatanakul, Kunat, et autres
Publié: (2026)
par: Pipatanakul, Kunat, et autres
Publié: (2026)
Efficient Post-Training Pruning of Large Language Models with Statistical Correction
par: Yu, Peiqi, et autres
Publié: (2026)
par: Yu, Peiqi, et autres
Publié: (2026)
Modifying Large Language Model Post-Training for Diverse Creative Writing
par: Chung, John Joon Young, et autres
Publié: (2025)
par: Chung, John Joon Young, et autres
Publié: (2025)
Efficient Post-Training Refinement of Latent Reasoning in Large Language Models
par: Wang, Xinyuan, et autres
Publié: (2025)
par: Wang, Xinyuan, et autres
Publié: (2025)
Documents similaires
-
MaZO: Masked Zeroth-Order Optimization for Multi-Task Fine-Tuning of Large Language Models
par: Zhang, Zhen, et autres
Publié: (2025) -
Activation-Informed Pareto-Guided Low-Rank Compression for Efficient LLM/VLM
par: Solgi, Ryan, et autres
Publié: (2025) -
SharpZO: Hybrid Sharpness-Aware Vision Language Model Prompt Tuning via Forward-Only Passes
par: Yang, Yifan, et autres
Publié: (2025) -
AdaZeta: Adaptive Zeroth-Order Tensor-Train Adaption for Memory-Efficient Large Language Models Fine-Tuning
par: Yang, Yifan, et autres
Publié: (2024) -
Wanda++: Pruning Large Language Models via Regional Gradients
par: Yang, Yifan, et autres
Publié: (2025)