Gespeichert in:
| Hauptverfasser: | Tian, Jiayi, Solgi, Ryan, Lu, Jinming, Yang, Yifan, Li, Hai, Zhang, Zheng |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2505.23966 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Activation-Informed Pareto-Guided Low-Rank Compression for Efficient LLM/VLM
von: Solgi, Ryan, et al.
Veröffentlicht: (2025)
von: Solgi, Ryan, et al.
Veröffentlicht: (2025)
Ultra Memory-Efficient On-FPGA Training of Transformers via Tensor-Compressed Optimization
von: Tian, Jiayi, et al.
Veröffentlicht: (2025)
von: Tian, Jiayi, et al.
Veröffentlicht: (2025)
Saten: Sparse Augmented Tensor Networks for Post-Training Compression of Large Language Models
von: Solgi, Ryan, et al.
Veröffentlicht: (2025)
von: Solgi, Ryan, et al.
Veröffentlicht: (2025)
FLAT: Formal Languages as Types
von: Zhu, Fengmin, et al.
Veröffentlicht: (2025)
von: Zhu, Fengmin, et al.
Veröffentlicht: (2025)
LoRETTA: Low-Rank Economic Tensor-Train Adaptation for Ultra-Low-Parameter Fine-Tuning of Large Language Models
von: Yang, Yifan, et al.
Veröffentlicht: (2024)
von: Yang, Yifan, et al.
Veröffentlicht: (2024)
Pruning Large Language Models to Intra-module Low-rank Architecture with Transitional Activations
von: Shen, Bowen, et al.
Veröffentlicht: (2024)
von: Shen, Bowen, et al.
Veröffentlicht: (2024)
Tensor-Compressed and Fully-Quantized Training of Neural PDE Solvers
von: Lu, Jinming, et al.
Veröffentlicht: (2025)
von: Lu, Jinming, et al.
Veröffentlicht: (2025)
FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing
von: Li, Zekai, et al.
Veröffentlicht: (2024)
von: Li, Zekai, et al.
Veröffentlicht: (2024)
FALCON: Fine-grained Activation Manipulation by Contrastive Orthogonal Unalignment for Large Language Model
von: Hu, Jinwei, et al.
Veröffentlicht: (2025)
von: Hu, Jinwei, et al.
Veröffentlicht: (2025)
Expressive and Generalizable Low-rank Adaptation for Large Models via Slow Cascaded Learning
von: Li, Siwei, et al.
Veröffentlicht: (2024)
von: Li, Siwei, et al.
Veröffentlicht: (2024)
Communication-Efficient and Tensorized Federated Fine-Tuning of Large Language Models
von: Ghiasvand, Sajjad, et al.
Veröffentlicht: (2024)
von: Ghiasvand, Sajjad, et al.
Veröffentlicht: (2024)
RefChecker: Reference-based Fine-grained Hallucination Checker and Benchmark for Large Language Models
von: Hu, Xiangkun, et al.
Veröffentlicht: (2024)
von: Hu, Xiangkun, et al.
Veröffentlicht: (2024)
MiLoRA: Efficient Mixture of Low-Rank Adaptation for Large Language Models Fine-tuning
von: Zhang, Jingfan, et al.
Veröffentlicht: (2024)
von: Zhang, Jingfan, et al.
Veröffentlicht: (2024)
Astra: Activation-Space Tail-Eigenvector Low-Rank Adaptation of Large Language Models
von: Liu, Kainan, et al.
Veröffentlicht: (2026)
von: Liu, Kainan, et al.
Veröffentlicht: (2026)
FLRC: Fine-grained Low-Rank Compressor for Efficient LLM Inference
von: Lu, Yu-Chen, et al.
Veröffentlicht: (2025)
von: Lu, Yu-Chen, et al.
Veröffentlicht: (2025)
RankGuide: Tensor-Rank-Guided Routing and Steering for Efficient Reasoning
von: Tian, Jiayi, et al.
Veröffentlicht: (2026)
von: Tian, Jiayi, et al.
Veröffentlicht: (2026)
Examining the Robustness of Large Language Models across Language Complexity
von: Zhang, Jiayi
Veröffentlicht: (2025)
von: Zhang, Jiayi
Veröffentlicht: (2025)
Distilling Fine-grained Sentiment Understanding from Large Language Models
von: Zhang, Yice, et al.
Veröffentlicht: (2024)
von: Zhang, Yice, et al.
Veröffentlicht: (2024)
BlockPruner: Fine-grained Pruning for Large Language Models
von: Zhong, Longguang, et al.
Veröffentlicht: (2024)
von: Zhong, Longguang, et al.
Veröffentlicht: (2024)
SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression
von: Wang, Xin, et al.
Veröffentlicht: (2024)
von: Wang, Xin, et al.
Veröffentlicht: (2024)
From Chaos to Order: The Atomic Reasoner Framework for Fine-grained Reasoning in Large Language Models
von: Liu, Jinyi, et al.
Veröffentlicht: (2025)
von: Liu, Jinyi, et al.
Veröffentlicht: (2025)
LoRA$^2$ : Multi-Scale Low-Rank Approximations for Fine-Tuning Large Language Models
von: Zhang, Jia-Chen, et al.
Veröffentlicht: (2024)
von: Zhang, Jia-Chen, et al.
Veröffentlicht: (2024)
ASVD: Activation-aware Singular Value Decomposition for Compressing Large Language Models
von: Yuan, Zhihang, et al.
Veröffentlicht: (2023)
von: Yuan, Zhihang, et al.
Veröffentlicht: (2023)
AdaZeta: Adaptive Zeroth-Order Tensor-Train Adaption for Memory-Efficient Large Language Models Fine-Tuning
von: Yang, Yifan, et al.
Veröffentlicht: (2024)
von: Yang, Yifan, et al.
Veröffentlicht: (2024)
Mitigating Outlier Activations in Low-Precision Fine-Tuning of Language Models
von: Ghaffari, Alireza, et al.
Veröffentlicht: (2023)
von: Ghaffari, Alireza, et al.
Veröffentlicht: (2023)
PocketLLM: Ultimate Compression of Large Language Models via Meta Networks
von: Tian, Ye, et al.
Veröffentlicht: (2025)
von: Tian, Ye, et al.
Veröffentlicht: (2025)
RetroLLM: Empowering Large Language Models to Retrieve Fine-grained Evidence within Generation
von: Li, Xiaoxi, et al.
Veröffentlicht: (2024)
von: Li, Xiaoxi, et al.
Veröffentlicht: (2024)
Fine-grained Gender Control in Machine Translation with Large Language Models
von: Lee, Minwoo, et al.
Veröffentlicht: (2024)
von: Lee, Minwoo, et al.
Veröffentlicht: (2024)
SoLA: Leveraging Soft Activation Sparsity and Low-Rank Decomposition for Large Language Model Compression
von: Huang, Xinhao, et al.
Veröffentlicht: (2026)
von: Huang, Xinhao, et al.
Veröffentlicht: (2026)
ALoRA: Allocating Low-Rank Adaptation for Fine-tuning Large Language Models
von: Liu, Zequan, et al.
Veröffentlicht: (2024)
von: Liu, Zequan, et al.
Veröffentlicht: (2024)
Adapting Large Language Models to Low-Resource Tibetan: A Two-Stage Continual and Supervised Fine-Tuning Study
von: Chen, Lifeng, et al.
Veröffentlicht: (2025)
von: Chen, Lifeng, et al.
Veröffentlicht: (2025)
Aligning Large Language Models via Fine-grained Supervision
von: Xu, Dehong, et al.
Veröffentlicht: (2024)
von: Xu, Dehong, et al.
Veröffentlicht: (2024)
Improving Large Language Models via Fine-grained Reinforcement Learning with Minimum Editing Constraint
von: Chen, Zhipeng, et al.
Veröffentlicht: (2024)
von: Chen, Zhipeng, et al.
Veröffentlicht: (2024)
VQ-Logits: Compressing the Output Bottleneck of Large Language Models via Vector Quantized Logits
von: Shao, Jintian, et al.
Veröffentlicht: (2025)
von: Shao, Jintian, et al.
Veröffentlicht: (2025)
InsCL: A Data-efficient Continual Learning Paradigm for Fine-tuning Large Language Models with Instructions
von: Wang, Yifan, et al.
Veröffentlicht: (2024)
von: Wang, Yifan, et al.
Veröffentlicht: (2024)
BriLLM: Brain-inspired Large Language Model
von: Zhao, Hai, et al.
Veröffentlicht: (2025)
von: Zhao, Hai, et al.
Veröffentlicht: (2025)
Unveiling the Generalization Power of Fine-Tuned Large Language Models
von: Yang, Haoran, et al.
Veröffentlicht: (2024)
von: Yang, Haoran, et al.
Veröffentlicht: (2024)
TruthX: Alleviating Hallucinations by Editing Large Language Models in Truthful Space
von: Zhang, Shaolei, et al.
Veröffentlicht: (2024)
von: Zhang, Shaolei, et al.
Veröffentlicht: (2024)
Quantization-Aware and Tensor-Compressed Training of Transformers for Natural Language Understanding
von: Yang, Zi, et al.
Veröffentlicht: (2023)
von: Yang, Zi, et al.
Veröffentlicht: (2023)
TableLoRA: Low-rank Adaptation on Table Structure Understanding for Large Language Models
von: He, Xinyi, et al.
Veröffentlicht: (2025)
von: He, Xinyi, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Activation-Informed Pareto-Guided Low-Rank Compression for Efficient LLM/VLM
von: Solgi, Ryan, et al.
Veröffentlicht: (2025) -
Ultra Memory-Efficient On-FPGA Training of Transformers via Tensor-Compressed Optimization
von: Tian, Jiayi, et al.
Veröffentlicht: (2025) -
Saten: Sparse Augmented Tensor Networks for Post-Training Compression of Large Language Models
von: Solgi, Ryan, et al.
Veröffentlicht: (2025) -
FLAT: Formal Languages as Types
von: Zhu, Fengmin, et al.
Veröffentlicht: (2025) -
LoRETTA: Low-Rank Economic Tensor-Train Adaptation for Ultra-Low-Parameter Fine-Tuning of Large Language Models
von: Yang, Yifan, et al.
Veröffentlicht: (2024)