SkipCat: Rank-Maximized Low-Rank Compression of Large Language Models via Shared Projection and Block Skipping
Fuente:
arXiv
Saved in:
| Main Authors: | Lu, Yu-Chen, Yu, Sheng-Feng, Weng, Hui-Hsien, Wang, Pei-Shuo, Hu, Yu-Fang, Hung-Chun, Liang, Chiang, Hung-Yueh, Wu, Kai-Chiang |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Palu: Compressing KV-Cache with Low-Rank Projection
by: Chang, Chi-Chih, et al.
Published: (2024)
by: Chang, Chi-Chih, et al.
Published: (2024)
UniQL: Unified Quantization and Low-rank Compression for Adaptive Edge LLMs
by: Chiang, Hung-Yueh, et al.
Published: (2025)
by: Chiang, Hung-Yueh, et al.
Published: (2025)
QuarterMap: Efficient Post-Training Token Pruning for Visual State Space Models
by: Chi, Tien-Yu, et al.
Published: (2025)
by: Chi, Tien-Yu, et al.
Published: (2025)
SCAN-Edge: Finding MobileNet-speed Hybrid Networks for Diverse Edge Devices via Hardware-Aware Evolutionary Search
by: Chiang, Hung-Yueh, et al.
Published: (2024)
by: Chiang, Hung-Yueh, et al.
Published: (2024)
GM-Skip: Metric-Guided Transformer Block Skipping for Efficient Vision-Language Models
by: Huang, Lianming, et al.
Published: (2025)
by: Huang, Lianming, et al.
Published: (2025)
On the existence of extremal solutions for the conjugate discrete-time Riccati equation
by: Chiang, Chun-Yueh
Published: (2024)
by: Chiang, Chun-Yueh
Published: (2024)
FLRC: Fine-grained Low-Rank Compressor for Efficient LLM Inference
by: Lu, Yu-Chen, et al.
Published: (2025)
by: Lu, Yu-Chen, et al.
Published: (2025)
Similarity Trajectories: Linking Sampling Process to Artifacts in Diffusion-Generated Images
by: Menn, Dennis, et al.
Published: (2024)
by: Menn, Dennis, et al.
Published: (2024)
V"Mean"ba: Visual State Space Models only need 1 hidden dimension
by: Chi, Tien-Yu, et al.
Published: (2024)
by: Chi, Tien-Yu, et al.
Published: (2024)
Lambda-Skip Connections: the architectural component that prevents Rank Collapse
by: Joseph, Federico Arangath, et al.
Published: (2024)
by: Joseph, Federico Arangath, et al.
Published: (2024)
DoRA: Weight-Decomposed Low-Rank Adaptation
by: Liu, Shih-Yang, et al.
Published: (2024)
by: Liu, Shih-Yang, et al.
Published: (2024)
ELANA: A Simple Energy and Latency Analyzer for LLMs
by: Chiang, Hung-Yueh, et al.
Published: (2025)
by: Chiang, Hung-Yueh, et al.
Published: (2025)
Quamba: A Post-Training Quantization Recipe for Selective State Space Models
by: Chiang, Hung-Yueh, et al.
Published: (2024)
by: Chiang, Hung-Yueh, et al.
Published: (2024)
SkipSR: Faster Super Resolution with Token Skipping
by: Choudhury, Rohan, et al.
Published: (2025)
by: Choudhury, Rohan, et al.
Published: (2025)
Dual-Branch HNSW Approach with Skip Bridges and LID-Driven Optimization
by: Nguyen, Hy, et al.
Published: (2025)
by: Nguyen, Hy, et al.
Published: (2025)
Only Large Weights (And Not Skip Connections) Can Prevent the Perils of Rank Collapse
by: Alman, Josh, et al.
Published: (2025)
by: Alman, Josh, et al.
Published: (2025)
Skip and Skip: Segmenting Medical Images with Prompts
by: Chen, Jiawei, et al.
Published: (2024)
by: Chen, Jiawei, et al.
Published: (2024)
Climate Downscaling: A Deep-Learning Based Super-resolution Model of Precipitation Data with Attention Block and Skip Connections
by: Chiang, Chia-Hao, et al.
Published: (2024)
by: Chiang, Chia-Hao, et al.
Published: (2024)
Quamba2: A Robust and Scalable Post-training Quantization Framework for Selective State Space Models
by: Chiang, Hung-Yueh, et al.
Published: (2025)
by: Chiang, Hung-Yueh, et al.
Published: (2025)
Spectral Kernels and Holomorphic Morse Inequalities for Sequence of Line Bundles
by: Chiang, Yueh-Lin
Published: (2024)
by: Chiang, Yueh-Lin
Published: (2024)
EoRA: Fine-tuning-free Compensation for Compressed LLM with Eigenspace Low-Rank Approximation
by: Liu, Shih-Yang, et al.
Published: (2024)
by: Liu, Shih-Yang, et al.
Published: (2024)
From Uniform to Adaptive: General Skip-Block Mechanisms for Efficient PDE Neural Operators
by: Liu, Lei, et al.
Published: (2025)
by: Liu, Lei, et al.
Published: (2025)
Skip-It? Theoretical Conditions for Layer Skipping in Vision-Language Models
by: Hartman, Max, et al.
Published: (2025)
by: Hartman, Max, et al.
Published: (2025)
xKV: Cross-Layer KV-Cache Compression via Aligned Singular Vector Extraction
by: Chang, Chi-Chih, et al.
Published: (2025)
by: Chang, Chi-Chih, et al.
Published: (2025)
Cultural structures that perpetuate silence: an East Asian reflection on bullying in the operating theatre
by: Pei‐Yi Hung, et al.
Published: (2025)
by: Pei‐Yi Hung, et al.
Published: (2025)
Randomized Block Low-Rank Matrix Compression by Tagging
by: Pearce, Katherine J., et al.
Published: (2025)
by: Pearce, Katherine J., et al.
Published: (2025)
TokenSkip: Controllable Chain-of-Thought Compression in LLMs
by: Xia, Heming, et al.
Published: (2025)
by: Xia, Heming, et al.
Published: (2025)
Emotional variability and late adolescent suicidal ideation: Buffering role of parent–youth connectedness
by: Shou‐Chun Chiang, et al.
Published: (2024)
by: Shou‐Chun Chiang, et al.
Published: (2024)
SEASON: Mitigating Temporal Hallucination in Video Large Language Models via Self-Diagnostic Contrastive Decoding
by: Wu, Chang-Hsun, et al.
Published: (2025)
by: Wu, Chang-Hsun, et al.
Published: (2025)
RaSA: Rank-Sharing Low-Rank Adaptation
by: He, Zhiwei, et al.
Published: (2025)
by: He, Zhiwei, et al.
Published: (2025)
Probing Stringy Horizons with Pole-Skipping in Non-Maximal Chaotic Systems
by: Gao, Ping, et al.
Published: (2025)
by: Gao, Ping, et al.
Published: (2025)
Always Skip Attention
by: Ji, Yiping, et al.
Published: (2025)
by: Ji, Yiping, et al.
Published: (2025)
AdaSkip: Adaptive Sublayer Skipping for Accelerating Long-Context LLM Inference
by: He, Zhuomin, et al.
Published: (2025)
by: He, Zhuomin, et al.
Published: (2025)
SkipGS: Post-Densification Backward Skipping for Efficient 3DGS Training
by: Li, Jingxing, et al.
Published: (2026)
by: Li, Jingxing, et al.
Published: (2026)
Skip to Secure: Securing Cyber-physical Control Loops with Intentionally Skipped Executions
by: Adhikary, Sunandan, et al.
Published: (2020)
by: Adhikary, Sunandan, et al.
Published: (2020)
Effects of Essential Oil Aromatherapy on Sleep, Depression, and Well‐Being Among Older Adults: Implications for Community Health and Social Care
by: Pei Fen Chiang, et al.
Published: (2026)
by: Pei Fen Chiang, et al.
Published: (2026)
LEAML: Label-Efficient Adaptation to Out-of-Distribution Visual Tasks for Multimodal Large Language Models
by: Lin, Ci-Siang, et al.
Published: (2025)
by: Lin, Ci-Siang, et al.
Published: (2025)
CeRA: Overcoming the Linear Ceiling of Low-Rank Adaptation via Capacity Expansion
by: Chen, Hung-Hsuan
Published: (2026)
by: Chen, Hung-Hsuan
Published: (2026)
FarSkip-Collective: Unhobbling Blocking Communication in Mixture of Experts Models
by: Dukler, Yonatan, et al.
Published: (2025)
by: Dukler, Yonatan, et al.
Published: (2025)
Skip-SCAR: Hardware-Friendly High-Quality Embodied Visual Navigation
by: Liu, Yaotian, et al.
Published: (2024)
by: Liu, Yaotian, et al.
Published: (2024)
Similar Items
-
Palu: Compressing KV-Cache with Low-Rank Projection
by: Chang, Chi-Chih, et al.
Published: (2024) -
UniQL: Unified Quantization and Low-rank Compression for Adaptive Edge LLMs
by: Chiang, Hung-Yueh, et al.
Published: (2025) -
QuarterMap: Efficient Post-Training Token Pruning for Visual State Space Models
by: Chi, Tien-Yu, et al.
Published: (2025) -
SCAN-Edge: Finding MobileNet-speed Hybrid Networks for Diverse Edge Devices via Hardware-Aware Evolutionary Search
by: Chiang, Hung-Yueh, et al.
Published: (2024) -
GM-Skip: Metric-Guided Transformer Block Skipping for Efficient Vision-Language Models
by: Huang, Lianming, et al.
Published: (2025)