CompressNAS : A Fast and Efficient Technique for Model Compression using Decomposition
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sah, Sudhakar, Chabbra, Nikhil, Durnerin, Matthieu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
STResNet & STYOLO : A New Family of Compact Classification and Object Detection Models for MCUs
par: Sah, Sudhakar, et autres
Publié: (2026)
par: Sah, Sudhakar, et autres
Publié: (2026)
A Hierarchical Compression Technique for 3D Gaussian Splatting Compression
par: Huang, He, et autres
Publié: (2024)
par: Huang, He, et autres
Publié: (2024)
Image Compression Using Singular Value Decomposition
par: Jiang, Justin
Publié: (2025)
par: Jiang, Justin
Publié: (2025)
Token Pruning using a Lightweight Background Aware Vision Transformer
par: Sah, Sudhakar, et autres
Publié: (2024)
par: Sah, Sudhakar, et autres
Publié: (2024)
Computer Vision Model Compression Techniques for Embedded Systems: A Survey
par: Lopes, Alexandre, et autres
Publié: (2024)
par: Lopes, Alexandre, et autres
Publié: (2024)
Spectral Compressive Imaging via Chromaticity-Intensity Decomposition
par: Wang, Xiaodong, et autres
Publié: (2025)
par: Wang, Xiaodong, et autres
Publié: (2025)
Model Compression Techniques in Biometrics Applications: A Survey
par: Caldeira, Eduarda, et autres
Publié: (2024)
par: Caldeira, Eduarda, et autres
Publié: (2024)
Convolutional Neural Network Compression Based on Low-Rank Decomposition
par: He, Yaping, et autres
Publié: (2024)
par: He, Yaping, et autres
Publié: (2024)
Fast Feedforward 3D Gaussian Splatting Compression
par: Chen, Yihang, et autres
Publié: (2024)
par: Chen, Yihang, et autres
Publié: (2024)
Compress to Focus: Efficient Coordinate Compression for Policy Optimization in Multi-Turn GUI Agents
par: Song, Yurun, et autres
Publié: (2026)
par: Song, Yurun, et autres
Publié: (2026)
A Survey of Token Compression for Efficient Multimodal Large Language Models
par: Shao, Kele, et autres
Publié: (2025)
par: Shao, Kele, et autres
Publié: (2025)
Delta-SVD: Efficient Compression for Personalized Text-to-Image Models
par: Zhang, Tangyuan, et autres
Publié: (2025)
par: Zhang, Tangyuan, et autres
Publié: (2025)
Towards Scalable Modeling of Compressed Videos for Efficient Action Recognition
par: Biswas, Shristi Das, et autres
Publié: (2025)
par: Biswas, Shristi Das, et autres
Publié: (2025)
Locality-aware Gaussian Compression for Fast and High-quality Rendering
par: Shin, Seungjoo, et autres
Publié: (2025)
par: Shin, Seungjoo, et autres
Publié: (2025)
Accurate and Fast Compressed Video Captioning
par: Shen, Yaojie, et autres
Publié: (2023)
par: Shen, Yaojie, et autres
Publié: (2023)
SlowFast-SCI: Slow-Fast Deep Unfolding Learning for Spectral Compressive Imaging
par: Zeng, Haijin, et autres
Publié: (2025)
par: Zeng, Haijin, et autres
Publié: (2025)
Steering One-Step Diffusion Model with Fidelity-Rich Decoder for Fast Image Compression
par: Chen, Zheng, et autres
Publié: (2025)
par: Chen, Zheng, et autres
Publié: (2025)
OFA-Diffusion Compression: Compressing Diffusion Model in One-Shot Manner
par: Jiang, Haoyang, et autres
Publié: (2026)
par: Jiang, Haoyang, et autres
Publié: (2026)
FSVideo: Fast Speed Video Diffusion Model in a Highly-Compressed Latent Space
par: FSVideo Team, et autres
Publié: (2026)
par: FSVideo Team, et autres
Publié: (2026)
Head-Aware KV Cache Compression for Efficient Visual Autoregressive Modeling
par: Qin, Ziran, et autres
Publié: (2025)
par: Qin, Ziran, et autres
Publié: (2025)
Towards Universal & Efficient Model Compression via Exponential Torque Pruning
par: Modi, Sarthak Ketanbhai, et autres
Publié: (2025)
par: Modi, Sarthak Ketanbhai, et autres
Publié: (2025)
LiteVAR: Compressing Visual Autoregressive Modelling with Efficient Attention and Quantization
par: Xie, Rui, et autres
Publié: (2024)
par: Xie, Rui, et autres
Publié: (2024)
Efficient Large Multi-modal Models via Visual Context Compression
par: Chen, Jieneng, et autres
Publié: (2024)
par: Chen, Jieneng, et autres
Publié: (2024)
Compressed-Language Models for Understanding Compressed File Formats: a JPEG Exploration
par: Pérez, Juan C., et autres
Publié: (2024)
par: Pérez, Juan C., et autres
Publié: (2024)
Can Visual Input Be Compressed? A Visual Token Compression Benchmark for Large Multimodal Models
par: Peng, Tianfan, et autres
Publié: (2025)
par: Peng, Tianfan, et autres
Publié: (2025)
EarlyTom: Early Token Compression Completes Fast Video Understanding
par: Wang, Hesong, et autres
Publié: (2026)
par: Wang, Hesong, et autres
Publié: (2026)
OmniZip: Audio-Guided Dynamic Token Compression for Fast Omnimodal Large Language Models
par: Tao, Keda, et autres
Publié: (2025)
par: Tao, Keda, et autres
Publié: (2025)
Distribution-Aware Tensor Decomposition for Compression of Convolutional Neural Networks
par: Kalle, Alper, et autres
Publié: (2025)
par: Kalle, Alper, et autres
Publié: (2025)
Activation Map Compression through Tensor Decomposition for Deep Learning
par: Nguyen, Le-Trung, et autres
Publié: (2024)
par: Nguyen, Le-Trung, et autres
Publié: (2024)
Efficient Learned Image Compression Through Knowledge Distillation
par: Allemand, Fabien, et autres
Publié: (2025)
par: Allemand, Fabien, et autres
Publié: (2025)
Efficient Feature Compression for Machines with Global Statistics Preservation
par: Eimon, Md Eimran Hossain, et autres
Publié: (2025)
par: Eimon, Md Eimran Hossain, et autres
Publié: (2025)
EfficientVLA: Training-Free Acceleration and Compression for Vision-Language-Action Models
par: Yang, Yantai, et autres
Publié: (2025)
par: Yang, Yantai, et autres
Publié: (2025)
SnapCap: Efficient Snapshot Compressive Video Captioning
par: Sun, Jianqiao, et autres
Publié: (2024)
par: Sun, Jianqiao, et autres
Publié: (2024)
General Compression Framework for Efficient Transformer Object Tracking
par: Hong, Lingyi, et autres
Publié: (2024)
par: Hong, Lingyi, et autres
Publié: (2024)
Efficient Reasoning via Thought Compression for Language Segmentation
par: Zhou, Qing, et autres
Publié: (2026)
par: Zhou, Qing, et autres
Publié: (2026)
Efficient Progressive Image Compression with Variance-aware Masking
par: Presta, Alberto, et autres
Publié: (2024)
par: Presta, Alberto, et autres
Publié: (2024)
Investigating Structural Pruning and Recovery Techniques for Compressing Multimodal Large Language Models: An Empirical Study
par: Huang, Yiran, et autres
Publié: (2025)
par: Huang, Yiran, et autres
Publié: (2025)
Invertible Diffusion Models for Compressed Sensing
par: Chen, Bin, et autres
Publié: (2024)
par: Chen, Bin, et autres
Publié: (2024)
Model Compression using Progressive Channel Pruning
par: Guo, Jinyang, et autres
Publié: (2025)
par: Guo, Jinyang, et autres
Publié: (2025)
Extreme Model Compression for Edge Vision-Language Models: Sparse Temporal Token Fusion and Adaptive Neural Compression
par: Tanvir, Md Tasnin, et autres
Publié: (2025)
par: Tanvir, Md Tasnin, et autres
Publié: (2025)
Documents similaires
-
STResNet & STYOLO : A New Family of Compact Classification and Object Detection Models for MCUs
par: Sah, Sudhakar, et autres
Publié: (2026) -
A Hierarchical Compression Technique for 3D Gaussian Splatting Compression
par: Huang, He, et autres
Publié: (2024) -
Image Compression Using Singular Value Decomposition
par: Jiang, Justin
Publié: (2025) -
Token Pruning using a Lightweight Background Aware Vision Transformer
par: Sah, Sudhakar, et autres
Publié: (2024) -
Computer Vision Model Compression Techniques for Embedded Systems: A Survey
par: Lopes, Alexandre, et autres
Publié: (2024)