Training-free Ultra Small Model for Universal Sparse Reconstruction in Compressed Sensing
Fuente:
arXiv
Guardado en:
| Autores principales: | Tang, Chaoqing, Zhuang, Huanze, Tian, Guiyun, Zeng, Zhenli, Ding, Yi, Liu, Wenzhong, Bai, Xiang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
UNIQUE: Universal Top-k Sparse Attention for Training-free Inference and Sparsity-aware Training
por: Deng, Keqi, et al.
Publicado: (2026)
por: Deng, Keqi, et al.
Publicado: (2026)
SEAP: Training-free Sparse Expert Activation Pruning Unlock the Brainpower of Large Language Models
por: Liang, Xun, et al.
Publicado: (2025)
por: Liang, Xun, et al.
Publicado: (2025)
HiSAC: Hierarchical Sparse Activation Compression for Ultra-long Sequence Modeling in Recommenders
por: Yuan, Kun, et al.
Publicado: (2026)
por: Yuan, Kun, et al.
Publicado: (2026)
Ultra Memory-Efficient On-FPGA Training of Transformers via Tensor-Compressed Optimization
por: Tian, Jiayi, et al.
Publicado: (2025)
por: Tian, Jiayi, et al.
Publicado: (2025)
Saten: Sparse Augmented Tensor Networks for Post-Training Compression of Large Language Models
por: Solgi, Ryan, et al.
Publicado: (2025)
por: Solgi, Ryan, et al.
Publicado: (2025)
KV-Embedding: Training-free Text Embedding via Internal KV Re-routing in Decoder-only LLMs
por: Tang, Yixuan, et al.
Publicado: (2026)
por: Tang, Yixuan, et al.
Publicado: (2026)
One-for-All Pruning: A Universal Model for Customized Compression of Large Language Models
por: Ye, Rongguang, et al.
Publicado: (2025)
por: Ye, Rongguang, et al.
Publicado: (2025)
Cross-Family Speculative Prefill: Training-Free Long-Context Compression with Small Draft Models
por: Upasani, Shubhangi, et al.
Publicado: (2026)
por: Upasani, Shubhangi, et al.
Publicado: (2026)
Jailbreak Antidote: Runtime Safety-Utility Balance via Sparse Representation Adjustment in Large Language Models
por: Shen, Guobin, et al.
Publicado: (2024)
por: Shen, Guobin, et al.
Publicado: (2024)
TaDA: Training-free recipe for Decoding with Adaptive KV Cache Compression and Mean-centering
por: Joshi, Vinay, et al.
Publicado: (2025)
por: Joshi, Vinay, et al.
Publicado: (2025)
One Small and One Large for Document-level Event Argument Extraction
por: Peng, Jiaren, et al.
Publicado: (2024)
por: Peng, Jiaren, et al.
Publicado: (2024)
KVReviver: Reversible KV Cache Compression with Sketch-Based Token Reconstruction
por: Yuan, Aomufei, et al.
Publicado: (2025)
por: Yuan, Aomufei, et al.
Publicado: (2025)
Compressing Lengthy Context With UltraGist
por: Zhang, Peitian, et al.
Publicado: (2024)
por: Zhang, Peitian, et al.
Publicado: (2024)
LACONIC: Dense-Level Effectiveness for Scalable Sparse Retrieval via a Two-Phase Training Curriculum
por: Xu, Zhichao, et al.
Publicado: (2026)
por: Xu, Zhichao, et al.
Publicado: (2026)
MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies
por: Hu, Shengding, et al.
Publicado: (2024)
por: Hu, Shengding, et al.
Publicado: (2024)
RATE: Reviewer Profiling and Annotation-free Training for Expertise Ranking in Peer Review Systems
por: Liu, Weicong, et al.
Publicado: (2026)
por: Liu, Weicong, et al.
Publicado: (2026)
Training-free Context-adaptive Attention for Efficient Long Context Modeling
por: You, Zeng, et al.
Publicado: (2025)
por: You, Zeng, et al.
Publicado: (2025)
Compressed Sensing for Capability Localization in Large Language Models
por: Bair, Anna, et al.
Publicado: (2026)
por: Bair, Anna, et al.
Publicado: (2026)
BEAVER: A Training-Free Hierarchical Prompt Compression Method via Structure-Aware Page Selection
por: Hu, Zhengpei, et al.
Publicado: (2026)
por: Hu, Zhengpei, et al.
Publicado: (2026)
Achieving Sparse Activation in Small Language Models
por: Song, Jifeng, et al.
Publicado: (2024)
por: Song, Jifeng, et al.
Publicado: (2024)
A Unified Sparse Attention via Multi-Granularity Compression
por: Liu, Siran, et al.
Publicado: (2025)
por: Liu, Siran, et al.
Publicado: (2025)
CSPLADE: Learned Sparse Retrieval with Causal Language Models
por: Xu, Zhichao, et al.
Publicado: (2025)
por: Xu, Zhichao, et al.
Publicado: (2025)
Sparse Rewards Can Self-Train Dialogue Agents
por: Lattimer, Barrett Martin, et al.
Publicado: (2024)
por: Lattimer, Barrett Martin, et al.
Publicado: (2024)
Efficient Long CoT Reasoning in Small Language Models
por: Wang, Zhaoyang, et al.
Publicado: (2025)
por: Wang, Zhaoyang, et al.
Publicado: (2025)
SciKnowEval: Evaluating Multi-level Scientific Knowledge of Large Language Models
por: Feng, Kehua, et al.
Publicado: (2024)
por: Feng, Kehua, et al.
Publicado: (2024)
White-Box Transformers via Sparse Rate Reduction: Compression Is All There Is?
por: Yu, Yaodong, et al.
Publicado: (2023)
por: Yu, Yaodong, et al.
Publicado: (2023)
Data-free Weight Compress and Denoise for Large Language Models
por: Peng, Runyu, et al.
Publicado: (2024)
por: Peng, Runyu, et al.
Publicado: (2024)
From Similarity to Structure: Training-free LLM Context Compression with Hybrid Graph Priors
por: Zhou, Yitian, et al.
Publicado: (2026)
por: Zhou, Yitian, et al.
Publicado: (2026)
GCoder: Improving Large Language Model for Generalized Graph Problem Solving
por: Zhang, Qifan, et al.
Publicado: (2024)
por: Zhang, Qifan, et al.
Publicado: (2024)
Wave Network: An Ultra-Small Language Model
por: Zhang, Xin, et al.
Publicado: (2024)
por: Zhang, Xin, et al.
Publicado: (2024)
Ultra-FineWeb: Efficient Data Filtering and Verification for High-Quality LLM Training Data
por: Wang, Yudong, et al.
Publicado: (2025)
por: Wang, Yudong, et al.
Publicado: (2025)
Improving Large Models with Small models: Lower Costs and Better Performance
por: Chen, Dong, et al.
Publicado: (2024)
por: Chen, Dong, et al.
Publicado: (2024)
PDF-WuKong: A Large Multimodal Model for Efficient Long PDF Reading with End-to-End Sparse Sampling
por: Xie, Xudong, et al.
Publicado: (2024)
por: Xie, Xudong, et al.
Publicado: (2024)
Training Superior Sparse Autoencoders for Instruct Models
por: Li, Jiaming, et al.
Publicado: (2025)
por: Li, Jiaming, et al.
Publicado: (2025)
Learning to Seek Help: Dynamic Collaboration Between Small and Large Language Models
por: Zeng, Hang, et al.
Publicado: (2026)
por: Zeng, Hang, et al.
Publicado: (2026)
SIRI: Scaling Iterative Reinforcement Learning with Interleaved Compression
por: Wen, Haoming, et al.
Publicado: (2025)
por: Wen, Haoming, et al.
Publicado: (2025)
MemoryFormer: Minimize Transformer Computation by Removing Fully-Connected Layers
por: Ding, Ning, et al.
Publicado: (2024)
por: Ding, Ning, et al.
Publicado: (2024)
IndexCache: Accelerating Sparse Attention via Cross-Layer Index Reuse
por: Bai, Yushi, et al.
Publicado: (2026)
por: Bai, Yushi, et al.
Publicado: (2026)
Dense Training, Sparse Inference: Rethinking Training of Mixture-of-Experts Language Models
por: Pan, Bowen, et al.
Publicado: (2024)
por: Pan, Bowen, et al.
Publicado: (2024)
SparseRM: A Lightweight Preference Modeling with Sparse Autoencoder
por: Liu, Dengcan, et al.
Publicado: (2025)
por: Liu, Dengcan, et al.
Publicado: (2025)
Ejemplares similares
-
UNIQUE: Universal Top-k Sparse Attention for Training-free Inference and Sparsity-aware Training
por: Deng, Keqi, et al.
Publicado: (2026) -
SEAP: Training-free Sparse Expert Activation Pruning Unlock the Brainpower of Large Language Models
por: Liang, Xun, et al.
Publicado: (2025) -
HiSAC: Hierarchical Sparse Activation Compression for Ultra-long Sequence Modeling in Recommenders
por: Yuan, Kun, et al.
Publicado: (2026) -
Ultra Memory-Efficient On-FPGA Training of Transformers via Tensor-Compressed Optimization
por: Tian, Jiayi, et al.
Publicado: (2025) -
Saten: Sparse Augmented Tensor Networks for Post-Training Compression of Large Language Models
por: Solgi, Ryan, et al.
Publicado: (2025)