UNComp: Can Matrix Entropy Uncover Sparsity? -- A Compressor Design from an Uncertainty-Aware Perspective
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xiong, Jing, Shen, Jianghan, Ye, Fanghua, Tao, Chaofan, Wan, Zhongwei, Lu, Jianqiao, Wu, Xun, Zheng, Chuanyang, Guo, Zhijiang, Yang, Min, Kong, Lingpeng, Wong, Ngai |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ParallelComp: Parallel Long-Context Compressor for Length Extrapolation
par: Xiong, Jing, et autres
Publié: (2025)
par: Xiong, Jing, et autres
Publié: (2025)
UncertaintyRAG: Span-Level Uncertainty Enhanced Long-Context Modeling for Retrieval-Augmented Generation
par: Li, Zixuan, et autres
Publié: (2024)
par: Li, Zixuan, et autres
Publié: (2024)
ATTS: Asynchronous Test-Time Scaling via Conformal Prediction
par: Xiong, Jing, et autres
Publié: (2025)
par: Xiong, Jing, et autres
Publié: (2025)
DoPE: Denoising Rotary Position Embedding
par: Xiong, Jing, et autres
Publié: (2025)
par: Xiong, Jing, et autres
Publié: (2025)
Scaling Laws with Vocabulary: Larger Models Deserve Larger Vocabularies
par: Tao, Chaofan, et autres
Publié: (2024)
par: Tao, Chaofan, et autres
Publié: (2024)
MMFormalizer: Multimodal Autoformalization in the Wild
par: Xiong, Jing, et autres
Publié: (2026)
par: Xiong, Jing, et autres
Publié: (2026)
OVD: On-policy Verbal Distillation
par: Xiong, Jing, et autres
Publié: (2026)
par: Xiong, Jing, et autres
Publié: (2026)
SwingArena: Competitive Programming Arena for Long-context GitHub Issue Solving
par: Xu, Wendong, et autres
Publié: (2025)
par: Xu, Wendong, et autres
Publié: (2025)
FormalAlign: Automated Alignment Evaluation for Autoformalization
par: Lu, Jianqiao, et autres
Publié: (2024)
par: Lu, Jianqiao, et autres
Publié: (2024)
LongEmotion: Measuring Emotional Intelligence of Large Language Models in Long-Context Interaction
par: Liu, Weichu, et autres
Publié: (2025)
par: Liu, Weichu, et autres
Publié: (2025)
Sparsity-Aware Roofline Models for Sparse Matrix-Matrix Multiplication
par: Qian, Matthew, et autres
Publié: (2026)
par: Qian, Matthew, et autres
Publié: (2026)
Efficient Generative Modeling with Unitary Matrix Product States Using Riemannian Optimization
par: Duan, Haotong, et autres
Publié: (2026)
par: Duan, Haotong, et autres
Publié: (2026)
LLM-Barber: Block-Aware Rebuilder for Sparsity Mask in One-Shot for Large Language Models
par: Su, Yupeng, et autres
Publié: (2024)
par: Su, Yupeng, et autres
Publié: (2024)
CktFormalizer: Autoformalization of Natural Language into Circuit Representations
par: Xiong, Jing, et autres
Publié: (2026)
par: Xiong, Jing, et autres
Publié: (2026)
Autoregressive Models in Vision: A Survey
par: Xiong, Jing, et autres
Publié: (2024)
par: Xiong, Jing, et autres
Publié: (2024)
FACTTRACK: Time-Aware World State Tracking in Story Outlines
par: Lyu, Zhiheng, et autres
Publié: (2024)
par: Lyu, Zhiheng, et autres
Publié: (2024)
Convolutional Networks as Extremely Small Foundation Models: Visual Prompting and Theoretical Perspective
par: Wangni, Jianqiao
Publié: (2024)
par: Wangni, Jianqiao
Publié: (2024)
AutoPSV: Automated Process-Supervised Verifier
par: Lu, Jianqiao, et autres
Publié: (2024)
par: Lu, Jianqiao, et autres
Publié: (2024)
MMSearch-Plus: Benchmarking Provenance-Aware Search for Multimodal Browsing Agents
par: Tao, Xijia, et autres
Publié: (2025)
par: Tao, Xijia, et autres
Publié: (2025)
Rethinking Kullback-Leibler Divergence in Knowledge Distillation for Large Language Models
par: Wu, Taiqiang, et autres
Publié: (2024)
par: Wu, Taiqiang, et autres
Publié: (2024)
PEFT-as-an-Attack! Jailbreaking Language Models during Federated Parameter-Efficient Fine-Tuning
par: Li, Shenghui, et autres
Publié: (2024)
par: Li, Shenghui, et autres
Publié: (2024)
The Compressor-Retriever Architecture for Language Model OS
par: Yang, Yuan, et autres
Publié: (2024)
par: Yang, Yuan, et autres
Publié: (2024)
FlexPrefill: A Context-Aware Sparse Attention Mechanism for Efficient Long-Sequence Inference
par: Lai, Xunhao, et autres
Publié: (2025)
par: Lai, Xunhao, et autres
Publié: (2025)
Self-consistent Reasoning For Solving Math Word Problems
par: Xiong, Jing, et autres
Publié: (2022)
par: Xiong, Jing, et autres
Publié: (2022)
The Linear Attention Resurrection in Vision Transformer
par: Zheng, Chuanyang
Publié: (2025)
par: Zheng, Chuanyang
Publié: (2025)
iFormer: Integrating ConvNet and Transformer for Mobile Application
par: Zheng, Chuanyang
Publié: (2025)
par: Zheng, Chuanyang
Publié: (2025)
MiniMax Entropy Network: Learning Category-Invariant Features for Domain Adaptation
par: Tao, Chaofan, et autres
Publié: (2019)
par: Tao, Chaofan, et autres
Publié: (2019)
TreeReview: A Dynamic Tree of Questions Framework for Deep and Efficient LLM-based Scientific Peer Review
par: Chang, Yuan, et autres
Publié: (2025)
par: Chang, Yuan, et autres
Publié: (2025)
Scaling Reasoning without Attention
par: Zhao, Xueliang, et autres
Publié: (2025)
par: Zhao, Xueliang, et autres
Publié: (2025)
Reasoning Does Not Necessarily Improve Role-Playing Ability
par: Feng, Xiachong, et autres
Publié: (2025)
par: Feng, Xiachong, et autres
Publié: (2025)
Linguistic Frameworks Go Toe-to-Toe at Neuro-Symbolic Language Modeling
par: Prange, Jakob, et autres
Publié: (2021)
par: Prange, Jakob, et autres
Publié: (2021)
SAUC: Sparsity-Aware Uncertainty Calibration for Spatiotemporal Prediction with Graph Neural Networks
par: Zhuang, Dingyi, et autres
Publié: (2024)
par: Zhuang, Dingyi, et autres
Publié: (2024)
Masked Matrix Multiplication for Emergent Sparsity
par: Wheatman, Brian, et autres
Publié: (2024)
par: Wheatman, Brian, et autres
Publié: (2024)
Cardinality Sparsity: Applications in Matrix-Matrix Multiplications and Machine Learning
par: Mohades, Ali, et autres
Publié: (2023)
par: Mohades, Ali, et autres
Publié: (2023)
Benchmarking LLMs via Uncertainty Quantification
par: Ye, Fanghua, et autres
Publié: (2024)
par: Ye, Fanghua, et autres
Publié: (2024)
An Efficient Gradient-Aware Error-Bounded Lossy Compressor for Federated Learning
par: Ye, Zhijing, et autres
Publié: (2025)
par: Ye, Zhijing, et autres
Publié: (2025)
MEIT: Multimodal Electrocardiogram Instruction Tuning on Large Language Models for Report Generation
par: Wan, Zhongwei, et autres
Publié: (2024)
par: Wan, Zhongwei, et autres
Publié: (2024)
Uncovering Layer-Dependent Activation Sparsity Patterns in ReLU Transformers
par: Wild, Cody, et autres
Publié: (2024)
par: Wild, Cody, et autres
Publié: (2024)
Sparsity of the Main Effect Matrix Factor Model
par: Cen, Zetai, et autres
Publié: (2025)
par: Cen, Zetai, et autres
Publié: (2025)
Orthogonal Nonnegative Matrix Factorization with Sparsity Constraints
par: Basiri, Salar, et autres
Publié: (2022)
par: Basiri, Salar, et autres
Publié: (2022)
Documents similaires
-
ParallelComp: Parallel Long-Context Compressor for Length Extrapolation
par: Xiong, Jing, et autres
Publié: (2025) -
UncertaintyRAG: Span-Level Uncertainty Enhanced Long-Context Modeling for Retrieval-Augmented Generation
par: Li, Zixuan, et autres
Publié: (2024) -
ATTS: Asynchronous Test-Time Scaling via Conformal Prediction
par: Xiong, Jing, et autres
Publié: (2025) -
DoPE: Denoising Rotary Position Embedding
par: Xiong, Jing, et autres
Publié: (2025) -
Scaling Laws with Vocabulary: Larger Models Deserve Larger Vocabularies
par: Tao, Chaofan, et autres
Publié: (2024)