Numerical Pruning for Efficient Autoregressive Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shen, Xuan, Song, Zhao, Zhou, Yufa, Chen, Bo, Liu, Jing, Zhang, Ruiyi, Rossi, Ryan A., Tan, Hao, Yu, Tong, Chen, Xiang, Zhou, Yufan, Sun, Tong, Zhao, Pu, Wang, Yanzhi, Gu, Jiuxiang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Efficient Reasoning with Hidden Thinking
par: Shen, Xuan, et autres
Publié: (2025)
par: Shen, Xuan, et autres
Publié: (2025)
Customization Assistant for Text-to-image Generation
par: Zhou, Yufan, et autres
Publié: (2023)
par: Zhou, Yufan, et autres
Publié: (2023)
SUGAR: Subject-Driven Video Customization in a Zero-Shot Manner
par: Zhou, Yufan, et autres
Publié: (2024)
par: Zhou, Yufan, et autres
Publié: (2024)
MMR: Evaluating Reading Ability of Large Multimodal Models
par: Chen, Jian, et autres
Publié: (2024)
par: Chen, Jian, et autres
Publié: (2024)
LLaVA-Read: Enhancing Reading Ability of Multimodal Language Models
par: Zhang, Ruiyi, et autres
Publié: (2024)
par: Zhang, Ruiyi, et autres
Publié: (2024)
SV-RAG: LoRA-Contextualizing Adaptation of MLLMs for Long Document Understanding
par: Chen, Jian, et autres
Publié: (2024)
par: Chen, Jian, et autres
Publié: (2024)
TRINS: Towards Multimodal Language Models that Can Read
par: Zhang, Ruiyi, et autres
Publié: (2024)
par: Zhang, Ruiyi, et autres
Publié: (2024)
DraftAttention: Fast Video Diffusion via Low-Resolution Attention Guidance
par: Shen, Xuan, et autres
Publié: (2025)
par: Shen, Xuan, et autres
Publié: (2025)
ARTIST: Improving the Generation of Text-rich Images with Disentangled Diffusion Models and Large Language Models
par: Zhang, Jianyi, et autres
Publié: (2024)
par: Zhang, Jianyi, et autres
Publié: (2024)
Toffee: Efficient Million-Scale Dataset Construction for Subject-Driven Text-to-Image Generation
par: Zhou, Yufan, et autres
Publié: (2024)
par: Zhou, Yufan, et autres
Publié: (2024)
LazyDiT: Lazy Learning for the Acceleration of Diffusion Transformers
par: Shen, Xuan, et autres
Publié: (2024)
par: Shen, Xuan, et autres
Publié: (2024)
LLaVAR: Enhanced Visual Instruction Tuning for Text-Rich Image Understanding
par: Zhang, Yanzhe, et autres
Publié: (2023)
par: Zhang, Yanzhe, et autres
Publié: (2023)
TextLap: Customizing Language Models for Text-to-Layout Planning
par: Chen, Jian, et autres
Publié: (2024)
par: Chen, Jian, et autres
Publié: (2024)
Multimodal LLMs as Customized Reward Models for Text-to-Image Generation
par: Zhou, Shijie, et autres
Publié: (2025)
par: Zhou, Shijie, et autres
Publié: (2025)
Towards Visual Text Grounding of Multimodal Large Language Model
par: Li, Ming, et autres
Publié: (2025)
par: Li, Ming, et autres
Publié: (2025)
Beyond Linear Approximations: A Novel Pruning Approach for Attention Matrix
par: Liang, Yingyu, et autres
Publié: (2024)
par: Liang, Yingyu, et autres
Publié: (2024)
VipAct: Visual-Perception Enhancement via Specialized VLM Agent Collaboration and Tool-use
par: Zhang, Zhehao, et autres
Publié: (2024)
par: Zhang, Zhehao, et autres
Publié: (2024)
FastCar: Cache Attentive Replay for Fast Auto-Regressive Video Generation on the Edge
par: Shen, Xuan, et autres
Publié: (2025)
par: Shen, Xuan, et autres
Publié: (2025)
Pruning Foundation Models for High Accuracy without Retraining
par: Zhao, Pu, et autres
Publié: (2024)
par: Zhao, Pu, et autres
Publié: (2024)
A Multi-LLM Debiasing Framework
par: Owens, Deonna M., et autres
Publié: (2024)
par: Owens, Deonna M., et autres
Publié: (2024)
Towards Aligned Layout Generation via Diffusion Model with Aesthetic Constraints
par: Chen, Jian, et autres
Publié: (2024)
par: Chen, Jian, et autres
Publié: (2024)
A High-Quality Text-Rich Image Instruction Tuning Dataset via Hybrid Instruction Generation
par: Zhou, Shijie, et autres
Publié: (2024)
par: Zhou, Shijie, et autres
Publié: (2024)
ImageFolder: Autoregressive Image Generation with Folded Tokens
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
MENTOR: Efficient Multimodal-Conditioned Tuning for Autoregressive Vision Generation Models
par: Zhao, Haozhe, et autres
Publié: (2025)
par: Zhao, Haozhe, et autres
Publié: (2025)
Differentially Private Attention Computation
par: Gao, Yeqi, et autres
Publié: (2023)
par: Gao, Yeqi, et autres
Publié: (2023)
Unraveling the Smoothness Properties of Diffusion Models: A Gaussian Mixture Perspective
par: Liang, Yingyu, et autres
Publié: (2024)
par: Liang, Yingyu, et autres
Publié: (2024)
SOHES: Self-supervised Open-world Hierarchical Entity Segmentation
par: Cao, Shengcao, et autres
Publié: (2024)
par: Cao, Shengcao, et autres
Publié: (2024)
QuartDepth: Post-Training Quantization for Real-Time Depth Estimation on the Edge
par: Shen, Xuan, et autres
Publié: (2025)
par: Shen, Xuan, et autres
Publié: (2025)
XQ-GAN: An Open-source Image Tokenization Framework for Autoregressive Generation
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
NutePrune: Efficient Progressive Pruning with Numerous Teachers for Large Language Models
par: Li, Shengrui, et autres
Publié: (2024)
par: Li, Shengrui, et autres
Publié: (2024)
CachePrune: Teaching LLMs What Not to Follow via KV-Cache Editing
par: Wang, Rui, et autres
Publié: (2025)
par: Wang, Rui, et autres
Publié: (2025)
HIERAMP: Coarse-to-Fine Autoregressive Amplification for Generative Dataset Distillation
par: Zhao, Lin, et autres
Publié: (2026)
par: Zhao, Lin, et autres
Publié: (2026)
Exploring Token Pruning in Vision State Space Models
par: Zhan, Zheng, et autres
Publié: (2024)
par: Zhan, Zheng, et autres
Publié: (2024)
VisR-Bench: An Empirical Study on Visual Retrieval-Augmented Generation for Multilingual Long Document Understanding
par: Chen, Jian, et autres
Publié: (2025)
par: Chen, Jian, et autres
Publié: (2025)
DocSynthv2: A Practical Autoregressive Modeling for Document Generation
par: Biswas, Sanket, et autres
Publié: (2024)
par: Biswas, Sanket, et autres
Publié: (2024)
Simple KNN-Based Outlier Detection Achieves Robust Clustering
par: Jiang, Tianle, et autres
Publié: (2026)
par: Jiang, Tianle, et autres
Publié: (2026)
Looped ReLU MLPs May Be All You Need as Practical Programmable Computers
par: Liang, Yingyu, et autres
Publié: (2024)
par: Liang, Yingyu, et autres
Publié: (2024)
Multi-Layer Transformers Gradient Can be Approximated in Almost Linear Time
par: Liang, Yingyu, et autres
Publié: (2024)
par: Liang, Yingyu, et autres
Publié: (2024)
Toward Adaptive Large Language Models Structured Pruning via Hybrid-grained Weight Importance Assessment
par: Liu, Jun, et autres
Publié: (2024)
par: Liu, Jun, et autres
Publié: (2024)
Towards Building the Federated GPT: Federated Instruction Tuning
par: Zhang, Jianyi, et autres
Publié: (2023)
par: Zhang, Jianyi, et autres
Publié: (2023)
Documents similaires
-
Efficient Reasoning with Hidden Thinking
par: Shen, Xuan, et autres
Publié: (2025) -
Customization Assistant for Text-to-image Generation
par: Zhou, Yufan, et autres
Publié: (2023) -
SUGAR: Subject-Driven Video Customization in a Zero-Shot Manner
par: Zhou, Yufan, et autres
Publié: (2024) -
MMR: Evaluating Reading Ability of Large Multimodal Models
par: Chen, Jian, et autres
Publié: (2024) -
LLaVA-Read: Enhancing Reading Ability of Multimodal Language Models
par: Zhang, Ruiyi, et autres
Publié: (2024)