QuickMerge++: Fast Token Merging with Autoregressive Prior
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Dong, Yu, Yanxuan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling
par: Liu, Dong, et autres
Publié: (2025)
par: Liu, Dong, et autres
Publié: (2025)
MergeDNA: Context-aware Genome Modeling with Dynamic Tokenization through Token Merging
par: Li, Siyuan, et autres
Publié: (2025)
par: Li, Siyuan, et autres
Publié: (2025)
Batching BPE Tokenization Merges
par: Morgan, Alexander P.
Publié: (2024)
par: Morgan, Alexander P.
Publié: (2024)
Cognitive Load Traces as Symbolic and Visual Accounts of Deep Model Cognition
par: Liu, Dong, et autres
Publié: (2025)
par: Liu, Dong, et autres
Publié: (2025)
HSGM: Hierarchical Segment-Graph Memory for Scalable Long-Text Semantics
par: Liu, Dong, et autres
Publié: (2025)
par: Liu, Dong, et autres
Publié: (2025)
CXL-SpecKV: A Disaggregated FPGA Speculative KV-Cache for Datacenter LLM Serving
par: Liu, Dong, et autres
Publié: (2025)
par: Liu, Dong, et autres
Publié: (2025)
MergeVQ: A Unified Framework for Visual Generation and Representation with Disentangled Token Merging and Quantization
par: Li, Siyuan, et autres
Publié: (2025)
par: Li, Siyuan, et autres
Publié: (2025)
Multiplex Thinking: Reasoning via Token-wise Branch-and-Merge
par: Tang, Yao, et autres
Publié: (2026)
par: Tang, Yao, et autres
Publié: (2026)
Towards Hyper-Efficient RAG Systems in VecDBs: Distributed Parallel Multi-Resolution Vector Search
par: Liu, Dong, et autres
Publié: (2025)
par: Liu, Dong, et autres
Publié: (2025)
$π$-Attention: Periodic Sparse Transformers for Efficient Long-Context Modeling
par: Liu, Dong, et autres
Publié: (2025)
par: Liu, Dong, et autres
Publié: (2025)
MIN-Merging: Merge the Important Neurons for Model Merging
par: Liang, Yunfei
Publié: (2025)
par: Liang, Yunfei
Publié: (2025)
Channel Merging: Preserving Specialization for Merged Experts
par: Zhang, Mingyang, et autres
Publié: (2024)
par: Zhang, Mingyang, et autres
Publié: (2024)
Local Representative Token Guided Merging for Text-to-Image Generation
par: Lee, Min-Jeong, et autres
Publié: (2025)
par: Lee, Min-Jeong, et autres
Publié: (2025)
Learning to Merge Tokens via Decoupled Embedding for Efficient Vision Transformers
par: Lee, Dong Hoon, et autres
Publié: (2024)
par: Lee, Dong Hoon, et autres
Publié: (2024)
RCP-Merging: Merging Long Chain-of-Thought Models with Domain-Specific Models by Considering Reasoning Capability as Prior
par: Yang, Junyao, et autres
Publié: (2025)
par: Yang, Junyao, et autres
Publié: (2025)
TinyServe: Query-Aware Cache Selection for Efficient LLM Serving
par: Liu, Dong, et autres
Publié: (2025)
par: Liu, Dong, et autres
Publié: (2025)
ToMA: Token Merge with Attention for Diffusion Models
par: Lu, Wenbo, et autres
Publié: (2025)
par: Lu, Wenbo, et autres
Publié: (2025)
Reinforced Model Merging
par: Han, Jiaqi, et autres
Publié: (2025)
par: Han, Jiaqi, et autres
Publié: (2025)
Extrapolation Merging: Keep Improving With Extrapolation and Merging
par: Lin, Yiguan, et autres
Publié: (2025)
par: Lin, Yiguan, et autres
Publié: (2025)
TMCIR: Token Merge Benefits Composed Image Retrieval
par: Wang, Chaoyang, et autres
Publié: (2025)
par: Wang, Chaoyang, et autres
Publié: (2025)
MergeIT: From Selection to Merging for Efficient Instruction Tuning
par: Cai, Hongyi, et autres
Publié: (2025)
par: Cai, Hongyi, et autres
Publié: (2025)
SuperMerge: An Approach For Gradient-Based Model Merging
par: Yang, Haoyu, et autres
Publié: (2024)
par: Yang, Haoyu, et autres
Publié: (2024)
Twin-Merging: Dynamic Integration of Modular Expertise in Model Merging
par: Lu, Zhenyi, et autres
Publié: (2024)
par: Lu, Zhenyi, et autres
Publié: (2024)
CSV-Decode: Certifiable Sub-Vocabulary Decoding for Efficient Large Language Model Inference
par: Liu, Dong, et autres
Publié: (2025)
par: Liu, Dong, et autres
Publié: (2025)
OptMerge: Unifying Multimodal LLM Capabilities and Modalities via Model Merging
par: Wei, Yongxian, et autres
Publié: (2025)
par: Wei, Yongxian, et autres
Publié: (2025)
Sens-Merging: Sensitivity-Guided Parameter Balancing for Merging Large Language Models
par: Liu, Shuqi, et autres
Publié: (2025)
par: Liu, Shuqi, et autres
Publié: (2025)
Think Big, Generate Quick: LLM-to-SLM for Fast Autoregressive Decoding
par: Bergner, Benjamin, et autres
Publié: (2024)
par: Bergner, Benjamin, et autres
Publié: (2024)
FW-Merging: Scaling Model Merging with Frank-Wolfe Optimization
par: Chen, Hao Mark, et autres
Publié: (2025)
par: Chen, Hao Mark, et autres
Publié: (2025)
PSO-Merging: Merging Models Based on Particle Swarm Optimization
par: Zhang, Kehao, et autres
Publié: (2025)
par: Zhang, Kehao, et autres
Publié: (2025)
Transport and Merge: Cross-Architecture Merging for Large Language Models
par: Cui, Chenhang, et autres
Publié: (2026)
par: Cui, Chenhang, et autres
Publié: (2026)
NegMerge: Sign-Consensual Weight Merging for Machine Unlearning
par: Kim, Hyo Seo, et autres
Publié: (2024)
par: Kim, Hyo Seo, et autres
Publié: (2024)
LED-Merging: Mitigating Safety-Utility Conflicts in Model Merging with Location-Election-Disjoint
par: Ma, Qianli, et autres
Publié: (2025)
par: Ma, Qianli, et autres
Publié: (2025)
Pruning via Merging: Compressing LLMs via Manifold Alignment Based Layer Merging
par: Liu, Deyuan, et autres
Publié: (2024)
par: Liu, Deyuan, et autres
Publié: (2024)
LoRE-Merging: Exploring Low-Rank Estimation For Large Language Model Merging
par: Liu, Zehua, et autres
Publié: (2025)
par: Liu, Zehua, et autres
Publié: (2025)
Merging Smarter, Generalizing Better: Enhancing Model Merging on OOD Data
par: Zhang, Bingjie, et autres
Publié: (2025)
par: Zhang, Bingjie, et autres
Publié: (2025)
Decom-Renorm-Merge: Model Merging on the Right Space Improves Multitasking
par: Chaichana, Yuatyong, et autres
Publié: (2025)
par: Chaichana, Yuatyong, et autres
Publié: (2025)
MergeME: Model Merging Techniques for Homogeneous and Heterogeneous MoEs
par: Zhou, Yuhang, et autres
Publié: (2025)
par: Zhou, Yuhang, et autres
Publié: (2025)
SE-Merging: A Self-Enhanced Approach for Dynamic Model Merging
par: Chen, Zijun, et autres
Publié: (2025)
par: Chen, Zijun, et autres
Publié: (2025)
SimMerge: Learning to Select Merge Operators from Similarity Signals
par: Bolton, Oliver, et autres
Publié: (2026)
par: Bolton, Oliver, et autres
Publié: (2026)
ES-Merging: Biological MLLM Merging via Embedding Space Signals
par: Lee, Wonbin, et autres
Publié: (2026)
par: Lee, Wonbin, et autres
Publié: (2026)
Documents similaires
-
SemToken: Semantic-Aware Tokenization for Efficient Long-Context Language Modeling
par: Liu, Dong, et autres
Publié: (2025) -
MergeDNA: Context-aware Genome Modeling with Dynamic Tokenization through Token Merging
par: Li, Siyuan, et autres
Publié: (2025) -
Batching BPE Tokenization Merges
par: Morgan, Alexander P.
Publié: (2024) -
Cognitive Load Traces as Symbolic and Visual Accounts of Deep Model Cognition
par: Liu, Dong, et autres
Publié: (2025) -
HSGM: Hierarchical Segment-Graph Memory for Scalable Long-Text Semantics
par: Liu, Dong, et autres
Publié: (2025)