SlideSparse: Fast and Flexible (2N-2):2N Structured Sparsity
Fuente:
arXiv
Saved in:
| Main Authors: | Shao, Hanyong, Hao, Yingbo, Song, Ting, Xia, Yan, Zhang, Di, Huang, Shaohan, Wu, Xun, Xu, Songchen, Xu, Le, Dong, Li, Chi, Zewen, Zou, Yi, Wei, Furu |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Sparse-BitNet: 1.58-bit LLMs are Naturally Friendly to Semi-Structured Sparsity
by: Zhang, Di, et al.
Published: (2026)
by: Zhang, Di, et al.
Published: (2026)
Black-Box On-Policy Distillation of Large Language Models
by: Ye, Tianzhu, et al.
Published: (2025)
by: Ye, Tianzhu, et al.
Published: (2025)
On-Policy RL with Optimal Reward Baseline
by: Hao, Yaru, et al.
Published: (2025)
by: Hao, Yaru, et al.
Published: (2025)
Reward Reasoning Model
by: Guo, Jiaxin, et al.
Published: (2025)
by: Guo, Jiaxin, et al.
Published: (2025)
The Era of Agentic Organization: Learning to Organize with Language Models
by: Chi, Zewen, et al.
Published: (2025)
by: Chi, Zewen, et al.
Published: (2025)
Towards Stable and Effective Reinforcement Learning for Mixture-of-Experts
by: Zhang, Di, et al.
Published: (2025)
by: Zhang, Di, et al.
Published: (2025)
Multimodal Large Language Model is a Human-Aligned Annotator for Text-to-Image Generation
by: Wu, Xun, et al.
Published: (2024)
by: Wu, Xun, et al.
Published: (2024)
Mixture of LoRA Experts
by: Wu, Xun, et al.
Published: (2024)
by: Wu, Xun, et al.
Published: (2024)
BitNet Distillation
by: Wu, Xun, et al.
Published: (2025)
by: Wu, Xun, et al.
Published: (2025)
Think Only When You Need with Large Hybrid-Reasoning Models
by: Jiang, Lingjie, et al.
Published: (2025)
by: Jiang, Lingjie, et al.
Published: (2025)
On-Policy Context Distillation for Language Models
by: Ye, Tianzhu, et al.
Published: (2026)
by: Ye, Tianzhu, et al.
Published: (2026)
Textual Aesthetics in Large Language Models
by: Jiang, Lingjie, et al.
Published: (2024)
by: Jiang, Lingjie, et al.
Published: (2024)
MH-MoE: Multi-Head Mixture-of-Experts
by: Huang, Shaohan, et al.
Published: (2024)
by: Huang, Shaohan, et al.
Published: (2024)
Multi-Head Mixture-of-Experts
by: Wu, Xun, et al.
Published: (2024)
by: Wu, Xun, et al.
Published: (2024)
Optimizing Prompts for Text-to-Image Generation
by: Hao, Yaru, et al.
Published: (2022)
by: Hao, Yaru, et al.
Published: (2022)
Breaking Training Bottlenecks: Effective and Stable Reinforcement Learning for Coding Models
by: Li, Zongqian, et al.
Published: (2026)
by: Li, Zongqian, et al.
Published: (2026)
Online Experiential Learning for Language Models
by: Ye, Tianzhu, et al.
Published: (2026)
by: Ye, Tianzhu, et al.
Published: (2026)
BitNet b1.58 2B4T Technical Report
by: Ma, Shuming, et al.
Published: (2025)
by: Ma, Shuming, et al.
Published: (2025)
VIBEVOICE-ASR Technical Report
by: Peng, Zhiliang, et al.
Published: (2026)
by: Peng, Zhiliang, et al.
Published: (2026)
Cascade C─C/C─N Bonding for Acetamide Synthesis from Electrocatalytic CO 2 and Nitrate Coupling on CuCo Diatomic Sites
by: Shaohan Xu, et al.
Published: (2026)
by: Shaohan Xu, et al.
Published: (2026)
Adapting Large Language Models to Domains via Reading Comprehension
by: Cheng, Daixuan, et al.
Published: (2023)
by: Cheng, Daixuan, et al.
Published: (2023)
Spatial Re-parameterization for N:M Sparsity
by: Zhang, Yuxin, et al.
Published: (2023)
by: Zhang, Yuxin, et al.
Published: (2023)
VisCodex: Unified Multimodal Code Generation via Merging Vision and Coding Models
by: Jiang, Lingjie, et al.
Published: (2025)
by: Jiang, Lingjie, et al.
Published: (2025)
Fluorinated Covalent Organic Framework Membranes Enable High‐Efficiency and Water‐Resistance CO2/N2 Separation
by: Pinyue Zhang, et al.
Published: (2025)
by: Pinyue Zhang, et al.
Published: (2025)
Thinking Augmented Pre-training
by: Wang, Liang, et al.
Published: (2025)
by: Wang, Liang, et al.
Published: (2025)
Dynamic Sparse Training with Structured Sparsity
by: Lasby, Mike, et al.
Published: (2023)
by: Lasby, Mike, et al.
Published: (2023)
Metallic Sliding Ferroelectricity in Trilayer Penta‐NiN2
by: Changsheng Hou, et al.
Published: (2025)
by: Changsheng Hou, et al.
Published: (2025)
The enumeration of odd spanning trees in graphs
by: Xu, Shaohan, et al.
Published: (2026)
by: Xu, Shaohan, et al.
Published: (2026)
On asymptotic values for the minimum number of spanning forests in simple regular graphs
by: Xu, Shaohan, et al.
Published: (2026)
by: Xu, Shaohan, et al.
Published: (2026)
Simulating Multi-Stakeholder Decision-Making with Generative Agents in Urban Planning
by: Gao, Jin, et al.
Published: (2024)
by: Gao, Jin, et al.
Published: (2024)
Characterizing the range of the complex Monge-Ampère operator
by: Liu, Songchen
Published: (2024)
by: Liu, Songchen
Published: (2024)
ELSA: Exploiting Layer-wise N:M Sparsity for Vision Transformer Acceleration
by: Huang, Ning-Chi, et al.
Published: (2024)
by: Huang, Ning-Chi, et al.
Published: (2024)
STS: Efficient Sparse Attention with Speculative Token Sparsity
by: Xu, Ceyu, et al.
Published: (2026)
by: Xu, Ceyu, et al.
Published: (2026)
Efficient Symbolic Computation via Hash Consing
by: Zhu, Bowen, et al.
Published: (2025)
by: Zhu, Bowen, et al.
Published: (2025)
$Se^2$: Sequential Example Selection for In-Context Learning
by: Liu, Haoyu, et al.
Published: (2024)
by: Liu, Haoyu, et al.
Published: (2024)
Structural Regulation of a Multi‐Component Co2P2O7‐MoN/NC Electrocatalyst for Efficient Oxygen Evolution Reaction
by: Man Jin, et al.
Published: (2024)
by: Man Jin, et al.
Published: (2024)
Disordered $\mathcal{N} = (2, 2)$ Supersymmetric Field Theories
by: Chang, Chi-Ming, et al.
Published: (2023)
by: Chang, Chi-Ming, et al.
Published: (2023)
Sparsity via Sparse Group $k$-max Regularization
by: Tao, Qinghua, et al.
Published: (2024)
by: Tao, Qinghua, et al.
Published: (2024)
Universal YOCO for Efficient Depth Scaling
by: Sun, Yutao, et al.
Published: (2026)
by: Sun, Yutao, et al.
Published: (2026)
Kosmos-G: Generating Images in Context with Multimodal Large Language Models
by: Pan, Xichen, et al.
Published: (2023)
by: Pan, Xichen, et al.
Published: (2023)
Similar Items
-
Sparse-BitNet: 1.58-bit LLMs are Naturally Friendly to Semi-Structured Sparsity
by: Zhang, Di, et al.
Published: (2026) -
Black-Box On-Policy Distillation of Large Language Models
by: Ye, Tianzhu, et al.
Published: (2025) -
On-Policy RL with Optimal Reward Baseline
by: Hao, Yaru, et al.
Published: (2025) -
Reward Reasoning Model
by: Guo, Jiaxin, et al.
Published: (2025) -
The Era of Agentic Organization: Learning to Organize with Language Models
by: Chi, Zewen, et al.
Published: (2025)