ROCKET: Rapid Optimization via Calibration-guided Knapsack Enhanced Truncation for Efficient Model Compression
Fuente:
arXiv
Saved in:
| Main Authors: | Ali, Ammar, Mohammad, Baher, Makhov, Denis, Shopkhoev, Dmitriy, Zhussip, Magauiya, Lefkimmiatis, Stamatios |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
CoSpaDi: Compressing LLMs via Calibration-Guided Sparse Dictionary Learning
by: Makhov, Denis, et al.
Published: (2025)
by: Makhov, Denis, et al.
Published: (2025)
COMPOT: Calibration-Optimized Matrix Procrustes Orthogonalization for Transformers Compression
by: Makhov, Denis, et al.
Published: (2026)
by: Makhov, Denis, et al.
Published: (2026)
Share Your Attention: Transformer Weight Sharing via Matrix-based Dictionary Learning
by: Zhussip, Magauiya, et al.
Published: (2025)
by: Zhussip, Magauiya, et al.
Published: (2025)
Speak, Edit, Repeat: High-Fidelity Voice Editing and Zero-Shot TTS with Cross-Attentive Mamba
by: Mohammad, Baher, et al.
Published: (2025)
by: Mohammad, Baher, et al.
Published: (2025)
ReplaceMe: Network Simplification via Depth Pruning and Transformer Block Linearization
by: Shopkhoev, Dmitriy, et al.
Published: (2025)
by: Shopkhoev, Dmitriy, et al.
Published: (2025)
A Modular Conditional Diffusion Framework for Image Reconstruction
by: Zhussip, Magauiya, et al.
Published: (2024)
by: Zhussip, Magauiya, et al.
Published: (2024)
SVD-LLM V2: Optimizing Singular Value Truncation for Large Language Model Compression
by: Wang, Xin, et al.
Published: (2025)
by: Wang, Xin, et al.
Published: (2025)
GSLoc: Visual Localization with 3D Gaussian Splatting
by: Botashev, Kazii, et al.
Published: (2024)
by: Botashev, Kazii, et al.
Published: (2024)
Knapsack RL: Unlocking Exploration of LLMs via Optimizing Budget Allocation
by: Li, Ziniu, et al.
Published: (2025)
by: Li, Ziniu, et al.
Published: (2025)
Distilling the Essence: Efficient Reasoning Distillation via Sequence Truncation
by: Chen, Wei-Rui, et al.
Published: (2025)
by: Chen, Wei-Rui, et al.
Published: (2025)
CUROCKET: Optimizing ROCKET for GPU
by: Stüven, Ole, et al.
Published: (2026)
by: Stüven, Ole, et al.
Published: (2026)
SVD-LLM: Truncation-aware Singular Value Decomposition for Large Language Model Compression
by: Wang, Xin, et al.
Published: (2024)
by: Wang, Xin, et al.
Published: (2024)
Knapsack Optimization-based Schema Linking for LLM-based Text-to-SQL Generation
by: Yuan, Zheng, et al.
Published: (2025)
by: Yuan, Zheng, et al.
Published: (2025)
Defusing Logic Bombs in Symbolic Execution with LLM-Generated Ghost Code
by: Bouras, Dimitrios Stamatios, et al.
Published: (2026)
by: Bouras, Dimitrios Stamatios, et al.
Published: (2026)
Few-Shot Optimized Framework for Hallucination Detection in Resource-Limited NLP Systems
by: Hikal, Baraa, et al.
Published: (2025)
by: Hikal, Baraa, et al.
Published: (2025)
Data-Efficient Spectral Classification of Hyperspectral Data Using MiniROCKET and HDC-MiniROCKET
by: Theisen, Nick, et al.
Published: (2025)
by: Theisen, Nick, et al.
Published: (2025)
Private Language Models via Truncated Laplacian Mechanism
by: Huang, Tianhao, et al.
Published: (2024)
by: Huang, Tianhao, et al.
Published: (2024)
Optimized Quran Passage Retrieval Using an Expanded QA Dataset and Fine-Tuned Language Models
by: Basem, Mohamed, et al.
Published: (2024)
by: Basem, Mohamed, et al.
Published: (2024)
Anti-Length Shift: Dynamic Outlier Truncation for Training Efficient Reasoning Models
by: Wu, Wei, et al.
Published: (2026)
by: Wu, Wei, et al.
Published: (2026)
ERGO: Entropy-guided Resetting for Generation Optimization in Multi-turn Language Models
by: Khalid, Haziq Mohammad, et al.
Published: (2025)
by: Khalid, Haziq Mohammad, et al.
Published: (2025)
ConCISE: Confidence-guided Compression in Step-by-step Efficient Reasoning
by: Qiao, Ziqing, et al.
Published: (2025)
by: Qiao, Ziqing, et al.
Published: (2025)
CaliDrop: KV Cache Compression with Calibration
by: Su, Yi, et al.
Published: (2025)
by: Su, Yi, et al.
Published: (2025)
Extreme Compression of Large Language Models via Additive Quantization
by: Egiazarian, Vage, et al.
Published: (2024)
by: Egiazarian, Vage, et al.
Published: (2024)
HIT-ROCKET: Hadamard-vector Inner-product Transformer for ROCKET
by: Hao, Wang, et al.
Published: (2025)
by: Hao, Wang, et al.
Published: (2025)
Towards Understanding and Improving Refusal in Compressed Models via Mechanistic Interpretability
by: Chhabra, Vishnu Kabir, et al.
Published: (2025)
by: Chhabra, Vishnu Kabir, et al.
Published: (2025)
Task-agnostic Prompt Compression with Context-aware Sentence Embedding and Reward-guided Task Descriptor
by: Liskavets, Barys, et al.
Published: (2025)
by: Liskavets, Barys, et al.
Published: (2025)
Systematic Evaluation of Optimization Techniques for Long-Context Language Models
by: Ahmed, Ammar, et al.
Published: (2025)
by: Ahmed, Ammar, et al.
Published: (2025)
Markov-Enhanced Clustering for Long Document Summarization: Tackling the 'Lost in the Middle' Challenge with Large Language Models
by: Amari, Aziz, et al.
Published: (2025)
by: Amari, Aziz, et al.
Published: (2025)
Arabic Large Language Models for Medical Text Generation
by: Allam, Abdulrahman, et al.
Published: (2025)
by: Allam, Abdulrahman, et al.
Published: (2025)
Enhancing Language Model Factuality via Activation-Based Confidence Calibration and Guided Decoding
by: Liu, Xin, et al.
Published: (2024)
by: Liu, Xin, et al.
Published: (2024)
You Only Prune Once: Designing Calibration-Free Model Compression With Policy Learning
by: Sengupta, Ayan, et al.
Published: (2025)
by: Sengupta, Ayan, et al.
Published: (2025)
Enhancing and Accelerating Large Language Models via Instruction-Aware Contextual Compression
by: Hou, Haowen, et al.
Published: (2024)
by: Hou, Haowen, et al.
Published: (2024)
Ultra Memory-Efficient On-FPGA Training of Transformers via Tensor-Compressed Optimization
by: Tian, Jiayi, et al.
Published: (2025)
by: Tian, Jiayi, et al.
Published: (2025)
Position IDs Matter: An Enhanced Position Layout for Efficient Context Compression in Large Language Models
by: Zhao, Runsong, et al.
Published: (2024)
by: Zhao, Runsong, et al.
Published: (2024)
When Compression Meets Model Compression: Memory-Efficient Double Compression for Large Language Models
by: Wang, Weilan, et al.
Published: (2025)
by: Wang, Weilan, et al.
Published: (2025)
Minitron-SSM: Efficient Hybrid Language Model Compression through Group-Aware SSM Pruning
by: Taghibakhshi, Ali, et al.
Published: (2025)
by: Taghibakhshi, Ali, et al.
Published: (2025)
Fewer Truncations Improve Language Modeling
by: Ding, Hantian, et al.
Published: (2024)
by: Ding, Hantian, et al.
Published: (2024)
Advancing Retrieval-Augmented Generation for Persian: Development of Language Models, Comprehensive Benchmarks, and Best Practices for Optimization
by: Hosseinbeigi, Sara Bourbour, et al.
Published: (2025)
by: Hosseinbeigi, Sara Bourbour, et al.
Published: (2025)
Graph of Attacks with Pruning: Optimizing Stealthy Jailbreak Prompt Generation for Enhanced LLM Content Moderation
by: Schwartz, Daniel, et al.
Published: (2025)
by: Schwartz, Daniel, et al.
Published: (2025)
Ranked List Truncation for Large Language Model-based Re-Ranking
by: Meng, Chuan, et al.
Published: (2024)
by: Meng, Chuan, et al.
Published: (2024)
Similar Items
-
CoSpaDi: Compressing LLMs via Calibration-Guided Sparse Dictionary Learning
by: Makhov, Denis, et al.
Published: (2025) -
COMPOT: Calibration-Optimized Matrix Procrustes Orthogonalization for Transformers Compression
by: Makhov, Denis, et al.
Published: (2026) -
Share Your Attention: Transformer Weight Sharing via Matrix-based Dictionary Learning
by: Zhussip, Magauiya, et al.
Published: (2025) -
Speak, Edit, Repeat: High-Fidelity Voice Editing and Zero-Shot TTS with Cross-Attentive Mamba
by: Mohammad, Baher, et al.
Published: (2025) -
ReplaceMe: Network Simplification via Depth Pruning and Transformer Block Linearization
by: Shopkhoev, Dmitriy, et al.
Published: (2025)