Trainable Bitwise Soft Quantization for Input Feature Compression
Fuente:
arXiv
Salvato in:
| Autori principali: | Schrödter, Karsten, Stenkamp, Jan, Herrmann, Nina, Gieseke, Fabian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Boosted Trees on a Diet: Compact Models for Resource-Constrained Devices
di: Herrmann, Nina, et al.
Pubblicazione: (2025)
di: Herrmann, Nina, et al.
Pubblicazione: (2025)
Send Less, Save More: Energy-Efficiency Benchmark of Embedded CNN Inference vs. Data Transmission in IoT
di: Karic, Benjamin, et al.
Pubblicazione: (2025)
di: Karic, Benjamin, et al.
Pubblicazione: (2025)
Canopy Tree Height Estimation Using Quantile Regression: Modeling and Evaluating Uncertainty in Remote Sensing
di: Schrödter, Karsten, et al.
Pubblicazione: (2026)
di: Schrödter, Karsten, et al.
Pubblicazione: (2026)
ECHOSAT: Estimating Canopy Height Over Space And Time
di: Pauls, Jan, et al.
Pubblicazione: (2026)
di: Pauls, Jan, et al.
Pubblicazione: (2026)
Projected Compression: Trainable Projection for Efficient Transformer Compression
di: Stefaniak, Maciej, et al.
Pubblicazione: (2025)
di: Stefaniak, Maciej, et al.
Pubblicazione: (2025)
Soft Quantization: Model Compression Via Weight Coupling
di: Bernstein, Daniel T., et al.
Pubblicazione: (2026)
di: Bernstein, Daniel T., et al.
Pubblicazione: (2026)
Trainable Fixed-Point Quantization for Deep Learning Acceleration on FPGAs
di: Dai, Dingyi, et al.
Pubblicazione: (2024)
di: Dai, Dingyi, et al.
Pubblicazione: (2024)
RQ-MoE: Residual Quantization via Mixture of Experts for Efficient Input-Dependent Vector Compression
di: Zhong, Zhengjia, et al.
Pubblicazione: (2026)
di: Zhong, Zhengjia, et al.
Pubblicazione: (2026)
A Trainable Optimizer
di: Wang, Ruiqi, et al.
Pubblicazione: (2025)
di: Wang, Ruiqi, et al.
Pubblicazione: (2025)
MatryoshkaKV: Adaptive KV Compression via Trainable Orthogonal Projection
di: Lin, Bokai, et al.
Pubblicazione: (2024)
di: Lin, Bokai, et al.
Pubblicazione: (2024)
Neural Image Compression with Quantization Rectifier
di: Luo, Wei, et al.
Pubblicazione: (2024)
di: Luo, Wei, et al.
Pubblicazione: (2024)
Learning Dynamics from Input-Output Data with Hamiltonian Gaussian Processes
di: Ewering, Jan-Hendrik, et al.
Pubblicazione: (2025)
di: Ewering, Jan-Hendrik, et al.
Pubblicazione: (2025)
Trainable Transformer in Transformer
di: Panigrahi, Abhishek, et al.
Pubblicazione: (2023)
di: Panigrahi, Abhishek, et al.
Pubblicazione: (2023)
Capturing Temporal Dynamics in Large-Scale Canopy Tree Height Estimation
di: Pauls, Jan, et al.
Pubblicazione: (2025)
di: Pauls, Jan, et al.
Pubblicazione: (2025)
DCSI -- An improved measure of cluster separability based on separation and connectedness
di: Gauss, Jana, et al.
Pubblicazione: (2023)
di: Gauss, Jana, et al.
Pubblicazione: (2023)
A Trainable Feature Extractor Module for Deep Neural Networks and Scanpath Classification
di: Fuhl, Wolfgang
Pubblicazione: (2024)
di: Fuhl, Wolfgang
Pubblicazione: (2024)
Survival Analysis as Imprecise Classification with Trainable Kernels
di: Konstantinov, Andrei V., et al.
Pubblicazione: (2025)
di: Konstantinov, Andrei V., et al.
Pubblicazione: (2025)
Quantization-Aware Regularizers for Deep Neural Networks Compression
di: Malchiodi, Dario, et al.
Pubblicazione: (2026)
di: Malchiodi, Dario, et al.
Pubblicazione: (2026)
Leech Lattice Vector Quantization for Efficient LLM Compression
di: van der Ouderaa, Tycho F. A., et al.
Pubblicazione: (2026)
di: van der Ouderaa, Tycho F. A., et al.
Pubblicazione: (2026)
Interestingness as an Inductive Heuristic for Future Compression Progress
di: Herrmann, Vincent, et al.
Pubblicazione: (2026)
di: Herrmann, Vincent, et al.
Pubblicazione: (2026)
Trainable Weight Averaging: Accelerating Training and Improving Generalization
di: Li, Tao, et al.
Pubblicazione: (2022)
di: Li, Tao, et al.
Pubblicazione: (2022)
Trainability issues in quantum policy gradients
di: Sequeira, André, et al.
Pubblicazione: (2024)
di: Sequeira, André, et al.
Pubblicazione: (2024)
A Trainable Centrality Framework for Modern Data
di: Vu, Minh Duc, et al.
Pubblicazione: (2025)
di: Vu, Minh Duc, et al.
Pubblicazione: (2025)
ProjQ: Project-and-Quantize for Adapter-Aware LLM Compression
di: Yu, Wneya, et al.
Pubblicazione: (2026)
di: Yu, Wneya, et al.
Pubblicazione: (2026)
One-Bit Quantization for Random Features Models
di: Akhtiamov, Danil, et al.
Pubblicazione: (2025)
di: Akhtiamov, Danil, et al.
Pubblicazione: (2025)
Compression Scaling Laws:Unifying Sparsity and Quantization
di: Frantar, Elias, et al.
Pubblicazione: (2025)
di: Frantar, Elias, et al.
Pubblicazione: (2025)
Why Do Some Inputs Break Low-Bit LLM Quantization?
di: Chang, Ting-Yun, et al.
Pubblicazione: (2025)
di: Chang, Ting-Yun, et al.
Pubblicazione: (2025)
IO-SVD: Input-Output Whitened SVD for Adaptive-Rank LLM Compression
di: Abbasi, Ali, et al.
Pubblicazione: (2026)
di: Abbasi, Ali, et al.
Pubblicazione: (2026)
Input Resolution Downsizing as a Compression Technique for Vision Deep Learning Systems
di: Morlier, Jeremy, et al.
Pubblicazione: (2025)
di: Morlier, Jeremy, et al.
Pubblicazione: (2025)
Bridging Input Feature Spaces Towards Graph Foundation Models
di: Eliasof, Moshe, et al.
Pubblicazione: (2026)
di: Eliasof, Moshe, et al.
Pubblicazione: (2026)
Maestro: Uncovering Low-Rank Structures via Trainable Decomposition
di: Horvath, Samuel, et al.
Pubblicazione: (2023)
di: Horvath, Samuel, et al.
Pubblicazione: (2023)
RAVQ-HoloNet: Rate-Adaptive Vector-Quantized Hologram Compression
di: Rafiei, Shima, et al.
Pubblicazione: (2025)
di: Rafiei, Shima, et al.
Pubblicazione: (2025)
AQUATIC-Diff: Additive Quantization for Truly Tiny Compressed Diffusion Models
di: Hasan, Adil, et al.
Pubblicazione: (2025)
di: Hasan, Adil, et al.
Pubblicazione: (2025)
Inshrinkerator: Compressing Deep Learning Training Checkpoints via Dynamic Quantization
di: Agrawal, Amey, et al.
Pubblicazione: (2023)
di: Agrawal, Amey, et al.
Pubblicazione: (2023)
Binary and Ternary Quantization Can Enhance Feature Discrimination
di: Lu, Weizhi, et al.
Pubblicazione: (2025)
di: Lu, Weizhi, et al.
Pubblicazione: (2025)
Trainability Beyond Linearity in Variational Quantum Objectives
di: Ma, Gordon, et al.
Pubblicazione: (2026)
di: Ma, Gordon, et al.
Pubblicazione: (2026)
On the Compressibility of Quantized Large Language Models
di: Mao, Yu, et al.
Pubblicazione: (2024)
di: Mao, Yu, et al.
Pubblicazione: (2024)
Hurwitz Quaternion Multiplicative Quantization for KV Cache Compression
di: Swain, Kabir, et al.
Pubblicazione: (2026)
di: Swain, Kabir, et al.
Pubblicazione: (2026)
Learning Attributed Graphlets: Predictive Graph Mining by Graphlets with Trainable Attribute
di: Shinji, Tajima, et al.
Pubblicazione: (2024)
di: Shinji, Tajima, et al.
Pubblicazione: (2024)
CARVQ: Corrective Adaptor with Group Residual Vector Quantization for LLM Embedding Compression
di: Gou, Dayin, et al.
Pubblicazione: (2025)
di: Gou, Dayin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Boosted Trees on a Diet: Compact Models for Resource-Constrained Devices
di: Herrmann, Nina, et al.
Pubblicazione: (2025) -
Send Less, Save More: Energy-Efficiency Benchmark of Embedded CNN Inference vs. Data Transmission in IoT
di: Karic, Benjamin, et al.
Pubblicazione: (2025) -
Canopy Tree Height Estimation Using Quantile Regression: Modeling and Evaluating Uncertainty in Remote Sensing
di: Schrödter, Karsten, et al.
Pubblicazione: (2026) -
ECHOSAT: Estimating Canopy Height Over Space And Time
di: Pauls, Jan, et al.
Pubblicazione: (2026) -
Projected Compression: Trainable Projection for Efficient Transformer Compression
di: Stefaniak, Maciej, et al.
Pubblicazione: (2025)