ZOQO: Zero-Order Quantized Optimization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bar, Noga, Giryes, Raja |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Pruning at Initialization -- A Sketching Perspective
par: Bar, Noga, et autres
Publié: (2023)
par: Bar, Noga, et autres
Publié: (2023)
Diverse Subset Selection via Norm-Based Sampling and Orthogonality
par: Bar, Noga, et autres
Publié: (2024)
par: Bar, Noga, et autres
Publié: (2024)
Multiplicative Reweighting for Robust Neural Network Optimization
par: Bar, Noga, et autres
Publié: (2021)
par: Bar, Noga, et autres
Publié: (2021)
Revisiting Glorot Initialization for Long-Range Linear Recurrences
par: Bar, Noga, et autres
Publié: (2025)
par: Bar, Noga, et autres
Publié: (2025)
Group Orthogonalization Regularization For Vision Models Adaptation and Robustness
par: Kurtz, Yoav, et autres
Publié: (2023)
par: Kurtz, Yoav, et autres
Publié: (2023)
Mamba Knockout for Unraveling Factual Information Flow
par: Endy, Nir, et autres
Publié: (2025)
par: Endy, Nir, et autres
Publié: (2025)
Bridging the Visual Gap: Fine-Tuning Multimodal Models with Knowledge-Adapted Captions
par: Yanuka, Moran, et autres
Publié: (2024)
par: Yanuka, Moran, et autres
Publié: (2024)
RaZeR: Pushing the Limits of NVFP4 Quantization with Redundant Zero Remapping
par: Chen, Yuzong, et autres
Publié: (2025)
par: Chen, Yuzong, et autres
Publié: (2025)
Training a Bilingual Language Model by Mapping Tokens onto a Shared Character Space
par: Rom, Aviad, et autres
Publié: (2024)
par: Rom, Aviad, et autres
Publié: (2024)
QJL: 1-Bit Quantized JL Transform for KV Cache Quantization with Zero Overhead
par: Zandieh, Amir, et autres
Publié: (2024)
par: Zandieh, Amir, et autres
Publié: (2024)
Optimizing Large Language Model Training Using FP4 Quantization
par: Wang, Ruizhe, et autres
Publié: (2025)
par: Wang, Ruizhe, et autres
Publié: (2025)
DINOv2 based Self Supervised Learning For Few Shot Medical Image Segmentation
par: Ayzenberg, Lev, et autres
Publié: (2024)
par: Ayzenberg, Lev, et autres
Publié: (2024)
SOUL: Unlocking the Power of Second-Order Optimization for LLM Unlearning
par: Jia, Jinghan, et autres
Publié: (2024)
par: Jia, Jinghan, et autres
Publié: (2024)
UDPM: Upsampling Diffusion Probabilistic Models
par: Abu-Hussein, Shady, et autres
Publié: (2023)
par: Abu-Hussein, Shady, et autres
Publié: (2023)
Parallel Corpora for Machine Translation in Low-resource Indic Languages: A Comprehensive Review
par: Raja, Rahul, et autres
Publié: (2025)
par: Raja, Rahul, et autres
Publié: (2025)
On-Device Fine-Tuning via Backprop-Free Zeroth-Order Optimization
par: Katti, Prabodh, et autres
Publié: (2025)
par: Katti, Prabodh, et autres
Publié: (2025)
Scaling Laws For Mixed Quantization
par: Cao, Zeyu, et autres
Publié: (2024)
par: Cao, Zeyu, et autres
Publié: (2024)
Efficient Second-Order Neural Network Optimization via Adaptive Trust Region Methods
par: Vo, James
Publié: (2024)
par: Vo, James
Publié: (2024)
Revisiting Zeroth-Order Optimization for Memory-Efficient LLM Fine-Tuning: A Benchmark
par: Zhang, Yihua, et autres
Publié: (2024)
par: Zhang, Yihua, et autres
Publié: (2024)
Low-Bit Quantization Favors Undertrained LLMs: Scaling Laws for Quantized LLMs with 100T Training Tokens
par: Ouyang, Xu, et autres
Publié: (2024)
par: Ouyang, Xu, et autres
Publié: (2024)
FUSE-ing Language Models: Zero-Shot Adapter Discovery for Prompt Optimization Across Tokenizers
par: Williams, Joshua Nathaniel, et autres
Publié: (2024)
par: Williams, Joshua Nathaniel, et autres
Publié: (2024)
Simultaneous Computation and Memory Efficient Zeroth-Order Optimizer for Fine-Tuning Large Language Models
par: Wang, Fei, et autres
Publié: (2024)
par: Wang, Fei, et autres
Publié: (2024)
Scaling Law for Quantization-Aware Training
par: Chen, Mengzhao, et autres
Publié: (2025)
par: Chen, Mengzhao, et autres
Publié: (2025)
GPTVQ: The Blessing of Dimensionality for LLM Quantization
par: van Baalen, Mart, et autres
Publié: (2024)
par: van Baalen, Mart, et autres
Publié: (2024)
SqueezeLLM: Dense-and-Sparse Quantization
par: Kim, Sehoon, et autres
Publié: (2023)
par: Kim, Sehoon, et autres
Publié: (2023)
Grouped Sequency-arranged Rotation: Optimizing Rotation Transformation for Quantization for Free
par: Choi, Euntae, et autres
Publié: (2025)
par: Choi, Euntae, et autres
Publié: (2025)
Optimize Weight Rounding via Signed Gradient Descent for the Quantization of LLMs
par: Cheng, Wenhua, et autres
Publié: (2023)
par: Cheng, Wenhua, et autres
Publié: (2023)
In-context Learning and Gradient Descent Revisited
par: Deutch, Gilad, et autres
Publié: (2023)
par: Deutch, Gilad, et autres
Publié: (2023)
Prior-Informed Zeroth-Order Optimization with Adaptive Direction Alignment for Memory-Efficient LLM Fine-Tuning
par: Jin, Feihu, et autres
Publié: (2026)
par: Jin, Feihu, et autres
Publié: (2026)
Fine-tuning Quantized Neural Networks with Zeroth-order Optimization
par: Shang, Sifeng, et autres
Publié: (2025)
par: Shang, Sifeng, et autres
Publié: (2025)
Compression Scaling Laws:Unifying Sparsity and Quantization
par: Frantar, Elias, et autres
Publié: (2025)
par: Frantar, Elias, et autres
Publié: (2025)
FlatQuant: Flatness Matters for LLM Quantization
par: Sun, Yuxuan, et autres
Publié: (2024)
par: Sun, Yuxuan, et autres
Publié: (2024)
Quantization of Large Language Models with an Overdetermined Basis
par: Merkulov, Daniil, et autres
Publié: (2024)
par: Merkulov, Daniil, et autres
Publié: (2024)
QEFT: Quantization for Efficient Fine-Tuning of LLMs
par: Lee, Changhun, et autres
Publié: (2024)
par: Lee, Changhun, et autres
Publié: (2024)
On the Importance of a Multi-Scale Calibration for Quantization
par: Son, Seungwoo, et autres
Publié: (2026)
par: Son, Seungwoo, et autres
Publié: (2026)
Robust Training of Vector Quantized Bottleneck Models
par: Łańcucki, Adrian, et autres
Publié: (2020)
par: Łańcucki, Adrian, et autres
Publié: (2020)
How Does Quantization Affect Multilingual LLMs?
par: Marchisio, Kelly, et autres
Publié: (2024)
par: Marchisio, Kelly, et autres
Publié: (2024)
FBQuant: FeedBack Quantization for Large Language Models
par: Liu, Yijiang, et autres
Publié: (2025)
par: Liu, Yijiang, et autres
Publié: (2025)
How Quantization Shapes Bias in Large Language Models
par: Marcuzzi, Federico, et autres
Publié: (2025)
par: Marcuzzi, Federico, et autres
Publié: (2025)
On the Quantization Robustness of Diffusion Language Models in Coding Benchmarks
par: Gupta, Aarav, et autres
Publié: (2026)
par: Gupta, Aarav, et autres
Publié: (2026)
Documents similaires
-
Pruning at Initialization -- A Sketching Perspective
par: Bar, Noga, et autres
Publié: (2023) -
Diverse Subset Selection via Norm-Based Sampling and Orthogonality
par: Bar, Noga, et autres
Publié: (2024) -
Multiplicative Reweighting for Robust Neural Network Optimization
par: Bar, Noga, et autres
Publié: (2021) -
Revisiting Glorot Initialization for Long-Range Linear Recurrences
par: Bar, Noga, et autres
Publié: (2025) -
Group Orthogonalization Regularization For Vision Models Adaptation and Robustness
par: Kurtz, Yoav, et autres
Publié: (2023)