Irrational Complex Rotations Empower Low-bit Optimizers
Fuente:
arXiv
Salvato in:
| Autori principali: | Tian, Zhen, Zhao, Wayne Xin, Wen, Ji-Rong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
EulerFormer: Sequential User Behavior Modeling with Complex Vector Attention
di: Tian, Zhen, et al.
Pubblicazione: (2024)
di: Tian, Zhen, et al.
Pubblicazione: (2024)
Low-rank Optimization Trajectories Modeling for LLM RLVR Acceleration
di: Chen, Zhipeng, et al.
Pubblicazione: (2026)
di: Chen, Zhipeng, et al.
Pubblicazione: (2026)
Exploring Context Window of Large Language Models via Decomposed Positional Vectors
di: Dong, Zican, et al.
Pubblicazione: (2024)
di: Dong, Zican, et al.
Pubblicazione: (2024)
Investigating the Pre-Training Dynamics of In-Context Learning: Task Recognition vs. Task Learning
di: Wang, Xiaolei, et al.
Pubblicazione: (2024)
di: Wang, Xiaolei, et al.
Pubblicazione: (2024)
OSAQ: Outlier Self-Absorption for Accurate Low-bit LLM Quantization
di: Li, Zhikai, et al.
Pubblicazione: (2026)
di: Li, Zhikai, et al.
Pubblicazione: (2026)
LoRaQ: Optimized Low Rank Approximation for 4-bit Quantization
di: Bouquet, Yann, et al.
Pubblicazione: (2026)
di: Bouquet, Yann, et al.
Pubblicazione: (2026)
Sample Complexity of Neural Policy Mirror Descent for Policy Optimization on Low-Dimensional Manifolds
di: Xu, Zhenghao, et al.
Pubblicazione: (2023)
di: Xu, Zhenghao, et al.
Pubblicazione: (2023)
Atom: Low-bit Quantization for Efficient and Accurate LLM Serving
di: Zhao, Yilong, et al.
Pubblicazione: (2023)
di: Zhao, Yilong, et al.
Pubblicazione: (2023)
SALE : Low-bit Estimation for Efficient Sparse Attention in Long-context LLM Prefilling
di: Ji, Xiaodong, et al.
Pubblicazione: (2025)
di: Ji, Xiaodong, et al.
Pubblicazione: (2025)
Degree of Irrationality: Sentiment and Implied Volatility Surface
di: Weng, Jiahao, et al.
Pubblicazione: (2024)
di: Weng, Jiahao, et al.
Pubblicazione: (2024)
CCQ: Convolutional Code for Extreme Low-bit Quantization in LLMs
di: Zhou, Zhaojing, et al.
Pubblicazione: (2025)
di: Zhou, Zhaojing, et al.
Pubblicazione: (2025)
SageBwd: A Trainable Low-bit Attention
di: Zhang, Jintao, et al.
Pubblicazione: (2026)
di: Zhang, Jintao, et al.
Pubblicazione: (2026)
DiRotQ: Rotation-Aware Quantization for 4-bit Diffusion Transformers
di: Sharify, Sayeh, et al.
Pubblicazione: (2026)
di: Sharify, Sayeh, et al.
Pubblicazione: (2026)
Stabilizing Backpropagation in 16-bit Neural Training with Modified Adam Optimizer
di: Yun, Juyoung
Pubblicazione: (2023)
di: Yun, Juyoung
Pubblicazione: (2023)
ICQuant: Index Coding enables Low-bit LLM Quantization
di: Li, Xinlin, et al.
Pubblicazione: (2025)
di: Li, Xinlin, et al.
Pubblicazione: (2025)
Towards Low-bit Communication for Tensor Parallel LLM Inference
di: Dong, Harry, et al.
Pubblicazione: (2024)
di: Dong, Harry, et al.
Pubblicazione: (2024)
Learning Universal Multi-level Market Irrationality Factors to Improve Stock Return Forecasting
di: Yang, Chen, et al.
Pubblicazione: (2025)
di: Yang, Chen, et al.
Pubblicazione: (2025)
A Black Swan Hypothesis: The Role of Human Irrationality in AI Safety
di: Lee, Hyunin, et al.
Pubblicazione: (2024)
di: Lee, Hyunin, et al.
Pubblicazione: (2024)
PRoLoRA: Partial Rotation Empowers More Parameter-Efficient LoRA
di: Wang, Sheng, et al.
Pubblicazione: (2024)
di: Wang, Sheng, et al.
Pubblicazione: (2024)
On the Low-Complexity of Fair Learning for Combinatorial Multi-Armed Bandit
di: Wu, Xiaoyi, et al.
Pubblicazione: (2025)
di: Wu, Xiaoyi, et al.
Pubblicazione: (2025)
Low-bit Model Quantization for Deep Neural Networks: A Survey
di: Liu, Kai, et al.
Pubblicazione: (2025)
di: Liu, Kai, et al.
Pubblicazione: (2025)
TeZO: Empowering the Low-Rankness on the Temporal Dimension in the Zeroth-Order Optimization for Fine-tuning LLMs
di: Sun, Yan, et al.
Pubblicazione: (2025)
di: Sun, Yan, et al.
Pubblicazione: (2025)
Rethinking Channel Dimensions to Isolate Outliers for Low-bit Weight Quantization of Large Language Models
di: Heo, Jung Hwan, et al.
Pubblicazione: (2023)
di: Heo, Jung Hwan, et al.
Pubblicazione: (2023)
More Than Irrational: Modeling Belief-Biased Agents
di: Zhu, Yifan, et al.
Pubblicazione: (2025)
di: Zhu, Yifan, et al.
Pubblicazione: (2025)
MergeMix: Optimizing Mid-Training Data Mixtures via Learnable Model Merging
di: Wang, Jiapeng, et al.
Pubblicazione: (2026)
di: Wang, Jiapeng, et al.
Pubblicazione: (2026)
ParetoQ: Improving Scaling Laws in Extremely Low-bit LLM Quantization
di: Liu, Zechun, et al.
Pubblicazione: (2025)
di: Liu, Zechun, et al.
Pubblicazione: (2025)
Unlocking Data-free Low-bit Quantization with Matrix Decomposition for KV Cache Compression
di: Liu, Peiyu, et al.
Pubblicazione: (2024)
di: Liu, Peiyu, et al.
Pubblicazione: (2024)
Regulatory DNA sequence Design with Reinforcement Learning
di: Yang, Zhao, et al.
Pubblicazione: (2025)
di: Yang, Zhao, et al.
Pubblicazione: (2025)
Interpretable Enzyme Function Prediction via Residue-Level Detection
di: Yang, Zhao, et al.
Pubblicazione: (2025)
di: Yang, Zhao, et al.
Pubblicazione: (2025)
Towards Effective Code-Integrated Reasoning
di: Bai, Fei, et al.
Pubblicazione: (2025)
di: Bai, Fei, et al.
Pubblicazione: (2025)
Sequential 1-bit Mean Estimation with Near-Optimal Sample Complexity
di: Lau, Ivan, et al.
Pubblicazione: (2025)
di: Lau, Ivan, et al.
Pubblicazione: (2025)
D$^2$Quant: Accurate Low-bit Post-Training Weight Quantization for LLMs
di: Yan, Xianglong, et al.
Pubblicazione: (2026)
di: Yan, Xianglong, et al.
Pubblicazione: (2026)
Unified Data Management and Comprehensive Performance Evaluation for Urban Spatial-Temporal Prediction [Experiment, Analysis & Benchmark]
di: Jiang, Jiawei, et al.
Pubblicazione: (2023)
di: Jiang, Jiawei, et al.
Pubblicazione: (2023)
PDFormer: Propagation Delay-Aware Dynamic Long-Range Transformer for Traffic Flow Prediction
di: Jiang, Jiawei, et al.
Pubblicazione: (2023)
di: Jiang, Jiawei, et al.
Pubblicazione: (2023)
OSCAR: Offline Spectral Covariance-Aware Rotation for 2-bit KV Cache Quantization
di: Zhou, Zhongzhu, et al.
Pubblicazione: (2026)
di: Zhou, Zhongzhu, et al.
Pubblicazione: (2026)
Optimal Transport Learning: Balancing Value Optimization and Fairness in Individualized Treatment Rules
di: Cui, Wenhai, et al.
Pubblicazione: (2025)
di: Cui, Wenhai, et al.
Pubblicazione: (2025)
Hybrid JIT-CUDA Graph Optimization for Low-Latency Large Language Model Inference
di: Yadav, Divakar Kumar, et al.
Pubblicazione: (2026)
di: Yadav, Divakar Kumar, et al.
Pubblicazione: (2026)
BitNet a4.8: 4-bit Activations for 1-bit LLMs
di: Wang, Hongyu, et al.
Pubblicazione: (2024)
di: Wang, Hongyu, et al.
Pubblicazione: (2024)
INT v.s. FP: A Comprehensive Study of Fine-Grained Low-bit Quantization Formats
di: Chen, Mengzhao, et al.
Pubblicazione: (2025)
di: Chen, Mengzhao, et al.
Pubblicazione: (2025)
2DQuant: Low-bit Post-Training Quantization for Image Super-Resolution
di: Liu, Kai, et al.
Pubblicazione: (2024)
di: Liu, Kai, et al.
Pubblicazione: (2024)
Documenti analoghi
-
EulerFormer: Sequential User Behavior Modeling with Complex Vector Attention
di: Tian, Zhen, et al.
Pubblicazione: (2024) -
Low-rank Optimization Trajectories Modeling for LLM RLVR Acceleration
di: Chen, Zhipeng, et al.
Pubblicazione: (2026) -
Exploring Context Window of Large Language Models via Decomposed Positional Vectors
di: Dong, Zican, et al.
Pubblicazione: (2024) -
Investigating the Pre-Training Dynamics of In-Context Learning: Task Recognition vs. Task Learning
di: Wang, Xiaolei, et al.
Pubblicazione: (2024) -
OSAQ: Outlier Self-Absorption for Accurate Low-bit LLM Quantization
di: Li, Zhikai, et al.
Pubblicazione: (2026)