AdaTSQ: Pushing the Pareto Frontier of Diffusion Transformers via Temporal-Sensitivity Quantization
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Shaoqiu, Ding, Zizhong, Yang, Kaicheng, Wu, Junyi, Yan, Xianglong, Li, Xi, Duan, Bingnan, Fang, Jianping, Zhang, Yulun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CLQ: Cross-Layer Guided Orthogonal-based Quantization for Diffusion Transformers
por: Liu, Kai, et al.
Publicado: (2025)
por: Liu, Kai, et al.
Publicado: (2025)
RobuQ: Pushing DiTs to W1.58A2 via Robust Activation Quantization
por: Yang, Kaicheng, et al.
Publicado: (2025)
por: Yang, Kaicheng, et al.
Publicado: (2025)
TreeQ: Pushing the Quantization Boundary of Diffusion Transformer via Tree-Structured Mixed-Precision Search
por: Yang, Kaicheng, et al.
Publicado: (2025)
por: Yang, Kaicheng, et al.
Publicado: (2025)
BiDM: Pushing the Limit of Quantization for Diffusion Models
por: Zheng, Xingyu, et al.
Publicado: (2024)
por: Zheng, Xingyu, et al.
Publicado: (2024)
DVFace: Spatio-Temporal Dual-Prior Diffusion for Video Face Restoration
por: Chen, Zheng, et al.
Publicado: (2026)
por: Chen, Zheng, et al.
Publicado: (2026)
D$^2$Quant: Accurate Low-bit Post-Training Weight Quantization for LLMs
por: Yan, Xianglong, et al.
Publicado: (2026)
por: Yan, Xianglong, et al.
Publicado: (2026)
QuantSR+: Pushing the Limit of Quantized Image Super-Resolution Networks
por: Qin, Haotong, et al.
Publicado: (2026)
por: Qin, Haotong, et al.
Publicado: (2026)
Q-DiT4SR: Exploration of Detail-Preserving Diffusion Transformer Quantization for Real-World Image Super-Resolution
por: Zhang, Xun, et al.
Publicado: (2026)
por: Zhang, Xun, et al.
Publicado: (2026)
Pushing Forward Pareto Frontiers of Proactive Agents with Behavioral Agentic Optimization
por: Yao, Yihang, et al.
Publicado: (2026)
por: Yao, Yihang, et al.
Publicado: (2026)
Quant-dLLM: Post-Training Extreme Low-Bit Quantization for Diffusion Large Language Models
por: Zhang, Tianao, et al.
Publicado: (2025)
por: Zhang, Tianao, et al.
Publicado: (2025)
PSD: Pushing the Pareto Frontier of Diffusion LLMs via Parallel Speculative Decoding
por: Sun, Shengyin, et al.
Publicado: (2026)
por: Sun, Shengyin, et al.
Publicado: (2026)
DVD-Quant: Data-free Video Diffusion Transformers Quantization
por: Li, Zhiteng, et al.
Publicado: (2025)
por: Li, Zhiteng, et al.
Publicado: (2025)
SOAR: Scale Optimization for Accurate Reconstruction in NVFP4 Quantization
por: Bao, Chengzhu, et al.
Publicado: (2026)
por: Bao, Chengzhu, et al.
Publicado: (2026)
BiLLM: Pushing the Limit of Post-Training Quantization for LLMs
por: Huang, Wei, et al.
Publicado: (2024)
por: Huang, Wei, et al.
Publicado: (2024)
PTQ4DiT: Post-training Quantization for Diffusion Transformers
por: Wu, Junyi, et al.
Publicado: (2024)
por: Wu, Junyi, et al.
Publicado: (2024)
Elastic-dLLM: Position Preserving Context Compression and Augmentation of Diffusion LLMs
por: Wu, Junyi, et al.
Publicado: (2026)
por: Wu, Junyi, et al.
Publicado: (2026)
InfVSR: Toward Consistency-Driven Streaming Generative Video Super-Resolution
por: Zhang, Ziqing, et al.
Publicado: (2025)
por: Zhang, Ziqing, et al.
Publicado: (2025)
TFMQ-DM: Temporal Feature Maintenance Quantization for Diffusion Models
por: Huang, Yushi, et al.
Publicado: (2023)
por: Huang, Yushi, et al.
Publicado: (2023)
QArtSR: Quantization via Reverse-Module and Timestep-Retraining in One-Step Diffusion based Image Super-Resolution
por: Zhu, Libo, et al.
Publicado: (2025)
por: Zhu, Libo, et al.
Publicado: (2025)
PT$^2$-LLM: Post-Training Ternarization for Large Language Models
por: Yan, Xianglong, et al.
Publicado: (2025)
por: Yan, Xianglong, et al.
Publicado: (2025)
On-Chip Hardware-Aware Quantization for Mixed Precision Neural Networks
por: Huang, Wei, et al.
Publicado: (2023)
por: Huang, Wei, et al.
Publicado: (2023)
Temporal Feature Matters: A Framework for Diffusion Model Quantization
por: Huang, Yushi, et al.
Publicado: (2024)
por: Huang, Yushi, et al.
Publicado: (2024)
Progressive Binarization with Semi-Structured Pruning for LLMs
por: Yan, Xianglong, et al.
Publicado: (2025)
por: Yan, Xianglong, et al.
Publicado: (2025)
LSGQuant: Layer-Sensitivity Guided Quantization for One-Step Diffusion Real-World Video Super-Resolution
por: Wu, Tianxing, et al.
Publicado: (2026)
por: Wu, Tianxing, et al.
Publicado: (2026)
Optimization of the Woodcock Particle Tracking Method Using Neural Network
por: Zhang, Bingnan
Publicado: (2025)
por: Zhang, Bingnan
Publicado: (2025)
Pushing Frontiers for Proteoglycans
por: Marissa L. Maciej‐Hulme
Publicado: (2026)
por: Marissa L. Maciej‐Hulme
Publicado: (2026)
AdaLog: Post-Training Quantization for Vision Transformers with Adaptive Logarithm Quantizer
por: Wu, Zhuguanyu, et al.
Publicado: (2024)
por: Wu, Zhuguanyu, et al.
Publicado: (2024)
QuantCache: Adaptive Importance-Guided Quantization with Hierarchical Latent and Layer Caching for Video Generation
por: Wu, Junyi, et al.
Publicado: (2025)
por: Wu, Junyi, et al.
Publicado: (2025)
G$^2$TR: Generation-Guided Visual Token Reduction for Separate-Encoder Unified Multimodal Models
por: Li, Junxian, et al.
Publicado: (2026)
por: Li, Junxian, et al.
Publicado: (2026)
QVGen: Pushing the Limit of Quantized Video Generative Models
por: Huang, Yushi, et al.
Publicado: (2025)
por: Huang, Yushi, et al.
Publicado: (2025)
Selective Focus: Investigating Semantics Sensitivity in Post-training Quantization for Lane Detection
por: Fan, Yunqian, et al.
Publicado: (2024)
por: Fan, Yunqian, et al.
Publicado: (2024)
An Analysis on Quantizing Diffusion Transformers
por: Yang, Yuewei, et al.
Publicado: (2024)
por: Yang, Yuewei, et al.
Publicado: (2024)
QuantSparse: Comprehensively Compressing Video Diffusion Transformer with Model Quantization and Attention Sparsification
por: Feng, Weilun, et al.
Publicado: (2025)
por: Feng, Weilun, et al.
Publicado: (2025)
The Pareto Frontier of Resilient Jet Tagging
por: Gambhir, Rikab, et al.
Publicado: (2025)
por: Gambhir, Rikab, et al.
Publicado: (2025)
The Full Pareto Frontier as Kantian Equilibria
por: Sloev, Igor, et al.
Publicado: (2026)
por: Sloev, Igor, et al.
Publicado: (2026)
Penalized Likelihood for Dyadic Network Formation Models with Degree Heterogeneity
por: Yan, Zizhong, et al.
Publicado: (2026)
por: Yan, Zizhong, et al.
Publicado: (2026)
AdaRevD: Adaptive Patch Exiting Reversible Decoder Pushes the Limit of Image Deblurring
por: Mao, Xintian, et al.
Publicado: (2024)
por: Mao, Xintian, et al.
Publicado: (2024)
MiniKV: Pushing the Limits of LLM Inference via 2-Bit Layer-Discriminative KV Cache
por: Sharma, Akshat, et al.
Publicado: (2024)
por: Sharma, Akshat, et al.
Publicado: (2024)
Pushing the Frontier on Approximate EFX Allocations
por: Amanatidis, Georgios, et al.
Publicado: (2024)
por: Amanatidis, Georgios, et al.
Publicado: (2024)
Stable-DiffCoder: Pushing the Frontier of Code Diffusion Large Language Model
por: Fan, Chenghao, et al.
Publicado: (2026)
por: Fan, Chenghao, et al.
Publicado: (2026)
Ejemplares similares
-
CLQ: Cross-Layer Guided Orthogonal-based Quantization for Diffusion Transformers
por: Liu, Kai, et al.
Publicado: (2025) -
RobuQ: Pushing DiTs to W1.58A2 via Robust Activation Quantization
por: Yang, Kaicheng, et al.
Publicado: (2025) -
TreeQ: Pushing the Quantization Boundary of Diffusion Transformer via Tree-Structured Mixed-Precision Search
por: Yang, Kaicheng, et al.
Publicado: (2025) -
BiDM: Pushing the Limit of Quantization for Diffusion Models
por: Zheng, Xingyu, et al.
Publicado: (2024) -
DVFace: Spatio-Temporal Dual-Prior Diffusion for Video Face Restoration
por: Chen, Zheng, et al.
Publicado: (2026)