Fisher-aware Quantization for DETR Detectors with Critical-category Objectives
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Huanrui, Huang, Yafeng, Dong, Zhen, Gudovskiy, Denis A, Okuno, Tomoyuki, Nakata, Yohei, Du, Yuan, Keutzer, Kurt, Zhang, Shanghang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Split-Ensemble: Efficient OOD-aware Ensemble via Task and Model Splitting
por: Chen, Anthony, et al.
Publicado: (2023)
por: Chen, Anthony, et al.
Publicado: (2023)
ODE$_t$(ODE$_l$): Shortcutting the Time and the Length in Diffusion and Flow Models for Faster Sampling
por: Gudovskiy, Denis, et al.
Publicado: (2025)
por: Gudovskiy, Denis, et al.
Publicado: (2025)
VeCAF: Vision-language Collaborative Active Finetuning with Training Objective Awareness
por: Zhang, Rongyu, et al.
Publicado: (2024)
por: Zhang, Rongyu, et al.
Publicado: (2024)
ContextFlow++: Generalist-Specialist Flow-based Generative Models with Mixed-Variable Context Encoding
por: Gudovskiy, Denis, et al.
Publicado: (2024)
por: Gudovskiy, Denis, et al.
Publicado: (2024)
DFM: Interpolant-free Dual Flow Matching
por: Gudovskiy, Denis, et al.
Publicado: (2024)
por: Gudovskiy, Denis, et al.
Publicado: (2024)
Proxy3D: Efficient 3D Representations for Vision-Language Models via Semantic Clustering and Alignment
por: Jiang, Jerry, et al.
Publicado: (2026)
por: Jiang, Jerry, et al.
Publicado: (2026)
SparseVLM: Visual Token Sparsification for Efficient Vision-Language Model Inference
por: Zhang, Yuan, et al.
Publicado: (2024)
por: Zhang, Yuan, et al.
Publicado: (2024)
MoBiQuant: Mixture-of-Bits Quantization for Token-Adaptive Any-Precision LLM
por: Wang, Dongwei, et al.
Publicado: (2026)
por: Wang, Dongwei, et al.
Publicado: (2026)
FactorLLM: Factorizing Knowledge via Mixture of Experts for Large Language Models
por: Zhao, Zhongyu, et al.
Publicado: (2024)
por: Zhao, Zhongyu, et al.
Publicado: (2024)
DQRM: Deep Quantized Recommendation Models
por: Zhou, Yang, et al.
Publicado: (2024)
por: Zhou, Yang, et al.
Publicado: (2024)
T-REX: Mixture-of-Rank-One-Experts with Semantic-aware Intuition for Multi-task Large Language Model Finetuning
por: Zhang, Rongyu, et al.
Publicado: (2024)
por: Zhang, Rongyu, et al.
Publicado: (2024)
QFT: Quantized Full-parameter Tuning of LLMs with Affordable Resources
por: Li, Zhikai, et al.
Publicado: (2023)
por: Li, Zhikai, et al.
Publicado: (2023)
SQAP-VLA: A Synergistic Quantization-Aware Pruning Framework for High-Performance Vision-Language-Action Models
por: Fang, Hengyu, et al.
Publicado: (2025)
por: Fang, Hengyu, et al.
Publicado: (2025)
Taming Sensitive Weights : Noise Perturbation Fine-tuning for Robust LLM Quantization
por: Wang, Dongwei, et al.
Publicado: (2024)
por: Wang, Dongwei, et al.
Publicado: (2024)
Magic-Me: Identity-Specific Video Customized Diffusion
por: Ma, Ze, et al.
Publicado: (2024)
por: Ma, Ze, et al.
Publicado: (2024)
SqueezeLLM: Dense-and-Sparse Quantization
por: Kim, Sehoon, et al.
Publicado: (2023)
por: Kim, Sehoon, et al.
Publicado: (2023)
Segment Any Motion in Videos
por: Huang, Nan, et al.
Publicado: (2025)
por: Huang, Nan, et al.
Publicado: (2025)
MITRA: A Large-Scale Parallel Corpus and Multilingual Pretrained Language Model for Machine Translation and Semantic Retrieval for Pāli, Sanskrit, Buddhist Chinese, and Tibetan
por: Nehrdich, Sebastian, et al.
Publicado: (2026)
por: Nehrdich, Sebastian, et al.
Publicado: (2026)
Caries DETR: Tooth Structure-aware Prior and Lesion-aware Dynamic Loss Refinement for DETR Based Caries Detection
por: Liu, Xuefen, et al.
Publicado: (2026)
por: Liu, Xuefen, et al.
Publicado: (2026)
Sharpness-diversity tradeoff: improving flat ensembles with SharpBalance
por: Lu, Haiquan, et al.
Publicado: (2024)
por: Lu, Haiquan, et al.
Publicado: (2024)
BASE-Q: Bias and Asymmetric Scaling Enhanced Rotational Quantization for Large Language Models
por: He, Liulu, et al.
Publicado: (2025)
por: He, Liulu, et al.
Publicado: (2025)
SEED: Targeted Data Selection by Weighted Independent Set
por: Zhang, Yuan, et al.
Publicado: (2026)
por: Zhang, Yuan, et al.
Publicado: (2026)
Stochastic Communication Avoidance for Recommendation Systems
por: Erdogan, Lutfi Eren, et al.
Publicado: (2024)
por: Erdogan, Lutfi Eren, et al.
Publicado: (2024)
UAV-DETR: DETR for Anti-Drone Target Detection
por: Yang, Jun, et al.
Publicado: (2026)
por: Yang, Jun, et al.
Publicado: (2026)
$\textit{S}^3$Gaussian: Self-Supervised Street Gaussians for Autonomous Driving
por: Huang, Nan, et al.
Publicado: (2024)
por: Huang, Nan, et al.
Publicado: (2024)
UniDrive: Towards Universal Driving Perception Across Camera Configurations
por: Li, Ye, et al.
Publicado: (2024)
por: Li, Ye, et al.
Publicado: (2024)
One Model is All You Need: ByT5-Sanskrit, a Unified Model for Sanskrit NLP Tasks
por: Nehrdich, Sebastian, et al.
Publicado: (2024)
por: Nehrdich, Sebastian, et al.
Publicado: (2024)
Simple and Effective Input Reformulations for Translation
por: Yu, Brian, et al.
Publicado: (2023)
por: Yu, Brian, et al.
Publicado: (2023)
An Uncertainty-aware DETR Enhancement Framework for Object Detection
por: Chen, Xingshu, et al.
Publicado: (2025)
por: Chen, Xingshu, et al.
Publicado: (2025)
UFO-DETR: Frequency-Guided End-to-End Detector for UAV Tiny Objects
por: Chen, Yuankai, et al.
Publicado: (2026)
por: Chen, Yuankai, et al.
Publicado: (2026)
GeoDrive: 3D Geometry-Informed Driving World Model with Precise Action Control
por: Chen, Anthony, et al.
Publicado: (2025)
por: Chen, Anthony, et al.
Publicado: (2025)
Decomposing the Neurons: Activation Sparsity via Mixture of Experts for Continual Test Time Adaptation
por: Zhang, Rongyu, et al.
Publicado: (2024)
por: Zhang, Rongyu, et al.
Publicado: (2024)
MoASE++: Mixture of Activation Sparsity Experts with Domain-Adaptive On-policy Distillation for Continual Test Time Adaptation
por: Zhang, Ronyu, et al.
Publicado: (2026)
por: Zhang, Ronyu, et al.
Publicado: (2026)
DQ-DETR: DETR with Dynamic Query for Tiny Object Detection
por: Huang, Yi-Xin, et al.
Publicado: (2024)
por: Huang, Yi-Xin, et al.
Publicado: (2024)
FGMP: Fine-Grained Mixed-Precision Weight and Activation Quantization for Hardware-Accelerated LLM Inference
por: Hooper, Coleman, et al.
Publicado: (2025)
por: Hooper, Coleman, et al.
Publicado: (2025)
Criticality Leveraged Adversarial Training (CLAT) for Boosted Performance via Parameter Efficiency
por: Gopal, Bhavna, et al.
Publicado: (2024)
por: Gopal, Bhavna, et al.
Publicado: (2024)
EPIM: Efficient Processing-In-Memory Accelerators based on Epitome
por: Wang, Chenyu, et al.
Publicado: (2023)
por: Wang, Chenyu, et al.
Publicado: (2023)
D$^3$R-DETR: DETR with Dual-Domain Density Refinement for Tiny Object Detection in Aerial Images
por: Wen, Zixiao, et al.
Publicado: (2026)
por: Wen, Zixiao, et al.
Publicado: (2026)
RT-DETR++ for UAV Object Detection
por: Shufang, Yuan
Publicado: (2025)
por: Shufang, Yuan
Publicado: (2025)
WAVE-DETR Multi-Modal Visible and Acoustic Real-Life Drone Detector
por: Stefanescu, Razvan, et al.
Publicado: (2025)
por: Stefanescu, Razvan, et al.
Publicado: (2025)
Ejemplares similares
-
Split-Ensemble: Efficient OOD-aware Ensemble via Task and Model Splitting
por: Chen, Anthony, et al.
Publicado: (2023) -
ODE$_t$(ODE$_l$): Shortcutting the Time and the Length in Diffusion and Flow Models for Faster Sampling
por: Gudovskiy, Denis, et al.
Publicado: (2025) -
VeCAF: Vision-language Collaborative Active Finetuning with Training Objective Awareness
por: Zhang, Rongyu, et al.
Publicado: (2024) -
ContextFlow++: Generalist-Specialist Flow-based Generative Models with Mixed-Variable Context Encoding
por: Gudovskiy, Denis, et al.
Publicado: (2024) -
DFM: Interpolant-free Dual Flow Matching
por: Gudovskiy, Denis, et al.
Publicado: (2024)