PTQAT: A Hybrid Parameter-Efficient Quantization Algorithm for 3D Perception Tasks
Fuente:
arXiv
Saved in:
| Main Authors: | Wang, Xinhao, Lin, Zhiwei, Xia, Zhongyu, Wang, Yongtao |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
QAPruner: Quantization-Aware Vision Token Pruning for Multimodal Large Language Models
by: Wang, Xinhao, et al.
Published: (2026)
by: Wang, Xinhao, et al.
Published: (2026)
HENet++: Hybrid Encoding and Multi-task Learning for 3D Perception and End-to-end Autonomous Driving
by: Xia, Zhongyu, et al.
Published: (2025)
by: Xia, Zhongyu, et al.
Published: (2025)
OpenAD: Open-World Autonomous Driving Benchmark for 3D Object Detection
by: Xia, Zhongyu, et al.
Published: (2024)
by: Xia, Zhongyu, et al.
Published: (2024)
KnowVal: A Knowledge-Augmented and Value-Guided Autonomous Driving System
by: Xia, Zhongyu, et al.
Published: (2025)
by: Xia, Zhongyu, et al.
Published: (2025)
CoLLM-NAS: Collaborative Large Language Models for Efficient Knowledge-Guided Neural Architecture Search
by: Li, Zhe, et al.
Published: (2025)
by: Li, Zhe, et al.
Published: (2025)
HENet: Hybrid Encoding for End-to-end Multi-task 3D Perception from Multi-view Cameras
by: Xia, Zhongyu, et al.
Published: (2024)
by: Xia, Zhongyu, et al.
Published: (2024)
InsFusion: Rethink Instance-level LiDAR-Camera Fusion for 3D Object Detection
by: Xia, Zhongyu, et al.
Published: (2025)
by: Xia, Zhongyu, et al.
Published: (2025)
RCBEVDet: Radar-camera Fusion in Bird's Eye View for 3D Object Detection
by: Lin, Zhiwei, et al.
Published: (2024)
by: Lin, Zhiwei, et al.
Published: (2024)
PHPQ: Pyramid Hybrid Pooling Quantization for Efficient Fine-Grained Image Retrieval
by: Zeng, Ziyun, et al.
Published: (2021)
by: Zeng, Ziyun, et al.
Published: (2021)
TriCLIP-3D: A Unified Parameter-Efficient Framework for Tri-Modal 3D Visual Grounding based on CLIP
by: Li, Fan, et al.
Published: (2025)
by: Li, Fan, et al.
Published: (2025)
GaMNet: A Hybrid Network with Gabor Fusion and NMamba for Efficient 3D Glioma Segmentation
by: Ye, Chengwei, et al.
Published: (2025)
by: Ye, Chengwei, et al.
Published: (2025)
SC3D: Label-Efficient Outdoor 3D Object Detection via Single Click Annotation
by: Xia, Qiming, et al.
Published: (2024)
by: Xia, Qiming, et al.
Published: (2024)
3DVLA: Enhancing Vision-Language-Action Models via 3D Spatial and Instance Understanding
by: Xia, Zhongyu, et al.
Published: (2026)
by: Xia, Zhongyu, et al.
Published: (2026)
Efficiently Training A Flat Neural Network Before It has been Quantizated
by: Xia, Peng, et al.
Published: (2025)
by: Xia, Peng, et al.
Published: (2025)
R4Det: 4D Radar-Camera Fusion for High-Performance 3D Object Detection
by: Xia, Zhongyu, et al.
Published: (2026)
by: Xia, Zhongyu, et al.
Published: (2026)
HQ-DiT: Efficient Diffusion Transformer with FP4 Hybrid Quantization
by: Liu, Wenxuan, et al.
Published: (2024)
by: Liu, Wenxuan, et al.
Published: (2024)
RCBEVDet++: Toward High-accuracy Radar-Camera Fusion 3D Perception Network
by: Lin, Zhiwei, et al.
Published: (2024)
by: Lin, Zhiwei, et al.
Published: (2024)
CombatVLA: An Efficient Vision-Language-Action Model for Combat Tasks in 3D Action Role-Playing Games
by: Chen, Peng, et al.
Published: (2025)
by: Chen, Peng, et al.
Published: (2025)
Towards Flexible 3D Perception: Object-Centric Occupancy Completion Augments 3D Object Detection
by: Zheng, Chaoda, et al.
Published: (2024)
by: Zheng, Chaoda, et al.
Published: (2024)
InteractMove: Text-Controlled Human-Object Interaction Generation in 3D Scenes with Movable Objects
by: Cai, Xinhao, et al.
Published: (2025)
by: Cai, Xinhao, et al.
Published: (2025)
Bidirectional Mammogram View Translation with Column-Aware and Implicit 3D Conditional Diffusion
by: Li, Xin, et al.
Published: (2025)
by: Li, Xin, et al.
Published: (2025)
Parameter-Efficient Fine-Tuning of Large Pretrained Models for Instance Segmentation Tasks
by: Baker, Nermeen Abou, et al.
Published: (2026)
by: Baker, Nermeen Abou, et al.
Published: (2026)
Ultra3D: Efficient and High-Fidelity 3D Generation with Part Attention
by: Chen, Yiwen, et al.
Published: (2025)
by: Chen, Yiwen, et al.
Published: (2025)
Perceptual Group Tokenizer: Building Perception with Iterative Grouping
by: Deng, Zhiwei, et al.
Published: (2023)
by: Deng, Zhiwei, et al.
Published: (2023)
3D MRI Image Pretraining via Controllable 2D Slice Navigation Task
by: Wang, Yu, et al.
Published: (2026)
by: Wang, Yu, et al.
Published: (2026)
EffiPerception: an Efficient Framework for Various Perception Tasks
by: Xiang, Xinhao, et al.
Published: (2024)
by: Xiang, Xinhao, et al.
Published: (2024)
Q$^2$: Quantization-Aware Gradient Balancing and Attention Alignment for Low-Bit Quantization
by: Wang, Zhaoyang, et al.
Published: (2025)
by: Wang, Zhaoyang, et al.
Published: (2025)
VL-SAM-V2: Open-World Object Detection with General and Specific Query Fusion
by: Lin, Zhiwei, et al.
Published: (2025)
by: Lin, Zhiwei, et al.
Published: (2025)
Multi-Representation Adapter with Neural Architecture Search for Efficient Range-Doppler Radar Object Detection
by: Lin, Zhiwei, et al.
Published: (2025)
by: Lin, Zhiwei, et al.
Published: (2025)
Point-PEFT: Parameter-Efficient Fine-Tuning for 3D Pre-trained Models
by: Tang, Yiwen, et al.
Published: (2023)
by: Tang, Yiwen, et al.
Published: (2023)
Advanced Sign Language Video Generation with Compressed and Quantized Multi-Condition Tokenization
by: Wang, Cong, et al.
Published: (2025)
by: Wang, Cong, et al.
Published: (2025)
Simple o3: Towards Interleaved Vision-Language Reasoning
by: Wang, Ye, et al.
Published: (2025)
by: Wang, Ye, et al.
Published: (2025)
ScaleNet: Scaling up Pretrained Neural Networks with Incremental Parameters
by: Hao, Zhiwei, et al.
Published: (2025)
by: Hao, Zhiwei, et al.
Published: (2025)
Enhanced Parking Perception by Multi-Task Fisheye Cross-view Transformers
by: Musabini, Antonyo, et al.
Published: (2024)
by: Musabini, Antonyo, et al.
Published: (2024)
Efficient Encoder-Free Fourier-based 3D Large Multimodal Model
by: Mei, Guofeng, et al.
Published: (2026)
by: Mei, Guofeng, et al.
Published: (2026)
LCV2: An Efficient Pretraining-Free Framework for Grounded Visual Question Answering
by: Chen, Yuhan, et al.
Published: (2024)
by: Chen, Yuhan, et al.
Published: (2024)
SCT: A Simple Baseline for Parameter-Efficient Fine-Tuning via Salient Channels
by: Zhao, Henry Hengyuan, et al.
Published: (2023)
by: Zhao, Henry Hengyuan, et al.
Published: (2023)
Trio-ViT: Post-Training Quantization and Acceleration for Softmax-Free Efficient Vision Transformer
by: Shi, Huihong, et al.
Published: (2024)
by: Shi, Huihong, et al.
Published: (2024)
TAP-SLF: Parameter-Efficient Adaptation of Vision Foundation Models for Multi-Task Ultrasound Image Analysis
by: Wan, Hui, et al.
Published: (2026)
by: Wan, Hui, et al.
Published: (2026)
A Parameter-Efficient Mixture-of-Experts Framework for Cross-Modal Geo-Localization
by: Li, LinFeng, et al.
Published: (2025)
by: Li, LinFeng, et al.
Published: (2025)
Similar Items
-
QAPruner: Quantization-Aware Vision Token Pruning for Multimodal Large Language Models
by: Wang, Xinhao, et al.
Published: (2026) -
HENet++: Hybrid Encoding and Multi-task Learning for 3D Perception and End-to-end Autonomous Driving
by: Xia, Zhongyu, et al.
Published: (2025) -
OpenAD: Open-World Autonomous Driving Benchmark for 3D Object Detection
by: Xia, Zhongyu, et al.
Published: (2024) -
KnowVal: A Knowledge-Augmented and Value-Guided Autonomous Driving System
by: Xia, Zhongyu, et al.
Published: (2025) -
CoLLM-NAS: Collaborative Large Language Models for Efficient Knowledge-Guided Neural Architecture Search
by: Li, Zhe, et al.
Published: (2025)