Efficient Multitask Dense Predictor via Binarization
Fuente:
arXiv
Salvato in:
| Autori principali: | Shang, Yuzhang, Xu, Dan, Liu, Gaowen, Kompella, Ramana Rao, Yan, Yan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Motion Marionette: Rethinking Rigid Motion Transfer via Prior Guidance
di: Wang, Haoxuan, et al.
Pubblicazione: (2025)
di: Wang, Haoxuan, et al.
Pubblicazione: (2025)
Orientation-anchored Hyper-Gaussian for 4D Reconstruction from Casual Videos
di: Wu, Junyi, et al.
Pubblicazione: (2025)
di: Wu, Junyi, et al.
Pubblicazione: (2025)
Targeted Forgetting of Image Subgroups in CLIP Models
di: Zhang, Zeliang, et al.
Pubblicazione: (2025)
di: Zhang, Zeliang, et al.
Pubblicazione: (2025)
Efficient Multimodal Dataset Distillation via Generative Models
di: Zhao, Zhenghao, et al.
Pubblicazione: (2025)
di: Zhao, Zhenghao, et al.
Pubblicazione: (2025)
Prompt Diffusion Robustifies Any-Modality Prompt Learning
di: Du, Yingjun, et al.
Pubblicazione: (2024)
di: Du, Yingjun, et al.
Pubblicazione: (2024)
Vision Verification Enhanced Fusion of VLMs for Efficient Visual Reasoning
di: Tekin, Selim Furkan, et al.
Pubblicazione: (2026)
di: Tekin, Selim Furkan, et al.
Pubblicazione: (2026)
Urban Scene Diffusion through Semantic Occupancy Map
di: Zhang, Junge, et al.
Pubblicazione: (2024)
di: Zhang, Junge, et al.
Pubblicazione: (2024)
Training-Free Semantic Segmentation via LLM-Supervision
di: Sun, Wenfang, et al.
Pubblicazione: (2024)
di: Sun, Wenfang, et al.
Pubblicazione: (2024)
SwiftNDC: Fast Neural Depth Correction for High-Fidelity 3D Reconstruction
di: Han, Kang, et al.
Pubblicazione: (2026)
di: Han, Kang, et al.
Pubblicazione: (2026)
CaO$_2$: Rectifying Inconsistencies in Diffusion-Based Dataset Distillation
di: Wang, Haoxuan, et al.
Pubblicazione: (2025)
di: Wang, Haoxuan, et al.
Pubblicazione: (2025)
GIFSplat: Generative Prior-Guided Iterative Feed-Forward 3D Gaussian Splatting from Sparse Views
di: Chen, Tianyu, et al.
Pubblicazione: (2026)
di: Chen, Tianyu, et al.
Pubblicazione: (2026)
A Neurosymbolic Agent System for Compositional Visual Reasoning
di: Xu, Yichang, et al.
Pubblicazione: (2025)
di: Xu, Yichang, et al.
Pubblicazione: (2025)
A Multi-Agent Perception-Action Alliance for Efficient Long Video Reasoning
di: Xu, Yichang, et al.
Pubblicazione: (2026)
di: Xu, Yichang, et al.
Pubblicazione: (2026)
BiDense: Binarization for Dense Prediction
di: Yin, Rui, et al.
Pubblicazione: (2024)
di: Yin, Rui, et al.
Pubblicazione: (2024)
QuEST: Low-bit Diffusion Model Quantization via Efficient Selective Finetuning
di: Wang, Haoxuan, et al.
Pubblicazione: (2024)
di: Wang, Haoxuan, et al.
Pubblicazione: (2024)
Attention-aware Inference Optimizations for Large Vision-Language Models with Memory-efficient Decoding
di: Ilhan, Fatih, et al.
Pubblicazione: (2026)
di: Ilhan, Fatih, et al.
Pubblicazione: (2026)
RayMap3R: Inference-Time RayMap for Dynamic 3D Reconstruction
di: Wang, Feiran, et al.
Pubblicazione: (2026)
di: Wang, Feiran, et al.
Pubblicazione: (2026)
Spectrally Distilled Representations Aligned with Instruction-Augmented LLMs for Satellite Imagery
di: Do, Minh Kha, et al.
Pubblicazione: (2026)
di: Do, Minh Kha, et al.
Pubblicazione: (2026)
Supplementing Missing Visions via Dialog for Scene Graph Generations
di: Zhao, Zhenghao, et al.
Pubblicazione: (2022)
di: Zhao, Zhenghao, et al.
Pubblicazione: (2022)
UnlearnCanvas: Stylized Image Dataset for Enhanced Machine Unlearning Evaluation in Diffusion Models
di: Zhang, Yihua, et al.
Pubblicazione: (2024)
di: Zhang, Yihua, et al.
Pubblicazione: (2024)
FBPT: A Fully Binary Point Transformer
di: Hou, Zhixing, et al.
Pubblicazione: (2024)
di: Hou, Zhixing, et al.
Pubblicazione: (2024)
Dataset Quantization with Active Learning based Adaptive Sampling
di: Zhao, Zhenghao, et al.
Pubblicazione: (2024)
di: Zhao, Zhenghao, et al.
Pubblicazione: (2024)
LLaVA-PruMerge: Adaptive Token Reduction for Efficient Large Multimodal Models
di: Shang, Yuzhang, et al.
Pubblicazione: (2024)
di: Shang, Yuzhang, et al.
Pubblicazione: (2024)
PTQ4DiT: Post-training Quantization for Diffusion Transformers
di: Wu, Junyi, et al.
Pubblicazione: (2024)
di: Wu, Junyi, et al.
Pubblicazione: (2024)
freePruner: A Training-free Approach for Large Multimodal Model Acceleration
di: Xu, Bingxin, et al.
Pubblicazione: (2024)
di: Xu, Bingxin, et al.
Pubblicazione: (2024)
SegVG: Transferring Object Bounding Box to Segmentation for Visual Grounding
di: Kang, Weitai, et al.
Pubblicazione: (2024)
di: Kang, Weitai, et al.
Pubblicazione: (2024)
Robin3D: Improving 3D Large Language Model via Robust Instruction Tuning
di: Kang, Weitai, et al.
Pubblicazione: (2024)
di: Kang, Weitai, et al.
Pubblicazione: (2024)
PackCache: A Training-Free Acceleration Method for Unified Autoregressive Video Generation via Compact KV-Cache
di: Li, Kunyang, et al.
Pubblicazione: (2026)
di: Li, Kunyang, et al.
Pubblicazione: (2026)
Distill Video Datasets into Images
di: Zhao, Zhenghao, et al.
Pubblicazione: (2025)
di: Zhao, Zhenghao, et al.
Pubblicazione: (2025)
Learning Streaming Video Representation via Multitask Training
di: Yan, Yibin, et al.
Pubblicazione: (2025)
di: Yan, Yibin, et al.
Pubblicazione: (2025)
BDC-Occ: Binarized Deep Convolution Unit For Binarized Occupancy Network
di: Zhang, Zongkai, et al.
Pubblicazione: (2024)
di: Zhang, Zongkai, et al.
Pubblicazione: (2024)
Online Multi-spectral Neuron Tracing
di: Duan, Bin, et al.
Pubblicazione: (2024)
di: Duan, Bin, et al.
Pubblicazione: (2024)
Enhancing Dance-to-Music Generation via Negative Conditioning Latent Diffusion Model
di: Sun, Changchang, et al.
Pubblicazione: (2025)
di: Sun, Changchang, et al.
Pubblicazione: (2025)
E-CAR: Efficient Continuous Autoregressive Image Generation via Multistage Modeling
di: Yuan, Zhihang, et al.
Pubblicazione: (2024)
di: Yuan, Zhihang, et al.
Pubblicazione: (2024)
BHViT: Binarized Hybrid Vision Transformer
di: Gao, Tian, et al.
Pubblicazione: (2025)
di: Gao, Tian, et al.
Pubblicazione: (2025)
BinaryDM: Accurate Weight Binarization for Efficient Diffusion Models
di: Zheng, Xingyu, et al.
Pubblicazione: (2024)
di: Zheng, Xingyu, et al.
Pubblicazione: (2024)
LightPure: Realtime Adversarial Image Purification for Mobile Devices Using Diffusion Models
di: Khalili, Hossein, et al.
Pubblicazione: (2024)
di: Khalili, Hossein, et al.
Pubblicazione: (2024)
BiVM: Accurate Binarized Neural Network for Efficient Video Matting
di: Qin, Haotong, et al.
Pubblicazione: (2025)
di: Qin, Haotong, et al.
Pubblicazione: (2025)
Memory Efficient Transformer Adapter for Dense Predictions
di: Zhang, Dong, et al.
Pubblicazione: (2025)
di: Zhang, Dong, et al.
Pubblicazione: (2025)
Neuromorphic Synergy for Video Binarization
di: Lin, Shijie, et al.
Pubblicazione: (2024)
di: Lin, Shijie, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Motion Marionette: Rethinking Rigid Motion Transfer via Prior Guidance
di: Wang, Haoxuan, et al.
Pubblicazione: (2025) -
Orientation-anchored Hyper-Gaussian for 4D Reconstruction from Casual Videos
di: Wu, Junyi, et al.
Pubblicazione: (2025) -
Targeted Forgetting of Image Subgroups in CLIP Models
di: Zhang, Zeliang, et al.
Pubblicazione: (2025) -
Efficient Multimodal Dataset Distillation via Generative Models
di: Zhao, Zhenghao, et al.
Pubblicazione: (2025) -
Prompt Diffusion Robustifies Any-Modality Prompt Learning
di: Du, Yingjun, et al.
Pubblicazione: (2024)