Sparse Refinement for Efficient High-Resolution Semantic Segmentation
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Zhijian, Zhang, Zhuoyang, Khaki, Samir, Yang, Shang, Tang, Haotian, Xu, Chenfeng, Keutzer, Kurt, Han, Song |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SparseVILA: Decoupling Visual Sparsity for Efficient VLM Inference
di: Khaki, Samir, et al.
Pubblicazione: (2025)
di: Khaki, Samir, et al.
Pubblicazione: (2025)
Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation
di: Yang, Shuo, et al.
Pubblicazione: (2025)
di: Yang, Shuo, et al.
Pubblicazione: (2025)
Segment Any Motion in Videos
di: Huang, Nan, et al.
Pubblicazione: (2025)
di: Huang, Nan, et al.
Pubblicazione: (2025)
A Lesson in Splats: Teacher-Guided Diffusion for 3D Gaussian Splats Generation with 2D Supervision
di: Peng, Chensheng, et al.
Pubblicazione: (2024)
di: Peng, Chensheng, et al.
Pubblicazione: (2024)
Deep Compression Autoencoder for Efficient High-Resolution Diffusion Models
di: Chen, Junyu, et al.
Pubblicazione: (2024)
di: Chen, Junyu, et al.
Pubblicazione: (2024)
Immiscible Diffusion: Accelerating Diffusion Training with Noise Assignment
di: Li, Yiheng, et al.
Pubblicazione: (2024)
di: Li, Yiheng, et al.
Pubblicazione: (2024)
Improved Immiscible Diffusion: Accelerate Diffusion Training by Reducing Its Miscibility
di: Li, Yiheng, et al.
Pubblicazione: (2025)
di: Li, Yiheng, et al.
Pubblicazione: (2025)
HallE-Control: Controlling Object Hallucination in Large Multimodal Models
di: Zhai, Bohan, et al.
Pubblicazione: (2023)
di: Zhai, Bohan, et al.
Pubblicazione: (2023)
Looking Backward: Streaming Video-to-Video Translation with Feature Banks
di: Liang, Feng, et al.
Pubblicazione: (2024)
di: Liang, Feng, et al.
Pubblicazione: (2024)
EfficientViT-SAM: Accelerated Segment Anything Model Without Accuracy Loss
di: Zhang, Zhuoyang, et al.
Pubblicazione: (2024)
di: Zhang, Zhuoyang, et al.
Pubblicazione: (2024)
Sparse VideoGen: Accelerating Video Diffusion Transformers with Spatial-Temporal Sparsity
di: Xi, Haocheng, et al.
Pubblicazione: (2025)
di: Xi, Haocheng, et al.
Pubblicazione: (2025)
2K Retrofit: Entropy-Guided Efficient Sparse Refinement for High-Resolution 3D Geometry Prediction
di: Zhang, Tianbao, et al.
Pubblicazione: (2026)
di: Zhang, Tianbao, et al.
Pubblicazione: (2026)
SANA: Efficient High-Resolution Image Synthesis with Linear Diffusion Transformers
di: Xie, Enze, et al.
Pubblicazione: (2024)
di: Xie, Enze, et al.
Pubblicazione: (2024)
Real-time High-Resolution Neural Network with Semantic Guidance for Crack Segmentation
di: Li, Yongshang, et al.
Pubblicazione: (2023)
di: Li, Yongshang, et al.
Pubblicazione: (2023)
Q-SLAM: Quadric Representations for Monocular SLAM
di: Peng, Chensheng, et al.
Pubblicazione: (2024)
di: Peng, Chensheng, et al.
Pubblicazione: (2024)
HART: Efficient Visual Generation with Hybrid Autoregressive Transformer
di: Tang, Haotian, et al.
Pubblicazione: (2024)
di: Tang, Haotian, et al.
Pubblicazione: (2024)
LMFNet: An Efficient Multimodal Fusion Approach for Semantic Segmentation in High-Resolution Remote Sensing
di: Wang, Tong, et al.
Pubblicazione: (2024)
di: Wang, Tong, et al.
Pubblicazione: (2024)
BEVFusion: Multi-Task Multi-Sensor Fusion with Unified Bird's-Eye View Representation
di: Liu, Zhijian, et al.
Pubblicazione: (2022)
di: Liu, Zhijian, et al.
Pubblicazione: (2022)
MoRe: Class Patch Attention Needs Regularization for Weakly Supervised Semantic Segmentation
di: Yang, Zhiwei, et al.
Pubblicazione: (2024)
di: Yang, Zhiwei, et al.
Pubblicazione: (2024)
Proxy3D: Efficient 3D Representations for Vision-Language Models via Semantic Clustering and Alignment
di: Jiang, Jerry, et al.
Pubblicazione: (2026)
di: Jiang, Jerry, et al.
Pubblicazione: (2026)
StreamDiffusion: A Pipeline-level Solution for Real-time Interactive Generation
di: Kodaira, Akio, et al.
Pubblicazione: (2023)
di: Kodaira, Akio, et al.
Pubblicazione: (2023)
LiSD: An Efficient Multi-Task Learning Framework for LiDAR Segmentation and Detection
di: Xu, Jiahua, et al.
Pubblicazione: (2024)
di: Xu, Jiahua, et al.
Pubblicazione: (2024)
DiCLIP: Diffusion Model Enhances CLIP's Dense Knowledge for Weakly Supervised Semantic Segmentation
di: Yang, Zhiwei, et al.
Pubblicazione: (2026)
di: Yang, Zhiwei, et al.
Pubblicazione: (2026)
DeSiRe-GS: 4D Street Gaussians for Static-Dynamic Decomposition and Surface Reconstruction for Urban Driving Scenes
di: Peng, Chensheng, et al.
Pubblicazione: (2024)
di: Peng, Chensheng, et al.
Pubblicazione: (2024)
BiCoR-Seg: Bidirectional Co-Refinement Framework for High-Resolution Remote Sensing Image Segmentation
di: Shi, Jinghao, et al.
Pubblicazione: (2025)
di: Shi, Jinghao, et al.
Pubblicazione: (2025)
Tackling Ambiguity from Perspective of Uncertainty Inference and Affinity Diversification for Weakly Supervised Semantic Segmentation
di: Yang, Zhiwei, et al.
Pubblicazione: (2024)
di: Yang, Zhiwei, et al.
Pubblicazione: (2024)
EA-ViT: Efficient Adaptation for Elastic Vision Transformer
di: Zhu, Chen, et al.
Pubblicazione: (2025)
di: Zhu, Chen, et al.
Pubblicazione: (2025)
ATOM: Attention Mixer for Efficient Dataset Distillation
di: Khaki, Samir, et al.
Pubblicazione: (2024)
di: Khaki, Samir, et al.
Pubblicazione: (2024)
UNetMamba: An Efficient UNet-Like Mamba for Semantic Segmentation of High-Resolution Remote Sensing Images
di: Zhu, Enze, et al.
Pubblicazione: (2024)
di: Zhu, Enze, et al.
Pubblicazione: (2024)
JetViT: Efficient High-Resolution Vision Transformer with Post-Training Attention Search
di: Zou, Dongyun, et al.
Pubblicazione: (2026)
di: Zou, Dongyun, et al.
Pubblicazione: (2026)
On the Effect of Image Resolution on Semantic Segmentation
di: Singh, Ritambhara, et al.
Pubblicazione: (2024)
di: Singh, Ritambhara, et al.
Pubblicazione: (2024)
Efficient Semantic Splatting for Remote Sensing Multi-view Segmentation
di: Qi, Zipeng, et al.
Pubblicazione: (2024)
di: Qi, Zipeng, et al.
Pubblicazione: (2024)
LDGNet: A Lightweight Difference Guiding Network for Remote Sensing Change Detection
di: Xu, Chenfeng
Pubblicazione: (2025)
di: Xu, Chenfeng
Pubblicazione: (2025)
Separate and Conquer: Decoupling Co-occurrence via Decomposition and Representation for Weakly Supervised Semantic Segmentation
di: Yang, Zhiwei, et al.
Pubblicazione: (2024)
di: Yang, Zhiwei, et al.
Pubblicazione: (2024)
SparseVLM: Visual Token Sparsification for Efficient Vision-Language Model Inference
di: Zhang, Yuan, et al.
Pubblicazione: (2024)
di: Zhang, Yuan, et al.
Pubblicazione: (2024)
Locality-aware Parallel Decoding for Efficient Autoregressive Image Generation
di: Zhang, Zhuoyang, et al.
Pubblicazione: (2025)
di: Zhang, Zhuoyang, et al.
Pubblicazione: (2025)
STORM: Token-Efficient Long Video Understanding for Multimodal LLMs
di: Jiang, Jindong, et al.
Pubblicazione: (2025)
di: Jiang, Jindong, et al.
Pubblicazione: (2025)
AFRDA: Attentive Feature Refinement for Domain Adaptive Semantic Segmentation
di: Khan, Md. Al-Masrur, et al.
Pubblicazione: (2025)
di: Khan, Md. Al-Masrur, et al.
Pubblicazione: (2025)
UniDrive: Towards Universal Driving Perception Across Camera Configurations
di: Li, Ye, et al.
Pubblicazione: (2024)
di: Li, Ye, et al.
Pubblicazione: (2024)
Enhancing 3D Semantic Scene Completion with a Refinement Module
di: Zhang, Dunxing, et al.
Pubblicazione: (2025)
di: Zhang, Dunxing, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SparseVILA: Decoupling Visual Sparsity for Efficient VLM Inference
di: Khaki, Samir, et al.
Pubblicazione: (2025) -
Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation
di: Yang, Shuo, et al.
Pubblicazione: (2025) -
Segment Any Motion in Videos
di: Huang, Nan, et al.
Pubblicazione: (2025) -
A Lesson in Splats: Teacher-Guided Diffusion for 3D Gaussian Splats Generation with 2D Supervision
di: Peng, Chensheng, et al.
Pubblicazione: (2024) -
Deep Compression Autoencoder for Efficient High-Resolution Diffusion Models
di: Chen, Junyu, et al.
Pubblicazione: (2024)