Dynamic Proxy Domain Generalizes the Crowd Localization by Better Binary Segmentation
Fuente:
arXiv
Guardado en:
| Autores principales: | Gao, Junyu, Zhang, Da, Wang, Qiyu, Zhao, Zhiyuan, Li, Xuelong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FGAseg: Fine-Grained Pixel-Text Alignment for Open-Vocabulary Semantic Segmentation
por: Li, Bingyu, et al.
Publicado: (2025)
por: Li, Bingyu, et al.
Publicado: (2025)
U3M: Unbiased Multiscale Modal Fusion Model for Multimodal Semantic Segmentation
por: Li, Bingyu, et al.
Publicado: (2024)
por: Li, Bingyu, et al.
Publicado: (2024)
Prototype-Based Low Altitude UAV Semantic Segmentation
por: Zhang, Da, et al.
Publicado: (2026)
por: Zhang, Da, et al.
Publicado: (2026)
MARIS: Marine Open-Vocabulary Instance Segmentation with Geometric Enhancement and Semantic Alignment
por: Li, Bingyu, et al.
Publicado: (2025)
por: Li, Bingyu, et al.
Publicado: (2025)
StitchFusion: Weaving Any Visual Modalities to Enhance Multimodal Semantic Segmentation
por: Li, Bingyu, et al.
Publicado: (2024)
por: Li, Bingyu, et al.
Publicado: (2024)
Exploring Efficient Open-Vocabulary Segmentation in the Remote Sensing
por: Li, Bingyu, et al.
Publicado: (2025)
por: Li, Bingyu, et al.
Publicado: (2025)
Exploring the Underwater World Segmentation without Extra Training
por: Li, Bingyu, et al.
Publicado: (2025)
por: Li, Bingyu, et al.
Publicado: (2025)
An Open-Source Benchmark and Baseline for Multi-temporal Referring Segmentation
por: Li, Bingyu, et al.
Publicado: (2026)
por: Li, Bingyu, et al.
Publicado: (2026)
Towards Realistic Open-Vocabulary Remote Sensing Segmentation: Benchmark and Baseline
por: Li, Bingyu, et al.
Publicado: (2026)
por: Li, Bingyu, et al.
Publicado: (2026)
UWBench: A Comprehensive Vision-Language Benchmark for Underwater Understanding
por: Zhang, Da, et al.
Publicado: (2025)
por: Zhang, Da, et al.
Publicado: (2025)
SVGen: Interpretable Vector Graphics Generation with Large Language Models
por: Wang, Feiyu, et al.
Publicado: (2025)
por: Wang, Feiyu, et al.
Publicado: (2025)
NWPU-MOC: A Benchmark for Fine-grained Multi-category Object Counting in Aerial Images
por: Gao, Junyu, et al.
Publicado: (2024)
por: Gao, Junyu, et al.
Publicado: (2024)
Boosting Quantitive and Spatial Awareness for Zero-Shot Object Counting
por: Zhang, Da, et al.
Publicado: (2026)
por: Zhang, Da, et al.
Publicado: (2026)
IntroSVG: Learning from Rendering Feedback for Text-to-SVG Generation via an Introspective Generator-Critic Framework
por: Wang, Feiyu, et al.
Publicado: (2026)
por: Wang, Feiyu, et al.
Publicado: (2026)
Do MLLMs Really See It: Reinforcing Visual Attention in Multimodal LLMs
por: Ou, Siqu, et al.
Publicado: (2026)
por: Ou, Siqu, et al.
Publicado: (2026)
Exploring Scale Shift in Crowd Localization under the Context of Domain Generalization
por: Wang, Juncheng, et al.
Publicado: (2025)
por: Wang, Juncheng, et al.
Publicado: (2025)
Real-Time Crowd Counting for Embedded Systems with Lightweight Architecture
por: Zhao, Zhiyuan, et al.
Publicado: (2025)
por: Zhao, Zhiyuan, et al.
Publicado: (2025)
One-Shot Crowd Counting With Density Guidance For Scene Adaptation
por: Chen, Jiwei, et al.
Publicado: (2026)
por: Chen, Jiwei, et al.
Publicado: (2026)
Single Domain Generalization for Crowd Counting
por: Peng, Zhuoxuan, et al.
Publicado: (2024)
por: Peng, Zhuoxuan, et al.
Publicado: (2024)
From Captions to Rewards (CAREVL): Leveraging Large Language Model Experts for Enhanced Reward Modeling in Large Vision-Language Models
por: Dai, Muzhi, et al.
Publicado: (2025)
por: Dai, Muzhi, et al.
Publicado: (2025)
ProxyCLIP: Proxy Attention Improves CLIP for Open-Vocabulary Segmentation
por: Lan, Mengcheng, et al.
Publicado: (2024)
por: Lan, Mengcheng, et al.
Publicado: (2024)
Embedding Generalized Semantic Knowledge into Few-Shot Remote Sensing Segmentation
por: Jia, Yuyu, et al.
Publicado: (2024)
por: Jia, Yuyu, et al.
Publicado: (2024)
Quantum-inspired Interpretable Deep Learning Architecture for Text Sentiment Analysis
por: Li, Bingyu, et al.
Publicado: (2024)
por: Li, Bingyu, et al.
Publicado: (2024)
Granular Ball Guided Stable Latent Domain Discovery for Domain-General Crowd Counting
por: Chen, Fan, et al.
Publicado: (2026)
por: Chen, Fan, et al.
Publicado: (2026)
DiffProxy: Multi-View Human Mesh Recovery via Diffusion-Generated Dense Proxies
por: Wang, Renke, et al.
Publicado: (2026)
por: Wang, Renke, et al.
Publicado: (2026)
Regressor-Segmenter Mutual Prompt Learning for Crowd Counting
por: Guo, Mingyue, et al.
Publicado: (2023)
por: Guo, Mingyue, et al.
Publicado: (2023)
Proxy Denoising for Source-Free Domain Adaptation
por: Tang, Song, et al.
Publicado: (2024)
por: Tang, Song, et al.
Publicado: (2024)
Domain Game: Disentangle Anatomical Feature for Single Domain Generalized Segmentation
por: Chen, Hao, et al.
Publicado: (2024)
por: Chen, Hao, et al.
Publicado: (2024)
Boosting SAM for Cross-Domain Few-Shot Segmentation via Conditional Point Sparsification
por: Nie, Jiahao, et al.
Publicado: (2026)
por: Nie, Jiahao, et al.
Publicado: (2026)
Referring Video Object Segmentation with Cross-Modality Proxy Queries
por: Sun, Baoli, et al.
Publicado: (2025)
por: Sun, Baoli, et al.
Publicado: (2025)
Frequency Domain Nuances Mining for Visible-Infrared Person Re-identification
por: Zhang, Yukang, et al.
Publicado: (2024)
por: Zhang, Yukang, et al.
Publicado: (2024)
Towards Diverse Binary Segmentation via A Simple yet General Gated Network
por: Zhao, Xiaoqi, et al.
Publicado: (2023)
por: Zhao, Xiaoqi, et al.
Publicado: (2023)
SamLP: A Customized Segment Anything Model for License Plate Detection
por: Ding, Haoxuan, et al.
Publicado: (2024)
por: Ding, Haoxuan, et al.
Publicado: (2024)
Open-Vocabulary Domain Generalization in Urban-Scene Segmentation
por: Zhao, Dong, et al.
Publicado: (2026)
por: Zhao, Dong, et al.
Publicado: (2026)
Ranking-based Adaptive Query Generation for DETRs in Crowded Pedestrian Detection
por: Gao, Feng, et al.
Publicado: (2023)
por: Gao, Feng, et al.
Publicado: (2023)
AHAP: Reconstructing Arbitrary Humans from Arbitrary Perspectives with Geometric Priors
por: Qiao, Xiaozhen, et al.
Publicado: (2026)
por: Qiao, Xiaozhen, et al.
Publicado: (2026)
HuPrior3R: Incorporating Human Priors for Better 3D Dynamic Reconstruction from Monocular Videos
por: Xiong, Weitao, et al.
Publicado: (2025)
por: Xiong, Weitao, et al.
Publicado: (2025)
DyCrowd: Towards Dynamic Crowd Reconstruction from a Large-scene Video
por: Wen, Hao, et al.
Publicado: (2025)
por: Wen, Hao, et al.
Publicado: (2025)
M4: Multi-Proxy Multi-Gate Mixture of Experts Network for Multiple Instance Learning in Histopathology Image Analysis
por: Li, Junyu, et al.
Publicado: (2024)
por: Li, Junyu, et al.
Publicado: (2024)
DynamicTrack: Advancing Gigapixel Tracking in Crowded Scenes
por: Zhao, Yunqi, et al.
Publicado: (2024)
por: Zhao, Yunqi, et al.
Publicado: (2024)
Ejemplares similares
-
FGAseg: Fine-Grained Pixel-Text Alignment for Open-Vocabulary Semantic Segmentation
por: Li, Bingyu, et al.
Publicado: (2025) -
U3M: Unbiased Multiscale Modal Fusion Model for Multimodal Semantic Segmentation
por: Li, Bingyu, et al.
Publicado: (2024) -
Prototype-Based Low Altitude UAV Semantic Segmentation
por: Zhang, Da, et al.
Publicado: (2026) -
MARIS: Marine Open-Vocabulary Instance Segmentation with Geometric Enhancement and Semantic Alignment
por: Li, Bingyu, et al.
Publicado: (2025) -
StitchFusion: Weaving Any Visual Modalities to Enhance Multimodal Semantic Segmentation
por: Li, Bingyu, et al.
Publicado: (2024)