CLIP-driven rain perception: Adaptive deraining with pattern-aware network routing and mask-guided cross-attention
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Guan, Cong, Yoshie, Osamu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Gabor-guided transformer for single image deraining
par: He, Sijin, et autres
Publié: (2024)
par: He, Sijin, et autres
Publié: (2024)
DM$^3$Net: Dual-Camera Super-Resolution via Domain Modulation and Multi-scale Matching
par: Guan, Cong, et autres
Publié: (2025)
par: Guan, Cong, et autres
Publié: (2025)
Multi-Attribute guided Thermal Face Image Translation based on Latent Diffusion Model
par: Cai, Mingshu, et autres
Publié: (2025)
par: Cai, Mingshu, et autres
Publié: (2025)
CLIP-aware Domain-Adaptive Super-Resolution
par: Lu, Zhengyang, et autres
Publié: (2025)
par: Lu, Zhengyang, et autres
Publié: (2025)
Co-distilled attention guided masked image modeling with noisy teacher for self-supervised learning on medical images
par: Jiang, Jue, et autres
Publié: (2026)
par: Jiang, Jue, et autres
Publié: (2026)
Ranking-aware adapter for text-driven image ordering with CLIP
par: Yu, Wei-Hsiang, et autres
Publié: (2024)
par: Yu, Wei-Hsiang, et autres
Publié: (2024)
Text-guided multi-stage cross-perception network for medical image segmentation
par: Chen, Gaoyu, et autres
Publié: (2025)
par: Chen, Gaoyu, et autres
Publié: (2025)
Density-aware global-local attention network for point cloud segmentation
par: Li, Chade, et autres
Publié: (2024)
par: Li, Chade, et autres
Publié: (2024)
FluencyVE: Marrying Temporal-Aware Mamba with Bypass Attention for Video Editing
par: Cai, Mingshu, et autres
Publié: (2025)
par: Cai, Mingshu, et autres
Publié: (2025)
Toward Motion Robustness: A masked attention regularization framework in remote photoplethysmography
par: Zhao, Pengfei, et autres
Publié: (2024)
par: Zhao, Pengfei, et autres
Publié: (2024)
Anatomically-guided masked autoencoder pre-training for aneurysm detection
par: Ceballos-Arroyo, Alberto Mario, et autres
Publié: (2025)
par: Ceballos-Arroyo, Alberto Mario, et autres
Publié: (2025)
Mask-guided cross-image attention for zero-shot in-silico histopathologic image generation with a diffusion model
par: Winter, Dominik, et autres
Publié: (2024)
par: Winter, Dominik, et autres
Publié: (2024)
SAAN: Similarity-aware attention flow network for change detection with VHR remote sensing images
par: Guo, Haonan, et autres
Publié: (2023)
par: Guo, Haonan, et autres
Publié: (2023)
Where, What, Why: Toward Explainable 3D-GS Watermarking
par: Cai, Mingshu, et autres
Publié: (2026)
par: Cai, Mingshu, et autres
Publié: (2026)
Semantic-aware Adversarial Fine-tuning for CLIP
par: Zhang, Jiacheng, et autres
Publié: (2026)
par: Zhang, Jiacheng, et autres
Publié: (2026)
RT-X Net: RGB-Thermal cross attention network for Low-Light Image Enhancement
par: Jha, Raman, et autres
Publié: (2025)
par: Jha, Raman, et autres
Publié: (2025)
AnatoMask: Enhancing Medical Image Segmentation with Reconstruction-guided Self-masking
par: Li, Yuheng, et autres
Publié: (2024)
par: Li, Yuheng, et autres
Publié: (2024)
Fast Self-Supervised depth and mask aware Association for Multi-Object Tracking
par: Khanchi, Milad, et autres
Publié: (2025)
par: Khanchi, Milad, et autres
Publié: (2025)
Is CLIP the main roadblock for fine-grained open-world perception?
par: Bianchi, Lorenzo, et autres
Publié: (2024)
par: Bianchi, Lorenzo, et autres
Publié: (2024)
CLIP the Divergence: Language-guided Unsupervised Domain Adaptation
par: Zhu, Jinjing, et autres
Publié: (2024)
par: Zhu, Jinjing, et autres
Publié: (2024)
CLIP-guided Prototype Modulating for Few-shot Action Recognition
par: Wang, Xiang, et autres
Publié: (2023)
par: Wang, Xiang, et autres
Publié: (2023)
Weakly supervised multimodal segmentation of acoustic borehole images with depth-aware cross-attention
par: Silva, Jose Luis Lima de Jesus
Publié: (2026)
par: Silva, Jose Luis Lima de Jesus
Publié: (2026)
KGEdit: Ambiguity-Aware Knowledge Graphs for Training-Free Precise Video Generation and Editing
par: Cai, Mingshu, et autres
Publié: (2026)
par: Cai, Mingshu, et autres
Publié: (2026)
CLIP-driven Zero-shot Learning with Ambiguous Labels
par: Fan, Jinfu, et autres
Publié: (2026)
par: Fan, Jinfu, et autres
Publié: (2026)
SPACE-CLIP: Spatial Perception via Adaptive CLIP Embeddings for Monocular Depth Estimation
par: Cho, Taewan, et autres
Publié: (2026)
par: Cho, Taewan, et autres
Publié: (2026)
LaserHuman: Language-guided Scene-aware Human Motion Generation in Free Environment
par: Cong, Peishan, et autres
Publié: (2024)
par: Cong, Peishan, et autres
Publié: (2024)
Vision-guided and Mask-enhanced Adaptive Denoising for Prompt-based Image Editing
par: Wang, Kejie, et autres
Publié: (2024)
par: Wang, Kejie, et autres
Publié: (2024)
SDDNet: Style-guided Dual-layer Disentanglement Network for Shadow Detection
par: Cong, Runmin, et autres
Publié: (2023)
par: Cong, Runmin, et autres
Publié: (2023)
DiffCLIP: Few-shot Language-driven Multimodal Classifier
par: Zhang, Jiaqing, et autres
Publié: (2024)
par: Zhang, Jiaqing, et autres
Publié: (2024)
Pig behavior dataset and Spatial-temporal perception and enhancement networks based on the attention mechanism for pig behavior recognition
par: Qi, Fangzheng, et autres
Publié: (2025)
par: Qi, Fangzheng, et autres
Publié: (2025)
FALFormer: Feature-aware Landmarks self-attention for Whole-slide Image Classification
par: Bui, Doanh C., et autres
Publié: (2024)
par: Bui, Doanh C., et autres
Publié: (2024)
DWARF: Disease-weighted network for attention map refinement
par: Luo, Haozhe, et autres
Publié: (2024)
par: Luo, Haozhe, et autres
Publié: (2024)
Fused attention mechanism-based ore sorting network
par: Zhen, Junjiang, et autres
Publié: (2024)
par: Zhen, Junjiang, et autres
Publié: (2024)
Self-distilled Masked Attention guided masked image modeling with noise Regularized Teacher (SMART) for medical image analysis
par: Jiang, Jue, et autres
Publié: (2023)
par: Jiang, Jue, et autres
Publié: (2023)
Revisiting Relevance Feedback for CLIP-based Interactive Image Retrieval
par: Nara, Ryoya, et autres
Publié: (2024)
par: Nara, Ryoya, et autres
Publié: (2024)
CDAN: Convolutional dense attention-guided network for low-light image enhancement
par: Shakibania, Hossein, et autres
Publié: (2023)
par: Shakibania, Hossein, et autres
Publié: (2023)
GazeCLIP: Gaze-Guided CLIP with Adaptive-Enhanced Fine-Grained Language Prompt for Deepfake Attribution and Detection
par: Zhang, Yaning, et autres
Publié: (2026)
par: Zhang, Yaning, et autres
Publié: (2026)
CLIP-DR: Textual Knowledge-Guided Diabetic Retinopathy Grading with Ranking-aware Prompting
par: Yu, Qinkai, et autres
Publié: (2024)
par: Yu, Qinkai, et autres
Publié: (2024)
GazeLT: Visual attention-guided long-tailed disease classification in chest radiographs
par: Bhattacharya, Moinak, et autres
Publié: (2025)
par: Bhattacharya, Moinak, et autres
Publié: (2025)
GraVITON: Graph based garment warping with attention guided inversion for Virtual-tryon
par: Pathak, Sanhita, et autres
Publié: (2024)
par: Pathak, Sanhita, et autres
Publié: (2024)
Documents similaires
-
Gabor-guided transformer for single image deraining
par: He, Sijin, et autres
Publié: (2024) -
DM$^3$Net: Dual-Camera Super-Resolution via Domain Modulation and Multi-scale Matching
par: Guan, Cong, et autres
Publié: (2025) -
Multi-Attribute guided Thermal Face Image Translation based on Latent Diffusion Model
par: Cai, Mingshu, et autres
Publié: (2025) -
CLIP-aware Domain-Adaptive Super-Resolution
par: Lu, Zhengyang, et autres
Publié: (2025) -
Co-distilled attention guided masked image modeling with noisy teacher for self-supervised learning on medical images
par: Jiang, Jue, et autres
Publié: (2026)