AMNS: Attention-Weighted Selective Mask and Noise Label Suppression for Text-to-Image Person Retrieval
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Runqing, Zhou, Xue |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GEA: Generation-Enhanced Alignment for Text-to-Image Person Retrieval
di: Zou, Hao, et al.
Pubblicazione: (2025)
di: Zou, Hao, et al.
Pubblicazione: (2025)
Gradient-Attention Guided Dual-Masking Synergetic Framework for Robust Text-based Person Retrieval
di: Zheng, Tianlu, et al.
Pubblicazione: (2025)
di: Zheng, Tianlu, et al.
Pubblicazione: (2025)
Attention Calibration for Disentangled Text-to-Image Personalization
di: Zhang, Yanbing, et al.
Pubblicazione: (2024)
di: Zhang, Yanbing, et al.
Pubblicazione: (2024)
MINDiff: Mask-Integrated Negative Attention for Controlling Overfitting in Text-to-Image Personalization
di: Jeong, Seulgi, et al.
Pubblicazione: (2025)
di: Jeong, Seulgi, et al.
Pubblicazione: (2025)
Suppressing Non-Semantic Noise in Masked Image Modeling Representations
di: Hjelkrem-Tan, Martine, et al.
Pubblicazione: (2026)
di: Hjelkrem-Tan, Martine, et al.
Pubblicazione: (2026)
From Text to Mask: Localizing Entities Using the Attention of Text-to-Image Diffusion Models
di: Xiao, Changming, et al.
Pubblicazione: (2023)
di: Xiao, Changming, et al.
Pubblicazione: (2023)
Fast Personalized Text-to-Image Syntheses With Attention Injection
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
PiCo: Enhancing Text-Image Alignment with Improved Noise Selection and Precise Mask Control in Diffusion Models
di: Xie, Chang, et al.
Pubblicazione: (2025)
di: Xie, Chang, et al.
Pubblicazione: (2025)
Intrinsic Gradient Suppression for Label-Noise Prompt Tuning in Vision-Language Models
di: Li, Jiayu, et al.
Pubblicazione: (2026)
di: Li, Jiayu, et al.
Pubblicazione: (2026)
MADiff: Text-Guided Fashion Image Editing with Mask Prediction and Attention-Enhanced Diffusion
di: Zhan, Zechao, et al.
Pubblicazione: (2024)
di: Zhan, Zechao, et al.
Pubblicazione: (2024)
Efficient Adaptive Label Refinement for Label Noise Learning
di: Zhang, Wenzhen, et al.
Pubblicazione: (2025)
di: Zhang, Wenzhen, et al.
Pubblicazione: (2025)
Multilingual Text-to-Image Person Retrieval via Bidirectional Relation Reasoning and Aligning
di: Cao, Min, et al.
Pubblicazione: (2025)
di: Cao, Min, et al.
Pubblicazione: (2025)
Personalized Image Descriptions from Attention Sequences
di: Xue, Ruoyu, et al.
Pubblicazione: (2025)
di: Xue, Ruoyu, et al.
Pubblicazione: (2025)
CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis
di: Sundaram, Aravindan, et al.
Pubblicazione: (2024)
di: Sundaram, Aravindan, et al.
Pubblicazione: (2024)
Active Adversarial Noise Suppression for Image Forgery Localization
di: Peng, Rongxuan, et al.
Pubblicazione: (2025)
di: Peng, Rongxuan, et al.
Pubblicazione: (2025)
Selective Noise Suppression and Discriminative Mutual Interaction for Robust Audio-Visual Segmentation
di: Peng, Kai, et al.
Pubblicazione: (2026)
di: Peng, Kai, et al.
Pubblicazione: (2026)
Noisy Label Classification using Label Noise Selection with Test-Time Augmentation Cross-Entropy and NoiseMix Learning
di: Lee, Hansang, et al.
Pubblicazione: (2022)
di: Lee, Hansang, et al.
Pubblicazione: (2022)
Cross-view Masked Diffusion Transformers for Person Image Synthesis
di: Pham, Trung X., et al.
Pubblicazione: (2024)
di: Pham, Trung X., et al.
Pubblicazione: (2024)
Text-guided Image Restoration and Semantic Enhancement for Text-to-Image Person Retrieval
di: Liu, Delong, et al.
Pubblicazione: (2023)
di: Liu, Delong, et al.
Pubblicazione: (2023)
Cross-Modal and Uni-Modal Soft-Label Alignment for Image-Text Retrieval
di: Huang, Hailang, et al.
Pubblicazione: (2024)
di: Huang, Hailang, et al.
Pubblicazione: (2024)
UFineBench: Towards Text-based Person Retrieval with Ultra-fine Granularity
di: Zuo, Jialong, et al.
Pubblicazione: (2023)
di: Zuo, Jialong, et al.
Pubblicazione: (2023)
Linguistics-aware Masked Image Modeling for Self-supervised Scene Text Recognition
di: Zhang, Yifei, et al.
Pubblicazione: (2025)
di: Zhang, Yifei, et al.
Pubblicazione: (2025)
Robust Tiny Object Detection in Aerial Images amidst Label Noise
di: Zhu, Haoran, et al.
Pubblicazione: (2024)
di: Zhu, Haoran, et al.
Pubblicazione: (2024)
Reinforcement Learning Meets Masked Generative Models: Mask-GRPO for Text-to-Image Generation
di: Luo, Yifu, et al.
Pubblicazione: (2025)
di: Luo, Yifu, et al.
Pubblicazione: (2025)
DreamMatcher: Appearance Matching Self-Attention for Semantically-Consistent Text-to-Image Personalization
di: Nam, Jisu, et al.
Pubblicazione: (2024)
di: Nam, Jisu, et al.
Pubblicazione: (2024)
Cross-modal Full-mode Fine-grained Alignment for Text-to-Image Person Retrieval
di: Yin, Hao, et al.
Pubblicazione: (2025)
di: Yin, Hao, et al.
Pubblicazione: (2025)
Towards Robust Text-to-Image Person Retrieval: Multi-View Reformulation for Semantic Compensation
di: Yuan, Chao, et al.
Pubblicazione: (2026)
di: Yuan, Chao, et al.
Pubblicazione: (2026)
OptiPrune: Boosting Prompt-Image Consistency with Attention-Guided Noise and Dynamic Token Selection
di: Lu, Ziji
Pubblicazione: (2025)
di: Lu, Ziji
Pubblicazione: (2025)
TVPR: Text-to-Video Person Retrieval and a New Benchmark
di: Zhang, Xu, et al.
Pubblicazione: (2023)
di: Zhang, Xu, et al.
Pubblicazione: (2023)
Text-based Aerial-Ground Person Retrieval
di: Zhou, Xinyu, et al.
Pubblicazione: (2025)
di: Zhou, Xinyu, et al.
Pubblicazione: (2025)
Small Target Detection Based on Mask-Enhanced Attention Fusion of Visible and Infrared Remote Sensing Images
di: Zhang, Qianqian, et al.
Pubblicazione: (2026)
di: Zhang, Qianqian, et al.
Pubblicazione: (2026)
TextDiff: Mask-Guided Residual Diffusion Models for Scene Text Image Super-Resolution
di: Liu, Baolin, et al.
Pubblicazione: (2023)
di: Liu, Baolin, et al.
Pubblicazione: (2023)
Relational Contrastive Learning and Masked Image Modeling for Scene Text Recognition
di: Lin, Tiancheng, et al.
Pubblicazione: (2024)
di: Lin, Tiancheng, et al.
Pubblicazione: (2024)
Mask-aware Text-to-Image Retrieval: Referring Expression Segmentation Meets Cross-modal Retrieval
di: Shen, Li-Cheng, et al.
Pubblicazione: (2025)
di: Shen, Li-Cheng, et al.
Pubblicazione: (2025)
Combating Label Noise With A General Surrogate Model For Sample Selection
di: Liang, Chao, et al.
Pubblicazione: (2023)
di: Liang, Chao, et al.
Pubblicazione: (2023)
Image-Text-Image Knowledge Transfer for Lifelong Person Re-Identification with Hybrid Clothing States
di: Wang, Qizao, et al.
Pubblicazione: (2024)
di: Wang, Qizao, et al.
Pubblicazione: (2024)
$Δ$-AttnMask: Attention-Guided Masked Hidden States for Efficient Data Selection and Augmentation
di: Hu, Jucheng, et al.
Pubblicazione: (2025)
di: Hu, Jucheng, et al.
Pubblicazione: (2025)
SA-Person: Text-Based Person Retrieval with Scene-aware Re-ranking
di: Xu, Yingjia, et al.
Pubblicazione: (2025)
di: Xu, Yingjia, et al.
Pubblicazione: (2025)
Multi-Label Logo Recognition and Retrieval based on Weighted Fusion of Neural Features
di: Bernabeu, Marisa, et al.
Pubblicazione: (2022)
di: Bernabeu, Marisa, et al.
Pubblicazione: (2022)
Selectively Informative Description can Reduce Undesired Embedding Entanglements in Text-to-Image Personalization
di: Kim, Jimyeong, et al.
Pubblicazione: (2024)
di: Kim, Jimyeong, et al.
Pubblicazione: (2024)
Documenti analoghi
-
GEA: Generation-Enhanced Alignment for Text-to-Image Person Retrieval
di: Zou, Hao, et al.
Pubblicazione: (2025) -
Gradient-Attention Guided Dual-Masking Synergetic Framework for Robust Text-based Person Retrieval
di: Zheng, Tianlu, et al.
Pubblicazione: (2025) -
Attention Calibration for Disentangled Text-to-Image Personalization
di: Zhang, Yanbing, et al.
Pubblicazione: (2024) -
MINDiff: Mask-Integrated Negative Attention for Controlling Overfitting in Text-to-Image Personalization
di: Jeong, Seulgi, et al.
Pubblicazione: (2025) -
Suppressing Non-Semantic Noise in Masked Image Modeling Representations
di: Hjelkrem-Tan, Martine, et al.
Pubblicazione: (2026)