LAIP: Learning Local Alignment from Image-Phrase Modeling for Text-based Person Search
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Haiguang, Wu, Yu, Wu, Mengxia, Min, Cao, Zhang, Min |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Semi-supervised Text-based Person Search
di: Gao, Daming, et al.
Pubblicazione: (2024)
di: Gao, Daming, et al.
Pubblicazione: (2024)
Inject Where It Matters: Training-Free Spatially-Adaptive Identity Preservation for Text-to-Image Personalization
di: Li, Guandong, et al.
Pubblicazione: (2026)
di: Li, Guandong, et al.
Pubblicazione: (2026)
Text-based Aerial-Ground Person Retrieval
di: Zhou, Xinyu, et al.
Pubblicazione: (2025)
di: Zhou, Xinyu, et al.
Pubblicazione: (2025)
Knowing Where to Focus: Attention-Guided Alignment for Text-based Person Search
di: Tan, Lei, et al.
Pubblicazione: (2024)
di: Tan, Lei, et al.
Pubblicazione: (2024)
KETA: Kinematic-Phrases-Enhanced Text-to-Motion Generation via Fine-grained Alignment
di: Jiang, Yu, et al.
Pubblicazione: (2025)
di: Jiang, Yu, et al.
Pubblicazione: (2025)
Exploring Phrase-Level Grounding with Text-to-Image Diffusion Model
di: Yang, Danni, et al.
Pubblicazione: (2024)
di: Yang, Danni, et al.
Pubblicazione: (2024)
Multilingual Text-to-Image Person Retrieval via Bidirectional Relation Reasoning and Aligning
di: Cao, Min, et al.
Pubblicazione: (2025)
di: Cao, Min, et al.
Pubblicazione: (2025)
Personalized Safety Alignment for Text-to-Image Diffusion Models
di: Lei, Yu, et al.
Pubblicazione: (2025)
di: Lei, Yu, et al.
Pubblicazione: (2025)
Object-Conditioned Energy-Based Attention Map Alignment in Text-to-Image Diffusion Models
di: Zhang, Yasi, et al.
Pubblicazione: (2024)
di: Zhang, Yasi, et al.
Pubblicazione: (2024)
TIT-Score: Evaluating Long-Prompt Based Text-to-Image Alignment via Text-to-Image-to-Text Consistency
di: Wang, Juntong, et al.
Pubblicazione: (2025)
di: Wang, Juntong, et al.
Pubblicazione: (2025)
ROGLE: Robust Global-Local Alignment with Automated Region Supervision for Text-Based Person Search
di: Xie, Zequn, et al.
Pubblicazione: (2026)
di: Xie, Zequn, et al.
Pubblicazione: (2026)
SA-Person: Text-Based Person Retrieval with Scene-aware Re-ranking
di: Xu, Yingjia, et al.
Pubblicazione: (2025)
di: Xu, Yingjia, et al.
Pubblicazione: (2025)
Learning to Localize Actions in Instructional Videos with LLM-Based Multi-Pathway Text-Video Alignment
di: Chen, Yuxiao, et al.
Pubblicazione: (2024)
di: Chen, Yuxiao, et al.
Pubblicazione: (2024)
Enhancing Visual Representation for Text-based Person Searching
di: Shen, Wei, et al.
Pubblicazione: (2024)
di: Shen, Wei, et al.
Pubblicazione: (2024)
Hyperspectral Image Classification via Transformer-based Spectral-Spatial Attention Decoupling and Adaptive Gating
di: Li, Guandong, et al.
Pubblicazione: (2025)
di: Li, Guandong, et al.
Pubblicazione: (2025)
CoRe: Context-Regularized Text Embedding Learning for Text-to-Image Personalization
di: Wu, Feize, et al.
Pubblicazione: (2024)
di: Wu, Feize, et al.
Pubblicazione: (2024)
DCoAR: Deep Concept Injection into Unified Autoregressive Models for Personalized Text-to-Image Generation
di: Wu, Fangtai, et al.
Pubblicazione: (2025)
di: Wu, Fangtai, et al.
Pubblicazione: (2025)
Efficient Vision Language Model Fine-tuning for Text-based Person Anomaly Search
di: He, Jiayi, et al.
Pubblicazione: (2025)
di: He, Jiayi, et al.
Pubblicazione: (2025)
Detecting Deepfakes with Multivariate Soft Blending and CLIP-based Image-Text Alignment
di: Li, Jingwei, et al.
Pubblicazione: (2026)
di: Li, Jingwei, et al.
Pubblicazione: (2026)
PEAR: Phrase-Based Hand-Object Interaction Anticipation
di: Zhang, Zichen, et al.
Pubblicazione: (2024)
di: Zhang, Zichen, et al.
Pubblicazione: (2024)
Edit Fidelity Field: Semantics-Aware Region Isolation for Training-Free Scene Text Editing
di: Li, Guandong, et al.
Pubblicazione: (2026)
di: Li, Guandong, et al.
Pubblicazione: (2026)
Beyond Walking: A Large-Scale Image-Text Benchmark for Text-based Person Anomaly Search
di: Yang, Shuyu, et al.
Pubblicazione: (2024)
di: Yang, Shuyu, et al.
Pubblicazione: (2024)
An Empirical Study of Validating Synthetic Data for Text-Based Person Retrieval
di: Cao, Min, et al.
Pubblicazione: (2025)
di: Cao, Min, et al.
Pubblicazione: (2025)
Language-Image Alignment with Fixed Text Encoders
di: Yang, Jingfeng, et al.
Pubblicazione: (2025)
di: Yang, Jingfeng, et al.
Pubblicazione: (2025)
TokenFocus-VQA: Enhancing Text-to-Image Alignment with Position-Aware Focus and Multi-Perspective Aggregations on LVLMs
di: Zhang, Zijian, et al.
Pubblicazione: (2025)
di: Zhang, Zijian, et al.
Pubblicazione: (2025)
Uncertainty-Aware Prototype Semantic Decoupling for Text-Based Person Search in Full Images
di: Luo, Zengli, et al.
Pubblicazione: (2025)
di: Luo, Zengli, et al.
Pubblicazione: (2025)
CODER: Coupled Diversity-Sensitive Momentum Contrastive Learning for Image-Text Retrieval
di: Wang, Haoran, et al.
Pubblicazione: (2022)
di: Wang, Haoran, et al.
Pubblicazione: (2022)
LLM-Enabled Style and Content Regularization for Personalized Text-to-Image Generation
di: Yu, Anran, et al.
Pubblicazione: (2025)
di: Yu, Anran, et al.
Pubblicazione: (2025)
Text-based Animatable 3D Avatars with Morphable Model Alignment
di: Wu, Yiqian, et al.
Pubblicazione: (2025)
di: Wu, Yiqian, et al.
Pubblicazione: (2025)
Efficient Dynamic Attention 3D Convolution for Hyperspectral Image Classification
di: Li, Guandong, et al.
Pubblicazione: (2025)
di: Li, Guandong, et al.
Pubblicazione: (2025)
Phrase Grounding-based Style Transfer for Single-Domain Generalized Object Detection
di: Li, Hao, et al.
Pubblicazione: (2024)
di: Li, Hao, et al.
Pubblicazione: (2024)
Expert Kernel Generation Network Driven by Contextual Mapping for Hyperspectral Image Classification
di: Li, Guandong, et al.
Pubblicazione: (2025)
di: Li, Guandong, et al.
Pubblicazione: (2025)
3D Wavelet Convolutions with Extended Receptive Fields for Hyperspectral Image Classification
di: Li, Guandong, et al.
Pubblicazione: (2025)
di: Li, Guandong, et al.
Pubblicazione: (2025)
Dynamic 3D KAN Convolution with Adaptive Grid Optimization for Hyperspectral Image Classification
di: Li, Guandong, et al.
Pubblicazione: (2025)
di: Li, Guandong, et al.
Pubblicazione: (2025)
AttnRouter: Per-Category Attention Routing for Training-Free Image Editing on MMDiT
di: Li, Guandong, et al.
Pubblicazione: (2026)
di: Li, Guandong, et al.
Pubblicazione: (2026)
Deep Intra-Image Contrastive Learning for Weakly Supervised One-Step Person Search
di: Wang, Jiabei, et al.
Pubblicazione: (2023)
di: Wang, Jiabei, et al.
Pubblicazione: (2023)
MVNet: Hyperspectral Remote Sensing Image Classification Based on Hybrid Mamba-Transformer Vision Backbone Architecture
di: Li, Guandong, et al.
Pubblicazione: (2025)
di: Li, Guandong, et al.
Pubblicazione: (2025)
PhysEdit: Physically-Consistent Region-Aware Image Editing via Adaptive Spatio-Temporal Reasoning
di: Li, Guandong, et al.
Pubblicazione: (2026)
di: Li, Guandong, et al.
Pubblicazione: (2026)
Spatial-Geometry Enhanced 3D Dynamic Snake Convolutional Neural Network for Hyperspectral Image Classification
di: Li, Guandong, et al.
Pubblicazione: (2025)
di: Li, Guandong, et al.
Pubblicazione: (2025)
GEA: Generation-Enhanced Alignment for Text-to-Image Person Retrieval
di: Zou, Hao, et al.
Pubblicazione: (2025)
di: Zou, Hao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Semi-supervised Text-based Person Search
di: Gao, Daming, et al.
Pubblicazione: (2024) -
Inject Where It Matters: Training-Free Spatially-Adaptive Identity Preservation for Text-to-Image Personalization
di: Li, Guandong, et al.
Pubblicazione: (2026) -
Text-based Aerial-Ground Person Retrieval
di: Zhou, Xinyu, et al.
Pubblicazione: (2025) -
Knowing Where to Focus: Attention-Guided Alignment for Text-based Person Search
di: Tan, Lei, et al.
Pubblicazione: (2024) -
KETA: Kinematic-Phrases-Enhanced Text-to-Motion Generation via Fine-grained Alignment
di: Jiang, Yu, et al.
Pubblicazione: (2025)