SCMM: Calibrating Cross-modal Representations for Text-Based Person Search
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Jing, Wei, Donglai, Liu, Yang, Zhang, Sipeng, Yang, Tong, Zhou, Wei, Ding, Weiping, Leung, Victor C. M. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Attention Calibration for Disentangled Text-to-Image Personalization
por: Zhang, Yanbing, et al.
Publicado: (2024)
por: Zhang, Yanbing, et al.
Publicado: (2024)
Enhancing Visual Representation for Text-based Person Searching
por: Shen, Wei, et al.
Publicado: (2024)
por: Shen, Wei, et al.
Publicado: (2024)
OccTransformer: Improving BEVFormer for 3D camera-only occupancy prediction
por: Liu, Jian, et al.
Publicado: (2024)
por: Liu, Jian, et al.
Publicado: (2024)
Improving Text-based Person Search via Part-level Cross-modal Correspondence
por: Park, Jicheol, et al.
Publicado: (2024)
por: Park, Jicheol, et al.
Publicado: (2024)
CONQUER: Context-Aware Representation with Query Enhancement for Text-Based Person Search
por: Xie, Zequn
Publicado: (2026)
por: Xie, Zequn
Publicado: (2026)
Uncertainty-Aware Prototype Semantic Decoupling for Text-Based Person Search in Full Images
por: Luo, Zengli, et al.
Publicado: (2025)
por: Luo, Zengli, et al.
Publicado: (2025)
CHRep: Cross-modal Histology Representation and Post-hoc Calibration for Spatial Gene Expression Prediction
por: Wang, Changfan, et al.
Publicado: (2026)
por: Wang, Changfan, et al.
Publicado: (2026)
Unsupervised Domain Adaptive Person Search via Dual Self-Calibration
por: Qi, Linfeng, et al.
Publicado: (2024)
por: Qi, Linfeng, et al.
Publicado: (2024)
Semi-supervised Text-based Person Search
por: Gao, Daming, et al.
Publicado: (2024)
por: Gao, Daming, et al.
Publicado: (2024)
Variational Adapter for Cross-modal Similarity Representation
por: Wei, WenZhang, et al.
Publicado: (2026)
por: Wei, WenZhang, et al.
Publicado: (2026)
Cross-modal Full-mode Fine-grained Alignment for Text-to-Image Person Retrieval
por: Yin, Hao, et al.
Publicado: (2025)
por: Yin, Hao, et al.
Publicado: (2025)
Harnessing Weak Pair Uncertainty for Text-based Person Search
por: Sun, Jintao, et al.
Publicado: (2026)
por: Sun, Jintao, et al.
Publicado: (2026)
CDPR: Cross-modal Diffusion with Polarization for Reliable Monocular Depth Estimation
por: Yu, Rongjia, et al.
Publicado: (2026)
por: Yu, Rongjia, et al.
Publicado: (2026)
Integrating Text and Image Pre-training for Multi-modal Algorithmic Reasoning
por: Zhang, Zijian, et al.
Publicado: (2024)
por: Zhang, Zijian, et al.
Publicado: (2024)
OTTER: Open-Tagging via Text-Image Representation for Multi-modal Understanding
por: Ouyang, Jieer, et al.
Publicado: (2025)
por: Ouyang, Jieer, et al.
Publicado: (2025)
Efficient Vision Language Model Fine-tuning for Text-based Person Anomaly Search
por: He, Jiayi, et al.
Publicado: (2025)
por: He, Jiayi, et al.
Publicado: (2025)
Rethinking Cross-modal Interaction from a Top-down Perspective for Referring Video Object Segmentation
por: Liang, Chen, et al.
Publicado: (2021)
por: Liang, Chen, et al.
Publicado: (2021)
VMix: Improving Text-to-Image Diffusion Model with Cross-Attention Mixing Control
por: Wu, Shaojin, et al.
Publicado: (2024)
por: Wu, Shaojin, et al.
Publicado: (2024)
CAMeL: Cross-modality Adaptive Meta-Learning for Text-based Person Retrieval
por: Yu, Hang, et al.
Publicado: (2025)
por: Yu, Hang, et al.
Publicado: (2025)
Cross-modal Fuzzy Alignment Network for Text-Aerial Person Retrieval and A Large-scale Benchmark
por: Deng, Yifei, et al.
Publicado: (2026)
por: Deng, Yifei, et al.
Publicado: (2026)
CRCL: Causal Representation Consistency Learning for Anomaly Detection in Surveillance Videos
por: Liu, Yang, et al.
Publicado: (2025)
por: Liu, Yang, et al.
Publicado: (2025)
Multi-Grained Cross-modal Alignment for Learning Open-vocabulary Semantic Segmentation from Text Supervision
por: Liu, Yajie, et al.
Publicado: (2024)
por: Liu, Yajie, et al.
Publicado: (2024)
CalibNet: Dual-branch Cross-modal Calibration for RGB-D Salient Instance Segmentation
por: Pei, Jialun, et al.
Publicado: (2023)
por: Pei, Jialun, et al.
Publicado: (2023)
Beyond Inserting: Learning Identity Embedding for Semantic-Fidelity Personalized Diffusion Generation
por: Li, Yang, et al.
Publicado: (2024)
por: Li, Yang, et al.
Publicado: (2024)
Learning Language-Driven Sequence-Level Modal-Invariant Representations for Video-Based Visible-Infrared Person Re-Identification
por: Yang, Xiaomei, et al.
Publicado: (2026)
por: Yang, Xiaomei, et al.
Publicado: (2026)
UP-Person: Unified Parameter-Efficient Transfer Learning for Text-based Person Retrieval
por: Liu, Yating, et al.
Publicado: (2025)
por: Liu, Yating, et al.
Publicado: (2025)
Bidirectional Image-Event Guided Fusion Framework for Low-Light Image Enhancement
por: Liu, Zhanwen, et al.
Publicado: (2025)
por: Liu, Zhanwen, et al.
Publicado: (2025)
Benefit from Reference: Retrieval-Augmented Cross-modal Point Cloud Completion
por: Hou, Hongye, et al.
Publicado: (2025)
por: Hou, Hongye, et al.
Publicado: (2025)
SA-Person: Text-Based Person Retrieval with Scene-aware Re-ranking
por: Xu, Yingjia, et al.
Publicado: (2025)
por: Xu, Yingjia, et al.
Publicado: (2025)
Object Affordance Recognition and Grounding via Multi-scale Cross-modal Representation Learning
por: Wan, Xinhang, et al.
Publicado: (2025)
por: Wan, Xinhang, et al.
Publicado: (2025)
Cross-modal ultra-scale learning with tri-modalities of renal biopsy images for glomerular multi-disease auxiliary diagnosis
por: Long, Kaixing, et al.
Publicado: (2025)
por: Long, Kaixing, et al.
Publicado: (2025)
DAPL: Integration of Positive and Negative Descriptions in Text-Based Person Search
por: Deng, Yuchuan, et al.
Publicado: (2024)
por: Deng, Yuchuan, et al.
Publicado: (2024)
Dynamic Uncertainty Learning with Noisy Correspondence for Text-Based Person Search
por: Xie, Zequn, et al.
Publicado: (2025)
por: Xie, Zequn, et al.
Publicado: (2025)
CKDA: Cross-modality Knowledge Disentanglement and Alignment for Visible-Infrared Lifelong Person Re-identification
por: Cui, Zhenyu, et al.
Publicado: (2025)
por: Cui, Zhenyu, et al.
Publicado: (2025)
Calibrated Multimodal Representation Learning with Missing Modalities
por: Liu, Xiaohao, et al.
Publicado: (2025)
por: Liu, Xiaohao, et al.
Publicado: (2025)
Cross-modal Ship Re-Identification via Optical and SAR Imagery: A Novel Dataset and Method
por: Wang, Han, et al.
Publicado: (2025)
por: Wang, Han, et al.
Publicado: (2025)
Beyond Walking: A Large-Scale Image-Text Benchmark for Text-based Person Anomaly Search
por: Yang, Shuyu, et al.
Publicado: (2024)
por: Yang, Shuyu, et al.
Publicado: (2024)
A Labeled Ophthalmic Ultrasound Dataset with Medical Report Generation Based on Cross-modal Deep Learning
por: Wang, Jing, et al.
Publicado: (2024)
por: Wang, Jing, et al.
Publicado: (2024)
Cross-modal Fundus Image Registration under Large FoV Disparity
por: Li, Hongyang, et al.
Publicado: (2025)
por: Li, Hongyang, et al.
Publicado: (2025)
Masked Contrastive Reconstruction for Cross-modal Medical Image-Report Retrieval
por: Wei, Zeqiang, et al.
Publicado: (2023)
por: Wei, Zeqiang, et al.
Publicado: (2023)
Ejemplares similares
-
Attention Calibration for Disentangled Text-to-Image Personalization
por: Zhang, Yanbing, et al.
Publicado: (2024) -
Enhancing Visual Representation for Text-based Person Searching
por: Shen, Wei, et al.
Publicado: (2024) -
OccTransformer: Improving BEVFormer for 3D camera-only occupancy prediction
por: Liu, Jian, et al.
Publicado: (2024) -
Improving Text-based Person Search via Part-level Cross-modal Correspondence
por: Park, Jicheol, et al.
Publicado: (2024) -
CONQUER: Context-Aware Representation with Query Enhancement for Text-Based Person Search
por: Xie, Zequn
Publicado: (2026)