Pretrain-then-Adapt: Uncertainty-Aware Test-Time Adaptation for Text-based Person Search
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Jiahao, Huang, Shaofei, Wang, Yaxiong, Zheng, Zhedong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Scale Up Composed Image Retrieval Learning via Modification Text Generation
di: Zhou, Yinan, et al.
Pubblicazione: (2025)
di: Zhou, Yinan, et al.
Pubblicazione: (2025)
MSAM: Multi-Semantic Adaptive Mining for Cross-Modal Drone Video-Text Retrieval
di: Huang, Jinghao, et al.
Pubblicazione: (2025)
di: Huang, Jinghao, et al.
Pubblicazione: (2025)
Attribute-Aware Implicit Modality Alignment for Text Attribute Person Search
di: Wang, Xin, et al.
Pubblicazione: (2024)
di: Wang, Xin, et al.
Pubblicazione: (2024)
Dual Prompt Learning for Adapting Vision-Language Models to Downstream Image-Text Retrieval
di: Wang, Yifan, et al.
Pubblicazione: (2025)
di: Wang, Yifan, et al.
Pubblicazione: (2025)
Beyond Walking: A Large-Scale Image-Text Benchmark for Text-based Person Anomaly Search
di: Yang, Shuyu, et al.
Pubblicazione: (2024)
di: Yang, Shuyu, et al.
Pubblicazione: (2024)
Minimizing the Pretraining Gap: Domain-aligned Text-Based Person Retrieval
di: Yang, Shuyu, et al.
Pubblicazione: (2025)
di: Yang, Shuyu, et al.
Pubblicazione: (2025)
Personalized Video Summarization using Text-Based Queries and Conditional Modeling
di: Huang, Jia-Hong
Pubblicazione: (2024)
di: Huang, Jia-Hong
Pubblicazione: (2024)
Harnessing Weak Pair Uncertainty for Text-based Person Search
di: Sun, Jintao, et al.
Pubblicazione: (2026)
di: Sun, Jintao, et al.
Pubblicazione: (2026)
DeepImageSearch: Benchmarking Multimodal Agents for Context-Aware Image Retrieval in Visual Histories
di: Deng, Chenlong, et al.
Pubblicazione: (2026)
di: Deng, Chenlong, et al.
Pubblicazione: (2026)
PATFinger: Prompt-Adapted Transferable Fingerprinting against Unauthorized Multimodal Dataset Usage
di: Zhang, Wenyi, et al.
Pubblicazione: (2025)
di: Zhang, Wenyi, et al.
Pubblicazione: (2025)
Design Your Ad: Personalized Advertising Image and Text Generation with Unified Autoregressive Models
di: Xu, Yexing, et al.
Pubblicazione: (2026)
di: Xu, Yexing, et al.
Pubblicazione: (2026)
Bridging Information Asymmetry in Text-video Retrieval: A Data-centric Approach
di: Bai, Zechen, et al.
Pubblicazione: (2024)
di: Bai, Zechen, et al.
Pubblicazione: (2024)
Advancing Re-Ranking with Multimodal Fusion and Target-Oriented Auxiliary Tasks in E-Commerce Search
di: Xu, Enqiang, et al.
Pubblicazione: (2024)
di: Xu, Enqiang, et al.
Pubblicazione: (2024)
AutothinkRAG: Complexity-Aware Control of Retrieval-Augmented Reasoning for Image-Text Interaction
di: Yang, Jiashu, et al.
Pubblicazione: (2026)
di: Yang, Jiashu, et al.
Pubblicazione: (2026)
Adapting MLLMs for Nuanced Video Retrieval
di: Bagad, Piyush, et al.
Pubblicazione: (2025)
di: Bagad, Piyush, et al.
Pubblicazione: (2025)
DRC: Enhancing Personalized Image Generation via Disentangled Representation Composition
di: Xu, Yiyan, et al.
Pubblicazione: (2025)
di: Xu, Yiyan, et al.
Pubblicazione: (2025)
NextAds: Towards Next-generation Personalized Video Advertising
di: Xu, Yiyan, et al.
Pubblicazione: (2026)
di: Xu, Yiyan, et al.
Pubblicazione: (2026)
IISAN: Efficiently Adapting Multimodal Representation for Sequential Recommendation with Decoupled PEFT
di: Fu, Junchen, et al.
Pubblicazione: (2024)
di: Fu, Junchen, et al.
Pubblicazione: (2024)
RAGAR: Retrieval Augmented Personalized Image Generation Guided by Recommendation
di: Ling, Run, et al.
Pubblicazione: (2025)
di: Ling, Run, et al.
Pubblicazione: (2025)
Efficient and Effective Adaptation of Multimodal Foundation Models in Sequential Recommendation
di: Fu, Junchen, et al.
Pubblicazione: (2024)
di: Fu, Junchen, et al.
Pubblicazione: (2024)
Unity is Strength: Unifying Convolutional and Transformeral Features for Better Person Re-Identification
di: Wang, Yuhao, et al.
Pubblicazione: (2024)
di: Wang, Yuhao, et al.
Pubblicazione: (2024)
ADaFuSE: Adaptive Diffusion-generated Image and Text Fusion for Interactive Text-to-Image Retrieval
di: Zhang, Zhuocheng, et al.
Pubblicazione: (2026)
di: Zhang, Zhuocheng, et al.
Pubblicazione: (2026)
When & How to Write for Personalized Demand-aware Query Rewriting in Video Search
di: cheng, Cheng, et al.
Pubblicazione: (2025)
di: cheng, Cheng, et al.
Pubblicazione: (2025)
TrajSV: A Trajectory-based Model for Sports Video Representations and Applications
di: Wang, Zheng, et al.
Pubblicazione: (2025)
di: Wang, Zheng, et al.
Pubblicazione: (2025)
ViFi-ReID: A Two-Stream Vision-WiFi Multimodal Approach for Person Re-identification
di: Mao, Chen, et al.
Pubblicazione: (2024)
di: Mao, Chen, et al.
Pubblicazione: (2024)
GenState-AI: State-Aware Dataset for Text-to-Video Retrieval on AI-Generated Videos
di: Li, Minghan, et al.
Pubblicazione: (2026)
di: Li, Minghan, et al.
Pubblicazione: (2026)
Identity-Decoupled Anonymization for Visual Evidence in Multi-modal Retrieval-Augmented Generation
di: Cheng, Zehua, et al.
Pubblicazione: (2026)
di: Cheng, Zehua, et al.
Pubblicazione: (2026)
A Flexible and Scalable Framework for Video Moment Search
di: Zhang, Chongzhi, et al.
Pubblicazione: (2025)
di: Zhang, Chongzhi, et al.
Pubblicazione: (2025)
A Novel Evaluation Framework for Image2Text Generation
di: Huang, Jia-Hong, et al.
Pubblicazione: (2024)
di: Huang, Jia-Hong, et al.
Pubblicazione: (2024)
TIGER-FG: Text-Guided Implicit Fine-Grained Grounding for E-commerce Retrieval
di: Sun, Xinyu, et al.
Pubblicazione: (2026)
di: Sun, Xinyu, et al.
Pubblicazione: (2026)
DEMO: A Statistical Perspective for Efficient Image-Text Matching
di: Zhang, Fan, et al.
Pubblicazione: (2024)
di: Zhang, Fan, et al.
Pubblicazione: (2024)
A Resource-Efficient Training Framework for Remote Sensing Text--Image Retrieval
di: Zhang, Weihang, et al.
Pubblicazione: (2025)
di: Zhang, Weihang, et al.
Pubblicazione: (2025)
Visual Product Search Benchmark
di: Govindappa, Karthik Sulthanpete
Pubblicazione: (2026)
di: Govindappa, Karthik Sulthanpete
Pubblicazione: (2026)
Ambiguity-Aware and High-Order Relation Learning for Multi-Grained Image-Text Matching
di: Chen, Junyu, et al.
Pubblicazione: (2025)
di: Chen, Junyu, et al.
Pubblicazione: (2025)
Multi-Branch Collaborative Learning Network for Video Quality Assessment in Industrial Video Search
di: Tang, Hengzhu, et al.
Pubblicazione: (2025)
di: Tang, Hengzhu, et al.
Pubblicazione: (2025)
CaLa: Complementary Association Learning for Augmenting Composed Image Retrieval
di: Jiang, Xintong, et al.
Pubblicazione: (2024)
di: Jiang, Xintong, et al.
Pubblicazione: (2024)
LongVidSearch: An Agentic Benchmark for Multi-hop Evidence Retrieval Planning in Long Videos
di: Yu, Rongyi, et al.
Pubblicazione: (2026)
di: Yu, Rongyi, et al.
Pubblicazione: (2026)
ABE-CLIP: Training-Free Attribute Binding Enhancement for Compositional Image-Text Matching
di: Zhang, Qi, et al.
Pubblicazione: (2025)
di: Zhang, Qi, et al.
Pubblicazione: (2025)
Modality and Task Adaptation for Enhanced Zero-shot Composed Image Retrieval
di: Li, Haiwen, et al.
Pubblicazione: (2024)
di: Li, Haiwen, et al.
Pubblicazione: (2024)
Bridging the Modality Gap: Dimension Information Alignment and Sparse Spatial Constraint for Image-Text Matching
di: Ma, Xiang, et al.
Pubblicazione: (2024)
di: Ma, Xiang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Scale Up Composed Image Retrieval Learning via Modification Text Generation
di: Zhou, Yinan, et al.
Pubblicazione: (2025) -
MSAM: Multi-Semantic Adaptive Mining for Cross-Modal Drone Video-Text Retrieval
di: Huang, Jinghao, et al.
Pubblicazione: (2025) -
Attribute-Aware Implicit Modality Alignment for Text Attribute Person Search
di: Wang, Xin, et al.
Pubblicazione: (2024) -
Dual Prompt Learning for Adapting Vision-Language Models to Downstream Image-Text Retrieval
di: Wang, Yifan, et al.
Pubblicazione: (2025) -
Beyond Walking: A Large-Scale Image-Text Benchmark for Text-based Person Anomaly Search
di: Yang, Shuyu, et al.
Pubblicazione: (2024)