Following the Clues: Experiments on Person Re-ID using Cross-Modal Intelligence
Fuente:
arXiv
Saved in:
| Main Authors: | Aufschläger, Robert, Shoeb, Youssef, Nowzad, Azarm, Heigl, Michael, Bally, Fabian, Schramm, Martin |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Adaptive Neural Networks for Intelligent Data-Driven Development
by: Shoeb, Youssef, et al.
Published: (2025)
by: Shoeb, Youssef, et al.
Published: (2025)
Out-of-Distribution Segmentation in Autonomous Driving: Problems and State of the Art
by: Shoeb, Youssef, et al.
Published: (2025)
by: Shoeb, Youssef, et al.
Published: (2025)
ClustEm4Ano: Clustering Text Embeddings of Nominal Textual Attributes for Microdata Anonymization
by: Aufschläger, Robert, et al.
Published: (2024)
by: Aufschläger, Robert, et al.
Published: (2024)
Segment-Level Road Obstacle Detection Using Visual Foundation Model Priors and Likelihood Ratios
by: Shoeb, Youssef, et al.
Published: (2024)
by: Shoeb, Youssef, et al.
Published: (2024)
Towards Context-Aware Image Anonymization with Multi-Agent Reasoning
by: Aufschläger, Robert, et al.
Published: (2026)
by: Aufschläger, Robert, et al.
Published: (2026)
CMCC-ReID: Cross-Modality Clothing-Change Person Re-Identification
by: Xu, Haoxuan, et al.
Published: (2026)
by: Xu, Haoxuan, et al.
Published: (2026)
Building Blocks for Robust and Effective Semi-Supervised Real-World Object Detection
by: Sbeyti, Moussa Kassem, et al.
Published: (2025)
by: Sbeyti, Moussa Kassem, et al.
Published: (2025)
MLLMReID: Multimodal Large Language Model-based Person Re-identification
by: Yang, Shan, et al.
Published: (2024)
by: Yang, Shan, et al.
Published: (2024)
PriMod4AI: Lifecycle-Aware Privacy Threat Modeling for AI Systems using LLM
by: Savaliya, Gautam, et al.
Published: (2026)
by: Savaliya, Gautam, et al.
Published: (2026)
FlexiReID: Adaptive Mixture of Expert for Multi-Modal Person Re-Identification
by: Sun, Zhen, et al.
Published: (2025)
by: Sun, Zhen, et al.
Published: (2025)
How Could Generative AI Support Compliance with the EU AI Act? A Review for Safe Automated Driving Perception
by: Keser, Mert, et al.
Published: (2024)
by: Keser, Mert, et al.
Published: (2024)
A Likelihood Ratio-Based Approach to Segmenting Unknown Objects
by: Nayal, Nazir, et al.
Published: (2024)
by: Nayal, Nazir, et al.
Published: (2024)
Efficient Bilateral Cross-Modality Cluster Matching for Unsupervised Visible-Infrared Person ReID
by: Cheng, De, et al.
Published: (2023)
by: Cheng, De, et al.
Published: (2023)
Identity Clue Refinement and Enhancement for Visible-Infrared Person Re-Identification
by: Zhang, Guoqing, et al.
Published: (2025)
by: Zhang, Guoqing, et al.
Published: (2025)
Deciphering Cross-Modal Alignment in Large Vision-Language Models with Modality Integration Rate
by: Huang, Qidong, et al.
Published: (2024)
by: Huang, Qidong, et al.
Published: (2024)
FSMR: A Feature Swapping Multi-modal Reasoning Approach with Joint Textual and Visual Clues
by: Li, Shuang, et al.
Published: (2024)
by: Li, Shuang, et al.
Published: (2024)
Distill CLIP (DCLIP): Enhancing Image-Text Retrieval via Cross-Modal Transformer Distillation
by: Csizmadia, Daniel, et al.
Published: (2025)
by: Csizmadia, Daniel, et al.
Published: (2025)
Cross-Modality Perturbation Synergy Attack for Person Re-identification
by: Gong, Yunpeng, et al.
Published: (2024)
by: Gong, Yunpeng, et al.
Published: (2024)
Cross-Modal Rationale Transfer for Explainable Humanitarian Classification on Social Media
by: Nguyen, Thi Huyen, et al.
Published: (2026)
by: Nguyen, Thi Huyen, et al.
Published: (2026)
Cross-Modal Obfuscation for Jailbreak Attacks on Large Vision-Language Models
by: Jiang, Lei, et al.
Published: (2025)
by: Jiang, Lei, et al.
Published: (2025)
Cross-Modal Retrieval for Motion and Text via DropTriple Loss
by: Yan, Sheng, et al.
Published: (2023)
by: Yan, Sheng, et al.
Published: (2023)
Unraveling Cross-Modality Knowledge Conflicts in Large Vision-Language Models
by: Zhu, Tinghui, et al.
Published: (2024)
by: Zhu, Tinghui, et al.
Published: (2024)
Dynamic Clue Bottlenecks: Towards Interpretable-by-Design Visual Question Answering
by: Fu, Xingyu, et al.
Published: (2023)
by: Fu, Xingyu, et al.
Published: (2023)
Exploring Typographic Visual Prompts Injection Threats in Cross-Modality Generation Models
by: Cheng, Hao, et al.
Published: (2025)
by: Cheng, Hao, et al.
Published: (2025)
CoLA: Cross-Modal Low-rank Adaptation for Multimodal Downstream Tasks
by: Suharitdamrong, Wish, et al.
Published: (2026)
by: Suharitdamrong, Wish, et al.
Published: (2026)
Cross-Modal Adapter for Vision-Language Retrieval
by: Jiang, Haojun, et al.
Published: (2022)
by: Jiang, Haojun, et al.
Published: (2022)
LLM2CLIP: Powerful Language Model Unlocks Richer Cross-Modality Representation
by: Huang, Weiquan, et al.
Published: (2024)
by: Huang, Weiquan, et al.
Published: (2024)
Enhancing Chest X-ray Classification through Knowledge Injection in Cross-Modality Learning
by: Yan, Yang, et al.
Published: (2025)
by: Yan, Yang, et al.
Published: (2025)
Leveraging Entity Information for Cross-Modality Correlation Learning: The Entity-Guided Multimodal Summarization
by: Zhang, Yanghai, et al.
Published: (2024)
by: Zhang, Yanghai, et al.
Published: (2024)
EgoBabyVLM: Benchmarking Cross-Modal Learning from Naturalistic Egocentric Video Data
by: Lin, Dongyan, et al.
Published: (2026)
by: Lin, Dongyan, et al.
Published: (2026)
CROME: Cross-Modal Adapters for Efficient Multimodal LLM
by: Ebrahimi, Sayna, et al.
Published: (2024)
by: Ebrahimi, Sayna, et al.
Published: (2024)
Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs
by: Gao, Xin, et al.
Published: (2026)
by: Gao, Xin, et al.
Published: (2026)
Synthetic-To-Real Video Person Re-ID
by: Zhang, Xiangqun, et al.
Published: (2024)
by: Zhang, Xiangqun, et al.
Published: (2024)
LinguDistill: Recovering Linguistic Ability in Vision-Language Models via Selective Cross-Modal Distillation
by: Irawan, Patrick Amadeus, et al.
Published: (2026)
by: Irawan, Patrick Amadeus, et al.
Published: (2026)
X-VILA: Cross-Modality Alignment for Large Language Model
by: Ye, Hanrong, et al.
Published: (2024)
by: Ye, Hanrong, et al.
Published: (2024)
Vision-Language Models Create Cross-Modal Task Representations
by: Luo, Grace, et al.
Published: (2024)
by: Luo, Grace, et al.
Published: (2024)
Text-to-Image Cross-Modal Generation: A Systematic Review
by: Żelaszczyk, Maciej, et al.
Published: (2024)
by: Żelaszczyk, Maciej, et al.
Published: (2024)
Investigating Cross-Modal Skill Injection: Scenarios, Methods, and Hyperparameters
by: Xu, Zhiyu, et al.
Published: (2026)
by: Xu, Zhiyu, et al.
Published: (2026)
Region-R1: Reinforcing Query-Side Region Cropping for Multi-Modal Re-Ranking
by: Hu, Chan-Wei, et al.
Published: (2026)
by: Hu, Chan-Wei, et al.
Published: (2026)
MoD-DPO: Towards Mitigating Cross-modal Hallucinations in Omni LLMs using Modality Decoupled Preference Optimization
by: Chaubey, Ashutosh, et al.
Published: (2026)
by: Chaubey, Ashutosh, et al.
Published: (2026)
Similar Items
-
Adaptive Neural Networks for Intelligent Data-Driven Development
by: Shoeb, Youssef, et al.
Published: (2025) -
Out-of-Distribution Segmentation in Autonomous Driving: Problems and State of the Art
by: Shoeb, Youssef, et al.
Published: (2025) -
ClustEm4Ano: Clustering Text Embeddings of Nominal Textual Attributes for Microdata Anonymization
by: Aufschläger, Robert, et al.
Published: (2024) -
Segment-Level Road Obstacle Detection Using Visual Foundation Model Priors and Likelihood Ratios
by: Shoeb, Youssef, et al.
Published: (2024) -
Towards Context-Aware Image Anonymization with Multi-Agent Reasoning
by: Aufschläger, Robert, et al.
Published: (2026)