AnomalyLMM: Bridging Generative Knowledge and Discriminative Retrieval for Text-Based Person Anomaly Search
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ju, Hao, Zhang, Hu, Zheng, Zhedong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Beyond Walking: A Large-Scale Image-Text Benchmark for Text-based Person Anomaly Search
par: Yang, Shuyu, et autres
Publié: (2024)
par: Yang, Shuyu, et autres
Publié: (2024)
Towards Scalable Video Anomaly Retrieval: A Synthetic Video-Text Benchmark
par: Yang, Shuyu, et autres
Publié: (2025)
par: Yang, Shuyu, et autres
Publié: (2025)
Harnessing Weak Pair Uncertainty for Text-based Person Search
par: Sun, Jintao, et autres
Publié: (2026)
par: Sun, Jintao, et autres
Publié: (2026)
Minimizing the Pretraining Gap: Domain-aligned Text-Based Person Retrieval
par: Yang, Shuyu, et autres
Publié: (2025)
par: Yang, Shuyu, et autres
Publié: (2025)
Bridging the Pose-Semantic Gap: A Cascade Framework for Text-Based Person Anomaly Search
par: Xie, Zequn, et autres
Publié: (2026)
par: Xie, Zequn, et autres
Publié: (2026)
CAMeL: Cross-modality Adaptive Meta-Learning for Text-based Person Retrieval
par: Yu, Hang, et autres
Publié: (2025)
par: Yu, Hang, et autres
Publié: (2025)
From Data Deluge to Data Curation: A Filtering-WoRA Paradigm for Efficient Text-based Person Search
par: Sun, Jintao, et autres
Publié: (2024)
par: Sun, Jintao, et autres
Publié: (2024)
Pretrain-then-Adapt: Uncertainty-Aware Test-Time Adaptation for Text-based Person Search
par: Zhang, Jiahao, et autres
Publié: (2026)
par: Zhang, Jiahao, et autres
Publié: (2026)
Hybrid, Unified and Iterative: A Novel Framework for Text-based Person Anomaly Retrieval
par: Nguyen, Tien-Huy, et autres
Publié: (2025)
par: Nguyen, Tien-Huy, et autres
Publié: (2025)
When Words Smile: Generating Diverse Emotional Facial Expressions from Text
par: Xu, Haidong, et autres
Publié: (2024)
par: Xu, Haidong, et autres
Publié: (2024)
Efficient Vision Language Model Fine-tuning for Text-based Person Anomaly Search
par: He, Jiayi, et autres
Publié: (2025)
par: He, Jiayi, et autres
Publié: (2025)
A Recover-then-Discriminate Framework for Robust Anomaly Detection
par: Xing, Peng, et autres
Publié: (2024)
par: Xing, Peng, et autres
Publié: (2024)
Triad: Empowering LMM-based Anomaly Detection with Vision Expert-guided Visual Tokenizer and Manufacturing Process
par: Li, Yuanze, et autres
Publié: (2025)
par: Li, Yuanze, et autres
Publié: (2025)
Video2BEV: Transforming Drone Videos to BEVs for Video-based Geo-localization
par: Ju, Hao, et autres
Publié: (2024)
par: Ju, Hao, et autres
Publié: (2024)
Composed Image Retrieval with Text Feedback via Multi-grained Uncertainty Regularization
par: Chen, Yiyang, et autres
Publié: (2022)
par: Chen, Yiyang, et autres
Publié: (2022)
Dual-path Frequency Discriminators for Few-shot Anomaly Detection
par: Bai, Yuhu, et autres
Publié: (2024)
par: Bai, Yuhu, et autres
Publié: (2024)
AnomalyDiffusion: Few-Shot Anomaly Image Generation with Diffusion Model
par: Hu, Teng, et autres
Publié: (2023)
par: Hu, Teng, et autres
Publié: (2023)
RAID: Retrieval-Augmented Anomaly Detection
par: Cai, Mingxiu, et autres
Publié: (2026)
par: Cai, Mingxiu, et autres
Publié: (2026)
VL-Uncertainty: Detecting Hallucination in Large Vision-Language Model via Uncertainty Estimation
par: Zhang, Ruiyang, et autres
Publié: (2024)
par: Zhang, Ruiyang, et autres
Publié: (2024)
Instilling Multi-round Thinking to Text-guided Image Generation
par: Zeng, Lidong, et autres
Publié: (2024)
par: Zeng, Lidong, et autres
Publié: (2024)
AnomalyFactory: Regard Anomaly Generation as Unsupervised Anomaly Localization
par: Zhao, Ying
Publié: (2024)
par: Zhao, Ying
Publié: (2024)
AnomalyXFusion: Multi-modal Anomaly Synthesis with Diffusion
par: Hu, Jie, et autres
Publié: (2024)
par: Hu, Jie, et autres
Publié: (2024)
Unseen Visual Anomaly Generation
par: Sun, Han, et autres
Publié: (2024)
par: Sun, Han, et autres
Publié: (2024)
Improving Multimodal Hateful Meme Detection Exploiting LMM-Generated Knowledge
par: Tzelepi, Maria, et autres
Publié: (2025)
par: Tzelepi, Maria, et autres
Publié: (2025)
Collaborative Group: Composed Image Retrieval via Consensus Learning from Noisy Annotations
par: Zhang, Xu, et autres
Publié: (2023)
par: Zhang, Xu, et autres
Publié: (2023)
LMM4LMM: Benchmarking and Evaluating Large-multimodal Image Generation with LMMs
par: Wang, Jiarui, et autres
Publié: (2025)
par: Wang, Jiarui, et autres
Publié: (2025)
Beyond Normal References: Discriminative Few-Shot Anomaly Detection
par: Wang, Huan, et autres
Publié: (2026)
par: Wang, Huan, et autres
Publié: (2026)
Search is All You Need for Few-shot Anomaly Detection
par: Wang, Qishan, et autres
Publié: (2025)
par: Wang, Qishan, et autres
Publié: (2025)
AIGV-Assessor: Benchmarking and Evaluating the Perceptual Quality of Text-to-Video Generation with LMM
par: Wang, Jiarui, et autres
Publié: (2024)
par: Wang, Jiarui, et autres
Publié: (2024)
GroundingAnomaly: Spatially-Grounded Diffusion for Few-Shot Anomaly Synthesis
par: Liu, Yishen, et autres
Publié: (2026)
par: Liu, Yishen, et autres
Publié: (2026)
Semi-supervised Text-based Person Search
par: Gao, Daming, et autres
Publié: (2024)
par: Gao, Daming, et autres
Publié: (2024)
Uncertainty-o: One Model-agnostic Framework for Unveiling Uncertainty in Large Multimodal Models
par: Zhang, Ruiyang, et autres
Publié: (2025)
par: Zhang, Ruiyang, et autres
Publié: (2025)
MIRAGE: Model-agnostic Industrial Realistic Anomaly Generation and Evaluation for Visual Anomaly Detection
par: Hu, Jinwei, et autres
Publié: (2026)
par: Hu, Jinwei, et autres
Publié: (2026)
GEA: Generation-Enhanced Alignment for Text-to-Image Person Retrieval
par: Zou, Hao, et autres
Publié: (2025)
par: Zou, Hao, et autres
Publié: (2025)
MRAD: Zero-Shot Anomaly Detection with Memory-Driven Retrieval
par: Xu, Chaoran, et autres
Publié: (2026)
par: Xu, Chaoran, et autres
Publié: (2026)
Bridging Degradation Discrimination and Generation for Universal Image Restoration
par: Hu, JiaKui, et autres
Publié: (2026)
par: Hu, JiaKui, et autres
Publié: (2026)
Component-aware Unsupervised Logical Anomaly Generation for Industrial Anomaly Detection
par: Tong, Xuan, et autres
Publié: (2025)
par: Tong, Xuan, et autres
Publié: (2025)
VSearcher: Long-Horizon Multimodal Search Agent via Reinforcement Learning
par: Zhang, Ruiyang, et autres
Publié: (2026)
par: Zhang, Ruiyang, et autres
Publié: (2026)
TextPecker: Rewarding Structural Anomaly Quantification for Enhancing Visual Text Rendering
par: Zhu, Hanshen, et autres
Publié: (2026)
par: Zhu, Hanshen, et autres
Publié: (2026)
DAPL: Integration of Positive and Negative Descriptions in Text-Based Person Search
par: Deng, Yuchuan, et autres
Publié: (2024)
par: Deng, Yuchuan, et autres
Publié: (2024)
Documents similaires
-
Beyond Walking: A Large-Scale Image-Text Benchmark for Text-based Person Anomaly Search
par: Yang, Shuyu, et autres
Publié: (2024) -
Towards Scalable Video Anomaly Retrieval: A Synthetic Video-Text Benchmark
par: Yang, Shuyu, et autres
Publié: (2025) -
Harnessing Weak Pair Uncertainty for Text-based Person Search
par: Sun, Jintao, et autres
Publié: (2026) -
Minimizing the Pretraining Gap: Domain-aligned Text-Based Person Retrieval
par: Yang, Shuyu, et autres
Publié: (2025) -
Bridging the Pose-Semantic Gap: A Cascade Framework for Text-Based Person Anomaly Search
par: Xie, Zequn, et autres
Publié: (2026)