Gespeichert in:
| Hauptverfasser: | Deng, Yuchuan, Hu, Zhanpeng, Xin, Zijie, Deng, Chuang, Zhao, Qijun |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2405.07459 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
LoSh: Long-Short Text Joint Prediction Network for Referring Video Object Segmentation
von: Yuan, Linfeng, et al.
Veröffentlicht: (2023)
von: Yuan, Linfeng, et al.
Veröffentlicht: (2023)
Dynamic Patch-aware Enrichment Transformer for Occluded Person Re-Identification
von: Zhang, Xin, et al.
Veröffentlicht: (2024)
von: Zhang, Xin, et al.
Veröffentlicht: (2024)
Boosting Weak Positives for Text Based Person Search
von: Modi, Akshay, et al.
Veröffentlicht: (2025)
von: Modi, Akshay, et al.
Veröffentlicht: (2025)
Empowering Small VLMs to Think with Dynamic Memorization and Exploration
von: Liu, Jiazhen, et al.
Veröffentlicht: (2025)
von: Liu, Jiazhen, et al.
Veröffentlicht: (2025)
Fundus-R1: Training a Fundus-Reading MLLM with Knowledge-Aware Reasoning on Public Data
von: Deng, Yuchuan, et al.
Veröffentlicht: (2026)
von: Deng, Yuchuan, et al.
Veröffentlicht: (2026)
Hierarchical Generative Network for Face Morphing Attacks
von: He, Zuyuan, et al.
Veröffentlicht: (2024)
von: He, Zuyuan, et al.
Veröffentlicht: (2024)
Optimal-Landmark-Guided Image Blending for Face Morphing Attacks
von: He, Qiaoyun, et al.
Veröffentlicht: (2024)
von: He, Qiaoyun, et al.
Veröffentlicht: (2024)
MINDiff: Mask-Integrated Negative Attention for Controlling Overfitting in Text-to-Image Personalization
von: Jeong, Seulgi, et al.
Veröffentlicht: (2025)
von: Jeong, Seulgi, et al.
Veröffentlicht: (2025)
XHand: Real-time Expressive Hand Avatar
von: Gan, Qijun, et al.
Veröffentlicht: (2024)
von: Gan, Qijun, et al.
Veröffentlicht: (2024)
TextPSG: Panoptic Scene Graph Generation from Textual Descriptions
von: Zhao, Chengyang, et al.
Veröffentlicht: (2023)
von: Zhao, Chengyang, et al.
Veröffentlicht: (2023)
Learning Partially-Decorrelated Common Spaces for Ad-hoc Video Search
von: Hu, Fan, et al.
Veröffentlicht: (2025)
von: Hu, Fan, et al.
Veröffentlicht: (2025)
AnomalyLMM: Bridging Generative Knowledge and Discriminative Retrieval for Text-Based Person Anomaly Search
von: Ju, Hao, et al.
Veröffentlicht: (2025)
von: Ju, Hao, et al.
Veröffentlicht: (2025)
Cross-modal Fuzzy Alignment Network for Text-Aerial Person Retrieval and A Large-scale Benchmark
von: Deng, Yifei, et al.
Veröffentlicht: (2026)
von: Deng, Yifei, et al.
Veröffentlicht: (2026)
Event Voxel Set Transformer for Spatiotemporal Representation Learning on Event Streams
von: Xie, Bochen, et al.
Veröffentlicht: (2023)
von: Xie, Bochen, et al.
Veröffentlicht: (2023)
Bootstrapping MLLM for Weakly-Supervised Class-Agnostic Object Counting
von: Zhang, Xiaowen, et al.
Veröffentlicht: (2026)
von: Zhang, Xiaowen, et al.
Veröffentlicht: (2026)
Tailored Visions: Enhancing Text-to-Image Generation with Personalized Prompt Rewriting
von: Chen, Zijie, et al.
Veröffentlicht: (2023)
von: Chen, Zijie, et al.
Veröffentlicht: (2023)
CamoSAM2: Motion-Appearance Induced Auto-Refining Prompts for Video Camouflaged Object Detection
von: Zhang, Xin, et al.
Veröffentlicht: (2025)
von: Zhang, Xin, et al.
Veröffentlicht: (2025)
Mamba-based Spatio-Frequency Motion Perception for Video Camouflaged Object Detection
von: Li, Xin, et al.
Veröffentlicht: (2025)
von: Li, Xin, et al.
Veröffentlicht: (2025)
IDAdapter: Learning Mixed Features for Tuning-Free Personalization of Text-to-Image Models
von: Cui, Siying, et al.
Veröffentlicht: (2024)
von: Cui, Siying, et al.
Veröffentlicht: (2024)
SCMM: Calibrating Cross-modal Representations for Text-Based Person Search
von: Liu, Jing, et al.
Veröffentlicht: (2023)
von: Liu, Jing, et al.
Veröffentlicht: (2023)
Dynamic Uncertainty Learning with Noisy Correspondence for Text-Based Person Search
von: Xie, Zequn, et al.
Veröffentlicht: (2025)
von: Xie, Zequn, et al.
Veröffentlicht: (2025)
Fast One-Stage Unsupervised Domain Adaptive Person Search
von: Cui, Tianxiang, et al.
Veröffentlicht: (2024)
von: Cui, Tianxiang, et al.
Veröffentlicht: (2024)
Semi-supervised Text-based Person Search
von: Gao, Daming, et al.
Veröffentlicht: (2024)
von: Gao, Daming, et al.
Veröffentlicht: (2024)
Unsupervised Integrated-Circuit Defect Segmentation via Image-Intrinsic Normality
von: Zhao, Botong, et al.
Veröffentlicht: (2025)
von: Zhao, Botong, et al.
Veröffentlicht: (2025)
SAVE: Speech-Aware Video Representation Learning for Video-Text Retrieval
von: Zhao, Ruixiang, et al.
Veröffentlicht: (2026)
von: Zhao, Ruixiang, et al.
Veröffentlicht: (2026)
CONQUER: Context-Aware Representation with Query Enhancement for Text-Based Person Search
von: Xie, Zequn
Veröffentlicht: (2026)
von: Xie, Zequn
Veröffentlicht: (2026)
Enhancing Micro Gesture Recognition for Emotion Understanding via Context-aware Visual-Text Contrastive Learning
von: Li, Deng, et al.
Veröffentlicht: (2024)
von: Li, Deng, et al.
Veröffentlicht: (2024)
Bridging the Pose-Semantic Gap: A Cascade Framework for Text-Based Person Anomaly Search
von: Xie, Zequn, et al.
Veröffentlicht: (2026)
von: Xie, Zequn, et al.
Veröffentlicht: (2026)
Enhancing Visual Representation for Text-based Person Searching
von: Shen, Wei, et al.
Veröffentlicht: (2024)
von: Shen, Wei, et al.
Veröffentlicht: (2024)
Bootstrapping Vision-language Models for Self-supervised Remote Physiological Measurement
von: Yue, Zijie, et al.
Veröffentlicht: (2024)
von: Yue, Zijie, et al.
Veröffentlicht: (2024)
Uncertainty-Aware Prototype Semantic Decoupling for Text-Based Person Search in Full Images
von: Luo, Zengli, et al.
Veröffentlicht: (2025)
von: Luo, Zengli, et al.
Veröffentlicht: (2025)
Prompting Continual Person Search
von: Zhang, Pengcheng, et al.
Veröffentlicht: (2024)
von: Zhang, Pengcheng, et al.
Veröffentlicht: (2024)
Decoupled Cross-Modal Alignment Network for Text-RGBT Person Retrieval and A High-Quality Benchmark
von: Deng, Yifei, et al.
Veröffentlicht: (2025)
von: Deng, Yifei, et al.
Veröffentlicht: (2025)
Playing to Vision Foundation Model's Strengths in Stereo Matching
von: Liu, Chuang-Wei, et al.
Veröffentlicht: (2024)
von: Liu, Chuang-Wei, et al.
Veröffentlicht: (2024)
Harnessing Weak Pair Uncertainty for Text-based Person Search
von: Sun, Jintao, et al.
Veröffentlicht: (2026)
von: Sun, Jintao, et al.
Veröffentlicht: (2026)
These Maps Are Made by Propagation: Adapting Deep Stereo Networks to Road Scenarios with Decisive Disparity Diffusion
von: Liu, Chuang-Wei, et al.
Veröffentlicht: (2024)
von: Liu, Chuang-Wei, et al.
Veröffentlicht: (2024)
Fully Exploiting Vision Foundation Model's Profound Prior Knowledge for Generalizable RGB-Depth Driving Scene Parsing
von: Guo, Sicen, et al.
Veröffentlicht: (2025)
von: Guo, Sicen, et al.
Veröffentlicht: (2025)
QEMesh: Employing A Quadric Error Metrics-Based Representation for Mesh Generation
von: Li, Jiaqi, et al.
Veröffentlicht: (2025)
von: Li, Jiaqi, et al.
Veröffentlicht: (2025)
Selectively Informative Description can Reduce Undesired Embedding Entanglements in Text-to-Image Personalization
von: Kim, Jimyeong, et al.
Veröffentlicht: (2024)
von: Kim, Jimyeong, et al.
Veröffentlicht: (2024)
TriLoRA: Integrating SVD for Advanced Style Personalization in Text-to-Image Generation
von: Feng, Chengcheng, et al.
Veröffentlicht: (2024)
von: Feng, Chengcheng, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
LoSh: Long-Short Text Joint Prediction Network for Referring Video Object Segmentation
von: Yuan, Linfeng, et al.
Veröffentlicht: (2023) -
Dynamic Patch-aware Enrichment Transformer for Occluded Person Re-Identification
von: Zhang, Xin, et al.
Veröffentlicht: (2024) -
Boosting Weak Positives for Text Based Person Search
von: Modi, Akshay, et al.
Veröffentlicht: (2025) -
Empowering Small VLMs to Think with Dynamic Memorization and Exploration
von: Liu, Jiazhen, et al.
Veröffentlicht: (2025) -
Fundus-R1: Training a Fundus-Reading MLLM with Knowledge-Aware Reasoning on Public Data
von: Deng, Yuchuan, et al.
Veröffentlicht: (2026)