Guardado en:
| Autores principales: | Deng, Yuchuan, Hu, Zhanpeng, Xin, Zijie, Deng, Chuang, Zhao, Qijun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2405.07459 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LoSh: Long-Short Text Joint Prediction Network for Referring Video Object Segmentation
por: Yuan, Linfeng, et al.
Publicado: (2023)
por: Yuan, Linfeng, et al.
Publicado: (2023)
Dynamic Patch-aware Enrichment Transformer for Occluded Person Re-Identification
por: Zhang, Xin, et al.
Publicado: (2024)
por: Zhang, Xin, et al.
Publicado: (2024)
Boosting Weak Positives for Text Based Person Search
por: Modi, Akshay, et al.
Publicado: (2025)
por: Modi, Akshay, et al.
Publicado: (2025)
Empowering Small VLMs to Think with Dynamic Memorization and Exploration
por: Liu, Jiazhen, et al.
Publicado: (2025)
por: Liu, Jiazhen, et al.
Publicado: (2025)
Fundus-R1: Training a Fundus-Reading MLLM with Knowledge-Aware Reasoning on Public Data
por: Deng, Yuchuan, et al.
Publicado: (2026)
por: Deng, Yuchuan, et al.
Publicado: (2026)
Hierarchical Generative Network for Face Morphing Attacks
por: He, Zuyuan, et al.
Publicado: (2024)
por: He, Zuyuan, et al.
Publicado: (2024)
Optimal-Landmark-Guided Image Blending for Face Morphing Attacks
por: He, Qiaoyun, et al.
Publicado: (2024)
por: He, Qiaoyun, et al.
Publicado: (2024)
MINDiff: Mask-Integrated Negative Attention for Controlling Overfitting in Text-to-Image Personalization
por: Jeong, Seulgi, et al.
Publicado: (2025)
por: Jeong, Seulgi, et al.
Publicado: (2025)
XHand: Real-time Expressive Hand Avatar
por: Gan, Qijun, et al.
Publicado: (2024)
por: Gan, Qijun, et al.
Publicado: (2024)
TextPSG: Panoptic Scene Graph Generation from Textual Descriptions
por: Zhao, Chengyang, et al.
Publicado: (2023)
por: Zhao, Chengyang, et al.
Publicado: (2023)
Learning Partially-Decorrelated Common Spaces for Ad-hoc Video Search
por: Hu, Fan, et al.
Publicado: (2025)
por: Hu, Fan, et al.
Publicado: (2025)
AnomalyLMM: Bridging Generative Knowledge and Discriminative Retrieval for Text-Based Person Anomaly Search
por: Ju, Hao, et al.
Publicado: (2025)
por: Ju, Hao, et al.
Publicado: (2025)
Cross-modal Fuzzy Alignment Network for Text-Aerial Person Retrieval and A Large-scale Benchmark
por: Deng, Yifei, et al.
Publicado: (2026)
por: Deng, Yifei, et al.
Publicado: (2026)
Event Voxel Set Transformer for Spatiotemporal Representation Learning on Event Streams
por: Xie, Bochen, et al.
Publicado: (2023)
por: Xie, Bochen, et al.
Publicado: (2023)
Bootstrapping MLLM for Weakly-Supervised Class-Agnostic Object Counting
por: Zhang, Xiaowen, et al.
Publicado: (2026)
por: Zhang, Xiaowen, et al.
Publicado: (2026)
Tailored Visions: Enhancing Text-to-Image Generation with Personalized Prompt Rewriting
por: Chen, Zijie, et al.
Publicado: (2023)
por: Chen, Zijie, et al.
Publicado: (2023)
CamoSAM2: Motion-Appearance Induced Auto-Refining Prompts for Video Camouflaged Object Detection
por: Zhang, Xin, et al.
Publicado: (2025)
por: Zhang, Xin, et al.
Publicado: (2025)
Mamba-based Spatio-Frequency Motion Perception for Video Camouflaged Object Detection
por: Li, Xin, et al.
Publicado: (2025)
por: Li, Xin, et al.
Publicado: (2025)
IDAdapter: Learning Mixed Features for Tuning-Free Personalization of Text-to-Image Models
por: Cui, Siying, et al.
Publicado: (2024)
por: Cui, Siying, et al.
Publicado: (2024)
SCMM: Calibrating Cross-modal Representations for Text-Based Person Search
por: Liu, Jing, et al.
Publicado: (2023)
por: Liu, Jing, et al.
Publicado: (2023)
Dynamic Uncertainty Learning with Noisy Correspondence for Text-Based Person Search
por: Xie, Zequn, et al.
Publicado: (2025)
por: Xie, Zequn, et al.
Publicado: (2025)
Fast One-Stage Unsupervised Domain Adaptive Person Search
por: Cui, Tianxiang, et al.
Publicado: (2024)
por: Cui, Tianxiang, et al.
Publicado: (2024)
Semi-supervised Text-based Person Search
por: Gao, Daming, et al.
Publicado: (2024)
por: Gao, Daming, et al.
Publicado: (2024)
Unsupervised Integrated-Circuit Defect Segmentation via Image-Intrinsic Normality
por: Zhao, Botong, et al.
Publicado: (2025)
por: Zhao, Botong, et al.
Publicado: (2025)
SAVE: Speech-Aware Video Representation Learning for Video-Text Retrieval
por: Zhao, Ruixiang, et al.
Publicado: (2026)
por: Zhao, Ruixiang, et al.
Publicado: (2026)
CONQUER: Context-Aware Representation with Query Enhancement for Text-Based Person Search
por: Xie, Zequn
Publicado: (2026)
por: Xie, Zequn
Publicado: (2026)
Enhancing Micro Gesture Recognition for Emotion Understanding via Context-aware Visual-Text Contrastive Learning
por: Li, Deng, et al.
Publicado: (2024)
por: Li, Deng, et al.
Publicado: (2024)
Bridging the Pose-Semantic Gap: A Cascade Framework for Text-Based Person Anomaly Search
por: Xie, Zequn, et al.
Publicado: (2026)
por: Xie, Zequn, et al.
Publicado: (2026)
Enhancing Visual Representation for Text-based Person Searching
por: Shen, Wei, et al.
Publicado: (2024)
por: Shen, Wei, et al.
Publicado: (2024)
Bootstrapping Vision-language Models for Self-supervised Remote Physiological Measurement
por: Yue, Zijie, et al.
Publicado: (2024)
por: Yue, Zijie, et al.
Publicado: (2024)
Uncertainty-Aware Prototype Semantic Decoupling for Text-Based Person Search in Full Images
por: Luo, Zengli, et al.
Publicado: (2025)
por: Luo, Zengli, et al.
Publicado: (2025)
Prompting Continual Person Search
por: Zhang, Pengcheng, et al.
Publicado: (2024)
por: Zhang, Pengcheng, et al.
Publicado: (2024)
Decoupled Cross-Modal Alignment Network for Text-RGBT Person Retrieval and A High-Quality Benchmark
por: Deng, Yifei, et al.
Publicado: (2025)
por: Deng, Yifei, et al.
Publicado: (2025)
Playing to Vision Foundation Model's Strengths in Stereo Matching
por: Liu, Chuang-Wei, et al.
Publicado: (2024)
por: Liu, Chuang-Wei, et al.
Publicado: (2024)
Harnessing Weak Pair Uncertainty for Text-based Person Search
por: Sun, Jintao, et al.
Publicado: (2026)
por: Sun, Jintao, et al.
Publicado: (2026)
These Maps Are Made by Propagation: Adapting Deep Stereo Networks to Road Scenarios with Decisive Disparity Diffusion
por: Liu, Chuang-Wei, et al.
Publicado: (2024)
por: Liu, Chuang-Wei, et al.
Publicado: (2024)
Fully Exploiting Vision Foundation Model's Profound Prior Knowledge for Generalizable RGB-Depth Driving Scene Parsing
por: Guo, Sicen, et al.
Publicado: (2025)
por: Guo, Sicen, et al.
Publicado: (2025)
QEMesh: Employing A Quadric Error Metrics-Based Representation for Mesh Generation
por: Li, Jiaqi, et al.
Publicado: (2025)
por: Li, Jiaqi, et al.
Publicado: (2025)
Selectively Informative Description can Reduce Undesired Embedding Entanglements in Text-to-Image Personalization
por: Kim, Jimyeong, et al.
Publicado: (2024)
por: Kim, Jimyeong, et al.
Publicado: (2024)
TriLoRA: Integrating SVD for Advanced Style Personalization in Text-to-Image Generation
por: Feng, Chengcheng, et al.
Publicado: (2024)
por: Feng, Chengcheng, et al.
Publicado: (2024)
Ejemplares similares
-
LoSh: Long-Short Text Joint Prediction Network for Referring Video Object Segmentation
por: Yuan, Linfeng, et al.
Publicado: (2023) -
Dynamic Patch-aware Enrichment Transformer for Occluded Person Re-Identification
por: Zhang, Xin, et al.
Publicado: (2024) -
Boosting Weak Positives for Text Based Person Search
por: Modi, Akshay, et al.
Publicado: (2025) -
Empowering Small VLMs to Think with Dynamic Memorization and Exploration
por: Liu, Jiazhen, et al.
Publicado: (2025) -
Fundus-R1: Training a Fundus-Reading MLLM with Knowledge-Aware Reasoning on Public Data
por: Deng, Yuchuan, et al.
Publicado: (2026)