UFineBench: Towards Text-based Person Retrieval with Ultra-fine Granularity
Fuente:
arXiv
Guardado en:
| Autores principales: | Zuo, Jialong, Zhou, Hanyu, Nie, Ying, Zhang, Feng, Guo, Tianyu, Sang, Nong, Wang, Yunhe, Gao, Changxin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Cross-video Identity Correlating for Person Re-identification Pre-training
por: Zuo, Jialong, et al.
Publicado: (2024)
por: Zuo, Jialong, et al.
Publicado: (2024)
PLIP: Language-Image Pre-training for Person Representation Learning
por: Zuo, Jialong, et al.
Publicado: (2023)
por: Zuo, Jialong, et al.
Publicado: (2023)
Partial Forward Blocking: A Novel Data Pruning Paradigm for Lossless Training Acceleration
por: Wu, Dongyue, et al.
Publicado: (2025)
por: Wu, Dongyue, et al.
Publicado: (2025)
Holmes-VAU: Towards Long-term Video Anomaly Understanding at Any Granularity
por: Zhang, Huaxin, et al.
Publicado: (2024)
por: Zhang, Huaxin, et al.
Publicado: (2024)
Spatial Cascaded Clustering and Weighted Memory for Unsupervised Person Re-identification
por: Hong, Jiahao, et al.
Publicado: (2024)
por: Hong, Jiahao, et al.
Publicado: (2024)
ReID5o: Achieving Omni Multi-modal Person Re-identification in a Single Model
por: Zuo, Jialong, et al.
Publicado: (2025)
por: Zuo, Jialong, et al.
Publicado: (2025)
DFIMat: Decoupled Flexible Interactive Matting in Multi-Person Scenarios
por: Jiao, Siyi, et al.
Publicado: (2024)
por: Jiao, Siyi, et al.
Publicado: (2024)
Holmes-VAD: Towards Unbiased and Explainable Video Anomaly Detection via Multi-modal LLM
por: Zhang, Huaxin, et al.
Publicado: (2024)
por: Zhang, Huaxin, et al.
Publicado: (2024)
REPAIR: Rank Correlation and Noisy Pair Half-replacing with Memory for Noisy Correspondence
por: Zheng, Ruochen, et al.
Publicado: (2024)
por: Zheng, Ruochen, et al.
Publicado: (2024)
Structural Pruning via Spatial-aware Information Redundancy for Semantic Segmentation
por: Wu, Dongyue, et al.
Publicado: (2024)
por: Wu, Dongyue, et al.
Publicado: (2024)
Is Nano Banana Pro a Low-Level Vision All-Rounder? A Comprehensive Evaluation on 14 Tasks and 40 Datasets
por: Zuo, Jialong, et al.
Publicado: (2025)
por: Zuo, Jialong, et al.
Publicado: (2025)
Learning to Tell Apart: Weakly Supervised Video Anomaly Detection via Disentangled Semantic Alignment
por: Yin, Wenti, et al.
Publicado: (2025)
por: Yin, Wenti, et al.
Publicado: (2025)
VideoLucy: Deep Memory Backtracking for Long Video Understanding
por: Zuo, Jialong, et al.
Publicado: (2025)
por: Zuo, Jialong, et al.
Publicado: (2025)
Object-Aware Video Matting with Cross-Frame Guidance
por: Zhang, Huayu, et al.
Publicado: (2025)
por: Zhang, Huayu, et al.
Publicado: (2025)
Lookup Table meets Local Laplacian Filter: Pyramid Reconstruction Network for Tone Mapping
por: Zhang, Feng, et al.
Publicado: (2023)
por: Zhang, Feng, et al.
Publicado: (2023)
SCTNet: Single-Branch CNN with Transformer Semantic Information for Real-Time Segmentation
por: Xu, Zhengze, et al.
Publicado: (2023)
por: Xu, Zhengze, et al.
Publicado: (2023)
Open-Vocabulary Semantic Segmentation with Image Embedding Balancing
por: Shan, Xiangheng, et al.
Publicado: (2024)
por: Shan, Xiangheng, et al.
Publicado: (2024)
Adaptive Prototype Replay for Class Incremental Semantic Segmentation
por: Zhu, Guilin, et al.
Publicado: (2024)
por: Zhu, Guilin, et al.
Publicado: (2024)
HR-Pro: Point-supervised Temporal Action Localization via Hierarchical Reliability Propagation
por: Zhang, Huaxin, et al.
Publicado: (2023)
por: Zhang, Huaxin, et al.
Publicado: (2023)
Towards Reliable and Holistic Visual In-Context Learning Prompt Selection
por: Wu, Wenxiao, et al.
Publicado: (2025)
por: Wu, Wenxiao, et al.
Publicado: (2025)
Learning Unpaired Image Dehazing with Physics-based Rehazy Generation
por: Deng, Haoyou, et al.
Publicado: (2025)
por: Deng, Haoyou, et al.
Publicado: (2025)
Text-based Aerial-Ground Person Retrieval
por: Zhou, Xinyu, et al.
Publicado: (2025)
por: Zhou, Xinyu, et al.
Publicado: (2025)
DenseGRPO: From Sparse to Dense Reward for Flow Matching Model Alignment
por: Deng, Haoyou, et al.
Publicado: (2026)
por: Deng, Haoyou, et al.
Publicado: (2026)
CLIP-guided Prototype Modulating for Few-shot Action Recognition
por: Wang, Xiang, et al.
Publicado: (2023)
por: Wang, Xiang, et al.
Publicado: (2023)
UniAnimate-DiT: Human Image Animation with Large-Scale Video Diffusion Transformer
por: Wang, Xiang, et al.
Publicado: (2025)
por: Wang, Xiang, et al.
Publicado: (2025)
UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation
por: Wang, Xiang, et al.
Publicado: (2024)
por: Wang, Xiang, et al.
Publicado: (2024)
CFinBench: A Comprehensive Chinese Financial Benchmark for Large Language Models
por: Nie, Ying, et al.
Publicado: (2024)
por: Nie, Ying, et al.
Publicado: (2024)
SlimLLM: Accurate Structured Pruning for Large Language Models
por: Guo, Jialong, et al.
Publicado: (2025)
por: Guo, Jialong, et al.
Publicado: (2025)
SLAB: Efficient Transformers with Simplified Linear Attention and Progressive Re-parameterized Batch Normalization
por: Guo, Jialong, et al.
Publicado: (2024)
por: Guo, Jialong, et al.
Publicado: (2024)
VersatileFFN: Achieving Parameter Efficiency in LLMs via Adaptive Wide-and-Deep Reuse
por: Nie, Ying, et al.
Publicado: (2025)
por: Nie, Ying, et al.
Publicado: (2025)
MP-Mat: A 3D-and-Instance-Aware Human Matting and Editing Framework with Multiplane Representation
por: Jiao, Siyi, et al.
Publicado: (2025)
por: Jiao, Siyi, et al.
Publicado: (2025)
Benchmark Granularity and Model Robustness for Image-Text Retrieval
por: Hendriksen, Mariya, et al.
Publicado: (2024)
por: Hendriksen, Mariya, et al.
Publicado: (2024)
Taming Consistency Distillation for Accelerated Human Image Animation
por: Wang, Xiang, et al.
Publicado: (2025)
por: Wang, Xiang, et al.
Publicado: (2025)
Tactile-based Object Retrieval From Granular Media
por: Xu, Jingxi, et al.
Publicado: (2024)
por: Xu, Jingxi, et al.
Publicado: (2024)
IDA-Bench: Evaluating LLMs on Interactive Guided Data Analysis
por: Li, Hanyu, et al.
Publicado: (2025)
por: Li, Hanyu, et al.
Publicado: (2025)
Premier: Personalized Preference Modulation with Learnable User Embedding in Text-to-Image Generation
por: Wang, Zihao, et al.
Publicado: (2026)
por: Wang, Zihao, et al.
Publicado: (2026)
Data Augmentation for Text-based Person Retrieval Using Large Language Models
por: Li, Zheng, et al.
Publicado: (2024)
por: Li, Zheng, et al.
Publicado: (2024)
PhotoBench: Beyond Visual Matching Towards Personalized Intent-Driven Photo Retrieval
por: Xu, Tianyi, et al.
Publicado: (2026)
por: Xu, Tianyi, et al.
Publicado: (2026)
MobileSpeech: A Fast and High-Fidelity Framework for Mobile Zero-Shot Text-to-Speech
por: Ji, Shengpeng, et al.
Publicado: (2024)
por: Ji, Shengpeng, et al.
Publicado: (2024)
AVGen-Bench: A Task-Driven Benchmark for Multi-Granular Evaluation of Text-to-Audio-Video Generation
por: Zhou, Ziwei, et al.
Publicado: (2026)
por: Zhou, Ziwei, et al.
Publicado: (2026)
Ejemplares similares
-
Cross-video Identity Correlating for Person Re-identification Pre-training
por: Zuo, Jialong, et al.
Publicado: (2024) -
PLIP: Language-Image Pre-training for Person Representation Learning
por: Zuo, Jialong, et al.
Publicado: (2023) -
Partial Forward Blocking: A Novel Data Pruning Paradigm for Lossless Training Acceleration
por: Wu, Dongyue, et al.
Publicado: (2025) -
Holmes-VAU: Towards Long-term Video Anomaly Understanding at Any Granularity
por: Zhang, Huaxin, et al.
Publicado: (2024) -
Spatial Cascaded Clustering and Weighted Memory for Unsupervised Person Re-identification
por: Hong, Jiahao, et al.
Publicado: (2024)