From Data Deluge to Data Curation: A Filtering-WoRA Paradigm for Efficient Text-based Person Search
Fuente:
arXiv
Salvato in:
| Autori principali: | Sun, Jintao, Fei, Hao, Zheng, Zhedong, Ding, Gangyi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Harnessing Weak Pair Uncertainty for Text-based Person Search
di: Sun, Jintao, et al.
Pubblicazione: (2026)
di: Sun, Jintao, et al.
Pubblicazione: (2026)
Beyond Walking: A Large-Scale Image-Text Benchmark for Text-based Person Anomaly Search
di: Yang, Shuyu, et al.
Pubblicazione: (2024)
di: Yang, Shuyu, et al.
Pubblicazione: (2024)
CAMeL: Cross-modality Adaptive Meta-Learning for Text-based Person Retrieval
di: Yu, Hang, et al.
Pubblicazione: (2025)
di: Yu, Hang, et al.
Pubblicazione: (2025)
Efficient Vision Language Model Fine-tuning for Text-based Person Anomaly Search
di: He, Jiayi, et al.
Pubblicazione: (2025)
di: He, Jiayi, et al.
Pubblicazione: (2025)
Echo Planning for Autonomous Driving: From Current Observations to Future Trajectories and Back
di: Sun, Jintao, et al.
Pubblicazione: (2025)
di: Sun, Jintao, et al.
Pubblicazione: (2025)
Towards Natural Language-Guided Drones: GeoText-1652 Benchmark with Spatial Relation Matching
di: Chu, Meng, et al.
Pubblicazione: (2023)
di: Chu, Meng, et al.
Pubblicazione: (2023)
Uncertainty-Aware Trajectory Prediction: A Unified Framework Harnessing Positional and Semantic Uncertainties
di: Sun, Jintao, et al.
Pubblicazione: (2026)
di: Sun, Jintao, et al.
Pubblicazione: (2026)
Every Painting Awakened: A Training-free Framework for Painting-to-Animation Generation
di: Liu, Lingyu, et al.
Pubblicazione: (2025)
di: Liu, Lingyu, et al.
Pubblicazione: (2025)
Can Video Diffusion Models Predict Past Frames? Bidirectional Cycle Consistency for Reversible Interpolation
di: Liu, Lingyu, et al.
Pubblicazione: (2026)
di: Liu, Lingyu, et al.
Pubblicazione: (2026)
SEED: A Benchmark Dataset for Sequential Facial Attribute Editing with Diffusion Models
di: Zhu, Yule, et al.
Pubblicazione: (2025)
di: Zhu, Yule, et al.
Pubblicazione: (2025)
Look, Compare and Draw: Differential Query Transformer for Automatic Oil Painting
di: Liu, Lingyu, et al.
Pubblicazione: (2026)
di: Liu, Lingyu, et al.
Pubblicazione: (2026)
ROGLE: Robust Global-Local Alignment with Automated Region Supervision for Text-Based Person Search
di: Xie, Zequn, et al.
Pubblicazione: (2026)
di: Xie, Zequn, et al.
Pubblicazione: (2026)
Bridging the Pose-Semantic Gap: A Cascade Framework for Text-Based Person Anomaly Search
di: Xie, Zequn, et al.
Pubblicazione: (2026)
di: Xie, Zequn, et al.
Pubblicazione: (2026)
Scaling and Masking: A New Paradigm of Data Sampling for Image and Video Quality Assessment
di: Liu, Yongxu, et al.
Pubblicazione: (2024)
di: Liu, Yongxu, et al.
Pubblicazione: (2024)
WoW: Towards a World omniscient World model Through Embodied Interaction
di: Chi, Xiaowei, et al.
Pubblicazione: (2025)
di: Chi, Xiaowei, et al.
Pubblicazione: (2025)
Can Vision-Language Models Think from the Sky? Unifying UAV Reasoning and Generation
di: Sun, Jintao, et al.
Pubblicazione: (2026)
di: Sun, Jintao, et al.
Pubblicazione: (2026)
Long Video Diffusion Generation with Segmented Cross-Attention and Content-Rich Video Data Curation
di: Yan, Xin, et al.
Pubblicazione: (2024)
di: Yan, Xin, et al.
Pubblicazione: (2024)
A Novel FACS-Aligned Anatomical Text Description Paradigm for Fine-Grained Facial Behavior Synthesis
di: Wang, Jiahe, et al.
Pubblicazione: (2026)
di: Wang, Jiahe, et al.
Pubblicazione: (2026)
Noisy-Correspondence Learning for Text-to-Image Person Re-identification
di: Qin, Yang, et al.
Pubblicazione: (2023)
di: Qin, Yang, et al.
Pubblicazione: (2023)
GAOT: Generating Articulated Objects Through Text-Guided Diffusion Models
di: Sun, Hao, et al.
Pubblicazione: (2025)
di: Sun, Hao, et al.
Pubblicazione: (2025)
SegTalker: Segmentation-based Talking Face Generation with Mask-guided Local Editing
di: Xiong, Lingyu, et al.
Pubblicazione: (2024)
di: Xiong, Lingyu, et al.
Pubblicazione: (2024)
SequencePAR: Understanding Pedestrian Attributes via A Sequence Generation Paradigm
di: Jin, Jiandong, et al.
Pubblicazione: (2023)
di: Jin, Jiandong, et al.
Pubblicazione: (2023)
MHAD: Multimodal Home Activity Dataset with Multi-Angle Videos and Synchronized Physiological Signals
di: Yu, Lei, et al.
Pubblicazione: (2024)
di: Yu, Lei, et al.
Pubblicazione: (2024)
Magic3DSketch: Create Colorful 3D Models From Sketch-Based 3D Modeling Guided by Text and Language-Image Pre-Training
di: Zang, Ying, et al.
Pubblicazione: (2024)
di: Zang, Ying, et al.
Pubblicazione: (2024)
Can Multimodal Large Language Models Understand Spatial Relations?
di: Liu, Jingping, et al.
Pubblicazione: (2025)
di: Liu, Jingping, et al.
Pubblicazione: (2025)
Prompt-aware of Frame Sampling for Efficient Text-Video Retrieval
di: Zhang, Deyu, et al.
Pubblicazione: (2025)
di: Zhang, Deyu, et al.
Pubblicazione: (2025)
CBVS: A Large-Scale Chinese Image-Text Benchmark for Real-World Short Video Search Scenarios
di: Qiao, Xiangshuo, et al.
Pubblicazione: (2024)
di: Qiao, Xiangshuo, et al.
Pubblicazione: (2024)
ProFD: Prompt-Guided Feature Disentangling for Occluded Person Re-Identification
di: Cui, Can, et al.
Pubblicazione: (2024)
di: Cui, Can, et al.
Pubblicazione: (2024)
Pre-training CLIP against Data Poisoning with Optimal Transport-based Matching and Alignment
di: Zhang, Tong, et al.
Pubblicazione: (2025)
di: Zhang, Tong, et al.
Pubblicazione: (2025)
Text-Only Data Synthesis for Vision Language Model Training
di: Yu, Xiaomin, et al.
Pubblicazione: (2025)
di: Yu, Xiaomin, et al.
Pubblicazione: (2025)
EDGE-Shield: Efficient Denoising-staGE Shield for Violative Content Filtering via Scalable Reference-Based Matching
di: Taniguchi, Takara, et al.
Pubblicazione: (2026)
di: Taniguchi, Takara, et al.
Pubblicazione: (2026)
Through Their Eyes: Fixation-aligned Tuning for Personalized User Emulation
di: Huang, Lingfeng, et al.
Pubblicazione: (2026)
di: Huang, Lingfeng, et al.
Pubblicazione: (2026)
CoSyncDiT: Cognitive Synchronous Diffusion Transformer for Movie Dubbing
di: Cong, Gaoxiang, et al.
Pubblicazione: (2026)
di: Cong, Gaoxiang, et al.
Pubblicazione: (2026)
Seeing Text in the Dark: Algorithm and Benchmark
di: Xu, Chengpei, et al.
Pubblicazione: (2024)
di: Xu, Chengpei, et al.
Pubblicazione: (2024)
Anchoring Emotions in Text: Robust Multimodal Fusion for Mimicry Intensity Estimation
di: Zhu, Lingsi, et al.
Pubblicazione: (2026)
di: Zhu, Lingsi, et al.
Pubblicazione: (2026)
Robust Duality Learning for Unsupervised Visible-Infrared Person Re-Identification
di: Li, Yongxiang, et al.
Pubblicazione: (2025)
di: Li, Yongxiang, et al.
Pubblicazione: (2025)
Hand1000: Generating Realistic Hands from Text with Only 1,000 Images
di: Zhang, Haozhuo, et al.
Pubblicazione: (2024)
di: Zhang, Haozhuo, et al.
Pubblicazione: (2024)
TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning
di: Xie, Jingjing, et al.
Pubblicazione: (2024)
di: Xie, Jingjing, et al.
Pubblicazione: (2024)
Class Agnostic Instance-level Descriptor for Visual Instance Search
di: Sun, Qi-Ying, et al.
Pubblicazione: (2025)
di: Sun, Qi-Ying, et al.
Pubblicazione: (2025)
CI-ICM: Channel Importance-driven Learned Image Coding for Machines
di: Zhang, Yun, et al.
Pubblicazione: (2026)
di: Zhang, Yun, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Harnessing Weak Pair Uncertainty for Text-based Person Search
di: Sun, Jintao, et al.
Pubblicazione: (2026) -
Beyond Walking: A Large-Scale Image-Text Benchmark for Text-based Person Anomaly Search
di: Yang, Shuyu, et al.
Pubblicazione: (2024) -
CAMeL: Cross-modality Adaptive Meta-Learning for Text-based Person Retrieval
di: Yu, Hang, et al.
Pubblicazione: (2025) -
Efficient Vision Language Model Fine-tuning for Text-based Person Anomaly Search
di: He, Jiayi, et al.
Pubblicazione: (2025) -
Echo Planning for Autonomous Driving: From Current Observations to Future Trajectories and Back
di: Sun, Jintao, et al.
Pubblicazione: (2025)