Transformer-Based Person Search with High-Frequency Augmentation and Multi-Wave Mixing
Fuente:
arXiv
Saved in:
| Main Authors: | Shu, Qilin, Zhang, Qixian, Zhang, Qi, Zhang, Hongyun, Miao, Duoqian, Zhao, Cairong |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Perception Activator: An intuitive and portable framework for brain cognitive exploration
by: Xu, Le, et al.
Published: (2025)
by: Xu, Le, et al.
Published: (2025)
Boosting Adversarial Transferability via Commonality-Oriented Gradient Optimization
by: Gao, Yanting, et al.
Published: (2025)
by: Gao, Yanting, et al.
Published: (2025)
Similarity Distribution based Membership Inference Attack on Person Re-identification
by: Gao, Junyao, et al.
Published: (2022)
by: Gao, Junyao, et al.
Published: (2022)
Rethinking the Zigzag Flattening for Image Reading
by: Zhao, Qingsong, et al.
Published: (2022)
by: Zhao, Qingsong, et al.
Published: (2022)
FedMinds: Privacy-Preserving Personalized Brain Visual Decoding
by: Bao, Guangyin, et al.
Published: (2024)
by: Bao, Guangyin, et al.
Published: (2024)
Markovian Scale Prediction: A New Era of Visual Autoregressive Generation
by: Zhang, Yu, et al.
Published: (2025)
by: Zhang, Yu, et al.
Published: (2025)
Enhancing Text-to-Image Diffusion Transformer via Split-Text Conditioning
by: Zhang, Yu, et al.
Published: (2025)
by: Zhang, Yu, et al.
Published: (2025)
Adaptive Visual Autoregressive Acceleration via Dual-Linkage Entropy Analysis
by: Zhang, Yu, et al.
Published: (2026)
by: Zhang, Yu, et al.
Published: (2026)
DiffPhysBA: Diffusion-based Physical Backdoor Attack against Person Re-Identification in Real-World
by: Sun, Wenli, et al.
Published: (2024)
by: Sun, Wenli, et al.
Published: (2024)
Wills Aligner: Multi-Subject Collaborative Brain Visual Decoding
by: Bao, Guangyin, et al.
Published: (2024)
by: Bao, Guangyin, et al.
Published: (2024)
MindTuner: Cross-Subject Visual Decoding with Visual Fingerprint and Semantic Correction
by: Gong, Zixuan, et al.
Published: (2024)
by: Gong, Zixuan, et al.
Published: (2024)
Attack-Augmentation Mixing-Contrastive Skeletal Representation Learning
by: Xu, Binqian, et al.
Published: (2023)
by: Xu, Binqian, et al.
Published: (2023)
Lite-Mind: Towards Efficient and Robust Brain Representation Network
by: Gong, Zixuan, et al.
Published: (2023)
by: Gong, Zixuan, et al.
Published: (2023)
Towards Effective Multi-Moving-Camera Tracking: A New Dataset and Lightweight Link Model
by: Zhang, Yanting, et al.
Published: (2023)
by: Zhang, Yanting, et al.
Published: (2023)
TreeQ: Pushing the Quantization Boundary of Diffusion Transformer via Tree-Structured Mixed-Precision Search
by: Yang, Kaicheng, et al.
Published: (2025)
by: Yang, Kaicheng, et al.
Published: (2025)
HiFiSeg: High-Frequency Information Enhanced Polyp Segmentation with Global-Local Vision Transformer
by: Ren, Jingjing, et al.
Published: (2024)
by: Ren, Jingjing, et al.
Published: (2024)
WaveNet-SF: A Hybrid Network for Retinal Disease Detection Based on Wavelet Transform in Spatial-Frequency Domain
by: Cheng, Jilan, et al.
Published: (2025)
by: Cheng, Jilan, et al.
Published: (2025)
Unsupervised Domain Adaptive Person Search via Dual Self-Calibration
by: Qi, Linfeng, et al.
Published: (2024)
by: Qi, Linfeng, et al.
Published: (2024)
DROP: Decouple Re-Identification and Human Parsing with Task-specific Features for Occluded Person Re-identification
by: Dou, Shuguang, et al.
Published: (2024)
by: Dou, Shuguang, et al.
Published: (2024)
WaveFace: Authentic Face Restoration with Efficient Frequency Recovery
by: Miao, Yunqi, et al.
Published: (2024)
by: Miao, Yunqi, et al.
Published: (2024)
Frequency Guidance Matters: Skeletal Action Recognition by Frequency-Aware Mixed Transformer
by: Wu, Wenhan, et al.
Published: (2024)
by: Wu, Wenhan, et al.
Published: (2024)
Dynamic Patch-aware Enrichment Transformer for Occluded Person Re-Identification
by: Zhang, Xin, et al.
Published: (2024)
by: Zhang, Xin, et al.
Published: (2024)
Frequency Domain Modality-invariant Feature Learning for Visible-infrared Person Re-Identification
by: Li, Yulin, et al.
Published: (2024)
by: Li, Yulin, et al.
Published: (2024)
Prompting Continual Person Search
by: Zhang, Pengcheng, et al.
Published: (2024)
by: Zhang, Pengcheng, et al.
Published: (2024)
Adaptive High-Frequency Preprocessing for Video Coding
by: Pang, Yingxue, et al.
Published: (2025)
by: Pang, Yingxue, et al.
Published: (2025)
MLIP: Efficient Multi-Perspective Language-Image Pretraining with Exhaustive Data Utilization
by: Zhang, Yu, et al.
Published: (2024)
by: Zhang, Yu, et al.
Published: (2024)
Distill, Diffuse, and Semanticize (DDS): Annotation-Free 3D Scene Understanding Based on Multi-Granularity Distillation and Graph-Diffusion-Based Segmentation
by: Wang, Yijing, et al.
Published: (2026)
by: Wang, Yijing, et al.
Published: (2026)
GS4Buildings: Prior-Guided Gaussian Splatting for 3D Building Reconstruction
by: Zhang, Qilin, et al.
Published: (2025)
by: Zhang, Qilin, et al.
Published: (2025)
WaveFormer: Frequency-Time Decoupled Vision Modeling with Wave Equation
by: Shu, Zishan, et al.
Published: (2026)
by: Shu, Zishan, et al.
Published: (2026)
AnomalyLMM: Bridging Generative Knowledge and Discriminative Retrieval for Text-Based Person Anomaly Search
by: Ju, Hao, et al.
Published: (2025)
by: Ju, Hao, et al.
Published: (2025)
MediAug: Exploring Visual Augmentation in Medical Imaging
by: Qi, Xuyin, et al.
Published: (2025)
by: Qi, Xuyin, et al.
Published: (2025)
Text-promptable Object Counting via Quantity Awareness Enhancement
by: Shi, Miaojing, et al.
Published: (2025)
by: Shi, Miaojing, et al.
Published: (2025)
Bootstrapping MLLM for Weakly-Supervised Class-Agnostic Object Counting
by: Zhang, Xiaowen, et al.
Published: (2026)
by: Zhang, Xiaowen, et al.
Published: (2026)
FSATFusion: Frequency-Spatial Attention Transformer for Infrared and Visible Image Fusion
by: Zhang, Tianpei, et al.
Published: (2025)
by: Zhang, Tianpei, et al.
Published: (2025)
Uncertainty-Aware Prototype Semantic Decoupling for Text-Based Person Search in Full Images
by: Luo, Zengli, et al.
Published: (2025)
by: Luo, Zengli, et al.
Published: (2025)
Tile Classification Based Viewport Prediction with Multi-modal Fusion Transformer
by: Zhang, Zhihao, et al.
Published: (2023)
by: Zhang, Zhihao, et al.
Published: (2023)
SCMM: Calibrating Cross-modal Representations for Text-Based Person Search
by: Liu, Jing, et al.
Published: (2023)
by: Liu, Jing, et al.
Published: (2023)
FreDFT: Frequency Domain Fusion Transformer for Visible-Infrared Object Detection
by: Wu, Wencong, et al.
Published: (2025)
by: Wu, Wencong, et al.
Published: (2025)
DiVE: Efficient Multi-View Driving Scenes Generation Based on Video Diffusion Transformer
by: Jiang, Junpeng, et al.
Published: (2025)
by: Jiang, Junpeng, et al.
Published: (2025)
Towards Fully Decoupled End-to-End Person Search
by: Zhang, Pengcheng, et al.
Published: (2023)
by: Zhang, Pengcheng, et al.
Published: (2023)
Similar Items
-
Perception Activator: An intuitive and portable framework for brain cognitive exploration
by: Xu, Le, et al.
Published: (2025) -
Boosting Adversarial Transferability via Commonality-Oriented Gradient Optimization
by: Gao, Yanting, et al.
Published: (2025) -
Similarity Distribution based Membership Inference Attack on Person Re-identification
by: Gao, Junyao, et al.
Published: (2022) -
Rethinking the Zigzag Flattening for Image Reading
by: Zhao, Qingsong, et al.
Published: (2022) -
FedMinds: Privacy-Preserving Personalized Brain Visual Decoding
by: Bao, Guangyin, et al.
Published: (2024)