Pedestrian Attribute Recognition: A New Benchmark Dataset and A Large Language Model Augmented Framework
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jin, Jiandong, Wang, Xiao, Zhu, Qian, Wang, Haiyang, Li, Chenglong |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RGB-Event based Pedestrian Attribute Recognition: A Benchmark Dataset and An Asymmetric RWKV Fusion Framework
par: Wang, Xiao, et autres
Publié: (2025)
par: Wang, Xiao, et autres
Publié: (2025)
Spatio-Temporal Side Tuning Pre-trained Foundation Models for Video-based Pedestrian Attribute Recognition
par: Wang, Xiao, et autres
Publié: (2024)
par: Wang, Xiao, et autres
Publié: (2024)
Pedestrian Attribute Recognition via CLIP based Prompt Vision-Language Fusion
par: Wang, Xiao, et autres
Publié: (2023)
par: Wang, Xiao, et autres
Publié: (2023)
An Empirical Study of Mamba-based Pedestrian Attribute Recognition
par: Wang, Xiao, et autres
Publié: (2024)
par: Wang, Xiao, et autres
Publié: (2024)
SequencePAR: Understanding Pedestrian Attributes via A Sequence Generation Paradigm
par: Jin, Jiandong, et autres
Publié: (2023)
par: Jin, Jiandong, et autres
Publié: (2023)
SNN-PAR: Energy Efficient Pedestrian Attribute Recognition via Spiking Neural Networks
par: Wang, Haiyang, et autres
Publié: (2024)
par: Wang, Haiyang, et autres
Publié: (2024)
Adversarial Semantic and Label Perturbation Attack for Pedestrian Attribute Recognition
par: Kong, Weizhe, et autres
Publié: (2025)
par: Kong, Weizhe, et autres
Publié: (2025)
VideoAVE: A Multi-Attribute Video-to-Text Attribute Value Extraction Dataset and Benchmark Models
par: Cheng, Ming, et autres
Publié: (2025)
par: Cheng, Ming, et autres
Publié: (2025)
UniPAR: A Unified Framework for Pedestrian Attribute Recognition
par: Xu, Minghe, et autres
Publié: (2026)
par: Xu, Minghe, et autres
Publié: (2026)
CVLUE: A New Benchmark Dataset for Chinese Vision-Language Understanding Evaluation
par: Wang, Yuxuan, et autres
Publié: (2024)
par: Wang, Yuxuan, et autres
Publié: (2024)
ERVQA: A Dataset to Benchmark the Readiness of Large Vision Language Models in Hospital Environments
par: Ray, Sourjyadip, et autres
Publié: (2024)
par: Ray, Sourjyadip, et autres
Publié: (2024)
When Pedestrian Detection Meets Multi-Modal Learning: Generalist Model and Benchmark Dataset
par: Zhang, Yi, et autres
Publié: (2024)
par: Zhang, Yi, et autres
Publié: (2024)
Res-Bench: Benchmarking the Robustness of Multimodal Large Language Models to Dynamic Resolution Input
par: Li, Chenxu, et autres
Publié: (2025)
par: Li, Chenxu, et autres
Publié: (2025)
VLFeedback: A Large-Scale AI Feedback Dataset for Large Vision-Language Models Alignment
par: Li, Lei, et autres
Publié: (2024)
par: Li, Lei, et autres
Publié: (2024)
Uncertainty-Aware Pedestrian Attribute Recognition via Evidential Deep Learning
par: Lou, Zhuofan, et autres
Publié: (2026)
par: Lou, Zhuofan, et autres
Publié: (2026)
CiteVQA: Benchmarking Evidence Attribution for Trustworthy Document Intelligence
par: Ma, Dongsheng, et autres
Publié: (2026)
par: Ma, Dongsheng, et autres
Publié: (2026)
Benchmarking Multimodal Large Language Models for Face Recognition
par: Shahreza, Hatef Otroshi, et autres
Publié: (2025)
par: Shahreza, Hatef Otroshi, et autres
Publié: (2025)
MM-SAP: A Comprehensive Benchmark for Assessing Self-Awareness of Multimodal Large Language Models in Perception
par: Wang, Yuhao, et autres
Publié: (2024)
par: Wang, Yuhao, et autres
Publié: (2024)
Evaluating Fairness in Large Vision-Language Models Across Diverse Demographic Attributes and Prompts
par: Wu, Xuyang, et autres
Publié: (2024)
par: Wu, Xuyang, et autres
Publié: (2024)
A Survey on Benchmarks of Multimodal Large Language Models
par: Li, Jian, et autres
Publié: (2024)
par: Li, Jian, et autres
Publié: (2024)
Multimodal ArXiv: A Dataset for Improving Scientific Comprehension of Large Vision-Language Models
par: Li, Lei, et autres
Publié: (2024)
par: Li, Lei, et autres
Publié: (2024)
SPORTU: A Comprehensive Sports Understanding Benchmark for Multimodal Large Language Models
par: Xia, Haotian, et autres
Publié: (2024)
par: Xia, Haotian, et autres
Publié: (2024)
MLLM-CL: Continual Learning for Multimodal Large Language Models
par: Zhao, Hongbo, et autres
Publié: (2025)
par: Zhao, Hongbo, et autres
Publié: (2025)
A Data-Centric Approach to Pedestrian Attribute Recognition: Synthetic Augmentation via Prompt-driven Diffusion Models
par: Alonso, Alejandro, et autres
Publié: (2025)
par: Alonso, Alejandro, et autres
Publié: (2025)
VLM-PAR: A Vision Language Model for Pedestrian Attribute Recognition
par: Sellam, Abdellah Zakaria, et autres
Publié: (2025)
par: Sellam, Abdellah Zakaria, et autres
Publié: (2025)
MM-Soc: Benchmarking Multimodal Large Language Models in Social Media Platforms
par: Jin, Yiqiao, et autres
Publié: (2024)
par: Jin, Yiqiao, et autres
Publié: (2024)
Lightweight Attribute Localizing Models for Pedestrian Attribute Recognition
par: Jha, Ashish, et autres
Publié: (2023)
par: Jha, Ashish, et autres
Publié: (2023)
MER-Bench: A Comprehensive Benchmark for Multimodal Meme Reappraisal
par: Nie, Yiqi, et autres
Publié: (2026)
par: Nie, Yiqi, et autres
Publié: (2026)
URPO: A Unified Reward & Policy Optimization Framework for Large Language Models
par: Lu, Songshuo, et autres
Publié: (2025)
par: Lu, Songshuo, et autres
Publié: (2025)
Pedestrian Attribute Recognition via Hierarchical Cross-Modality HyperGraph Learning
par: Wang, Xiao, et autres
Publié: (2025)
par: Wang, Xiao, et autres
Publié: (2025)
Benchmarking Large Language Models for Image Classification of Marine Mammals
par: Qi, Yijiashun, et autres
Publié: (2024)
par: Qi, Yijiashun, et autres
Publié: (2024)
FOCUS: Fine-grained Optimization with Semantic Guided Understanding for Pedestrian Attributes Recognition
par: An, Hongyan, et autres
Publié: (2025)
par: An, Hongyan, et autres
Publié: (2025)
A Spectrum Evaluation Benchmark for Medical Multi-Modal Large Language Models
par: Liu, Jie, et autres
Publié: (2024)
par: Liu, Jie, et autres
Publié: (2024)
TUBench: Benchmarking Large Vision-Language Models on Trustworthiness with Unanswerable Questions
par: He, Xingwei, et autres
Publié: (2024)
par: He, Xingwei, et autres
Publié: (2024)
VisualSimpleQA: A Benchmark for Decoupled Evaluation of Large Vision-Language Models in Fact-Seeking Question Answering
par: Wang, Yanling, et autres
Publié: (2025)
par: Wang, Yanling, et autres
Publié: (2025)
Pedestrian Attribute Editing for Gait Recognition and Anonymization
par: Ma, Jingzhe, et autres
Publié: (2023)
par: Ma, Jingzhe, et autres
Publié: (2023)
CODIS: Benchmarking Context-Dependent Visual Comprehension for Multimodal Large Language Models
par: Luo, Fuwen, et autres
Publié: (2024)
par: Luo, Fuwen, et autres
Publié: (2024)
A Superalignment Framework in Autonomous Driving with Large Language Models
par: Kong, Xiangrui, et autres
Publié: (2024)
par: Kong, Xiangrui, et autres
Publié: (2024)
GlyphPattern: An Abstract Pattern Recognition Benchmark for Vision-Language Models
par: Wu, Zixuan, et autres
Publié: (2024)
par: Wu, Zixuan, et autres
Publié: (2024)
Rethinking Facial Expression Recognition in the Era of Multimodal Large Language Models: Benchmark, Datasets, and Beyond
par: Zhang, Fan, et autres
Publié: (2025)
par: Zhang, Fan, et autres
Publié: (2025)
Documents similaires
-
RGB-Event based Pedestrian Attribute Recognition: A Benchmark Dataset and An Asymmetric RWKV Fusion Framework
par: Wang, Xiao, et autres
Publié: (2025) -
Spatio-Temporal Side Tuning Pre-trained Foundation Models for Video-based Pedestrian Attribute Recognition
par: Wang, Xiao, et autres
Publié: (2024) -
Pedestrian Attribute Recognition via CLIP based Prompt Vision-Language Fusion
par: Wang, Xiao, et autres
Publié: (2023) -
An Empirical Study of Mamba-based Pedestrian Attribute Recognition
par: Wang, Xiao, et autres
Publié: (2024) -
SequencePAR: Understanding Pedestrian Attributes via A Sequence Generation Paradigm
par: Jin, Jiandong, et autres
Publié: (2023)