MPT-PAR:Mix-Parameters Transformer for Panoramic Activity Recognition
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gan, Wenqing, Sun, Yan, Liu, Feiran, Luo, Xiangfeng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MPT: A Large-scale Multi-Phytoplankton Tracking Benchmark
par: Yu, Yang, et autres
Publié: (2024)
par: Yu, Yang, et autres
Publié: (2024)
UniPAR: A Unified Framework for Pedestrian Attribute Recognition
par: Xu, Minghe, et autres
Publié: (2026)
par: Xu, Minghe, et autres
Publié: (2026)
Logi-PAR: Logic-Infused Patient Activity Recognition via Differentiable Rule
par: Zarar, Muhammad, et autres
Publié: (2026)
par: Zarar, Muhammad, et autres
Publié: (2026)
Feature Fusion for Human Activity Recognition using Parameter-Optimized Multi-Stage Graph Convolutional Network and Transformer Models
par: Belal, Mohammad, et autres
Publié: (2024)
par: Belal, Mohammad, et autres
Publié: (2024)
VLM-PAR: A Vision Language Model for Pedestrian Attribute Recognition
par: Sellam, Abdellah Zakaria, et autres
Publié: (2025)
par: Sellam, Abdellah Zakaria, et autres
Publié: (2025)
A Lightweight Transformer for Pain Recognition from Brain Activity
par: Gkikas, Stefanos, et autres
Publié: (2026)
par: Gkikas, Stefanos, et autres
Publié: (2026)
Hybrid Generative Fusion for Efficient and Privacy-Preserving Face Recognition Dataset Generation
par: Li, Feiran, et autres
Publié: (2025)
par: Li, Feiran, et autres
Publié: (2025)
PanoTPS-Net: Panoramic Room Layout Estimation via Thin Plate Spline Transformation
par: Ibrahem, Hatem, et autres
Publié: (2025)
par: Ibrahem, Hatem, et autres
Publié: (2025)
ViTA-PAR: Visual and Textual Attribute Alignment with Attribute Prompting for Pedestrian Attribute Recognition
par: Park, Minjeong, et autres
Publié: (2025)
par: Park, Minjeong, et autres
Publié: (2025)
Non-stationary BERT: Exploring Augmented IMU Data For Robust Human Activity Recognition
par: Sun, Ning, et autres
Publié: (2024)
par: Sun, Ning, et autres
Publié: (2024)
From Narrow to Panoramic Vision: Attention-Guided Cold-Start Reshapes Multimodal Reasoning
par: Luo, Ruilin, et autres
Publié: (2026)
par: Luo, Ruilin, et autres
Publié: (2026)
Enhancing Floor Plan Recognition: A Hybrid Mix-Transformer and U-Net Approach for Precise Wall Segmentation
par: Parashchuk, Dmitriy, et autres
Publié: (2025)
par: Parashchuk, Dmitriy, et autres
Publié: (2025)
Fraesormer: Learning Adaptive Sparse Transformer for Efficient Food Recognition
par: Zou, Shun, et autres
Publié: (2025)
par: Zou, Shun, et autres
Publié: (2025)
PanoWorld: Geometry-Consistent Panoramic Video World Modeling
par: Jiang, Le, et autres
Publié: (2026)
par: Jiang, Le, et autres
Publié: (2026)
OPGAgent: An Agent for Auditable Dental Panoramic X-ray Interpretation
par: Yu, Zhaolin, et autres
Publié: (2026)
par: Yu, Zhaolin, et autres
Publié: (2026)
Unified Panoramic Geometry Estimation via Multi-View Foundation Models
par: Bozic, Vukasin, et autres
Publié: (2026)
par: Bozic, Vukasin, et autres
Publié: (2026)
Texo: Formula Recognition within 20M Parameters
par: Mao, Sicheng
Publié: (2026)
par: Mao, Sicheng
Publié: (2026)
TransFace++: Rethinking the Face Recognition Paradigm with a Focus on Accuracy, Efficiency, and Security
par: Dan, Jun, et autres
Publié: (2023)
par: Dan, Jun, et autres
Publié: (2023)
PAR: Prompt-Aware Token Reduction Method for Efficient Large Multimodal Models
par: Liu, Yingen, et autres
Publié: (2024)
par: Liu, Yingen, et autres
Publié: (2024)
CMD-HAR: Cross-Modal Disentanglement for Wearable Human Activity Recognition
par: Yu, Ying, et autres
Publié: (2025)
par: Yu, Ying, et autres
Publié: (2025)
Panoramic Distortion-Aware Tokenization for Person Detection and Localization in Overhead Fisheye Images
par: Wakai, Nobuhiko, et autres
Publié: (2025)
par: Wakai, Nobuhiko, et autres
Publié: (2025)
PanoLora: Bridging Perspective and Panoramic Video Generation with LoRA Adaptation
par: Dong, Zeyu, et autres
Publié: (2025)
par: Dong, Zeyu, et autres
Publié: (2025)
TexLiDAR: Automated Text Understanding for Panoramic LiDAR Data
par: Cohen, Naor, et autres
Publié: (2025)
par: Cohen, Naor, et autres
Publié: (2025)
SNN-PAR: Energy Efficient Pedestrian Attribute Recognition via Spiking Neural Networks
par: Wang, Haiyang, et autres
Publié: (2024)
par: Wang, Haiyang, et autres
Publié: (2024)
Decoupled Prompt-Adapter Tuning for Continual Activity Recognition
par: Fu, Di, et autres
Publié: (2024)
par: Fu, Di, et autres
Publié: (2024)
Transformer-based Models to Deal with Heterogeneous Environments in Human Activity Recognition
par: EK, Sannara, et autres
Publié: (2022)
par: EK, Sannara, et autres
Publié: (2022)
AUFormer: Vision Transformers are Parameter-Efficient Facial Action Unit Detectors
par: Yuan, Kaishen, et autres
Publié: (2024)
par: Yuan, Kaishen, et autres
Publié: (2024)
Integrating Features for Recognizing Human Activities through Optimized Parameters in Graph Convolutional Networks and Transformer Architectures
par: Belal, Mohammad, et autres
Publié: (2024)
par: Belal, Mohammad, et autres
Publié: (2024)
GI-Bench: A Panoramic Benchmark Revealing the Knowledge-Experience Dissociation of Multimodal Large Language Models in Gastrointestinal Endoscopy Against Clinical Standards
par: Zhu, Yan, et autres
Publié: (2026)
par: Zhu, Yan, et autres
Publié: (2026)
Mixed Non-linear Quantization for Vision Transformers
par: Kim, Gihwan, et autres
Publié: (2024)
par: Kim, Gihwan, et autres
Publié: (2024)
LoViT: Long Video Transformer for Surgical Phase Recognition
par: Liu, Yang, et autres
Publié: (2023)
par: Liu, Yang, et autres
Publié: (2023)
Unified-EGformer: Exposure Guided Lightweight Transformer for Mixed-Exposure Image Enhancement
par: Adhikarla, Eashan, et autres
Publié: (2024)
par: Adhikarla, Eashan, et autres
Publié: (2024)
Toward Optimal Sampling Rate Selection and Unbiased Classification for Precise Animal Activity Recognition
par: Mao, Axiu, et autres
Publié: (2026)
par: Mao, Axiu, et autres
Publié: (2026)
USAD: End-to-End Human Activity Recognition via Diffusion Model with Spatiotemporal Attention
par: Xiao, Hang, et autres
Publié: (2025)
par: Xiao, Hang, et autres
Publié: (2025)
Emotion Recognition Using Transformers with Masked Learning
par: Min, Seongjae, et autres
Publié: (2024)
par: Min, Seongjae, et autres
Publié: (2024)
Beyond Motion Primitives: Behavioral Activity Recognition from Head-Mounted IMU
par: Huang, Chung-Ta, et autres
Publié: (2026)
par: Huang, Chung-Ta, et autres
Publié: (2026)
DCMM-Transformer: Degree-Corrected Mixed-Membership Attention for Medical Imaging
par: Cheng, Huimin, et autres
Publié: (2025)
par: Cheng, Huimin, et autres
Publié: (2025)
VideoPanda: Video Panoramic Diffusion with Multi-view Attention
par: Xie, Kevin, et autres
Publié: (2025)
par: Xie, Kevin, et autres
Publié: (2025)
TxP: Reciprocal Generation of Ground Pressure Dynamics and Activity Descriptions for Improving Human Activity Recognition
par: Ray, Lala Shakti Swarup, et autres
Publié: (2025)
par: Ray, Lala Shakti Swarup, et autres
Publié: (2025)
DreamScene360: Unconstrained Text-to-3D Scene Generation with Panoramic Gaussian Splatting
par: Zhou, Shijie, et autres
Publié: (2024)
par: Zhou, Shijie, et autres
Publié: (2024)
Documents similaires
-
MPT: A Large-scale Multi-Phytoplankton Tracking Benchmark
par: Yu, Yang, et autres
Publié: (2024) -
UniPAR: A Unified Framework for Pedestrian Attribute Recognition
par: Xu, Minghe, et autres
Publié: (2026) -
Logi-PAR: Logic-Infused Patient Activity Recognition via Differentiable Rule
par: Zarar, Muhammad, et autres
Publié: (2026) -
Feature Fusion for Human Activity Recognition using Parameter-Optimized Multi-Stage Graph Convolutional Network and Transformer Models
par: Belal, Mohammad, et autres
Publié: (2024) -
VLM-PAR: A Vision Language Model for Pedestrian Attribute Recognition
par: Sellam, Abdellah Zakaria, et autres
Publié: (2025)