SiT-MLP: A Simple MLP with Point-wise Topology Feature Learning for Skeleton-based Action Recognition
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Shaojie, Yin, Jianqin, Dang, Yonghao, Fu, Jiajun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Generically Contrastive Spatiotemporal Representation Enhancement for 3D Skeleton Action Recognition
por: Zhang, Shaojie, et al.
Publicado: (2023)
por: Zhang, Shaojie, et al.
Publicado: (2023)
MaskSem: Semantic-Guided Masking for Learning 3D Hybrid High-Order Motion Representation
por: Wei, Wei, et al.
Publicado: (2025)
por: Wei, Wei, et al.
Publicado: (2025)
Kinematics Modeling Network for Video-based Human Pose Estimation
por: Dang, Yonghao, et al.
Publicado: (2022)
por: Dang, Yonghao, et al.
Publicado: (2022)
ActivityCLIP: Enhancing Group Activity Recognition by Mining Complementary Information from Text to Supplement Image Modality
por: Xu, Guoliang, et al.
Publicado: (2024)
por: Xu, Guoliang, et al.
Publicado: (2024)
A Two-stream Hybrid CNN-Transformer Network for Skeleton-based Human Interaction Recognition
por: Yin, Ruoqi, et al.
Publicado: (2023)
por: Yin, Ruoqi, et al.
Publicado: (2023)
MamKPD: A Simple Mamba Baseline for Real-Time 2D Keypoint Detection
por: Dang, Yonghao, et al.
Publicado: (2024)
por: Dang, Yonghao, et al.
Publicado: (2024)
SpiralMLP: A Lightweight Vision MLP Architecture
por: Mu, Haojie, et al.
Publicado: (2024)
por: Mu, Haojie, et al.
Publicado: (2024)
evMLP: An Efficient Event-Driven MLP Architecture for Vision
por: Zheng, Zhentan
Publicado: (2025)
por: Zheng, Zhentan
Publicado: (2025)
Leveraging the Video-level Semantic Consistency of Event for Audio-visual Event Localization
por: Jiang, Yuanyuan, et al.
Publicado: (2022)
por: Jiang, Yuanyuan, et al.
Publicado: (2022)
Physics-constrained Attack against Convolution-based Human Motion Prediction
por: Duan, Chengxu, et al.
Publicado: (2023)
por: Duan, Chengxu, et al.
Publicado: (2023)
Lateralization MLP: A Simple Brain-inspired Architecture for Diffusion
por: Hu, Zizhao, et al.
Publicado: (2024)
por: Hu, Zizhao, et al.
Publicado: (2024)
KAN or MLP? Point Cloud Shows the Way Forward
por: Shi, Yan, et al.
Publicado: (2025)
por: Shi, Yan, et al.
Publicado: (2025)
PointMT: Efficient Point Cloud Analysis with Hybrid MLP-Transformer Architecture
por: Zheng, Qiang, et al.
Publicado: (2024)
por: Zheng, Qiang, et al.
Publicado: (2024)
Variational Contrastive Learning for Skeleton-based Action Recognition
por: Nguyen, Dang Dinh, et al.
Publicado: (2026)
por: Nguyen, Dang Dinh, et al.
Publicado: (2026)
An Efficient MLP-based Point-guided Segmentation Network for Ore Images with Ambiguous Boundary
por: Sun, Guodong, et al.
Publicado: (2024)
por: Sun, Guodong, et al.
Publicado: (2024)
FW-GAN: Frequency-Driven Handwriting Synthesis with Wave-Modulated MLP Generator
por: Khoa, Huynh Tong Dang, et al.
Publicado: (2025)
por: Khoa, Huynh Tong Dang, et al.
Publicado: (2025)
D2-MLP: Dynamic Decomposed MLP Mixer for Medical Image Segmentation
por: Yang, Jin, et al.
Publicado: (2024)
por: Yang, Jin, et al.
Publicado: (2024)
A Sobel-Gradient MLP Baseline for Handwritten Character Recognition
por: Nouri, Azam
Publicado: (2025)
por: Nouri, Azam
Publicado: (2025)
Expressive Keypoints for Skeleton-based Action Recognition via Skeleton Transformation
por: Yang, Yijie, et al.
Publicado: (2024)
por: Yang, Yijie, et al.
Publicado: (2024)
ChebMixer: Efficient Graph Representation Learning with MLP Mixer
por: Kui, Xiaoyan, et al.
Publicado: (2024)
por: Kui, Xiaoyan, et al.
Publicado: (2024)
MLP Can Be A Good Transformer Learner
por: Lin, Sihao, et al.
Publicado: (2024)
por: Lin, Sihao, et al.
Publicado: (2024)
Adaptive MLP Pruning for Large Vision Transformers
por: Shen, Chengchao
Publicado: (2026)
por: Shen, Chengchao
Publicado: (2026)
An MLP Baseline for Handwriting Recognition Using Planar Curvature and Gradient Orientation
por: Nouri, Azam
Publicado: (2025)
por: Nouri, Azam
Publicado: (2025)
ESG-Net: Event-Aware Semantic Guided Network for Dense Audio-Visual Event Localization
por: Li, Huilai, et al.
Publicado: (2025)
por: Li, Huilai, et al.
Publicado: (2025)
ResDiT: Evoking the Intrinsic Resolution Scalability in Diffusion Transformers
por: Ma, Yiyang, et al.
Publicado: (2025)
por: Ma, Yiyang, et al.
Publicado: (2025)
PosMLP-Video: Spatial and Temporal Relative Position Encoding for Efficient Video Recognition
por: Hao, Yanbin, et al.
Publicado: (2024)
por: Hao, Yanbin, et al.
Publicado: (2024)
3DGAA: Realistic and Robust 3D Gaussian-based Adversarial Attack for Autonomous Driving
por: Zhang, Yixun, et al.
Publicado: (2025)
por: Zhang, Yixun, et al.
Publicado: (2025)
SiT: Exploring Flow and Diffusion-based Generative Models with Scalable Interpolant Transformers
por: Ma, Nanye, et al.
Publicado: (2024)
por: Ma, Nanye, et al.
Publicado: (2024)
L2HCount:Generalizing Crowd Counting from Low to High Crowd Density via Density Simulation
por: Xu, Guoliang, et al.
Publicado: (2025)
por: Xu, Guoliang, et al.
Publicado: (2025)
SkeletonContext: Skeleton-side Context Prompt Learning for Zero-Shot Skeleton-based Action Recognition
por: Wang, Ning, et al.
Publicado: (2026)
por: Wang, Ning, et al.
Publicado: (2026)
HDBN: A Novel Hybrid Dual-branch Network for Robust Skeleton-based Action Recognition
por: Liu, Jinfu, et al.
Publicado: (2024)
por: Liu, Jinfu, et al.
Publicado: (2024)
Are GNNs Worth the Effort for IoT Botnet Detection? A Comparative Study of VAE-GNN vs. ViT-MLP and VAE-MLP Approaches
por: Wasswa, Hassan, et al.
Publicado: (2025)
por: Wasswa, Hassan, et al.
Publicado: (2025)
SkeletonAgent: An Agentic Interaction Framework for Skeleton-based Action Recognition
por: Liu, Hongda, et al.
Publicado: (2025)
por: Liu, Hongda, et al.
Publicado: (2025)
GraphMLP: A Graph MLP-Like Architecture for 3D Human Pose Estimation
por: Li, Wenhao, et al.
Publicado: (2022)
por: Li, Wenhao, et al.
Publicado: (2022)
3D Skeleton-Based Action Recognition: A Review
por: Liu, Mengyuan, et al.
Publicado: (2025)
por: Liu, Mengyuan, et al.
Publicado: (2025)
PointNet with KAN versus PointNet with MLP for 3D Classification and Segmentation of Point Sets
por: Kashefi, Ali
Publicado: (2024)
por: Kashefi, Ali
Publicado: (2024)
DHRNet: A Dual-Path Hierarchical Relation Network for Multi-Person Pose Estimation
por: Dang, Yonghao, et al.
Publicado: (2024)
por: Dang, Yonghao, et al.
Publicado: (2024)
CMIP-CIL: A Cross-Modal Benchmark for Image-Point Class Incremental Learning
por: Qi, Chao, et al.
Publicado: (2025)
por: Qi, Chao, et al.
Publicado: (2025)
SkeletonX: Data-Efficient Skeleton-based Action Recognition via Cross-sample Feature Aggregation
por: Zhang, Zongye, et al.
Publicado: (2025)
por: Zhang, Zongye, et al.
Publicado: (2025)
Cross-DINO: Cross the Deep MLP and Transformer for Small Object Detection
por: Cao, Guiping, et al.
Publicado: (2025)
por: Cao, Guiping, et al.
Publicado: (2025)
Ejemplares similares
-
A Generically Contrastive Spatiotemporal Representation Enhancement for 3D Skeleton Action Recognition
por: Zhang, Shaojie, et al.
Publicado: (2023) -
MaskSem: Semantic-Guided Masking for Learning 3D Hybrid High-Order Motion Representation
por: Wei, Wei, et al.
Publicado: (2025) -
Kinematics Modeling Network for Video-based Human Pose Estimation
por: Dang, Yonghao, et al.
Publicado: (2022) -
ActivityCLIP: Enhancing Group Activity Recognition by Mining Complementary Information from Text to Supplement Image Modality
por: Xu, Guoliang, et al.
Publicado: (2024) -
A Two-stream Hybrid CNN-Transformer Network for Skeleton-based Human Interaction Recognition
por: Yin, Ruoqi, et al.
Publicado: (2023)