SiT-MLP: A Simple MLP with Point-wise Topology Feature Learning for Skeleton-based Action Recognition
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Shaojie, Yin, Jianqin, Dang, Yonghao, Fu, Jiajun |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2023
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
A Generically Contrastive Spatiotemporal Representation Enhancement for 3D Skeleton Action Recognition
von: Zhang, Shaojie, et al.
Veröffentlicht: (2023)
von: Zhang, Shaojie, et al.
Veröffentlicht: (2023)
MaskSem: Semantic-Guided Masking for Learning 3D Hybrid High-Order Motion Representation
von: Wei, Wei, et al.
Veröffentlicht: (2025)
von: Wei, Wei, et al.
Veröffentlicht: (2025)
Kinematics Modeling Network for Video-based Human Pose Estimation
von: Dang, Yonghao, et al.
Veröffentlicht: (2022)
von: Dang, Yonghao, et al.
Veröffentlicht: (2022)
ActivityCLIP: Enhancing Group Activity Recognition by Mining Complementary Information from Text to Supplement Image Modality
von: Xu, Guoliang, et al.
Veröffentlicht: (2024)
von: Xu, Guoliang, et al.
Veröffentlicht: (2024)
A Two-stream Hybrid CNN-Transformer Network for Skeleton-based Human Interaction Recognition
von: Yin, Ruoqi, et al.
Veröffentlicht: (2023)
von: Yin, Ruoqi, et al.
Veröffentlicht: (2023)
MamKPD: A Simple Mamba Baseline for Real-Time 2D Keypoint Detection
von: Dang, Yonghao, et al.
Veröffentlicht: (2024)
von: Dang, Yonghao, et al.
Veröffentlicht: (2024)
SpiralMLP: A Lightweight Vision MLP Architecture
von: Mu, Haojie, et al.
Veröffentlicht: (2024)
von: Mu, Haojie, et al.
Veröffentlicht: (2024)
evMLP: An Efficient Event-Driven MLP Architecture for Vision
von: Zheng, Zhentan
Veröffentlicht: (2025)
von: Zheng, Zhentan
Veröffentlicht: (2025)
Leveraging the Video-level Semantic Consistency of Event for Audio-visual Event Localization
von: Jiang, Yuanyuan, et al.
Veröffentlicht: (2022)
von: Jiang, Yuanyuan, et al.
Veröffentlicht: (2022)
Physics-constrained Attack against Convolution-based Human Motion Prediction
von: Duan, Chengxu, et al.
Veröffentlicht: (2023)
von: Duan, Chengxu, et al.
Veröffentlicht: (2023)
Lateralization MLP: A Simple Brain-inspired Architecture for Diffusion
von: Hu, Zizhao, et al.
Veröffentlicht: (2024)
von: Hu, Zizhao, et al.
Veröffentlicht: (2024)
KAN or MLP? Point Cloud Shows the Way Forward
von: Shi, Yan, et al.
Veröffentlicht: (2025)
von: Shi, Yan, et al.
Veröffentlicht: (2025)
PointMT: Efficient Point Cloud Analysis with Hybrid MLP-Transformer Architecture
von: Zheng, Qiang, et al.
Veröffentlicht: (2024)
von: Zheng, Qiang, et al.
Veröffentlicht: (2024)
Variational Contrastive Learning for Skeleton-based Action Recognition
von: Nguyen, Dang Dinh, et al.
Veröffentlicht: (2026)
von: Nguyen, Dang Dinh, et al.
Veröffentlicht: (2026)
An Efficient MLP-based Point-guided Segmentation Network for Ore Images with Ambiguous Boundary
von: Sun, Guodong, et al.
Veröffentlicht: (2024)
von: Sun, Guodong, et al.
Veröffentlicht: (2024)
FW-GAN: Frequency-Driven Handwriting Synthesis with Wave-Modulated MLP Generator
von: Khoa, Huynh Tong Dang, et al.
Veröffentlicht: (2025)
von: Khoa, Huynh Tong Dang, et al.
Veröffentlicht: (2025)
D2-MLP: Dynamic Decomposed MLP Mixer for Medical Image Segmentation
von: Yang, Jin, et al.
Veröffentlicht: (2024)
von: Yang, Jin, et al.
Veröffentlicht: (2024)
A Sobel-Gradient MLP Baseline for Handwritten Character Recognition
von: Nouri, Azam
Veröffentlicht: (2025)
von: Nouri, Azam
Veröffentlicht: (2025)
Expressive Keypoints for Skeleton-based Action Recognition via Skeleton Transformation
von: Yang, Yijie, et al.
Veröffentlicht: (2024)
von: Yang, Yijie, et al.
Veröffentlicht: (2024)
ChebMixer: Efficient Graph Representation Learning with MLP Mixer
von: Kui, Xiaoyan, et al.
Veröffentlicht: (2024)
von: Kui, Xiaoyan, et al.
Veröffentlicht: (2024)
MLP Can Be A Good Transformer Learner
von: Lin, Sihao, et al.
Veröffentlicht: (2024)
von: Lin, Sihao, et al.
Veröffentlicht: (2024)
Adaptive MLP Pruning for Large Vision Transformers
von: Shen, Chengchao
Veröffentlicht: (2026)
von: Shen, Chengchao
Veröffentlicht: (2026)
An MLP Baseline for Handwriting Recognition Using Planar Curvature and Gradient Orientation
von: Nouri, Azam
Veröffentlicht: (2025)
von: Nouri, Azam
Veröffentlicht: (2025)
ESG-Net: Event-Aware Semantic Guided Network for Dense Audio-Visual Event Localization
von: Li, Huilai, et al.
Veröffentlicht: (2025)
von: Li, Huilai, et al.
Veröffentlicht: (2025)
PosMLP-Video: Spatial and Temporal Relative Position Encoding for Efficient Video Recognition
von: Hao, Yanbin, et al.
Veröffentlicht: (2024)
von: Hao, Yanbin, et al.
Veröffentlicht: (2024)
ResDiT: Evoking the Intrinsic Resolution Scalability in Diffusion Transformers
von: Ma, Yiyang, et al.
Veröffentlicht: (2025)
von: Ma, Yiyang, et al.
Veröffentlicht: (2025)
3DGAA: Realistic and Robust 3D Gaussian-based Adversarial Attack for Autonomous Driving
von: Zhang, Yixun, et al.
Veröffentlicht: (2025)
von: Zhang, Yixun, et al.
Veröffentlicht: (2025)
SiT: Exploring Flow and Diffusion-based Generative Models with Scalable Interpolant Transformers
von: Ma, Nanye, et al.
Veröffentlicht: (2024)
von: Ma, Nanye, et al.
Veröffentlicht: (2024)
L2HCount:Generalizing Crowd Counting from Low to High Crowd Density via Density Simulation
von: Xu, Guoliang, et al.
Veröffentlicht: (2025)
von: Xu, Guoliang, et al.
Veröffentlicht: (2025)
SkeletonContext: Skeleton-side Context Prompt Learning for Zero-Shot Skeleton-based Action Recognition
von: Wang, Ning, et al.
Veröffentlicht: (2026)
von: Wang, Ning, et al.
Veröffentlicht: (2026)
HDBN: A Novel Hybrid Dual-branch Network for Robust Skeleton-based Action Recognition
von: Liu, Jinfu, et al.
Veröffentlicht: (2024)
von: Liu, Jinfu, et al.
Veröffentlicht: (2024)
Are GNNs Worth the Effort for IoT Botnet Detection? A Comparative Study of VAE-GNN vs. ViT-MLP and VAE-MLP Approaches
von: Wasswa, Hassan, et al.
Veröffentlicht: (2025)
von: Wasswa, Hassan, et al.
Veröffentlicht: (2025)
SkeletonAgent: An Agentic Interaction Framework for Skeleton-based Action Recognition
von: Liu, Hongda, et al.
Veröffentlicht: (2025)
von: Liu, Hongda, et al.
Veröffentlicht: (2025)
GraphMLP: A Graph MLP-Like Architecture for 3D Human Pose Estimation
von: Li, Wenhao, et al.
Veröffentlicht: (2022)
von: Li, Wenhao, et al.
Veröffentlicht: (2022)
3D Skeleton-Based Action Recognition: A Review
von: Liu, Mengyuan, et al.
Veröffentlicht: (2025)
von: Liu, Mengyuan, et al.
Veröffentlicht: (2025)
PointNet with KAN versus PointNet with MLP for 3D Classification and Segmentation of Point Sets
von: Kashefi, Ali
Veröffentlicht: (2024)
von: Kashefi, Ali
Veröffentlicht: (2024)
DHRNet: A Dual-Path Hierarchical Relation Network for Multi-Person Pose Estimation
von: Dang, Yonghao, et al.
Veröffentlicht: (2024)
von: Dang, Yonghao, et al.
Veröffentlicht: (2024)
CMIP-CIL: A Cross-Modal Benchmark for Image-Point Class Incremental Learning
von: Qi, Chao, et al.
Veröffentlicht: (2025)
von: Qi, Chao, et al.
Veröffentlicht: (2025)
SkeletonX: Data-Efficient Skeleton-based Action Recognition via Cross-sample Feature Aggregation
von: Zhang, Zongye, et al.
Veröffentlicht: (2025)
von: Zhang, Zongye, et al.
Veröffentlicht: (2025)
Cross-DINO: Cross the Deep MLP and Transformer for Small Object Detection
von: Cao, Guiping, et al.
Veröffentlicht: (2025)
von: Cao, Guiping, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
A Generically Contrastive Spatiotemporal Representation Enhancement for 3D Skeleton Action Recognition
von: Zhang, Shaojie, et al.
Veröffentlicht: (2023) -
MaskSem: Semantic-Guided Masking for Learning 3D Hybrid High-Order Motion Representation
von: Wei, Wei, et al.
Veröffentlicht: (2025) -
Kinematics Modeling Network for Video-based Human Pose Estimation
von: Dang, Yonghao, et al.
Veröffentlicht: (2022) -
ActivityCLIP: Enhancing Group Activity Recognition by Mining Complementary Information from Text to Supplement Image Modality
von: Xu, Guoliang, et al.
Veröffentlicht: (2024) -
A Two-stream Hybrid CNN-Transformer Network for Skeleton-based Human Interaction Recognition
von: Yin, Ruoqi, et al.
Veröffentlicht: (2023)