Unsupervised View-Invariant Human Posture Representation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sardari, Faegheh, Ommer, Björn, Mirmehdi, Majid |
|---|---|
| Format: | Preprint |
| Publié: |
2021
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CAGE: Unsupervised Visual Composition and Animation for Controllable Video Generation
par: Davtyan, Aram, et autres
Publié: (2024)
par: Davtyan, Aram, et autres
Publié: (2024)
Unsupervised Cross-Domain 3D Human Pose Estimation via Pseudo-Label-Guided Global Transforms
par: Liu, Jingjing, et autres
Publié: (2025)
par: Liu, Jingjing, et autres
Publié: (2025)
An Effective-Efficient Approach for Dense Multi-Label Action Detection
par: Sardari, Faegheh, et autres
Publié: (2024)
par: Sardari, Faegheh, et autres
Publié: (2024)
Reframing Dense Action Detection (RefDense): A Paradigm Shift in Problem Solving & a Novel Optimization Strategy
par: Sardari, Faegheh, et autres
Publié: (2025)
par: Sardari, Faegheh, et autres
Publié: (2025)
CoLeaF: A Contrastive-Collaborative Learning Framework for Weakly Supervised Audio-Visual Video Parsing
par: Sardari, Faegheh, et autres
Publié: (2024)
par: Sardari, Faegheh, et autres
Publié: (2024)
Visual-textual Dermatoglyphic Animal Biometrics: A First Case Study on Panthera tigris
par: Li, Wenshuo, et autres
Publié: (2025)
par: Li, Wenshuo, et autres
Publié: (2025)
Co-STAR: Collaborative Curriculum Self-Training with Adaptive Regularization for Source-Free Video Domain Adaptation
par: Dadashzadeh, Amirhossein, et autres
Publié: (2025)
par: Dadashzadeh, Amirhossein, et autres
Publié: (2025)
Trajectory-guided Motion Perception for Facial Expression Quality Assessment in Neurological Disorders
par: Duan, Shuchao, et autres
Publié: (2025)
par: Duan, Shuchao, et autres
Publié: (2025)
[MASK] is All You Need
par: Hu, Vincent Tao, et autres
Publié: (2024)
par: Hu, Vincent Tao, et autres
Publié: (2024)
MaskFlow: Discrete Flows For Flexible and Efficient Long Video Generation
par: Fuest, Michael, et autres
Publié: (2025)
par: Fuest, Michael, et autres
Publié: (2025)
NarrativeBridge: Enhancing Video Captioning with Causal-Temporal Narrative
par: Nadeem, Asmar, et autres
Publié: (2024)
par: Nadeem, Asmar, et autres
Publié: (2024)
TEn-CATG:Text-Enriched Audio-Visual Video Parsing with Multi-Scale Category-Aware Temporal Graph
par: Chen, Yaru, et autres
Publié: (2025)
par: Chen, Yaru, et autres
Publié: (2025)
Skeleton-Snippet Contrastive Learning with Multiscale Feature Fusion for Action Localization
par: Cheng, Qiushuo, et autres
Publié: (2025)
par: Cheng, Qiushuo, et autres
Publié: (2025)
DocSLM: A Small Vision-Language Model for Long Multimodal Document Understanding
par: Hannan, Tanveer, et autres
Publié: (2025)
par: Hannan, Tanveer, et autres
Publié: (2025)
RayDer: Scalable Self-Supervised Novel View Synthesis from Real-World Video
par: Prestel, Ulrich, et autres
Publié: (2026)
par: Prestel, Ulrich, et autres
Publié: (2026)
Prediction of Thrombectomy Functional Outcomes using Multimodal Data
par: Samak, Zeynel A., et autres
Publié: (2020)
par: Samak, Zeynel A., et autres
Publié: (2020)
TranSOP: Transformer-based Multimodal Classification for Stroke Treatment Outcome Prediction
par: Samak, Zeynel A., et autres
Publié: (2023)
par: Samak, Zeynel A., et autres
Publié: (2023)
Automatic Prediction of Stroke Treatment Outcomes: Latest Advances and Perspectives
par: Samak, Zeynel A., et autres
Publié: (2024)
par: Samak, Zeynel A., et autres
Publié: (2024)
Adapting Self-Supervised Representations as a Latent Space for Efficient Generation
par: Gui, Ming, et autres
Publié: (2025)
par: Gui, Ming, et autres
Publié: (2025)
Distillation of Diffusion Features for Semantic Correspondence
par: Fundel, Frank, et autres
Publié: (2024)
par: Fundel, Frank, et autres
Publié: (2024)
What If : Understanding Motion Through Sparse Interactions
par: Baumann, Stefan Andreas, et autres
Publié: (2025)
par: Baumann, Stefan Andreas, et autres
Publié: (2025)
Diffusion Models and Representation Learning: A Survey
par: Fuest, Michael, et autres
Publié: (2024)
par: Fuest, Michael, et autres
Publié: (2024)
DisMo: Disentangled Motion Representations for Open-World Motion Transfer
par: Ressler-Antal, Thomas, et autres
Publié: (2025)
par: Ressler-Antal, Thomas, et autres
Publié: (2025)
Probabilistic Precipitation Nowcasting with Rectified Flow Transformers
par: Schusterbauer, Johannes, et autres
Publié: (2026)
par: Schusterbauer, Johannes, et autres
Publié: (2026)
Stable-Pose: Leveraging Transformers for Pose-Guided Text-to-Image Generation
par: Wang, Jiajun, et autres
Publié: (2024)
par: Wang, Jiajun, et autres
Publié: (2024)
When Visual Privacy Protection Meets Multimodal Large Language Models
par: Hui, Xiaofei, et autres
Publié: (2026)
par: Hui, Xiaofei, et autres
Publié: (2026)
VIRD: View-Invariant Representation through Dual-Axis Transformation for Cross-View Pose Estimation
par: Park, Juhye, et autres
Publié: (2026)
par: Park, Juhye, et autres
Publié: (2026)
Diff2Flow: Training Flow Matching Models via Diffusion Model Alignment
par: Schusterbauer, Johannes, et autres
Publié: (2025)
par: Schusterbauer, Johannes, et autres
Publié: (2025)
Does VLM Classification Benefit from LLM Description Semantics?
par: Ma, Pingchuan, et autres
Publié: (2024)
par: Ma, Pingchuan, et autres
Publié: (2024)
CleanDIFT: Diffusion Features without Noise
par: Stracke, Nick, et autres
Publié: (2024)
par: Stracke, Nick, et autres
Publié: (2024)
ChimpVLM: Ethogram-Enhanced Chimpanzee Behaviour Recognition
par: Brookes, Otto, et autres
Publié: (2024)
par: Brookes, Otto, et autres
Publié: (2024)
Learning to Generate Cross-Task Unexploitable Examples
par: Qu, Haoxuan, et autres
Publié: (2025)
par: Qu, Haoxuan, et autres
Publié: (2025)
Denoising, Fast and Slow: Difficulty-Aware Adaptive Sampling for Image Generation
par: Schusterbauer, Johannes, et autres
Publié: (2026)
par: Schusterbauer, Johannes, et autres
Publié: (2026)
Cross-View Graph Consistency Learning for Invariant Graph Representations
par: Chen, Jie, et autres
Publié: (2023)
par: Chen, Jie, et autres
Publié: (2023)
CTRLorALTer: Conditional LoRAdapter for Efficient 0-Shot Control & Altering of T2I Models
par: Stracke, Nick, et autres
Publié: (2024)
par: Stracke, Nick, et autres
Publié: (2024)
VIFSS: View-Invariant and Figure Skating-Specific Pose Representation Learning for Temporal Action Segmentation
par: Tanaka, Ryota, et autres
Publié: (2025)
par: Tanaka, Ryota, et autres
Publié: (2025)
Incremental Human-Object Interaction Detection with Invariant Relation Representation Learning
par: Wei, Yana, et autres
Publié: (2025)
par: Wei, Yana, et autres
Publié: (2025)
Your Turn: At Home Turning Angle Estimation for Parkinson's Disease Severity Assessment
par: Cheng, Qiushuo, et autres
Publié: (2024)
par: Cheng, Qiushuo, et autres
Publié: (2024)
Disentangled Human Body Representation Based on Unsupervised Semantic-Aware Learning
par: Wang, Lu, et autres
Publié: (2025)
par: Wang, Lu, et autres
Publié: (2025)
Learning Long-term Motion Embeddings for Efficient Kinematics Generation
par: Stracke, Nick, et autres
Publié: (2026)
par: Stracke, Nick, et autres
Publié: (2026)
Documents similaires
-
CAGE: Unsupervised Visual Composition and Animation for Controllable Video Generation
par: Davtyan, Aram, et autres
Publié: (2024) -
Unsupervised Cross-Domain 3D Human Pose Estimation via Pseudo-Label-Guided Global Transforms
par: Liu, Jingjing, et autres
Publié: (2025) -
An Effective-Efficient Approach for Dense Multi-Label Action Detection
par: Sardari, Faegheh, et autres
Publié: (2024) -
Reframing Dense Action Detection (RefDense): A Paradigm Shift in Problem Solving & a Novel Optimization Strategy
par: Sardari, Faegheh, et autres
Publié: (2025) -
CoLeaF: A Contrastive-Collaborative Learning Framework for Weakly Supervised Audio-Visual Video Parsing
par: Sardari, Faegheh, et autres
Publié: (2024)