MacDiff: Unified Skeleton Modeling with Masked Conditional Diffusion
Fuente:
arXiv
Saved in:
| Main Authors: | Wu, Lehong, Lin, Lilang, Zhang, Jiahang, Ma, Yiyang, Liu, Jiaying |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Idempotent Unsupervised Representation Learning for Skeleton-Based Action Recognition
by: Lin, Lilang, et al.
Published: (2024)
by: Lin, Lilang, et al.
Published: (2024)
Shap-Mix: Shapley Value Guided Mixing for Long-Tailed Skeleton Based Action Recognition
by: Zhang, Jiahang, et al.
Published: (2024)
by: Zhang, Jiahang, et al.
Published: (2024)
Self-Supervised Skeleton-Based Action Representation Learning: A Benchmark and Beyond
by: Zhang, Jiahang, et al.
Published: (2024)
by: Zhang, Jiahang, et al.
Published: (2024)
S$^{5}$Mars: Semi-Supervised Learning for Mars Semantic Segmentation
by: Zhang, Jiahang, et al.
Published: (2022)
by: Zhang, Jiahang, et al.
Published: (2022)
DivDiff: A Conditional Diffusion Model for Diverse Human Motion Prediction
by: Yu, Hua, et al.
Published: (2024)
by: Yu, Hua, et al.
Published: (2024)
Graph-Jigsaw Conditioned Diffusion Model for Skeleton-based Video Anomaly Detection
by: Karami, Ali, et al.
Published: (2024)
by: Karami, Ali, et al.
Published: (2024)
HDBN: A Novel Hybrid Dual-branch Network for Robust Skeleton-based Action Recognition
by: Liu, Jinfu, et al.
Published: (2024)
by: Liu, Jinfu, et al.
Published: (2024)
AnimateDiff-Lightning: Cross-Model Diffusion Distillation
by: Lin, Shanchuan, et al.
Published: (2024)
by: Lin, Shanchuan, et al.
Published: (2024)
CoDiff: Conditional Diffusion Model for Collaborative 3D Object Detection
by: Huang, Zhe, et al.
Published: (2025)
by: Huang, Zhe, et al.
Published: (2025)
AsyncDiff: Parallelizing Diffusion Models by Asynchronous Denoising
by: Chen, Zigeng, et al.
Published: (2024)
by: Chen, Zigeng, et al.
Published: (2024)
AdaDiff: Adaptive Step Selection for Fast Diffusion Models
by: Zhang, Hui, et al.
Published: (2023)
by: Zhang, Hui, et al.
Published: (2023)
Frequency-Enhanced Diffusion Models: Curriculum-Guided Semantic Alignment for Zero-Shot Skeleton Action Recognition
by: Zhou, Yuxi, et al.
Published: (2026)
by: Zhou, Yuxi, et al.
Published: (2026)
Skeleton-to-Image Encoding: Enabling Skeleton Representation Learning via Vision-Pretrained Models
by: Yang, Siyuan, et al.
Published: (2026)
by: Yang, Siyuan, et al.
Published: (2026)
AortaDiff: A Unified Multitask Diffusion Framework For Contrast-Free AAA Imaging
by: Ou, Yuxuan, et al.
Published: (2025)
by: Ou, Yuxuan, et al.
Published: (2025)
ASMa: Asymmetric Spatio-temporal Masking for Skeleton Action Representation Learning
by: Anand, Aman, et al.
Published: (2026)
by: Anand, Aman, et al.
Published: (2026)
Mask and Compress: Efficient Skeleton-based Action Recognition in Continual Learning
by: Mosconi, Matteo, et al.
Published: (2024)
by: Mosconi, Matteo, et al.
Published: (2024)
DiffCAP: Diffusion-based Cumulative Adversarial Purification for Vision Language Models
by: Fu, Jia, et al.
Published: (2025)
by: Fu, Jia, et al.
Published: (2025)
Mass Concept Erasure in Diffusion Models with Concept Hierarchy
by: Tu, Jiahang, et al.
Published: (2026)
by: Tu, Jiahang, et al.
Published: (2026)
JanusFlow: Harmonizing Autoregression and Rectified Flow for Unified Multimodal Understanding and Generation
by: Ma, Yiyang, et al.
Published: (2024)
by: Ma, Yiyang, et al.
Published: (2024)
LocDiff: Identifying Locations on Earth by Diffusing in the Hilbert Space
by: Wang, Zhangyu, et al.
Published: (2025)
by: Wang, Zhangyu, et al.
Published: (2025)
UniCombine: Unified Multi-Conditional Combination with Diffusion Transformer
by: Wang, Haoxuan, et al.
Published: (2025)
by: Wang, Haoxuan, et al.
Published: (2025)
FBSDiff: Plug-and-Play Frequency Band Substitution of Diffusion Features for Highly Controllable Text-Driven Image Translation
by: Gao, Xiang, et al.
Published: (2024)
by: Gao, Xiang, et al.
Published: (2024)
Unified Auto-Encoding with Masked Diffusion
by: Hansen-Estruch, Philippe, et al.
Published: (2024)
by: Hansen-Estruch, Philippe, et al.
Published: (2024)
DiffSpeaker: Speech-Driven 3D Facial Animation with Diffusion Transformer
by: Ma, Zhiyuan, et al.
Published: (2024)
by: Ma, Zhiyuan, et al.
Published: (2024)
WAM-Diff: A Masked Diffusion VLA Framework with MoE and Online Reinforcement Learning for Autonomous Driving
by: Xu, Mingwang, et al.
Published: (2025)
by: Xu, Mingwang, et al.
Published: (2025)
CCIS-Diff: A Generative Model with Stable Diffusion Prior for Controlled Colonoscopy Image Synthesis
by: Xie, Yifan, et al.
Published: (2024)
by: Xie, Yifan, et al.
Published: (2024)
DiffSeg: A Segmentation Model for Skin Lesions Based on Diffusion Difference
by: Shuai, Zhihao, et al.
Published: (2024)
by: Shuai, Zhihao, et al.
Published: (2024)
CoCoDiff: Correspondence-Consistent Diffusion Model for Fine-grained Style Transfer
by: Nie, Wenbo, et al.
Published: (2026)
by: Nie, Wenbo, et al.
Published: (2026)
DiffGuard: Text-Based Safety Checker for Diffusion Models
by: Khader, Massine El, et al.
Published: (2024)
by: Khader, Massine El, et al.
Published: (2024)
DiffMorph: Text-less Image Morphing with Diffusion Models
by: Chatterjee, Shounak
Published: (2024)
by: Chatterjee, Shounak
Published: (2024)
MultiDiffSense: Diffusion-Based Multi-Modal Visuo-Tactile Image Generation Conditioned on Object Shape and Contact Pose
by: Bhouri, Sirine, et al.
Published: (2026)
by: Bhouri, Sirine, et al.
Published: (2026)
SkeletonGaussian: Editable 4D Generation through Gaussian Skeletonization
by: Wu, Lifan, et al.
Published: (2026)
by: Wu, Lifan, et al.
Published: (2026)
MCGM: Mask Conditional Text-to-Image Generative Model
by: Skaik, Rami, et al.
Published: (2024)
by: Skaik, Rami, et al.
Published: (2024)
Taming Identity Consistency and Prompt Diversity in Diffusion Models via Latent Concatenation and Masked Conditional Flow Matching
by: Singhania, Aditi, et al.
Published: (2025)
by: Singhania, Aditi, et al.
Published: (2025)
DiffSketcher: Text Guided Vector Sketch Synthesis through Latent Diffusion Models
by: Xing, Ximing, et al.
Published: (2023)
by: Xing, Ximing, et al.
Published: (2023)
MagDiff: Multi-Alignment Diffusion for High-Fidelity Video Generation and Editing
by: Zhao, Haoyu, et al.
Published: (2023)
by: Zhao, Haoyu, et al.
Published: (2023)
Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL
by: Wu, Junyi, et al.
Published: (2026)
by: Wu, Junyi, et al.
Published: (2026)
AnyMo: Scaling Any-Modality Conditional Motion Generation with Masked Modeling
by: Li, Yiheng, et al.
Published: (2026)
by: Li, Yiheng, et al.
Published: (2026)
DiffHDR: Re-Exposing LDR Videos with Video Diffusion Models
by: Yu, Zhengming, et al.
Published: (2026)
by: Yu, Zhengming, et al.
Published: (2026)
RIV: Recursive Introspection Mask Diffusion Vision Language Model
by: Li, YuQian, et al.
Published: (2025)
by: Li, YuQian, et al.
Published: (2025)
Similar Items
-
Idempotent Unsupervised Representation Learning for Skeleton-Based Action Recognition
by: Lin, Lilang, et al.
Published: (2024) -
Shap-Mix: Shapley Value Guided Mixing for Long-Tailed Skeleton Based Action Recognition
by: Zhang, Jiahang, et al.
Published: (2024) -
Self-Supervised Skeleton-Based Action Representation Learning: A Benchmark and Beyond
by: Zhang, Jiahang, et al.
Published: (2024) -
S$^{5}$Mars: Semi-Supervised Learning for Mars Semantic Segmentation
by: Zhang, Jiahang, et al.
Published: (2022) -
DivDiff: A Conditional Diffusion Model for Diverse Human Motion Prediction
by: Yu, Hua, et al.
Published: (2024)