SMCD: High Realism Motion Style Transfer via Mamba-based Diffusion
Fuente:
arXiv
Guardado en:
| Autores principales: | Qian, Ziyun, Xiao, Zeyu, Jin, Xingliang, Yang, Dingkang, Li, Mingcheng, Wu, Zhenyi, Kou, Dongliang, Zhai, Peng, Zhang, Lihua |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
PersonaAnimator: Personalized Motion Transfer from Unconstrained Videos
por: Qian, Ziyun, et al.
Publicado: (2025)
por: Qian, Ziyun, et al.
Publicado: (2025)
UniMGS: Unifying Mesh and 3D Gaussian Splatting with Single-Pass Rasterization and Proxy-Based Deformation
por: Xiao, Zeyu, et al.
Publicado: (2026)
por: Xiao, Zeyu, et al.
Publicado: (2026)
Correlation-Decoupled Knowledge Distillation for Multimodal Sentiment Analysis with Incomplete Modalities
por: Li, Mingcheng, et al.
Publicado: (2024)
por: Li, Mingcheng, et al.
Publicado: (2024)
Faster Diffusion Action Segmentation
por: Wang, Shuaibing, et al.
Publicado: (2024)
por: Wang, Shuaibing, et al.
Publicado: (2024)
Can LLMs' Tuning Methods Work in Medical Multimodal Domain?
por: Chen, Jiawei, et al.
Publicado: (2024)
por: Chen, Jiawei, et al.
Publicado: (2024)
HandGCAT: Occlusion-Robust 3D Hand Mesh Reconstruction from Monocular Images
por: Wang, Shuaibing, et al.
Publicado: (2024)
por: Wang, Shuaibing, et al.
Publicado: (2024)
MCCD: Multi-Agent Collaboration-based Compositional Diffusion for Complex Text-to-Image Generation
por: Li, Mingcheng, et al.
Publicado: (2025)
por: Li, Mingcheng, et al.
Publicado: (2025)
HybridOcc: NeRF Enhanced Transformer-based Multi-Camera 3D Occupancy Prediction
por: Zhao, Xiao, et al.
Publicado: (2024)
por: Zhao, Xiao, et al.
Publicado: (2024)
Toward Robust Incomplete Multimodal Sentiment Analysis via Hierarchical Representation Learning
por: Li, Mingcheng, et al.
Publicado: (2024)
por: Li, Mingcheng, et al.
Publicado: (2024)
Asynchronous Multimodal Video Sequence Fusion via Learning Modality-Exclusive and -Agnostic Representations
por: Yang, Dingkang, et al.
Publicado: (2024)
por: Yang, Dingkang, et al.
Publicado: (2024)
Improving Multimodal Sentiment Analysis via Modality Optimization and Dynamic Primary Modality Selection
por: Yang, Dingkang, et al.
Publicado: (2025)
por: Yang, Dingkang, et al.
Publicado: (2025)
PhysHand: A Hand Simulation Model with Physiological Geometry, Physical Deformation, and Accurate Contact Handling
por: Sun, Mingyang, et al.
Publicado: (2024)
por: Sun, Mingyang, et al.
Publicado: (2024)
BloomScene: Lightweight Structured 3D Gaussian Splatting for Crossmodal Scene Generation
por: Hou, Xiaolu, et al.
Publicado: (2025)
por: Hou, Xiaolu, et al.
Publicado: (2025)
Decoupling Contact for Fine-Grained Motion Style Transfer
por: Tang, Xiangjun, et al.
Publicado: (2024)
por: Tang, Xiangjun, et al.
Publicado: (2024)
Towards Multimodal Sentiment Analysis Debiasing via Bias Purification
por: Yang, Dingkang, et al.
Publicado: (2024)
por: Yang, Dingkang, et al.
Publicado: (2024)
Improving Factuality in Large Language Models via Decoding-Time Hallucinatory and Truthful Comparators
por: Yang, Dingkang, et al.
Publicado: (2024)
por: Yang, Dingkang, et al.
Publicado: (2024)
ProFocus: Proactive Perception and Focused Reasoning in Vision-and-Language Navigation
por: Xue, Wei, et al.
Publicado: (2026)
por: Xue, Wei, et al.
Publicado: (2026)
Diffusion-based Human Motion Style Transfer with Semantic Guidance
por: Hu, Lei, et al.
Publicado: (2024)
por: Hu, Lei, et al.
Publicado: (2024)
FysicsWorld: A Unified Full-Modality Benchmark for Any-to-Any Understanding, Generation, and Reasoning
por: Jiang, Yue, et al.
Publicado: (2025)
por: Jiang, Yue, et al.
Publicado: (2025)
MaskBEV: Towards A Unified Framework for BEV Detection and Map Segmentation
por: Zhao, Xiao, et al.
Publicado: (2024)
por: Zhao, Xiao, et al.
Publicado: (2024)
Robust Emotion Recognition in Context Debiasing
por: Yang, Dingkang, et al.
Publicado: (2024)
por: Yang, Dingkang, et al.
Publicado: (2024)
Resolving Evidence Sparsity: Agentic Context Engineering for Long-Document Understanding
por: Liu, Keliang, et al.
Publicado: (2025)
por: Liu, Keliang, et al.
Publicado: (2025)
PIG: Physically-based Multi-Material Interaction with 3D Gaussians
por: Xiao, Zeyu, et al.
Publicado: (2025)
por: Xiao, Zeyu, et al.
Publicado: (2025)
Reinforcement Learning Meets Large Language Models: A Survey of Advancements and Applications Across the LLM Lifecycle
por: Liu, Keliang, et al.
Publicado: (2025)
por: Liu, Keliang, et al.
Publicado: (2025)
Efficiency in Focus: LayerNorm as a Catalyst for Fine-tuning Medical Visual Language Pre-trained Models
por: Chen, Jiawei, et al.
Publicado: (2024)
por: Chen, Jiawei, et al.
Publicado: (2024)
CoMT: Chain-of-Medical-Thought Reduces Hallucination in Medical Report Generation
por: Jiang, Yue, et al.
Publicado: (2024)
por: Jiang, Yue, et al.
Publicado: (2024)
Large Vision-Language Models as Emotion Recognizers in Context Awareness
por: Lei, Yuxuan, et al.
Publicado: (2024)
por: Lei, Yuxuan, et al.
Publicado: (2024)
Dystruct: Dynamically Structured Diffusion Language Model Decoding via Bayesian Inference
por: Sun, Bian, et al.
Publicado: (2026)
por: Sun, Bian, et al.
Publicado: (2026)
MedAide: Information Fusion and Anatomy of Medical Intents via LLM-based Agent Collaboration
por: Yang, Dingkang, et al.
Publicado: (2024)
por: Yang, Dingkang, et al.
Publicado: (2024)
ColorMamba: Towards High-quality NIR-to-RGB Spectral Translation with Mamba
por: Zhai, Huiyu, et al.
Publicado: (2024)
por: Zhai, Huiyu, et al.
Publicado: (2024)
Motion Mamba: Efficient and Long Sequence Motion Generation
por: Zhang, Zeyu, et al.
Publicado: (2024)
por: Zhang, Zeyu, et al.
Publicado: (2024)
Detecting and Evaluating Medical Hallucinations in Large Vision Language Models
por: Chen, Jiawei, et al.
Publicado: (2024)
por: Chen, Jiawei, et al.
Publicado: (2024)
StyleMamba : State Space Model for Efficient Text-driven Image Style Transfer
por: Wang, Zijia, et al.
Publicado: (2024)
por: Wang, Zijia, et al.
Publicado: (2024)
SatireDecoder: Visual Cascaded Decoupling for Enhancing Satirical Image Comprehension
por: Jiang, Yue, et al.
Publicado: (2025)
por: Jiang, Yue, et al.
Publicado: (2025)
Debiased Multimodal Understanding for Human Language Sequences
por: Xu, Zhi, et al.
Publicado: (2024)
por: Xu, Zhi, et al.
Publicado: (2024)
PediatricsGPT: Large Language Models as Chinese Medical Assistants for Pediatric Applications
por: Yang, Dingkang, et al.
Publicado: (2024)
por: Yang, Dingkang, et al.
Publicado: (2024)
Mamba-ST: State Space Model for Efficient Style Transfer
por: Botti, Filippo, et al.
Publicado: (2024)
por: Botti, Filippo, et al.
Publicado: (2024)
LogoStyleFool: Vitiating Video Recognition Systems via Logo Style Transfer
por: Cao, Yuxin, et al.
Publicado: (2023)
por: Cao, Yuxin, et al.
Publicado: (2023)
Mamba-based Light Field Super-Resolution with Efficient Subspace Scanning
por: Gao, Ruisheng, et al.
Publicado: (2024)
por: Gao, Ruisheng, et al.
Publicado: (2024)
RENet: Fault-Tolerant Motion Control for Quadruped Robots via Redundant Estimator Networks under Visual Collapse
por: Zhang, Yueqi, et al.
Publicado: (2025)
por: Zhang, Yueqi, et al.
Publicado: (2025)
Ejemplares similares
-
PersonaAnimator: Personalized Motion Transfer from Unconstrained Videos
por: Qian, Ziyun, et al.
Publicado: (2025) -
UniMGS: Unifying Mesh and 3D Gaussian Splatting with Single-Pass Rasterization and Proxy-Based Deformation
por: Xiao, Zeyu, et al.
Publicado: (2026) -
Correlation-Decoupled Knowledge Distillation for Multimodal Sentiment Analysis with Incomplete Modalities
por: Li, Mingcheng, et al.
Publicado: (2024) -
Faster Diffusion Action Segmentation
por: Wang, Shuaibing, et al.
Publicado: (2024) -
Can LLMs' Tuning Methods Work in Medical Multimodal Domain?
por: Chen, Jiawei, et al.
Publicado: (2024)