Improving Human Image Animation via Semantic Representation Alignment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Chang, Chen, Mengting, Huang, Yixuan, Wu, Haoning, Ju, Chen, Xiao, Shuai, Lan, Jinsong, Wang, Yanfeng |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Wear-Any-Way: Manipulable Virtual Try-on via Sparse Correspondence Alignment
par: Chen, Mengting, et autres
Publié: (2024)
par: Chen, Mengting, et autres
Publié: (2024)
Advancing Myopia To Holism: Fully Contrastive Language-Image Pre-training
par: Wang, Haicheng, et autres
Publié: (2024)
par: Wang, Haicheng, et autres
Publié: (2024)
Cell Variational Information Bottleneck Network
par: Zhai, Zhonghua, et autres
Publié: (2024)
par: Zhai, Zhonghua, et autres
Publié: (2024)
Animate-X: Universal Character Image Animation with Enhanced Motion Representation
par: Tan, Shuai, et autres
Publié: (2024)
par: Tan, Shuai, et autres
Publié: (2024)
Intelligent Grimm -- Open-ended Visual Storytelling via Latent Diffusion Models
par: Liu, Chang, et autres
Publié: (2023)
par: Liu, Chang, et autres
Publié: (2023)
MatchTime: Towards Automatic Soccer Game Commentary Generation
par: Rao, Jiayuan, et autres
Publié: (2024)
par: Rao, Jiayuan, et autres
Publié: (2024)
Animate-X++: Universal Character Image Animation with Dynamic Backgrounds
par: Tan, Shuai, et autres
Publié: (2025)
par: Tan, Shuai, et autres
Publié: (2025)
Wave-Particle (Continuous-Discrete) Dualistic Visual Tokenization for Unified Understanding and Generation
par: Chen, Yizhu, et autres
Publié: (2025)
par: Chen, Yizhu, et autres
Publié: (2025)
Implicit Preference Alignment for Human Image Animation
par: Wang, Yuanzhi, et autres
Publié: (2026)
par: Wang, Yuanzhi, et autres
Publié: (2026)
AnimateZoo: Zero-shot Video Generation of Cross-Species Animation via Subject Alignment
par: Xu, Yuanfeng, et autres
Publié: (2024)
par: Xu, Yuanfeng, et autres
Publié: (2024)
AnimateAnywhere: Rouse the Background in Human Image Animation
par: Liu, Xiaoyu, et autres
Publié: (2025)
par: Liu, Xiaoyu, et autres
Publié: (2025)
Flowing Backwards: Improving Normalizing Flows via Reverse Representation Alignment
par: Chen, Yang, et autres
Publié: (2025)
par: Chen, Yang, et autres
Publié: (2025)
SpatialScore: Towards Comprehensive Evaluation for Spatial Intelligence
par: Wu, Haoning, et autres
Publié: (2025)
par: Wu, Haoning, et autres
Publié: (2025)
KeyframeFace: Language-Driven Facial Animation via Semantic Keyframes
par: Wu, Jingchao, et autres
Publié: (2025)
par: Wu, Jingchao, et autres
Publié: (2025)
Turbo: Informativity-Driven Acceleration Plug-In for Vision-Language Large Models
par: Ju, Chen, et autres
Publié: (2024)
par: Ju, Chen, et autres
Publié: (2024)
LSF-Animation: Label-Free Speech-Driven Facial Animation via Implicit Feature Representation
par: Lu, Xin, et autres
Publié: (2025)
par: Lu, Xin, et autres
Publié: (2025)
Tunnel Try-on: Excavating Spatial-temporal Tunnels for High-quality Virtual Try-on in Videos
par: Xu, Zhengze, et autres
Publié: (2024)
par: Xu, Zhengze, et autres
Publié: (2024)
FashionChameleon: Towards Real-Time and Interactive Human-Garment Video Customization
par: Song, Quanjian, et autres
Publié: (2026)
par: Song, Quanjian, et autres
Publié: (2026)
EvAnimate: Event-conditioned Image-to-Video Generation for Human Animation
par: Qu, Qiang, et autres
Publié: (2025)
par: Qu, Qiang, et autres
Publié: (2025)
The Semantic Lifecycle in Embodied AI: Acquisition, Representation and Storage via Foundation Models
par: Chen, Shuai, et autres
Publié: (2026)
par: Chen, Shuai, et autres
Publié: (2026)
iTryOn: Mastering Interactive Video Virtual Try-On with Spatial-Semantic Guidance
par: Zheng, Jun, et autres
Publié: (2026)
par: Zheng, Jun, et autres
Publié: (2026)
X-Dyna: Expressive Dynamic Human Image Animation
par: Chang, Di, et autres
Publié: (2025)
par: Chang, Di, et autres
Publié: (2025)
LEO: Generative Latent Image Animator for Human Video Synthesis
par: Wang, Yaohui, et autres
Publié: (2023)
par: Wang, Yaohui, et autres
Publié: (2023)
LINR Bridge: Vector Graphic Animation via Neural Implicits and Video Diffusion Priors
par: Gao, Wenshuo, et autres
Publié: (2025)
par: Gao, Wenshuo, et autres
Publié: (2025)
Explore More, Learn Better: Parallel MLLM Embeddings under Mutual Information Minimization
par: Wang, Zhicheng, et autres
Publié: (2025)
par: Wang, Zhicheng, et autres
Publié: (2025)
One-to-All Animation: Alignment-Free Character Animation and Image Pose Transfer
par: Shi, Shijun, et autres
Publié: (2025)
par: Shi, Shijun, et autres
Publié: (2025)
Count Anything at Any Granularity
par: Liu, Chang, et autres
Publié: (2026)
par: Liu, Chang, et autres
Publié: (2026)
MegaFusion: Extend Diffusion Models towards Higher-resolution Image Generation without Further Tuning
par: Wu, Haoning, et autres
Publié: (2024)
par: Wu, Haoning, et autres
Publié: (2024)
Multi-identity Human Image Animation with Structural Video Diffusion
par: Wang, Zhenzhi, et autres
Publié: (2025)
par: Wang, Zhenzhi, et autres
Publié: (2025)
Disco4D: Disentangled 4D Human Generation and Animation from a Single Image
par: Pang, Hui En, et autres
Publié: (2024)
par: Pang, Hui En, et autres
Publié: (2024)
HumanVid: Demystifying Training Data for Camera-controllable Human Image Animation
par: Wang, Zhenzhi, et autres
Publié: (2024)
par: Wang, Zhenzhi, et autres
Publié: (2024)
EverAnimate: Minute-Scale Human Animation via Latent Flow Restoration
par: Li, Wuyang, et autres
Publié: (2026)
par: Li, Wuyang, et autres
Publié: (2026)
Rethinking the Evaluation of Visible and Infrared Image Fusion
par: Guan, Dayan, et autres
Publié: (2024)
par: Guan, Dayan, et autres
Publié: (2024)
High-Fidelity and Long-Duration Human Image Animation with Diffusion Transformer
par: Zheng, Shen, et autres
Publié: (2025)
par: Zheng, Shen, et autres
Publié: (2025)
EmoDiffusion: Enhancing Emotional 3D Facial Animation with Latent Diffusion Models
par: Zhang, Yixuan, et autres
Publié: (2025)
par: Zhang, Yixuan, et autres
Publié: (2025)
Learning Semantic Facial Descriptors for Accurate Face Animation
par: Zhu, Lei, et autres
Publié: (2025)
par: Zhu, Lei, et autres
Publié: (2025)
Squeeze Out Tokens from Sample for Finer-Grained Data Governance
par: Lin, Weixiong, et autres
Publié: (2025)
par: Lin, Weixiong, et autres
Publié: (2025)
TPC: Test-time Procrustes Calibration for Diffusion-based Human Image Animation
par: Yoon, Sunjae, et autres
Publié: (2024)
par: Yoon, Sunjae, et autres
Publié: (2024)
StableAnimator: High-Quality Identity-Preserving Human Image Animation
par: Tu, Shuyuan, et autres
Publié: (2024)
par: Tu, Shuyuan, et autres
Publié: (2024)
SteadyDancer: Harmonized and Coherent Human Image Animation with First-Frame Preservation
par: Zhang, Jiaming, et autres
Publié: (2025)
par: Zhang, Jiaming, et autres
Publié: (2025)
Documents similaires
-
Wear-Any-Way: Manipulable Virtual Try-on via Sparse Correspondence Alignment
par: Chen, Mengting, et autres
Publié: (2024) -
Advancing Myopia To Holism: Fully Contrastive Language-Image Pre-training
par: Wang, Haicheng, et autres
Publié: (2024) -
Cell Variational Information Bottleneck Network
par: Zhai, Zhonghua, et autres
Publié: (2024) -
Animate-X: Universal Character Image Animation with Enhanced Motion Representation
par: Tan, Shuai, et autres
Publié: (2024) -
Intelligent Grimm -- Open-ended Visual Storytelling via Latent Diffusion Models
par: Liu, Chang, et autres
Publié: (2023)