Multi-scale Coarse-to-fine Modeling for Test-time Human Motion Control
Fuente:
arXiv
Salvato in:
| Autori principali: | Le, Nhat, Liu, Daochang, Nguyen, Anh, Mian, Ajmal |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Implicit Neural Representation-Based Continuous Single Image Super-Resolution: An Empirical Benchmark
di: Nasir, Tayyab, et al.
Pubblicazione: (2026)
di: Nasir, Tayyab, et al.
Pubblicazione: (2026)
NAIMA: Semantics Aware RGB Guided Depth Super-Resolution
di: Nasir, Tayyab, et al.
Pubblicazione: (2026)
di: Nasir, Tayyab, et al.
Pubblicazione: (2026)
Enhancing Physical Plausibility in Video Generation by Reasoning the Implausibility
di: Hao, Yutong, et al.
Pubblicazione: (2025)
di: Hao, Yutong, et al.
Pubblicazione: (2025)
EgoMusic-driven Human Dance Motion Estimation with Skeleton Mamba
di: Nguyen, Quang, et al.
Pubblicazione: (2025)
di: Nguyen, Quang, et al.
Pubblicazione: (2025)
Learning Human Motion with Temporally Conditional Mamba
di: Nguyen, Quang, et al.
Pubblicazione: (2025)
di: Nguyen, Quang, et al.
Pubblicazione: (2025)
Modeling Human Skeleton Joint Dynamics for Fall Detection
di: Zahan, Sania, et al.
Pubblicazione: (2025)
di: Zahan, Sania, et al.
Pubblicazione: (2025)
UniHM: Universal Human Motion Generation with Object Interactions in Indoor Scenes
di: Geng, Zichen, et al.
Pubblicazione: (2025)
di: Geng, Zichen, et al.
Pubblicazione: (2025)
Generative Physical AI in Vision: A Survey
di: Liu, Daochang, et al.
Pubblicazione: (2025)
di: Liu, Daochang, et al.
Pubblicazione: (2025)
SepFormer: Coarse-to-fine Separator Regression Network for Table Structure Recognition
di: Nguyen, Nam Quan, et al.
Pubblicazione: (2025)
di: Nguyen, Nam Quan, et al.
Pubblicazione: (2025)
Occlusion-aware Text-Image-Point Cloud Pretraining for Open-World 3D Object Recognition
di: Nguyen, Khanh, et al.
Pubblicazione: (2025)
di: Nguyen, Khanh, et al.
Pubblicazione: (2025)
SDFA: Structure Aware Discriminative Feature Aggregation for Efficient Human Fall Detection in Video
di: Zahan, Sania, et al.
Pubblicazione: (2025)
di: Zahan, Sania, et al.
Pubblicazione: (2025)
Time-series Meets Complex Motion Modeling: Robust and Computational-effective Motion Predictor for Multi-object Tracking
di: Do, Nhat-Tan, et al.
Pubblicazione: (2026)
di: Do, Nhat-Tan, et al.
Pubblicazione: (2026)
Text-guided 3D Human Motion Generation with Keyframe-based Parallel Skip Transformer
di: Geng, Zichen, et al.
Pubblicazione: (2024)
di: Geng, Zichen, et al.
Pubblicazione: (2024)
Avatar Concept Slider: Controllable Editing of Concepts in 3D Human Avatars
di: Foo, Lin Geng, et al.
Pubblicazione: (2024)
di: Foo, Lin Geng, et al.
Pubblicazione: (2024)
ARMFlow: AutoRegressive MeanFlow for Online 3D Human Reaction Generation
di: Geng, Zichen, et al.
Pubblicazione: (2025)
di: Geng, Zichen, et al.
Pubblicazione: (2025)
Compress Guidance in Conditional Diffusion Sampling
di: Dinh, Anh-Dung, et al.
Pubblicazione: (2024)
di: Dinh, Anh-Dung, et al.
Pubblicazione: (2024)
Mantis: Mamba-native Tuning is Efficient for 3D Point Cloud Foundation Models
di: Guo, Zihao, et al.
Pubblicazione: (2026)
di: Guo, Zihao, et al.
Pubblicazione: (2026)
Towards Memorization-Free Diffusion Models
di: Chen, Chen, et al.
Pubblicazione: (2024)
di: Chen, Chen, et al.
Pubblicazione: (2024)
Revisit Visual Prompt Tuning: The Expressiveness of Prompt Experts
di: Le, Minh, et al.
Pubblicazione: (2025)
di: Le, Minh, et al.
Pubblicazione: (2025)
Disentangled Hierarchical VAE for 3D Human-Human Interaction Generation
di: Geng, Zichen, et al.
Pubblicazione: (2026)
di: Geng, Zichen, et al.
Pubblicazione: (2026)
Deeper Diffusion Models Amplify Bias
di: Hakemi, Shahin, et al.
Pubblicazione: (2025)
di: Hakemi, Shahin, et al.
Pubblicazione: (2025)
Class-Partitioned VQ-VAE and Latent Flow Matching for Point Cloud Scene Generation
di: Edirimuni, Dasith de Silva, et al.
Pubblicazione: (2026)
di: Edirimuni, Dasith de Silva, et al.
Pubblicazione: (2026)
Single-weight Model Editing for Post-hoc Spurious Correlation Neutralization
di: Hakemi, Shahin, et al.
Pubblicazione: (2025)
di: Hakemi, Shahin, et al.
Pubblicazione: (2025)
Auto-Regressive Diffusion for Generating 3D Human-Object Interactions
di: Geng, Zichen, et al.
Pubblicazione: (2025)
di: Geng, Zichen, et al.
Pubblicazione: (2025)
RI-Mamba: Rotation-Invariant Mamba for Robust Text-to-Shape Retrieval
di: Nguyen, Khanh, et al.
Pubblicazione: (2026)
di: Nguyen, Khanh, et al.
Pubblicazione: (2026)
Retrieving Objects from 3D Scenes with Box-Guided Open-Vocabulary Instance Segmentation
di: Nguyen, Khanh, et al.
Pubblicazione: (2025)
di: Nguyen, Khanh, et al.
Pubblicazione: (2025)
FastBO: Fast HPO and NAS with Adaptive Fidelity Identification
di: Jiang, Jiantong, et al.
Pubblicazione: (2024)
di: Jiang, Jiantong, et al.
Pubblicazione: (2024)
On the Reliability of Vision-Language Models Under Adversarial Frequency-Domain Perturbations
di: Vice, Jordan, et al.
Pubblicazione: (2025)
di: Vice, Jordan, et al.
Pubblicazione: (2025)
Towards Efficient and Robust Moment Retrieval System: A Unified Framework for Multi-Granularity Models and Temporal Reranking
di: Tran, Huu-Loc, et al.
Pubblicazione: (2025)
di: Tran, Huu-Loc, et al.
Pubblicazione: (2025)
HumanRefiner: Benchmarking Abnormal Human Generation and Refining with Coarse-to-fine Pose-Reversible Guidance
di: Fang, Guian, et al.
Pubblicazione: (2024)
di: Fang, Guian, et al.
Pubblicazione: (2024)
Lightweight Language-driven Grasp Detection using Conditional Consistency Model
di: Nguyen, Nghia, et al.
Pubblicazione: (2024)
di: Nguyen, Nghia, et al.
Pubblicazione: (2024)
MotionMix: Weakly-Supervised Diffusion for Controllable Motion Generation
di: Hoang, Nhat M., et al.
Pubblicazione: (2024)
di: Hoang, Nhat M., et al.
Pubblicazione: (2024)
A Distributed Multi-Modal Sensing Approach for Human Activity Recognition in Real-Time Human-Robot Collaboration
di: Belcamino, Valerio, et al.
Pubblicazione: (2026)
di: Belcamino, Valerio, et al.
Pubblicazione: (2026)
Manipulating and Mitigating Generative Model Biases without Retraining
di: Vice, Jordan, et al.
Pubblicazione: (2024)
di: Vice, Jordan, et al.
Pubblicazione: (2024)
Enhancing Privacy-Utility Trade-offs to Mitigate Memorization in Diffusion Models
di: Chen, Chen, et al.
Pubblicazione: (2025)
di: Chen, Chen, et al.
Pubblicazione: (2025)
Exploring Local Memorization in Diffusion Models via Bright Ending Attention
di: Chen, Chen, et al.
Pubblicazione: (2024)
di: Chen, Chen, et al.
Pubblicazione: (2024)
Exploring Bias in over 100 Text-to-Image Generative Models
di: Vice, Jordan, et al.
Pubblicazione: (2025)
di: Vice, Jordan, et al.
Pubblicazione: (2025)
Long-range Turbulence Mitigation: A Large-scale Dataset and A Coarse-to-fine Framework
di: Xu, Shengqi, et al.
Pubblicazione: (2024)
di: Xu, Shengqi, et al.
Pubblicazione: (2024)
BiMa: Towards Biases Mitigation for Text-Video Retrieval via Scene Element Guidance
di: Le, Huy, et al.
Pubblicazione: (2025)
di: Le, Huy, et al.
Pubblicazione: (2025)
D3Seg: Dependency-Aware Diffusion for Brain Tumor Segmentation with Missing Modalities
di: Ali, Danish, et al.
Pubblicazione: (2026)
di: Ali, Danish, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Implicit Neural Representation-Based Continuous Single Image Super-Resolution: An Empirical Benchmark
di: Nasir, Tayyab, et al.
Pubblicazione: (2026) -
NAIMA: Semantics Aware RGB Guided Depth Super-Resolution
di: Nasir, Tayyab, et al.
Pubblicazione: (2026) -
Enhancing Physical Plausibility in Video Generation by Reasoning the Implausibility
di: Hao, Yutong, et al.
Pubblicazione: (2025) -
EgoMusic-driven Human Dance Motion Estimation with Skeleton Mamba
di: Nguyen, Quang, et al.
Pubblicazione: (2025) -
Learning Human Motion with Temporally Conditional Mamba
di: Nguyen, Quang, et al.
Pubblicazione: (2025)