MGHanD: Multi-modal Guidance for authentic Hand Diffusion
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Eum, Taehyeon, Choi, Jieun, Kim, Tae-Kyun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Multi-hypotheses Conditioned Point Cloud Diffusion for 3D Human Reconstruction from Occluded Images
par: Kim, Donghwan, et autres
Publié: (2024)
par: Kim, Donghwan, et autres
Publié: (2024)
Hand-object reconstruction via interaction-aware graph attention mechanism
par: Woo, Taeyun, et autres
Publié: (2024)
par: Woo, Taeyun, et autres
Publié: (2024)
PhysHanDI: Physics-Based Reconstruction of Hand-Deformable Object Interactions
par: Lee, Jihyun, et autres
Publié: (2026)
par: Lee, Jihyun, et autres
Publié: (2026)
3DPhysVideo: Consistency-Guided Flow SDE for Video Generation via 3D Scene Reconstruction and Physical Simulation
par: Kim, Hwidong, et autres
Publié: (2026)
par: Kim, Hwidong, et autres
Publié: (2026)
Visual Delta Generator with Large Multi-modal Models for Semi-supervised Composed Image Retrieval
par: Jang, Young Kyun, et autres
Publié: (2024)
par: Jang, Young Kyun, et autres
Publié: (2024)
SRHand: Super-Resolving Hand Images and 3D Shapes via View/Pose-aware Neural Image Representations and Explicit 3D Meshes
par: Kim, Minje, et autres
Publié: (2025)
par: Kim, Minje, et autres
Publié: (2025)
Towards Cross-modal Backward-compatible Representation Learning for Vision-Language Models
par: Jang, Young Kyun, et autres
Publié: (2024)
par: Jang, Young Kyun, et autres
Publié: (2024)
Cascaded Diffusion Framework for Probabilistic Coarse-to-Fine Hand Pose Estimation
par: Woo, Taeyun, et autres
Publié: (2025)
par: Woo, Taeyun, et autres
Publié: (2025)
Multi-modal Generative AI: Multi-modal LLMs, Diffusions, and the Unification
par: Wang, Xin, et autres
Publié: (2024)
par: Wang, Xin, et autres
Publié: (2024)
Cross-modality Guidance-aided Multi-modal Learning with Dual Attention for MRI Brain Tumor Grading
par: Xu, Dunyuan, et autres
Publié: (2024)
par: Xu, Dunyuan, et autres
Publié: (2024)
BP-SGCN: Behavioral Pseudo-Label Informed Sparse Graph Convolution Network for Pedestrian and Heterogeneous Trajectory Prediction
par: Li, Ruochen, et autres
Publié: (2025)
par: Li, Ruochen, et autres
Publié: (2025)
BiTT: Bi-directional Texture Reconstruction of Interacting Two Hands from a Single Image
par: Kim, Minje, et autres
Publié: (2024)
par: Kim, Minje, et autres
Publié: (2024)
InterHandGen: Two-Hand Interaction Generation via Cascaded Reverse Diffusion
par: Lee, Jihyun, et autres
Publié: (2024)
par: Lee, Jihyun, et autres
Publié: (2024)
Body-Hand Modality Expertized Networks with Cross-attention for Fine-grained Skeleton Action Recognition
par: Cho, Seungyeon, et autres
Publié: (2025)
par: Cho, Seungyeon, et autres
Publié: (2025)
Toward the Frontiers of Reliable Diffusion Sampling via Adversarial Sinkhorn Attention Guidance
par: Kim, Kwanyoung
Publié: (2025)
par: Kim, Kwanyoung
Publié: (2025)
Frame Guidance: Training-Free Guidance for Frame-Level Control in Video Diffusion Models
par: Jang, Sangwon, et autres
Publié: (2025)
par: Jang, Sangwon, et autres
Publié: (2025)
DCG ReID: Disentangling Collaboration and Guidance Fusion Representations for Multi-modal Vehicle Re-Identification
par: Zheng, Aihua, et autres
Publié: (2026)
par: Zheng, Aihua, et autres
Publié: (2026)
ZERO: Industry-ready Vision Foundation Model with Multi-modal Prompts
par: Choi, Sangbum, et autres
Publié: (2025)
par: Choi, Sangbum, et autres
Publié: (2025)
Parallel Rescaling: Rebalancing Consistency Guidance for Personalized Diffusion Models
par: Chae, JungWoo, et autres
Publié: (2025)
par: Chae, JungWoo, et autres
Publié: (2025)
SSIMBaD: Sigma Scaling with SSIM-Guided Balanced Diffusion for AnimeFace Colorization
par: Seo, Junpyo, et autres
Publié: (2025)
par: Seo, Junpyo, et autres
Publié: (2025)
Gradient-Free Classifier Guidance for Diffusion Model Sampling
par: Shenoy, Rahul, et autres
Publié: (2024)
par: Shenoy, Rahul, et autres
Publié: (2024)
TCAN: Animating Human Images with Temporally Consistent Pose Guidance using Diffusion Models
par: Kim, Jeongho, et autres
Publié: (2024)
par: Kim, Jeongho, et autres
Publié: (2024)
Joint Learning of Pose Regression and Denoising Diffusion with Score Scaling Sampling for Category-level 6D Pose Estimation
par: Lee, Seunghyun, et autres
Publié: (2025)
par: Lee, Seunghyun, et autres
Publié: (2025)
AlignDiT: Multimodal Aligned Diffusion Transformer for Synchronized Speech Generation
par: Choi, Jeongsoo, et autres
Publié: (2025)
par: Choi, Jeongsoo, et autres
Publié: (2025)
LieHMR: Autoregressive Human Mesh Recovery with $SO(3)$ Diffusion
par: Kim, Donghwan, et autres
Publié: (2025)
par: Kim, Donghwan, et autres
Publié: (2025)
CODE: Contrasting Self-generated Description to Combat Hallucination in Large Multi-modal Models
par: Kim, Junho, et autres
Publié: (2024)
par: Kim, Junho, et autres
Publié: (2024)
M4CXR: Exploring Multi-task Potentials of Multi-modal Large Language Models for Chest X-ray Interpretation
par: Park, Jonggwon, et autres
Publié: (2024)
par: Park, Jonggwon, et autres
Publié: (2024)
Arbitrary-Scale Image Generation and Upsampling using Latent Diffusion Model and Implicit Neural Decoder
par: Kim, Jinseok, et autres
Publié: (2024)
par: Kim, Jinseok, et autres
Publié: (2024)
A Noise is Worth Diffusion Guidance
par: Ahn, Donghoon, et autres
Publié: (2024)
par: Ahn, Donghoon, et autres
Publié: (2024)
Error as Signal: Stiffness-Aware Diffusion Sampling via Embedded Runge-Kutta Guidance
par: Kong, Inho, et autres
Publié: (2026)
par: Kong, Inho, et autres
Publié: (2026)
AttentionHand: Text-driven Controllable Hand Image Generation for 3D Hand Reconstruction in the Wild
par: Park, Junho, et autres
Publié: (2024)
par: Park, Junho, et autres
Publié: (2024)
CharDiff-LP: A Diffusion Model with Character-Level Guidance for License Plate Image Restoration
par: Na, Kihyun, et autres
Publié: (2025)
par: Na, Kihyun, et autres
Publié: (2025)
Latent Guidance in Diffusion Models for Perceptual Evaluations
par: Saini, Shreshth, et autres
Publié: (2025)
par: Saini, Shreshth, et autres
Publié: (2025)
Entropy Rectifying Guidance for Diffusion and Flow Models
par: Ifriqi, Tariq Berrada, et autres
Publié: (2025)
par: Ifriqi, Tariq Berrada, et autres
Publié: (2025)
PCEvE: Part Contribution Evaluation Based Model Explanation for Human Figure Drawing Assessment and Beyond
par: Lee, Jongseo, et autres
Publié: (2024)
par: Lee, Jongseo, et autres
Publié: (2024)
MAGIC: Few-Shot Mask-Guided Anomaly Inpainting with Prompt Perturbation, Spatially Adaptive Guidance, and Context Awareness
par: Choi, JaeHyuck, et autres
Publié: (2025)
par: Choi, JaeHyuck, et autres
Publié: (2025)
Multi-modal Relation Distillation for Unified 3D Representation Learning
par: Wang, Huiqun, et autres
Publié: (2024)
par: Wang, Huiqun, et autres
Publié: (2024)
Simultaneous Long-tailed Recognition and Multi-modal Fusion for Highly Imbalanced Multi-modal Data
par: Yoon, Heegeon, et autres
Publié: (2026)
par: Yoon, Heegeon, et autres
Publié: (2026)
SPLite Hand: Sparsity-Aware Lightweight 3D Hand Pose Estimation
par: Hao, Yeh Keng, et autres
Publié: (2025)
par: Hao, Yeh Keng, et autres
Publié: (2025)
Hand3R: Online 4D Hand-Scene Reconstruction in the Wild
par: Hu, Wendi, et autres
Publié: (2026)
par: Hu, Wendi, et autres
Publié: (2026)
Documents similaires
-
Multi-hypotheses Conditioned Point Cloud Diffusion for 3D Human Reconstruction from Occluded Images
par: Kim, Donghwan, et autres
Publié: (2024) -
Hand-object reconstruction via interaction-aware graph attention mechanism
par: Woo, Taeyun, et autres
Publié: (2024) -
PhysHanDI: Physics-Based Reconstruction of Hand-Deformable Object Interactions
par: Lee, Jihyun, et autres
Publié: (2026) -
3DPhysVideo: Consistency-Guided Flow SDE for Video Generation via 3D Scene Reconstruction and Physical Simulation
par: Kim, Hwidong, et autres
Publié: (2026) -
Visual Delta Generator with Large Multi-modal Models for Semi-supervised Composed Image Retrieval
par: Jang, Young Kyun, et autres
Publié: (2024)