Adaptive Multi-Modal Control of Digital Human Hand Synthesis Using a Region-Aware Cycle Loss
Fuente:
arXiv
Saved in:
| Main Authors: | Fu, Qifan, Yang, Xiaohang, Asad, Muhammad, Oh, Changjae, Yuan, Shanxin, Slabaugh, Gregory |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
HanDrawer: Leveraging Spatial Information to Render Realistic Hands Using a Conditional Diffusion Model in Single Stage
by: Fu, Qifan, et al.
Published: (2025)
by: Fu, Qifan, et al.
Published: (2025)
Robust Photo-Realistic Hand Gesture Generation: from Single View to Multiple View
by: Fu, Qifan, et al.
Published: (2025)
by: Fu, Qifan, et al.
Published: (2025)
STaR: Seamless Spatial-Temporal Aware Motion Retargeting with Penetration and Consistency Constraints
by: Yang, Xiaohang, et al.
Published: (2025)
by: Yang, Xiaohang, et al.
Published: (2025)
SuperCap: Multi-resolution Superpixel-based Image Captioning
by: Senior, Henry, et al.
Published: (2025)
by: Senior, Henry, et al.
Published: (2025)
DanceChat: Large Language Model-Guided Music-to-Dance Generation
by: Wang, Qing, et al.
Published: (2025)
by: Wang, Qing, et al.
Published: (2025)
HandSCS: Structural Coordinate Space for Animatable Hand Gaussian Splatting
by: Dong, Yilan, et al.
Published: (2025)
by: Dong, Yilan, et al.
Published: (2025)
Graph Neural Networks in Vision-Language Image Understanding: A Survey
by: Senior, Henry, et al.
Published: (2023)
by: Senior, Henry, et al.
Published: (2023)
Stereo Hand-Object Reconstruction for Human-to-Robot Handover
by: Pang, Yik Lung, et al.
Published: (2024)
by: Pang, Yik Lung, et al.
Published: (2024)
Multi-view Cardiac Image Segmentation via Trans-Dimensional Priors
by: Khan, Abbas, et al.
Published: (2024)
by: Khan, Abbas, et al.
Published: (2024)
CAMS: Convolution and Attention-Free Mamba-based Cardiac Image Segmentation
by: Khan, Abbas, et al.
Published: (2024)
by: Khan, Abbas, et al.
Published: (2024)
Compositional Segmentation of Cardiac Images Leveraging Metadata
by: Khan, Abbas, et al.
Published: (2024)
by: Khan, Abbas, et al.
Published: (2024)
Crop and Couple: cardiac image segmentation using interlinked specialist networks
by: Khan, Abbas, et al.
Published: (2024)
by: Khan, Abbas, et al.
Published: (2024)
Diffusion-driven GAN Inversion for Multi-Modal Face Image Generation
by: Kim, Jihyun, et al.
Published: (2024)
by: Kim, Jihyun, et al.
Published: (2024)
MOAB: Multi-Modal Outer Arithmetic Block For Fusion Of Histopathological Images And Genetic Data For Brain Tumor Grading
by: Alwazzan, Omnia, et al.
Published: (2024)
by: Alwazzan, Omnia, et al.
Published: (2024)
Improving Image De-raining Using Reference-Guided Transformers
by: Ye, Zihao, et al.
Published: (2024)
by: Ye, Zihao, et al.
Published: (2024)
The Detector Teaches Itself: Lightweight Self-Supervised Adaptation for Open-Vocabulary Object Detection
by: Wan, Yazhe, et al.
Published: (2026)
by: Wan, Yazhe, et al.
Published: (2026)
Chain-of-Caption: Training-free improvement of multimodal large language model on referring expression comprehension
by: Pang, Yik Lung, et al.
Published: (2026)
by: Pang, Yik Lung, et al.
Published: (2026)
OpenUS: A Fully Open-Source Foundation Model for Ultrasound Image Analysis via Self-Adaptive Masked Contrastive Learning
by: Zheng, Xiaoyu, et al.
Published: (2025)
by: Zheng, Xiaoyu, et al.
Published: (2025)
Adaptive Multi-Modal Cross-Entropy Loss for Stereo Matching
by: Xu, Peng, et al.
Published: (2023)
by: Xu, Peng, et al.
Published: (2023)
Toward Human-Robot Teaming: Learning Handover Behaviors from 3D Scenes
by: Wu, Yuekun, et al.
Published: (2025)
by: Wu, Yuekun, et al.
Published: (2025)
FlowOVD: Learning Generative Latent Flows for Zero-shot Open-vocabulary Detection
by: Wei, Yao, et al.
Published: (2026)
by: Wei, Yao, et al.
Published: (2026)
Sub-Region-Aware Modality Fusion and Adaptive Prompting for Multi-Modal Brain Tumor Segmentation
by: Alijani, Shadi, et al.
Published: (2026)
by: Alijani, Shadi, et al.
Published: (2026)
Sparse multi-view hand-object reconstruction for unseen environments
by: Pang, Yik Lung, et al.
Published: (2024)
by: Pang, Yik Lung, et al.
Published: (2024)
Neural quantum support vector data description for one-class classification
by: Im, Changjae, et al.
Published: (2026)
by: Im, Changjae, et al.
Published: (2026)
RAVE: Residual Vector Embedding for CLIP-Guided Backlit Image Enhancement
by: Gaintseva, Tatiana, et al.
Published: (2024)
by: Gaintseva, Tatiana, et al.
Published: (2024)
FOAA: Flattened Outer Arithmetic Attention For Multimodal Tumor Classification
by: Alwazzan, Omnia, et al.
Published: (2024)
by: Alwazzan, Omnia, et al.
Published: (2024)
DAAL: Density-Aware Adaptive Line Margin Loss for Multi-Modal Deep Metric Learning
by: Gebrerufael, Hadush Hailu, et al.
Published: (2024)
by: Gebrerufael, Hadush Hailu, et al.
Published: (2024)
Learning by Erasing: Conditional Entropy based Transferable Out-Of-Distribution Detection
by: Xing, Meng, et al.
Published: (2022)
by: Xing, Meng, et al.
Published: (2022)
Improving Generalization of Language-Conditioned Robot Manipulation
by: Cui, Chenglin, et al.
Published: (2025)
by: Cui, Chenglin, et al.
Published: (2025)
Model‐Based Active Fault‐Tolerant Control Method for Variable Cycle Engine
by: Kejie Xu, et al.
Published: (2026)
by: Kejie Xu, et al.
Published: (2026)
CoLoRSMamba: Conditional LoRA-Steered Mamba for Supervised Multimodal Violence Detection
by: Senadeera, Damith Chamalke, et al.
Published: (2026)
by: Senadeera, Damith Chamalke, et al.
Published: (2026)
CUE-Net: Violence Detection Video Analytics with Spatial Cropping, Enhanced UniformerV2 and Modified Efficient Additive Attention
by: Senadeera, Damith Chamalke, et al.
Published: (2024)
by: Senadeera, Damith Chamalke, et al.
Published: (2024)
Dual Branch VideoMamba with Gated Class Token Fusion for Violence Detection
by: Senadeera, Damith Chamalke, et al.
Published: (2025)
by: Senadeera, Damith Chamalke, et al.
Published: (2025)
Localization Meets Uncertainty: Uncertainty-Aware Multi-Modal Localization
by: Won, Hye-Min, et al.
Published: (2025)
by: Won, Hye-Min, et al.
Published: (2025)
Multi-Rigid-Body Approximation of Human Hands with Application to Digital Twin
by: Zhao, Bin, et al.
Published: (2025)
by: Zhao, Bin, et al.
Published: (2025)
Learning human-to-robot handovers through 3D scene reconstruction
by: Wu, Yuekun, et al.
Published: (2025)
by: Wu, Yuekun, et al.
Published: (2025)
LaVA-Man: Learning Visual Action Representations for Robot Manipulation
by: Zhu, Chaoran, et al.
Published: (2025)
by: Zhu, Chaoran, et al.
Published: (2025)
Machine Learning Techniques for Source Localisation in Elastic Media
by: Mandalia, Bansi, et al.
Published: (2024)
by: Mandalia, Bansi, et al.
Published: (2024)
From Keyboard to Chatbot: An AI-powered Integration Platform with Large-Language Models for Teaching Computational Thinking for Young Children
by: Lee, Changjae, et al.
Published: (2024)
by: Lee, Changjae, et al.
Published: (2024)
Learning to Rebalance Multi-Modal Optimization by Adaptively Masking Subnetworks
by: Yang, Yang, et al.
Published: (2024)
by: Yang, Yang, et al.
Published: (2024)
Similar Items
-
HanDrawer: Leveraging Spatial Information to Render Realistic Hands Using a Conditional Diffusion Model in Single Stage
by: Fu, Qifan, et al.
Published: (2025) -
Robust Photo-Realistic Hand Gesture Generation: from Single View to Multiple View
by: Fu, Qifan, et al.
Published: (2025) -
STaR: Seamless Spatial-Temporal Aware Motion Retargeting with Penetration and Consistency Constraints
by: Yang, Xiaohang, et al.
Published: (2025) -
SuperCap: Multi-resolution Superpixel-based Image Captioning
by: Senior, Henry, et al.
Published: (2025) -
DanceChat: Large Language Model-Guided Music-to-Dance Generation
by: Wang, Qing, et al.
Published: (2025)