HumanGif: Single-View Human Diffusion with Generative Prior
Fuente:
arXiv
Salvato in:
| Autori principali: | Hu, Shoukang, Narihira, Takuya, Fukuda, Kazumi, Sawata, Ryosuke, Shibuya, Takashi, Mitsufuji, Yuki |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GenWarp: Single Image to Novel Views with Semantic-Preserving Generative Warping
di: Seo, Junyoung, et al.
Pubblicazione: (2024)
di: Seo, Junyoung, et al.
Pubblicazione: (2024)
Vid-CamEdit: Video Camera Trajectory Editing with Generative Rendering from Estimated Geometry
di: Seo, Junyoung, et al.
Pubblicazione: (2025)
di: Seo, Junyoung, et al.
Pubblicazione: (2025)
3D Scene Prompting for Scene-Consistent Camera-Controllable Video Generation
di: Lee, JoungBin, et al.
Pubblicazione: (2025)
di: Lee, JoungBin, et al.
Pubblicazione: (2025)
Dyadic Mamba: Long-term Dyadic Human Motion Synthesis
di: Tanke, Julian, et al.
Pubblicazione: (2025)
di: Tanke, Julian, et al.
Pubblicazione: (2025)
D$^2$USt3R: Enhancing 3D Reconstruction for Dynamic Scenes
di: Han, Jisang, et al.
Pubblicazione: (2025)
di: Han, Jisang, et al.
Pubblicazione: (2025)
MMAudioReverbs: Video-Guided Acoustic Modeling for Dereverberation and Room Impulse Response Estimation
di: Takahashi, Akira, et al.
Pubblicazione: (2026)
di: Takahashi, Akira, et al.
Pubblicazione: (2026)
MMDisCo: Multi-Modal Discriminator-Guided Cooperative Diffusion for Joint Audio and Video Generation
di: Hayakawa, Akio, et al.
Pubblicazione: (2024)
di: Hayakawa, Akio, et al.
Pubblicazione: (2024)
MoLA: Motion Generation and Editing with Latent Diffusion Enhanced by Adversarial Training
di: Uchida, Kengo, et al.
Pubblicazione: (2024)
di: Uchida, Kengo, et al.
Pubblicazione: (2024)
C3G: Learning Compact 3D Representations with 2K Gaussians
di: An, Honggyu, et al.
Pubblicazione: (2025)
di: An, Honggyu, et al.
Pubblicazione: (2025)
Learning Global Motion with Compact Gaussians for Feed-Forward 4D Reconstruction
di: Kim, Mungyeom, et al.
Pubblicazione: (2026)
di: Kim, Mungyeom, et al.
Pubblicazione: (2026)
Efficiency without Compromise: CLIP-aided Text-to-Image GANs with Increased Diversity
di: Kobayashi, Yuya, et al.
Pubblicazione: (2025)
di: Kobayashi, Yuya, et al.
Pubblicazione: (2025)
Forging and Removing Latent-Noise Diffusion Watermarks Using a Single Image
di: Jain, Anubhav, et al.
Pubblicazione: (2025)
di: Jain, Anubhav, et al.
Pubblicazione: (2025)
TITAN-Guide: Taming Inference-Time AligNment for Guided Text-to-Video Diffusion Models
di: Simon, Christian, et al.
Pubblicazione: (2025)
di: Simon, Christian, et al.
Pubblicazione: (2025)
AutoRefiner: Improving Autoregressive Video Diffusion Models via Reflective Refinement Over the Stochastic Sampling Path
di: Yu, Zhengyang, et al.
Pubblicazione: (2025)
di: Yu, Zhengyang, et al.
Pubblicazione: (2025)
Pix2Gif: Motion-Guided Diffusion for GIF Generation
di: Kandala, Hitesh, et al.
Pubblicazione: (2024)
di: Kandala, Hitesh, et al.
Pubblicazione: (2024)
Step-by-Step Video-to-Audio Synthesis via Negative Audio Guidance
di: Hayakawa, Akio, et al.
Pubblicazione: (2025)
di: Hayakawa, Akio, et al.
Pubblicazione: (2025)
EG-HumanNeRF: Efficient Generalizable Human NeRF Utilizing Human Prior for Sparse View
di: Wang, Zhaorong, et al.
Pubblicazione: (2024)
di: Wang, Zhaorong, et al.
Pubblicazione: (2024)
Reference-Free Image Quality Assessment for Virtual Try-On via Human Feedback
di: Hirakawa, Yuki, et al.
Pubblicazione: (2026)
di: Hirakawa, Yuki, et al.
Pubblicazione: (2026)
CCStereo: Audio-Visual Contextual and Contrastive Learning for Binaural Audio Generation
di: Chen, Yuanhong, et al.
Pubblicazione: (2025)
di: Chen, Yuanhong, et al.
Pubblicazione: (2025)
HERO: Human-Feedback Efficient Reinforcement Learning for Online Diffusion Model Finetuning
di: Hiranaka, Ayano, et al.
Pubblicazione: (2024)
di: Hiranaka, Ayano, et al.
Pubblicazione: (2024)
OccFusion: Rendering Occluded Humans with Generative Diffusion Priors
di: Sun, Adam, et al.
Pubblicazione: (2024)
di: Sun, Adam, et al.
Pubblicazione: (2024)
Single-View Scene Point Cloud Human Grasp Generation
di: Wang, Yan-Kang, et al.
Pubblicazione: (2024)
di: Wang, Yan-Kang, et al.
Pubblicazione: (2024)
Blur2Sharp: Human Novel Pose and View Synthesis with Generative Prior Refinement
di: Lai, Chia-Hern, et al.
Pubblicazione: (2025)
di: Lai, Chia-Hern, et al.
Pubblicazione: (2025)
StereoSync: Spatially-Aware Stereo Audio Generation from Video
di: Marinoni, Christian, et al.
Pubblicazione: (2025)
di: Marinoni, Christian, et al.
Pubblicazione: (2025)
DiffBody: Human Body Restoration by Imagining with Generative Diffusion Prior
di: Zhang, Yiming, et al.
Pubblicazione: (2024)
di: Zhang, Yiming, et al.
Pubblicazione: (2024)
HumanSplat: Generalizable Single-Image Human Gaussian Splatting with Structure Priors
di: Pan, Panwang, et al.
Pubblicazione: (2024)
di: Pan, Panwang, et al.
Pubblicazione: (2024)
Template-Free Single-View 3D Human Digitalization with Diffusion-Guided LRM
di: Weng, Zhenzhen, et al.
Pubblicazione: (2024)
di: Weng, Zhenzhen, et al.
Pubblicazione: (2024)
Human Video Generation from a Single Image with 3D Pose and View Control
di: Wang, Tiantian, et al.
Pubblicazione: (2026)
di: Wang, Tiantian, et al.
Pubblicazione: (2026)
GaussianIP: Identity-Preserving Realistic 3D Human Generation via Human-Centric Diffusion Prior
di: Tang, Zichen, et al.
Pubblicazione: (2025)
di: Tang, Zichen, et al.
Pubblicazione: (2025)
TraSCE: Trajectory Steering for Concept Erasure
di: Jain, Anubhav, et al.
Pubblicazione: (2024)
di: Jain, Anubhav, et al.
Pubblicazione: (2024)
Classifier-Free Guidance inside the Attraction Basin May Cause Memorization
di: Jain, Anubhav, et al.
Pubblicazione: (2024)
di: Jain, Anubhav, et al.
Pubblicazione: (2024)
MVD-HuGaS: Human Gaussians from a Single Image via 3D Human Multi-view Diffusion Prior
di: Xiong, Kaiqiang, et al.
Pubblicazione: (2025)
di: Xiong, Kaiqiang, et al.
Pubblicazione: (2025)
Visual Echoes: A Simple Unified Transformer for Audio-Visual Generation
di: Yang, Shiqi, et al.
Pubblicazione: (2024)
di: Yang, Shiqi, et al.
Pubblicazione: (2024)
Generalizable Human Gaussians from Single-View Image
di: Chen, Jinnan, et al.
Pubblicazione: (2024)
di: Chen, Jinnan, et al.
Pubblicazione: (2024)
Real-Time Human Frontal View Synthesis from a Single Image
di: Lin, Fangyu, et al.
Pubblicazione: (2026)
di: Lin, Fangyu, et al.
Pubblicazione: (2026)
MMAudio: Taming Multimodal Joint Training for High-Quality Video-to-Audio Synthesis
di: Cheng, Ho Kei, et al.
Pubblicazione: (2024)
di: Cheng, Ho Kei, et al.
Pubblicazione: (2024)
Fashion Style Editing with Generative Human Prior
di: Kong, Chaerin, et al.
Pubblicazione: (2024)
di: Kong, Chaerin, et al.
Pubblicazione: (2024)
DPMesh: Exploiting Diffusion Prior for Occluded Human Mesh Recovery
di: Zhu, Yixuan, et al.
Pubblicazione: (2024)
di: Zhu, Yixuan, et al.
Pubblicazione: (2024)
Echoes Over Time: Unlocking Length Generalization in Video-to-Audio Generation Models
di: Simon, Christian, et al.
Pubblicazione: (2026)
di: Simon, Christian, et al.
Pubblicazione: (2026)
TalkCuts: A Large-Scale Dataset for Multi-Shot Human Speech Video Generation
di: Chen, Jiaben, et al.
Pubblicazione: (2025)
di: Chen, Jiaben, et al.
Pubblicazione: (2025)
Documenti analoghi
-
GenWarp: Single Image to Novel Views with Semantic-Preserving Generative Warping
di: Seo, Junyoung, et al.
Pubblicazione: (2024) -
Vid-CamEdit: Video Camera Trajectory Editing with Generative Rendering from Estimated Geometry
di: Seo, Junyoung, et al.
Pubblicazione: (2025) -
3D Scene Prompting for Scene-Consistent Camera-Controllable Video Generation
di: Lee, JoungBin, et al.
Pubblicazione: (2025) -
Dyadic Mamba: Long-term Dyadic Human Motion Synthesis
di: Tanke, Julian, et al.
Pubblicazione: (2025) -
D$^2$USt3R: Enhancing 3D Reconstruction for Dynamic Scenes
di: Han, Jisang, et al.
Pubblicazione: (2025)