Salvato in:
| Autori principali: | Huang, Junjia, Yang, Binbin, Yan, Pengxiang, Liu, Jiyang, Xia, Bin, Wang, Zhao, Wang, Yitong, Lin, Liang, Li, Guanbin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2604.17195 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DreamFuse: Adaptive Image Fusion with Diffusion Transformer
di: Huang, Junjia, et al.
Pubblicazione: (2025)
di: Huang, Junjia, et al.
Pubblicazione: (2025)
DreamLayer: Simultaneous Multi-Layer Generation via Diffusion Mode
di: Huang, Junjia, et al.
Pubblicazione: (2025)
di: Huang, Junjia, et al.
Pubblicazione: (2025)
DreamOmni3: Scribble-based Editing and Generation
di: Xia, Bin, et al.
Pubblicazione: (2025)
di: Xia, Bin, et al.
Pubblicazione: (2025)
DreamOmni2: Multimodal Instruction-based Editing and Generation
di: Xia, Bin, et al.
Pubblicazione: (2025)
di: Xia, Bin, et al.
Pubblicazione: (2025)
DreamVE: Unified Instruction-based Image and Video Editing
di: Xia, Bin, et al.
Pubblicazione: (2025)
di: Xia, Bin, et al.
Pubblicazione: (2025)
UniCell: Universal Cell Nucleus Classification via Prompt Learning
di: Huang, Junjia, et al.
Pubblicazione: (2024)
di: Huang, Junjia, et al.
Pubblicazione: (2024)
Storyboard guided Alignment for Fine-grained Video Action Recognition
di: Liu, Enqi, et al.
Pubblicazione: (2024)
di: Liu, Enqi, et al.
Pubblicazione: (2024)
DreamOmni: Unified Image Generation and Editing
di: Xia, Bin, et al.
Pubblicazione: (2024)
di: Xia, Bin, et al.
Pubblicazione: (2024)
UniDream: Unifying Diffusion Priors for Relightable Text-to-3D Generation
di: Liu, Zexiang, et al.
Pubblicazione: (2023)
di: Liu, Zexiang, et al.
Pubblicazione: (2023)
DrawVideo: Generating Long Video from Storyboard Keyframe Sketches
di: Xu, Chuanzhi, et al.
Pubblicazione: (2026)
di: Xu, Chuanzhi, et al.
Pubblicazione: (2026)
LMP: Leveraging Motion Prior in Zero-Shot Video Generation with Diffusion Transformer
di: Chen, Changgu, et al.
Pubblicazione: (2025)
di: Chen, Changgu, et al.
Pubblicazione: (2025)
OrbitNVS: Harnessing Video Diffusion Priors for Novel View Synthesis
di: Liang, Jinglin, et al.
Pubblicazione: (2026)
di: Liang, Jinglin, et al.
Pubblicazione: (2026)
DreamPhysics: Learning Physics-Based 3D Dynamics with Video Diffusion Priors
di: Huang, Tianyu, et al.
Pubblicazione: (2024)
di: Huang, Tianyu, et al.
Pubblicazione: (2024)
High-fidelity and Lip-synced Talking Face Synthesis via Landmark-based Diffusion Model
di: Zhong, Weizhi, et al.
Pubblicazione: (2024)
di: Zhong, Weizhi, et al.
Pubblicazione: (2024)
WildVidFit: Video Virtual Try-On in the Wild via Image-Based Controlled Diffusion Models
di: He, Zijian, et al.
Pubblicazione: (2024)
di: He, Zijian, et al.
Pubblicazione: (2024)
DreamVideo-2: Zero-Shot Subject-Driven Video Customization with Precise Motion Control
di: Wei, Yujie, et al.
Pubblicazione: (2024)
di: Wei, Yujie, et al.
Pubblicazione: (2024)
StoryBlender: Inter-Shot Consistent and Editable 3D Storyboard with Spatial-temporal Dynamics
di: Li, Bingliang, et al.
Pubblicazione: (2026)
di: Li, Bingliang, et al.
Pubblicazione: (2026)
UnPose: Uncertainty-Guided Diffusion Priors for Zero-Shot Pose Estimation
di: Jiang, Zhaodong, et al.
Pubblicazione: (2025)
di: Jiang, Zhaodong, et al.
Pubblicazione: (2025)
AnchorDream: Repurposing Video Diffusion for Embodiment-Aware Robot Data Synthesis
di: Ye, Junjie, et al.
Pubblicazione: (2025)
di: Ye, Junjie, et al.
Pubblicazione: (2025)
SDesc3D: Towards Layout-Aware 3D Indoor Scene Generation from Short Descriptions
di: Feng, Jie, et al.
Pubblicazione: (2026)
di: Feng, Jie, et al.
Pubblicazione: (2026)
SwapAnyone: Consistent and Realistic Video Synthesis for Swapping Any Person into Any Video
di: Zhao, Chengshu, et al.
Pubblicazione: (2025)
di: Zhao, Chengshu, et al.
Pubblicazione: (2025)
One Model for All: Unified Try-On and Try-Off in Any Pose via LLM-Inspired Bidirectional Tweedie Diffusion
di: Liu, Jinxi, et al.
Pubblicazione: (2025)
di: Liu, Jinxi, et al.
Pubblicazione: (2025)
Open-Vocabulary Segmentation with Semantic-Assisted Calibration
di: Liu, Yong, et al.
Pubblicazione: (2023)
di: Liu, Yong, et al.
Pubblicazione: (2023)
Memory Storyboard: Leveraging Temporal Segmentation for Streaming Self-Supervised Learning from Egocentric Videos
di: Yang, Yanlai, et al.
Pubblicazione: (2025)
di: Yang, Yanlai, et al.
Pubblicazione: (2025)
LaneDiffusion: Improving Centerline Graph Learning via Prior Injected BEV Feature Generation
di: Wang, Zijie, et al.
Pubblicazione: (2025)
di: Wang, Zijie, et al.
Pubblicazione: (2025)
Diffusion Priors for Dynamic View Synthesis from Monocular Videos
di: Wang, Chaoyang, et al.
Pubblicazione: (2024)
di: Wang, Chaoyang, et al.
Pubblicazione: (2024)
DreamSR: Towards Ultra-High-Resolution Image Super-Resolution via a Receptive-Field Enhanced Diffusion Transformer
di: Dong, Qingji, et al.
Pubblicazione: (2026)
di: Dong, Qingji, et al.
Pubblicazione: (2026)
Zero-Shot Personalized Camera Motion Control for Image-to-Video Synthesis
di: Guhan, Pooja, et al.
Pubblicazione: (2025)
di: Guhan, Pooja, et al.
Pubblicazione: (2025)
Zero-Shot Human-Object Interaction Synthesis with Multimodal Priors
di: Lou, Yuke, et al.
Pubblicazione: (2025)
di: Lou, Yuke, et al.
Pubblicazione: (2025)
DreamVTON: Customizing 3D Virtual Try-on with Personalized Diffusion Models
di: Xie, Zhenyu, et al.
Pubblicazione: (2024)
di: Xie, Zhenyu, et al.
Pubblicazione: (2024)
Searching Priors Makes Text-to-Video Synthesis Better
di: Cheng, Haoran, et al.
Pubblicazione: (2024)
di: Cheng, Haoran, et al.
Pubblicazione: (2024)
NormalCrafter: Learning Temporally Consistent Normals from Video Diffusion Priors
di: Bin, Yanrui, et al.
Pubblicazione: (2025)
di: Bin, Yanrui, et al.
Pubblicazione: (2025)
Credible Teacher for Semi-Supervised Object Detection in Open Scene
di: Zhuang, Jingyu, et al.
Pubblicazione: (2024)
di: Zhuang, Jingyu, et al.
Pubblicazione: (2024)
Single-Shot HDR Recovery via a Video Diffusion Prior
di: Talegaonkar, Chinmay, et al.
Pubblicazione: (2026)
di: Talegaonkar, Chinmay, et al.
Pubblicazione: (2026)
PiTe: Pixel-Temporal Alignment for Large Video-Language Model
di: Liu, Yang, et al.
Pubblicazione: (2024)
di: Liu, Yang, et al.
Pubblicazione: (2024)
DreamLight: Towards Harmonious and Consistent Image Relighting
di: Liu, Yong, et al.
Pubblicazione: (2025)
di: Liu, Yong, et al.
Pubblicazione: (2025)
EgoTwin: Dreaming Body and View in First Person
di: Xiu, Jingqiao, et al.
Pubblicazione: (2025)
di: Xiu, Jingqiao, et al.
Pubblicazione: (2025)
One-Shot Learning for Pose-Guided Person Image Synthesis in the Wild
di: Fan, Dongqi, et al.
Pubblicazione: (2024)
di: Fan, Dongqi, et al.
Pubblicazione: (2024)
Greit-HRNet: Grouped Lightweight High-Resolution Network for Human Pose Estimation
di: Han, Junjia
Pubblicazione: (2024)
di: Han, Junjia
Pubblicazione: (2024)
DreamInsert: Zero-Shot Image-to-Video Object Insertion from A Single Image
di: Zhao, Qi, et al.
Pubblicazione: (2025)
di: Zhao, Qi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
DreamFuse: Adaptive Image Fusion with Diffusion Transformer
di: Huang, Junjia, et al.
Pubblicazione: (2025) -
DreamLayer: Simultaneous Multi-Layer Generation via Diffusion Mode
di: Huang, Junjia, et al.
Pubblicazione: (2025) -
DreamOmni3: Scribble-based Editing and Generation
di: Xia, Bin, et al.
Pubblicazione: (2025) -
DreamOmni2: Multimodal Instruction-based Editing and Generation
di: Xia, Bin, et al.
Pubblicazione: (2025) -
DreamVE: Unified Instruction-based Image and Video Editing
di: Xia, Bin, et al.
Pubblicazione: (2025)