DualDiff+: Dual-Branch Diffusion for High-Fidelity Video Generation with Reward Guidance
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Zhao, Qian, Zezhong, Li, Xiaofan, Xu, Weixiang, Zhao, Gongpeng, Yu, Ruohong, Zhu, Lingsi, Liu, Longjun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DualDiff: Dual-branch Diffusion Model for Autonomous Driving with Semantic Fusion
par: Li, Haoteng, et autres
Publié: (2025)
par: Li, Haoteng, et autres
Publié: (2025)
MagDiff: Multi-Alignment Diffusion for High-Fidelity Video Generation and Editing
par: Zhao, Haoyu, et autres
Publié: (2023)
par: Zhao, Haoyu, et autres
Publié: (2023)
DualCamCtrl: Dual-Branch Diffusion Model for Geometry-Aware Camera-Controlled Video Generation
par: Zhang, Hongfei, et autres
Publié: (2025)
par: Zhang, Hongfei, et autres
Publié: (2025)
DreamVideo: High-Fidelity Image-to-Video Generation with Image Retention and Text Guidance
par: Wang, Cong, et autres
Publié: (2023)
par: Wang, Cong, et autres
Publié: (2023)
DIFFUMA: High-Fidelity Spatio-Temporal Video Prediction via Dual-Path Mamba and Diffusion Enhancement
par: Xie, Xinyu, et autres
Publié: (2025)
par: Xie, Xinyu, et autres
Publié: (2025)
DASH: Dual-Branch Score Distillation for Guidance-Calibrated Compact Diffusion Models
par: Shafi, Abdullah Al, et autres
Publié: (2026)
par: Shafi, Abdullah Al, et autres
Publié: (2026)
GeoDiff3D: Self-Supervised 3D Scene Generation with Geometry-Constrained 2D Diffusion Guidance
par: Zhu, Haozhi, et autres
Publié: (2026)
par: Zhu, Haozhi, et autres
Publié: (2026)
DiffMVR: Diffusion-based Automated Multi-Guidance Video Restoration
par: Zhang, Zheyan, et autres
Publié: (2024)
par: Zhang, Zheyan, et autres
Publié: (2024)
FideDiff: Efficient Diffusion Model for High-Fidelity Image Motion Deblurring
par: Liu, Xiaoyang, et autres
Publié: (2025)
par: Liu, Xiaoyang, et autres
Publié: (2025)
Dual-Stream Diffusion Net for Text-to-Video Generation
par: Liu, Binhui, et autres
Publié: (2023)
par: Liu, Binhui, et autres
Publié: (2023)
Dual Orthogonal Guidance for Robust Diffusion-based Handwritten Text Generation
par: Nikolaidou, Konstantina, et autres
Publié: (2025)
par: Nikolaidou, Konstantina, et autres
Publié: (2025)
MMFace-DiT: A Dual-Stream Diffusion Transformer for High-Fidelity Multimodal Face Generation
par: Krishnamurthy, Bharath, et autres
Publié: (2026)
par: Krishnamurthy, Bharath, et autres
Publié: (2026)
HunyuanVideo-Foley: Multimodal Diffusion with Representation Alignment for High-Fidelity Foley Audio Generation
par: Shan, Sizhe, et autres
Publié: (2025)
par: Shan, Sizhe, et autres
Publié: (2025)
Differentiable Stroke Planning with Dual Parameterization for Efficient and High-Fidelity Painting Creation
par: Liu, Jinfan, et autres
Publié: (2026)
par: Liu, Jinfan, et autres
Publié: (2026)
InvDiff: Invariant Guidance for Bias Mitigation in Diffusion Models
par: Hou, Min, et autres
Publié: (2024)
par: Hou, Min, et autres
Publié: (2024)
DualFast: Dual-Speedup Framework for Fast Sampling of Diffusion Models
par: Yu, Hu, et autres
Publié: (2025)
par: Yu, Hu, et autres
Publié: (2025)
DreamID-V:Bridging the Image-to-Video Gap for High-Fidelity Face Swapping via Diffusion Transformer
par: Guo, Xu, et autres
Publié: (2026)
par: Guo, Xu, et autres
Publié: (2026)
LaMamba-Diff: Linear-Time High-Fidelity Diffusion Models Based on Local Attention and Mamba
par: Fu, Yunxiang, et autres
Publié: (2024)
par: Fu, Yunxiang, et autres
Publié: (2024)
DuoDiff: Accelerating Diffusion Models with a Dual-Backbone Approach
par: Fernández, Daniel Gallo, et autres
Publié: (2024)
par: Fernández, Daniel Gallo, et autres
Publié: (2024)
AtomoVideo: High Fidelity Image-to-Video Generation
par: Gong, Litong, et autres
Publié: (2024)
par: Gong, Litong, et autres
Publié: (2024)
SynthDrive: Scalable Real2Sim2Real Sensor Simulation Pipeline for High-Fidelity Asset Generation and Driving Data Synthesis
par: Chen, Zhengqing, et autres
Publié: (2025)
par: Chen, Zhengqing, et autres
Publié: (2025)
MedDiff-FM: A Diffusion-based Foundation Model for Versatile Medical Image Applications
par: Yu, Yongrui, et autres
Publié: (2024)
par: Yu, Yongrui, et autres
Publié: (2024)
HAODiff: Human-Aware One-Step Diffusion via Dual-Prompt Guidance
par: Gong, Jue, et autres
Publié: (2025)
par: Gong, Jue, et autres
Publié: (2025)
DBDH: A Dual-Branch Dual-Head Neural Network for Invisible Embedded Regions Localization
par: Zhao, Chengxin, et autres
Publié: (2024)
par: Zhao, Chengxin, et autres
Publié: (2024)
DAE-Talker: High Fidelity Speech-Driven Talking Face Generation with Diffusion Autoencoder
par: Du, Chenpeng, et autres
Publié: (2023)
par: Du, Chenpeng, et autres
Publié: (2023)
Artistic Intelligence: A Diffusion-Based Framework for High-Fidelity Landscape Painting Synthesis
par: Yang, Wanggong, et autres
Publié: (2024)
par: Yang, Wanggong, et autres
Publié: (2024)
Diff-BGM: A Diffusion Model for Video Background Music Generation
par: Li, Sizhe, et autres
Publié: (2024)
par: Li, Sizhe, et autres
Publié: (2024)
Mask$^2$DiT: Dual Mask-based Diffusion Transformer for Multi-Scene Long Video Generation
par: Qi, Tianhao, et autres
Publié: (2025)
par: Qi, Tianhao, et autres
Publié: (2025)
The Language of Touch: Translating Vibrations into Text with Dual-Branch Learning
par: Chen, Jin, et autres
Publié: (2026)
par: Chen, Jin, et autres
Publié: (2026)
ReactDiff: Latent Diffusion for Facial Reaction Generation
par: Li, Jiaming, et autres
Publié: (2025)
par: Li, Jiaming, et autres
Publié: (2025)
PhysNeXt: Next-Generation Dual-Branch Structured Attention Fusion Network for Remote Photoplethysmography Measurement
par: Cao, Junzhe, et autres
Publié: (2026)
par: Cao, Junzhe, et autres
Publié: (2026)
Dual-IPO: Dual-Iterative Preference Optimization for Text-to-Video Generation
par: Yang, Xiaomeng, et autres
Publié: (2025)
par: Yang, Xiaomeng, et autres
Publié: (2025)
Beyond Flat Text: Dual Self-inherited Guidance for Visual Text Generation
par: Luo, Minxing, et autres
Publié: (2025)
par: Luo, Minxing, et autres
Publié: (2025)
Dual-Expert Consistency Model for Efficient and High-Quality Video Generation
par: Lv, Zhengyao, et autres
Publié: (2025)
par: Lv, Zhengyao, et autres
Publié: (2025)
Dual Branch VideoMamba with Gated Class Token Fusion for Violence Detection
par: Senadeera, Damith Chamalke, et autres
Publié: (2025)
par: Senadeera, Damith Chamalke, et autres
Publié: (2025)
BrushNet: A Plug-and-Play Image Inpainting Model with Decomposed Dual-Branch Diffusion
par: Ju, Xuan, et autres
Publié: (2024)
par: Ju, Xuan, et autres
Publié: (2024)
RodinHD: High-Fidelity 3D Avatar Generation with Diffusion Models
par: Zhang, Bowen, et autres
Publié: (2024)
par: Zhang, Bowen, et autres
Publié: (2024)
AortaDiff: Volume-Guided Conditional Diffusion Models for Multi-Branch Aortic Surface Generation
par: An, Delin, et autres
Publié: (2025)
par: An, Delin, et autres
Publié: (2025)
Democratizing High-Fidelity Co-Speech Gesture Video Generation
par: Yang, Xu, et autres
Publié: (2025)
par: Yang, Xu, et autres
Publié: (2025)
DAMS:Dual-Branch Adaptive Multiscale Spatiotemporal Framework for Video Anomaly Detection
par: An, Dezhi, et autres
Publié: (2025)
par: An, Dezhi, et autres
Publié: (2025)
Documents similaires
-
DualDiff: Dual-branch Diffusion Model for Autonomous Driving with Semantic Fusion
par: Li, Haoteng, et autres
Publié: (2025) -
MagDiff: Multi-Alignment Diffusion for High-Fidelity Video Generation and Editing
par: Zhao, Haoyu, et autres
Publié: (2023) -
DualCamCtrl: Dual-Branch Diffusion Model for Geometry-Aware Camera-Controlled Video Generation
par: Zhang, Hongfei, et autres
Publié: (2025) -
DreamVideo: High-Fidelity Image-to-Video Generation with Image Retention and Text Guidance
par: Wang, Cong, et autres
Publié: (2023) -
DIFFUMA: High-Fidelity Spatio-Temporal Video Prediction via Dual-Path Mamba and Diffusion Enhancement
par: Xie, Xinyu, et autres
Publié: (2025)