Dual-Expert Consistency Model for Efficient and High-Quality Video Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lv, Zhengyao, Si, Chenyang, Pan, Tianlin, Chen, Zhaoxi, Wong, Kwan-Yee K., Qiao, Yu, Liu, Ziwei |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Rethinking Cross-Modal Interaction in Multimodal Diffusion Transformers
par: Lv, Zhengyao, et autres
Publié: (2025)
par: Lv, Zhengyao, et autres
Publié: (2025)
FasterCache: Training-Free Video Diffusion Model Acceleration with High Quality
par: Lv, Zhengyao, et autres
Publié: (2024)
par: Lv, Zhengyao, et autres
Publié: (2024)
StableWorld: Towards Stable and Consistent Long Interactive Video Generation
par: Yang, Ying, et autres
Publié: (2026)
par: Yang, Ying, et autres
Publié: (2026)
RepVideo: Rethinking Cross-Layer Representation for Video Generation
par: Si, Chenyang, et autres
Publié: (2025)
par: Si, Chenyang, et autres
Publié: (2025)
DUO-VSR: Dual-Stream Distillation for One-Step Video Super-Resolution
par: Lv, Zhengyao, et autres
Publié: (2026)
par: Lv, Zhengyao, et autres
Publié: (2026)
PLACE: Adaptive Layout-Semantic Fusion for Semantic Image Synthesis
par: Lv, Zhengyao, et autres
Publié: (2024)
par: Lv, Zhengyao, et autres
Publié: (2024)
DiverseAR: Boosting Diversity in Bitwise Autoregressive Image Generation
par: Yang, Ying, et autres
Publié: (2025)
par: Yang, Ying, et autres
Publié: (2025)
DecMem: Towards Minute-Long Consistent World Generation with Decoupled Memory
par: Yang, Zhenhao, et autres
Publié: (2026)
par: Yang, Zhenhao, et autres
Publié: (2026)
LongVie: Multimodal-Guided Controllable Ultra-Long Video Generation
par: Gao, Jianxiong, et autres
Publié: (2025)
par: Gao, Jianxiong, et autres
Publié: (2025)
ConceptExpress: Harnessing Diffusion Models for Single-image Unsupervised Concept Extraction
par: Hao, Shaozhe, et autres
Publié: (2024)
par: Hao, Shaozhe, et autres
Publié: (2024)
Collaborative Multi-Modal Coding for High-Quality 3D Generation
par: Cao, Ziang, et autres
Publié: (2025)
par: Cao, Ziang, et autres
Publié: (2025)
NOVA: Sparse Control, Dense Synthesis for Pair-Free Video Editing
par: Pan, Tianlin, et autres
Publié: (2026)
par: Pan, Tianlin, et autres
Publié: (2026)
AvatarGO: Zero-shot 4D Human-Object Interaction Generation and Animation
par: Cao, Yukang, et autres
Publié: (2024)
par: Cao, Yukang, et autres
Publié: (2024)
LongVie 2: Multimodal Controllable Ultra-Long Video World Model
par: Gao, Jianxiong, et autres
Publié: (2025)
par: Gao, Jianxiong, et autres
Publié: (2025)
VipDiff: Towards Coherent and Diverse Video Inpainting via Training-free Denoising Diffusion Models
par: Xie, Chaohao, et autres
Publié: (2025)
par: Xie, Chaohao, et autres
Publié: (2025)
CiPR: An Efficient Framework with Cross-instance Positive Relations for Generalized Category Discovery
par: Hao, Shaozhe, et autres
Publié: (2023)
par: Hao, Shaozhe, et autres
Publié: (2023)
ArtiFade: Learning to Generate High-quality Subject from Blemished Images
par: Yang, Shuya, et autres
Publié: (2024)
par: Yang, Shuya, et autres
Publié: (2024)
PhysX-3D: Physical-Grounded 3D Asset Generation
par: Cao, Ziang, et autres
Publié: (2025)
par: Cao, Ziang, et autres
Publié: (2025)
FreeInit: Bridging Initialization Gap in Video Diffusion Models
par: Wu, Tianxing, et autres
Publié: (2023)
par: Wu, Tianxing, et autres
Publié: (2023)
FreeMorph: Tuning-Free Generalized Image Morphing with Diffusion Model
par: Cao, Yukang, et autres
Publié: (2025)
par: Cao, Yukang, et autres
Publié: (2025)
A Survey on 3D Human Avatar Modeling -- From Reconstruction to Generation
par: Wang, Ruihe, et autres
Publié: (2024)
par: Wang, Ruihe, et autres
Publié: (2024)
Bridging Different Language Models and Generative Vision Models for Text-to-Image Generation
par: Zhao, Shihao, et autres
Publié: (2024)
par: Zhao, Shihao, et autres
Publié: (2024)
OnlineSI: Taming Large Language Model for Online 3D Understanding and Grounding
par: Liu, Zixian, et autres
Publié: (2026)
par: Liu, Zixian, et autres
Publié: (2026)
Compositional Generative Model of Unbounded 4D Cities
par: Xie, Haozhe, et autres
Publié: (2025)
par: Xie, Haozhe, et autres
Publié: (2025)
CityDreamer: Compositional Generative Model of Unbounded 3D Cities
par: Xie, Haozhe, et autres
Publié: (2023)
par: Xie, Haozhe, et autres
Publié: (2023)
VersusQ: Pairwise Margin Reasoning for Generalizable Video Quality Assessment
par: Meng, Shibei, et autres
Publié: (2026)
par: Meng, Shibei, et autres
Publié: (2026)
Generative Gaussian Splatting for Unbounded 3D City Generation
par: Xie, Haozhe, et autres
Publié: (2024)
par: Xie, Haozhe, et autres
Publié: (2024)
LooC: Effective Low-Dimensional Codebook for Compositional Vector Quantization
par: Li, Jie, et autres
Publié: (2026)
par: Li, Jie, et autres
Publié: (2026)
Lumina-Video: Efficient and Flexible Video Generation with Multi-scale Next-DiT
par: Liu, Dongyang, et autres
Publié: (2025)
par: Liu, Dongyang, et autres
Publié: (2025)
FreeTraj: Tuning-Free Trajectory Control in Video Diffusion Models
par: Qiu, Haonan, et autres
Publié: (2024)
par: Qiu, Haonan, et autres
Publié: (2024)
InsMapper: Exploring Inner-instance Information for Vectorized HD Mapping
par: Xu, Zhenhua, et autres
Publié: (2023)
par: Xu, Zhenhua, et autres
Publié: (2023)
FashionEngine: Interactive 3D Human Generation and Editing via Multimodal Controls
par: Hu, Tao, et autres
Publié: (2024)
par: Hu, Tao, et autres
Publié: (2024)
VBench++: Comprehensive and Versatile Benchmark Suite for Video Generative Models
par: Huang, Ziqi, et autres
Publié: (2024)
par: Huang, Ziqi, et autres
Publié: (2024)
STCDiT: Spatio-Temporally Consistent Diffusion Transformer for High-Quality Video Super-Resolution
par: Chen, Junyang, et autres
Publié: (2025)
par: Chen, Junyang, et autres
Publié: (2025)
LGM: Large Multi-View Gaussian Model for High-Resolution 3D Content Creation
par: Tang, Jiaxiang, et autres
Publié: (2024)
par: Tang, Jiaxiang, et autres
Publié: (2024)
3D Scene Generation: A Survey
par: Wen, Beichen, et autres
Publié: (2025)
par: Wen, Beichen, et autres
Publié: (2025)
BlockVid: Block Diffusion for High-Quality and Consistent Minute-Long Video Generation
par: Zhang, Zeyu, et autres
Publié: (2025)
par: Zhang, Zeyu, et autres
Publié: (2025)
MotionAura: Generating High-Quality and Motion Consistent Videos using Discrete Diffusion
par: Susladkar, Onkar, et autres
Publié: (2024)
par: Susladkar, Onkar, et autres
Publié: (2024)
PhysX-Anything: Simulation-Ready Physical 3D Assets from Single Image
par: Cao, Ziang, et autres
Publié: (2025)
par: Cao, Ziang, et autres
Publié: (2025)
Free4D: Tuning-free 4D Scene Generation with Spatial-Temporal Consistency
par: Liu, Tianqi, et autres
Publié: (2025)
par: Liu, Tianqi, et autres
Publié: (2025)
Documents similaires
-
Rethinking Cross-Modal Interaction in Multimodal Diffusion Transformers
par: Lv, Zhengyao, et autres
Publié: (2025) -
FasterCache: Training-Free Video Diffusion Model Acceleration with High Quality
par: Lv, Zhengyao, et autres
Publié: (2024) -
StableWorld: Towards Stable and Consistent Long Interactive Video Generation
par: Yang, Ying, et autres
Publié: (2026) -
RepVideo: Rethinking Cross-Layer Representation for Video Generation
par: Si, Chenyang, et autres
Publié: (2025) -
DUO-VSR: Dual-Stream Distillation for One-Step Video Super-Resolution
par: Lv, Zhengyao, et autres
Publié: (2026)