Saved in:
| Main Authors: | Yang, Ceyuan, Lin, Zhijie, Zhao, Yang, Xiao, Fei, He, Hao, Zhao, Qi, Deng, Chaorui, Li, Kunchang, Ding, Zihan, Guo, Yuwei, Wang, Fuyun, Zhu, Fangqi, Nie, Xiaonan, Zhu, Shenhan, Lin, Shanchuan, Li, Hongsheng, Huang, Weilin, Shi, Guang, Fan, Haoqi |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2604.21921 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Continuous Adversarial Flow Models
by: Lin, Shanchuan, et al.
Published: (2026)
by: Lin, Shanchuan, et al.
Published: (2026)
Adversarial Flow Models
by: Lin, Shanchuan, et al.
Published: (2025)
by: Lin, Shanchuan, et al.
Published: (2025)
Causal Diffusion Transformers for Generative Modeling
by: Deng, Chaorui, et al.
Published: (2024)
by: Deng, Chaorui, et al.
Published: (2024)
Representation Forcing for Bottleneck-Free Unified Multimodal Models
by: Wang, Yuqing, et al.
Published: (2026)
by: Wang, Yuqing, et al.
Published: (2026)
Emerging Properties in Unified Multimodal Pretraining
by: Deng, Chaorui, et al.
Published: (2025)
by: Deng, Chaorui, et al.
Published: (2025)
UniGRPO: Unified Policy Optimization for Reasoning-Driven Visual Generation
by: Liu, Jie, et al.
Published: (2026)
by: Liu, Jie, et al.
Published: (2026)
Long Context Tuning for Video Generation
by: Guo, Yuwei, et al.
Published: (2025)
by: Guo, Yuwei, et al.
Published: (2025)
CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion Models
by: He, Hao, et al.
Published: (2025)
by: He, Hao, et al.
Published: (2025)
End-to-End Training for Autoregressive Video Diffusion via Self-Resampling
by: Guo, Yuwei, et al.
Published: (2025)
by: Guo, Yuwei, et al.
Published: (2025)
Diffusion Adversarial Post-Training for One-Step Video Generation
by: Lin, Shanchuan, et al.
Published: (2025)
by: Lin, Shanchuan, et al.
Published: (2025)
Autoregressive Adversarial Post-Training for Real-Time Interactive Video Generation
by: Lin, Shanchuan, et al.
Published: (2025)
by: Lin, Shanchuan, et al.
Published: (2025)
AnimateDiff-Lightning: Cross-Model Diffusion Distillation
by: Lin, Shanchuan, et al.
Published: (2024)
by: Lin, Shanchuan, et al.
Published: (2024)
Diffusion Model with Perceptual Loss
by: Lin, Shanchuan, et al.
Published: (2023)
by: Lin, Shanchuan, et al.
Published: (2023)
LightFusion: A Light-weighted, Double Fusion Framework for Unified Multimodal Understanding and Generation
by: Wang, Zeyu, et al.
Published: (2025)
by: Wang, Zeyu, et al.
Published: (2025)
SeedVR2: One-Step Video Restoration via Diffusion Adversarial Post-Training
by: Wang, Jianyi, et al.
Published: (2025)
by: Wang, Jianyi, et al.
Published: (2025)
CameraCtrl: Enabling Camera Control for Text-to-Video Generation
by: He, Hao, et al.
Published: (2024)
by: He, Hao, et al.
Published: (2024)
SeedVR: Seeding Infinity in Diffusion Transformer Towards Generic Video Restoration
by: Wang, Jianyi, et al.
Published: (2025)
by: Wang, Jianyi, et al.
Published: (2025)
LSH-MoE: Communication-efficient MoE Training via Locality-Sensitive Hashing
by: Nie, Xiaonan, et al.
Published: (2024)
by: Nie, Xiaonan, et al.
Published: (2024)
SDXL-Lightning: Progressive Adversarial Diffusion Distillation
by: Lin, Shanchuan, et al.
Published: (2024)
by: Lin, Shanchuan, et al.
Published: (2024)
Common Diffusion Noise Schedules and Sample Steps are Flawed
by: Lin, Shanchuan, et al.
Published: (2023)
by: Lin, Shanchuan, et al.
Published: (2023)
VQ-VA World: Towards High-Quality Visual Question-Visual Answering
by: Gou, Chenhui, et al.
Published: (2025)
by: Gou, Chenhui, et al.
Published: (2025)
Improving Automatic Parallel Training via Balanced Memory Workload Optimization
by: Wang, Yujie, et al.
Published: (2023)
by: Wang, Yujie, et al.
Published: (2023)
Self-Supervised Cross-Encoder for Neurodegenerative Disease Diagnosis
by: Cheng, Fangqi, et al.
Published: (2025)
by: Cheng, Fangqi, et al.
Published: (2025)
Unleashing Scalable Context Parallelism for Foundation Models Pre-Training via FCP
by: Zhao, Yilong, et al.
Published: (2026)
by: Zhao, Yilong, et al.
Published: (2026)
Dynamic Spectral Denoising with Global-Context Attention for Multi-Behavior Recommendation
by: Cai, Miaomiao, et al.
Published: (2026)
by: Cai, Miaomiao, et al.
Published: (2026)
Seedance 1.0: Exploring the Boundaries of Video Generation Models
by: Gao, Yu, et al.
Published: (2025)
by: Gao, Yu, et al.
Published: (2025)
HIFICL: High-Fidelity In-Context Learning for Multimodal Tasks
by: Li, Xiaoyu, et al.
Published: (2026)
by: Li, Xiaoyu, et al.
Published: (2026)
From Cd(SCN)2(CH4N2S)2 to Cd(SCN)2(C4H6N2)2: Controlling Sulfur Content in Thiocyanate Systems Significantly Improves the Overall Performance of UV Nonlinear Optical Materials
by: Yuwei Kang, et al.
Published: (2024)
by: Yuwei Kang, et al.
Published: (2024)
Memory-Efficient Gradient Unrolling for Large-Scale Bi-level Optimization
by: Shen, Qianli, et al.
Published: (2024)
by: Shen, Qianli, et al.
Published: (2024)
Unrolled Decomposed Unpaired Learning for Controllable Low-Light Video Enhancement
by: Zhu, Lingyu, et al.
Published: (2024)
by: Zhu, Lingyu, et al.
Published: (2024)
Mixture of Contexts for Long Video Generation
by: Cai, Shengqu, et al.
Published: (2025)
by: Cai, Shengqu, et al.
Published: (2025)
HumanOmniV2: From Understanding to Omni-Modal Reasoning with Context
by: Yang, Qize, et al.
Published: (2025)
by: Yang, Qize, et al.
Published: (2025)
SAIL-Embedding Technical Report: Omni-modal Embedding Foundation Model
by: Lin, Lin, et al.
Published: (2025)
by: Lin, Lin, et al.
Published: (2025)
Revisiting 360 Depth Estimation with PanoGabor: A New Fusion Perspective
by: Shen, Zhijie, et al.
Published: (2024)
by: Shen, Zhijie, et al.
Published: (2024)
Revisiting Monocular 3D Object Detection with Depth Thickness Field
by: Zhang, Qiude, et al.
Published: (2024)
by: Zhang, Qiude, et al.
Published: (2024)
AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning
by: Guo, Yuwei, et al.
Published: (2023)
by: Guo, Yuwei, et al.
Published: (2023)
Galvatron: An Automatic Distributed System for Efficient Foundation Model Training
by: Liu, Xinyi, et al.
Published: (2025)
by: Liu, Xinyi, et al.
Published: (2025)
Cost‐Effective 3D‐Printed Bionic Hydrogel Evaporator for Stable Solar Desalination
by: Shuang Zhang, et al.
Published: (2024)
by: Shuang Zhang, et al.
Published: (2024)
Evading Data Provenance in Deep Neural Networks
by: Zhu, Hongyu, et al.
Published: (2025)
by: Zhu, Hongyu, et al.
Published: (2025)
Explicit Critic Guidance for Aligning Diffusion Models
by: Liang, Zhengyang, et al.
Published: (2026)
by: Liang, Zhengyang, et al.
Published: (2026)
Similar Items
-
Continuous Adversarial Flow Models
by: Lin, Shanchuan, et al.
Published: (2026) -
Adversarial Flow Models
by: Lin, Shanchuan, et al.
Published: (2025) -
Causal Diffusion Transformers for Generative Modeling
by: Deng, Chaorui, et al.
Published: (2024) -
Representation Forcing for Bottleneck-Free Unified Multimodal Models
by: Wang, Yuqing, et al.
Published: (2026) -
Emerging Properties in Unified Multimodal Pretraining
by: Deng, Chaorui, et al.
Published: (2025)