Dual-End Consistency Model
Fuente:
arXiv
Guardado en:
| Autores principales: | Dong, Linwei, Guo, Ruoyu, Bai, Ge, Yuan, Zehuan, Luo, Yawei, Zou, Changqing |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Guiding Distribution Matching Distillation with Gradient-Based Reinforcement Learning
por: Dong, Linwei, et al.
Publicado: (2026)
por: Dong, Linwei, et al.
Publicado: (2026)
TinySR: Pruning Diffusion for Real-World Image Super-Resolution
por: Dong, Linwei, et al.
Publicado: (2025)
por: Dong, Linwei, et al.
Publicado: (2025)
TSD-SR: One-Step Diffusion with Target Score Distillation for Real-World Image Super-Resolution
por: Dong, Linwei, et al.
Publicado: (2024)
por: Dong, Linwei, et al.
Publicado: (2024)
Consistency Calibration: Improving Uncertainty Calibration via Consistency among Perturbed Neighbors
por: Tao, Linwei, et al.
Publicado: (2024)
por: Tao, Linwei, et al.
Publicado: (2024)
MV-Adapter: Multi-view Consistent Image Generation Made Easy
por: Huang, Zehuan, et al.
Publicado: (2024)
por: Huang, Zehuan, et al.
Publicado: (2024)
Deep-JGAC: End-to-End Deep Joint Geometry and Attribute Compression for Dense Colored Point Clouds
por: Zhang, Yun, et al.
Publicado: (2025)
por: Zhang, Yun, et al.
Publicado: (2025)
Diff3DS: Generating View-Consistent 3D Sketch via Differentiable Curve Rendering
por: Zhang, Yibo, et al.
Publicado: (2024)
por: Zhang, Yibo, et al.
Publicado: (2024)
Liquid: Language Models are Scalable and Unified Multi-modal Generators
por: Wu, Junfeng, et al.
Publicado: (2024)
por: Wu, Junfeng, et al.
Publicado: (2024)
UniGeo: Taming Video Diffusion for Unified Consistent Geometry Estimation
por: Sun, Yang-Tian, et al.
Publicado: (2025)
por: Sun, Yang-Tian, et al.
Publicado: (2025)
SemiETS: Integrating Spatial and Content Consistencies for Semi-Supervised End-to-end Text Spotting
por: Luo, Dongliang, et al.
Publicado: (2025)
por: Luo, Dongliang, et al.
Publicado: (2025)
Beyond One-Hot Labels: Semantic Mixing for Model Calibration
por: Luo, Haoyang, et al.
Publicado: (2025)
por: Luo, Haoyang, et al.
Publicado: (2025)
Senna-2: Aligning VLM and End-to-End Driving Policy for Consistent Decision Making and Planning
por: Song, Yuehao, et al.
Publicado: (2026)
por: Song, Yuehao, et al.
Publicado: (2026)
Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation
por: Sun, Peize, et al.
Publicado: (2024)
por: Sun, Peize, et al.
Publicado: (2024)
BindWeave: Subject-Consistent Video Generation via Cross-Modal Integration
por: Li, Zhaoyang, et al.
Publicado: (2025)
por: Li, Zhaoyang, et al.
Publicado: (2025)
Bernini: Latent Semantic Planning for Video Diffusion
por: Bernini Team, et al.
Publicado: (2026)
por: Bernini Team, et al.
Publicado: (2026)
SparseWorld: Enhancing End-to-End Autonomous Driving via World Models with Sparse Scene Representation
por: Wang, Ruoyu, et al.
Publicado: (2026)
por: Wang, Ruoyu, et al.
Publicado: (2026)
SceneLCM: End-to-End Layout-Guided Interactive Indoor Scene Generation with Latent Consistency Model
por: Lin, Yangkai, et al.
Publicado: (2025)
por: Lin, Yangkai, et al.
Publicado: (2025)
Qianfan-OCR: A Unified End-to-End Model for Document Intelligence
por: Dong, Daxiang, et al.
Publicado: (2026)
por: Dong, Daxiang, et al.
Publicado: (2026)
ChatSearch: a Dataset and a Generative Retrieval Model for General Conversational Image Retrieval
por: Zhao, Zijia, et al.
Publicado: (2024)
por: Zhao, Zijia, et al.
Publicado: (2024)
MaskGWM: A Generalizable Driving World Model with Video Mask Reconstruction
por: Ni, Jingcheng, et al.
Publicado: (2025)
por: Ni, Jingcheng, et al.
Publicado: (2025)
PhyMAGIC: Physical Motion-Aware Generative Inference with Confidence-guided LLM
por: Meng, Siwei, et al.
Publicado: (2025)
por: Meng, Siwei, et al.
Publicado: (2025)
Grounding Creativity in Physics: A Brief Survey of Physical Priors in AIGC
por: Meng, Siwei, et al.
Publicado: (2025)
por: Meng, Siwei, et al.
Publicado: (2025)
DICS: Find Domain-Invariant and Class-Specific Features for Out-of-Distribution Generalization
por: Miao, Qiaowei, et al.
Publicado: (2024)
por: Miao, Qiaowei, et al.
Publicado: (2024)
SpatialCrafter: Unleashing the Imagination of Video Diffusion Models for Scene Reconstruction from Limited Observations
por: Zhang, Songchun, et al.
Publicado: (2025)
por: Zhang, Songchun, et al.
Publicado: (2025)
CCEdit: Creative and Controllable Video Editing via Diffusion Models
por: Feng, Ruoyu, et al.
Publicado: (2023)
por: Feng, Ruoyu, et al.
Publicado: (2023)
AnimaX: Animating the Inanimate in 3D with Joint Video-Pose Diffusion Models
por: Huang, Zehuan, et al.
Publicado: (2025)
por: Huang, Zehuan, et al.
Publicado: (2025)
Drive&Gen: Co-Evaluating End-to-End Driving and Video Generation Models
por: Wang, Jiahao, et al.
Publicado: (2025)
por: Wang, Jiahao, et al.
Publicado: (2025)
Generalizing Visual Geometry Priors to Sparse Gaussian Occupancy Prediction
por: Zhou, Changqing, et al.
Publicado: (2026)
por: Zhou, Changqing, et al.
Publicado: (2026)
Unveiling the Tapestry of Consistency in Large Vision-Language Models
por: Zhang, Yuan, et al.
Publicado: (2024)
por: Zhang, Yuan, et al.
Publicado: (2024)
GEMINUS: Dual-aware Global and Scene-Adaptive Mixture-of-Experts for End-to-End Autonomous Driving
por: Wan, Chi, et al.
Publicado: (2025)
por: Wan, Chi, et al.
Publicado: (2025)
Generative Refinement Networks for Visual Synthesis
por: Han, Jian, et al.
Publicado: (2026)
por: Han, Jian, et al.
Publicado: (2026)
LatentUMM: Dual Latent Alignment for Unified Multimodal Models
por: Luo, Yinyi, et al.
Publicado: (2026)
por: Luo, Yinyi, et al.
Publicado: (2026)
Generative Region-Language Pretraining for Open-Ended Object Detection
por: Lin, Chuang, et al.
Publicado: (2024)
por: Lin, Chuang, et al.
Publicado: (2024)
Conditional Diffusion Model with Anatomical-Dose Dual Constraints for End-to-End Multi-Tumor Dose Prediction
por: Xie, Hui, et al.
Publicado: (2025)
por: Xie, Hui, et al.
Publicado: (2025)
Physical Degradation Model-Guided Interferometric Hyperspectral Reconstruction with Unfolding Transformer
por: Li, Yuansheng, et al.
Publicado: (2025)
por: Li, Yuansheng, et al.
Publicado: (2025)
DualAD: Disentangling the Dynamic and Static World for End-to-End Driving
por: Doll, Simon, et al.
Publicado: (2024)
por: Doll, Simon, et al.
Publicado: (2024)
AstraNav-World: World Model for Foresight Control and Consistency
por: Chen, Jintao, et al.
Publicado: (2025)
por: Chen, Jintao, et al.
Publicado: (2025)
Towards Fully Decoupled End-to-End Person Search
por: Zhang, Pengcheng, et al.
Publicado: (2023)
por: Zhang, Pengcheng, et al.
Publicado: (2023)
End-to-End Autonomous Driving without Costly Modularization and 3D Manual Annotation
por: Guo, Mingzhe, et al.
Publicado: (2024)
por: Guo, Mingzhe, et al.
Publicado: (2024)
Sample Margin-Aware Recalibration of Temperature Scaling
por: Guo, Haolan, et al.
Publicado: (2025)
por: Guo, Haolan, et al.
Publicado: (2025)
Ejemplares similares
-
Guiding Distribution Matching Distillation with Gradient-Based Reinforcement Learning
por: Dong, Linwei, et al.
Publicado: (2026) -
TinySR: Pruning Diffusion for Real-World Image Super-Resolution
por: Dong, Linwei, et al.
Publicado: (2025) -
TSD-SR: One-Step Diffusion with Target Score Distillation for Real-World Image Super-Resolution
por: Dong, Linwei, et al.
Publicado: (2024) -
Consistency Calibration: Improving Uncertainty Calibration via Consistency among Perturbed Neighbors
por: Tao, Linwei, et al.
Publicado: (2024) -
MV-Adapter: Multi-view Consistent Image Generation Made Easy
por: Huang, Zehuan, et al.
Publicado: (2024)