PiD: Fast and High-Resolution Latent Decoding with Pixel Diffusion
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lu, Yifan, Wu, Qi, Wu, Jay Zhangjie, Wang, Zian, Ling, Huan, Fidler, Sanja, Ren, Xuanchi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
APE: Agentic Prompt Enhancer for Image Generation and Editing
par: Huang, Zijian, et autres
Publié: (2026)
par: Huang, Zijian, et autres
Publié: (2026)
Difix3D+: Improving 3D Reconstructions with Single-Step Diffusion Models
par: Wu, Jay Zhangjie, et autres
Publié: (2025)
par: Wu, Jay Zhangjie, et autres
Publié: (2025)
SCube: Instant Large-Scale Scene Reconstruction using VoxSplats
par: Ren, Xuanchi, et autres
Publié: (2024)
par: Ren, Xuanchi, et autres
Publié: (2024)
ChronoEdit: Towards Temporal Reasoning for Image Editing and World Simulation
par: Wu, Jay Zhangjie, et autres
Publié: (2025)
par: Wu, Jay Zhangjie, et autres
Publié: (2025)
InfiniCube: Unbounded and Controllable Dynamic 3D Driving Scene Generation with World-Guided Video Models
par: Lu, Yifan, et autres
Publié: (2024)
par: Lu, Yifan, et autres
Publié: (2024)
GEN3C: 3D-Informed World-Consistent Video Generation with Precise Camera Control
par: Ren, Xuanchi, et autres
Publié: (2025)
par: Ren, Xuanchi, et autres
Publié: (2025)
XCube: Large-Scale 3D Generative Modeling using Sparse Voxel Hierarchies
par: Ren, Xuanchi, et autres
Publié: (2023)
par: Ren, Xuanchi, et autres
Publié: (2023)
Align Your Gaussians: Text-to-4D with Dynamic 3D Gaussians and Composed Diffusion Models
par: Ling, Huan, et autres
Publié: (2023)
par: Ling, Huan, et autres
Publié: (2023)
Cosmos-Drive-Dreams: Scalable Synthetic Driving Data Generation with World Foundation Models
par: Ren, Xuanchi, et autres
Publié: (2025)
par: Ren, Xuanchi, et autres
Publié: (2025)
EmerDiff: Emerging Pixel-level Semantic Knowledge in Diffusion Models
par: Namekata, Koichi, et autres
Publié: (2024)
par: Namekata, Koichi, et autres
Publié: (2024)
Show-1: Marrying Pixel and Latent Diffusion Models for Text-to-Video Generation
par: Zhang, David Junhao, et autres
Publié: (2023)
par: Zhang, David Junhao, et autres
Publié: (2023)
Lyra: Generative 3D Scene Reconstruction via Video Diffusion Model Self-Distillation
par: Bahmani, Sherwin, et autres
Publié: (2025)
par: Bahmani, Sherwin, et autres
Publié: (2025)
Lyra 2.0: Explorable Generative 3D Worlds
par: Shen, Tianchang, et autres
Publié: (2026)
par: Shen, Tianchang, et autres
Publié: (2026)
MoRight: Motion Control Done Right
par: Liu, Shaowei, et autres
Publié: (2026)
par: Liu, Shaowei, et autres
Publié: (2026)
Gamma-World: Generative Multi-Agent World Modeling Beyond Two Players
par: Liu, Fangfu, et autres
Publié: (2026)
par: Liu, Fangfu, et autres
Publié: (2026)
WildFusion: Learning 3D-Aware Latent Diffusion Models in View Space
par: Schwarz, Katja, et autres
Publié: (2023)
par: Schwarz, Katja, et autres
Publié: (2023)
DiffusionRenderer: Neural Inverse and Forward Rendering with Video Diffusion Models
par: Liang, Ruofan, et autres
Publié: (2025)
par: Liang, Ruofan, et autres
Publié: (2025)
Controllable Weather Synthesis and Removal with Video Diffusion Models
par: Lin, Chih-Hao, et autres
Publié: (2025)
par: Lin, Chih-Hao, et autres
Publié: (2025)
Align Your Steps: Optimizing Sampling Schedules in Diffusion Models
par: Sabour, Amirmojtaba, et autres
Publié: (2024)
par: Sabour, Amirmojtaba, et autres
Publié: (2024)
LuxDiT: Lighting Estimation with Video Diffusion Transformer
par: Liang, Ruofan, et autres
Publié: (2025)
par: Liang, Ruofan, et autres
Publié: (2025)
Photorealistic Object Insertion with Diffusion-Guided Inverse Rendering
par: Liang, Ruofan, et autres
Publié: (2024)
par: Liang, Ruofan, et autres
Publié: (2024)
Augmented Reality based Simulated Data (ARSim) with multi-view consistency for AV perception networks
par: Anwar, Aqeel, et autres
Publié: (2024)
par: Anwar, Aqeel, et autres
Publié: (2024)
ArtiFixer: Enhancing and Extending 3D Reconstruction with Auto-Regressive Diffusion Models
par: de Lutio, Riccardo, et autres
Publié: (2026)
par: de Lutio, Riccardo, et autres
Publié: (2026)
Fast High-Resolution Image Synthesis with Latent Adversarial Diffusion Distillation
par: Sauer, Axel, et autres
Publié: (2024)
par: Sauer, Axel, et autres
Publié: (2024)
Pixel to Gaussian: Ultra-Fast Continuous Super-Resolution with 2D Gaussian Modeling
par: Peng, Long, et autres
Publié: (2025)
par: Peng, Long, et autres
Publié: (2025)
Align Your Flow: Scaling Continuous-Time Flow Map Distillation
par: Sabour, Amirmojtaba, et autres
Publié: (2025)
par: Sabour, Amirmojtaba, et autres
Publié: (2025)
PixelRush: Ultra-Fast, Training-Free High-Resolution Image Generation via One-step Diffusion
par: Lai, Hong-Phuc, et autres
Publié: (2026)
par: Lai, Hong-Phuc, et autres
Publié: (2026)
ViPE: Video Pose Engine for 3D Geometric Perception
par: Huang, Jiahui, et autres
Publié: (2025)
par: Huang, Jiahui, et autres
Publié: (2025)
PiT: Progressive Diffusion Transformer
par: Wu, Jiafu, et autres
Publié: (2025)
par: Wu, Jiafu, et autres
Publié: (2025)
PiLaMIM: Toward Richer Visual Representations by Integrating Pixel and Latent Masked Image Modeling
par: Lee, Junmyeong, et autres
Publié: (2025)
par: Lee, Junmyeong, et autres
Publié: (2025)
DiffusionHarmonizer: Bridging Neural Reconstruction and Photorealistic Simulation with Online Diffusion Enhancer
par: Zhang, Yuxuan, et autres
Publié: (2026)
par: Zhang, Yuxuan, et autres
Publié: (2026)
One Small Step in Latent, One Giant Leap for Pixels: Fast Latent Upscale Adapter for Your Diffusion Models
par: Razin, Aleksandr, et autres
Publié: (2025)
par: Razin, Aleksandr, et autres
Publié: (2025)
Enhancing High-Resolution 3D Generation through Pixel-wise Gradient Clipping
par: Pan, Zijie, et autres
Publié: (2023)
par: Pan, Zijie, et autres
Publié: (2023)
fVDB: A Deep-Learning Framework for Sparse, Large-Scale, and High-Performance Spatial Intelligence
par: Williams, Francis, et autres
Publié: (2024)
par: Williams, Francis, et autres
Publié: (2024)
Cross-Resolution Diffusion Models via Network Pruning
par: Ren, Jiaxuan, et autres
Publié: (2026)
par: Ren, Jiaxuan, et autres
Publié: (2026)
L4GM: Large 4D Gaussian Reconstruction Model
par: Ren, Jiawei, et autres
Publié: (2024)
par: Ren, Jiawei, et autres
Publié: (2024)
RefFusion: Reference Adapted Diffusion Models for 3D Scene Inpainting
par: Mirzaei, Ashkan, et autres
Publié: (2024)
par: Mirzaei, Ashkan, et autres
Publié: (2024)
3D Gaussian Ray Tracing: Fast Tracing of Particle Scenes
par: Moenne-Loccoz, Nicolas, et autres
Publié: (2024)
par: Moenne-Loccoz, Nicolas, et autres
Publié: (2024)
Can Large Vision-Language Models Correct Semantic Grounding Errors By Themselves?
par: Liao, Yuan-Hong, et autres
Publié: (2024)
par: Liao, Yuan-Hong, et autres
Publié: (2024)
Greedy Growing Enables High-Resolution Pixel-Based Diffusion Models
par: Vasconcelos, Cristina N., et autres
Publié: (2024)
par: Vasconcelos, Cristina N., et autres
Publié: (2024)
Documents similaires
-
APE: Agentic Prompt Enhancer for Image Generation and Editing
par: Huang, Zijian, et autres
Publié: (2026) -
Difix3D+: Improving 3D Reconstructions with Single-Step Diffusion Models
par: Wu, Jay Zhangjie, et autres
Publié: (2025) -
SCube: Instant Large-Scale Scene Reconstruction using VoxSplats
par: Ren, Xuanchi, et autres
Publié: (2024) -
ChronoEdit: Towards Temporal Reasoning for Image Editing and World Simulation
par: Wu, Jay Zhangjie, et autres
Publié: (2025) -
InfiniCube: Unbounded and Controllable Dynamic 3D Driving Scene Generation with World-Guided Video Models
par: Lu, Yifan, et autres
Publié: (2024)