Scale Space Diffusion
Fuente:
arXiv
Salvato in:
| Autori principali: | Mukhopadhyay, Soumik, Udhayanan, Prateksha, Shrivastava, Abhinav |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Design-o-meter: Towards Evaluating and Refining Graphic Designs
di: Goyal, Sahil, et al.
Pubblicazione: (2024)
di: Goyal, Sahil, et al.
Pubblicazione: (2024)
Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction
di: Shrivastava, Gaurav, et al.
Pubblicazione: (2024)
di: Shrivastava, Gaurav, et al.
Pubblicazione: (2024)
V-VIPE: Variational View Invariant Pose Embedding
di: Levy, Mara, et al.
Pubblicazione: (2024)
di: Levy, Mara, et al.
Pubblicazione: (2024)
Characterizing Motion Encoding in Video Diffusion Timesteps
di: Baherwani, Vatsal, et al.
Pubblicazione: (2025)
di: Baherwani, Vatsal, et al.
Pubblicazione: (2025)
LARP: Tokenizing Videos with a Learned Autoregressive Generative Prior
di: Wang, Hanyu, et al.
Pubblicazione: (2024)
di: Wang, Hanyu, et al.
Pubblicazione: (2024)
MaGGIe: Masked Guided Gradual Human Instance Matting
di: Huynh, Chuong, et al.
Pubblicazione: (2024)
di: Huynh, Chuong, et al.
Pubblicazione: (2024)
SIEDD: Shared-Implicit Encoder with Discrete Decoders
di: Rangarajan, Vikram, et al.
Pubblicazione: (2025)
di: Rangarajan, Vikram, et al.
Pubblicazione: (2025)
QUEEN: QUantized Efficient ENcoding of Dynamic Gaussians for Streaming Free-viewpoint Videos
di: Girish, Sharath, et al.
Pubblicazione: (2024)
di: Girish, Sharath, et al.
Pubblicazione: (2024)
LSSGen: Leveraging Latent Space Scaling in Flow and Diffusion for Efficient Text to Image Generation
di: Tang, Jyun-Ze, et al.
Pubblicazione: (2025)
di: Tang, Jyun-Ze, et al.
Pubblicazione: (2025)
Zero-Shot and Supervised Bird Image Segmentation Using Foundation Models: A Dual-Pipeline Approach with Grounding DINO~1.5, YOLOv11, and SAM~2.1
di: Munagala, Abhinav
Pubblicazione: (2026)
di: Munagala, Abhinav
Pubblicazione: (2026)
Taxonomy-Aware Continual Semantic Segmentation in Hyperbolic Spaces for Open-World Perception
di: Hindel, Julia, et al.
Pubblicazione: (2024)
di: Hindel, Julia, et al.
Pubblicazione: (2024)
Diffusion-Augmented Coreset Expansion for Scalable Dataset Distillation
di: Abbasi, Ali, et al.
Pubblicazione: (2024)
di: Abbasi, Ali, et al.
Pubblicazione: (2024)
Fast Sampling Through The Reuse Of Attention Maps In Diffusion Models
di: Hunter, Rosco, et al.
Pubblicazione: (2023)
di: Hunter, Rosco, et al.
Pubblicazione: (2023)
Efficient Continuous Video Flow Model for Video Prediction
di: Shrivastava, Gaurav, et al.
Pubblicazione: (2024)
di: Shrivastava, Gaurav, et al.
Pubblicazione: (2024)
eNCApsulate: NCA for Precision Diagnosis on Capsule Endoscopes
di: Krumb, Henry John, et al.
Pubblicazione: (2025)
di: Krumb, Henry John, et al.
Pubblicazione: (2025)
Upcycling Text-to-Image Diffusion Models for Multi-Task Capabilities
di: Chavhan, Ruchika, et al.
Pubblicazione: (2025)
di: Chavhan, Ruchika, et al.
Pubblicazione: (2025)
Navigating with Annealing Guidance Scale in Diffusion Space
di: Yehezkel, Shai, et al.
Pubblicazione: (2025)
di: Yehezkel, Shai, et al.
Pubblicazione: (2025)
Multi-Scale Neighborhood Occupancy Masked Autoencoder for Self-Supervised Learning in LiDAR Point Clouds
di: Abdelsamad, Mohamed, et al.
Pubblicazione: (2025)
di: Abdelsamad, Mohamed, et al.
Pubblicazione: (2025)
DocShaDiffusion: Diffusion Model in Latent Space for Document Image Shadow Removal
di: Liu, Wenjie, et al.
Pubblicazione: (2025)
di: Liu, Wenjie, et al.
Pubblicazione: (2025)
Color encoding in Latent Space of Stable Diffusion Models
di: Arias, Guillem, et al.
Pubblicazione: (2025)
di: Arias, Guillem, et al.
Pubblicazione: (2025)
Scaling Properties of Diffusion Models for Perceptual Tasks
di: Ravishankar, Rahul, et al.
Pubblicazione: (2024)
di: Ravishankar, Rahul, et al.
Pubblicazione: (2024)
Diffusion Model in Latent Space for Medical Image Segmentation Task
di: Ngoc, Huynh Trinh, et al.
Pubblicazione: (2025)
di: Ngoc, Huynh Trinh, et al.
Pubblicazione: (2025)
Unleashing Diffusion and State Space Models for Medical Image Segmentation
di: Wu, Rong, et al.
Pubblicazione: (2025)
di: Wu, Rong, et al.
Pubblicazione: (2025)
LocDiff: Identifying Locations on Earth by Diffusing in the Hilbert Space
di: Wang, Zhangyu, et al.
Pubblicazione: (2025)
di: Wang, Zhangyu, et al.
Pubblicazione: (2025)
Diffusion Suction Grasping with Large-Scale Parcel Dataset
di: Huang, Ding-Tao, et al.
Pubblicazione: (2025)
di: Huang, Ding-Tao, et al.
Pubblicazione: (2025)
Evolutionary Caching to Accelerate Your Off-the-Shelf Diffusion Model
di: Aggarwal, Anirud, et al.
Pubblicazione: (2025)
di: Aggarwal, Anirud, et al.
Pubblicazione: (2025)
Mitigating Hallucinations in Diffusion Models through Adaptive Attention Modulation
di: Oorloff, Trevine, et al.
Pubblicazione: (2025)
di: Oorloff, Trevine, et al.
Pubblicazione: (2025)
Do text-free diffusion models learn discriminative visual representations?
di: Mukhopadhyay, Soumik, et al.
Pubblicazione: (2023)
di: Mukhopadhyay, Soumik, et al.
Pubblicazione: (2023)
StochSync: Stochastic Diffusion Synchronization for Image Generation in Arbitrary Spaces
di: Yeo, Kyeongmin, et al.
Pubblicazione: (2025)
di: Yeo, Kyeongmin, et al.
Pubblicazione: (2025)
MarDini: Masked Autoregressive Diffusion for Video Generation at Scale
di: Liu, Haozhe, et al.
Pubblicazione: (2024)
di: Liu, Haozhe, et al.
Pubblicazione: (2024)
Upsample Guidance: Scale Up Diffusion Models without Training
di: Hwang, Juno, et al.
Pubblicazione: (2024)
di: Hwang, Juno, et al.
Pubblicazione: (2024)
Towards Latent Masked Image Modeling for Self-Supervised Visual Representation Learning
di: Wei, Yibing, et al.
Pubblicazione: (2024)
di: Wei, Yibing, et al.
Pubblicazione: (2024)
DC-Gen: Post-Training Diffusion Acceleration with Deeply Compressed Latent Space
di: He, Wenkun, et al.
Pubblicazione: (2025)
di: He, Wenkun, et al.
Pubblicazione: (2025)
When Color-Space Decoupling Meets Diffusion for Adverse-Weather Image Restoration
di: Fang, Wenxuan, et al.
Pubblicazione: (2025)
di: Fang, Wenxuan, et al.
Pubblicazione: (2025)
Self-Cascaded Diffusion Models for Arbitrary-Scale Image Super-Resolution
di: Bang, Junseo, et al.
Pubblicazione: (2025)
di: Bang, Junseo, et al.
Pubblicazione: (2025)
HierarchicalPrune: Position-Aware Compression for Large-Scale Diffusion Models
di: Kwon, Young D., et al.
Pubblicazione: (2025)
di: Kwon, Young D., et al.
Pubblicazione: (2025)
Unifying Visual and Semantic Feature Spaces with Diffusion Models for Enhanced Cross-Modal Alignment
di: Zheng, Yuze, et al.
Pubblicazione: (2024)
di: Zheng, Yuze, et al.
Pubblicazione: (2024)
DC-AE 1.5: Accelerating Diffusion Model Convergence with Structured Latent Space
di: Chen, Junyu, et al.
Pubblicazione: (2025)
di: Chen, Junyu, et al.
Pubblicazione: (2025)
U-Mamba2: Scaling State Space Models for Dental Anatomy Segmentation in CBCT
di: Tan, Zhi Qin, et al.
Pubblicazione: (2025)
di: Tan, Zhi Qin, et al.
Pubblicazione: (2025)
Multi-Sensor Diffusion-Driven Optical Image Translation for Large-Scale Applications
di: Vinholi, João Gabriel, et al.
Pubblicazione: (2024)
di: Vinholi, João Gabriel, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Design-o-meter: Towards Evaluating and Refining Graphic Designs
di: Goyal, Sahil, et al.
Pubblicazione: (2024) -
Continuous Video Process: Modeling Videos as Continuous Multi-Dimensional Processes for Video Prediction
di: Shrivastava, Gaurav, et al.
Pubblicazione: (2024) -
V-VIPE: Variational View Invariant Pose Embedding
di: Levy, Mara, et al.
Pubblicazione: (2024) -
Characterizing Motion Encoding in Video Diffusion Timesteps
di: Baherwani, Vatsal, et al.
Pubblicazione: (2025) -
LARP: Tokenizing Videos with a Learned Autoregressive Generative Prior
di: Wang, Hanyu, et al.
Pubblicazione: (2024)