Creatively Upscaling Images with Global-Regional Priors
Fuente:
arXiv
Salvato in:
| Autori principali: | Qian, Yurui, Cai, Qi, Pan, Yingwei, Yao, Ting, Mei, Tao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Boosting Diffusion Models with Moving Average Sampling in Frequency Domain
di: Qian, Yurui, et al.
Pubblicazione: (2024)
di: Qian, Yurui, et al.
Pubblicazione: (2024)
TRIP: Temporal Residual Learning with Image Noise Prior for Image-to-Video Diffusion Models
di: Zhang, Zhongwei, et al.
Pubblicazione: (2024)
di: Zhang, Zhongwei, et al.
Pubblicazione: (2024)
Visual Autoregressive Modeling for Instruction-Guided Image Editing
di: Mao, Qingyang, et al.
Pubblicazione: (2025)
di: Mao, Qingyang, et al.
Pubblicazione: (2025)
HIRI-ViT: Scaling Vision Transformer with High Resolution Inputs
di: Yao, Ting, et al.
Pubblicazione: (2024)
di: Yao, Ting, et al.
Pubblicazione: (2024)
Incorporating Visual Correspondence into Diffusion Model for Virtual Try-On
di: Wan, Siqi, et al.
Pubblicazione: (2025)
di: Wan, Siqi, et al.
Pubblicazione: (2025)
VP3D: Unleashing 2D Visual Prompt for Text-to-3D Generation
di: Chen, Yang, et al.
Pubblicazione: (2024)
di: Chen, Yang, et al.
Pubblicazione: (2024)
MotionPro: A Precise Motion Controller for Image-to-Video Generation
di: Zhang, Zhongwei, et al.
Pubblicazione: (2025)
di: Zhang, Zhongwei, et al.
Pubblicazione: (2025)
Hi3D: Pursuing High-Resolution Image-to-3D Generation with Video Diffusion Models
di: Yang, Haibo, et al.
Pubblicazione: (2024)
di: Yang, Haibo, et al.
Pubblicazione: (2024)
Hierarchical Masked Autoregressive Models with Low-Resolution Token Pivots
di: Zheng, Guangting, et al.
Pubblicazione: (2025)
di: Zheng, Guangting, et al.
Pubblicazione: (2025)
Improving Virtual Try-On with Garment-focused Diffusion Models
di: Wan, Siqi, et al.
Pubblicazione: (2024)
di: Wan, Siqi, et al.
Pubblicazione: (2024)
Improving Text-guided Object Inpainting with Semantic Pre-inpainting
di: Chen, Yifu, et al.
Pubblicazione: (2024)
di: Chen, Yifu, et al.
Pubblicazione: (2024)
SD-DiT: Unleashing the Power of Self-supervised Discrimination in Diffusion Transformer
di: Zhu, Rui, et al.
Pubblicazione: (2024)
di: Zhu, Rui, et al.
Pubblicazione: (2024)
Unleashing Text-to-Image Diffusion Prior for Zero-Shot Image Captioning
di: Luo, Jianjie, et al.
Pubblicazione: (2024)
di: Luo, Jianjie, et al.
Pubblicazione: (2024)
Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction
di: Li, Dong, et al.
Pubblicazione: (2025)
di: Li, Dong, et al.
Pubblicazione: (2025)
DreamMesh: Jointly Manipulating and Texturing Triangle Meshes for Text-to-3D Generation
di: Yang, Haibo, et al.
Pubblicazione: (2024)
di: Yang, Haibo, et al.
Pubblicazione: (2024)
Region-Constraint In-Context Generation for Instructional Video Editing
di: Zhang, Zhongwei, et al.
Pubblicazione: (2025)
di: Zhang, Zhongwei, et al.
Pubblicazione: (2025)
HiDream-I1: A High-Efficient Image Generative Foundation Model with Sparse Diffusion Transformer
di: Cai, Qi, et al.
Pubblicazione: (2025)
di: Cai, Qi, et al.
Pubblicazione: (2025)
HiDream-O1-Image: A Natively Unified Image Generative Foundation Model with Pixel-level Unified Transformer
di: Cai, Qi, et al.
Pubblicazione: (2026)
di: Cai, Qi, et al.
Pubblicazione: (2026)
ROGLE: Robust Global-Local Alignment with Automated Region Supervision for Text-Based Person Search
di: Xie, Zequn, et al.
Pubblicazione: (2026)
di: Xie, Zequn, et al.
Pubblicazione: (2026)
FreeEnhance: Tuning-Free Image Enhancement via Content-Consistent Noising-and-Denoising Process
di: Luo, Yang, et al.
Pubblicazione: (2024)
di: Luo, Yang, et al.
Pubblicazione: (2024)
Learning Spatial Adaptation and Temporal Coherence in Diffusion Models for Video Super-Resolution
di: Chen, Zhikai, et al.
Pubblicazione: (2024)
di: Chen, Zhikai, et al.
Pubblicazione: (2024)
Webcam-based Pupil Diameter Prediction Benefits from Upscaling
di: Shah, Vijul, et al.
Pubblicazione: (2024)
di: Shah, Vijul, et al.
Pubblicazione: (2024)
Disparity-based Stereo Image Compression with Aligned Cross-View Priors
di: Zhai, Yongqi, et al.
Pubblicazione: (2022)
di: Zhai, Yongqi, et al.
Pubblicazione: (2022)
Enhancing Fake News Video Detection via LLM-Driven Creative Process Simulation
di: Bu, Yuyan, et al.
Pubblicazione: (2025)
di: Bu, Yuyan, et al.
Pubblicazione: (2025)
Residual Prior-driven Frequency-aware Network for Image Fusion
di: Zheng, Guan, et al.
Pubblicazione: (2025)
di: Zheng, Guan, et al.
Pubblicazione: (2025)
Inclusion 2024 Global Multimedia Deepfake Detection Challenge: Towards Multi-dimensional Face Forgery Detection
di: Zhang, Yi, et al.
Pubblicazione: (2024)
di: Zhang, Yi, et al.
Pubblicazione: (2024)
Synthetic Perception: Can Generated Images Unlock Latent Visual Prior for Text-Centric Reasoning?
di: Huang, Yuesheng, et al.
Pubblicazione: (2025)
di: Huang, Yuesheng, et al.
Pubblicazione: (2025)
Predicting Satisfied User and Machine Ratio for Compressed Images: A Unified Approach
di: Zhang, Qi, et al.
Pubblicazione: (2024)
di: Zhang, Qi, et al.
Pubblicazione: (2024)
CreativeVR: Diffusion-Prior-Guided Approach for Structure and Motion Restoration in Generative and Real Videos
di: Panambur, Tejas, et al.
Pubblicazione: (2025)
di: Panambur, Tejas, et al.
Pubblicazione: (2025)
DeepSPG: Exploring Deep Semantic Prior Guidance for Low-light Image Enhancement with Multimodal Learning
di: Lu, Jialang, et al.
Pubblicazione: (2025)
di: Lu, Jialang, et al.
Pubblicazione: (2025)
Beyond Patches: Global-aware Autoregressive Model for Multimodal Few-Shot Font Generation
di: Cai, Haonan, et al.
Pubblicazione: (2026)
di: Cai, Haonan, et al.
Pubblicazione: (2026)
Scene Aware Person Image Generation through Global Contextual Conditioning
di: Roy, Prasun, et al.
Pubblicazione: (2022)
di: Roy, Prasun, et al.
Pubblicazione: (2022)
Taming Flow-based I2V Models for Creative Video Editing
di: Kong, Xianghao, et al.
Pubblicazione: (2025)
di: Kong, Xianghao, et al.
Pubblicazione: (2025)
Holistic Visual-Textual Sentiment Analysis with Prior Models
di: Chen, Junyu, et al.
Pubblicazione: (2022)
di: Chen, Junyu, et al.
Pubblicazione: (2022)
3D-LMVIC: Learning-based Multi-View Image Coding with 3D Gaussian Geometric Priors
di: Huang, Yujun, et al.
Pubblicazione: (2024)
di: Huang, Yujun, et al.
Pubblicazione: (2024)
FakingRecipe: Detecting Fake News on Short Video Platforms from the Perspective of Creative Process
di: Bu, Yuyan, et al.
Pubblicazione: (2024)
di: Bu, Yuyan, et al.
Pubblicazione: (2024)
Self-similarity Prior Distillation for Unsupervised Remote Physiological Measurement
di: Zhang, Xinyu, et al.
Pubblicazione: (2023)
di: Zhang, Xinyu, et al.
Pubblicazione: (2023)
TALDS-Net: Task-Aware Adaptive Local Descriptors Selection for Few-shot Image Classification
di: Qiao, Qian, et al.
Pubblicazione: (2023)
di: Qiao, Qian, et al.
Pubblicazione: (2023)
Multi-Modal Image Fusion via Intervention-Stable Feature Learning
di: Wang, Xue, et al.
Pubblicazione: (2026)
di: Wang, Xue, et al.
Pubblicazione: (2026)
Towards Explainable Partial-AIGC Image Quality Assessment
di: Qian, Jiaying, et al.
Pubblicazione: (2025)
di: Qian, Jiaying, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Boosting Diffusion Models with Moving Average Sampling in Frequency Domain
di: Qian, Yurui, et al.
Pubblicazione: (2024) -
TRIP: Temporal Residual Learning with Image Noise Prior for Image-to-Video Diffusion Models
di: Zhang, Zhongwei, et al.
Pubblicazione: (2024) -
Visual Autoregressive Modeling for Instruction-Guided Image Editing
di: Mao, Qingyang, et al.
Pubblicazione: (2025) -
HIRI-ViT: Scaling Vision Transformer with High Resolution Inputs
di: Yao, Ting, et al.
Pubblicazione: (2024) -
Incorporating Visual Correspondence into Diffusion Model for Virtual Try-On
di: Wan, Siqi, et al.
Pubblicazione: (2025)