Guardado en:
| Autores principales: | Ling, XuDong, Li, ChaoRong, Qin, FengQing, Zhu, LiHong, Huang, Yuanyuan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2402.12779 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Precipitation Nowcasting Using Diffusion Transformer with Causal Attention
por: Li, ChaoRong, et al.
Publicado: (2024)
por: Li, ChaoRong, et al.
Publicado: (2024)
RNDiff: Rainfall nowcasting with Condition Diffusion Model
por: Ling, Xudong, et al.
Publicado: (2024)
por: Ling, Xudong, et al.
Publicado: (2024)
Segment Anything without Supervision
por: Wang, XuDong, et al.
Publicado: (2024)
por: Wang, XuDong, et al.
Publicado: (2024)
UnSAMv2: Self-Supervised Learning Enables Segment Anything at Any Granularity
por: Yu, Junwei, et al.
Publicado: (2025)
por: Yu, Junwei, et al.
Publicado: (2025)
Reconstruction Alignment Improves Unified Multimodal Models
por: Xie, Ji, et al.
Publicado: (2025)
por: Xie, Ji, et al.
Publicado: (2025)
Consistency Model is an Effective Posterior Sample Approximation for Diffusion Inverse Solvers
por: Xu, Tongda, et al.
Publicado: (2024)
por: Xu, Tongda, et al.
Publicado: (2024)
Extreme Precipitation Nowcasting using Multi-Task Latent Diffusion Models
por: Chaorong, Li, et al.
Publicado: (2024)
por: Chaorong, Li, et al.
Publicado: (2024)
Chain-of-Visual-Thought: Teaching VLMs to See and Think Better with Continuous Visual Tokens
por: Qin, Yiming, et al.
Publicado: (2025)
por: Qin, Yiming, et al.
Publicado: (2025)
Visual Lexicon: Rich Image Features in Language Space
por: Wang, XuDong, et al.
Publicado: (2024)
por: Wang, XuDong, et al.
Publicado: (2024)
SegLLM: Multi-round Reasoning Segmentation
por: Wang, XuDong, et al.
Publicado: (2024)
por: Wang, XuDong, et al.
Publicado: (2024)
Incremental Multiview Point Cloud Registration with Two-stage Candidate Retrieval
por: Li, Shiqi, et al.
Publicado: (2024)
por: Li, Shiqi, et al.
Publicado: (2024)
Human detectors are surprisingly powerful reward models
por: Ashutosh, Kumar, et al.
Publicado: (2026)
por: Ashutosh, Kumar, et al.
Publicado: (2026)
Two Causally Related Needles in a Video Haystack
por: Li, Miaoyu, et al.
Publicado: (2025)
por: Li, Miaoyu, et al.
Publicado: (2025)
Multi-weather Cross-view Geo-localization Using Denoising Diffusion Models
por: Feng, Tongtong, et al.
Publicado: (2024)
por: Feng, Tongtong, et al.
Publicado: (2024)
Raccoon: Multi-stage Diffusion Training with Coarse-to-Fine Curating Videos
por: Tan, Zhiyu, et al.
Publicado: (2025)
por: Tan, Zhiyu, et al.
Publicado: (2025)
Visually Prompted Benchmarks Are Surprisingly Fragile
por: Feng, Haiwen, et al.
Publicado: (2025)
por: Feng, Haiwen, et al.
Publicado: (2025)
Two in One Go: Single-stage Emotion Recognition with Decoupled Subject-context Transformer
por: Li, Xinpeng, et al.
Publicado: (2024)
por: Li, Xinpeng, et al.
Publicado: (2024)
Reversible Efficient Diffusion for Image Fusion
por: Xu, Xingxin, et al.
Publicado: (2026)
por: Xu, Xingxin, et al.
Publicado: (2026)
M3R: Localized Rainfall Nowcasting with Meteorology-Informed MultiModal Attention
por: Panta, Sanjeev, et al.
Publicado: (2026)
por: Panta, Sanjeev, et al.
Publicado: (2026)
Constantly Improving Image Models Need Constantly Improving Benchmarks
por: Ge, Jiaxin, et al.
Publicado: (2025)
por: Ge, Jiaxin, et al.
Publicado: (2025)
Diffusion Model is Secretly a Training-free Open Vocabulary Semantic Segmenter
por: Wang, Jinglong, et al.
Publicado: (2023)
por: Wang, Jinglong, et al.
Publicado: (2023)
QuantSparse: Comprehensively Compressing Video Diffusion Transformer with Model Quantization and Attention Sparsification
por: Feng, Weilun, et al.
Publicado: (2025)
por: Feng, Weilun, et al.
Publicado: (2025)
WarmFed: Federated Learning with Warm-Start for Globalization and Personalization Via Personalized Diffusion Models
por: Feng, Tao, et al.
Publicado: (2025)
por: Feng, Tao, et al.
Publicado: (2025)
Seeing It Before It Happens: In-Generation NSFW Detection for Diffusion-Based Text-to-Image Models
por: Yang, Fan, et al.
Publicado: (2025)
por: Yang, Fan, et al.
Publicado: (2025)
Is Diffusion Model Safe? Severe Data Leakage via Gradient-Guided Diffusion Model
por: Meng, Jiayang, et al.
Publicado: (2024)
por: Meng, Jiayang, et al.
Publicado: (2024)
FreSca: Scaling in Frequency Space Enhances Diffusion Models
por: Huang, Chao, et al.
Publicado: (2025)
por: Huang, Chao, et al.
Publicado: (2025)
Learning to Score Sign Language with Two-stage Method
por: Wen, Hongli, et al.
Publicado: (2024)
por: Wen, Hongli, et al.
Publicado: (2024)
Improving Long-Text Alignment for Text-to-Image Diffusion Models
por: Liu, Luping, et al.
Publicado: (2024)
por: Liu, Luping, et al.
Publicado: (2024)
Instructing Text-to-Image Diffusion Models via Classifier-Guided Semantic Optimization
por: Chang, Yuanyuan, et al.
Publicado: (2025)
por: Chang, Yuanyuan, et al.
Publicado: (2025)
UniCon: Unidirectional Information Flow for Effective Control of Large-Scale Diffusion Models
por: Yu, Fanghua, et al.
Publicado: (2025)
por: Yu, Fanghua, et al.
Publicado: (2025)
Seeing the Unseen: Mask-Driven Positional Encoding and Strip-Convolution Context Modeling for Cross-View Object Geo-Localization
por: Hu, Shuhan, et al.
Publicado: (2025)
por: Hu, Shuhan, et al.
Publicado: (2025)
Simplifying DINO via Coding Rate Regularization
por: Wu, Ziyang, et al.
Publicado: (2025)
por: Wu, Ziyang, et al.
Publicado: (2025)
FreeDNA: Endowing Domain Adaptation of Diffusion-Based Dense Prediction with Training-Free Domain Noise Alignment
por: Xu, Hang, et al.
Publicado: (2025)
por: Xu, Hang, et al.
Publicado: (2025)
MPQ-DMv2: Flexible Residual Mixed Precision Quantization for Low-Bit Diffusion Models with Temporal Distillation
por: Feng, Weilun, et al.
Publicado: (2025)
por: Feng, Weilun, et al.
Publicado: (2025)
Unmasking Bias in Diffusion Model Training
por: Yu, Hu, et al.
Publicado: (2023)
por: Yu, Hu, et al.
Publicado: (2023)
HieraFashDiff: Hierarchical Fashion Design with Multi-stage Diffusion Models
por: Xie, Zhifeng, et al.
Publicado: (2024)
por: Xie, Zhifeng, et al.
Publicado: (2024)
Locate n' Rotate: Two-stage Openable Part Detection with Foundation Model Priors
por: Li, Siqi, et al.
Publicado: (2024)
por: Li, Siqi, et al.
Publicado: (2024)
Simultaneous Image-to-Zero and Zero-to-Noise: Diffusion Models with Analytical Image Attenuation
por: Huang, Yuhang, et al.
Publicado: (2023)
por: Huang, Yuhang, et al.
Publicado: (2023)
Chest-Diffusion: A Light-Weight Text-to-Image Model for Report-to-CXR Generation
por: Huang, Peng, et al.
Publicado: (2024)
por: Huang, Peng, et al.
Publicado: (2024)
Audio-visual Controlled Video Diffusion with Masked Selective State Spaces Modeling for Natural Talking Head Generation
por: Hong, Fa-Ting, et al.
Publicado: (2025)
por: Hong, Fa-Ting, et al.
Publicado: (2025)
Ejemplares similares
-
Precipitation Nowcasting Using Diffusion Transformer with Causal Attention
por: Li, ChaoRong, et al.
Publicado: (2024) -
RNDiff: Rainfall nowcasting with Condition Diffusion Model
por: Ling, Xudong, et al.
Publicado: (2024) -
Segment Anything without Supervision
por: Wang, XuDong, et al.
Publicado: (2024) -
UnSAMv2: Self-Supervised Learning Enables Segment Anything at Any Granularity
por: Yu, Junwei, et al.
Publicado: (2025) -
Reconstruction Alignment Improves Unified Multimodal Models
por: Xie, Ji, et al.
Publicado: (2025)