Salvato in:
| Autori principali: | Tschannen, Michael, Pinto, André Susano, Kolesnikov, Alexander |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2411.19722 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Jet: A Modern Transformer-Based Normalizing Flow
di: Kolesnikov, Alexander, et al.
Pubblicazione: (2024)
di: Kolesnikov, Alexander, et al.
Pubblicazione: (2024)
Towards Truly Zero-shot Compositional Visual Reasoning with LLMs as Programmers
di: Stanić, Aleksandar, et al.
Pubblicazione: (2024)
di: Stanić, Aleksandar, et al.
Pubblicazione: (2024)
Enhancing Diffusion Models for High-Quality Image Generation
di: Shah, Jaineet, et al.
Pubblicazione: (2024)
di: Shah, Jaineet, et al.
Pubblicazione: (2024)
E-CAR: Efficient Continuous Autoregressive Image Generation via Multistage Modeling
di: Yuan, Zhihang, et al.
Pubblicazione: (2024)
di: Yuan, Zhihang, et al.
Pubblicazione: (2024)
VTBench: Evaluating Visual Tokenizers for Autoregressive Image Generation
di: Lin, Huawei, et al.
Pubblicazione: (2025)
di: Lin, Huawei, et al.
Pubblicazione: (2025)
Annealed Relaxation of Speculative Decoding for Faster Autoregressive Image Generation
di: Li, Xingyao, et al.
Pubblicazione: (2026)
di: Li, Xingyao, et al.
Pubblicazione: (2026)
Watermarking Autoregressive Image Generation
di: Jovanović, Nikola, et al.
Pubblicazione: (2025)
di: Jovanović, Nikola, et al.
Pubblicazione: (2025)
PaliGemma: A versatile 3B VLM for transfer
di: Beyer, Lucas, et al.
Pubblicazione: (2024)
di: Beyer, Lucas, et al.
Pubblicazione: (2024)
Astra: General Interactive World Model with Autoregressive Denoising
di: Zhu, Yixuan, et al.
Pubblicazione: (2025)
di: Zhu, Yixuan, et al.
Pubblicazione: (2025)
MASC: Boosting Autoregressive Image Generation with a Manifold-Aligned Semantic Clustering
di: He, Lixuan, et al.
Pubblicazione: (2025)
di: He, Lixuan, et al.
Pubblicazione: (2025)
Optimizing Negative Prompts for Enhanced Aesthetics and Fidelity in Text-To-Image Generation
di: Ogezi, Michael, et al.
Pubblicazione: (2024)
di: Ogezi, Michael, et al.
Pubblicazione: (2024)
Contextualized Diffusion Models for Text-Guided Image and Video Generation
di: Yang, Ling, et al.
Pubblicazione: (2024)
di: Yang, Ling, et al.
Pubblicazione: (2024)
DocSynthv2: A Practical Autoregressive Modeling for Document Generation
di: Biswas, Sanket, et al.
Pubblicazione: (2024)
di: Biswas, Sanket, et al.
Pubblicazione: (2024)
Text-To-Image with Generative Adversarial Networks
di: Momen-Tayefeh, Mehrshad
Pubblicazione: (2024)
di: Momen-Tayefeh, Mehrshad
Pubblicazione: (2024)
Identity Curvature Laplace Approximation for Improved Out-of-Distribution Detection
di: Zhdanov, Maksim, et al.
Pubblicazione: (2023)
di: Zhdanov, Maksim, et al.
Pubblicazione: (2023)
RL for Consistency Models: Faster Reward Guided Text-to-Image Generation
di: Oertell, Owen, et al.
Pubblicazione: (2024)
di: Oertell, Owen, et al.
Pubblicazione: (2024)
Pre-trained Language Models Do Not Help Auto-regressive Text-to-Image Generation
di: Zhang, Yuhui, et al.
Pubblicazione: (2023)
di: Zhang, Yuhui, et al.
Pubblicazione: (2023)
SpectralAR: Spectral Autoregressive Visual Generation
di: Huang, Yuanhui, et al.
Pubblicazione: (2025)
di: Huang, Yuanhui, et al.
Pubblicazione: (2025)
On the Scalability of Diffusion-based Text-to-Image Generation
di: Li, Hao, et al.
Pubblicazione: (2024)
di: Li, Hao, et al.
Pubblicazione: (2024)
EdgeFusion: On-Device Text-to-Image Generation
di: Castells, Thibault, et al.
Pubblicazione: (2024)
di: Castells, Thibault, et al.
Pubblicazione: (2024)
MetaFormer Baselines for Vision
di: Yu, Weihao, et al.
Pubblicazione: (2022)
di: Yu, Weihao, et al.
Pubblicazione: (2022)
PoGDiff: Product-of-Gaussians Diffusion Models for Imbalanced Text-to-Image Generation
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
di: Wang, Ziyan, et al.
Pubblicazione: (2025)
ReText: Text Boosts Generalization in Image-Based Person Re-identification
di: Mamedov, Timur, et al.
Pubblicazione: (2026)
di: Mamedov, Timur, et al.
Pubblicazione: (2026)
Image Captions are Natural Prompts for Text-to-Image Models
di: Lei, Shiye, et al.
Pubblicazione: (2023)
di: Lei, Shiye, et al.
Pubblicazione: (2023)
HART: Efficient Visual Generation with Hybrid Autoregressive Transformer
di: Tang, Haotian, et al.
Pubblicazione: (2024)
di: Tang, Haotian, et al.
Pubblicazione: (2024)
Towards Understanding and Quantifying Uncertainty for Text-to-Image Generation
di: Franchi, Gianni, et al.
Pubblicazione: (2024)
di: Franchi, Gianni, et al.
Pubblicazione: (2024)
Compositional Text-to-Image Generation with Dense Blob Representations
di: Nie, Weili, et al.
Pubblicazione: (2024)
di: Nie, Weili, et al.
Pubblicazione: (2024)
ScribFormer: Transformer Makes CNN Work Better for Scribble-based Medical Image Segmentation
di: Li, Zihan, et al.
Pubblicazione: (2024)
di: Li, Zihan, et al.
Pubblicazione: (2024)
Soft-TransFormers for Continual Learning
di: Kang, Haeyong, et al.
Pubblicazione: (2024)
di: Kang, Haeyong, et al.
Pubblicazione: (2024)
Diversifying Deep Ensembles: A Saliency Map Approach for Enhanced OOD Detection, Calibration, and Accuracy
di: Dereka, Stanislav, et al.
Pubblicazione: (2023)
di: Dereka, Stanislav, et al.
Pubblicazione: (2023)
Text-Aware Image Restoration with Diffusion Models
di: Min, Jaewon, et al.
Pubblicazione: (2025)
di: Min, Jaewon, et al.
Pubblicazione: (2025)
Curriculum-DPO++: Direct Preference Optimization via Data and Model Curricula for Text-to-Image Generation
di: Croitoru, Florinel-Alin, et al.
Pubblicazione: (2026)
di: Croitoru, Florinel-Alin, et al.
Pubblicazione: (2026)
Skrr: Skip and Re-use Text Encoder Layers for Memory Efficient Text-to-Image Generation
di: Seo, Hoigi, et al.
Pubblicazione: (2025)
di: Seo, Hoigi, et al.
Pubblicazione: (2025)
UNCAGE: Contrastive Attention Guidance for Masked Generative Transformers in Text-to-Image Generation
di: Kang, Wonjun, et al.
Pubblicazione: (2025)
di: Kang, Wonjun, et al.
Pubblicazione: (2025)
AlignGuard: Scalable Safety Alignment for Text-to-Image Generation
di: Liu, Runtao, et al.
Pubblicazione: (2024)
di: Liu, Runtao, et al.
Pubblicazione: (2024)
Minority-Focused Text-to-Image Generation via Prompt Optimization
di: Um, Soobin, et al.
Pubblicazione: (2024)
di: Um, Soobin, et al.
Pubblicazione: (2024)
Self-Evaluation Unlocks Any-Step Text-to-Image Generation
di: Yu, Xin, et al.
Pubblicazione: (2025)
di: Yu, Xin, et al.
Pubblicazione: (2025)
PreciseCam: Precise Camera Control for Text-to-Image Generation
di: Bernal-Berdun, Edurne, et al.
Pubblicazione: (2025)
di: Bernal-Berdun, Edurne, et al.
Pubblicazione: (2025)
Understanding Implosion in Text-to-Image Generative Models
di: Ding, Wenxin, et al.
Pubblicazione: (2024)
di: Ding, Wenxin, et al.
Pubblicazione: (2024)
Autoregressive Adversarial Post-Training for Real-Time Interactive Video Generation
di: Lin, Shanchuan, et al.
Pubblicazione: (2025)
di: Lin, Shanchuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Jet: A Modern Transformer-Based Normalizing Flow
di: Kolesnikov, Alexander, et al.
Pubblicazione: (2024) -
Towards Truly Zero-shot Compositional Visual Reasoning with LLMs as Programmers
di: Stanić, Aleksandar, et al.
Pubblicazione: (2024) -
Enhancing Diffusion Models for High-Quality Image Generation
di: Shah, Jaineet, et al.
Pubblicazione: (2024) -
E-CAR: Efficient Continuous Autoregressive Image Generation via Multistage Modeling
di: Yuan, Zhihang, et al.
Pubblicazione: (2024) -
VTBench: Evaluating Visual Tokenizers for Autoregressive Image Generation
di: Lin, Huawei, et al.
Pubblicazione: (2025)