Improvements to SDXL in NovelAI Diffusion V3
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ossa, Juan, Doğan, Eren, Birch, Alex, Johnson, F. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SDXL-Lightning: Progressive Adversarial Diffusion Distillation
par: Lin, Shanchuan, et autres
Publié: (2024)
par: Lin, Shanchuan, et autres
Publié: (2024)
Scalable High-Resolution Pixel-Space Image Synthesis with Hourglass Diffusion Transformers
par: Crowson, Katherine, et autres
Publié: (2024)
par: Crowson, Katherine, et autres
Publié: (2024)
DOSE3 : Diffusion-based Out-of-distribution detection on SE(3) trajectories
par: Cheng, Hongzhe, et autres
Publié: (2025)
par: Cheng, Hongzhe, et autres
Publié: (2025)
Post-Hoc Concept Disentanglement: From Correlated to Isolated Concept Representations
par: Erogullari, Eren, et autres
Publié: (2025)
par: Erogullari, Eren, et autres
Publié: (2025)
ViT-ProtoNet for Few-Shot Image Classification: A Multi-Benchmark Evaluation
par: Mutlu, Abdulvahap, et autres
Publié: (2025)
par: Mutlu, Abdulvahap, et autres
Publié: (2025)
Self-supervised Benchmark Lottery on ImageNet: Do Marginal Improvements Translate to Improvements on Similar Datasets?
par: Ozbulak, Utku, et autres
Publié: (2025)
par: Ozbulak, Utku, et autres
Publié: (2025)
Warped Diffusion: Solving Video Inverse Problems with Image Diffusion Models
par: Daras, Giannis, et autres
Publié: (2024)
par: Daras, Giannis, et autres
Publié: (2024)
Memory-V2V: Memory-Augmented Video-to-Video Diffusion for Consistent Multi-Turn Editing
par: Lee, Dohun, et autres
Publié: (2026)
par: Lee, Dohun, et autres
Publié: (2026)
AmaraSpatial-10K: A Spatially and Semantically Aligned 3D Dataset for Spatial Computing and Embodied AI
par: Salehi, Mohammad Sadegh, et autres
Publié: (2026)
par: Salehi, Mohammad Sadegh, et autres
Publié: (2026)
On the Design Fundamentals of Diffusion Models: A Survey
par: Chang, Ziyi, et autres
Publié: (2023)
par: Chang, Ziyi, et autres
Publié: (2023)
Text-to-image Diffusion Models in Generative AI: A Survey
par: Zhang, Chenshuang, et autres
Publié: (2023)
par: Zhang, Chenshuang, et autres
Publié: (2023)
MaskAttn-SDXL: Controllable Region-Level Text-To-Image Generation
par: Chang, Yu, et autres
Publié: (2025)
par: Chang, Yu, et autres
Publié: (2025)
RealmDreamer: Text-Driven 3D Scene Generation with Inpainting and Depth Diffusion
par: Shriram, Jaidev, et autres
Publié: (2024)
par: Shriram, Jaidev, et autres
Publié: (2024)
Mask Approximation Net: A Novel Diffusion Model Approach for Remote Sensing Change Captioning
par: Sun, Dongwei, et autres
Publié: (2024)
par: Sun, Dongwei, et autres
Publié: (2024)
Cosmos-LLaVA: Chatting with the Visual Cosmos-LLaVA: Görselle Sohbet Etmek
par: Zeer, Ahmed, et autres
Publié: (2024)
par: Zeer, Ahmed, et autres
Publié: (2024)
Diffuse Everything: Multimodal Diffusion Models on Arbitrary State Spaces
par: Rojas, Kevin, et autres
Publié: (2025)
par: Rojas, Kevin, et autres
Publié: (2025)
Organic or Diffused: Can We Distinguish Human Art from AI-generated Images?
par: Ha, Anna Yoo Jeong, et autres
Publié: (2024)
par: Ha, Anna Yoo Jeong, et autres
Publié: (2024)
SPIE: Semantic and Structural Post-Training of Image Editing Diffusion Models with AI feedback
par: Benarous, Elior, et autres
Publié: (2025)
par: Benarous, Elior, et autres
Publié: (2025)
Naïve PAINE: Lightweight Text-to-Image Generation Improvement with Prompt Evaluation
par: Kim, Joong Ho, et autres
Publié: (2026)
par: Kim, Joong Ho, et autres
Publié: (2026)
Latent Diffusion Models with Image-Derived Annotations for Enhanced AI-Assisted Cancer Diagnosis in Histopathology
par: Osorio, Pedro, et autres
Publié: (2023)
par: Osorio, Pedro, et autres
Publié: (2023)
GCI-ViTAL: Gradual Confidence Improvement with Vision Transformers for Active Learning on Label Noise
par: Mots'oehli, Moseli, et autres
Publié: (2024)
par: Mots'oehli, Moseli, et autres
Publié: (2024)
When Generative Augmentation Hurts: A Benchmark Study of GAN and Diffusion Models for Bias Correction in AI Classification Systems
par: Gupta, Shesh Narayan, et autres
Publié: (2026)
par: Gupta, Shesh Narayan, et autres
Publié: (2026)
MatchDiffusion: Training-free Generation of Match-cuts
par: Pardo, Alejandro, et autres
Publié: (2024)
par: Pardo, Alejandro, et autres
Publié: (2024)
IM-3D: Iterative Multiview Diffusion and Reconstruction for High-Quality 3D Generation
par: Melas-Kyriazi, Luke, et autres
Publié: (2024)
par: Melas-Kyriazi, Luke, et autres
Publié: (2024)
Towards a Novel Measure of User Trust in XAI Systems
par: Miró-Nicolau, Miquel, et autres
Publié: (2024)
par: Miró-Nicolau, Miquel, et autres
Publié: (2024)
Rethinking Metrics and Diffusion Architecture for 3D Point Cloud Generation
par: Bastico, Matteo, et autres
Publié: (2025)
par: Bastico, Matteo, et autres
Publié: (2025)
AI-Driven Non-Invasive Detection and Staging of Steatosis in Fatty Liver Disease Using a Novel Cascade Model and Information Fusion Techniques
par: Delfan, Niloufar, et autres
Publié: (2024)
par: Delfan, Niloufar, et autres
Publié: (2024)
3D Diffuser Actor: Policy Diffusion with 3D Scene Representations
par: Ke, Tsung-Wei, et autres
Publié: (2024)
par: Ke, Tsung-Wei, et autres
Publié: (2024)
Efficient 3D Shape Generation via Diffusion Mamba with Bidirectional SSMs
par: Mo, Shentong
Publié: (2024)
par: Mo, Shentong
Publié: (2024)
SceneTok: A Compressed, Diffusable Token Space for 3D Scenes
par: Asim, Mohammad, et autres
Publié: (2026)
par: Asim, Mohammad, et autres
Publié: (2026)
From Image to Video: An Empirical Study of Diffusion Representations
par: Vélez, Pedro, et autres
Publié: (2025)
par: Vélez, Pedro, et autres
Publié: (2025)
DiffusionNFT: Online Diffusion Reinforcement with Forward Process
par: Zheng, Kaiwen, et autres
Publié: (2025)
par: Zheng, Kaiwen, et autres
Publié: (2025)
Tackling Structural Hallucination in Image Translation with Local Diffusion
par: Kim, Seunghoi, et autres
Publié: (2024)
par: Kim, Seunghoi, et autres
Publié: (2024)
HiFA: High-fidelity Text-to-3D Generation with Advanced Diffusion Guidance
par: Zhu, Junzhe, et autres
Publié: (2023)
par: Zhu, Junzhe, et autres
Publié: (2023)
SymmetricDiffusers: Learning Discrete Diffusion on Finite Symmetric Groups
par: Zhang, Yongxing, et autres
Publié: (2024)
par: Zhang, Yongxing, et autres
Publié: (2024)
Infinite Leagues Under the Sea: Photorealistic 3D Underwater Terrain Generation by Latent Fractal Diffusion Models
par: Zhang, Tianyi, et autres
Publié: (2025)
par: Zhang, Tianyi, et autres
Publié: (2025)
AdjointDPM: Adjoint Sensitivity Method for Gradient Backpropagation of Diffusion Probabilistic Models
par: Pan, Jiachun, et autres
Publié: (2023)
par: Pan, Jiachun, et autres
Publié: (2023)
Contextual Experience Replay for Self-Improvement of Language Agents
par: Liu, Yitao, et autres
Publié: (2025)
par: Liu, Yitao, et autres
Publié: (2025)
ConsistDreamer: 3D-Consistent 2D Diffusion for High-Fidelity Scene Editing
par: Chen, Jun-Kun, et autres
Publié: (2024)
par: Chen, Jun-Kun, et autres
Publié: (2024)
Neural Assets: 3D-Aware Multi-Object Scene Synthesis with Image Diffusion Models
par: Wu, Ziyi, et autres
Publié: (2024)
par: Wu, Ziyi, et autres
Publié: (2024)
Documents similaires
-
SDXL-Lightning: Progressive Adversarial Diffusion Distillation
par: Lin, Shanchuan, et autres
Publié: (2024) -
Scalable High-Resolution Pixel-Space Image Synthesis with Hourglass Diffusion Transformers
par: Crowson, Katherine, et autres
Publié: (2024) -
DOSE3 : Diffusion-based Out-of-distribution detection on SE(3) trajectories
par: Cheng, Hongzhe, et autres
Publié: (2025) -
Post-Hoc Concept Disentanglement: From Correlated to Isolated Concept Representations
par: Erogullari, Eren, et autres
Publié: (2025) -
ViT-ProtoNet for Few-Shot Image Classification: A Multi-Benchmark Evaluation
par: Mutlu, Abdulvahap, et autres
Publié: (2025)