Hyperspherical Autoencoder for High-Fidelity Image Reconstruction and Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chang, Hun, Cha, Byunghee, Ye, Jong Chul |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Align Your Tangent: Training Better Consistency Models via Manifold-Aligned Tangents
par: Kim, Beomsu, et autres
Publié: (2025)
par: Kim, Beomsu, et autres
Publié: (2025)
Aligning Text to Image in Diffusion Models is Easier Than You Think
par: Lee, Jaa-Yeon, et autres
Publié: (2025)
par: Lee, Jaa-Yeon, et autres
Publié: (2025)
Minority-Focused Text-to-Image Generation via Prompt Optimization
par: Um, Soobin, et autres
Publié: (2024)
par: Um, Soobin, et autres
Publié: (2024)
PCPO: Proportionate Credit Policy Optimization for Aligning Image Generation Models
par: Lee, Jeongjae, et autres
Publié: (2025)
par: Lee, Jeongjae, et autres
Publié: (2025)
VISION-XL: High Definition Video Inverse Problem Solver using Latent Image Diffusion Models
par: Kwon, Taesung, et autres
Publié: (2024)
par: Kwon, Taesung, et autres
Publié: (2024)
FILT3R: Latent State Adaptive Kalman Filter for Streaming 3D Reconstruction
par: Jin, Seonghyun, et autres
Publié: (2026)
par: Jin, Seonghyun, et autres
Publié: (2026)
Solving Video Inverse Problems Using Image Diffusion Models
par: Kwon, Taesung, et autres
Publié: (2024)
par: Kwon, Taesung, et autres
Publié: (2024)
Self-Guided Generation of Minority Samples Using Diffusion Models
par: Um, Soobin, et autres
Publié: (2024)
par: Um, Soobin, et autres
Publié: (2024)
Generalized Consistency Trajectory Models for Image Manipulation
par: Kim, Beomsu, et autres
Publié: (2024)
par: Kim, Beomsu, et autres
Publié: (2024)
Diverse Text-to-Image Generation via Contrastive Noise Optimization
par: Kim, Byungjun, et autres
Publié: (2025)
par: Kim, Byungjun, et autres
Publié: (2025)
LLM-CXR: Instruction-Finetuned LLM for CXR Image Understanding and Generation
par: Lee, Suhyeon, et autres
Publié: (2023)
par: Lee, Suhyeon, et autres
Publié: (2023)
Latent Schrodinger Bridge: Prompting Latent Diffusion for Fast Unpaired Image-to-Image Translation
par: Kim, Jeongsol, et autres
Publié: (2024)
par: Kim, Jeongsol, et autres
Publié: (2024)
Contrastive CFG: Improving CFG in Diffusion Models by Contrasting Positive and Negative Concepts
par: Chang, Jinho, et autres
Publié: (2024)
par: Chang, Jinho, et autres
Publié: (2024)
Geometric 4D Stitching for Grounded 4D Generation
par: Park, Sunwoo, et autres
Publié: (2026)
par: Park, Sunwoo, et autres
Publié: (2026)
Unpaired Image-to-Image Translation via Neural Schrödinger Bridge
par: Kim, Beomsu, et autres
Publié: (2023)
par: Kim, Beomsu, et autres
Publié: (2023)
Boost-and-Skip: A Simple Guidance-Free Diffusion for Minority Generation
par: Um, Soobin, et autres
Publié: (2025)
par: Um, Soobin, et autres
Publié: (2025)
Tiled Prompts: Overcoming Prompt Misguidance in Image and Video Super-Resolution
par: Kim, Bryan Sangwoo, et autres
Publié: (2026)
par: Kim, Bryan Sangwoo, et autres
Publié: (2026)
DreamSampler: Unifying Diffusion Sampling and Score Distillation for Image Manipulation
par: Kim, Jeongsol, et autres
Publié: (2024)
par: Kim, Jeongsol, et autres
Publié: (2024)
Extreme Blind Image Restoration via Prompt-Conditioned Information Bottleneck
par: Kim, Hongeun, et autres
Publié: (2025)
par: Kim, Hongeun, et autres
Publié: (2025)
Ground-A-Video: Zero-shot Grounded Video Editing using Text-to-image Diffusion Models
par: Jeong, Hyeonho, et autres
Publié: (2023)
par: Jeong, Hyeonho, et autres
Publié: (2023)
FlowLPS: Langevin-Proximal Sampling for Flow-based Inverse Problem Solvers
par: Park, Jonghyun, et autres
Publié: (2025)
par: Park, Jonghyun, et autres
Publié: (2025)
PromptLoop: Plug-and-Play Prompt Refinement via Latent Feedback for Diffusion Model Alignment
par: Lee, Suhyeon, et autres
Publié: (2025)
par: Lee, Suhyeon, et autres
Publié: (2025)
Free$^2$Guide: Training-Free Text-to-Video Alignment using Image LVLM
par: Kim, Jaemin, et autres
Publié: (2024)
par: Kim, Jaemin, et autres
Publié: (2024)
Reward Score Matching: Unifying Reward-based Fine-tuning for Flow and Diffusion Models
par: Lee, Jeongjae, et autres
Publié: (2026)
par: Lee, Jeongjae, et autres
Publié: (2026)
FlowAlign: Trajectory-Regularized, Inversion-Free Flow-based Image Editing
par: Kim, Jeongsol, et autres
Publié: (2025)
par: Kim, Jeongsol, et autres
Publié: (2025)
Gradient-Free Noise Optimization for Reward Alignment in Generative Models
par: Kim, Jeongsol, et autres
Publié: (2026)
par: Kim, Jeongsol, et autres
Publié: (2026)
Alignment-Guided Score Matching for Text-to-Image Alignment in Diffusion Models
par: Lee, Jaa-Yeon, et autres
Publié: (2026)
par: Lee, Jaa-Yeon, et autres
Publié: (2026)
Contrastive Denoising Score for Text-guided Latent Diffusion Image Editing
par: Nam, Hyelin, et autres
Publié: (2023)
par: Nam, Hyelin, et autres
Publié: (2023)
CRePE: Curved Ray Expectation Positional Encoding for Unified-Camera-Controlled Video Generation
par: Jin, Seonghyun, et autres
Publié: (2026)
par: Jin, Seonghyun, et autres
Publié: (2026)
MotionCFG: Boosting Motion Dynamics via Stochastic Concept Perturbation
par: Kim, Byungjun, et autres
Publié: (2026)
par: Kim, Byungjun, et autres
Publié: (2026)
Decomposed Diffusion Sampler for Accelerating Large-Scale Inverse Problems
par: Chung, Hyungjin, et autres
Publié: (2023)
par: Chung, Hyungjin, et autres
Publié: (2023)
MindFormer: Semantic Alignment of Multi-Subject fMRI for Brain Decoding
par: Han, Inhwa, et autres
Publié: (2024)
par: Han, Inhwa, et autres
Publié: (2024)
ViBiDSampler: Enhancing Video Interpolation Using Bidirectional Diffusion Sampler
par: Yang, Serin, et autres
Publié: (2024)
par: Yang, Serin, et autres
Publié: (2024)
Don't Play Favorites: Minority Guidance for Diffusion Models
par: Um, Soobin, et autres
Publié: (2023)
par: Um, Soobin, et autres
Publié: (2023)
OTSeg: Multi-prompt Sinkhorn Attention for Zero-Shot Semantic Segmentation
par: Kim, Kwanyoung, et autres
Publié: (2024)
par: Kim, Kwanyoung, et autres
Publié: (2024)
ED-NeRF: Efficient Text-Guided Editing of 3D Scene with Latent Space NeRF
par: Park, Jangho, et autres
Publié: (2023)
par: Park, Jangho, et autres
Publié: (2023)
Chain-of-Zoom: Extreme Super-Resolution via Scale Autoregression and Preference Alignment
par: Kim, Bryan Sangwoo, et autres
Publié: (2025)
par: Kim, Bryan Sangwoo, et autres
Publié: (2025)
FlowDPS: Flow-Driven Posterior Sampling for Inverse Problems
par: Kim, Jeongsol, et autres
Publié: (2025)
par: Kim, Jeongsol, et autres
Publié: (2025)
Diffusion Posterior Sampling for General Noisy Inverse Problems
par: Chung, Hyungjin, et autres
Publié: (2022)
par: Chung, Hyungjin, et autres
Publié: (2022)
Probabilistic Contrastive Learning with Explicit Concentration on the Hypersphere
par: Li, Hongwei Bran, et autres
Publié: (2024)
par: Li, Hongwei Bran, et autres
Publié: (2024)
Documents similaires
-
Align Your Tangent: Training Better Consistency Models via Manifold-Aligned Tangents
par: Kim, Beomsu, et autres
Publié: (2025) -
Aligning Text to Image in Diffusion Models is Easier Than You Think
par: Lee, Jaa-Yeon, et autres
Publié: (2025) -
Minority-Focused Text-to-Image Generation via Prompt Optimization
par: Um, Soobin, et autres
Publié: (2024) -
PCPO: Proportionate Credit Policy Optimization for Aligning Image Generation Models
par: Lee, Jeongjae, et autres
Publié: (2025) -
VISION-XL: High Definition Video Inverse Problem Solver using Latent Image Diffusion Models
par: Kwon, Taesung, et autres
Publié: (2024)