Representation Fréchet Loss for Visual Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Jiawei, Geng, Zhengyang, Ju, Xuan, Tian, Yonglong, Wang, Yue |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Latent Denoising Makes Good Tokenizers
di: Yang, Jiawei, et al.
Pubblicazione: (2025)
di: Yang, Jiawei, et al.
Pubblicazione: (2025)
Personalized Representation from Personalized Generation
di: Sundaram, Shobhita, et al.
Pubblicazione: (2024)
di: Sundaram, Shobhita, et al.
Pubblicazione: (2024)
Autoregressive Image Generation without Vector Quantization
di: Li, Tianhong, et al.
Pubblicazione: (2024)
di: Li, Tianhong, et al.
Pubblicazione: (2024)
Denoising Vision Transformers
di: Yang, Jiawei, et al.
Pubblicazione: (2024)
di: Yang, Jiawei, et al.
Pubblicazione: (2024)
Fréchet Denoised Distance: Enhancing Plausibility Evaluation for Generated Designs with Denoising Autoencoder
di: Fan, Jiajie, et al.
Pubblicazione: (2024)
di: Fan, Jiajie, et al.
Pubblicazione: (2024)
Improving the Classification Effect of Clinical Images of Diseases for Multi-Source Privacy Protection
di: Bowen, Tian, et al.
Pubblicazione: (2024)
di: Bowen, Tian, et al.
Pubblicazione: (2024)
Component-Aware Structure-Preserving Style Transfer for Satellite Visual Sim2Real Data Construction
di: Xie, Zongwu, et al.
Pubblicazione: (2026)
di: Xie, Zongwu, et al.
Pubblicazione: (2026)
Visual Text Generation in the Wild
di: Zhu, Yuanzhi, et al.
Pubblicazione: (2024)
di: Zhu, Yuanzhi, et al.
Pubblicazione: (2024)
Visual Bridge: Universal Visual Perception Representations Generating
di: Gao, Yilin, et al.
Pubblicazione: (2025)
di: Gao, Yilin, et al.
Pubblicazione: (2025)
Native Audio-Visual Alignment for Generation
di: Ji, Longbin, et al.
Pubblicazione: (2026)
di: Ji, Longbin, et al.
Pubblicazione: (2026)
SceneVTG++: Controllable Multilingual Visual Text Generation in the Wild
di: Liu, Jiawei, et al.
Pubblicazione: (2025)
di: Liu, Jiawei, et al.
Pubblicazione: (2025)
Stable Consistency Tuning: Understanding and Improving Consistency Models
di: Wang, Fu-Yun, et al.
Pubblicazione: (2024)
di: Wang, Fu-Yun, et al.
Pubblicazione: (2024)
DINOv3 Visual Representations for Blueberry Perception Toward Robotic Harvesting
di: Wang, Rui-Feng, et al.
Pubblicazione: (2026)
di: Wang, Rui-Feng, et al.
Pubblicazione: (2026)
Are Video Generation Models Geographically Fair? An Attraction-Centric Evaluation of Global Visual Knowledge
di: Liu, Xiao, et al.
Pubblicazione: (2026)
di: Liu, Xiao, et al.
Pubblicazione: (2026)
LMPT: Prompt Tuning with Class-Specific Embedding Loss for Long-tailed Multi-Label Visual Recognition
di: Xia, Peng, et al.
Pubblicazione: (2023)
di: Xia, Peng, et al.
Pubblicazione: (2023)
Learning Vision from Models Rivals Learning Vision from Data
di: Tian, Yonglong, et al.
Pubblicazione: (2023)
di: Tian, Yonglong, et al.
Pubblicazione: (2023)
VQ-SGen: A Vector Quantized Stroke Representation for Creative Sketch Generation
di: Wang, Jiawei, et al.
Pubblicazione: (2024)
di: Wang, Jiawei, et al.
Pubblicazione: (2024)
Learning 1D Causal Visual Representation with De-focus Attention Networks
di: Tao, Chenxin, et al.
Pubblicazione: (2024)
di: Tao, Chenxin, et al.
Pubblicazione: (2024)
Evaluating Text-to-Image and Text-to-Video Synthesis with a Conditional Fréchet Distance
di: Koo, Jaywon, et al.
Pubblicazione: (2025)
di: Koo, Jaywon, et al.
Pubblicazione: (2025)
Neural Clustering based Visual Representation Learning
di: Chen, Guikun, et al.
Pubblicazione: (2024)
di: Chen, Guikun, et al.
Pubblicazione: (2024)
DirectTriGS: Triplane-based Gaussian Splatting Field Representation for 3D Generation
di: Ju, Xiaoliang, et al.
Pubblicazione: (2025)
di: Ju, Xiaoliang, et al.
Pubblicazione: (2025)
Learning Robust Representations via Bidirectional Transition for Visual Reinforcement Learning
di: Hu, Xiaobo, et al.
Pubblicazione: (2023)
di: Hu, Xiaobo, et al.
Pubblicazione: (2023)
EVA-02: A Visual Representation for Neon Genesis
di: Fang, Yuxin, et al.
Pubblicazione: (2023)
di: Fang, Yuxin, et al.
Pubblicazione: (2023)
Randomized Autoregressive Visual Generation
di: Yu, Qihang, et al.
Pubblicazione: (2024)
di: Yu, Qihang, et al.
Pubblicazione: (2024)
GMC: A General Framework of Multi-stage Context Learning and Utilization for Visual Detection Tasks
di: Wang, Xuan, et al.
Pubblicazione: (2024)
di: Wang, Xuan, et al.
Pubblicazione: (2024)
SparseGS-W: Sparse-View 3D Gaussian Splatting in the Wild with Generative Priors
di: Li, Yiqing, et al.
Pubblicazione: (2025)
di: Li, Yiqing, et al.
Pubblicazione: (2025)
AnyText2: Visual Text Generation and Editing With Customizable Attributes
di: Tuo, Yuxiang, et al.
Pubblicazione: (2024)
di: Tuo, Yuxiang, et al.
Pubblicazione: (2024)
Visual Anagrams: Generating Multi-View Optical Illusions with Diffusion Models
di: Geng, Daniel, et al.
Pubblicazione: (2023)
di: Geng, Daniel, et al.
Pubblicazione: (2023)
Fréchet Video Motion Distance: A Metric for Evaluating Motion Consistency in Videos
di: Liu, Jiahe, et al.
Pubblicazione: (2024)
di: Liu, Jiahe, et al.
Pubblicazione: (2024)
City Scene Super-Resolution via Geometric Error Minimization
di: Lu, Zhengyang, et al.
Pubblicazione: (2024)
di: Lu, Zhengyang, et al.
Pubblicazione: (2024)
One-step Latent-free Image Generation with Pixel Mean Flows
di: Lu, Yiyang, et al.
Pubblicazione: (2026)
di: Lu, Yiyang, et al.
Pubblicazione: (2026)
Mean Flows for One-step Generative Modeling
di: Geng, Zhengyang, et al.
Pubblicazione: (2025)
di: Geng, Zhengyang, et al.
Pubblicazione: (2025)
Harmonizing Visual Representations for Unified Multimodal Understanding and Generation
di: Wu, Size, et al.
Pubblicazione: (2025)
di: Wu, Size, et al.
Pubblicazione: (2025)
VDLF-Net: Variational Feature Fusion for Adaptive and Few-Shot Visual Learning
di: Yan, Jiawei
Pubblicazione: (2026)
di: Yan, Jiawei
Pubblicazione: (2026)
One-Step Diffusion Distillation via Deep Equilibrium Models
di: Geng, Zhengyang, et al.
Pubblicazione: (2023)
di: Geng, Zhengyang, et al.
Pubblicazione: (2023)
Cubic Discrete Diffusion: Discrete Visual Generation on High-Dimensional Representation Tokens
di: Wang, Yuqing, et al.
Pubblicazione: (2026)
di: Wang, Yuqing, et al.
Pubblicazione: (2026)
Semi-supervised Chinese Poem-to-Painting Generation via Cycle-consistent Adversarial Networks
di: Lu, Zhengyang, et al.
Pubblicazione: (2024)
di: Lu, Zhengyang, et al.
Pubblicazione: (2024)
Visual Attention Drifts,but Anchors Hold:Mitigating Hallucination in Multimodal Large Language Models via Cross-Layer Visual Anchors
di: Yang, Chengxu, et al.
Pubblicazione: (2026)
di: Yang, Chengxu, et al.
Pubblicazione: (2026)
EVCtrl: Efficient Control Adapter for Visual Generation
di: Yang, Zixiang, et al.
Pubblicazione: (2025)
di: Yang, Zixiang, et al.
Pubblicazione: (2025)
OpenMixup: Open Mixup Toolbox and Benchmark for Visual Representation Learning
di: Li, Siyuan, et al.
Pubblicazione: (2022)
di: Li, Siyuan, et al.
Pubblicazione: (2022)
Documenti analoghi
-
Latent Denoising Makes Good Tokenizers
di: Yang, Jiawei, et al.
Pubblicazione: (2025) -
Personalized Representation from Personalized Generation
di: Sundaram, Shobhita, et al.
Pubblicazione: (2024) -
Autoregressive Image Generation without Vector Quantization
di: Li, Tianhong, et al.
Pubblicazione: (2024) -
Denoising Vision Transformers
di: Yang, Jiawei, et al.
Pubblicazione: (2024) -
Fréchet Denoised Distance: Enhancing Plausibility Evaluation for Generated Designs with Denoising Autoencoder
di: Fan, Jiajie, et al.
Pubblicazione: (2024)