Representation Fréchet Loss for Visual Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Jiawei, Geng, Zhengyang, Ju, Xuan, Tian, Yonglong, Wang, Yue |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Latent Denoising Makes Good Tokenizers
por: Yang, Jiawei, et al.
Publicado: (2025)
por: Yang, Jiawei, et al.
Publicado: (2025)
Personalized Representation from Personalized Generation
por: Sundaram, Shobhita, et al.
Publicado: (2024)
por: Sundaram, Shobhita, et al.
Publicado: (2024)
Autoregressive Image Generation without Vector Quantization
por: Li, Tianhong, et al.
Publicado: (2024)
por: Li, Tianhong, et al.
Publicado: (2024)
Denoising Vision Transformers
por: Yang, Jiawei, et al.
Publicado: (2024)
por: Yang, Jiawei, et al.
Publicado: (2024)
Fréchet Denoised Distance: Enhancing Plausibility Evaluation for Generated Designs with Denoising Autoencoder
por: Fan, Jiajie, et al.
Publicado: (2024)
por: Fan, Jiajie, et al.
Publicado: (2024)
Improving the Classification Effect of Clinical Images of Diseases for Multi-Source Privacy Protection
por: Bowen, Tian, et al.
Publicado: (2024)
por: Bowen, Tian, et al.
Publicado: (2024)
Component-Aware Structure-Preserving Style Transfer for Satellite Visual Sim2Real Data Construction
por: Xie, Zongwu, et al.
Publicado: (2026)
por: Xie, Zongwu, et al.
Publicado: (2026)
Visual Text Generation in the Wild
por: Zhu, Yuanzhi, et al.
Publicado: (2024)
por: Zhu, Yuanzhi, et al.
Publicado: (2024)
Visual Bridge: Universal Visual Perception Representations Generating
por: Gao, Yilin, et al.
Publicado: (2025)
por: Gao, Yilin, et al.
Publicado: (2025)
Native Audio-Visual Alignment for Generation
por: Ji, Longbin, et al.
Publicado: (2026)
por: Ji, Longbin, et al.
Publicado: (2026)
SceneVTG++: Controllable Multilingual Visual Text Generation in the Wild
por: Liu, Jiawei, et al.
Publicado: (2025)
por: Liu, Jiawei, et al.
Publicado: (2025)
Stable Consistency Tuning: Understanding and Improving Consistency Models
por: Wang, Fu-Yun, et al.
Publicado: (2024)
por: Wang, Fu-Yun, et al.
Publicado: (2024)
DINOv3 Visual Representations for Blueberry Perception Toward Robotic Harvesting
por: Wang, Rui-Feng, et al.
Publicado: (2026)
por: Wang, Rui-Feng, et al.
Publicado: (2026)
Are Video Generation Models Geographically Fair? An Attraction-Centric Evaluation of Global Visual Knowledge
por: Liu, Xiao, et al.
Publicado: (2026)
por: Liu, Xiao, et al.
Publicado: (2026)
LMPT: Prompt Tuning with Class-Specific Embedding Loss for Long-tailed Multi-Label Visual Recognition
por: Xia, Peng, et al.
Publicado: (2023)
por: Xia, Peng, et al.
Publicado: (2023)
Learning Vision from Models Rivals Learning Vision from Data
por: Tian, Yonglong, et al.
Publicado: (2023)
por: Tian, Yonglong, et al.
Publicado: (2023)
VQ-SGen: A Vector Quantized Stroke Representation for Creative Sketch Generation
por: Wang, Jiawei, et al.
Publicado: (2024)
por: Wang, Jiawei, et al.
Publicado: (2024)
Learning 1D Causal Visual Representation with De-focus Attention Networks
por: Tao, Chenxin, et al.
Publicado: (2024)
por: Tao, Chenxin, et al.
Publicado: (2024)
Evaluating Text-to-Image and Text-to-Video Synthesis with a Conditional Fréchet Distance
por: Koo, Jaywon, et al.
Publicado: (2025)
por: Koo, Jaywon, et al.
Publicado: (2025)
Neural Clustering based Visual Representation Learning
por: Chen, Guikun, et al.
Publicado: (2024)
por: Chen, Guikun, et al.
Publicado: (2024)
DirectTriGS: Triplane-based Gaussian Splatting Field Representation for 3D Generation
por: Ju, Xiaoliang, et al.
Publicado: (2025)
por: Ju, Xiaoliang, et al.
Publicado: (2025)
Learning Robust Representations via Bidirectional Transition for Visual Reinforcement Learning
por: Hu, Xiaobo, et al.
Publicado: (2023)
por: Hu, Xiaobo, et al.
Publicado: (2023)
EVA-02: A Visual Representation for Neon Genesis
por: Fang, Yuxin, et al.
Publicado: (2023)
por: Fang, Yuxin, et al.
Publicado: (2023)
Randomized Autoregressive Visual Generation
por: Yu, Qihang, et al.
Publicado: (2024)
por: Yu, Qihang, et al.
Publicado: (2024)
GMC: A General Framework of Multi-stage Context Learning and Utilization for Visual Detection Tasks
por: Wang, Xuan, et al.
Publicado: (2024)
por: Wang, Xuan, et al.
Publicado: (2024)
SparseGS-W: Sparse-View 3D Gaussian Splatting in the Wild with Generative Priors
por: Li, Yiqing, et al.
Publicado: (2025)
por: Li, Yiqing, et al.
Publicado: (2025)
AnyText2: Visual Text Generation and Editing With Customizable Attributes
por: Tuo, Yuxiang, et al.
Publicado: (2024)
por: Tuo, Yuxiang, et al.
Publicado: (2024)
Visual Anagrams: Generating Multi-View Optical Illusions with Diffusion Models
por: Geng, Daniel, et al.
Publicado: (2023)
por: Geng, Daniel, et al.
Publicado: (2023)
Fréchet Video Motion Distance: A Metric for Evaluating Motion Consistency in Videos
por: Liu, Jiahe, et al.
Publicado: (2024)
por: Liu, Jiahe, et al.
Publicado: (2024)
City Scene Super-Resolution via Geometric Error Minimization
por: Lu, Zhengyang, et al.
Publicado: (2024)
por: Lu, Zhengyang, et al.
Publicado: (2024)
One-step Latent-free Image Generation with Pixel Mean Flows
por: Lu, Yiyang, et al.
Publicado: (2026)
por: Lu, Yiyang, et al.
Publicado: (2026)
Mean Flows for One-step Generative Modeling
por: Geng, Zhengyang, et al.
Publicado: (2025)
por: Geng, Zhengyang, et al.
Publicado: (2025)
Harmonizing Visual Representations for Unified Multimodal Understanding and Generation
por: Wu, Size, et al.
Publicado: (2025)
por: Wu, Size, et al.
Publicado: (2025)
VDLF-Net: Variational Feature Fusion for Adaptive and Few-Shot Visual Learning
por: Yan, Jiawei
Publicado: (2026)
por: Yan, Jiawei
Publicado: (2026)
One-Step Diffusion Distillation via Deep Equilibrium Models
por: Geng, Zhengyang, et al.
Publicado: (2023)
por: Geng, Zhengyang, et al.
Publicado: (2023)
Cubic Discrete Diffusion: Discrete Visual Generation on High-Dimensional Representation Tokens
por: Wang, Yuqing, et al.
Publicado: (2026)
por: Wang, Yuqing, et al.
Publicado: (2026)
Semi-supervised Chinese Poem-to-Painting Generation via Cycle-consistent Adversarial Networks
por: Lu, Zhengyang, et al.
Publicado: (2024)
por: Lu, Zhengyang, et al.
Publicado: (2024)
Visual Attention Drifts,but Anchors Hold:Mitigating Hallucination in Multimodal Large Language Models via Cross-Layer Visual Anchors
por: Yang, Chengxu, et al.
Publicado: (2026)
por: Yang, Chengxu, et al.
Publicado: (2026)
EVCtrl: Efficient Control Adapter for Visual Generation
por: Yang, Zixiang, et al.
Publicado: (2025)
por: Yang, Zixiang, et al.
Publicado: (2025)
OpenMixup: Open Mixup Toolbox and Benchmark for Visual Representation Learning
por: Li, Siyuan, et al.
Publicado: (2022)
por: Li, Siyuan, et al.
Publicado: (2022)
Ejemplares similares
-
Latent Denoising Makes Good Tokenizers
por: Yang, Jiawei, et al.
Publicado: (2025) -
Personalized Representation from Personalized Generation
por: Sundaram, Shobhita, et al.
Publicado: (2024) -
Autoregressive Image Generation without Vector Quantization
por: Li, Tianhong, et al.
Publicado: (2024) -
Denoising Vision Transformers
por: Yang, Jiawei, et al.
Publicado: (2024) -
Fréchet Denoised Distance: Enhancing Plausibility Evaluation for Generated Designs with Denoising Autoencoder
por: Fan, Jiajie, et al.
Publicado: (2024)