Energy-Calibrated VAE with Test Time Free Lunch
Fuente:
arXiv
Salvato in:
| Autori principali: | Luo, Yihong, Qiu, Siya, Tao, Xingjian, Cai, Yujun, Tang, Jing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Mitigating Coordinate Prediction Bias from Positional Encoding Failures
di: Tao, Xingjian, et al.
Pubblicazione: (2025)
di: Tao, Xingjian, et al.
Pubblicazione: (2025)
Learning Few-Step Diffusion Models by Trajectory Distribution Matching
di: Luo, Yihong, et al.
Pubblicazione: (2025)
di: Luo, Yihong, et al.
Pubblicazione: (2025)
ViewFusion: Structured Spatial Thinking Chains for Multi-View Reasoning
di: Tao, Xingjian, et al.
Pubblicazione: (2026)
di: Tao, Xingjian, et al.
Pubblicazione: (2026)
SegDebias: Test-Time Bias Mitigation for ViT-Based CLIP via Segmentation
di: Wu, Fangyu, et al.
Pubblicazione: (2025)
di: Wu, Fangyu, et al.
Pubblicazione: (2025)
CineScale: Free Lunch in High-Resolution Cinematic Visual Generation
di: Qiu, Haonan, et al.
Pubblicazione: (2025)
di: Qiu, Haonan, et al.
Pubblicazione: (2025)
FreeInv: Free Lunch for Improving DDIM Inversion
di: Bao, Yuxiang, et al.
Pubblicazione: (2025)
di: Bao, Yuxiang, et al.
Pubblicazione: (2025)
Free Lunch for Generating Effective Outlier Supervision
di: Pei, Sen, et al.
Pubblicazione: (2023)
di: Pei, Sen, et al.
Pubblicazione: (2023)
Predictive Spectral Calibration for Source-Free Test-Time Regression
di: Kiet, Nguyen Viet Tuan, et al.
Pubblicazione: (2026)
di: Kiet, Nguyen Viet Tuan, et al.
Pubblicazione: (2026)
FreeCus: Free Lunch Subject-driven Customization in Diffusion Transformers
di: Zhang, Yanbing, et al.
Pubblicazione: (2025)
di: Zhang, Yanbing, et al.
Pubblicazione: (2025)
Free Lunch for Unified Multimodal Models: Enhancing Generation via Reflective Rectification with Inherent Understanding
di: Jiang, Yibo, et al.
Pubblicazione: (2026)
di: Jiang, Yibo, et al.
Pubblicazione: (2026)
Free-Lunch Color-Texture Disentanglement for Stylized Image Generation
di: Qin, Jiang, et al.
Pubblicazione: (2025)
di: Qin, Jiang, et al.
Pubblicazione: (2025)
Calibration & Reconstruction: Deep Integrated Language for Referring Image Segmentation
di: Yan, Yichen, et al.
Pubblicazione: (2024)
di: Yan, Yichen, et al.
Pubblicazione: (2024)
Reinforcing Diffusion Models by Direct Group Preference Optimization
di: Luo, Yihong, et al.
Pubblicazione: (2025)
di: Luo, Yihong, et al.
Pubblicazione: (2025)
Switch EMA: A Free Lunch for Better Flatness and Sharpness
di: Li, Siyuan, et al.
Pubblicazione: (2024)
di: Li, Siyuan, et al.
Pubblicazione: (2024)
RIFLEx: A Free Lunch for Length Extrapolation in Video Diffusion Transformers
di: Zhao, Min, et al.
Pubblicazione: (2025)
di: Zhao, Min, et al.
Pubblicazione: (2025)
Reward-Instruct: A Reward-Centric Approach to Fast Photo-Realistic Image Generation
di: Luo, Yihong, et al.
Pubblicazione: (2025)
di: Luo, Yihong, et al.
Pubblicazione: (2025)
Free Lunch for Stabilizing Rectified Flow Inversion
di: Wang, Chenru, et al.
Pubblicazione: (2026)
di: Wang, Chenru, et al.
Pubblicazione: (2026)
Shortcutting Pre-trained Flow Matching Diffusion Models is Almost Free Lunch
di: Cai, Xu, et al.
Pubblicazione: (2025)
di: Cai, Xu, et al.
Pubblicazione: (2025)
SegTTA: Training-Free Test-Time Augmentation for Zero-Shot Medical Imaging Segmentation
di: Yao, Yihong, et al.
Pubblicazione: (2026)
di: Yao, Yihong, et al.
Pubblicazione: (2026)
CRAFT-LoRA: Content-Style Personalization via Rank-Constrained Adaptation and Training-Free Fusion
di: Li, Yu, et al.
Pubblicazione: (2026)
di: Li, Yu, et al.
Pubblicazione: (2026)
Fuse & Calibrate: A bi-directional Vision-Language Guided Framework for Referring Image Segmentation
di: Yan, Yichen, et al.
Pubblicazione: (2024)
di: Yan, Yichen, et al.
Pubblicazione: (2024)
Spatial Reasoning is Not a Free Lunch: A Controlled Study on LLaVA
di: Alam, Nahid, et al.
Pubblicazione: (2026)
di: Alam, Nahid, et al.
Pubblicazione: (2026)
InstantStyle: Free Lunch towards Style-Preserving in Text-to-Image Generation
di: Wang, Haofan, et al.
Pubblicazione: (2024)
di: Wang, Haofan, et al.
Pubblicazione: (2024)
TDM-R1: Reinforcing Few-Step Diffusion Models with Non-Differentiable Reward
di: Luo, Yihong, et al.
Pubblicazione: (2026)
di: Luo, Yihong, et al.
Pubblicazione: (2026)
FreeCond: Free Lunch in the Input Conditions of Text-Guided Inpainting
di: Hsiao, Teng-Fang, et al.
Pubblicazione: (2024)
di: Hsiao, Teng-Fang, et al.
Pubblicazione: (2024)
FLOSS: Free Lunch in Open-vocabulary Semantic Segmentation
di: Benigmim, Yasser, et al.
Pubblicazione: (2025)
di: Benigmim, Yasser, et al.
Pubblicazione: (2025)
LDPM: Towards undersampled MRI reconstruction with MR-VAE and Latent Diffusion Prior
di: Tang, Xingjian, et al.
Pubblicazione: (2024)
di: Tang, Xingjian, et al.
Pubblicazione: (2024)
You Only Sample Once: Taming One-Step Text-to-Image Synthesis by Self-Cooperative Diffusion GANs
di: Luo, Yihong, et al.
Pubblicazione: (2024)
di: Luo, Yihong, et al.
Pubblicazione: (2024)
Free Lunch Alignment of Text-to-Image Diffusion Models without Preference Image Pairs
di: Xian, Jia Jun Cheng, et al.
Pubblicazione: (2025)
di: Xian, Jia Jun Cheng, et al.
Pubblicazione: (2025)
SATTC: Structure-Aware Label-Free Test-Time Calibration for Cross-Subject EEG-to-Image Retrieval
di: Huang, Qunjie, et al.
Pubblicazione: (2026)
di: Huang, Qunjie, et al.
Pubblicazione: (2026)
SwitchCraft: Training-Free Multi-Event Video Generation with Attention Controls
di: Xu, Qianxun, et al.
Pubblicazione: (2026)
di: Xu, Qianxun, et al.
Pubblicazione: (2026)
Sparse-to-Dense: A Free Lunch for Lossless Acceleration of Video Understanding in LLMs
di: Zhang, Xuan, et al.
Pubblicazione: (2025)
di: Zhang, Xuan, et al.
Pubblicazione: (2025)
REPA-E: Unlocking VAE for End-to-End Tuning with Latent Diffusion Transformers
di: Leng, Xingjian, et al.
Pubblicazione: (2025)
di: Leng, Xingjian, et al.
Pubblicazione: (2025)
FreeBind: Free Lunch in Unified Multimodal Space via Knowledge Fusion
di: Wang, Zehan, et al.
Pubblicazione: (2024)
di: Wang, Zehan, et al.
Pubblicazione: (2024)
PTDiffusion: Free Lunch for Generating Optical Illusion Hidden Pictures with Phase-Transferred Diffusion Model
di: Gao, Xiang, et al.
Pubblicazione: (2025)
di: Gao, Xiang, et al.
Pubblicazione: (2025)
No Free Lunch in Annotation either: An objective evaluation of foundation models for streamlining annotation in animal tracking
di: Mededovic, Emil, et al.
Pubblicazione: (2025)
di: Mededovic, Emil, et al.
Pubblicazione: (2025)
Free Lunch to Meet the Gap: Intermediate Domain Reconstruction for Cross-Domain Few-Shot Learning
di: Zhang, Tong, et al.
Pubblicazione: (2025)
di: Zhang, Tong, et al.
Pubblicazione: (2025)
Noise Consistency Training: A Native Approach for One-Step Generator in Learning Additional Controls
di: Luo, Yihong, et al.
Pubblicazione: (2025)
di: Luo, Yihong, et al.
Pubblicazione: (2025)
Unleashing the Potential of All Test Samples: Mean-Shift Guided Test-Time Adaptation
di: Han, Jizhou, et al.
Pubblicazione: (2025)
di: Han, Jizhou, et al.
Pubblicazione: (2025)
Free Lunch in Pathology Foundation Model: Task-specific Model Adaptation with Concept-Guided Feature Enhancement
di: Huang, Yanyan, et al.
Pubblicazione: (2024)
di: Huang, Yanyan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Mitigating Coordinate Prediction Bias from Positional Encoding Failures
di: Tao, Xingjian, et al.
Pubblicazione: (2025) -
Learning Few-Step Diffusion Models by Trajectory Distribution Matching
di: Luo, Yihong, et al.
Pubblicazione: (2025) -
ViewFusion: Structured Spatial Thinking Chains for Multi-View Reasoning
di: Tao, Xingjian, et al.
Pubblicazione: (2026) -
SegDebias: Test-Time Bias Mitigation for ViT-Based CLIP via Segmentation
di: Wu, Fangyu, et al.
Pubblicazione: (2025) -
CineScale: Free Lunch in High-Resolution Cinematic Visual Generation
di: Qiu, Haonan, et al.
Pubblicazione: (2025)