Image Inversion: A Survey from GANs to Diffusion and Beyond
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Yinan, Zhang, Jiangning, Bi, Yali, Hu, Xiaobin, Hu, Teng, Xue, Zhucun, Yi, Ran, Liu, Yong, Tai, Ying |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
UniICL: Systematizing Unified Multimodal In-context Learning through a Capability-Oriented Taxonomy
par: Xu, Yicheng, et autres
Publié: (2026)
par: Xu, Yicheng, et autres
Publié: (2026)
InstanceV: Instance-Level Video Generation
par: Chen, Yuheng, et autres
Publié: (2025)
par: Chen, Yuheng, et autres
Publié: (2025)
IVEBench: Modern Benchmark Suite for Instruction-Guided Video Editing Assessment
par: Chen, Yinan, et autres
Publié: (2025)
par: Chen, Yinan, et autres
Publié: (2025)
M3CoTBench: Benchmark Chain-of-Thought of MLLMs in Medical Image Understanding
par: Jiang, Juntao, et autres
Publié: (2026)
par: Jiang, Juntao, et autres
Publié: (2026)
Multi-Dimensional Knowledge Profiling with Large-Scale Literature Database and Hierarchical Retrieval
par: Xue, Zhucun, et autres
Publié: (2026)
par: Xue, Zhucun, et autres
Publié: (2026)
RWKV-UNet: Improving UNet with Long-Range Cooperation for Effective Medical Image Segmentation
par: Jiang, Juntao, et autres
Publié: (2025)
par: Jiang, Juntao, et autres
Publié: (2025)
Improving Autoregressive Visual Generation with Cluster-Oriented Token Prediction
par: Hu, Teng, et autres
Publié: (2025)
par: Hu, Teng, et autres
Publié: (2025)
SPIKE: An Adaptive Dual Controller Framework for Cost-Efficient Long-Horizon Game Agents
par: Jiang, Wencan, et autres
Publié: (2026)
par: Jiang, Wencan, et autres
Publié: (2026)
AnomalyDiffusion: Few-Shot Anomaly Image Generation with Diffusion Model
par: Hu, Teng, et autres
Publié: (2023)
par: Hu, Teng, et autres
Publié: (2023)
UltraVideo: High-Quality UHD Video Dataset with Comprehensive Captions
par: Xue, Zhucun, et autres
Publié: (2025)
par: Xue, Zhucun, et autres
Publié: (2025)
Transform Trained Transformer: Accelerating Naive 4K Video Generation Over 10$\times$
par: Zhang, Jiangning, et autres
Publié: (2025)
par: Zhang, Jiangning, et autres
Publié: (2025)
Semantic Frame Interpolation
par: Hong, Yijia, et autres
Publié: (2025)
par: Hong, Yijia, et autres
Publié: (2025)
Learning Feature Inversion for Multi-class Anomaly Detection under General-purpose COCO-AD Benchmark
par: Zhang, Jiangning, et autres
Publié: (2024)
par: Zhang, Jiangning, et autres
Publié: (2024)
Advancing Narrative Long Video Generation via Training-Free Identity-Aware Memory
par: Liu, Jinzhuo, et autres
Publié: (2026)
par: Liu, Jinzhuo, et autres
Publié: (2026)
UltraGen: High-Resolution Video Generation with Hierarchical Attention
par: Hu, Teng, et autres
Publié: (2025)
par: Hu, Teng, et autres
Publié: (2025)
EMOv2: Pushing 5M Vision Model Frontier
par: Zhang, Jiangning, et autres
Publié: (2024)
par: Zhang, Jiangning, et autres
Publié: (2024)
Evolution of Optimization Methods: Algorithms, Scenarios, and Evaluations
par: Zhang, Tong, et autres
Publié: (2026)
par: Zhang, Tong, et autres
Publié: (2026)
DiP: Taming Diffusion Models in Pixel Space
par: Chen, Zhennan, et autres
Publié: (2025)
par: Chen, Zhennan, et autres
Publié: (2025)
Exploring Real&Synthetic Dataset and Linear Attention in Image Restoration
par: Du, Yuzhen, et autres
Publié: (2024)
par: Du, Yuzhen, et autres
Publié: (2024)
Evolution of Video Generative Foundations
par: Hu, Teng, et autres
Publié: (2026)
par: Hu, Teng, et autres
Publié: (2026)
SaRA: High-Efficient Diffusion Model Fine-tuning with Progressive Sparse Low-Rank Adaptation
par: Hu, Teng, et autres
Publié: (2024)
par: Hu, Teng, et autres
Publié: (2024)
IAR2: Improving Autoregressive Visual Generation with Semantic-Detail Associated Token Prediction
par: Yi, Ran, et autres
Publié: (2025)
par: Yi, Ran, et autres
Publié: (2025)
UltraLBM-UNet: Ultralight Bidirectional Mamba-based Model for Skin Lesion Segmentation
par: Fan, Linxuan, et autres
Publié: (2025)
par: Fan, Linxuan, et autres
Publié: (2025)
TIMotion: Temporal and Interactive Framework for Efficient Human-Human Motion Generation
par: Wang, Yabiao, et autres
Publié: (2024)
par: Wang, Yabiao, et autres
Publié: (2024)
AdaVideoRAG: Omni-Contextual Adaptive Retrieval-Augmented Efficient Long Video Understanding
par: Xue, Zhucun, et autres
Publié: (2025)
par: Xue, Zhucun, et autres
Publié: (2025)
JoIN: Joint GANs Inversion for Intrinsic Image Decomposition
par: Shah, Viraj, et autres
Publié: (2023)
par: Shah, Viraj, et autres
Publié: (2023)
GPT-4V-AD: Exploring Grounding Potential of VQA-oriented GPT-4V for Zero-shot Anomaly Detection
par: Zhang, Jiangning, et autres
Publié: (2023)
par: Zhang, Jiangning, et autres
Publié: (2023)
Unveil Inversion and Invariance in Flow Transformer for Versatile Image Editing
par: Xu, Pengcheng, et autres
Publié: (2024)
par: Xu, Pengcheng, et autres
Publié: (2024)
FeRA: Frequency-Energy Constrained Routing for Effective Diffusion Adaptation Fine-Tuning
par: Yin, Bo, et autres
Publié: (2025)
par: Yin, Bo, et autres
Publié: (2025)
Open-Vocabulary SAM3D: Towards Training-free Open-Vocabulary 3D Scene Understanding
par: Tai, Hanchen, et autres
Publié: (2024)
par: Tai, Hanchen, et autres
Publié: (2024)
ArtWeaver: Advanced Dynamic Style Integration via Diffusion Model
par: Xu, Chengming, et autres
Publié: (2024)
par: Xu, Chengming, et autres
Publié: (2024)
You Only Sample Once: Taming One-Step Text-to-Image Synthesis by Self-Cooperative Diffusion GANs
par: Luo, Yihong, et autres
Publié: (2024)
par: Luo, Yihong, et autres
Publié: (2024)
Visual Multi-Agent System: Mitigating Hallucination Snowballing via Visual Flow
par: Yu, Xinlei, et autres
Publié: (2025)
par: Yu, Xinlei, et autres
Publié: (2025)
SuperSVG: Superpixel-based Scalable Vector Graphics Synthesis
par: Hu, Teng, et autres
Publié: (2024)
par: Hu, Teng, et autres
Publié: (2024)
Multi-Prototype Embedding Refinement for Semi-Supervised Medical Image Segmentation
par: Bi, Yali, et autres
Publié: (2025)
par: Bi, Yali, et autres
Publié: (2025)
PointSeg: A Training-Free Paradigm for 3D Scene Segmentation via Foundation Models
par: He, Qingdong, et autres
Publié: (2024)
par: He, Qingdong, et autres
Publié: (2024)
IIDM: Image-to-Image Diffusion Model for Semantic Image Synthesis
par: Liu, Feng, et autres
Publié: (2024)
par: Liu, Feng, et autres
Publié: (2024)
SMaRt: Improving GANs with Score Matching Regularity
par: Xia, Mengfei, et autres
Publié: (2023)
par: Xia, Mengfei, et autres
Publié: (2023)
HumanVideo-MME: Benchmarking MLLMs for Human-Centric Video Understanding
par: Cai, Yuxuan, et autres
Publié: (2025)
par: Cai, Yuxuan, et autres
Publié: (2025)
A Comprehensive Library for Benchmarking Multi-class Visual Anomaly Detection
par: Zhang, Jiangning, et autres
Publié: (2024)
par: Zhang, Jiangning, et autres
Publié: (2024)
Documents similaires
-
UniICL: Systematizing Unified Multimodal In-context Learning through a Capability-Oriented Taxonomy
par: Xu, Yicheng, et autres
Publié: (2026) -
InstanceV: Instance-Level Video Generation
par: Chen, Yuheng, et autres
Publié: (2025) -
IVEBench: Modern Benchmark Suite for Instruction-Guided Video Editing Assessment
par: Chen, Yinan, et autres
Publié: (2025) -
M3CoTBench: Benchmark Chain-of-Thought of MLLMs in Medical Image Understanding
par: Jiang, Juntao, et autres
Publié: (2026) -
Multi-Dimensional Knowledge Profiling with Large-Scale Literature Database and Hierarchical Retrieval
par: Xue, Zhucun, et autres
Publié: (2026)