Autoregressive Image Generation with Vision Full-view Prompt
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cai, Miaomiao, Wang, Guanjie, Li, Wei, Tu, Zhijun, Chen, Hanting, Lin, Shaohui, Hu, Jie |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LIPT: Latency-aware Image Processing Transformer
par: Qiao, Junbo, et autres
Publié: (2024)
par: Qiao, Junbo, et autres
Publié: (2024)
Data Upcycling Knowledge Distillation for Image Super-Resolution
par: Zhang, Yun, et autres
Publié: (2023)
par: Zhang, Yun, et autres
Publié: (2023)
IPT-V2: Efficient Image Processing Transformer using Hierarchical Attentions
par: Tu, Zhijun, et autres
Publié: (2024)
par: Tu, Zhijun, et autres
Publié: (2024)
From Sequential to Spatial: Reordering Autoregression for Efficient Visual Generation
par: Wang, Siyang, et autres
Publié: (2025)
par: Wang, Siyang, et autres
Publié: (2025)
RealSR-R1: Reinforcement Learning for Real-World Image Super-Resolution with Vision-Language Chain-of-Thought
par: Qiao, Junbo, et autres
Publié: (2025)
par: Qiao, Junbo, et autres
Publié: (2025)
DSPO: Direct Semantic Preference Optimization for Real-World Image Super-Resolution
par: Cai, Miaomiao, et autres
Publié: (2025)
par: Cai, Miaomiao, et autres
Publié: (2025)
Knowledge Distillation with Multi-granularity Mixture of Priors for Image Super-Resolution
par: Li, Simiao, et autres
Publié: (2024)
par: Li, Simiao, et autres
Publié: (2024)
U-DiTs: Downsample Tokens in U-Shaped Diffusion Transformers
par: Tian, Yuchuan, et autres
Publié: (2024)
par: Tian, Yuchuan, et autres
Publié: (2024)
GIM: A Million-scale Benchmark for Generative Image Manipulation Detection and Localization
par: Chen, Yirui, et autres
Publié: (2024)
par: Chen, Yirui, et autres
Publié: (2024)
Multi-view Image Prompted Multi-view Diffusion for Improved 3D Generation
par: Kim, Seungwook, et autres
Publié: (2024)
par: Kim, Seungwook, et autres
Publié: (2024)
Vision Superalignment: Weak-to-Strong Generalization for Vision Foundation Models
par: Guo, Jianyuan, et autres
Publié: (2024)
par: Guo, Jianyuan, et autres
Publié: (2024)
Allo{SR}$^2$: Rectifying One-Step Super-Resolution to Stay Real via Allomorphic Generative Flows
par: Wang, Zihan, et autres
Publié: (2026)
par: Wang, Zihan, et autres
Publié: (2026)
One-Step Diffusion-based Real-World Image Super-Resolution with Visual Perception Distillation
par: Wu, Xue, et autres
Publié: (2025)
par: Wu, Xue, et autres
Publié: (2025)
Towards Better & Faster Autoregressive Image Generation: From the Perspective of Entropy
par: Ma, Xiaoxiao, et autres
Publié: (2025)
par: Ma, Xiaoxiao, et autres
Publié: (2025)
Autoregressive Pretraining with Mamba in Vision
par: Ren, Sucheng, et autres
Publié: (2024)
par: Ren, Sucheng, et autres
Publié: (2024)
ImageFolder: Autoregressive Image Generation with Folded Tokens
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
One Step Diffusion-based Super-Resolution with Time-Aware Distillation
par: He, Xiao, et autres
Publié: (2024)
par: He, Xiao, et autres
Publié: (2024)
LottieGPT: Tokenizing Vector Animation for Autoregressive Generation
par: Chen, Junhao, et autres
Publié: (2026)
par: Chen, Junhao, et autres
Publié: (2026)
Scalable Autoregressive Image Generation with Mamba
par: Li, Haopeng, et autres
Publié: (2024)
par: Li, Haopeng, et autres
Publié: (2024)
Distilling Semantic Priors from SAM to Efficient Image Restoration Models
par: Zhang, Quan, et autres
Publié: (2024)
par: Zhang, Quan, et autres
Publié: (2024)
Omni-Dimensional Frequency Learner for General Time Series Analysis
par: Chen, Xianing, et autres
Publié: (2024)
par: Chen, Xianing, et autres
Publié: (2024)
Autoregressive Image Generation with Randomized Parallel Decoding
par: Li, Haopeng, et autres
Publié: (2025)
par: Li, Haopeng, et autres
Publié: (2025)
AntifakePrompt: Prompt-Tuned Vision-Language Models are Fake Image Detectors
par: Chang, You-Ming, et autres
Publié: (2023)
par: Chang, You-Ming, et autres
Publié: (2023)
Mixture of Ranks with Degradation-Aware Routing for One-Step Real-World Image Super-Resolution
par: He, Xiao, et autres
Publié: (2025)
par: He, Xiao, et autres
Publié: (2025)
Align Beyond Prompts: Evaluating World Knowledge Alignment in Text-to-Image Generation
par: Zhang, Wenchao, et autres
Publié: (2025)
par: Zhang, Wenchao, et autres
Publié: (2025)
XQ-GAN: An Open-source Image Tokenization Framework for Autoregressive Generation
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
Dynamic Contrastive Knowledge Distillation for Efficient Image Restoration
par: Zhou, Yunshuai, et autres
Publié: (2024)
par: Zhou, Yunshuai, et autres
Publié: (2024)
Go with Your Gut: Scaling Confidence for Autoregressive Image Generation
par: Chen, Harold Haodong, et autres
Publié: (2025)
par: Chen, Harold Haodong, et autres
Publié: (2025)
ControlAR: Controllable Image Generation with Autoregressive Models
par: Li, Zongming, et autres
Publié: (2024)
par: Li, Zongming, et autres
Publié: (2024)
Conditional Panoramic Image Generation via Masked Autoregressive Modeling
par: Wang, Chaoyang, et autres
Publié: (2025)
par: Wang, Chaoyang, et autres
Publié: (2025)
Auto DragGAN: Editing the Generative Image Manifold in an Autoregressive Manner
par: Cai, Pengxiang, et autres
Publié: (2024)
par: Cai, Pengxiang, et autres
Publié: (2024)
Frequency Autoregressive Image Generation with Continuous Tokens
par: Yu, Hu, et autres
Publié: (2025)
par: Yu, Hu, et autres
Publié: (2025)
Group Critical-token Policy Optimization for Autoregressive Image Generation
par: Zhang, Guohui, et autres
Publié: (2025)
par: Zhang, Guohui, et autres
Publié: (2025)
IRBridge: Solving Image Restoration Bridge with Pre-trained Generative Diffusion Models
par: Wang, Hanting, et autres
Publié: (2025)
par: Wang, Hanting, et autres
Publié: (2025)
LF-ViT: Reducing Spatial Redundancy in Vision Transformer for Efficient Image Recognition
par: Hu, Youbing, et autres
Publié: (2024)
par: Hu, Youbing, et autres
Publié: (2024)
X-Omni: Reinforcement Learning Makes Discrete Autoregressive Image Generative Models Great Again
par: Geng, Zigang, et autres
Publié: (2025)
par: Geng, Zigang, et autres
Publié: (2025)
PromptIQA: Boosting the Performance and Generalization for No-Reference Image Quality Assessment via Prompts
par: Chen, Zewen, et autres
Publié: (2024)
par: Chen, Zewen, et autres
Publié: (2024)
DisEnvisioner: Disentangled and Enriched Visual Prompt for Customized Image Generation
par: He, Jing, et autres
Publié: (2024)
par: He, Jing, et autres
Publié: (2024)
I2VWM: Robust Watermarking for Image to Video Generation
par: Wang, Guanjie, et autres
Publié: (2025)
par: Wang, Guanjie, et autres
Publié: (2025)
D2C: Unlocking the Potential of Continuous Autoregressive Image Generation with Discrete Tokens
par: Wang, Panpan, et autres
Publié: (2025)
par: Wang, Panpan, et autres
Publié: (2025)
Documents similaires
-
LIPT: Latency-aware Image Processing Transformer
par: Qiao, Junbo, et autres
Publié: (2024) -
Data Upcycling Knowledge Distillation for Image Super-Resolution
par: Zhang, Yun, et autres
Publié: (2023) -
IPT-V2: Efficient Image Processing Transformer using Hierarchical Attentions
par: Tu, Zhijun, et autres
Publié: (2024) -
From Sequential to Spatial: Reordering Autoregression for Efficient Visual Generation
par: Wang, Siyang, et autres
Publié: (2025) -
RealSR-R1: Reinforcement Learning for Real-World Image Super-Resolution with Vision-Language Chain-of-Thought
par: Qiao, Junbo, et autres
Publié: (2025)