Autoregressive Image Generation with Masked Bit Modeling
Fuente:
arXiv
Guardado en:
| Autores principales: | Yu, Qihang, Liu, Qihao, He, Ju, Zhang, Xinyang, Liu, Yang, Chen, Liang-Chieh, Chen, Xi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FlowTok: Flowing Seamlessly Across Text and Image Tokens
por: He, Ju, et al.
Publicado: (2025)
por: He, Ju, et al.
Publicado: (2025)
Alleviating Distortion in Image Generation via Multi-Resolution Diffusion Models and Time-Dependent Layer Normalization
por: Liu, Qihao, et al.
Publicado: (2024)
por: Liu, Qihao, et al.
Publicado: (2024)
Randomized Autoregressive Visual Generation
por: Yu, Qihang, et al.
Publicado: (2024)
por: Yu, Qihang, et al.
Publicado: (2024)
ReVision: Refining Video Diffusion with Explicit 3D Motion Modeling
por: Liu, Qihao, et al.
Publicado: (2025)
por: Liu, Qihao, et al.
Publicado: (2025)
MaskBit: Embedding-free Image Generation via Bit Tokens
por: Weber, Mark, et al.
Publicado: (2024)
por: Weber, Mark, et al.
Publicado: (2024)
FlowAR: Scale-wise Autoregressive Image Generation Meets Flow Matching
por: Ren, Sucheng, et al.
Publicado: (2024)
por: Ren, Sucheng, et al.
Publicado: (2024)
Democratizing Text-to-Image Masked Generative Models with Compact Text-Aware One-Dimensional Tokens
por: Kim, Dongwon, et al.
Publicado: (2025)
por: Kim, Dongwon, et al.
Publicado: (2025)
Beyond Next-Token: Next-X Prediction for Autoregressive Visual Generation
por: Ren, Sucheng, et al.
Publicado: (2025)
por: Ren, Sucheng, et al.
Publicado: (2025)
Frequency-Aware Flow Matching for High-Quality Image Generation
por: Ren, Sucheng, et al.
Publicado: (2026)
por: Ren, Sucheng, et al.
Publicado: (2026)
Grouping First, Attending Smartly: Training-Free Acceleration for Diffusion Transformers
por: Ren, Sucheng, et al.
Publicado: (2025)
por: Ren, Sucheng, et al.
Publicado: (2025)
An Image is Worth 32 Tokens for Reconstruction and Generation
por: Yu, Qihang, et al.
Publicado: (2024)
por: Yu, Qihang, et al.
Publicado: (2024)
A Frame is Worth One Token: Efficient Generative World Modeling with Delta Tokens
por: Kerssies, Tommie, et al.
Publicado: (2026)
por: Kerssies, Tommie, et al.
Publicado: (2026)
ViTamin: Designing Scalable Vision Models in the Vision-Language Era
por: Chen, Jieneng, et al.
Publicado: (2024)
por: Chen, Jieneng, et al.
Publicado: (2024)
A Simple Video Segmenter by Tracking Objects Along Axial Trajectories
por: He, Ju, et al.
Publicado: (2023)
por: He, Ju, et al.
Publicado: (2023)
Conditional Panoramic Image Generation via Masked Autoregressive Modeling
por: Wang, Chaoyang, et al.
Publicado: (2025)
por: Wang, Chaoyang, et al.
Publicado: (2025)
BitDance: Scaling Autoregressive Generative Models with Binary Tokens
por: Ai, Yuang, et al.
Publicado: (2026)
por: Ai, Yuang, et al.
Publicado: (2026)
BitMark: Watermarking Bitwise Autoregressive Image Generative Models
por: Kerner, Louis, et al.
Publicado: (2025)
por: Kerner, Louis, et al.
Publicado: (2025)
LlamaSeg: Image Segmentation via Autoregressive Mask Generation
por: Deng, Jiru, et al.
Publicado: (2025)
por: Deng, Jiru, et al.
Publicado: (2025)
MarDini: Masked Autoregressive Diffusion for Video Generation at Scale
por: Liu, Haozhe, et al.
Publicado: (2024)
por: Liu, Haozhe, et al.
Publicado: (2024)
ControlAR: Controllable Image Generation with Autoregressive Models
por: Li, Zongming, et al.
Publicado: (2024)
por: Li, Zongming, et al.
Publicado: (2024)
MARRS: Masked Autoregressive Unit-based Reaction Synthesis
por: Wang, Yabiao, et al.
Publicado: (2025)
por: Wang, Yabiao, et al.
Publicado: (2025)
DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer
por: Wu, Yecheng, et al.
Publicado: (2025)
por: Wu, Yecheng, et al.
Publicado: (2025)
Token Painter: Training-Free Text-Guided Image Inpainting via Mask Autoregressive Models
por: Jiang, Longtao, et al.
Publicado: (2025)
por: Jiang, Longtao, et al.
Publicado: (2025)
COCONut: Modernizing COCO Segmentation
por: Deng, Xueqing, et al.
Publicado: (2024)
por: Deng, Xueqing, et al.
Publicado: (2024)
DCoAR: Deep Concept Injection into Unified Autoregressive Models for Personalized Text-to-Image Generation
por: Wu, Fangtai, et al.
Publicado: (2025)
por: Wu, Fangtai, et al.
Publicado: (2025)
ALTo: Adaptive-Length Tokenizer for Autoregressive Mask Generation
por: Wang, Lingfeng, et al.
Publicado: (2025)
por: Wang, Lingfeng, et al.
Publicado: (2025)
Deeply Supervised Flow-Based Generative Models
por: Shin, Inkyu, et al.
Publicado: (2025)
por: Shin, Inkyu, et al.
Publicado: (2025)
COCONut-PanCap: Joint Panoptic Segmentation and Grounded Captions for Fine-Grained Understanding and Generation
por: Deng, Xueqing, et al.
Publicado: (2025)
por: Deng, Xueqing, et al.
Publicado: (2025)
CM-MaskSD: Cross-Modality Masked Self-Distillation for Referring Image Segmentation
por: Wang, Wenxuan, et al.
Publicado: (2023)
por: Wang, Wenxuan, et al.
Publicado: (2023)
Dictionary-based Framework for Interpretable and Consistent Object Parsing
por: Zhang, Tiezheng, et al.
Publicado: (2025)
por: Zhang, Tiezheng, et al.
Publicado: (2025)
Seg-VAR: Image Segmentation with Visual Autoregressive Modeling
por: Zheng, Rongkun, et al.
Publicado: (2025)
por: Zheng, Rongkun, et al.
Publicado: (2025)
DART: Denoising Autoregressive Transformer for Scalable Text-to-Image Generation
por: Gu, Jiatao, et al.
Publicado: (2024)
por: Gu, Jiatao, et al.
Publicado: (2024)
AR-GRPO: Training Autoregressive Image Generation Models via Reinforcement Learning
por: Yuan, Shihao, et al.
Publicado: (2025)
por: Yuan, Shihao, et al.
Publicado: (2025)
Token-Shuffle: Towards High-Resolution Image Generation with Autoregressive Models
por: Ma, Xu, et al.
Publicado: (2025)
por: Ma, Xu, et al.
Publicado: (2025)
MOODv2: Masked Image Modeling for Out-of-Distribution Detection
por: Li, Jingyao, et al.
Publicado: (2024)
por: Li, Jingyao, et al.
Publicado: (2024)
SJD-PV: Speculative Jacobi Decoding with Phrase Verification for Autoregressive Image Generation
por: Yu, Zhehao, et al.
Publicado: (2026)
por: Yu, Zhehao, et al.
Publicado: (2026)
Masked Autoregressive Model for Weather Forecasting
por: Kim, Doyi, et al.
Publicado: (2024)
por: Kim, Doyi, et al.
Publicado: (2024)
Wavelet-Driven Masked Image Modeling: A Path to Efficient Visual Representation
por: Xiang, Wenzhao, et al.
Publicado: (2025)
por: Xiang, Wenzhao, et al.
Publicado: (2025)
ARGenSeg: Image Segmentation with Autoregressive Image Generation Model
por: Wang, Xiaolong, et al.
Publicado: (2025)
por: Wang, Xiaolong, et al.
Publicado: (2025)
Reinforcement Learning Meets Masked Generative Models: Mask-GRPO for Text-to-Image Generation
por: Luo, Yifu, et al.
Publicado: (2025)
por: Luo, Yifu, et al.
Publicado: (2025)
Ejemplares similares
-
FlowTok: Flowing Seamlessly Across Text and Image Tokens
por: He, Ju, et al.
Publicado: (2025) -
Alleviating Distortion in Image Generation via Multi-Resolution Diffusion Models and Time-Dependent Layer Normalization
por: Liu, Qihao, et al.
Publicado: (2024) -
Randomized Autoregressive Visual Generation
por: Yu, Qihang, et al.
Publicado: (2024) -
ReVision: Refining Video Diffusion with Explicit 3D Motion Modeling
por: Liu, Qihao, et al.
Publicado: (2025) -
MaskBit: Embedding-free Image Generation via Bit Tokens
por: Weber, Mark, et al.
Publicado: (2024)