D2C: Unlocking the Potential of Continuous Autoregressive Image Generation with Discrete Tokens
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Panpan, Niu, Liqiang, Meng, Fandong, Xu, Jinan, Chen, Yufeng, Zhou, Jie |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Continuous Visual Autoregressive Generation via Score Maximization
por: Shao, Chenze, et al.
Publicado: (2025)
por: Shao, Chenze, et al.
Publicado: (2025)
LaCo: Efficient Layer-wise Compression of Visual Tokens for Multimodal Large Language Models
por: Liu, Juntao, et al.
Publicado: (2025)
por: Liu, Juntao, et al.
Publicado: (2025)
MaskMamba: A Hybrid Mamba-Transformer Model for Masked Image Generation
por: Chen, Wenchao, et al.
Publicado: (2024)
por: Chen, Wenchao, et al.
Publicado: (2024)
ArrowGEV: Grounding Events in Video via Learning the Arrow of Time
por: Yu, Fangxu, et al.
Publicado: (2026)
por: Yu, Fangxu, et al.
Publicado: (2026)
Bridging Continuous and Discrete Tokens for Autoregressive Visual Generation
por: Wang, Yuqing, et al.
Publicado: (2025)
por: Wang, Yuqing, et al.
Publicado: (2025)
Frequency Autoregressive Image Generation with Continuous Tokens
por: Yu, Hu, et al.
Publicado: (2025)
por: Yu, Hu, et al.
Publicado: (2025)
Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis
por: Zheng, Peng, et al.
Publicado: (2025)
por: Zheng, Peng, et al.
Publicado: (2025)
NextStep-1: Toward Autoregressive Image Generation with Continuous Tokens at Scale
por: NextStep Team, et al.
Publicado: (2025)
por: NextStep Team, et al.
Publicado: (2025)
InsightTok: Improving Text and Face Fidelity in Discrete Tokenization for Autoregressive Image Generation
por: Yue, Yang, et al.
Publicado: (2026)
por: Yue, Yang, et al.
Publicado: (2026)
LLaVE: Large Language and Vision Embedding Models with Hardness-Weighted Contrastive Learning
por: Lan, Zhibin, et al.
Publicado: (2025)
por: Lan, Zhibin, et al.
Publicado: (2025)
LINA: Linear Autoregressive Image Generative Models with Continuous Tokens
por: Wang, Jiahao, et al.
Publicado: (2026)
por: Wang, Jiahao, et al.
Publicado: (2026)
AVG-LLaVA: An Efficient Large Multimodal Model with Adaptive Visual Granularity
por: Lan, Zhibin, et al.
Publicado: (2024)
por: Lan, Zhibin, et al.
Publicado: (2024)
ImageFolder: Autoregressive Image Generation with Folded Tokens
por: Li, Xiang, et al.
Publicado: (2024)
por: Li, Xiang, et al.
Publicado: (2024)
WeEdit: A Dataset, Benchmark and Glyph-Guided Framework for Text-centric Image Editing
por: Zhang, Hui, et al.
Publicado: (2026)
por: Zhang, Hui, et al.
Publicado: (2026)
Selftok: Discrete Visual Tokens of Autoregression, by Diffusion, and for Reasoning
por: Wang, Bohan, et al.
Publicado: (2025)
por: Wang, Bohan, et al.
Publicado: (2025)
Revolutionizing Text-to-Image Retrieval as Autoregressive Token-to-Voken Generation
por: Li, Yongqi, et al.
Publicado: (2024)
por: Li, Yongqi, et al.
Publicado: (2024)
Autoregressive Sequence Modeling for 3D Medical Image Representation
por: Wang, Siwen, et al.
Publicado: (2024)
por: Wang, Siwen, et al.
Publicado: (2024)
Improving Flexible Image Tokenizers for Autoregressive Image Generation
por: Fu, Zixuan, et al.
Publicado: (2026)
por: Fu, Zixuan, et al.
Publicado: (2026)
Wave-Particle (Continuous-Discrete) Dualistic Visual Tokenization for Unified Understanding and Generation
por: Chen, Yizhu, et al.
Publicado: (2025)
por: Chen, Yizhu, et al.
Publicado: (2025)
ResTok: Learning Hierarchical Residuals in 1D Visual Tokenizers for Autoregressive Image Generation
por: Zhang, Xu, et al.
Publicado: (2026)
por: Zhang, Xu, et al.
Publicado: (2026)
Unified Autoregressive Visual Generation and Understanding with Continuous Tokens
por: Fan, Lijie, et al.
Publicado: (2025)
por: Fan, Lijie, et al.
Publicado: (2025)
Token-Shuffle: Towards High-Resolution Image Generation with Autoregressive Models
por: Ma, Xu, et al.
Publicado: (2025)
por: Ma, Xu, et al.
Publicado: (2025)
$\bf{D^3}$QE: Learning Discrete Distribution Discrepancy-aware Quantization Error for Autoregressive-Generated Image Detection
por: Zhang, Yanran, et al.
Publicado: (2025)
por: Zhang, Yanran, et al.
Publicado: (2025)
XQ-GAN: An Open-source Image Tokenization Framework for Autoregressive Generation
por: Li, Xiang, et al.
Publicado: (2024)
por: Li, Xiang, et al.
Publicado: (2024)
Hyperspherical Latents Improve Continuous-Token Autoregressive Generation
por: Ke, Guolin, et al.
Publicado: (2025)
por: Ke, Guolin, et al.
Publicado: (2025)
End-to-End Autoregressive Image Generation with 1D Semantic Tokenizer
por: Chu, Wenda, et al.
Publicado: (2026)
por: Chu, Wenda, et al.
Publicado: (2026)
Hita: Holistic Tokenizer for Autoregressive Image Generation
por: Zheng, Anlin, et al.
Publicado: (2025)
por: Zheng, Anlin, et al.
Publicado: (2025)
VibeToken: Scaling 1D Image Tokenizers and Autoregressive Models for Dynamic Resolution Generations
por: Patel, Maitreya, et al.
Publicado: (2026)
por: Patel, Maitreya, et al.
Publicado: (2026)
Autoregressive Image Generation Needs Only a Few Lines of Cached Tokens
por: Qin, Ziran, et al.
Publicado: (2025)
por: Qin, Ziran, et al.
Publicado: (2025)
Continuous Speculative Decoding for Autoregressive Image Generation
por: Wang, Zili, et al.
Publicado: (2024)
por: Wang, Zili, et al.
Publicado: (2024)
X-Omni: Reinforcement Learning Makes Discrete Autoregressive Image Generative Models Great Again
por: Geng, Zigang, et al.
Publicado: (2025)
por: Geng, Zigang, et al.
Publicado: (2025)
SJD-VP: Speculative Jacobi Decoding with Verification Prediction for Autoregressive Image Generation
por: Shan, Bingqi, et al.
Publicado: (2026)
por: Shan, Bingqi, et al.
Publicado: (2026)
Fractal Autoregressive Depth Estimation with Continuous Token Diffusion
por: Zhang, Jinchang, et al.
Publicado: (2026)
por: Zhang, Jinchang, et al.
Publicado: (2026)
Fluid: Scaling Autoregressive Text-to-image Generative Models with Continuous Tokens
por: Fan, Lijie, et al.
Publicado: (2024)
por: Fan, Lijie, et al.
Publicado: (2024)
Improving Autoregressive Image Generation through Coarse-to-Fine Token Prediction
por: Guo, Ziyao, et al.
Publicado: (2025)
por: Guo, Ziyao, et al.
Publicado: (2025)
VTBench: Evaluating Visual Tokenizers for Autoregressive Image Generation
por: Lin, Huawei, et al.
Publicado: (2025)
por: Lin, Huawei, et al.
Publicado: (2025)
MergeTok: Unified Continuous and Discrete Visual Tokenization via Token Merging
por: Zhang, Luyuan, et al.
Publicado: (2026)
por: Zhang, Luyuan, et al.
Publicado: (2026)
LottieGPT: Tokenizing Vector Animation for Autoregressive Generation
por: Chen, Junhao, et al.
Publicado: (2026)
por: Chen, Junhao, et al.
Publicado: (2026)
ALTo: Adaptive-Length Tokenizer for Autoregressive Mask Generation
por: Wang, Lingfeng, et al.
Publicado: (2025)
por: Wang, Lingfeng, et al.
Publicado: (2025)
Token Painter: Training-Free Text-Guided Image Inpainting via Mask Autoregressive Models
por: Jiang, Longtao, et al.
Publicado: (2025)
por: Jiang, Longtao, et al.
Publicado: (2025)
Ejemplares similares
-
Continuous Visual Autoregressive Generation via Score Maximization
por: Shao, Chenze, et al.
Publicado: (2025) -
LaCo: Efficient Layer-wise Compression of Visual Tokens for Multimodal Large Language Models
por: Liu, Juntao, et al.
Publicado: (2025) -
MaskMamba: A Hybrid Mamba-Transformer Model for Masked Image Generation
por: Chen, Wenchao, et al.
Publicado: (2024) -
ArrowGEV: Grounding Events in Video via Learning the Arrow of Time
por: Yu, Fangxu, et al.
Publicado: (2026) -
Bridging Continuous and Discrete Tokens for Autoregressive Visual Generation
por: Wang, Yuqing, et al.
Publicado: (2025)