Scalable Autoregressive Image Generation with Mamba
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Haopeng, Yang, Jinyue, Wang, Kexin, Qiu, Xuerui, Chou, Yuhong, Li, Xin, Li, Guoqi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Autoregressive Image Generation with Randomized Parallel Decoding
di: Li, Haopeng, et al.
Pubblicazione: (2025)
di: Li, Haopeng, et al.
Pubblicazione: (2025)
RSC-SNN: Exploring the Trade-off Between Adversarial Robustness and Accuracy in Spiking Neural Networks via Randomized Smoothing Coding
di: Wu, Keming, et al.
Pubblicazione: (2024)
di: Wu, Keming, et al.
Pubblicazione: (2024)
Efficient 3D Recognition with Event-driven Spike Sparse Convolution
di: Qiu, Xuerui, et al.
Pubblicazione: (2024)
di: Qiu, Xuerui, et al.
Pubblicazione: (2024)
Scaling Spike-driven Transformer with Efficient Spike Firing Approximation Training
di: Yao, Man, et al.
Pubblicazione: (2024)
di: Yao, Man, et al.
Pubblicazione: (2024)
VideoMAP: Toward Scalable Mamba-based Video Autoregressive Pretraining
di: Liu, Yunze, et al.
Pubblicazione: (2025)
di: Liu, Yunze, et al.
Pubblicazione: (2025)
Safe-VAR: Safe Visual Autoregressive Model for Text-to-Image Generative Watermarking
di: Wang, Ziyi, et al.
Pubblicazione: (2025)
di: Wang, Ziyi, et al.
Pubblicazione: (2025)
Autoregressive Pretraining with Mamba in Vision
di: Ren, Sucheng, et al.
Pubblicazione: (2024)
di: Ren, Sucheng, et al.
Pubblicazione: (2024)
ImageFolder: Autoregressive Image Generation with Folded Tokens
di: Li, Xiang, et al.
Pubblicazione: (2024)
di: Li, Xiang, et al.
Pubblicazione: (2024)
MoSa: Motion Generation with Scalable Autoregressive Modeling
di: Liu, Mengyuan, et al.
Pubblicazione: (2025)
di: Liu, Mengyuan, et al.
Pubblicazione: (2025)
Continuous Speculative Decoding for Autoregressive Image Generation
di: Wang, Zili, et al.
Pubblicazione: (2024)
di: Wang, Zili, et al.
Pubblicazione: (2024)
SVL: Spike-based Vision-language Pretraining for Efficient 3D Open-world Understanding
di: Qiu, Xuerui, et al.
Pubblicazione: (2025)
di: Qiu, Xuerui, et al.
Pubblicazione: (2025)
MedVAR: Towards Scalable and Efficient Medical Image Generation via Next-scale Autoregressive Prediction
di: He, Zhicheng, et al.
Pubblicazione: (2026)
di: He, Zhicheng, et al.
Pubblicazione: (2026)
Beyond Words: Advancing Long-Text Image Generation via Multimodal Autoregressive Models
di: Wang, Alex Jinpeng, et al.
Pubblicazione: (2025)
di: Wang, Alex Jinpeng, et al.
Pubblicazione: (2025)
Autoregressive Image Generation without Vector Quantization
di: Li, Tianhong, et al.
Pubblicazione: (2024)
di: Li, Tianhong, et al.
Pubblicazione: (2024)
XQ-GAN: An Open-source Image Tokenization Framework for Autoregressive Generation
di: Li, Xiang, et al.
Pubblicazione: (2024)
di: Li, Xiang, et al.
Pubblicazione: (2024)
Scalable Autoregressive Monocular Depth Estimation
di: Wang, Jinhong, et al.
Pubblicazione: (2024)
di: Wang, Jinhong, et al.
Pubblicazione: (2024)
RemoteDet-Mamba: A Hybrid Mamba-CNN Network for Multi-modal Object Detection in Remote Sensing Images
di: Ren, Kejun, et al.
Pubblicazione: (2024)
di: Ren, Kejun, et al.
Pubblicazione: (2024)
Autoregressive Model Beats Diffusion: Llama for Scalable Image Generation
di: Sun, Peize, et al.
Pubblicazione: (2024)
di: Sun, Peize, et al.
Pubblicazione: (2024)
DiverseAR: Boosting Diversity in Bitwise Autoregressive Image Generation
di: Yang, Ying, et al.
Pubblicazione: (2025)
di: Yang, Ying, et al.
Pubblicazione: (2025)
USEMA: a Scalable Efficient Mamba Like Attention for Medical Image Segmentation
di: Dayag, Elisha, et al.
Pubblicazione: (2026)
di: Dayag, Elisha, et al.
Pubblicazione: (2026)
STAGE: Stable and Generalizable GRPO for Autoregressive Image Generation
di: Ma, Xiaoxiao, et al.
Pubblicazione: (2025)
di: Ma, Xiaoxiao, et al.
Pubblicazione: (2025)
Hi-Mamba: Hierarchical Mamba for Efficient Image Super-Resolution
di: Qiao, Junbo, et al.
Pubblicazione: (2024)
di: Qiao, Junbo, et al.
Pubblicazione: (2024)
Causal Forcing++: Scalable Few-Step Autoregressive Diffusion Distillation for Real-Time Interactive Video Generation
di: Zhao, Min, et al.
Pubblicazione: (2026)
di: Zhao, Min, et al.
Pubblicazione: (2026)
LlamaSeg: Image Segmentation via Autoregressive Mask Generation
di: Deng, Jiru, et al.
Pubblicazione: (2025)
di: Deng, Jiru, et al.
Pubblicazione: (2025)
MambaHSI: Spatial-Spectral Mamba for Hyperspectral Image Classification
di: Li, Yapeng, et al.
Pubblicazione: (2025)
di: Li, Yapeng, et al.
Pubblicazione: (2025)
Towards Unifying Understanding and Generation in the Era of Vision Foundation Models: A Survey from the Autoregression Perspective
di: Xie, Shenghao, et al.
Pubblicazione: (2024)
di: Xie, Shenghao, et al.
Pubblicazione: (2024)
Autoregressive Image Generation with Vision Full-view Prompt
di: Cai, Miaomiao, et al.
Pubblicazione: (2025)
di: Cai, Miaomiao, et al.
Pubblicazione: (2025)
SpectralMamba: Efficient Mamba for Hyperspectral Image Classification
di: Yao, Jing, et al.
Pubblicazione: (2024)
di: Yao, Jing, et al.
Pubblicazione: (2024)
DART: Denoising Autoregressive Transformer for Scalable Text-to-Image Generation
di: Gu, Jiatao, et al.
Pubblicazione: (2024)
di: Gu, Jiatao, et al.
Pubblicazione: (2024)
ControlAR: Controllable Image Generation with Autoregressive Models
di: Li, Zongming, et al.
Pubblicazione: (2024)
di: Li, Zongming, et al.
Pubblicazione: (2024)
DreamVAR: Taming Reinforced Visual Autoregressive Model for High-Fidelity Subject-Driven Image Generation
di: Jiang, Xin, et al.
Pubblicazione: (2026)
di: Jiang, Xin, et al.
Pubblicazione: (2026)
Conditional Panoramic Image Generation via Masked Autoregressive Modeling
di: Wang, Chaoyang, et al.
Pubblicazione: (2025)
di: Wang, Chaoyang, et al.
Pubblicazione: (2025)
Scalable Pre-training of Large Autoregressive Image Models
di: El-Nouby, Alaaeldin, et al.
Pubblicazione: (2024)
di: El-Nouby, Alaaeldin, et al.
Pubblicazione: (2024)
MambaCSR: Dual-Interleaved Scanning for Compressed Image Super-Resolution With SSMs
di: Ren, Yulin, et al.
Pubblicazione: (2024)
di: Ren, Yulin, et al.
Pubblicazione: (2024)
Semantic-Aware Prefix Learning for Token-Efficient Image Generation
di: Li, Qingfeng, et al.
Pubblicazione: (2026)
di: Li, Qingfeng, et al.
Pubblicazione: (2026)
Rectification Reimagined: A Unified Mamba Model for Image Correction and Rectangling with Prompts
di: Qiu, Linwei, et al.
Pubblicazione: (2025)
di: Qiu, Linwei, et al.
Pubblicazione: (2025)
Vision Mamba Distillation for Low-resolution Fine-grained Image Classification
di: Chen, Yao, et al.
Pubblicazione: (2024)
di: Chen, Yao, et al.
Pubblicazione: (2024)
Context-Aware Autoregressive Models for Multi-Conditional Image Generation
di: Chen, Yixiao, et al.
Pubblicazione: (2025)
di: Chen, Yixiao, et al.
Pubblicazione: (2025)
MambaDFuse: A Mamba-based Dual-phase Model for Multi-modality Image Fusion
di: Li, Zhe, et al.
Pubblicazione: (2024)
di: Li, Zhe, et al.
Pubblicazione: (2024)
MotionCharacter: Fine-Grained Motion Controllable Human Video Generation
di: Fang, Haopeng, et al.
Pubblicazione: (2024)
di: Fang, Haopeng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Autoregressive Image Generation with Randomized Parallel Decoding
di: Li, Haopeng, et al.
Pubblicazione: (2025) -
RSC-SNN: Exploring the Trade-off Between Adversarial Robustness and Accuracy in Spiking Neural Networks via Randomized Smoothing Coding
di: Wu, Keming, et al.
Pubblicazione: (2024) -
Efficient 3D Recognition with Event-driven Spike Sparse Convolution
di: Qiu, Xuerui, et al.
Pubblicazione: (2024) -
Scaling Spike-driven Transformer with Efficient Spike Firing Approximation Training
di: Yao, Man, et al.
Pubblicazione: (2024) -
VideoMAP: Toward Scalable Mamba-based Video Autoregressive Pretraining
di: Liu, Yunze, et al.
Pubblicazione: (2025)