Direction-Aware Diagonal Autoregressive Image Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Xu, Yijia, Ju, Jianzhong, Luan, Jian, Cui, Jinshi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Hierarchical Concept-to-Appearance Guidance for Multi-Subject Image Generation
por: Xu, Yijia, et al.
Publicado: (2026)
por: Xu, Yijia, et al.
Publicado: (2026)
LLaVA-SG: Leveraging Scene Graphs as Visual Semantic Expression in Vision-Language Models
por: Wang, Jingyi, et al.
Publicado: (2024)
por: Wang, Jingyi, et al.
Publicado: (2024)
Image-Feature Weak-to-Strong Consistency: An Enhanced Paradigm for Semi-Supervised Learning
por: Wu, Zhiyu, et al.
Publicado: (2024)
por: Wu, Zhiyu, et al.
Publicado: (2024)
Fast Autoregressive Video Generation with Diagonal Decoding
por: Ye, Yang, et al.
Publicado: (2025)
por: Ye, Yang, et al.
Publicado: (2025)
Visual Para-Thinker: Divide-and-Conquer Reasoning for Visual Comprehension
por: Xu, Haoran, et al.
Publicado: (2026)
por: Xu, Haoran, et al.
Publicado: (2026)
TimeViper: A Hybrid Mamba-Transformer Vision-Language Model for Efficient Long Video Understanding
por: Xu, Boshen, et al.
Publicado: (2025)
por: Xu, Boshen, et al.
Publicado: (2025)
Motion-Aware Caching for Efficient Autoregressive Video Generation
por: Xu, Jing, et al.
Publicado: (2026)
por: Xu, Jing, et al.
Publicado: (2026)
DySink: Dynamic Frame Sinks for Autoregressive Long Video Generation
por: Ye, Bo, et al.
Publicado: (2026)
por: Ye, Bo, et al.
Publicado: (2026)
StreamPro: From Reactive Perception to Proactive Decision-Making in Streaming Video
por: Li, Ao, et al.
Publicado: (2026)
por: Li, Ao, et al.
Publicado: (2026)
Autoregressive Image Generation with Linear Complexity: A Spatial-Aware Decay Perspective
por: Mao, Yuxin, et al.
Publicado: (2025)
por: Mao, Yuxin, et al.
Publicado: (2025)
Frequency Autoregressive Image Generation with Continuous Tokens
por: Yu, Hu, et al.
Publicado: (2025)
por: Yu, Hu, et al.
Publicado: (2025)
Hita: Holistic Tokenizer for Autoregressive Image Generation
por: Zheng, Anlin, et al.
Publicado: (2025)
por: Zheng, Anlin, et al.
Publicado: (2025)
RandAR: Decoder-only Autoregressive Visual Generation in Random Orders
por: Pang, Ziqi, et al.
Publicado: (2024)
por: Pang, Ziqi, et al.
Publicado: (2024)
Layout-Conditioned Autoregressive Text-to-Image Generation via Structured Masking
por: Zheng, Zirui, et al.
Publicado: (2025)
por: Zheng, Zirui, et al.
Publicado: (2025)
Make It Efficient: Dynamic Sparse Attention for Autoregressive Image Generation
por: Xiang, Xunzhi, et al.
Publicado: (2025)
por: Xiang, Xunzhi, et al.
Publicado: (2025)
BitMark: Watermarking Bitwise Autoregressive Image Generative Models
por: Kerner, Louis, et al.
Publicado: (2025)
por: Kerner, Louis, et al.
Publicado: (2025)
Progress by Pieces: Test-Time Scaling for Autoregressive Image Generation
por: Park, Joonhyung, et al.
Publicado: (2025)
por: Park, Joonhyung, et al.
Publicado: (2025)
Locality-aware Parallel Decoding for Efficient Autoregressive Image Generation
por: Zhang, Zhuoyang, et al.
Publicado: (2025)
por: Zhang, Zhuoyang, et al.
Publicado: (2025)
Orthus: Autoregressive Interleaved Image-Text Generation with Modality-Specific Heads
por: Kou, Siqi, et al.
Publicado: (2024)
por: Kou, Siqi, et al.
Publicado: (2024)
One-Forcing: Towards Stable One-Step Autoregressive Video Generation
por: Feng, Jiaqi, et al.
Publicado: (2026)
por: Feng, Jiaqi, et al.
Publicado: (2026)
Improving Chain-of-Thought Efficiency for Autoregressive Image Generation
por: Gu, Zeqi, et al.
Publicado: (2025)
por: Gu, Zeqi, et al.
Publicado: (2025)
Adversarial Error Correction for Visual Autoregressive Generation
por: Bi, Ligong, et al.
Publicado: (2026)
por: Bi, Ligong, et al.
Publicado: (2026)
Training-Free Text-Guided Image Editing with Visual Autoregressive Model
por: Wang, Yufei, et al.
Publicado: (2025)
por: Wang, Yufei, et al.
Publicado: (2025)
VTBench: Evaluating Visual Tokenizers for Autoregressive Image Generation
por: Lin, Huawei, et al.
Publicado: (2025)
por: Lin, Huawei, et al.
Publicado: (2025)
Vision Foundation Models as Effective Visual Tokenizers for Autoregressive Image Generation
por: Zheng, Anlin, et al.
Publicado: (2025)
por: Zheng, Anlin, et al.
Publicado: (2025)
RestoreVAR: Visual Autoregressive Generation for All-in-One Image Restoration
por: Rajagopalan, Sudarshan, et al.
Publicado: (2025)
por: Rajagopalan, Sudarshan, et al.
Publicado: (2025)
Nexus-Gen: Unified Image Understanding, Generation, and Editing via Prefilled Autoregression in Shared Embedding Space
por: Zhang, Hong, et al.
Publicado: (2025)
por: Zhang, Hong, et al.
Publicado: (2025)
Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction
por: Tian, Keyu, et al.
Publicado: (2024)
por: Tian, Keyu, et al.
Publicado: (2024)
On the Robustness of Watermarking for Autoregressive Image Generation
por: Müller, Andreas, et al.
Publicado: (2026)
por: Müller, Andreas, et al.
Publicado: (2026)
Think-Clip-Sample: Slow-Fast Frame Selection for Video Understanding
por: Tan, Wenhui, et al.
Publicado: (2026)
por: Tan, Wenhui, et al.
Publicado: (2026)
Stabilize the Latent Space for Image Autoregressive Modeling: A Unified Perspective
por: Zhu, Yongxin, et al.
Publicado: (2024)
por: Zhu, Yongxin, et al.
Publicado: (2024)
Moving Beyond Diffusion: Hierarchy-to-Hierarchy Autoregression for fMRI-to-Image Reconstruction
por: Zhang, Xu, et al.
Publicado: (2025)
por: Zhang, Xu, et al.
Publicado: (2025)
MAGI-1: Autoregressive Video Generation at Scale
por: ai, Sand., et al.
Publicado: (2025)
por: ai, Sand., et al.
Publicado: (2025)
DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer
por: Wu, Yecheng, et al.
Publicado: (2025)
por: Wu, Yecheng, et al.
Publicado: (2025)
CtrlNeRF: The Generative Neural Radiation Fields for the Controllable Synthesis of High-fidelity 3D-Aware Images
por: Liu, Jian, et al.
Publicado: (2024)
por: Liu, Jian, et al.
Publicado: (2024)
Autoregressive Omni-Aware Outpainting for Open-Vocabulary 360-Degree Image Generation
por: Lu, Zhuqiang, et al.
Publicado: (2023)
por: Lu, Zhuqiang, et al.
Publicado: (2023)
Revolutionizing Text-to-Image Retrieval as Autoregressive Token-to-Voken Generation
por: Li, Yongqi, et al.
Publicado: (2024)
por: Li, Yongqi, et al.
Publicado: (2024)
Next Block Prediction: Video Generation via Semi-Autoregressive Modeling
por: Ren, Shuhuai, et al.
Publicado: (2025)
por: Ren, Shuhuai, et al.
Publicado: (2025)
Spanning Tree Autoregressive Visual Generation
por: Lee, Sangkyu, et al.
Publicado: (2025)
por: Lee, Sangkyu, et al.
Publicado: (2025)
Speculative Decoding for Autoregressive Video Generation
por: Hu, Yuezhou, et al.
Publicado: (2026)
por: Hu, Yuezhou, et al.
Publicado: (2026)
Ejemplares similares
-
Hierarchical Concept-to-Appearance Guidance for Multi-Subject Image Generation
por: Xu, Yijia, et al.
Publicado: (2026) -
LLaVA-SG: Leveraging Scene Graphs as Visual Semantic Expression in Vision-Language Models
por: Wang, Jingyi, et al.
Publicado: (2024) -
Image-Feature Weak-to-Strong Consistency: An Enhanced Paradigm for Semi-Supervised Learning
por: Wu, Zhiyu, et al.
Publicado: (2024) -
Fast Autoregressive Video Generation with Diagonal Decoding
por: Ye, Yang, et al.
Publicado: (2025) -
Visual Para-Thinker: Divide-and-Conquer Reasoning for Visual Comprehension
por: Xu, Haoran, et al.
Publicado: (2026)