Frequency Autoregressive Image Generation with Continuous Tokens
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yu, Hu, Luo, Hao, Yuan, Hangjie, Rong, Yu, Huang, Jie, Zhao, Feng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
VideoMAR: Autoregressive Video Generatio with Continuous Tokens
par: Yu, Hu, et autres
Publié: (2025)
par: Yu, Hu, et autres
Publié: (2025)
Hita: Holistic Tokenizer for Autoregressive Image Generation
par: Zheng, Anlin, et autres
Publié: (2025)
par: Zheng, Anlin, et autres
Publié: (2025)
FreqPolicy: Frequency Autoregressive Visuomotor Policy with Continuous Tokens
par: Zhong, Yiming, et autres
Publié: (2025)
par: Zhong, Yiming, et autres
Publié: (2025)
Vision Foundation Models as Effective Visual Tokenizers for Autoregressive Image Generation
par: Zheng, Anlin, et autres
Publié: (2025)
par: Zheng, Anlin, et autres
Publié: (2025)
Lumos-1: On Autoregressive Video Generation with Discrete Diffusion from a Unified Model Perspective
par: Yuan, Hangjie, et autres
Publié: (2025)
par: Yuan, Hangjie, et autres
Publié: (2025)
DC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer
par: Wu, Yecheng, et autres
Publié: (2025)
par: Wu, Yecheng, et autres
Publié: (2025)
BitDance: Scaling Autoregressive Generative Models with Binary Tokens
par: Ai, Yuang, et autres
Publié: (2026)
par: Ai, Yuang, et autres
Publié: (2026)
Uncovering the Text Embedding in Text-to-Image Diffusion Models
par: Yu, Hu, et autres
Publié: (2024)
par: Yu, Hu, et autres
Publié: (2024)
High-quality Image Dehazing with Diffusion Model
par: Yu, Hu, et autres
Publié: (2023)
par: Yu, Hu, et autres
Publié: (2023)
VTBench: Evaluating Visual Tokenizers for Autoregressive Image Generation
par: Lin, Huawei, et autres
Publié: (2025)
par: Lin, Huawei, et autres
Publié: (2025)
LARP: Tokenizing Videos with a Learned Autoregressive Generative Prior
par: Wang, Hanyu, et autres
Publié: (2024)
par: Wang, Hanyu, et autres
Publié: (2024)
Revolutionizing Text-to-Image Retrieval as Autoregressive Token-to-Voken Generation
par: Li, Yongqi, et autres
Publié: (2024)
par: Li, Yongqi, et autres
Publié: (2024)
E-CAR: Efficient Continuous Autoregressive Image Generation via Multistage Modeling
par: Yuan, Zhihang, et autres
Publié: (2024)
par: Yuan, Zhihang, et autres
Publié: (2024)
TokenTrim: Inference-Time Token Pruning for Autoregressive Long Video Generation
par: Shaulov, Ariel, et autres
Publié: (2026)
par: Shaulov, Ariel, et autres
Publié: (2026)
TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation
par: Qu, Liao, et autres
Publié: (2024)
par: Qu, Liao, et autres
Publié: (2024)
DualFast: Dual-Speedup Framework for Fast Sampling of Diffusion Models
par: Yu, Hu, et autres
Publié: (2025)
par: Yu, Hu, et autres
Publié: (2025)
$\bf{D^3}$QE: Learning Discrete Distribution Discrepancy-aware Quantization Error for Autoregressive-Generated Image Detection
par: Zhang, Yanran, et autres
Publié: (2025)
par: Zhang, Yanran, et autres
Publié: (2025)
MacTok: Robust Continuous Tokenization for Image Generation
par: Zeng, Hengyu, et autres
Publié: (2026)
par: Zeng, Hengyu, et autres
Publié: (2026)
V2Flow: Unifying Visual Tokenization and Large Language Model Vocabularies for Autoregressive Image Generation
par: Zhang, Guiwei, et autres
Publié: (2025)
par: Zhang, Guiwei, et autres
Publié: (2025)
Revisiting Non-Autoregressive Transformers for Efficient Image Synthesis
par: Ni, Zanlin, et autres
Publié: (2024)
par: Ni, Zanlin, et autres
Publié: (2024)
HiTVideo: Hierarchical Tokenizers for Enhancing Text-to-Video Generation with Autoregressive Large Language Models
par: Zhou, Ziqin, et autres
Publié: (2025)
par: Zhou, Ziqin, et autres
Publié: (2025)
TokenUnify: Scaling Up Autoregressive Pretraining for Neuron Segmentation
par: Chen, Yinda, et autres
Publié: (2024)
par: Chen, Yinda, et autres
Publié: (2024)
Autoregressive Image Diffusion: Generation of Image Sequence and Application in MRI
par: Luo, Guanxiong, et autres
Publié: (2024)
par: Luo, Guanxiong, et autres
Publié: (2024)
CAFe: Unifying Representation and Generation with Contrastive-Autoregressive Finetuning
par: Yu, Hao, et autres
Publié: (2025)
par: Yu, Hao, et autres
Publié: (2025)
Generative Pre-trained Autoregressive Diffusion Transformer
par: Zhang, Yuan, et autres
Publié: (2025)
par: Zhang, Yuan, et autres
Publié: (2025)
DFVEdit: Conditional Delta Flow Vector for Zero-shot Video Editing
par: Cai, Lingling, et autres
Publié: (2025)
par: Cai, Lingling, et autres
Publié: (2025)
Frequency-Aware Token Reduction for Efficient Vision Transformer
par: Lee, Dong-Jae, et autres
Publié: (2025)
par: Lee, Dong-Jae, et autres
Publié: (2025)
Training-Free Watermarking for Autoregressive Image Generation
par: Tong, Yu, et autres
Publié: (2025)
par: Tong, Yu, et autres
Publié: (2025)
BitMark: Watermarking Bitwise Autoregressive Image Generative Models
par: Kerner, Louis, et autres
Publié: (2025)
par: Kerner, Louis, et autres
Publié: (2025)
Locality-aware Parallel Decoding for Efficient Autoregressive Image Generation
par: Zhang, Zhuoyang, et autres
Publié: (2025)
par: Zhang, Zhuoyang, et autres
Publié: (2025)
Nexus-Gen: Unified Image Understanding, Generation, and Editing via Prefilled Autoregression in Shared Embedding Space
par: Zhang, Hong, et autres
Publié: (2025)
par: Zhang, Hong, et autres
Publié: (2025)
ICAS: Detecting Training Data from Autoregressive Image Generative Models
par: Yu, Hongyao, et autres
Publié: (2025)
par: Yu, Hongyao, et autres
Publié: (2025)
Speculative Decoding for Autoregressive Video Generation
par: Hu, Yuezhou, et autres
Publié: (2026)
par: Hu, Yuezhou, et autres
Publié: (2026)
Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction
par: Tian, Keyu, et autres
Publié: (2024)
par: Tian, Keyu, et autres
Publié: (2024)
Unmasking Bias in Diffusion Model Training
par: Yu, Hu, et autres
Publié: (2023)
par: Yu, Hu, et autres
Publié: (2023)
Direction-Aware Diagonal Autoregressive Image Generation
par: Xu, Yijia, et autres
Publié: (2025)
par: Xu, Yijia, et autres
Publié: (2025)
MCIE: Multimodal LLM-Driven Complex Instruction Image Editing with Spatial Guidance
par: Bai, Xuehai, et autres
Publié: (2026)
par: Bai, Xuehai, et autres
Publié: (2026)
Lumos-Nexus: Efficient Frequency Bridging with Homogeneous Latent Space for Video Unified Models
par: Xing, Jiazheng, et autres
Publié: (2026)
par: Xing, Jiazheng, et autres
Publié: (2026)
RandAR: Decoder-only Autoregressive Visual Generation in Random Orders
par: Pang, Ziqi, et autres
Publié: (2024)
par: Pang, Ziqi, et autres
Publié: (2024)
HieraTok: Multi-Scale Visual Tokenizer Improves Image Reconstruction and Generation
par: Chen, Cong, et autres
Publié: (2025)
par: Chen, Cong, et autres
Publié: (2025)
Documents similaires
-
VideoMAR: Autoregressive Video Generatio with Continuous Tokens
par: Yu, Hu, et autres
Publié: (2025) -
Hita: Holistic Tokenizer for Autoregressive Image Generation
par: Zheng, Anlin, et autres
Publié: (2025) -
FreqPolicy: Frequency Autoregressive Visuomotor Policy with Continuous Tokens
par: Zhong, Yiming, et autres
Publié: (2025) -
Vision Foundation Models as Effective Visual Tokenizers for Autoregressive Image Generation
par: Zheng, Anlin, et autres
Publié: (2025) -
Lumos-1: On Autoregressive Video Generation with Discrete Diffusion from a Unified Model Perspective
par: Yuan, Hangjie, et autres
Publié: (2025)