Salvato in:
| Autori principali: | Kumbong, Hermann, Liu, Xian, Lin, Tsung-Yi, Liu, Ming-Yu, Liu, Xihui, Liu, Ziwei, Fu, Daniel Y., Ré, Christopher, Romero, David W. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2506.04421 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Personalized Text-to-Image Generation with Auto-Regressive Models
di: Sun, Kaiyue, et al.
Pubblicazione: (2025)
di: Sun, Kaiyue, et al.
Pubblicazione: (2025)
The Hedgehog & the Porcupine: Expressive Linear Attentions with Softmax Mimicry
di: Zhang, Michael, et al.
Pubblicazione: (2024)
di: Zhang, Michael, et al.
Pubblicazione: (2024)
HMAR: Hierarchical Masked Attention for Multi-Behaviour Recommendation
di: Elsayed, Shereen, et al.
Pubblicazione: (2024)
di: Elsayed, Shereen, et al.
Pubblicazione: (2024)
Resurrect Mask AutoRegressive Modeling for Efficient and Scalable Image Generation
di: Xin, Yi, et al.
Pubblicazione: (2025)
di: Xin, Yi, et al.
Pubblicazione: (2025)
LowRA: Accurate and Efficient LoRA Fine-Tuning of LLMs under 2 Bits
di: Zhou, Zikai, et al.
Pubblicazione: (2025)
di: Zhou, Zikai, et al.
Pubblicazione: (2025)
Accelerating Auto-regressive Text-to-Image Generation with Training-free Speculative Jacobi Decoding
di: Teng, Yao, et al.
Pubblicazione: (2024)
di: Teng, Yao, et al.
Pubblicazione: (2024)
HumanGaussian: Text-Driven 3D Human Generation with Gaussian Splatting
di: Liu, Xian, et al.
Pubblicazione: (2023)
di: Liu, Xian, et al.
Pubblicazione: (2023)
Meshtron: High-Fidelity, Artist-Like 3D Mesh Generation at Scale
di: Hao, Zekun, et al.
Pubblicazione: (2024)
di: Hao, Zekun, et al.
Pubblicazione: (2024)
HMAR: Hierarchical Modality-Aware Expert and Dynamic Routing Medical Image Retrieval Architecture
di: Yuan, Aojie
Pubblicazione: (2026)
di: Yuan, Aojie
Pubblicazione: (2026)
T2I-ReasonBench: Benchmarking Reasoning-Informed Text-to-Image Generation
di: Sun, Kaiyue, et al.
Pubblicazione: (2025)
di: Sun, Kaiyue, et al.
Pubblicazione: (2025)
SJD++: Improved Speculative Jacobi Decoding for Training-free Acceleration of Discrete Auto-regressive Text-to-Image Generation
di: Teng, Yao, et al.
Pubblicazione: (2025)
di: Teng, Yao, et al.
Pubblicazione: (2025)
TTS-VAR: A Test-Time Scaling Framework for Visual Auto-Regressive Generation
di: Chen, Zhekai, et al.
Pubblicazione: (2025)
di: Chen, Zhekai, et al.
Pubblicazione: (2025)
HyperHuman: Hyper-Realistic Human Generation with Latent Structural Diffusion
di: Liu, Xian, et al.
Pubblicazione: (2023)
di: Liu, Xian, et al.
Pubblicazione: (2023)
EdgeRunner: Auto-regressive Auto-encoder for Artistic Mesh Generation
di: Tang, Jiaxiang, et al.
Pubblicazione: (2024)
di: Tang, Jiaxiang, et al.
Pubblicazione: (2024)
Auto-Regressively Generating Multi-View Consistent Images
di: Hu, JiaKui, et al.
Pubblicazione: (2025)
di: Hu, JiaKui, et al.
Pubblicazione: (2025)
Infinity: Scaling Bitwise AutoRegressive Modeling for High-Resolution Image Synthesis
di: Han, Jian, et al.
Pubblicazione: (2024)
di: Han, Jian, et al.
Pubblicazione: (2024)
Genuine-Focused Learning using Mask AutoEncoder for Generalized Fake Audio Detection
di: Wang, Xiaopeng, et al.
Pubblicazione: (2024)
di: Wang, Xiaopeng, et al.
Pubblicazione: (2024)
Learning Interpretable Representations Leads to Semantically Faithful EEG-to-Text Generation
di: Liu, Xiaozhao, et al.
Pubblicazione: (2025)
di: Liu, Xiaozhao, et al.
Pubblicazione: (2025)
Auto-Regressive Masked Diffusion Models
di: Karami, Mahdi, et al.
Pubblicazione: (2026)
di: Karami, Mahdi, et al.
Pubblicazione: (2026)
Adaptive 1D Video Diffusion Autoencoder
di: Teng, Yao, et al.
Pubblicazione: (2026)
di: Teng, Yao, et al.
Pubblicazione: (2026)
S ee 4D: Pose‐Free 4D Generation via Auto‐Regressive Video Inpainting
di: Dongyue Lu, et al.
Pubblicazione: (2026)
di: Dongyue Lu, et al.
Pubblicazione: (2026)
See4D: Pose-Free 4D Generation via Auto-Regressive Video Inpainting
di: Lu, Dongyue, et al.
Pubblicazione: (2025)
di: Lu, Dongyue, et al.
Pubblicazione: (2025)
Exploiting Hierarchical Interactions for Protein Surface Learning
di: Lin, Yiqun, et al.
Pubblicazione: (2024)
di: Lin, Yiqun, et al.
Pubblicazione: (2024)
GenArtist: Multimodal LLM as an Agent for Unified Image Generation and Editing
di: Wang, Zhenyu, et al.
Pubblicazione: (2024)
di: Wang, Zhenyu, et al.
Pubblicazione: (2024)
MARS: Mixture of Auto-Regressive Models for Fine-grained Text-to-image Synthesis
di: He, Wanggui, et al.
Pubblicazione: (2024)
di: He, Wanggui, et al.
Pubblicazione: (2024)
MACRO: Advancing Multi-Reference Image Generation with Structured Long-Context Data
di: Chen, Zhekai, et al.
Pubblicazione: (2026)
di: Chen, Zhekai, et al.
Pubblicazione: (2026)
Reprojection Errors as Prompts for Efficient Scene Coordinate Regression
di: Liu, Ting-Ru, et al.
Pubblicazione: (2024)
di: Liu, Ting-Ru, et al.
Pubblicazione: (2024)
T2V-CompBench: A Comprehensive Benchmark for Compositional Text-to-video Generation
di: Sun, Kaiyue, et al.
Pubblicazione: (2024)
di: Sun, Kaiyue, et al.
Pubblicazione: (2024)
Hierarchical Information Flow for Generalized Efficient Image Restoration
di: Li, Yawei, et al.
Pubblicazione: (2024)
di: Li, Yawei, et al.
Pubblicazione: (2024)
GenDoP: Auto-regressive Camera Trajectory Generation as a Director of Photography
di: Zhang, Mengchen, et al.
Pubblicazione: (2025)
di: Zhang, Mengchen, et al.
Pubblicazione: (2025)
AR-Diffusion: Asynchronous Video Generation with Auto-Regressive Diffusion
di: Sun, Mingzhen, et al.
Pubblicazione: (2025)
di: Sun, Mingzhen, et al.
Pubblicazione: (2025)
AutoVP: An Automated Visual Prompting Framework and Benchmark
di: Tsao, Hsi-Ai, et al.
Pubblicazione: (2023)
di: Tsao, Hsi-Ai, et al.
Pubblicazione: (2023)
TC4D: Trajectory-Conditioned Text-to-4D Generation
di: Bahmani, Sherwin, et al.
Pubblicazione: (2024)
di: Bahmani, Sherwin, et al.
Pubblicazione: (2024)
EVATok: Adaptive Length Video Tokenization for Efficient Visual Autoregressive Generation
di: Xiong, Tianwei, et al.
Pubblicazione: (2026)
di: Xiong, Tianwei, et al.
Pubblicazione: (2026)
InfinityStar: Unified Spacetime AutoRegressive Modeling for Visual Generation
di: Liu, Jinlai, et al.
Pubblicazione: (2025)
di: Liu, Jinlai, et al.
Pubblicazione: (2025)
Auto-Regressive Diffusion for Generating 3D Human-Object Interactions
di: Geng, Zichen, et al.
Pubblicazione: (2025)
di: Geng, Zichen, et al.
Pubblicazione: (2025)
Masked Generative Transformer Is What You Need for Image Editing
di: Chow, Wei, et al.
Pubblicazione: (2026)
di: Chow, Wei, et al.
Pubblicazione: (2026)
Deep Lossless Image Compression via Masked Sampling and Coarse-to-Fine Auto-Regression
di: Li, Tiantian, et al.
Pubblicazione: (2025)
di: Li, Tiantian, et al.
Pubblicazione: (2025)
Sample- and Parameter-Efficient Auto-Regressive Image Models
di: Amrani, Elad, et al.
Pubblicazione: (2024)
di: Amrani, Elad, et al.
Pubblicazione: (2024)
Lumina-mGPT 2.0: Stand-Alone AutoRegressive Image Modeling
di: Xin, Yi, et al.
Pubblicazione: (2025)
di: Xin, Yi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Personalized Text-to-Image Generation with Auto-Regressive Models
di: Sun, Kaiyue, et al.
Pubblicazione: (2025) -
The Hedgehog & the Porcupine: Expressive Linear Attentions with Softmax Mimicry
di: Zhang, Michael, et al.
Pubblicazione: (2024) -
HMAR: Hierarchical Masked Attention for Multi-Behaviour Recommendation
di: Elsayed, Shereen, et al.
Pubblicazione: (2024) -
Resurrect Mask AutoRegressive Modeling for Efficient and Scalable Image Generation
di: Xin, Yi, et al.
Pubblicazione: (2025) -
LowRA: Accurate and Efficient LoRA Fine-Tuning of LLMs under 2 Bits
di: Zhou, Zikai, et al.
Pubblicazione: (2025)