SCALAR: Scale-wise Controllable Visual Autoregressive Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Xu, Ryan, Jin, Dongyang, Bai, Yancheng, Lan, Rui, Duan, Xu, Sun, Lei, Chu, Xiangxiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Semantic Context Matters: Improving Conditioning for Autoregressive Models
di: Jin, Dongyang, et al.
Pubblicazione: (2025)
di: Jin, Dongyang, et al.
Pubblicazione: (2025)
FLUX-Text: A Simple and Advanced Diffusion Transformer Baseline for Scene Text Editing
di: Lan, Rui, et al.
Pubblicazione: (2025)
di: Lan, Rui, et al.
Pubblicazione: (2025)
RAGSR: Regional Attention Guided Diffusion for Image Super-Resolution
di: He, Haodong, et al.
Pubblicazione: (2025)
di: He, Haodong, et al.
Pubblicazione: (2025)
TEXTS-Diff: TEXTS-Aware Diffusion Model for Real-World Text Image Super-Resolution
di: He, Haodong, et al.
Pubblicazione: (2026)
di: He, Haodong, et al.
Pubblicazione: (2026)
Next Token Is Enough: Realistic Image Quality and Aesthetic Scoring with Multimodal Large Language Model
di: Li, Mingxing, et al.
Pubblicazione: (2025)
di: Li, Mingxing, et al.
Pubblicazione: (2025)
Layer-wise Instance Binding for Regional and Occlusion Control in Text-to-Image Diffusion Transformers
di: Chen, Ruidong, et al.
Pubblicazione: (2026)
di: Chen, Ruidong, et al.
Pubblicazione: (2026)
Eevee: Towards Close-up High-resolution Video-based Virtual Try-on
di: Zeng, Jianhao, et al.
Pubblicazione: (2025)
di: Zeng, Jianhao, et al.
Pubblicazione: (2025)
UniVG-R1: Reasoning Guided Universal Visual Grounding with Reinforcement Learning
di: Bai, Sule, et al.
Pubblicazione: (2025)
di: Bai, Sule, et al.
Pubblicazione: (2025)
Efficient Conditional Generation on Scale-based Visual Autoregressive Models
di: Liu, Jiaqi, et al.
Pubblicazione: (2025)
di: Liu, Jiaqi, et al.
Pubblicazione: (2025)
FlowAR: Scale-wise Autoregressive Image Generation Meets Flow Matching
di: Ren, Sucheng, et al.
Pubblicazione: (2024)
di: Ren, Sucheng, et al.
Pubblicazione: (2024)
AMS-KV: Adaptive KV Caching in Multi-Scale Visual Autoregressive Transformers
di: Xu, Boxun, et al.
Pubblicazione: (2025)
di: Xu, Boxun, et al.
Pubblicazione: (2025)
CAR: Controllable Autoregressive Modeling for Visual Generation
di: Yao, Ziyu, et al.
Pubblicazione: (2024)
di: Yao, Ziyu, et al.
Pubblicazione: (2024)
A Training-Free Style-aligned Image Generation with Scale-wise Autoregressive Model
di: Park, Jihun, et al.
Pubblicazione: (2025)
di: Park, Jihun, et al.
Pubblicazione: (2025)
M-VAR: Decoupled Scale-wise Autoregressive Modeling for High-Quality Image Generation
di: Ren, Sucheng, et al.
Pubblicazione: (2024)
di: Ren, Sucheng, et al.
Pubblicazione: (2024)
FingER: Content Aware Fine-grained Evaluation with Reasoning for AI-Generated Videos
di: Chen, Rui, et al.
Pubblicazione: (2025)
di: Chen, Rui, et al.
Pubblicazione: (2025)
SAMPO:Scale-wise Autoregression with Motion PrOmpt for generative world models
di: Wang, Sen, et al.
Pubblicazione: (2025)
di: Wang, Sen, et al.
Pubblicazione: (2025)
From Scale to Speed: Adaptive Test-Time Scaling for Image Editing
di: Qu, Xiangyan, et al.
Pubblicazione: (2026)
di: Qu, Xiangyan, et al.
Pubblicazione: (2026)
Elucidating the SNR-t Bias of Diffusion Probabilistic Models
di: Yu, Meng, et al.
Pubblicazione: (2026)
di: Yu, Meng, et al.
Pubblicazione: (2026)
STAR: Scale-wise Text-conditioned AutoRegressive image generation
di: Ma, Xiaoxiao, et al.
Pubblicazione: (2024)
di: Ma, Xiaoxiao, et al.
Pubblicazione: (2024)
Q-Hawkeye: Reliable Visual Policy Optimization for Image Quality Assessment
di: Xie, Wulin, et al.
Pubblicazione: (2026)
di: Xie, Wulin, et al.
Pubblicazione: (2026)
Rethinking Training Dynamics in Scale-wise Autoregressive Generation
di: Zhou, Gengze, et al.
Pubblicazione: (2025)
di: Zhou, Gengze, et al.
Pubblicazione: (2025)
SSG: Scaled Spatial Guidance for Multi-Scale Visual Autoregressive Generation
di: Shin, Youngwoo, et al.
Pubblicazione: (2026)
di: Shin, Youngwoo, et al.
Pubblicazione: (2026)
Dyn-Adapter: Towards Disentangled Representation for Efficient Visual Recognition
di: Zhang, Yurong, et al.
Pubblicazione: (2024)
di: Zhang, Yurong, et al.
Pubblicazione: (2024)
Visual Enhanced Depth Scaling for Multimodal Latent Reasoning
di: Han, Yudong, et al.
Pubblicazione: (2026)
di: Han, Yudong, et al.
Pubblicazione: (2026)
MSC: Multi-Scale Spatio-Temporal Causal Attention for Autoregressive Video Diffusion
di: Xu, Xunnong, et al.
Pubblicazione: (2024)
di: Xu, Xunnong, et al.
Pubblicazione: (2024)
MVAR: Visual Autoregressive Modeling with Scale and Spatial Markovian Conditioning
di: Zhang, Jinhua, et al.
Pubblicazione: (2025)
di: Zhang, Jinhua, et al.
Pubblicazione: (2025)
LSRS: Latent Scale Rejection Sampling for Visual Autoregressive Modeling
di: Zheng, Hong-Kai, et al.
Pubblicazione: (2025)
di: Zheng, Hong-Kai, et al.
Pubblicazione: (2025)
SoftCFG: Uncertainty-guided Stable Guidance for Visual Autoregressive Model
di: Xu, Dongli, et al.
Pubblicazione: (2025)
di: Xu, Dongli, et al.
Pubblicazione: (2025)
EARTalking: End-to-end GPT-style Autoregressive Talking Head Synthesis with Frame-wise Control
di: Weng, Yuzhe, et al.
Pubblicazione: (2026)
di: Weng, Yuzhe, et al.
Pubblicazione: (2026)
FARTrack: Fast Autoregressive Visual Tracking with High Performance
di: Wang, Guijie, et al.
Pubblicazione: (2026)
di: Wang, Guijie, et al.
Pubblicazione: (2026)
Closing the Safety Gap: Surgical Concept Erasure in Visual Autoregressive Models
di: Zhong, Xinhao, et al.
Pubblicazione: (2025)
di: Zhong, Xinhao, et al.
Pubblicazione: (2025)
ResTok: Learning Hierarchical Residuals in 1D Visual Tokenizers for Autoregressive Image Generation
di: Zhang, Xu, et al.
Pubblicazione: (2026)
di: Zhang, Xu, et al.
Pubblicazione: (2026)
NSARM: Next-Scale Autoregressive Modeling for Robust Real-World Image Super-Resolution
di: Kong, Xiangtao, et al.
Pubblicazione: (2025)
di: Kong, Xiangtao, et al.
Pubblicazione: (2025)
LayerPeeler: Autoregressive Peeling for Layer-wise Image Vectorization
di: Wu, Ronghuan, et al.
Pubblicazione: (2025)
di: Wu, Ronghuan, et al.
Pubblicazione: (2025)
Markovian Scale Prediction: A New Era of Visual Autoregressive Generation
di: Zhang, Yu, et al.
Pubblicazione: (2025)
di: Zhang, Yu, et al.
Pubblicazione: (2025)
Visual Autoregressive Models Beat Diffusion Models on Inference Time Scaling
di: Riise, Erik, et al.
Pubblicazione: (2025)
di: Riise, Erik, et al.
Pubblicazione: (2025)
Next-Scale Autoregressive Models for Text-to-Motion Generation
di: Zheng, Zhiwei, et al.
Pubblicazione: (2026)
di: Zheng, Zhiwei, et al.
Pubblicazione: (2026)
LiteVAR: Compressing Visual Autoregressive Modelling with Efficient Attention and Quantization
di: Xie, Rui, et al.
Pubblicazione: (2024)
di: Xie, Rui, et al.
Pubblicazione: (2024)
USP: Unified Self-Supervised Pretraining for Image Generation and Understanding
di: Chu, Xiangxiang, et al.
Pubblicazione: (2025)
di: Chu, Xiangxiang, et al.
Pubblicazione: (2025)
StyleVAR: Controllable Image Style Transfer via Visual Autoregressive Modeling
di: Jing, Liqi, et al.
Pubblicazione: (2026)
di: Jing, Liqi, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Semantic Context Matters: Improving Conditioning for Autoregressive Models
di: Jin, Dongyang, et al.
Pubblicazione: (2025) -
FLUX-Text: A Simple and Advanced Diffusion Transformer Baseline for Scene Text Editing
di: Lan, Rui, et al.
Pubblicazione: (2025) -
RAGSR: Regional Attention Guided Diffusion for Image Super-Resolution
di: He, Haodong, et al.
Pubblicazione: (2025) -
TEXTS-Diff: TEXTS-Aware Diffusion Model for Real-World Text Image Super-Resolution
di: He, Haodong, et al.
Pubblicazione: (2026) -
Next Token Is Enough: Realistic Image Quality and Aesthetic Scoring with Multimodal Large Language Model
di: Li, Mingxing, et al.
Pubblicazione: (2025)