Visual Implicit Autoregressive Modeling
Fuente:
arXiv
Salvato in:
| Autori principali: | Jiang, Pengfei, Luo, Jixiang, Lin, Luxi, Huang, Zhaohong, Li, Xuelong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SmartFreeEdit: Mask-Free Spatial-Aware Image Editing with Complex Instruction Understanding
di: Sun, Qianqian, et al.
Pubblicazione: (2025)
di: Sun, Qianqian, et al.
Pubblicazione: (2025)
TeleMem: Building Long-Term and Multimodal Memory for Agentic AI
di: Chen, Chunliang, et al.
Pubblicazione: (2025)
di: Chen, Chunliang, et al.
Pubblicazione: (2025)
Boosting Multimodal Large Language Models with Visual Tokens Withdrawal for Rapid Inference
di: Lin, Zhihang, et al.
Pubblicazione: (2024)
di: Lin, Zhihang, et al.
Pubblicazione: (2024)
CAR: Controllable Autoregressive Modeling for Visual Generation
di: Yao, Ziyu, et al.
Pubblicazione: (2024)
di: Yao, Ziyu, et al.
Pubblicazione: (2024)
Vehicle Perception from Satellite
di: Zhao, Bin, et al.
Pubblicazione: (2024)
di: Zhao, Bin, et al.
Pubblicazione: (2024)
Progressive Supernet Training for Efficient Visual Autoregressive Modeling
di: Chen, Xiaoyue, et al.
Pubblicazione: (2025)
di: Chen, Xiaoyue, et al.
Pubblicazione: (2025)
Drift-AR: Single-Step Visual Autoregressive Generation via Anti-Symmetric Drifting
di: Zou, Zhen, et al.
Pubblicazione: (2026)
di: Zou, Zhen, et al.
Pubblicazione: (2026)
Depth Adaptive Efficient Visual Autoregressive Modeling
di: Li, Chunliang, et al.
Pubblicazione: (2026)
di: Li, Chunliang, et al.
Pubblicazione: (2026)
TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning
di: Xie, Jingjing, et al.
Pubblicazione: (2024)
di: Xie, Jingjing, et al.
Pubblicazione: (2024)
Customize Your Visual Autoregressive Recipe with Set Autoregressive Modeling
di: Liu, Wenze, et al.
Pubblicazione: (2024)
di: Liu, Wenze, et al.
Pubblicazione: (2024)
Efficient Conditional Generation on Scale-based Visual Autoregressive Models
di: Liu, Jiaqi, et al.
Pubblicazione: (2025)
di: Liu, Jiaqi, et al.
Pubblicazione: (2025)
FlexVAR: Flexible Visual Autoregressive Modeling without Residual Prediction
di: Jiao, Siyu, et al.
Pubblicazione: (2025)
di: Jiao, Siyu, et al.
Pubblicazione: (2025)
Rethinking Learned Image Compression: Context is All You Need
di: Luo, Jixiang
Pubblicazione: (2024)
di: Luo, Jixiang
Pubblicazione: (2024)
ID-Selection: Importance-Diversity Based Visual Token Selection for Efficient LVLM Inference
di: Huang, Zhaohong, et al.
Pubblicazione: (2026)
di: Huang, Zhaohong, et al.
Pubblicazione: (2026)
Mirai: Autoregressive Visual Generation Needs Foresight
di: Yu, Yonghao, et al.
Pubblicazione: (2026)
di: Yu, Yonghao, et al.
Pubblicazione: (2026)
Exploring Implicit Visual Misunderstandings in Multimodal Large Language Models through Attention Analysis
di: Wang, Pengfei, et al.
Pubblicazione: (2025)
di: Wang, Pengfei, et al.
Pubblicazione: (2025)
Head-Aware KV Cache Compression for Efficient Visual Autoregressive Modeling
di: Qin, Ziran, et al.
Pubblicazione: (2025)
di: Qin, Ziran, et al.
Pubblicazione: (2025)
ToProVAR: Efficient Visual Autoregressive Modeling via Tri-Dimensional Entropy-Aware Semantic Analysis and Sparsity Optimization
di: Chen, Jiayu, et al.
Pubblicazione: (2026)
di: Chen, Jiayu, et al.
Pubblicazione: (2026)
Parallelized Autoregressive Visual Generation
di: Wang, Yuqing, et al.
Pubblicazione: (2024)
di: Wang, Yuqing, et al.
Pubblicazione: (2024)
Visual Self-Refinement for Autoregressive Models
di: Wang, Jiamian, et al.
Pubblicazione: (2025)
di: Wang, Jiamian, et al.
Pubblicazione: (2025)
Implicit Event-RGBD Neural SLAM
di: Qu, Delin, et al.
Pubblicazione: (2023)
di: Qu, Delin, et al.
Pubblicazione: (2023)
Motion-Aware Video Frame Interpolation
di: Han, Pengfei, et al.
Pubblicazione: (2024)
di: Han, Pengfei, et al.
Pubblicazione: (2024)
LSRS: Latent Scale Rejection Sampling for Visual Autoregressive Modeling
di: Zheng, Hong-Kai, et al.
Pubblicazione: (2025)
di: Zheng, Hong-Kai, et al.
Pubblicazione: (2025)
Beyond Static Artifacts: A Forensic Benchmark for Video Deepfake Reasoning in Vision Language Models
di: Gu, Zheyuan, et al.
Pubblicazione: (2026)
di: Gu, Zheyuan, et al.
Pubblicazione: (2026)
Compressible and Searchable: AI-native Multi-Modal Retrieval System with Learned Image Compression
di: Luo, Jixiang
Pubblicazione: (2024)
di: Luo, Jixiang
Pubblicazione: (2024)
Visual Autoregressive Modeling for Image Super-Resolution
di: Qu, Yunpeng, et al.
Pubblicazione: (2025)
di: Qu, Yunpeng, et al.
Pubblicazione: (2025)
Dynamic Mixture-of-Experts for Visual Autoregressive Model
di: Vincenti, Jort, et al.
Pubblicazione: (2025)
di: Vincenti, Jort, et al.
Pubblicazione: (2025)
Visual Autoregressive Modelling for Monocular Depth Estimation
di: El-Ghoussani, Amir, et al.
Pubblicazione: (2025)
di: El-Ghoussani, Amir, et al.
Pubblicazione: (2025)
Seeing What Matters: Visual Preference Policy Optimization for Visual Generation
di: Ni, Ziqi, et al.
Pubblicazione: (2025)
di: Ni, Ziqi, et al.
Pubblicazione: (2025)
EVATok: Adaptive Length Video Tokenization for Efficient Visual Autoregressive Generation
di: Xiong, Tianwei, et al.
Pubblicazione: (2026)
di: Xiong, Tianwei, et al.
Pubblicazione: (2026)
VGGT-World: Transforming VGGT into an Autoregressive Geometry World Model
di: Sun, Xiangyu, et al.
Pubblicazione: (2026)
di: Sun, Xiangyu, et al.
Pubblicazione: (2026)
Next Patch Prediction for Autoregressive Visual Generation
di: Pang, Yatian, et al.
Pubblicazione: (2024)
di: Pang, Yatian, et al.
Pubblicazione: (2024)
VarAD: Lightweight High-Resolution Image Anomaly Detection via Visual Autoregressive Modeling
di: Cao, Yunkang, et al.
Pubblicazione: (2024)
di: Cao, Yunkang, et al.
Pubblicazione: (2024)
FasterVAR: Plug-and-Play Acceleration for Visual Autoregressive Models
di: Li, Senmao, et al.
Pubblicazione: (2025)
di: Li, Senmao, et al.
Pubblicazione: (2025)
ControlVAR: Exploring Controllable Visual Autoregressive Modeling
di: Li, Xiang, et al.
Pubblicazione: (2024)
di: Li, Xiang, et al.
Pubblicazione: (2024)
A Survey on Vision Autoregressive Model
di: Jiang, Kai, et al.
Pubblicazione: (2024)
di: Jiang, Kai, et al.
Pubblicazione: (2024)
DreamVAR: Taming Reinforced Visual Autoregressive Model for High-Fidelity Subject-Driven Image Generation
di: Jiang, Xin, et al.
Pubblicazione: (2026)
di: Jiang, Xin, et al.
Pubblicazione: (2026)
FVAR: Visual Autoregressive Modeling via Next Focus Prediction
di: Li, Xiaofan, et al.
Pubblicazione: (2025)
di: Li, Xiaofan, et al.
Pubblicazione: (2025)
Diversity Has Always Been There in Your Visual Autoregressive Models
di: Wang, Tong, et al.
Pubblicazione: (2025)
di: Wang, Tong, et al.
Pubblicazione: (2025)
UniModel: A Visual-Only Framework for Unified Multimodal Understanding and Generation
di: Zhang, Chi, et al.
Pubblicazione: (2025)
di: Zhang, Chi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SmartFreeEdit: Mask-Free Spatial-Aware Image Editing with Complex Instruction Understanding
di: Sun, Qianqian, et al.
Pubblicazione: (2025) -
TeleMem: Building Long-Term and Multimodal Memory for Agentic AI
di: Chen, Chunliang, et al.
Pubblicazione: (2025) -
Boosting Multimodal Large Language Models with Visual Tokens Withdrawal for Rapid Inference
di: Lin, Zhihang, et al.
Pubblicazione: (2024) -
CAR: Controllable Autoregressive Modeling for Visual Generation
di: Yao, Ziyu, et al.
Pubblicazione: (2024) -
Vehicle Perception from Satellite
di: Zhao, Bin, et al.
Pubblicazione: (2024)