Analyzing Diffusion and Autoregressive Vision Language Models in Multimodal Embedding Space

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Wang, Zihang, Zhang, Siyue, Zhao, Yilun, Yang, Jingyi, Song, Tingyu, Luu, Anh Tuan, Zhao, Chen
Format: Preprint
Published: 2026
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!