TBAC-UniImage: Unified Understanding and Generation by Ladder-Side Diffusion Tuning
Fuente:
arXiv
Guardado en:
| Autores principales: | Xu, Junzhe, Yin, Yuyang, Chen, Xi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LadderMoE: Ladder-Side Mixture of Experts Adapters for Bronze Inscription Recognition
por: Zhou, Rixin, et al.
Publicado: (2025)
por: Zhou, Rixin, et al.
Publicado: (2025)
UniX: Unifying Autoregression and Diffusion for Chest X-Ray Understanding and Generation
por: Zhang, Ruiheng, et al.
Publicado: (2026)
por: Zhang, Ruiheng, et al.
Publicado: (2026)
UniVG: A Generalist Diffusion Model for Unified Image Generation and Editing
por: Fu, Tsu-Jui, et al.
Publicado: (2025)
por: Fu, Tsu-Jui, et al.
Publicado: (2025)
LSP-ST: Ladder Shape-Biased Side-Tuning for Robust Infrared Small Target Detection
por: Zhang, Guoyi, et al.
Publicado: (2025)
por: Zhang, Guoyi, et al.
Publicado: (2025)
UniAlignment: Semantic Alignment for Unified Image Generation, Understanding, Manipulation and Perception
por: Song, Xinyang, et al.
Publicado: (2025)
por: Song, Xinyang, et al.
Publicado: (2025)
UniVideo: Unified Understanding, Generation, and Editing for Videos
por: Wei, Cong, et al.
Publicado: (2025)
por: Wei, Cong, et al.
Publicado: (2025)
UniMesh: Unifying 3D Mesh Understanding and Generation
por: Huang, Peng, et al.
Publicado: (2026)
por: Huang, Peng, et al.
Publicado: (2026)
Ming-UniVision: Joint Image Understanding and Generation with a Unified Continuous Tokenizer
por: Huang, Ziyuan, et al.
Publicado: (2025)
por: Huang, Ziyuan, et al.
Publicado: (2025)
UniCompress: Token Compression for Unified Vision-Language Understanding and Generation
por: Wang, Ziyao, et al.
Publicado: (2026)
por: Wang, Ziyao, et al.
Publicado: (2026)
LLaDA2.0-Uni: Unifying Multimodal Understanding and Generation with Diffusion Large Language Model
por: AI, Inclusion, et al.
Publicado: (2026)
por: AI, Inclusion, et al.
Publicado: (2026)
UniMC: Taming Diffusion Transformer for Unified Keypoint-Guided Multi-Class Image Generation
por: Guo, Qin, et al.
Publicado: (2025)
por: Guo, Qin, et al.
Publicado: (2025)
UniUGG: Unified 3D Understanding and Generation via Geometric-Semantic Encoding
por: Xu, Yueming, et al.
Publicado: (2025)
por: Xu, Yueming, et al.
Publicado: (2025)
OpenUni: A Simple Baseline for Unified Multimodal Understanding and Generation
por: Wu, Size, et al.
Publicado: (2025)
por: Wu, Size, et al.
Publicado: (2025)
UniUGP: Unifying Understanding, Generation, and Planing For End-to-end Autonomous Driving
por: Lu, Hao, et al.
Publicado: (2025)
por: Lu, Hao, et al.
Publicado: (2025)
UniCalli: A Unified Diffusion Framework for Column-Level Generation and Recognition of Chinese Calligraphy
por: Xu, Tianshuo, et al.
Publicado: (2025)
por: Xu, Tianshuo, et al.
Publicado: (2025)
UniFlow: A Unified Pixel Flow Tokenizer for Visual Understanding and Generation
por: Yue, Zhengrong, et al.
Publicado: (2025)
por: Yue, Zhengrong, et al.
Publicado: (2025)
UniCustom: Unified Visual Conditioning for Multi-Reference Image Generation
por: Xu, Yiyan, et al.
Publicado: (2026)
por: Xu, Yiyan, et al.
Publicado: (2026)
UniFork: Exploring Modality Alignment for Unified Multimodal Understanding and Generation
por: Li, Teng, et al.
Publicado: (2025)
por: Li, Teng, et al.
Publicado: (2025)
Skywork UniPic: Unified Autoregressive Modeling for Visual Understanding and Generation
por: Wang, Peiyu, et al.
Publicado: (2025)
por: Wang, Peiyu, et al.
Publicado: (2025)
UniEmo: Unifying Emotional Understanding and Generation with Learnable Expert Queries
por: Zhu, Yijie, et al.
Publicado: (2025)
por: Zhu, Yijie, et al.
Publicado: (2025)
Uni-Edit: Intelligent Editing Is A General Task For Unified Model Tuning
por: Zheng, Dian, et al.
Publicado: (2026)
por: Zheng, Dian, et al.
Publicado: (2026)
UniGen: Enhanced Training & Test-Time Strategies for Unified Multimodal Understanding and Generation
por: Tian, Rui, et al.
Publicado: (2025)
por: Tian, Rui, et al.
Publicado: (2025)
Uni-ViGU: Towards Unified Video Generation and Understanding via A Diffusion-Based Video Generator
por: Qin, Luozheng, et al.
Publicado: (2026)
por: Qin, Luozheng, et al.
Publicado: (2026)
UniEval: Unified Holistic Evaluation for Unified Multimodal Understanding and Generation
por: Li, Yi, et al.
Publicado: (2025)
por: Li, Yi, et al.
Publicado: (2025)
UniCMs: A Unified Consistency Model For Efficient Multimodal Generation and Understanding
por: Xu, Chenkai, et al.
Publicado: (2025)
por: Xu, Chenkai, et al.
Publicado: (2025)
UniLiP: Adapting CLIP for Unified Multimodal Understanding, Generation and Editing
por: Tang, Hao, et al.
Publicado: (2025)
por: Tang, Hao, et al.
Publicado: (2025)
UniCTokens: Boosting Personalized Understanding and Generation via Unified Concept Tokens
por: An, Ruichuan, et al.
Publicado: (2025)
por: An, Ruichuan, et al.
Publicado: (2025)
UniModel: A Visual-Only Framework for Unified Multimodal Understanding and Generation
por: Zhang, Chi, et al.
Publicado: (2025)
por: Zhang, Chi, et al.
Publicado: (2025)
Uni-Renderer: Unifying Rendering and Inverse Rendering Via Dual Stream Diffusion
por: Chen, Zhifei, et al.
Publicado: (2024)
por: Chen, Zhifei, et al.
Publicado: (2024)
UniEdit-I: Training-free Image Editing for Unified VLM via Iterative Understanding, Editing and Verifying
por: Bai, Chengyu, et al.
Publicado: (2025)
por: Bai, Chengyu, et al.
Publicado: (2025)
UniCode$^2$: Cascaded Large-scale Codebooks for Unified Multimodal Understanding and Generation
por: Chen, Yanzhe, et al.
Publicado: (2025)
por: Chen, Yanzhe, et al.
Publicado: (2025)
UniF$^2$ace: A Unified Fine-grained Face Understanding and Generation Model
por: Li, Junzhe, et al.
Publicado: (2025)
por: Li, Junzhe, et al.
Publicado: (2025)
UniVidX: A Unified Multimodal Framework for Versatile Video Generation via Diffusion Priors
por: Chen, Houyuan, et al.
Publicado: (2026)
por: Chen, Houyuan, et al.
Publicado: (2026)
UniDream: Unifying Diffusion Priors for Relightable Text-to-3D Generation
por: Liu, Zexiang, et al.
Publicado: (2023)
por: Liu, Zexiang, et al.
Publicado: (2023)
UniAnimate: Taming Unified Video Diffusion Models for Consistent Human Image Animation
por: Wang, Xiang, et al.
Publicado: (2024)
por: Wang, Xiang, et al.
Publicado: (2024)
UniToken: Harmonizing Multimodal Understanding and Generation through Unified Visual Encoding
por: Jiao, Yang, et al.
Publicado: (2025)
por: Jiao, Yang, et al.
Publicado: (2025)
UniGenDet: A Unified Generative-Discriminative Framework for Co-Evolutionary Image Generation and Generated Image Detection
por: Zhang, Yanran, et al.
Publicado: (2026)
por: Zhang, Yanran, et al.
Publicado: (2026)
UniDrive-WM: Unified Understanding, Planning and Generation World Model For Autonomous Driving
por: Xiong, Zhexiao, et al.
Publicado: (2026)
por: Xiong, Zhexiao, et al.
Publicado: (2026)
UniStitch: Unifying Semantic and Geometric Features for Image Stitching
por: Mei, Yuan, et al.
Publicado: (2026)
por: Mei, Yuan, et al.
Publicado: (2026)
UniPercept: Towards Unified Perceptual-Level Image Understanding across Aesthetics, Quality, Structure, and Texture
por: Cao, Shuo, et al.
Publicado: (2025)
por: Cao, Shuo, et al.
Publicado: (2025)
Ejemplares similares
-
LadderMoE: Ladder-Side Mixture of Experts Adapters for Bronze Inscription Recognition
por: Zhou, Rixin, et al.
Publicado: (2025) -
UniX: Unifying Autoregression and Diffusion for Chest X-Ray Understanding and Generation
por: Zhang, Ruiheng, et al.
Publicado: (2026) -
UniVG: A Generalist Diffusion Model for Unified Image Generation and Editing
por: Fu, Tsu-Jui, et al.
Publicado: (2025) -
LSP-ST: Ladder Shape-Biased Side-Tuning for Robust Infrared Small Target Detection
por: Zhang, Guoyi, et al.
Publicado: (2025) -
UniAlignment: Semantic Alignment for Unified Image Generation, Understanding, Manipulation and Perception
por: Song, Xinyang, et al.
Publicado: (2025)