UniG2U-Bench: Do Unified Models Advance Multimodal Understanding?
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wen, Zimo, Li, Boxiu, Zhang, Wanbo, Lei, Junxiang, Chen, Xiaoyu, Fan, Yijia, Zhang, Qi, Wang, Yujiang, Qiu, Lili, Li, Bo, Liu, Ziwei, Shan, Caihua, Yang, Yifan, Shen, Yifei |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
UniEval: Unified Holistic Evaluation for Unified Multimodal Understanding and Generation
von: Li, Yi, et al.
Veröffentlicht: (2025)
von: Li, Yi, et al.
Veröffentlicht: (2025)
UniFork: Exploring Modality Alignment for Unified Multimodal Understanding and Generation
von: Li, Teng, et al.
Veröffentlicht: (2025)
von: Li, Teng, et al.
Veröffentlicht: (2025)
UniModel: A Visual-Only Framework for Unified Multimodal Understanding and Generation
von: Zhang, Chi, et al.
Veröffentlicht: (2025)
von: Zhang, Chi, et al.
Veröffentlicht: (2025)
Does Unification Come at a Cost? Uni-SafeBench: A Safety Benchmark for Unified Multimodal Large Models
von: Peng, Zixiang, et al.
Veröffentlicht: (2026)
von: Peng, Zixiang, et al.
Veröffentlicht: (2026)
OpenUni: A Simple Baseline for Unified Multimodal Understanding and Generation
von: Wu, Size, et al.
Veröffentlicht: (2025)
von: Wu, Size, et al.
Veröffentlicht: (2025)
UniToken: Harmonizing Multimodal Understanding and Generation through Unified Visual Encoding
von: Jiao, Yang, et al.
Veröffentlicht: (2025)
von: Jiao, Yang, et al.
Veröffentlicht: (2025)
VidGuard-R1: AI-Generated Video Detection and Explanation via Reasoning MLLMs and RL
von: Park, Kyoungjun, et al.
Veröffentlicht: (2025)
von: Park, Kyoungjun, et al.
Veröffentlicht: (2025)
UniAPO: Unified Multimodal Automated Prompt Optimization
von: Zhu, Qipeng, et al.
Veröffentlicht: (2025)
von: Zhu, Qipeng, et al.
Veröffentlicht: (2025)
UniCMs: A Unified Consistency Model For Efficient Multimodal Generation and Understanding
von: Xu, Chenkai, et al.
Veröffentlicht: (2025)
von: Xu, Chenkai, et al.
Veröffentlicht: (2025)
UniLiP: Adapting CLIP for Unified Multimodal Understanding, Generation and Editing
von: Tang, Hao, et al.
Veröffentlicht: (2025)
von: Tang, Hao, et al.
Veröffentlicht: (2025)
Omni-DNA: A Unified Genomic Foundation Model for Cross-Modal and Multi-Task Learning
von: Li, Zehui, et al.
Veröffentlicht: (2025)
von: Li, Zehui, et al.
Veröffentlicht: (2025)
CueBench: Advancing Unified Understanding of Context-Aware Video Anomalies in Real-World
von: Yu, Yating, et al.
Veröffentlicht: (2025)
von: Yu, Yating, et al.
Veröffentlicht: (2025)
UniCode$^2$: Cascaded Large-scale Codebooks for Unified Multimodal Understanding and Generation
von: Chen, Yanzhe, et al.
Veröffentlicht: (2025)
von: Chen, Yanzhe, et al.
Veröffentlicht: (2025)
UniChange: Unifying Change Detection with Multimodal Large Language Model
von: Zhang, Xu, et al.
Veröffentlicht: (2025)
von: Zhang, Xu, et al.
Veröffentlicht: (2025)
UniPose: A Unified Multimodal Framework for Human Pose Comprehension, Generation and Editing
von: Li, Yiheng, et al.
Veröffentlicht: (2024)
von: Li, Yiheng, et al.
Veröffentlicht: (2024)
PairUni: Pairwise Training for Unified Multimodal Language Models
von: Zheng, Jiani, et al.
Veröffentlicht: (2025)
von: Zheng, Jiani, et al.
Veröffentlicht: (2025)
UniDiff: A Unified Diffusion Framework for Multimodal Time Series Forecasting
von: Zhang, Da, et al.
Veröffentlicht: (2025)
von: Zhang, Da, et al.
Veröffentlicht: (2025)
UniAct: Unified Motion Generation and Action Streaming for Humanoid Robots
von: Jiang, Nan, et al.
Veröffentlicht: (2025)
von: Jiang, Nan, et al.
Veröffentlicht: (2025)
UniPath: Adaptive Coordination of Understanding and Generation for Unified Multimodal Reasoning
von: Bai, Hayes, et al.
Veröffentlicht: (2026)
von: Bai, Hayes, et al.
Veröffentlicht: (2026)
UniM: A Unified Any-to-Any Interleaved Multimodal Benchmark
von: Li, Yanlin, et al.
Veröffentlicht: (2026)
von: Li, Yanlin, et al.
Veröffentlicht: (2026)
How Do Large Language Models Understand Graph Patterns? A Benchmark for Graph Pattern Comprehension
von: Dai, Xinnan, et al.
Veröffentlicht: (2024)
von: Dai, Xinnan, et al.
Veröffentlicht: (2024)
Towards Graph Foundation Models: Training on Knowledge Graphs Enables Transferability to General Graphs
von: Wang, Kai, et al.
Veröffentlicht: (2024)
von: Wang, Kai, et al.
Veröffentlicht: (2024)
Uni-MMMU: A Massive Multi-discipline Multimodal Unified Benchmark
von: Zou, Kai, et al.
Veröffentlicht: (2025)
von: Zou, Kai, et al.
Veröffentlicht: (2025)
Uni-RS: A Spatially Faithful Unified Understanding and Generation Model for Remote Sensing
von: Zhang, Weiyu, et al.
Veröffentlicht: (2026)
von: Zhang, Weiyu, et al.
Veröffentlicht: (2026)
M$^3$GPT: An Advanced Multimodal, Multitask Framework for Motion Comprehension and Generation
von: Luo, Mingshuang, et al.
Veröffentlicht: (2024)
von: Luo, Mingshuang, et al.
Veröffentlicht: (2024)
Uni-Sign: Toward Unified Sign Language Understanding at Scale
von: Li, Zecheng, et al.
Veröffentlicht: (2025)
von: Li, Zecheng, et al.
Veröffentlicht: (2025)
When Do LLMs Help With Node Classification? A Comprehensive Analysis
von: Wu, Xixi, et al.
Veröffentlicht: (2025)
von: Wu, Xixi, et al.
Veröffentlicht: (2025)
UniPhyNet: A Unified Network For Multimodal Physiological Raw Signal Classification
von: Qiu, Renxiang, et al.
Veröffentlicht: (2025)
von: Qiu, Renxiang, et al.
Veröffentlicht: (2025)
UniECG: Understanding and Generating ECG in One Unified Model
von: Jin, Jiarui, et al.
Veröffentlicht: (2025)
von: Jin, Jiarui, et al.
Veröffentlicht: (2025)
Done Is Better than Perfect: Unlocking Efficient Reasoning by Structured Multi-Turn Decomposition
von: Zeng, Zihao, et al.
Veröffentlicht: (2025)
von: Zeng, Zihao, et al.
Veröffentlicht: (2025)
Uni-MoE: Scaling Unified Multimodal LLMs with Mixture of Experts
von: Li, Yunxin, et al.
Veröffentlicht: (2024)
von: Li, Yunxin, et al.
Veröffentlicht: (2024)
UniGraph2: Learning a Unified Embedding Space to Bind Multimodal Graphs
von: He, Yufei, et al.
Veröffentlicht: (2025)
von: He, Yufei, et al.
Veröffentlicht: (2025)
UniVS: Unified and Universal Video Segmentation with Prompts as Queries
von: Li, Minghan, et al.
Veröffentlicht: (2024)
von: Li, Minghan, et al.
Veröffentlicht: (2024)
UniMesh: Unifying 3D Mesh Understanding and Generation
von: Huang, Peng, et al.
Veröffentlicht: (2026)
von: Huang, Peng, et al.
Veröffentlicht: (2026)
Resurrecting Label Propagation for Graphs with Heterophily and Label Noise
von: Cheng, Yao, et al.
Veröffentlicht: (2023)
von: Cheng, Yao, et al.
Veröffentlicht: (2023)
Unified Multimodal Understanding and Generation Models: Advances, Challenges, and Opportunities
von: Zhao, Shanshan, et al.
Veröffentlicht: (2025)
von: Zhao, Shanshan, et al.
Veröffentlicht: (2025)
UniNote: A Unified Embedding Model for Multimodal Representation and Ranking
von: Zhao, Jinghan, et al.
Veröffentlicht: (2026)
von: Zhao, Jinghan, et al.
Veröffentlicht: (2026)
SIFT: Grounding LLM Reasoning in Contexts via Stickers
von: Zeng, Zihao, et al.
Veröffentlicht: (2025)
von: Zeng, Zihao, et al.
Veröffentlicht: (2025)
UNO-Bench: A Unified Benchmark for Exploring the Compositional Law Between Uni-modal and Omni-modal in Omni Models
von: Chen, Chen, et al.
Veröffentlicht: (2025)
von: Chen, Chen, et al.
Veröffentlicht: (2025)
Enhancing Large Multimodal Models with Adaptive Sparsity and KV Cache Compression
von: Zhang, Te, et al.
Veröffentlicht: (2025)
von: Zhang, Te, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
UniEval: Unified Holistic Evaluation for Unified Multimodal Understanding and Generation
von: Li, Yi, et al.
Veröffentlicht: (2025) -
UniFork: Exploring Modality Alignment for Unified Multimodal Understanding and Generation
von: Li, Teng, et al.
Veröffentlicht: (2025) -
UniModel: A Visual-Only Framework for Unified Multimodal Understanding and Generation
von: Zhang, Chi, et al.
Veröffentlicht: (2025) -
Does Unification Come at a Cost? Uni-SafeBench: A Safety Benchmark for Unified Multimodal Large Models
von: Peng, Zixiang, et al.
Veröffentlicht: (2026) -
OpenUni: A Simple Baseline for Unified Multimodal Understanding and Generation
von: Wu, Size, et al.
Veröffentlicht: (2025)