Unsafe by Reciprocity: How Generation-Understanding Coupling Undermines Safety in Unified Multimodal Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Kaishen, Huang, Heng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ImAgent: A Unified Multimodal Agent Framework for Test-Time Scalable Image Generation
por: Wang, Kaishen, et al.
Publicado: (2025)
por: Wang, Kaishen, et al.
Publicado: (2025)
Unified Reward Model for Multimodal Understanding and Generation
por: Wang, Yibin, et al.
Publicado: (2025)
por: Wang, Yibin, et al.
Publicado: (2025)
Learning to Generate via Understanding: Understanding-Driven Intrinsic Rewarding for Unified Multimodal Models
por: Pan, Jiadong, et al.
Publicado: (2026)
por: Pan, Jiadong, et al.
Publicado: (2026)
To Generate or Not? Safety-Driven Unlearned Diffusion Models Are Still Easy To Generate Unsafe Images ... For Now
por: Zhang, Yimeng, et al.
Publicado: (2023)
por: Zhang, Yimeng, et al.
Publicado: (2023)
UniModel: A Visual-Only Framework for Unified Multimodal Understanding and Generation
por: Zhang, Chi, et al.
Publicado: (2025)
por: Zhang, Chi, et al.
Publicado: (2025)
Towards Understanding Unsafe Video Generation
por: Pang, Yan, et al.
Publicado: (2024)
por: Pang, Yan, et al.
Publicado: (2024)
GPT4Video: A Unified Multimodal Large Language Model for lnstruction-Followed Understanding and Safety-Aware Generation
por: Wang, Zhanyu, et al.
Publicado: (2023)
por: Wang, Zhanyu, et al.
Publicado: (2023)
MME-Unify: A Comprehensive Benchmark for Unified Multimodal Understanding and Generation Models
por: Xie, Wulin, et al.
Publicado: (2025)
por: Xie, Wulin, et al.
Publicado: (2025)
Unified Multimodal Understanding and Generation Models: Advances, Challenges, and Opportunities
por: Zhao, Shanshan, et al.
Publicado: (2025)
por: Zhao, Shanshan, et al.
Publicado: (2025)
Thinking with Camera: A Unified Multimodal Model for Camera-Centric Understanding and Generation
por: Liao, Kang, et al.
Publicado: (2025)
por: Liao, Kang, et al.
Publicado: (2025)
Why Text Prevails: Vision May Undermine Multimodal Medical Decision Making
por: Dai, Siyuan, et al.
Publicado: (2025)
por: Dai, Siyuan, et al.
Publicado: (2025)
CLEAR: Unlocking Generative Potential for Degraded Image Understanding in Unified Multimodal Models
por: Hao, Xiangzhao, et al.
Publicado: (2026)
por: Hao, Xiangzhao, et al.
Publicado: (2026)
Steering Visual Generation in Unified Multimodal Models with Understanding Supervision
por: Liu, Zeyu, et al.
Publicado: (2026)
por: Liu, Zeyu, et al.
Publicado: (2026)
OmniMamba: Efficient and Unified Multimodal Understanding and Generation via State Space Models
por: Zou, Jialv, et al.
Publicado: (2025)
por: Zou, Jialv, et al.
Publicado: (2025)
Period-LLM: Extending the Periodic Capability of Multimodal Large Language Model
por: Zhang, Yuting, et al.
Publicado: (2025)
por: Zhang, Yuting, et al.
Publicado: (2025)
Math Blind: Failures in Diagram Understanding Undermine Reasoning in MLLMs
por: Sun, Yanpeng, et al.
Publicado: (2025)
por: Sun, Yanpeng, et al.
Publicado: (2025)
Harmonizing Visual Representations for Unified Multimodal Understanding and Generation
por: Wu, Size, et al.
Publicado: (2025)
por: Wu, Size, et al.
Publicado: (2025)
Omni-Weather: A Unified Multimodal Model for Weather Radar Understanding and Generation
por: Zhou, Zhiwang, et al.
Publicado: (2025)
por: Zhou, Zhiwang, et al.
Publicado: (2025)
InternVL-U: Democratizing Unified Multimodal Models for Understanding, Reasoning, Generation and Editing
por: Tian, Changyao, et al.
Publicado: (2026)
por: Tian, Changyao, et al.
Publicado: (2026)
LLaDA2.0-Uni: Unifying Multimodal Understanding and Generation with Diffusion Large Language Model
por: AI, Inclusion, et al.
Publicado: (2026)
por: AI, Inclusion, et al.
Publicado: (2026)
No Safe Dose: How Training Data Drives Unsafe Image Generation
por: Friedrich, Felix, et al.
Publicado: (2026)
por: Friedrich, Felix, et al.
Publicado: (2026)
UniEval: Unified Holistic Evaluation for Unified Multimodal Understanding and Generation
por: Li, Yi, et al.
Publicado: (2025)
por: Li, Yi, et al.
Publicado: (2025)
Show-o: One Single Transformer to Unify Multimodal Understanding and Generation
por: Xie, Jinheng, et al.
Publicado: (2024)
por: Xie, Jinheng, et al.
Publicado: (2024)
Mobile-O: Unified Multimodal Understanding and Generation on Mobile Device
por: Shaker, Abdelrahman, et al.
Publicado: (2026)
por: Shaker, Abdelrahman, et al.
Publicado: (2026)
Lavida-O: Elastic Large Masked Diffusion Models for Unified Multimodal Understanding and Generation
por: Li, Shufan, et al.
Publicado: (2025)
por: Li, Shufan, et al.
Publicado: (2025)
VARGPT: Unified Understanding and Generation in a Visual Autoregressive Multimodal Large Language Model
por: Zhuang, Xianwei, et al.
Publicado: (2025)
por: Zhuang, Xianwei, et al.
Publicado: (2025)
MedXChat: A Unified Multimodal Large Language Model Framework towards CXRs Understanding and Generation
por: Yang, Ling, et al.
Publicado: (2023)
por: Yang, Ling, et al.
Publicado: (2023)
Beyond the Safety Tax: Mitigating Unsafe Text-to-Image Generation via External Safety Rectification
por: Meng, Xiangtao, et al.
Publicado: (2025)
por: Meng, Xiangtao, et al.
Publicado: (2025)
HBridge: H-Shape Bridging of Heterogeneous Experts for Unified Multimodal Understanding and Generation
por: Wang, Xiang, et al.
Publicado: (2025)
por: Wang, Xiang, et al.
Publicado: (2025)
NextFlow: Unified Sequential Modeling Activates Multimodal Understanding and Generation
por: Zhang, Huichao, et al.
Publicado: (2026)
por: Zhang, Huichao, et al.
Publicado: (2026)
UniLiP: Adapting CLIP for Unified Multimodal Understanding, Generation and Editing
por: Tang, Hao, et al.
Publicado: (2025)
por: Tang, Hao, et al.
Publicado: (2025)
QLIP: Text-Aligned Visual Tokenization Unifies Auto-Regressive Multimodal Understanding and Generation
por: Zhao, Yue, et al.
Publicado: (2025)
por: Zhao, Yue, et al.
Publicado: (2025)
Omni-Diffusion: Unified Multimodal Understanding and Generation with Masked Discrete Diffusion
por: Li, Lijiang, et al.
Publicado: (2026)
por: Li, Lijiang, et al.
Publicado: (2026)
Hyper-Bagel: A Unified Acceleration Framework for Multimodal Understanding and Generation
por: Lu, Yanzuo, et al.
Publicado: (2025)
por: Lu, Yanzuo, et al.
Publicado: (2025)
EMMA: Efficient Multimodal Understanding, Generation, and Editing with a Unified Architecture
por: He, Xin, et al.
Publicado: (2025)
por: He, Xin, et al.
Publicado: (2025)
OpenUni: A Simple Baseline for Unified Multimodal Understanding and Generation
por: Wu, Size, et al.
Publicado: (2025)
por: Wu, Size, et al.
Publicado: (2025)
UniFork: Exploring Modality Alignment for Unified Multimodal Understanding and Generation
por: Li, Teng, et al.
Publicado: (2025)
por: Li, Teng, et al.
Publicado: (2025)
UniCMs: A Unified Consistency Model For Efficient Multimodal Generation and Understanding
por: Xu, Chenkai, et al.
Publicado: (2025)
por: Xu, Chenkai, et al.
Publicado: (2025)
SenseNova-U1: Unifying Multimodal Understanding and Generation with NEO-unify Architecture
por: Diao, Haiwen, et al.
Publicado: (2026)
por: Diao, Haiwen, et al.
Publicado: (2026)
Bridging Domain Generalization to Multimodal Domain Generalization via Unified Representations
por: Huang, Hai, et al.
Publicado: (2025)
por: Huang, Hai, et al.
Publicado: (2025)
Ejemplares similares
-
ImAgent: A Unified Multimodal Agent Framework for Test-Time Scalable Image Generation
por: Wang, Kaishen, et al.
Publicado: (2025) -
Unified Reward Model for Multimodal Understanding and Generation
por: Wang, Yibin, et al.
Publicado: (2025) -
Learning to Generate via Understanding: Understanding-Driven Intrinsic Rewarding for Unified Multimodal Models
por: Pan, Jiadong, et al.
Publicado: (2026) -
To Generate or Not? Safety-Driven Unlearned Diffusion Models Are Still Easy To Generate Unsafe Images ... For Now
por: Zhang, Yimeng, et al.
Publicado: (2023) -
UniModel: A Visual-Only Framework for Unified Multimodal Understanding and Generation
por: Zhang, Chi, et al.
Publicado: (2025)