MedXChat: A Unified Multimodal Large Language Model Framework towards CXRs Understanding and Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Ling, Wang, Zhanyu, Chen, Zhenghao, Liang, Xinyu, Zhou, Luping |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GPT4Video: A Unified Multimodal Large Language Model for lnstruction-Followed Understanding and Safety-Aware Generation
di: Wang, Zhanyu, et al.
Pubblicazione: (2023)
di: Wang, Zhanyu, et al.
Pubblicazione: (2023)
S-RRG-Bench: Structured Radiology Report Generation with Fine-Grained Evaluation Framework
di: Li, Yingshu, et al.
Pubblicazione: (2025)
di: Li, Yingshu, et al.
Pubblicazione: (2025)
KARGEN: Knowledge-enhanced Automated Radiology Report Generation Using Large Language Models
di: Li, Yingshu, et al.
Pubblicazione: (2024)
di: Li, Yingshu, et al.
Pubblicazione: (2024)
Reversing the Flow: Generation-to-Understanding Synergy in Large Multimodal Models
di: Tong, Yujun, et al.
Pubblicazione: (2026)
di: Tong, Yujun, et al.
Pubblicazione: (2026)
VARGPT: Unified Understanding and Generation in a Visual Autoregressive Multimodal Large Language Model
di: Zhuang, Xianwei, et al.
Pubblicazione: (2025)
di: Zhuang, Xianwei, et al.
Pubblicazione: (2025)
UniModel: A Visual-Only Framework for Unified Multimodal Understanding and Generation
di: Zhang, Chi, et al.
Pubblicazione: (2025)
di: Zhang, Chi, et al.
Pubblicazione: (2025)
MedMO: Grounding and Understanding Multimodal Large Language Model for Medical Images
di: Deria, Ankan, et al.
Pubblicazione: (2026)
di: Deria, Ankan, et al.
Pubblicazione: (2026)
Hulu-Med: A Transparent Generalist Model towards Holistic Medical Vision-Language Understanding
di: Jiang, Songtao, et al.
Pubblicazione: (2025)
di: Jiang, Songtao, et al.
Pubblicazione: (2025)
MME-Unify: A Comprehensive Benchmark for Unified Multimodal Understanding and Generation Models
di: Xie, Wulin, et al.
Pubblicazione: (2025)
di: Xie, Wulin, et al.
Pubblicazione: (2025)
LLaDA2.0-Uni: Unifying Multimodal Understanding and Generation with Diffusion Large Language Model
di: AI, Inclusion, et al.
Pubblicazione: (2026)
di: AI, Inclusion, et al.
Pubblicazione: (2026)
PoinTramba: A Hybrid Transformer-Mamba Framework for Point Cloud Analysis
di: Wang, Zicheng, et al.
Pubblicazione: (2024)
di: Wang, Zicheng, et al.
Pubblicazione: (2024)
A Systematic Evaluation of GPT-4V's Multimodal Capability for Medical Image Analysis
di: Li, Yingshu, et al.
Pubblicazione: (2023)
di: Li, Yingshu, et al.
Pubblicazione: (2023)
MedSeg-R: Reasoning Segmentation in Medical Images with Multimodal Large Language Models
di: Huang, Yu, et al.
Pubblicazione: (2025)
di: Huang, Yu, et al.
Pubblicazione: (2025)
Can Large Vision-Language Models Understand Multimodal Sarcasm?
di: Wang, Xinyu, et al.
Pubblicazione: (2025)
di: Wang, Xinyu, et al.
Pubblicazione: (2025)
A Unified Image-Dense Annotation Generation Model for Underwater Scenes
di: Lin, Hongkai, et al.
Pubblicazione: (2025)
di: Lin, Hongkai, et al.
Pubblicazione: (2025)
Unified Reward Model for Multimodal Understanding and Generation
di: Wang, Yibin, et al.
Pubblicazione: (2025)
di: Wang, Yibin, et al.
Pubblicazione: (2025)
MammothModa2: A Unified AR-Diffusion Framework for Multimodal Understanding and Generation
di: Shen, Tao, et al.
Pubblicazione: (2025)
di: Shen, Tao, et al.
Pubblicazione: (2025)
UniCode$^2$: Cascaded Large-scale Codebooks for Unified Multimodal Understanding and Generation
di: Chen, Yanzhe, et al.
Pubblicazione: (2025)
di: Chen, Yanzhe, et al.
Pubblicazione: (2025)
Learning to Generate via Understanding: Understanding-Driven Intrinsic Rewarding for Unified Multimodal Models
di: Pan, Jiadong, et al.
Pubblicazione: (2026)
di: Pan, Jiadong, et al.
Pubblicazione: (2026)
Med-Evo: Test-time Self-evolution for Medical Multimodal Large Language Models
di: Xu, Dunyuan, et al.
Pubblicazione: (2026)
di: Xu, Dunyuan, et al.
Pubblicazione: (2026)
UniSVG: A Unified Dataset for Vector Graphic Understanding and Generation with Multimodal Large Language Models
di: Li, Jinke, et al.
Pubblicazione: (2025)
di: Li, Jinke, et al.
Pubblicazione: (2025)
SynerMedGen: Synergizing Medical Multimodal Understanding with Generation via Task Alignment
di: Zhao, Weiren, et al.
Pubblicazione: (2026)
di: Zhao, Weiren, et al.
Pubblicazione: (2026)
Evaluating Attribute Comprehension in Large Vision-Language Models
di: Zhang, Haiwen, et al.
Pubblicazione: (2024)
di: Zhang, Haiwen, et al.
Pubblicazione: (2024)
Large Language Model-Driven Distributed Integrated Multimodal Sensing and Semantic Communications
di: Peng, Yubo, et al.
Pubblicazione: (2025)
di: Peng, Yubo, et al.
Pubblicazione: (2025)
Lavida-O: Elastic Large Masked Diffusion Models for Unified Multimodal Understanding and Generation
di: Li, Shufan, et al.
Pubblicazione: (2025)
di: Li, Shufan, et al.
Pubblicazione: (2025)
Unified Multimodal Understanding and Generation Models: Advances, Challenges, and Opportunities
di: Zhao, Shanshan, et al.
Pubblicazione: (2025)
di: Zhao, Shanshan, et al.
Pubblicazione: (2025)
Hyper-Bagel: A Unified Acceleration Framework for Multimodal Understanding and Generation
di: Lu, Yanzuo, et al.
Pubblicazione: (2025)
di: Lu, Yanzuo, et al.
Pubblicazione: (2025)
Group-aware Parameter-efficient Updating for Content-Adaptive Neural Video Compression
di: Chen, Zhenghao, et al.
Pubblicazione: (2024)
di: Chen, Zhenghao, et al.
Pubblicazione: (2024)
Omni-Weather: A Unified Multimodal Model for Weather Radar Understanding and Generation
di: Zhou, Zhiwang, et al.
Pubblicazione: (2025)
di: Zhou, Zhiwang, et al.
Pubblicazione: (2025)
Decoding the Delta: Unifying Remote Sensing Change Detection and Understanding with Multimodal Large Language Models
di: Li, Xiaohe, et al.
Pubblicazione: (2026)
di: Li, Xiaohe, et al.
Pubblicazione: (2026)
LLaDA-MedV: Exploring Large Language Diffusion Models for Biomedical Image Understanding
di: Dong, Xuanzhao, et al.
Pubblicazione: (2025)
di: Dong, Xuanzhao, et al.
Pubblicazione: (2025)
UniBrain: A Unified Model for Cross-Subject Brain Decoding
di: Wang, Zicheng, et al.
Pubblicazione: (2024)
di: Wang, Zicheng, et al.
Pubblicazione: (2024)
MM-R1: Unleashing the Power of Unified Multimodal Large Language Models for Personalized Image Generation
di: Liang, Qian, et al.
Pubblicazione: (2025)
di: Liang, Qian, et al.
Pubblicazione: (2025)
InternVL-U: Democratizing Unified Multimodal Models for Understanding, Reasoning, Generation and Editing
di: Tian, Changyao, et al.
Pubblicazione: (2026)
di: Tian, Changyao, et al.
Pubblicazione: (2026)
Steering Visual Generation in Unified Multimodal Models with Understanding Supervision
di: Liu, Zeyu, et al.
Pubblicazione: (2026)
di: Liu, Zeyu, et al.
Pubblicazione: (2026)
UFVideo: Towards Unified Fine-Grained Video Cooperative Understanding with Large Language Models
di: Pan, Hewen, et al.
Pubblicazione: (2025)
di: Pan, Hewen, et al.
Pubblicazione: (2025)
VisionGPT: Vision-Language Understanding Agent Using Generalized Multimodal Framework
di: Kelly, Chris, et al.
Pubblicazione: (2024)
di: Kelly, Chris, et al.
Pubblicazione: (2024)
Harmonizing Visual Representations for Unified Multimodal Understanding and Generation
di: Wu, Size, et al.
Pubblicazione: (2025)
di: Wu, Size, et al.
Pubblicazione: (2025)
Seeing is Believing? Mitigating OCR Hallucinations in Multimodal Large Language Models
di: He, Zhentao, et al.
Pubblicazione: (2025)
di: He, Zhentao, et al.
Pubblicazione: (2025)
CLEAR: Unlocking Generative Potential for Degraded Image Understanding in Unified Multimodal Models
di: Hao, Xiangzhao, et al.
Pubblicazione: (2026)
di: Hao, Xiangzhao, et al.
Pubblicazione: (2026)
Documenti analoghi
-
GPT4Video: A Unified Multimodal Large Language Model for lnstruction-Followed Understanding and Safety-Aware Generation
di: Wang, Zhanyu, et al.
Pubblicazione: (2023) -
S-RRG-Bench: Structured Radiology Report Generation with Fine-Grained Evaluation Framework
di: Li, Yingshu, et al.
Pubblicazione: (2025) -
KARGEN: Knowledge-enhanced Automated Radiology Report Generation Using Large Language Models
di: Li, Yingshu, et al.
Pubblicazione: (2024) -
Reversing the Flow: Generation-to-Understanding Synergy in Large Multimodal Models
di: Tong, Yujun, et al.
Pubblicazione: (2026) -
VARGPT: Unified Understanding and Generation in a Visual Autoregressive Multimodal Large Language Model
di: Zhuang, Xianwei, et al.
Pubblicazione: (2025)