Unified Modeling Enhanced Multimodal Learning for Precision Neuro-Oncology
Fuente:
arXiv
Salvato in:
| Autori principali: | Yi, Huahui, Wang, Xiaofei, Li, Kang, Li, Chao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ClueTracer: Question-to-Vision Clue Tracing for Training-Free Hallucination Suppression in Multimodal Reasoning
di: Xi, Gongli, et al.
Pubblicazione: (2026)
di: Xi, Gongli, et al.
Pubblicazione: (2026)
C3-Diff: Super-resolving Spatial Transcriptomics via Cross-modal Cross-content Contrastive Diffusion Modelling
di: Wang, Xiaofei, et al.
Pubblicazione: (2025)
di: Wang, Xiaofei, et al.
Pubblicazione: (2025)
UniEval: Unified Holistic Evaluation for Unified Multimodal Understanding and Generation
di: Li, Yi, et al.
Pubblicazione: (2025)
di: Li, Yi, et al.
Pubblicazione: (2025)
Understanding and Harnessing Sparsity in Unified Multimodal Models
di: He, Shwai, et al.
Pubblicazione: (2025)
di: He, Shwai, et al.
Pubblicazione: (2025)
Semantic Generative Tuning for Unified Multimodal Models
di: Yu, Songsong, et al.
Pubblicazione: (2026)
di: Yu, Songsong, et al.
Pubblicazione: (2026)
Enhancing Multimodal Unified Representations for Cross Modal Generalization
di: Huang, Hai, et al.
Pubblicazione: (2024)
di: Huang, Hai, et al.
Pubblicazione: (2024)
Free Lunch for Unified Multimodal Models: Enhancing Generation via Reflective Rectification with Inherent Understanding
di: Jiang, Yibo, et al.
Pubblicazione: (2026)
di: Jiang, Yibo, et al.
Pubblicazione: (2026)
Large Vision-Language Models Get Lost in Attention
di: Xi, Gongli, et al.
Pubblicazione: (2026)
di: Xi, Gongli, et al.
Pubblicazione: (2026)
Enhancing Alignment for Unified Multimodal Models via Semantically-Grounded Supervision
di: Kim, Jiyeong, et al.
Pubblicazione: (2026)
di: Kim, Jiyeong, et al.
Pubblicazione: (2026)
UniCMs: A Unified Consistency Model For Efficient Multimodal Generation and Understanding
di: Xu, Chenkai, et al.
Pubblicazione: (2025)
di: Xu, Chenkai, et al.
Pubblicazione: (2025)
NextFlow: Unified Sequential Modeling Activates Multimodal Understanding and Generation
di: Zhang, Huichao, et al.
Pubblicazione: (2026)
di: Zhang, Huichao, et al.
Pubblicazione: (2026)
A Disease-Centric Vision-Language Foundation Model for Precision Oncology in Kidney Cancer
di: Tao, Yuhui, et al.
Pubblicazione: (2025)
di: Tao, Yuhui, et al.
Pubblicazione: (2025)
UniWeTok: An Unified Binary Tokenizer with Codebook Size $\mathit{2^{128}}$ for Unified Multimodal Large Language Model
di: Zhuang, Shaobin, et al.
Pubblicazione: (2026)
di: Zhuang, Shaobin, et al.
Pubblicazione: (2026)
Lance: Unified Multimodal Modeling by Multi-Task Synergy
di: Fu, Fengyi, et al.
Pubblicazione: (2026)
di: Fu, Fengyi, et al.
Pubblicazione: (2026)
Multimodal Slice Interaction Network Enhanced by Transfer Learning for Precise Segmentation of Internal Gross Tumor Volume in Lung Cancer PET/CT Imaging
di: Luo, Yi, et al.
Pubblicazione: (2025)
di: Luo, Yi, et al.
Pubblicazione: (2025)
Improving Medical Visual Reinforcement Fine-Tuning via Perception and Reasoning Augmentation
di: Yang, Guangjing, et al.
Pubblicazione: (2026)
di: Yang, Guangjing, et al.
Pubblicazione: (2026)
Mode-as-Sequence: Translating Multimodal Motion Prediction into Unified Sequential Mode Modeling
di: Zhou, Zikang, et al.
Pubblicazione: (2026)
di: Zhou, Zikang, et al.
Pubblicazione: (2026)
MM-NeuroOnco: A Multimodal Benchmark and Instruction Dataset for MRI-Based Brain Tumor Diagnosis
di: Guo, Feng, et al.
Pubblicazione: (2026)
di: Guo, Feng, et al.
Pubblicazione: (2026)
Unifying Visual and Semantic Feature Spaces with Diffusion Models for Enhanced Cross-Modal Alignment
di: Zheng, Yuze, et al.
Pubblicazione: (2024)
di: Zheng, Yuze, et al.
Pubblicazione: (2024)
DeepGen 1.0: A Lightweight Unified Multimodal Model for Advancing Image Generation and Editing
di: Wang, Dianyi, et al.
Pubblicazione: (2026)
di: Wang, Dianyi, et al.
Pubblicazione: (2026)
UniG2U-Bench: Do Unified Models Advance Multimodal Understanding?
di: Wen, Zimo, et al.
Pubblicazione: (2026)
di: Wen, Zimo, et al.
Pubblicazione: (2026)
Instinct vs. Reflection: Unifying Token and Verbalized Confidence in Multimodal Large Models
di: Dang, Yunkai, et al.
Pubblicazione: (2026)
di: Dang, Yunkai, et al.
Pubblicazione: (2026)
Discrete Diffusion Models with MLLMs for Unified Medical Multimodal Generation
di: Mao, Jiawei, et al.
Pubblicazione: (2025)
di: Mao, Jiawei, et al.
Pubblicazione: (2025)
Multimodal Oncology Agent for IDH1 Mutation Prediction in Low-Grade Glioma
di: Akebli, Hafsa, et al.
Pubblicazione: (2025)
di: Akebli, Hafsa, et al.
Pubblicazione: (2025)
UniSVG: A Unified Dataset for Vector Graphic Understanding and Generation with Multimodal Large Language Models
di: Li, Jinke, et al.
Pubblicazione: (2025)
di: Li, Jinke, et al.
Pubblicazione: (2025)
Draw-In-Mind: Rebalancing Designer-Painter Roles in Unified Multimodal Models Benefits Image Editing
di: Zeng, Ziyun, et al.
Pubblicazione: (2025)
di: Zeng, Ziyun, et al.
Pubblicazione: (2025)
CodeBind: Decoupled Representation Learning for Multimodal Alignment with Unified Compositional Codebook
di: Chen, Zeyu, et al.
Pubblicazione: (2026)
di: Chen, Zeyu, et al.
Pubblicazione: (2026)
UniCode: Learning a Unified Codebook for Multimodal Large Language Models
di: Zheng, Sipeng, et al.
Pubblicazione: (2024)
di: Zheng, Sipeng, et al.
Pubblicazione: (2024)
TokenFlow: Unified Image Tokenizer for Multimodal Understanding and Generation
di: Qu, Liao, et al.
Pubblicazione: (2024)
di: Qu, Liao, et al.
Pubblicazione: (2024)
OmniCorpus: A Unified Multimodal Corpus of 10 Billion-Level Images Interleaved with Text
di: Li, Qingyun, et al.
Pubblicazione: (2024)
di: Li, Qingyun, et al.
Pubblicazione: (2024)
Diagnosing and Mitigating Modality Interference in Multimodal Large Language Models
di: Cai, Rui, et al.
Pubblicazione: (2025)
di: Cai, Rui, et al.
Pubblicazione: (2025)
UniCorn: Towards Self-Improving Unified Multimodal Models through Self-Generated Supervision
di: Han, Ruiyan, et al.
Pubblicazione: (2026)
di: Han, Ruiyan, et al.
Pubblicazione: (2026)
STAR: STacked AutoRegressive Scheme for Unified Multimodal Learning
di: Qin, Jie, et al.
Pubblicazione: (2025)
di: Qin, Jie, et al.
Pubblicazione: (2025)
RS-GPT4V: A Unified Multimodal Instruction-Following Dataset for Remote Sensing Image Understanding
di: Xu, Linrui, et al.
Pubblicazione: (2024)
di: Xu, Linrui, et al.
Pubblicazione: (2024)
Score-based Diffusion Model for Unpaired Virtual Histology Staining
di: Liu, Anran, et al.
Pubblicazione: (2025)
di: Liu, Anran, et al.
Pubblicazione: (2025)
Towards Unified Multimodal Misinformation Detection in Social Media: A Benchmark Dataset and Baseline
di: Li, Haiyang, et al.
Pubblicazione: (2025)
di: Li, Haiyang, et al.
Pubblicazione: (2025)
Molecular-driven Foundation Model for Oncologic Pathology
di: Vaidya, Anurag, et al.
Pubblicazione: (2025)
di: Vaidya, Anurag, et al.
Pubblicazione: (2025)
Enhancing Multimodal In-Context Learning via Inductive-Deductive Reasoning
di: Wang, Haoyu, et al.
Pubblicazione: (2026)
di: Wang, Haoyu, et al.
Pubblicazione: (2026)
Unified Multimodal Understanding via Byte-Pair Visual Encoding
di: Zhang, Wanpeng, et al.
Pubblicazione: (2025)
di: Zhang, Wanpeng, et al.
Pubblicazione: (2025)
GPT-4 Enhanced Multimodal Grounding for Autonomous Driving: Leveraging Cross-Modal Attention with Large Language Models
di: Liao, Haicheng, et al.
Pubblicazione: (2023)
di: Liao, Haicheng, et al.
Pubblicazione: (2023)
Documenti analoghi
-
ClueTracer: Question-to-Vision Clue Tracing for Training-Free Hallucination Suppression in Multimodal Reasoning
di: Xi, Gongli, et al.
Pubblicazione: (2026) -
C3-Diff: Super-resolving Spatial Transcriptomics via Cross-modal Cross-content Contrastive Diffusion Modelling
di: Wang, Xiaofei, et al.
Pubblicazione: (2025) -
UniEval: Unified Holistic Evaluation for Unified Multimodal Understanding and Generation
di: Li, Yi, et al.
Pubblicazione: (2025) -
Understanding and Harnessing Sparsity in Unified Multimodal Models
di: He, Shwai, et al.
Pubblicazione: (2025) -
Semantic Generative Tuning for Unified Multimodal Models
di: Yu, Songsong, et al.
Pubblicazione: (2026)