Medical Report Generation: A Hierarchical Task Structure-Based Cross-Modal Causal Intervention Framework
Fuente:
arXiv
Saved in:
| Main Authors: | Song, Yucheng, Ge, Yifan, Li, Junhao, Liao, Zhining, Liao, Zhifang |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
FGML-DG: Feynman-Inspired Cognitive Science Paradigm for Cross-Domain Medical Image Segmentation
by: Song, Yucheng, et al.
Published: (2026)
by: Song, Yucheng, et al.
Published: (2026)
TreeFedDG: Alleviating Global Drift in Federated Domain Generalization for Medical Image Segmentation
by: Song, Yucheng, et al.
Published: (2025)
by: Song, Yucheng, et al.
Published: (2025)
Cross-Modal Causal Intervention for Medical Report Generation
by: Chen, Weixing, et al.
Published: (2023)
by: Chen, Weixing, et al.
Published: (2023)
Exploring Boundary-Aware Spatial-Frequency Fusion for Camouflaged Object Detection
by: Yu, Song, et al.
Published: (2026)
by: Yu, Song, et al.
Published: (2026)
ClinKD: Cross-Modal Clinical Knowledge Distiller For Multi-Task Medical Images
by: Ge, Hongyu, et al.
Published: (2025)
by: Ge, Hongyu, et al.
Published: (2025)
AnimeGamer: Infinite Anime Life Simulation with Next Game State Prediction
by: Cheng, Junhao, et al.
Published: (2025)
by: Cheng, Junhao, et al.
Published: (2025)
Source-Free Cross-Modal Knowledge Transfer by Unleashing the Potential of Task-Irrelevant Data
by: Zhu, Jinjing, et al.
Published: (2024)
by: Zhu, Jinjing, et al.
Published: (2024)
Robust Egocentric Referring Video Object Segmentation via Dual-Modal Causal Intervention
by: Liu, Haijing, et al.
Published: (2025)
by: Liu, Haijing, et al.
Published: (2025)
Cross Modality Image Translation In Medical Imaging Using Generative Frameworks
by: Romoli, Giulia, et al.
Published: (2026)
by: Romoli, Giulia, et al.
Published: (2026)
Video-Holmes: Can MLLM Think Like Holmes for Complex Video Reasoning?
by: Cheng, Junhao, et al.
Published: (2025)
by: Cheng, Junhao, et al.
Published: (2025)
Video-as-Answer: Predict and Generate Next Video Event with Joint-GRPO
by: Cheng, Junhao, et al.
Published: (2025)
by: Cheng, Junhao, et al.
Published: (2025)
Prototype-Enhanced Confidence Modeling for Cross-Modal Medical Image-Report Retrieval
by: Gowda, Shreyank N, et al.
Published: (2025)
by: Gowda, Shreyank N, et al.
Published: (2025)
VIHD: Visual Intervention-based Hallucination Detection for Medical Visual Question Answering
by: Chen, Jiayi, et al.
Published: (2026)
by: Chen, Jiayi, et al.
Published: (2026)
Cross-Modal Clinical Knowledge Integration for Mammography Report Generation
by: Zhu, Jiayi, et al.
Published: (2026)
by: Zhu, Jiayi, et al.
Published: (2026)
Semantic Causality-Aware Vision-Based 3D Occupancy Prediction
by: Chen, Dubing, et al.
Published: (2025)
by: Chen, Dubing, et al.
Published: (2025)
Improving Joint Audio-Video Generation with Cross-Modal Context Learning
by: Ma, Bingqi, et al.
Published: (2026)
by: Ma, Bingqi, et al.
Published: (2026)
Interpreting and Enhancing Emotional Circuits in Large Vision-Language Models via Cross-Modal Information Flow
by: Zhang, Chengsheng, et al.
Published: (2026)
by: Zhang, Chengsheng, et al.
Published: (2026)
Multi-View Industrial Anomaly Detection with Epipolar Constrained Cross-View Fusion
by: Liu, Yifan, et al.
Published: (2025)
by: Liu, Yifan, et al.
Published: (2025)
RHVI-FDD: A Hierarchical Decoupling Framework for Low-Light Image Enhancement
by: Yang, Junhao, et al.
Published: (2026)
by: Yang, Junhao, et al.
Published: (2026)
CausalCLIPSeg: Unlocking CLIP's Potential in Referring Medical Image Segmentation with Causal Intervention
by: Chen, Yaxiong, et al.
Published: (2025)
by: Chen, Yaxiong, et al.
Published: (2025)
Cross-Modal Clustering-Guided Negative Sampling for Self-Supervised Joint Learning from Medical Images and Reports
by: Lan, Libin, et al.
Published: (2025)
by: Lan, Libin, et al.
Published: (2025)
MetaSSL: A General Heterogeneous Loss for Semi-Supervised Medical Image Segmentation
by: Zhao, Weiren, et al.
Published: (2025)
by: Zhao, Weiren, et al.
Published: (2025)
RIHA: Report-Image Hierarchical Alignment for Radiology Report Generation
by: Chen, Yucheng, et al.
Published: (2026)
by: Chen, Yucheng, et al.
Published: (2026)
Ultrasound Report Generation with Cross-Modality Feature Alignment via Unsupervised Guidance
by: Li, Jun, et al.
Published: (2024)
by: Li, Jun, et al.
Published: (2024)
Rad-VLSM: A Cross-Modal Framework with Semantics-Assisted Prompting for Medical Segmentation and Diagnosis
by: Zhang, Fengyi, et al.
Published: (2026)
by: Zhang, Fengyi, et al.
Published: (2026)
Character Mixing for Video Generation
by: Liao, Tingting, et al.
Published: (2025)
by: Liao, Tingting, et al.
Published: (2025)
Federated Learning for Cross-Modality Medical Image Segmentation via Augmentation-Driven Generalization
by: Nagaraju, Sachin Dudda, et al.
Published: (2026)
by: Nagaraju, Sachin Dudda, et al.
Published: (2026)
Image Translation-Based Unsupervised Cross-Modality Domain Adaptation for Medical Image Segmentation
by: Yang, Tao, et al.
Published: (2025)
by: Yang, Tao, et al.
Published: (2025)
MedRAT: Unpaired Medical Report Generation via Auxiliary Tasks
by: Hirsch, Elad, et al.
Published: (2024)
by: Hirsch, Elad, et al.
Published: (2024)
Cross-Modal Conditioned Reconstruction for Language-guided Medical Image Segmentation
by: Huang, Xiaoshuang, et al.
Published: (2024)
by: Huang, Xiaoshuang, et al.
Published: (2024)
DecAlign: Hierarchical Cross-Modal Alignment for Decoupled Multimodal Representation Learning
by: Qian, Chengxuan, et al.
Published: (2025)
by: Qian, Chengxuan, et al.
Published: (2025)
DMAF-Net: An Effective Modality Rebalancing Framework for Incomplete Multi-Modal Medical Image Segmentation
by: Lan, Libin, et al.
Published: (2025)
by: Lan, Libin, et al.
Published: (2025)
ToLL: Topological Layout Learning with Asymmetric Cross-View Structural Distillation for 3D Scene Graph Generation Pretraining
by: Huang, Yucheng, et al.
Published: (2026)
by: Huang, Yucheng, et al.
Published: (2026)
Integrating MedCLIP and Cross-Modal Fusion for Automatic Radiology Report Generation
by: Han, Qianhao, et al.
Published: (2024)
by: Han, Qianhao, et al.
Published: (2024)
A Labeled Ophthalmic Ultrasound Dataset with Medical Report Generation Based on Cross-modal Deep Learning
by: Wang, Jing, et al.
Published: (2024)
by: Wang, Jing, et al.
Published: (2024)
Continual Cross-Modal Generalization
by: Xia, Yan, et al.
Published: (2025)
by: Xia, Yan, et al.
Published: (2025)
Enhancing Cross-Modal Medical Image Segmentation through Compositionality
by: Eijpe, Aniek, et al.
Published: (2024)
by: Eijpe, Aniek, et al.
Published: (2024)
Cross-Modal Dual-Causal Learning for Long-Term Action Recognition
by: Shaowu, Xu, et al.
Published: (2025)
by: Shaowu, Xu, et al.
Published: (2025)
Causality-based Cross-Modal Representation Learning for Vision-and-Language Navigation
by: Wang, Liuyi, et al.
Published: (2024)
by: Wang, Liuyi, et al.
Published: (2024)
Causal Disentanglement and Cross-Modal Alignment for Enhanced Few-Shot Learning
by: Jiang, Tianjiao, et al.
Published: (2025)
by: Jiang, Tianjiao, et al.
Published: (2025)
Similar Items
-
FGML-DG: Feynman-Inspired Cognitive Science Paradigm for Cross-Domain Medical Image Segmentation
by: Song, Yucheng, et al.
Published: (2026) -
TreeFedDG: Alleviating Global Drift in Federated Domain Generalization for Medical Image Segmentation
by: Song, Yucheng, et al.
Published: (2025) -
Cross-Modal Causal Intervention for Medical Report Generation
by: Chen, Weixing, et al.
Published: (2023) -
Exploring Boundary-Aware Spatial-Frequency Fusion for Camouflaged Object Detection
by: Yu, Song, et al.
Published: (2026) -
ClinKD: Cross-Modal Clinical Knowledge Distiller For Multi-Task Medical Images
by: Ge, Hongyu, et al.
Published: (2025)