Medical Report Generation: A Hierarchical Task Structure-Based Cross-Modal Causal Intervention Framework
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Song, Yucheng, Ge, Yifan, Li, Junhao, Liao, Zhining, Liao, Zhifang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FGML-DG: Feynman-Inspired Cognitive Science Paradigm for Cross-Domain Medical Image Segmentation
par: Song, Yucheng, et autres
Publié: (2026)
par: Song, Yucheng, et autres
Publié: (2026)
TreeFedDG: Alleviating Global Drift in Federated Domain Generalization for Medical Image Segmentation
par: Song, Yucheng, et autres
Publié: (2025)
par: Song, Yucheng, et autres
Publié: (2025)
Cross-Modal Causal Intervention for Medical Report Generation
par: Chen, Weixing, et autres
Publié: (2023)
par: Chen, Weixing, et autres
Publié: (2023)
Exploring Boundary-Aware Spatial-Frequency Fusion for Camouflaged Object Detection
par: Yu, Song, et autres
Publié: (2026)
par: Yu, Song, et autres
Publié: (2026)
ClinKD: Cross-Modal Clinical Knowledge Distiller For Multi-Task Medical Images
par: Ge, Hongyu, et autres
Publié: (2025)
par: Ge, Hongyu, et autres
Publié: (2025)
AnimeGamer: Infinite Anime Life Simulation with Next Game State Prediction
par: Cheng, Junhao, et autres
Publié: (2025)
par: Cheng, Junhao, et autres
Publié: (2025)
Source-Free Cross-Modal Knowledge Transfer by Unleashing the Potential of Task-Irrelevant Data
par: Zhu, Jinjing, et autres
Publié: (2024)
par: Zhu, Jinjing, et autres
Publié: (2024)
Robust Egocentric Referring Video Object Segmentation via Dual-Modal Causal Intervention
par: Liu, Haijing, et autres
Publié: (2025)
par: Liu, Haijing, et autres
Publié: (2025)
Cross Modality Image Translation In Medical Imaging Using Generative Frameworks
par: Romoli, Giulia, et autres
Publié: (2026)
par: Romoli, Giulia, et autres
Publié: (2026)
Video-Holmes: Can MLLM Think Like Holmes for Complex Video Reasoning?
par: Cheng, Junhao, et autres
Publié: (2025)
par: Cheng, Junhao, et autres
Publié: (2025)
Video-as-Answer: Predict and Generate Next Video Event with Joint-GRPO
par: Cheng, Junhao, et autres
Publié: (2025)
par: Cheng, Junhao, et autres
Publié: (2025)
Prototype-Enhanced Confidence Modeling for Cross-Modal Medical Image-Report Retrieval
par: Gowda, Shreyank N, et autres
Publié: (2025)
par: Gowda, Shreyank N, et autres
Publié: (2025)
VIHD: Visual Intervention-based Hallucination Detection for Medical Visual Question Answering
par: Chen, Jiayi, et autres
Publié: (2026)
par: Chen, Jiayi, et autres
Publié: (2026)
Cross-Modal Clinical Knowledge Integration for Mammography Report Generation
par: Zhu, Jiayi, et autres
Publié: (2026)
par: Zhu, Jiayi, et autres
Publié: (2026)
Semantic Causality-Aware Vision-Based 3D Occupancy Prediction
par: Chen, Dubing, et autres
Publié: (2025)
par: Chen, Dubing, et autres
Publié: (2025)
Improving Joint Audio-Video Generation with Cross-Modal Context Learning
par: Ma, Bingqi, et autres
Publié: (2026)
par: Ma, Bingqi, et autres
Publié: (2026)
Interpreting and Enhancing Emotional Circuits in Large Vision-Language Models via Cross-Modal Information Flow
par: Zhang, Chengsheng, et autres
Publié: (2026)
par: Zhang, Chengsheng, et autres
Publié: (2026)
Multi-View Industrial Anomaly Detection with Epipolar Constrained Cross-View Fusion
par: Liu, Yifan, et autres
Publié: (2025)
par: Liu, Yifan, et autres
Publié: (2025)
RHVI-FDD: A Hierarchical Decoupling Framework for Low-Light Image Enhancement
par: Yang, Junhao, et autres
Publié: (2026)
par: Yang, Junhao, et autres
Publié: (2026)
CausalCLIPSeg: Unlocking CLIP's Potential in Referring Medical Image Segmentation with Causal Intervention
par: Chen, Yaxiong, et autres
Publié: (2025)
par: Chen, Yaxiong, et autres
Publié: (2025)
Cross-Modal Clustering-Guided Negative Sampling for Self-Supervised Joint Learning from Medical Images and Reports
par: Lan, Libin, et autres
Publié: (2025)
par: Lan, Libin, et autres
Publié: (2025)
MetaSSL: A General Heterogeneous Loss for Semi-Supervised Medical Image Segmentation
par: Zhao, Weiren, et autres
Publié: (2025)
par: Zhao, Weiren, et autres
Publié: (2025)
RIHA: Report-Image Hierarchical Alignment for Radiology Report Generation
par: Chen, Yucheng, et autres
Publié: (2026)
par: Chen, Yucheng, et autres
Publié: (2026)
Ultrasound Report Generation with Cross-Modality Feature Alignment via Unsupervised Guidance
par: Li, Jun, et autres
Publié: (2024)
par: Li, Jun, et autres
Publié: (2024)
Rad-VLSM: A Cross-Modal Framework with Semantics-Assisted Prompting for Medical Segmentation and Diagnosis
par: Zhang, Fengyi, et autres
Publié: (2026)
par: Zhang, Fengyi, et autres
Publié: (2026)
Character Mixing for Video Generation
par: Liao, Tingting, et autres
Publié: (2025)
par: Liao, Tingting, et autres
Publié: (2025)
Federated Learning for Cross-Modality Medical Image Segmentation via Augmentation-Driven Generalization
par: Nagaraju, Sachin Dudda, et autres
Publié: (2026)
par: Nagaraju, Sachin Dudda, et autres
Publié: (2026)
Image Translation-Based Unsupervised Cross-Modality Domain Adaptation for Medical Image Segmentation
par: Yang, Tao, et autres
Publié: (2025)
par: Yang, Tao, et autres
Publié: (2025)
MedRAT: Unpaired Medical Report Generation via Auxiliary Tasks
par: Hirsch, Elad, et autres
Publié: (2024)
par: Hirsch, Elad, et autres
Publié: (2024)
Cross-Modal Conditioned Reconstruction for Language-guided Medical Image Segmentation
par: Huang, Xiaoshuang, et autres
Publié: (2024)
par: Huang, Xiaoshuang, et autres
Publié: (2024)
DecAlign: Hierarchical Cross-Modal Alignment for Decoupled Multimodal Representation Learning
par: Qian, Chengxuan, et autres
Publié: (2025)
par: Qian, Chengxuan, et autres
Publié: (2025)
DMAF-Net: An Effective Modality Rebalancing Framework for Incomplete Multi-Modal Medical Image Segmentation
par: Lan, Libin, et autres
Publié: (2025)
par: Lan, Libin, et autres
Publié: (2025)
ToLL: Topological Layout Learning with Asymmetric Cross-View Structural Distillation for 3D Scene Graph Generation Pretraining
par: Huang, Yucheng, et autres
Publié: (2026)
par: Huang, Yucheng, et autres
Publié: (2026)
Integrating MedCLIP and Cross-Modal Fusion for Automatic Radiology Report Generation
par: Han, Qianhao, et autres
Publié: (2024)
par: Han, Qianhao, et autres
Publié: (2024)
A Labeled Ophthalmic Ultrasound Dataset with Medical Report Generation Based on Cross-modal Deep Learning
par: Wang, Jing, et autres
Publié: (2024)
par: Wang, Jing, et autres
Publié: (2024)
Continual Cross-Modal Generalization
par: Xia, Yan, et autres
Publié: (2025)
par: Xia, Yan, et autres
Publié: (2025)
Enhancing Cross-Modal Medical Image Segmentation through Compositionality
par: Eijpe, Aniek, et autres
Publié: (2024)
par: Eijpe, Aniek, et autres
Publié: (2024)
Cross-Modal Dual-Causal Learning for Long-Term Action Recognition
par: Shaowu, Xu, et autres
Publié: (2025)
par: Shaowu, Xu, et autres
Publié: (2025)
Causality-based Cross-Modal Representation Learning for Vision-and-Language Navigation
par: Wang, Liuyi, et autres
Publié: (2024)
par: Wang, Liuyi, et autres
Publié: (2024)
Causal Disentanglement and Cross-Modal Alignment for Enhanced Few-Shot Learning
par: Jiang, Tianjiao, et autres
Publié: (2025)
par: Jiang, Tianjiao, et autres
Publié: (2025)
Documents similaires
-
FGML-DG: Feynman-Inspired Cognitive Science Paradigm for Cross-Domain Medical Image Segmentation
par: Song, Yucheng, et autres
Publié: (2026) -
TreeFedDG: Alleviating Global Drift in Federated Domain Generalization for Medical Image Segmentation
par: Song, Yucheng, et autres
Publié: (2025) -
Cross-Modal Causal Intervention for Medical Report Generation
par: Chen, Weixing, et autres
Publié: (2023) -
Exploring Boundary-Aware Spatial-Frequency Fusion for Camouflaged Object Detection
par: Yu, Song, et autres
Publié: (2026) -
ClinKD: Cross-Modal Clinical Knowledge Distiller For Multi-Task Medical Images
par: Ge, Hongyu, et autres
Publié: (2025)