Self-Supervised Anatomical Consistency Learning for Vision-Grounded Medical Report Generation
Fuente:
arXiv
Saved in:
| Main Authors: | Yang, Longzhen, Ni, Zhangkai, Wen, Ying, Liu, Yihang, He, Lianghua, Shen, Heng Tao |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
M-IDoL: Information Decomposition for Modality-Specific and Diverse Representation Learning in Medical Foundation Model
by: Liu, Yihang, et al.
Published: (2026)
by: Liu, Yihang, et al.
Published: (2026)
AFiRe: Anatomy-Driven Self-Supervised Learning for Fine-Grained Representation in Radiographic Images
by: Liu, Yihang, et al.
Published: (2025)
by: Liu, Yihang, et al.
Published: (2025)
EntropyPrune: Matrix Entropy Guided Visual Token Pruning for Multimodal Large Language Models
by: Wang, Yahong, et al.
Published: (2026)
by: Wang, Yahong, et al.
Published: (2026)
When Token Pruning is Worse than Random: Understanding Visual Token Information in VLLMs
by: Wang, Yahong, et al.
Published: (2025)
by: Wang, Yahong, et al.
Published: (2025)
Visual Neural Decoding via Improved Visual-EEG Semantic Consistency
by: Chen, Hongzhou, et al.
Published: (2024)
by: Chen, Hongzhou, et al.
Published: (2024)
Wavelet-Domain Masked Image Modeling for Color-Consistent HDR Video Reconstruction
by: Zhang, Yang, et al.
Published: (2026)
by: Zhang, Yang, et al.
Published: (2026)
Perceptual-GS: Scene-adaptive Perceptual Densification for Gaussian Splatting
by: Zhou, Hongbi, et al.
Published: (2025)
by: Zhou, Hongbi, et al.
Published: (2025)
FlowBypass: Rectified Flow Trajectory Bypass for Training-Free Image Editing
by: Han, Menglin, et al.
Published: (2026)
by: Han, Menglin, et al.
Published: (2026)
Octree-GS: Towards Consistent Real-time Rendering with LOD-Structured 3D Gaussians
by: Ren, Kerui, et al.
Published: (2024)
by: Ren, Kerui, et al.
Published: (2024)
Prototype Contrastive Consistency Learning for Semi-Supervised Medical Image Segmentation
by: He, Shihuan, et al.
Published: (2025)
by: He, Shihuan, et al.
Published: (2025)
VALA: Learning Latent Anchors for Training-Free and Temporally Consistent
by: Wu, Zhangkai, et al.
Published: (2025)
by: Wu, Zhangkai, et al.
Published: (2025)
Visual Alignment of Medical Vision-Language Models for Grounded Radiology Report Generation
by: Bose, Sarosij, et al.
Published: (2025)
by: Bose, Sarosij, et al.
Published: (2025)
Whitening Consistently Improves Self-Supervised Learning
by: Kalapos, András, et al.
Published: (2024)
by: Kalapos, András, et al.
Published: (2024)
AFUNet: Cross-Iterative Alignment-Fusion Synergy for HDR Reconstruction via Deep Unfolding Paradigm
by: Li, Xinyue, et al.
Published: (2025)
by: Li, Xinyue, et al.
Published: (2025)
Learning Anatomically Consistent Embedding for Chest Radiography
by: Zhou, Ziyu, et al.
Published: (2023)
by: Zhou, Ziyu, et al.
Published: (2023)
TRACE: Temporal Radiology with Anatomical Change Explanation for Grounded X-ray Report Generation
by: Aranya, OFM Riaz Rahman, et al.
Published: (2026)
by: Aranya, OFM Riaz Rahman, et al.
Published: (2026)
SCoT: Unifying Consistency Models and Rectified Flows via Straight-Consistent Trajectories
by: Wu, Zhangkai, et al.
Published: (2025)
by: Wu, Zhangkai, et al.
Published: (2025)
Anatomical Structure-Guided Medical Vision-Language Pre-training
by: Li, Qingqiu, et al.
Published: (2024)
by: Li, Qingqiu, et al.
Published: (2024)
Semi-Supervised Medical Image Segmentation via Dual Networks
by: Lu, Yunyao, et al.
Published: (2025)
by: Lu, Yunyao, et al.
Published: (2025)
Self-Paced Sample Selection for Barely-Supervised Medical Image Segmentation
by: Su, Junming, et al.
Published: (2024)
by: Su, Junming, et al.
Published: (2024)
On Robust Cross-View Consistency in Self-Supervised Monocular Depth Estimation
by: Zhao, Haimei, et al.
Published: (2022)
by: Zhao, Haimei, et al.
Published: (2022)
Decoupled Spatio-Temporal Consistency Learning for Self-Supervised Tracking
by: Zheng, Yaozong, et al.
Published: (2025)
by: Zheng, Yaozong, et al.
Published: (2025)
Hierarchical Consistency Learning for Test-time Adaptation in Camouflage Perception
by: Zha, Mingfeng, et al.
Published: (2026)
by: Zha, Mingfeng, et al.
Published: (2026)
Semantic Graph Consistency: Going Beyond Patches for Regularizing Self-Supervised Vision Transformers
by: Devaguptapu, Chaitanya, et al.
Published: (2024)
by: Devaguptapu, Chaitanya, et al.
Published: (2024)
Region-aware Distribution Contrast: A Novel Approach to Multi-Task Partially Supervised Learning
by: Li, Meixuan, et al.
Published: (2024)
by: Li, Meixuan, et al.
Published: (2024)
Fake It Right: Injecting Anatomical Logic into Synthetic Supervised Pre-training for Medical Segmentation
by: Tang, Jiaqi, et al.
Published: (2026)
by: Tang, Jiaqi, et al.
Published: (2026)
Self-Supervised Alignment Learning for Medical Image Segmentation
by: Li, Haofeng, et al.
Published: (2024)
by: Li, Haofeng, et al.
Published: (2024)
Context Consistency Learning via Sentence Removal for Semi-Supervised Video Paragraph Grounding
by: Zhong, Yaokun, et al.
Published: (2025)
by: Zhong, Yaokun, et al.
Published: (2025)
Anatomical Attention Alignment representation for Radiology Report Generation
by: Nguyen, Quang Vinh, et al.
Published: (2025)
by: Nguyen, Quang Vinh, et al.
Published: (2025)
VisionNVS: Self-Supervised Inpainting for Novel View Synthesis under the Virtual-Shift Paradigm
by: Lu, Hongbo, et al.
Published: (2026)
by: Lu, Hongbo, et al.
Published: (2026)
Hierarchical Salient Patch Identification for Interpretable Fundus Disease Localization
by: Peng, Yitao, et al.
Published: (2024)
by: Peng, Yitao, et al.
Published: (2024)
ProtoSolo: Interpretable Image Classification via Single-Prototype Activation
by: Peng, Yitao, et al.
Published: (2025)
by: Peng, Yitao, et al.
Published: (2025)
Generate to Ground: Multimodal Text Conditioning Boosts Phrase Grounding in Medical Vision-Language Models
by: Nützel, Felix, et al.
Published: (2025)
by: Nützel, Felix, et al.
Published: (2025)
Unrolled Decomposed Unpaired Learning for Controllable Low-Light Video Enhancement
by: Zhu, Lingyu, et al.
Published: (2024)
by: Zhu, Lingyu, et al.
Published: (2024)
A Generative Framework for Self-Supervised Facial Representation Learning
by: He, Ruian, et al.
Published: (2023)
by: He, Ruian, et al.
Published: (2023)
Pattern Integration and Enhancement Vision Transformer for Self-Supervised Learning in Remote Sensing
by: Lu, Kaixuan, et al.
Published: (2024)
by: Lu, Kaixuan, et al.
Published: (2024)
MedCycle: Unpaired Medical Report Generation via Cycle-Consistency
by: Hirsch, Elad, et al.
Published: (2024)
by: Hirsch, Elad, et al.
Published: (2024)
Adversarial Robustness of Discriminative Self-Supervised Learning in Vision
by: Çağatan, Ömer Veysel, et al.
Published: (2025)
by: Çağatan, Ömer Veysel, et al.
Published: (2025)
EvRepSL: Event-Stream Representation via Self-Supervised Learning for Event-Based Vision
by: Qu, Qiang, et al.
Published: (2024)
by: Qu, Qiang, et al.
Published: (2024)
Unified Generation and Self-Verification for Vision-Language Models via Advantage Decoupled Preference Optimization
by: Qiu, Xinyu, et al.
Published: (2026)
by: Qiu, Xinyu, et al.
Published: (2026)
Similar Items
-
M-IDoL: Information Decomposition for Modality-Specific and Diverse Representation Learning in Medical Foundation Model
by: Liu, Yihang, et al.
Published: (2026) -
AFiRe: Anatomy-Driven Self-Supervised Learning for Fine-Grained Representation in Radiographic Images
by: Liu, Yihang, et al.
Published: (2025) -
EntropyPrune: Matrix Entropy Guided Visual Token Pruning for Multimodal Large Language Models
by: Wang, Yahong, et al.
Published: (2026) -
When Token Pruning is Worse than Random: Understanding Visual Token Information in VLLMs
by: Wang, Yahong, et al.
Published: (2025) -
Visual Neural Decoding via Improved Visual-EEG Semantic Consistency
by: Chen, Hongzhou, et al.
Published: (2024)