Towards Interpretable Counterfactual Generation via Multimodal Autoregression
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ma, Chenglong, Ji, Yuanfeng, Ye, Jin, Zhang, Lu, Chen, Ying, Li, Tianbin, Li, Mingjie, He, Junjun, Shan, Hongming |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Unified Medical Image Tokenizer for Autoregressive Synthesis and Understanding
par: Ma, Chenglong, et autres
Publié: (2025)
par: Ma, Chenglong, et autres
Publié: (2025)
Prompted Contextual Transformer for Incomplete-View CT Reconstruction
par: Ma, Chenglong, et autres
Publié: (2023)
par: Ma, Chenglong, et autres
Publié: (2023)
SegBook: A Simple Baseline and Cookbook for Volumetric Medical Image Segmentation
par: Ye, Jin, et autres
Publié: (2024)
par: Ye, Jin, et autres
Publié: (2024)
GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI
par: Chen, Pengcheng, et autres
Publié: (2024)
par: Chen, Pengcheng, et autres
Publié: (2024)
OmniMedVQA: A New Large-Scale Comprehensive Evaluation Benchmark for Medical LVLM
par: Hu, Yutao, et autres
Publié: (2024)
par: Hu, Yutao, et autres
Publié: (2024)
RetinaLogos: Fine-Grained Synthesis of High-Resolution Retinal Images Through Captions
par: Ning, Junzhi, et autres
Publié: (2025)
par: Ning, Junzhi, et autres
Publié: (2025)
Semantics Guided Disentangled GAN for Chest X-ray Image Rib Segmentation
par: Huang, Lili, et autres
Publié: (2024)
par: Huang, Lili, et autres
Publié: (2024)
Promptable Counterfactual Diffusion Model for Unified Brain Tumor Segmentation and Generation with MRIs
par: Shen, Yiqing, et autres
Publié: (2024)
par: Shen, Yiqing, et autres
Publié: (2024)
HOPE: Hybrid-granularity Ordinal Prototype Learning for Progression Prediction of Mild Cognitive Impairment
par: Wang, Chenhui, et autres
Publié: (2024)
par: Wang, Chenhui, et autres
Publié: (2024)
Skill-Evolving Grounded Reasoning for Free-Text Promptable 3D Medical Image Segmentation
par: Zhang, Tongrui, et autres
Publié: (2026)
par: Zhang, Tongrui, et autres
Publié: (2026)
Radiologist-in-the-Loop Self-Training for Generalizable CT Metal Artifact Reduction
par: Ma, Chenglong, et autres
Publié: (2025)
par: Ma, Chenglong, et autres
Publié: (2025)
Towards Backward-Compatible Continual Learning of Image Compression
par: Duan, Zhihao, et autres
Publié: (2024)
par: Duan, Zhihao, et autres
Publié: (2024)
Image Generation with Supervised Selection Based on Multimodal Features for Semantic Communications
par: Liang, Chengyang, et autres
Publié: (2024)
par: Liang, Chengyang, et autres
Publié: (2024)
Semantic Satellite Communications Based on Generative Foundation Model
par: Jiang, Peiwen, et autres
Publié: (2024)
par: Jiang, Peiwen, et autres
Publié: (2024)
Diffusion-based Counterfactual Augmentation: Towards Robust and Interpretable Knee Osteoarthritis Grading
par: Wang, Zhe, et autres
Publié: (2025)
par: Wang, Zhe, et autres
Publié: (2025)
A-Eval: A Benchmark for Cross-Dataset Evaluation of Abdominal Multi-Organ Segmentation
par: Huang, Ziyan, et autres
Publié: (2023)
par: Huang, Ziyan, et autres
Publié: (2023)
Neighboring Autoregressive Modeling for Efficient Visual Generation
par: He, Yefei, et autres
Publié: (2025)
par: He, Yefei, et autres
Publié: (2025)
Exploring Autoregressive Vision Foundation Models for Image Compression
par: Phung, Huu-Tai, et autres
Publié: (2025)
par: Phung, Huu-Tai, et autres
Publié: (2025)
Highly Undersampled MRI Reconstruction via a Single Posterior Sampling of Diffusion Models
par: Liu, Jin, et autres
Publié: (2025)
par: Liu, Jin, et autres
Publié: (2025)
Accelerating Training of Autoregressive Video Generation Models via Local Optimization with Representation Continuity
par: Zhou, Yucheng, et autres
Publié: (2026)
par: Zhou, Yucheng, et autres
Publié: (2026)
GroupCDL: Interpretable Denoising and Compressed Sensing MRI via Learned Group-Sparsity and Circulant Attention
par: Janjusevic, Nikola, et autres
Publié: (2024)
par: Janjusevic, Nikola, et autres
Publié: (2024)
Goal-Oriented Semantic Communication for Wireless Video Transmission via Generative AI
par: Li, Nan, et autres
Publié: (2025)
par: Li, Nan, et autres
Publié: (2025)
FM2S: Towards Spatially-Correlated Noise Modeling in Zero-Shot Fluorescence Microscopy Image Denoising
par: Liu, Jizhihui, et autres
Publié: (2024)
par: Liu, Jizhihui, et autres
Publié: (2024)
TinyUSFM: Towards Compact and Efficient Ultrasound Foundation Models
par: Ma, Chen, et autres
Publié: (2025)
par: Ma, Chen, et autres
Publié: (2025)
U-Net-Based Generative Joint Source-Channel Coding for Wireless Image Transmission
par: Ye, Ming, et autres
Publié: (2026)
par: Ye, Ming, et autres
Publié: (2026)
TVMC: Time-Varying Mesh Compression via Multi-Stage Anchor Mesh Generation
par: Huang, He, et autres
Publié: (2025)
par: Huang, He, et autres
Publié: (2025)
Wireless Semantic Communications for Video Conferencing
par: Jiang, Peiwen, et autres
Publié: (2022)
par: Jiang, Peiwen, et autres
Publié: (2022)
Evaluation of 3D Counterfactual Brain MRI Generation
par: Sun, Pengwei, et autres
Publié: (2025)
par: Sun, Pengwei, et autres
Publié: (2025)
Multimodal Fusion of Skeleton Dynamics and Clinical Gait Features for Video-Based Cerebral Palsy Severity Assessment
par: Yang, Kaiyuan, et autres
Publié: (2026)
par: Yang, Kaiyuan, et autres
Publié: (2026)
AI Alignment in Medical Imaging: Unveiling Hidden Biases Through Counterfactual Analysis
par: Ma, Haroui, et autres
Publié: (2025)
par: Ma, Haroui, et autres
Publié: (2025)
Defining Robust Ultrasound Quality Metrics via an Ultrasound Foundation Model
par: Huang, Ziyang, et autres
Publié: (2026)
par: Huang, Ziyang, et autres
Publié: (2026)
Artificial Intelligence-Enhanced Couinaud Segmentation for Precision Liver Cancer Therapy
par: Qiu, Liang, et autres
Publié: (2024)
par: Qiu, Liang, et autres
Publié: (2024)
Feature Compression for Cloud-Edge Multimodal 3D Object Detection
par: Tian, Chongzhen, et autres
Publié: (2024)
par: Tian, Chongzhen, et autres
Publié: (2024)
Multimodal Medical Image Binding via Shared Text Embeddings
par: Liu, Yunhao, et autres
Publié: (2025)
par: Liu, Yunhao, et autres
Publié: (2025)
HippoMM: Hippocampal-inspired Multimodal Memory for Long Audiovisual Event Understanding
par: Lin, Yueqian, et autres
Publié: (2025)
par: Lin, Yueqian, et autres
Publié: (2025)
Noise-Inspired Diffusion Model for Generalizable Low-Dose CT Reconstruction
par: Gao, Qi, et autres
Publié: (2025)
par: Gao, Qi, et autres
Publié: (2025)
Adaptive Online Learning of Separable Path Graph Transforms for Intra-prediction
par: Lu, Wen-Yang, et autres
Publié: (2024)
par: Lu, Wen-Yang, et autres
Publié: (2024)
CardiacFlow: 3D+t Four-Chamber Cardiac Shape Completion and Generation via Flow Matching
par: Ma, Qiang, et autres
Publié: (2025)
par: Ma, Qiang, et autres
Publié: (2025)
Reinforced Rate Control for Neural Video Compression via Inter-Frame Rate-Distortion Awareness
par: Cong, Wuyang, et autres
Publié: (2026)
par: Cong, Wuyang, et autres
Publié: (2026)
Robust Target Detection of Intelligent Integrated Optical Camera and mmWave Radar System
par: Zhu, Chen, et autres
Publié: (2023)
par: Zhu, Chen, et autres
Publié: (2023)
Documents similaires
-
Unified Medical Image Tokenizer for Autoregressive Synthesis and Understanding
par: Ma, Chenglong, et autres
Publié: (2025) -
Prompted Contextual Transformer for Incomplete-View CT Reconstruction
par: Ma, Chenglong, et autres
Publié: (2023) -
SegBook: A Simple Baseline and Cookbook for Volumetric Medical Image Segmentation
par: Ye, Jin, et autres
Publié: (2024) -
GMAI-MMBench: A Comprehensive Multimodal Evaluation Benchmark Towards General Medical AI
par: Chen, Pengcheng, et autres
Publié: (2024) -
OmniMedVQA: A New Large-Scale Comprehensive Evaluation Benchmark for Medical LVLM
par: Hu, Yutao, et autres
Publié: (2024)