Enhancing Reinforcement Learning for Radiology Report Generation with Evidence-aware Rewards and Self-correcting Preference Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Zhou, Qin, Liang, Guoyan, Yang, Qianyi, Chen, Jingyuan, Wu, Sai, Yao, Chang, Wang, Zhe |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation
by: Zhou, Qin, et al.
Published: (2025)
by: Zhou, Qin, et al.
Published: (2025)
Advancing Medical Image Segmentation via Self-supervised Instance-adaptive Prototype Learning
by: Liang, Guoyan, et al.
Published: (2025)
by: Liang, Guoyan, et al.
Published: (2025)
Semantic-guided Masked Mutual Learning for Multi-modal Brain Tumor Segmentation with Arbitrary Missing Modalities
by: Liang, Guoyan, et al.
Published: (2025)
by: Liang, Guoyan, et al.
Published: (2025)
Deconfounding via Profiled Transfer Learning
by: Chen, Ziyuan, et al.
Published: (2025)
by: Chen, Ziyuan, et al.
Published: (2025)
STEEL: Singularity-aware Reinforcement Learning
by: Chen, Xiaohong, et al.
Published: (2023)
by: Chen, Xiaohong, et al.
Published: (2023)
Just Ramp-up: Unleash the Potential of Regression-based Estimator for A/B Tests under Network Interference
by: Chen, Qianyi, et al.
Published: (2024)
by: Chen, Qianyi, et al.
Published: (2024)
Preference-based Centrality and Ranking in General Metric Spaces
by: Lyu, Lingfeng, et al.
Published: (2026)
by: Lyu, Lingfeng, et al.
Published: (2026)
Separating and Learning Latent Confounders to Enhancing User Preferences Modeling
by: Xu, Hangtong, et al.
Published: (2023)
by: Xu, Hangtong, et al.
Published: (2023)
A General Control-Theoretic Approach for Reinforcement Learning: Theory and Algorithms
by: Chen, Weiqin, et al.
Published: (2024)
by: Chen, Weiqin, et al.
Published: (2024)
Practical Performative Policy Learning with Strategic Agents
by: Chen, Qianyi, et al.
Published: (2024)
by: Chen, Qianyi, et al.
Published: (2024)
Multi-Attribute Preferences: A Transfer Learning Approach
by: Hermes, Sjoerd, et al.
Published: (2024)
by: Hermes, Sjoerd, et al.
Published: (2024)
Federated Offline Reinforcement Learning
by: Zhou, Doudou, et al.
Published: (2022)
by: Zhou, Doudou, et al.
Published: (2022)
Learning Preferences from Conjoint Data: A Structural Deep Learning Approach
by: Acharya, Avidit, et al.
Published: (2026)
by: Acharya, Avidit, et al.
Published: (2026)
Colorful Pinball: Density-Weighted Quantile Regression for Conditional Guarantee of Conformal Prediction
by: Chen, Qianyi, et al.
Published: (2025)
by: Chen, Qianyi, et al.
Published: (2025)
Multivariate Dynamic Mediation Analysis under a Reinforcement Learning Framework
by: Luo, Lan, et al.
Published: (2023)
by: Luo, Lan, et al.
Published: (2023)
Nonlinear Modal Interval Regression for Bivariate Data Analysis
by: Yao, Sai, et al.
Published: (2026)
by: Yao, Sai, et al.
Published: (2026)
PAC-Bayesian Reward-Certified Outcome Weighted Learning
by: Ishikawa, Yuya, et al.
Published: (2026)
by: Ishikawa, Yuya, et al.
Published: (2026)
OPTICS: Order-Preserved Test-Inverse Confidence Set for Number of Change-Points
by: Sun, Ao, et al.
Published: (2026)
by: Sun, Ao, et al.
Published: (2026)
FAIRM: Learning invariant representations for algorithmic fairness and domain generalization with minimax optimality
by: Li, Sai, et al.
Published: (2024)
by: Li, Sai, et al.
Published: (2024)
Empirical likelihood meta analysis with publication bias correction under Copas-like selection model
by: Li, Mengke, et al.
Published: (2025)
by: Li, Mengke, et al.
Published: (2025)
Enhanced inference for distributions and quantiles of individual treatment effects in various experiments
by: Chen, Zhe, et al.
Published: (2024)
by: Chen, Zhe, et al.
Published: (2024)
Extending Evidence Accumulation Models to Bounded Continuous Self-report Data
by: Wu, Yufei, et al.
Published: (2026)
by: Wu, Yufei, et al.
Published: (2026)
Reinforcement Learning with Continuous Actions Under Unmeasured Confounding
by: Li, Yuhan, et al.
Published: (2025)
by: Li, Yuhan, et al.
Published: (2025)
A Flexible Framework for Incorporating Patient Preferences Into Q-Learning
by: Zitovsky, Joshua P., et al.
Published: (2023)
by: Zitovsky, Joshua P., et al.
Published: (2023)
Contextual Online Uncertainty-Aware Preference Learning for Human Feedback
by: Lu, Nan, et al.
Published: (2025)
by: Lu, Nan, et al.
Published: (2025)
Journey to the Centre of Cluster: Harnessing Interior Nodes for A/B Testing under Network Interference
by: Chen, Qianyi, et al.
Published: (2026)
by: Chen, Qianyi, et al.
Published: (2026)
Multi-Layer Backward Joint Model for Dynamic Prediction of Clinical Events with Multivariate Longitudinal Predictors of Mixed Types
by: Li, Wenhao, et al.
Published: (2025)
by: Li, Wenhao, et al.
Published: (2025)
Covariance test for discretely observed functional data: when and how it works?
by: Zhou, Yang, et al.
Published: (2025)
by: Zhou, Yang, et al.
Published: (2025)
Transfer Learning for Degree-Corrected Mixed Membership Network Models
by: He, Yong, et al.
Published: (2026)
by: He, Yong, et al.
Published: (2026)
AdaTrans: Feature-wise and Sample-wise Adaptive Transfer Learning for High-dimensional Regression
by: He, Zelin, et al.
Published: (2024)
by: He, Zelin, et al.
Published: (2024)
Cumulative Treatment Effect Testing under Continuous Time Reinforcement Learning
by: Zhang, Jiuchen, et al.
Published: (2026)
by: Zhang, Jiuchen, et al.
Published: (2026)
Bayesian Transfer Learning for Enhanced Estimation and Inference
by: Lai, Daoyuan, et al.
Published: (2024)
by: Lai, Daoyuan, et al.
Published: (2024)
Temporal network analysis via a degree-corrected Cox model
by: Chen, Yuguo, et al.
Published: (2025)
by: Chen, Yuguo, et al.
Published: (2025)
Novel Knockoff Generation and Importance Measures with Heterogeneous Data via Conditional Residuals and Local Gradients
by: Mason, Evan, et al.
Published: (2025)
by: Mason, Evan, et al.
Published: (2025)
Reinforcement Learning for Respondent-Driven Sampling
by: Weltz, Justin, et al.
Published: (2025)
by: Weltz, Justin, et al.
Published: (2025)
CURLS: Causal Rule Learning for Subgroups with Significant Treatment Effect
by: Zhou, Jiehui, et al.
Published: (2024)
by: Zhou, Jiehui, et al.
Published: (2024)
Designing Time Series Experiments in A/B Testing with Transformer Reinforcement Learning
by: Wu, Xiangkun, et al.
Published: (2026)
by: Wu, Xiangkun, et al.
Published: (2026)
Optimizing Sample Size for Supervised Machine Learning with Bulk Transcriptomic Sequencing: A Learning Curve Approach
by: Qi, Yunhui, et al.
Published: (2024)
by: Qi, Yunhui, et al.
Published: (2024)
Differentiable Structure Learning and Causal Discovery for General Binary Data
by: Deng, Chang, et al.
Published: (2025)
by: Deng, Chang, et al.
Published: (2025)
Learning Shared and Source-specific Subspaces across Multiple Data Sources for Functional Data
by: Zhang, Chi, et al.
Published: (2025)
by: Zhang, Chi, et al.
Published: (2025)
Similar Items
-
Learnable Retrieval Enhanced Visual-Text Alignment and Fusion for Radiology Report Generation
by: Zhou, Qin, et al.
Published: (2025) -
Advancing Medical Image Segmentation via Self-supervised Instance-adaptive Prototype Learning
by: Liang, Guoyan, et al.
Published: (2025) -
Semantic-guided Masked Mutual Learning for Multi-modal Brain Tumor Segmentation with Arbitrary Missing Modalities
by: Liang, Guoyan, et al.
Published: (2025) -
Deconfounding via Profiled Transfer Learning
by: Chen, Ziyuan, et al.
Published: (2025) -
STEEL: Singularity-aware Reinforcement Learning
by: Chen, Xiaohong, et al.
Published: (2023)