Human-in-the-Loop Multi-Agent Ventilator Decision Support with Contextual Bandit Preference Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Sijia, Tan, Xiaoyu, Wang, Qixing, Zhao, Weiyi, Zhan, Chen, Hao, Teqi, Wang, Xuemin, Gu, Lei, Eils, Roland, Qiu, Xihe |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PRISM: Festina Lente Proactivity -- Risk-Sensitive, Uncertainty-Aware Deliberation for Proactive Agents
par: Fu, Yuxuan, et autres
Publié: (2026)
par: Fu, Yuxuan, et autres
Publié: (2026)
Reflective Personalization Optimization: A Post-hoc Rewriting Framework for Black-Box Large Language Models
par: Hao, Teqi, et autres
Publié: (2025)
par: Hao, Teqi, et autres
Publié: (2025)
OR-VSKC: Resolving Visual-Semantic Knowledge Conflicts in Operating Rooms with Synthetic Data-Guided Alignment
par: Zhao, Weiyi, et autres
Publié: (2025)
par: Zhao, Weiyi, et autres
Publié: (2025)
Curiosity Driven Knowledge Retrieval for Mobile Agents
par: Li, Sijia, et autres
Publié: (2026)
par: Li, Sijia, et autres
Publié: (2026)
Subequivariant Reinforcement Learning Framework for Coordinated Motion Control
par: Wang, Haoyu, et autres
Publié: (2024)
par: Wang, Haoyu, et autres
Publié: (2024)
Structured Visual Evidence Decomposition for Evidence-Grounded Multimodal Screening of Obstructive Sleep Apnea-Hypopnea Syndrome
par: Zhan, Chen, et autres
Publié: (2026)
par: Zhan, Chen, et autres
Publié: (2026)
EEG-VLM: A Hierarchical Vision-Language Model with Multi-Level Feature Alignment and Visually Enhanced Language-Guided Reasoning for EEG Image-Based Sleep Stage Prediction
par: Qiu, Xihe, et autres
Publié: (2025)
par: Qiu, Xihe, et autres
Publié: (2025)
FedSlate:A Federated Deep Reinforcement Learning Recommender System
par: Deng, Yongxin, et autres
Publié: (2024)
par: Deng, Yongxin, et autres
Publié: (2024)
Reward Guidance for Reinforcement Learning Tasks Based on Large Language Models: The LMGT Framework
par: Deng, Yongxin, et autres
Publié: (2024)
par: Deng, Yongxin, et autres
Publié: (2024)
SRU-Pix2Pix: A Fusion-Driven Generator Network for Medical Image Translation with Few-Shot Learning
par: Qiu, Xihe, et autres
Publié: (2026)
par: Qiu, Xihe, et autres
Publié: (2026)
Fusion or Confusion? Multimodal Complexity Is Not All You Need
par: Rheude, Tillmann, et autres
Publié: (2025)
par: Rheude, Tillmann, et autres
Publié: (2025)
Cohort-Based Active Modality Acquisition
par: Rheude, Tillmann, et autres
Publié: (2025)
par: Rheude, Tillmann, et autres
Publié: (2025)
Towards Domain Adaptive Neural Contextual Bandits
par: Wang, Ziyan, et autres
Publié: (2024)
par: Wang, Ziyan, et autres
Publié: (2024)
From Answers to Arguments: Toward Trustworthy Clinical Diagnostic Reasoning with Toulmin-Guided Curriculum Goal-Conditioned Learning
par: Zhan, Chen, et autres
Publié: (2026)
par: Zhan, Chen, et autres
Publié: (2026)
VIVID-Med: LLM-Supervised Structured Pretraining for Deployable Medical ViTs
par: Wang, Xiyao, et autres
Publié: (2026)
par: Wang, Xiyao, et autres
Publié: (2026)
Corruption-Robust Algorithms with Uncertainty Weighting for Nonlinear Contextual Bandits and Markov Decision Processes
par: Ye, Chenlu, et autres
Publié: (2022)
par: Ye, Chenlu, et autres
Publié: (2022)
Towards Collaborative Intelligence: Propagating Intentions and Reasoning for Multi-Agent Coordination with Large Language Models
par: Qiu, Xihe, et autres
Publié: (2024)
par: Qiu, Xihe, et autres
Publié: (2024)
JanusDNA: A Powerful Bi-directional Hybrid DNA Foundation Model
par: Duan, Qihao, et autres
Publié: (2025)
par: Duan, Qihao, et autres
Publié: (2025)
Hidden in the Multiplicative Interaction: Uncovering Fragility in Multimodal Contrastive Learning
par: Rheude, Tillmann, et autres
Publié: (2026)
par: Rheude, Tillmann, et autres
Publié: (2026)
Variance-Dependent Regret Lower Bounds for Contextual Bandits
par: He, Jiafan, et autres
Publié: (2025)
par: He, Jiafan, et autres
Publié: (2025)
Struct-X: Enhancing Large Language Models Reasoning with Structured Data
par: Tan, Xiaoyu, et autres
Publié: (2024)
par: Tan, Xiaoyu, et autres
Publié: (2024)
Comparative Explanations: Explanation Guided Decision Making for Human-in-the-Loop Preference Selection
par: Chakraborty, Tanmay, et autres
Publié: (2025)
par: Chakraborty, Tanmay, et autres
Publié: (2025)
Robust Deep Hawkes Process under Label Noise of Both Event and Occurrence
par: Tan, Xiaoyu, et autres
Publié: (2024)
par: Tan, Xiaoyu, et autres
Publié: (2024)
Contextual Linear Bandits with Delay as Payoff
par: Zhang, Mengxiao, et autres
Publié: (2025)
par: Zhang, Mengxiao, et autres
Publié: (2025)
Feel-Good Thompson Sampling for Contextual Dueling Bandits
par: Li, Xuheng, et autres
Publié: (2024)
par: Li, Xuheng, et autres
Publié: (2024)
Variance-Aware Feel-Good Thompson Sampling for Contextual Bandits
par: Li, Xuheng, et autres
Publié: (2025)
par: Li, Xuheng, et autres
Publié: (2025)
Quantum-Enhanced Neural Contextual Bandit Algorithms
par: Huang, Yuqi, et autres
Publié: (2026)
par: Huang, Yuqi, et autres
Publié: (2026)
Leveraging Offline Data in Linear Latent Contextual Bandits
par: Kausik, Chinmaya, et autres
Publié: (2024)
par: Kausik, Chinmaya, et autres
Publié: (2024)
Sainsc: A Computational Tool for Segmentation‐Free Analysis of In Situ Capture Data
par: Niklas Müller‐Bötticher, et autres
Publié: (2024)
par: Niklas Müller‐Bötticher, et autres
Publié: (2024)
Sainsc: A Computational Tool for Segmentation‐Free Analysis of In Situ Capture Data (Small Methods 5/2025)
par: Niklas Müller‐Bötticher, et autres
Publié: (2025)
par: Niklas Müller‐Bötticher, et autres
Publié: (2025)
Contextual Bandits and Reconfigurable Intelligent Surfaces for Predictive LTM Handover Decisions
par: Moreno-Locubiche, Ainna Yue, et autres
Publié: (2025)
par: Moreno-Locubiche, Ainna Yue, et autres
Publié: (2025)
Static Sandboxes Are Inadequate: Modeling Societal Complexity Requires Open-Ended Co-Evolution in LLM-Based Multi-Agent Simulations
par: Chen, Jinkun, et autres
Publié: (2025)
par: Chen, Jinkun, et autres
Publié: (2025)
Sharp Analysis for KL-Regularized Contextual Bandits and RLHF
par: Zhao, Heyang, et autres
Publié: (2024)
par: Zhao, Heyang, et autres
Publié: (2024)
Preference is More Than Comparisons: Rethinking Dueling Bandits with Augmented Human Feedback
par: Wang, Shengbo, et autres
Publié: (2025)
par: Wang, Shengbo, et autres
Publié: (2025)
Federated Linear Contextual Bandits with Heterogeneous Clients
par: Blaser, Ethan, et autres
Publié: (2024)
par: Blaser, Ethan, et autres
Publié: (2024)
Contextual Bandits for Unbounded Context Distributions
par: Zhao, Puning, et autres
Publié: (2024)
par: Zhao, Puning, et autres
Publié: (2024)
COBRA: Contextual Bandit Algorithm for Ensuring Truthful Strategic Agents
par: Verma, Arun, et autres
Publié: (2025)
par: Verma, Arun, et autres
Publié: (2025)
Contextual Restless Multi-Armed Bandits with Application to Demand Response Decision-Making
par: Chen, Xin, et autres
Publié: (2024)
par: Chen, Xin, et autres
Publié: (2024)
Nearly Optimal Algorithms for Contextual Dueling Bandits from Adversarial Feedback
par: Di, Qiwei, et autres
Publié: (2024)
par: Di, Qiwei, et autres
Publié: (2024)
Episodic Contextual Bandits with Knapsacks under Conversion Models
par: Cheung, Wang Chi, et autres
Publié: (2025)
par: Cheung, Wang Chi, et autres
Publié: (2025)
Documents similaires
-
PRISM: Festina Lente Proactivity -- Risk-Sensitive, Uncertainty-Aware Deliberation for Proactive Agents
par: Fu, Yuxuan, et autres
Publié: (2026) -
Reflective Personalization Optimization: A Post-hoc Rewriting Framework for Black-Box Large Language Models
par: Hao, Teqi, et autres
Publié: (2025) -
OR-VSKC: Resolving Visual-Semantic Knowledge Conflicts in Operating Rooms with Synthetic Data-Guided Alignment
par: Zhao, Weiyi, et autres
Publié: (2025) -
Curiosity Driven Knowledge Retrieval for Mobile Agents
par: Li, Sijia, et autres
Publié: (2026) -
Subequivariant Reinforcement Learning Framework for Coordinated Motion Control
par: Wang, Haoyu, et autres
Publié: (2024)