CarePilot: A Multi-Agent Framework for Long-Horizon Computer Task Automation in Healthcare
Fuente:
arXiv
Salvato in:
| Autori principali: | Ghosh, Akash, Ashraf, Tajamul, Singh, Rishu Kumar, Saeed, Numan, Saha, Sriparna, Chen, Xiuying, Khan, Salman |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
When Background Matters: Breaking Medical Vision Language Models by Transferable Attack
di: Ghosh, Akash, et al.
Pubblicazione: (2026)
di: Ghosh, Akash, et al.
Pubblicazione: (2026)
Talk, Snap, Complain: Validation-Aware Multimodal Expert Framework for Fine-Grained Customer Grievances
di: Singh, Rishu Kumar, et al.
Pubblicazione: (2025)
di: Singh, Rishu Kumar, et al.
Pubblicazione: (2025)
CURE-Med: Curriculum-Informed Reinforcement Learning for Multilingual Medical Reasoning
di: Onyame, Eric, et al.
Pubblicazione: (2026)
di: Onyame, Eric, et al.
Pubblicazione: (2026)
HF-Fed: Hierarchical based customized Federated Learning Framework for X-Ray Imaging
di: Ashraf, Tajamul, et al.
Pubblicazione: (2024)
di: Ashraf, Tajamul, et al.
Pubblicazione: (2024)
SANSKRITI: A Comprehensive Benchmark for Evaluating Language Models' Knowledge of Indian Culture
di: Maji, Arijit, et al.
Pubblicazione: (2025)
di: Maji, Arijit, et al.
Pubblicazione: (2025)
CLINIC: Evaluating Multilingual Trustworthiness in Language Models for Healthcare
di: Ghosh, Akash, et al.
Pubblicazione: (2025)
di: Ghosh, Akash, et al.
Pubblicazione: (2025)
A Survey of Multilingual Reasoning in Language Models
di: Ghosh, Akash, et al.
Pubblicazione: (2025)
di: Ghosh, Akash, et al.
Pubblicazione: (2025)
MATRIX: Multimodal Agent Tuning for Robust Tool-Use Reasoning
di: Ashraf, Tajamul, et al.
Pubblicazione: (2025)
di: Ashraf, Tajamul, et al.
Pubblicazione: (2025)
TITAN: Query-Token based Domain Adaptive Adversarial Learning
di: Ashraf, Tajamul, et al.
Pubblicazione: (2025)
di: Ashraf, Tajamul, et al.
Pubblicazione: (2025)
FATE: Focal-modulated Attention Encoder for Multivariate Time-series Forecasting
di: Ashraf, Tajamul, et al.
Pubblicazione: (2024)
di: Ashraf, Tajamul, et al.
Pubblicazione: (2024)
SUMMIR: A Hallucination-Aware Framework for Ranking Sports Insights from LLMs
di: Kumar, Nitish, et al.
Pubblicazione: (2026)
di: Kumar, Nitish, et al.
Pubblicazione: (2026)
BhashaSutra: A Task-Centric Unified Survey of Indian NLP Datasets, Corpora, and Resources
di: Kumar, Raghvendra, et al.
Pubblicazione: (2026)
di: Kumar, Raghvendra, et al.
Pubblicazione: (2026)
M3Retrieve: Benchmarking Multimodal Retrieval for Medicine
di: Acharya, Arkadeep, et al.
Pubblicazione: (2025)
di: Acharya, Arkadeep, et al.
Pubblicazione: (2025)
Exploring the Frontier of Vision-Language Models: A Survey of Current Methodologies and Future Directions
di: Ghosh, Akash, et al.
Pubblicazione: (2024)
di: Ghosh, Akash, et al.
Pubblicazione: (2024)
Infogen: Generating Complex Statistical Infographics from Documents
di: Ghosh, Akash, et al.
Pubblicazione: (2025)
di: Ghosh, Akash, et al.
Pubblicazione: (2025)
A Survey on Medical Document Summarization: From Machine Learning Techniques to Large Language Models
di: Akash Ghosh, et al.
Pubblicazione: (2025)
di: Akash Ghosh, et al.
Pubblicazione: (2025)
Generalizable Federated Learning using Client Adaptive Focal Modulation
di: Ashraf, Tajamul, et al.
Pubblicazione: (2025)
di: Ashraf, Tajamul, et al.
Pubblicazione: (2025)
Towards Knowledge-Infused Automated Disease Diagnosis Assistant
di: Tomar, Mohit, et al.
Pubblicazione: (2024)
di: Tomar, Mohit, et al.
Pubblicazione: (2024)
A Comprehensive Survey of Hallucination in Large Language, Image, Video and Audio Foundation Models
di: Sahoo, Pranab, et al.
Pubblicazione: (2024)
di: Sahoo, Pranab, et al.
Pubblicazione: (2024)
Agent-X: Evaluating Deep Multimodal Reasoning in Vision-Centric Agentic Tasks
di: Ashraf, Tajamul, et al.
Pubblicazione: (2025)
di: Ashraf, Tajamul, et al.
Pubblicazione: (2025)
Relic: Enhancing Reward Model Generalization for Low-Resource Indic Languages with Few-Shot Examples
di: Ghosal, Soumya Suvra, et al.
Pubblicazione: (2025)
di: Ghosal, Soumya Suvra, et al.
Pubblicazione: (2025)
VIRAASAT: Traversing Novel Paths for Indian Cultural Reasoning
di: Surana, Harshul Raj, et al.
Pubblicazione: (2026)
di: Surana, Harshul Raj, et al.
Pubblicazione: (2026)
Some factorization results for formal power series
di: Garg, Rishu, et al.
Pubblicazione: (2025)
di: Garg, Rishu, et al.
Pubblicazione: (2025)
Some factorization results on polynomials having integer coefficients
di: Singh, Jitender, et al.
Pubblicazione: (2023)
di: Singh, Jitender, et al.
Pubblicazione: (2023)
A generalized Dumas irreducibility criterion
di: Garg, Rishu, et al.
Pubblicazione: (2025)
di: Garg, Rishu, et al.
Pubblicazione: (2025)
On irreducible factors of polynomials over integers
di: Garg, Rishu, et al.
Pubblicazione: (2025)
di: Garg, Rishu, et al.
Pubblicazione: (2025)
An EcoSage Assistant: Towards Building A Multimodal Plant Care Dialogue Assistant
di: Tomar, Mohit, et al.
Pubblicazione: (2024)
di: Tomar, Mohit, et al.
Pubblicazione: (2024)
BMW Agents -- A Framework For Task Automation Through Multi-Agent Collaboration
di: Crawford, Noel, et al.
Pubblicazione: (2024)
di: Crawford, Noel, et al.
Pubblicazione: (2024)
OS-Marathon: Benchmarking Computer-Use Agents on Long-Horizon Repetitive Tasks
di: Wu, Jing, et al.
Pubblicazione: (2026)
di: Wu, Jing, et al.
Pubblicazione: (2026)
GTA: Generating Long-Horizon Tasks for Web Agents at Scale
di: Huang, Tenghao, et al.
Pubblicazione: (2026)
di: Huang, Tenghao, et al.
Pubblicazione: (2026)
MIRA: A Novel Framework for Fusing Modalities in Medical RAG
di: Wang, Jinhong, et al.
Pubblicazione: (2025)
di: Wang, Jinhong, et al.
Pubblicazione: (2025)
CHI-Bench: Can AI Agents Automate End-to-End, Long-Horizon, Policy-Rich Healthcare Workflows?
di: Chen, Haolin, et al.
Pubblicazione: (2026)
di: Chen, Haolin, et al.
Pubblicazione: (2026)
Agent-BRACE: Decoupling Beliefs from Actions in Long-Horizon Tasks via Verbalized State Uncertainty
di: Singh, Joykirat, et al.
Pubblicazione: (2026)
di: Singh, Joykirat, et al.
Pubblicazione: (2026)
DRISHTIKON: A Multimodal Multilingual Benchmark for Testing Language Models' Understanding on Indian Culture
di: Maji, Arijit, et al.
Pubblicazione: (2025)
di: Maji, Arijit, et al.
Pubblicazione: (2025)
From Fragments to Facts: A Curriculum-Driven DPO Approach for Generating Hindi News Veracity Explanations
di: Bansal, Pulkit, et al.
Pubblicazione: (2025)
di: Bansal, Pulkit, et al.
Pubblicazione: (2025)
Curriculum Guided Massive Multi Agent System Solving For Robust Long Horizon Tasks
di: Kar, Indrajit, et al.
Pubblicazione: (2025)
di: Kar, Indrajit, et al.
Pubblicazione: (2025)
Searching for Dark Matter with MeVCube
di: Saha, Akash Kumar
Pubblicazione: (2025)
di: Saha, Akash Kumar
Pubblicazione: (2025)
Demystifying ChatGPT: How It Masters Genre Recognition
di: Raj, Subham, et al.
Pubblicazione: (2025)
di: Raj, Subham, et al.
Pubblicazione: (2025)
On Evaluating Adversarial Robustness of Volumetric Medical Segmentation Models
di: Malik, Hashmat Shadab, et al.
Pubblicazione: (2024)
di: Malik, Hashmat Shadab, et al.
Pubblicazione: (2024)
LLM Post-Training: A Deep Dive into Reasoning Large Language Models
di: Kumar, Komal, et al.
Pubblicazione: (2025)
di: Kumar, Komal, et al.
Pubblicazione: (2025)
Documenti analoghi
-
When Background Matters: Breaking Medical Vision Language Models by Transferable Attack
di: Ghosh, Akash, et al.
Pubblicazione: (2026) -
Talk, Snap, Complain: Validation-Aware Multimodal Expert Framework for Fine-Grained Customer Grievances
di: Singh, Rishu Kumar, et al.
Pubblicazione: (2025) -
CURE-Med: Curriculum-Informed Reinforcement Learning for Multilingual Medical Reasoning
di: Onyame, Eric, et al.
Pubblicazione: (2026) -
HF-Fed: Hierarchical based customized Federated Learning Framework for X-Ray Imaging
di: Ashraf, Tajamul, et al.
Pubblicazione: (2024) -
SANSKRITI: A Comprehensive Benchmark for Evaluating Language Models' Knowledge of Indian Culture
di: Maji, Arijit, et al.
Pubblicazione: (2025)