Reliably Detecting Model Failures in Deployment Without Labels
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Nguyen, Viet, Shui, Changjian, Giri, Vijay, Arya, Siddharth, Verma, Amol, Razak, Fahad, Krishnan, Rahul G. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Endogenous Aggregation of Multiple Data Envelopment Analysis Scores for Large Data Sets
par: Omrani, Hashem, et autres
Publié: (2025)
par: Omrani, Hashem, et autres
Publié: (2025)
A Comprehensive View of Personalized Federated Learning on Heterogeneous Clinical Datasets
par: Tavakoli, Fatemeh, et autres
Publié: (2023)
par: Tavakoli, Fatemeh, et autres
Publié: (2023)
Mitigating Privacy Risk via Forget Set-Free Unlearning
par: Newatia, Aviraj, et autres
Publié: (2026)
par: Newatia, Aviraj, et autres
Publié: (2026)
Decentralised, Collaborative, and Privacy-preserving Machine Learning for Multi-Hospital Data
par: Fang, Congyu, et autres
Publié: (2024)
par: Fang, Congyu, et autres
Publié: (2024)
Interpretable Fine-Gray Deep Survival Model for Competing Risks: Predicting Post-Discharge Foot Complications for Diabetic Patients in Ontario
par: Ramachandram, Dhanesh, et autres
Publié: (2025)
par: Ramachandram, Dhanesh, et autres
Publié: (2025)
Sequential Decision Making with Expert Demonstrations under Unobserved Heterogeneity
par: Balazadeh, Vahid, et autres
Publié: (2024)
par: Balazadeh, Vahid, et autres
Publié: (2024)
Modular Multimodal Classification Without Fine-Tuning: A Simple Compositional Approach
par: Bergström, Herman, et autres
Publié: (2026)
par: Bergström, Herman, et autres
Publié: (2026)
Flexible and Efficient Drift Detection without Labels
par: Tan, Nelvin, et autres
Publié: (2025)
par: Tan, Nelvin, et autres
Publié: (2025)
U-Trustworthy Models.Reliability, Competence, and Confidence in Decision-Making
par: Vashistha, Ritwik, et autres
Publié: (2024)
par: Vashistha, Ritwik, et autres
Publié: (2024)
Can We Detect Failures Without Failure Data? Uncertainty-Aware Runtime Failure Detection for Imitation Learning Policies
par: Xu, Chen, et autres
Publié: (2025)
par: Xu, Chen, et autres
Publié: (2025)
Efficient Bilevel Optimization for Meta Label Correction in Noisy Label Learning
par: Nguyen, Ba Hoang Anh, et autres
Publié: (2026)
par: Nguyen, Ba Hoang Anh, et autres
Publié: (2026)
Sequential Harmful Shift Detection Without Labels
par: Amoukou, Salim I., et autres
Publié: (2024)
par: Amoukou, Salim I., et autres
Publié: (2024)
Comparative Analysis of AWS Model Deployment Services
par: Bagai, Rahul
Publié: (2024)
par: Bagai, Rahul
Publié: (2024)
SHA-256 Infused Embedding-Driven Generative Modeling of High-Energy Molecules in Low-Data Regimes
par: Verma, Siddharth, et autres
Publié: (2025)
par: Verma, Siddharth, et autres
Publié: (2025)
Two-Stage Stance Labeling: User-Hashtag Heuristics with Graph Neural Networks
par: Melton, Joshua, et autres
Publié: (2024)
par: Melton, Joshua, et autres
Publié: (2024)
DynaSubVAE: Adaptive Subgrouping for Scalable and Robust OOD Detection
par: Behrouzi, Tina, et autres
Publié: (2025)
par: Behrouzi, Tina, et autres
Publié: (2025)
AutoElicit: Using Large Language Models for Expert Prior Elicitation in Predictive Modelling
par: Capstick, Alexander, et autres
Publié: (2024)
par: Capstick, Alexander, et autres
Publié: (2024)
SurF: A Generative Model for Multivariate Irregular Time Series Forecasting
par: Rezaei, Mohammad R., et autres
Publié: (2026)
par: Rezaei, Mohammad R., et autres
Publié: (2026)
From Residuals to Reasons: LLM-Guided Mechanism Inference from Tabular Data
par: Rezaei, Mohammad R., et autres
Publié: (2026)
par: Rezaei, Mohammad R., et autres
Publié: (2026)
Intersectional Unfairness Discovery
par: Xu, Gezheng, et autres
Publié: (2024)
par: Xu, Gezheng, et autres
Publié: (2024)
Performative Risk Control: Calibrating Models for Reliable Deployment under Performativity
par: Li, Victor, et autres
Publié: (2025)
par: Li, Victor, et autres
Publié: (2025)
Steering Without Side Effects: Improving Post-Deployment Control of Language Models
par: Stickland, Asa Cooper, et autres
Publié: (2024)
par: Stickland, Asa Cooper, et autres
Publié: (2024)
Sequence Diffusion Model for Temporal Link Prediction in Continuous-Time Dynamic Graph
par: Duc, Nguyen Minh, et autres
Publié: (2026)
par: Duc, Nguyen Minh, et autres
Publié: (2026)
Scaling Pretrained Representations Enables Label-Free Out-of-Distribution Detection Without Fine-Tuning
par: Barkley, Brett, et autres
Publié: (2026)
par: Barkley, Brett, et autres
Publié: (2026)
Implicit Dynamical Flow Fusion (IDFF) for Generative Modeling
par: Rezaei, Mohammad R., et autres
Publié: (2024)
par: Rezaei, Mohammad R., et autres
Publié: (2024)
Learning Predictive Checklists with Probabilistic Logic Programming
par: Makhija, Yukti, et autres
Publié: (2024)
par: Makhija, Yukti, et autres
Publié: (2024)
Cost-Adaptive Recourse Recommendation by Adaptive Preference Elicitation
par: Nguyen, Duy, et autres
Publié: (2024)
par: Nguyen, Duy, et autres
Publié: (2024)
CAPSULE: Control-Theoretic Action Perturbations for Safe Uncertainty-Aware Reinforcement Learning
par: Narava, Rahul, et autres
Publié: (2026)
par: Narava, Rahul, et autres
Publié: (2026)
Adapting Prediction Sets to Distribution Shifts Without Labels
par: Kasa, Kevin, et autres
Publié: (2024)
par: Kasa, Kevin, et autres
Publié: (2024)
Causal Foundation Models with Continuous Treatments
par: Stith, Christopher, et autres
Publié: (2026)
par: Stith, Christopher, et autres
Publié: (2026)
Bellman Optimal Stepsize Straightening of Flow-Matching Models
par: Nguyen, Bao, et autres
Publié: (2023)
par: Nguyen, Bao, et autres
Publié: (2023)
ML Compass: Navigating Capability, Cost, and Compliance Trade-offs in AI Model Deployment
par: Digalakis Jr, Vassilis, et autres
Publié: (2025)
par: Digalakis Jr, Vassilis, et autres
Publié: (2025)
Measurement Scheduling for ICU Patients with Offline Reinforcement Learning
par: Ji, Zongliang, et autres
Publié: (2024)
par: Ji, Zongliang, et autres
Publié: (2024)
Real-world Deployment of a Deep Learning Model for Dental Caries Detection
par: Umer, Fahad
Publié: (2026)
par: Umer, Fahad
Publié: (2026)
Good Enough to Learn: LLM-based Anomaly Detection in ECU Logs without Reliable Labels
par: Bogdan, Bogdan, et autres
Publié: (2025)
par: Bogdan, Bogdan, et autres
Publié: (2025)
Frequentist Consistency of Prior-Data Fitted Networks for Causal Inference
par: Melnychuk, Valentyn, et autres
Publié: (2026)
par: Melnychuk, Valentyn, et autres
Publié: (2026)
Estimating Model Performance Under Covariate Shift Without Labels
par: Białek, Jakub, et autres
Publié: (2024)
par: Białek, Jakub, et autres
Publié: (2024)
Unsupervised Replay Strategies for Continual Learning with Limited Data
par: Bazhenov, Anthony, et autres
Publié: (2024)
par: Bazhenov, Anthony, et autres
Publié: (2024)
Early Stopping Against Label Noise Without Validation Data
par: Yuan, Suqin, et autres
Publié: (2025)
par: Yuan, Suqin, et autres
Publié: (2025)
Distributional Surgery for Language Model Activations
par: Nguyen, Bao, et autres
Publié: (2025)
par: Nguyen, Bao, et autres
Publié: (2025)
Documents similaires
-
Endogenous Aggregation of Multiple Data Envelopment Analysis Scores for Large Data Sets
par: Omrani, Hashem, et autres
Publié: (2025) -
A Comprehensive View of Personalized Federated Learning on Heterogeneous Clinical Datasets
par: Tavakoli, Fatemeh, et autres
Publié: (2023) -
Mitigating Privacy Risk via Forget Set-Free Unlearning
par: Newatia, Aviraj, et autres
Publié: (2026) -
Decentralised, Collaborative, and Privacy-preserving Machine Learning for Multi-Hospital Data
par: Fang, Congyu, et autres
Publié: (2024) -
Interpretable Fine-Gray Deep Survival Model for Competing Risks: Predicting Post-Discharge Foot Complications for Diabetic Patients in Ontario
par: Ramachandram, Dhanesh, et autres
Publié: (2025)