Making LLMs Reliable When It Matters Most: A Five-Layer Architecture for High-Stakes Decisions
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Jadad, Alejandro R. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AI Knows What's Wrong But Cannot Fix It: Helicoid Dynamics in Frontier LLMs Under High-Stakes Decisions
par: Jadad, Alejandro R
Publié: (2026)
par: Jadad, Alejandro R
Publié: (2026)
The Foundations of Computational Management: A Systematic Approach to Task Automation for the Integration of Artificial Intelligence into Existing Workflows
par: Jadad-Garcia, Tamen, et autres
Publié: (2024)
par: Jadad-Garcia, Tamen, et autres
Publié: (2024)
Leading Across the Spectrum of Human-AI Relationships: A Conceptual Framework for Increasingly Heterogeneous Teams
par: Jadad, Alejandro R.
Publié: (2026)
par: Jadad, Alejandro R.
Publié: (2026)
Generative Models, Humans, Predictive Models: Who Is Worse at High-Stakes Decision Making?
par: Mallari, Keri, et autres
Publié: (2024)
par: Mallari, Keri, et autres
Publié: (2024)
AgenticSimLaw: A Juvenile Courtroom Multi-Agent Debate Simulation for Explainable High-Stakes Tabular Decision Making
par: Chun, Jon, et autres
Publié: (2026)
par: Chun, Jon, et autres
Publié: (2026)
Engaging with AI: How Interface Design Shapes Human-AI Collaboration in High-Stakes Decision-Making
par: Chen, Zichen, et autres
Publié: (2025)
par: Chen, Zichen, et autres
Publié: (2025)
The Paradox of Robustness: Decoupling Rule-Based Logic from Affective Noise in High-Stakes Decision-Making
par: Chun, Jon, et autres
Publié: (2026)
par: Chun, Jon, et autres
Publié: (2026)
How to Make the Most of LLMs' Grammatical Knowledge for Acceptability Judgments
par: Ide, Yusuke, et autres
Publié: (2024)
par: Ide, Yusuke, et autres
Publié: (2024)
On the Effectiveness and Generalization of Race Representations for Debiasing High-Stakes Decisions
par: Nguyen, Dang, et autres
Publié: (2025)
par: Nguyen, Dang, et autres
Publié: (2025)
Cognitive Bias in Decision-Making with LLMs
par: Echterhoff, Jessica, et autres
Publié: (2024)
par: Echterhoff, Jessica, et autres
Publié: (2024)
Fair outputs, Biased Internals: Causal Potency and Asymmetry of Latent Bias in LLMs for High-Stakes Decisions
par: Tripathy, Jagdish, et autres
Publié: (2026)
par: Tripathy, Jagdish, et autres
Publié: (2026)
Confidence-Aware Alignment Makes Reasoning LLMs More Reliable
par: Chen, Kejia, et autres
Publié: (2026)
par: Chen, Kejia, et autres
Publié: (2026)
Adversarial Testing in LLMs: Insights into Decision-Making Vulnerabilities
par: Zhang, Lili, et autres
Publié: (2025)
par: Zhang, Lili, et autres
Publié: (2025)
LLMs for High-Frequency Decision-Making: Normalized Action Reward-Guided Consistency Policy Optimization
par: Zhao, Yang, et autres
Publié: (2026)
par: Zhao, Yang, et autres
Publié: (2026)
New Statistical Framework for Extreme Error Probability in High-Stakes Domains for Reliable Machine Learning
par: Michelucci, Umberto, et autres
Publié: (2025)
par: Michelucci, Umberto, et autres
Publié: (2025)
An AI Monkey Gets Grapes for Sure -- Sphere Neural Networks for Reliable Decision-Making
par: Dong, Tiansi, et autres
Publié: (2026)
par: Dong, Tiansi, et autres
Publié: (2026)
Reliable Decision Making via Calibration Oriented Retrieval Augmented Generation
par: Jang, Chaeyun, et autres
Publié: (2024)
par: Jang, Chaeyun, et autres
Publié: (2024)
SOLID: a Framework of Synergizing Optimization and LLMs for Intelligent Decision-Making
par: Wang, Yinsheng, et autres
Publié: (2025)
par: Wang, Yinsheng, et autres
Publié: (2025)
Can LLMs Make (Personalized) Access Control Decisions?
par: Groschupp, Friederike, et autres
Publié: (2025)
par: Groschupp, Friederike, et autres
Publié: (2025)
Post-Training LLMs as Better Decision-Making Agents: A Regret-Minimization Approach
par: Park, Chanwoo, et autres
Publié: (2025)
par: Park, Chanwoo, et autres
Publié: (2025)
WARBENCH: A Comprehensive Benchmark for Evaluating LLMs in Military Decision-Making
par: Li, Zongjie, et autres
Publié: (2026)
par: Li, Zongjie, et autres
Publié: (2026)
When AI Persuades: Adversarial Explanation Attacks on Human Trust in AI-Assisted Decision Making
par: Fan, Shutong, et autres
Publié: (2026)
par: Fan, Shutong, et autres
Publié: (2026)
Grounding Natural Language for Multi-agent Decision-Making with Multi-agentic LLMs
par: Huh, Dom, et autres
Publié: (2025)
par: Huh, Dom, et autres
Publié: (2025)
Multimodal Agricultural Agent Architecture (MA3): A New Paradigm for Intelligent Agricultural Decision-Making
par: Xu, Zhuoning, et autres
Publié: (2025)
par: Xu, Zhuoning, et autres
Publié: (2025)
Can You Trust an LLM with Your Life-Changing Decision? An Investigation into AI High-Stakes Responses
par: Cahyono, Joshua Adrian, et autres
Publié: (2025)
par: Cahyono, Joshua Adrian, et autres
Publié: (2025)
Enhancing Explainability and Reliable Decision-Making in Particle Swarm Optimization through Communication Topologies
par: Gupta, Nitin, et autres
Publié: (2025)
par: Gupta, Nitin, et autres
Publié: (2025)
How Far Are We on the Decision-Making of LLMs? Evaluating LLMs' Gaming Ability in Multi-Agent Environments
par: Huang, Jen-tse, et autres
Publié: (2024)
par: Huang, Jen-tse, et autres
Publié: (2024)
Rethinking Prospect Theory for LLMs: Revealing the Instability of Decision-Making under Epistemic Uncertainty
par: Wang, Rui, et autres
Publié: (2025)
par: Wang, Rui, et autres
Publié: (2025)
IDEA: An Interpretable and Editable Decision-Making Framework for LLMs via Verbal-to-Numeric Calibration
par: He, Yanji, et autres
Publié: (2026)
par: He, Yanji, et autres
Publié: (2026)
CivBench: Progress-Based Evaluation for LLMs' Strategic Decision-Making in Civilization V
par: Chen, John, et autres
Publié: (2026)
par: Chen, John, et autres
Publié: (2026)
Temporal Fairness in Decision Making Problems
par: Torres, Manuel R., et autres
Publié: (2024)
par: Torres, Manuel R., et autres
Publié: (2024)
Using LLMs in Generating Design Rationale for Software Architecture Decisions
par: Zhou, Xiyu, et autres
Publié: (2025)
par: Zhou, Xiyu, et autres
Publié: (2025)
Responsible LLM Deployment for High-Stake Decisions by Decentralized Technologies and Human-AI Interactions
par: Sachan, Swati, et autres
Publié: (2025)
par: Sachan, Swati, et autres
Publié: (2025)
MDAgents: An Adaptive Collaboration of LLMs for Medical Decision-Making
par: Kim, Yubin, et autres
Publié: (2024)
par: Kim, Yubin, et autres
Publié: (2024)
Subtle Risks, Critical Failures: A Framework for Diagnosing Physical Safety of LLMs for Embodied Decision Making
par: Son, Yejin, et autres
Publié: (2025)
par: Son, Yejin, et autres
Publié: (2025)
Cracking the code: Lessons from 15 years of digital health IPOs for the era of AI
par: Jadad-Garcia, Tamen, et autres
Publié: (2024)
par: Jadad-Garcia, Tamen, et autres
Publié: (2024)
What Layers When: Learning to Skip Compute in LLMs with Residual Gates
par: Laitenberger, Filipe, et autres
Publié: (2025)
par: Laitenberger, Filipe, et autres
Publié: (2025)
An Inference-Based Architecture for Intent and Affordance Saturation in Decision-Making
par: Ilboudo, Wendyam Eric Lionel, et autres
Publié: (2025)
par: Ilboudo, Wendyam Eric Lionel, et autres
Publié: (2025)
When Punctuation Matters: A Large-Scale Comparison of Prompt Robustness Methods for LLMs
par: Seleznyov, Mikhail, et autres
Publié: (2025)
par: Seleznyov, Mikhail, et autres
Publié: (2025)
ALIGN: Prompt-based Attribute Alignment for Reliable, Responsible, and Personalized LLM-based Decision-Making
par: Ravichandran, Bharadwaj, et autres
Publié: (2025)
par: Ravichandran, Bharadwaj, et autres
Publié: (2025)
Documents similaires
-
AI Knows What's Wrong But Cannot Fix It: Helicoid Dynamics in Frontier LLMs Under High-Stakes Decisions
par: Jadad, Alejandro R
Publié: (2026) -
The Foundations of Computational Management: A Systematic Approach to Task Automation for the Integration of Artificial Intelligence into Existing Workflows
par: Jadad-Garcia, Tamen, et autres
Publié: (2024) -
Leading Across the Spectrum of Human-AI Relationships: A Conceptual Framework for Increasingly Heterogeneous Teams
par: Jadad, Alejandro R.
Publié: (2026) -
Generative Models, Humans, Predictive Models: Who Is Worse at High-Stakes Decision Making?
par: Mallari, Keri, et autres
Publié: (2024) -
AgenticSimLaw: A Juvenile Courtroom Multi-Agent Debate Simulation for Explainable High-Stakes Tabular Decision Making
par: Chun, Jon, et autres
Publié: (2026)