The Paradox of Robustness: Decoupling Rule-Based Logic from Affective Noise in High-Stakes Decision-Making
Fuente:
arXiv
Salvato in:
| Autori principali: | Chun, Jon, Elkins, Katherine |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The AI Fiction Paradox
di: Elkins, Katherine
Pubblicazione: (2026)
di: Elkins, Katherine
Pubblicazione: (2026)
Informed AI Regulation: Comparing the Ethical Frameworks of Leading LLM Chatbots Using an Ethics-Based Audit to Assess Moral Reasoning and Normative Values
di: Chun, Jon, et al.
Pubblicazione: (2024)
di: Chun, Jon, et al.
Pubblicazione: (2024)
KemenkeuGPT: Leveraging a Large Language Model on Indonesia's Government Financial Data and Regulations to Enhance Decision Making
di: Febrian, Gilang Fajar, et al.
Pubblicazione: (2024)
di: Febrian, Gilang Fajar, et al.
Pubblicazione: (2024)
Intrinsic Evaluation of RAG Systems for Deep-Logic Questions
di: Hu, Junyi, et al.
Pubblicazione: (2024)
di: Hu, Junyi, et al.
Pubblicazione: (2024)
Reasoning-Based AI for Startup Evaluation (R.A.I.S.E.): A Memory-Augmented, Multi-Step Decision Framework
di: Preuveneers, Jack, et al.
Pubblicazione: (2025)
di: Preuveneers, Jack, et al.
Pubblicazione: (2025)
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
di: Peters, Sydney, et al.
Pubblicazione: (2025)
di: Peters, Sydney, et al.
Pubblicazione: (2025)
Leveraging Natural Language Processing and Machine Learning for Evidence-Based Food Security Policy Decision-Making in Data-Scarce Making
di: Singh, Karan Kumar, et al.
Pubblicazione: (2026)
di: Singh, Karan Kumar, et al.
Pubblicazione: (2026)
A Fuzzy Logic Prompting Framework for Large Language Models in Adaptive and Uncertain Tasks
di: Figueiredo, Vanessa
Pubblicazione: (2025)
di: Figueiredo, Vanessa
Pubblicazione: (2025)
RomanLens: The Role Of Latent Romanization In Multilinguality In LLMs
di: Saji, Alan, et al.
Pubblicazione: (2025)
di: Saji, Alan, et al.
Pubblicazione: (2025)
Executing Arithmetic: Fine-Tuning Large Language Models as Turing Machines
di: Lai, Junyu, et al.
Pubblicazione: (2024)
di: Lai, Junyu, et al.
Pubblicazione: (2024)
What Makes a Good AI Review? Concern-Level Diagnostics for AI Peer Review
di: Jin, Ming
Pubblicazione: (2026)
di: Jin, Ming
Pubblicazione: (2026)
Reinforced Language Models for Sequential Decision Making
di: Dilkes, Jim, et al.
Pubblicazione: (2025)
di: Dilkes, Jim, et al.
Pubblicazione: (2025)
The Perplexity Paradox: Why Code Compresses Better Than Math in LLM Prompts
di: Johnson, Warren
Pubblicazione: (2026)
di: Johnson, Warren
Pubblicazione: (2026)
Syntactic Framing Fragility: An Audit of Robustness in LLM Ethical Decisions
di: Elkins, Katherine, et al.
Pubblicazione: (2025)
di: Elkins, Katherine, et al.
Pubblicazione: (2025)
LLM-based Automated Theorem Proving Hinges on Scalable Synthetic Data Generation
di: Lai, Junyu, et al.
Pubblicazione: (2025)
di: Lai, Junyu, et al.
Pubblicazione: (2025)
Tigrinya Number Verbalization: Rules, Algorithm, and Implementation
di: Gaim, Fitsum, et al.
Pubblicazione: (2026)
di: Gaim, Fitsum, et al.
Pubblicazione: (2026)
Fine-Tuned Large Language Models for Logical Translation: Reducing Hallucinations with Lang2Logic
di: Pan, Muyu, et al.
Pubblicazione: (2025)
di: Pan, Muyu, et al.
Pubblicazione: (2025)
Teaching Probabilistic Logical Reasoning to Transformers
di: Nafar, Aliakbar, et al.
Pubblicazione: (2023)
di: Nafar, Aliakbar, et al.
Pubblicazione: (2023)
LLMs as Signal Detectors: Sensitivity, Bias, and the Temperature-Criterion Analogy
di: Cacioli, Jon-Paul
Pubblicazione: (2026)
di: Cacioli, Jon-Paul
Pubblicazione: (2026)
Instruction Complexity Induces Positional Collapse in Adversarial LLM Evaluation
di: Cacioli, Jon-Paul
Pubblicazione: (2026)
di: Cacioli, Jon-Paul
Pubblicazione: (2026)
Weber's Law in Transformer Magnitude Representations: Efficient Coding, Representational Geometry, and Psychophysical Laws in Language Models
di: Cacioli, Jon-Paul
Pubblicazione: (2026)
di: Cacioli, Jon-Paul
Pubblicazione: (2026)
Below-Chance Blindness: Prompted Underperformance in Small LLMs Produces Positional Bias Rather than Answer Avoidance
di: Cacioli, Jon-Paul
Pubblicazione: (2026)
di: Cacioli, Jon-Paul
Pubblicazione: (2026)
Beyond the Mean: Within-Model Reliable Change Detection for LLM Evaluation
di: Cacioli, Jon-Paul
Pubblicazione: (2026)
di: Cacioli, Jon-Paul
Pubblicazione: (2026)
Option-Order Randomisation Reveals a Distributional Position Attractor in Prompted Sandbagging
di: Cacioli, Jon-Paul
Pubblicazione: (2026)
di: Cacioli, Jon-Paul
Pubblicazione: (2026)
Robustness of Large Language Models to Perturbations in Text
di: Singh, Ayush, et al.
Pubblicazione: (2024)
di: Singh, Ayush, et al.
Pubblicazione: (2024)
Distilling Self-Consistency into Verbal Confidence: A Pre-Registered Negative Result and Post-Hoc Rescue on Gemma 3 4B
di: Cacioli, Jon-Paul
Pubblicazione: (2026)
di: Cacioli, Jon-Paul
Pubblicazione: (2026)
Exemplar Retrieval Without Overhypothesis Induction: Limits of Distributional Sequence Learning in Early Word Learning
di: Cacioli, Jon-Paul
Pubblicazione: (2026)
di: Cacioli, Jon-Paul
Pubblicazione: (2026)
Improving Fuzzy Rule Classifier with Brain Storm Optimization and Rule Modification
di: Huang, Yan, et al.
Pubblicazione: (2024)
di: Huang, Yan, et al.
Pubblicazione: (2024)
Exploring Graph Representations of Logical Forms for Language Modeling
di: Sullivan, Michael
Pubblicazione: (2025)
di: Sullivan, Michael
Pubblicazione: (2025)
Automated CAD Modeling Sequence Generation from Text Descriptions via Transformer-Based Large Language Models
di: Liao, Jianxing, et al.
Pubblicazione: (2025)
di: Liao, Jianxing, et al.
Pubblicazione: (2025)
OSCToM: RL-Guided Adversarial Generation for High-Order Theory of Mind
di: Srishty, Sharmin Sultana, et al.
Pubblicazione: (2026)
di: Srishty, Sharmin Sultana, et al.
Pubblicazione: (2026)
Random Rule Forest (RRF): Interpretable Ensembles of LLM-Generated Questions for Predicting Startup Success
di: Griffin, Ben, et al.
Pubblicazione: (2025)
di: Griffin, Ben, et al.
Pubblicazione: (2025)
SQLord: A Robust Enterprise Text-to-SQL Solution via Reverse Data Generation and Workflow Decomposition
di: Cheng, Song, et al.
Pubblicazione: (2025)
di: Cheng, Song, et al.
Pubblicazione: (2025)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2023)
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2023)
Direct Semantic Communication Between Large Language Models via Vector Translation
di: Yang, Fu-Chun, et al.
Pubblicazione: (2025)
di: Yang, Fu-Chun, et al.
Pubblicazione: (2025)
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
di: Fadli, Samih
Pubblicazione: (2025)
di: Fadli, Samih
Pubblicazione: (2025)
Understanding LLM Evaluator Behavior: A Structured Multi-Evaluator Framework for Merchant Risk Assessment
di: Wang, Liang, et al.
Pubblicazione: (2026)
di: Wang, Liang, et al.
Pubblicazione: (2026)
RADD: Retrieval-Augmented Discrete Diffusion for Multi-Modal Knowledge Graph Completion
di: Niu, Guanglin, et al.
Pubblicazione: (2026)
di: Niu, Guanglin, et al.
Pubblicazione: (2026)
Quantifying Self-Preservation Bias in Large Language Models
di: Migliarini, Matteo, et al.
Pubblicazione: (2026)
di: Migliarini, Matteo, et al.
Pubblicazione: (2026)
Evaluating Relational Reasoning in LLMs with REL
di: Fesser, Lukas, et al.
Pubblicazione: (2026)
di: Fesser, Lukas, et al.
Pubblicazione: (2026)
Documenti analoghi
-
The AI Fiction Paradox
di: Elkins, Katherine
Pubblicazione: (2026) -
Informed AI Regulation: Comparing the Ethical Frameworks of Leading LLM Chatbots Using an Ethics-Based Audit to Assess Moral Reasoning and Normative Values
di: Chun, Jon, et al.
Pubblicazione: (2024) -
KemenkeuGPT: Leveraging a Large Language Model on Indonesia's Government Financial Data and Regulations to Enhance Decision Making
di: Febrian, Gilang Fajar, et al.
Pubblicazione: (2024) -
Intrinsic Evaluation of RAG Systems for Deep-Logic Questions
di: Hu, Junyi, et al.
Pubblicazione: (2024) -
Reasoning-Based AI for Startup Evaluation (R.A.I.S.E.): A Memory-Augmented, Multi-Step Decision Framework
di: Preuveneers, Jack, et al.
Pubblicazione: (2025)