Dual Turing Test: A Framework for Detecting and Mitigating Undetectable AI
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Messina, Alberto |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Detecting the Undetectable: Combining Kolmogorov-Arnold Networks and MLP for AI-Generated Image Detection
par: Anon, Taharim Rahman, et autres
Publié: (2024)
par: Anon, Taharim Rahman, et autres
Publié: (2024)
Turing Test on Screen: A Benchmark for Mobile GUI Agent Humanization
par: Zhu, Jiachen, et autres
Publié: (2026)
par: Zhu, Jiachen, et autres
Publié: (2026)
The Generalized Turing Test: A Foundation for Comparing Intelligence
par: Mitropolsky, Daniel, et autres
Publié: (2026)
par: Mitropolsky, Daniel, et autres
Publié: (2026)
Undetectable Conversations Between AI Agents via Pseudorandom Noise-Resilient Key Exchange
par: Vaikuntanathan, Vinod, et autres
Publié: (2026)
par: Vaikuntanathan, Vinod, et autres
Publié: (2026)
Brain-Model Evaluations Need the NeuroAI Turing Test
par: Feather, Jenelle, et autres
Publié: (2025)
par: Feather, Jenelle, et autres
Publié: (2025)
An Undetectable Watermark for Generative Image Models
par: Gunn, Sam, et autres
Publié: (2024)
par: Gunn, Sam, et autres
Publié: (2024)
Introducing Background Temperature to Characterise Hidden Randomness in Large Language Models
par: Messina, Alberto, et autres
Publié: (2026)
par: Messina, Alberto, et autres
Publié: (2026)
Undetectable Backdoors in Model Parameters: Hiding Sparse Secrets in High Dimensions
par: Choudhary, Sarthak, et autres
Publié: (2026)
par: Choudhary, Sarthak, et autres
Publié: (2026)
Detecting and Mitigating the Correct-Answer Extinction Window in Test-Time Reinforcement Learning with Majority Voting
par: Lin, Hongxiang, et autres
Publié: (2026)
par: Lin, Hongxiang, et autres
Publié: (2026)
Adversarial Activation Patching: A Framework for Detecting and Mitigating Emergent Deception in Safety-Aligned Transformers
par: Ravindran, Santhosh Kumar
Publié: (2025)
par: Ravindran, Santhosh Kumar
Publié: (2025)
DGP: A Dual-Granularity Prompting Framework for Fraud Detection with Graph-Enhanced LLMs
par: Li, Yuan, et autres
Publié: (2025)
par: Li, Yuan, et autres
Publié: (2025)
Neural Paging: Learning Context Management Policies for Turing-Complete Agents
par: Chen, Liang, et autres
Publié: (2026)
par: Chen, Liang, et autres
Publié: (2026)
Adaptive Dual-Weighting Framework for Federated Learning via Out-of-Distribution Detection
par: Ling, Zhiwei, et autres
Publié: (2026)
par: Ling, Zhiwei, et autres
Publié: (2026)
DARTs: A Dual-Path Robust Framework for Anomaly Detection in High-Dimensional Multivariate Time Series
par: Liu, Xuechun, et autres
Publié: (2025)
par: Liu, Xuechun, et autres
Publié: (2025)
A Causal Framework to Measure and Mitigate Non-binary Treatment Discrimination
par: Majumdar, Ayan, et autres
Publié: (2025)
par: Majumdar, Ayan, et autres
Publié: (2025)
PSO-XAI: A PSO-Enhanced Explainable AI Framework for Reliable Breast Cancer Detection
par: Raquib, Mirza, et autres
Publié: (2025)
par: Raquib, Mirza, et autres
Publié: (2025)
Hidden in Plain Sight: Undetectable Adversarial Bias Attacks on Vulnerable Patient Populations
par: Kulkarni, Pranav, et autres
Publié: (2024)
par: Kulkarni, Pranav, et autres
Publié: (2024)
AdaMixup: A Dynamic Defense Framework for Membership Inference Attack Mitigation
par: Chen, Ying, et autres
Publié: (2025)
par: Chen, Ying, et autres
Publié: (2025)
Mitigating Label Shift in Tabular In-Context Learning via Test-Time Posterior Adjustment
par: Lee, Seunghan
Publié: (2026)
par: Lee, Seunghan
Publié: (2026)
Mitigating Overconfidence in Out-of-Distribution Detection by Capturing Extreme Activations
par: Azizmalayeri, Mohammad, et autres
Publié: (2024)
par: Azizmalayeri, Mohammad, et autres
Publié: (2024)
Adversarial Reward Auditing for Active Detection and Mitigation of Reward Hacking
par: Beigi, Mohammad, et autres
Publié: (2026)
par: Beigi, Mohammad, et autres
Publié: (2026)
Detecting and Mitigating DDoS Attacks with AI: A Survey
par: Apostu, Alexandru, et autres
Publié: (2025)
par: Apostu, Alexandru, et autres
Publié: (2025)
AIMM: An AI-Driven Multimodal Framework for Detecting Social-Media-Influenced Stock Market Manipulation
par: Neela, Sandeep
Publié: (2025)
par: Neela, Sandeep
Publié: (2025)
HeartBeatAI: An Interpretable and Robust Deep Learning Framework for Multi-Label ECG Arrhythmia Detection
par: Gupta, Shubham, et autres
Publié: (2026)
par: Gupta, Shubham, et autres
Publié: (2026)
EAGLE: A Domain Generalization Framework for AI-generated Text Detection
par: Bhattacharjee, Amrita, et autres
Publié: (2024)
par: Bhattacharjee, Amrita, et autres
Publié: (2024)
Detecting Neurovascular Instability from Multimodal Physiological Signals Using Wearable-Compatible Edge AI: A Responsible Computational Framework
par: Hoa, Truong Quynh, et autres
Publié: (2026)
par: Hoa, Truong Quynh, et autres
Publié: (2026)
STRIDE: A Systematic Framework for Selecting AI Modalities -- Agentic AI, AI Assistants, or LLM Calls
par: Asthana, Shubhi, et autres
Publié: (2025)
par: Asthana, Shubhi, et autres
Publié: (2025)
Stabilising Explainability Fragility in Cybersecurity AI: The Impact and Mitigation of Multicollinearity in Public Benchmark Datasets
par: Vourganas, Ioannis J., et autres
Publié: (2026)
par: Vourganas, Ioannis J., et autres
Publié: (2026)
Mitigating the Likelihood Paradox in Flow-based OOD Detection via Entropy Manipulation
par: Kim, Donghwan, et autres
Publié: (2026)
par: Kim, Donghwan, et autres
Publié: (2026)
Navigating Shortcuts, Spurious Correlations, and Confounders: From Origins via Detection to Mitigation
par: Steinmann, David, et autres
Publié: (2024)
par: Steinmann, David, et autres
Publié: (2024)
Position: The Turing-Completeness of Autoregressive Transformers Relies Heavily on Context Management
par: Cui, Guanyu, et autres
Publié: (2026)
par: Cui, Guanyu, et autres
Publié: (2026)
If Turing played piano with an artificial partner
par: Dotov, Dobromir, et autres
Publié: (2024)
par: Dotov, Dobromir, et autres
Publié: (2024)
A Dual-Agent Adversarial Framework for Robust Generalization in Deep Reinforcement Learning
par: Xie, Zhengpeng, et autres
Publié: (2025)
par: Xie, Zhengpeng, et autres
Publié: (2025)
JANUS: A Dual-Constraint Generative Framework for Stealthy Node Injection Attacks
par: Zhang, Jiahao, et autres
Publié: (2025)
par: Zhang, Jiahao, et autres
Publié: (2025)
Spectral Disentanglement and Enhancement: A Dual-domain Contrastive Framework for Representation Learning
par: Guo, Jinjin, et autres
Publié: (2026)
par: Guo, Jinjin, et autres
Publié: (2026)
Dual Mixture-of-Experts Framework for Discrete-Time Survival Analysis
par: Lee, Hyeonjun, et autres
Publié: (2025)
par: Lee, Hyeonjun, et autres
Publié: (2025)
"Turing Tests" For An AI Scientist
par: Yin, Xiaoxin
Publié: (2024)
par: Yin, Xiaoxin
Publié: (2024)
Test-Time Personalization: A Diagnostic Framework and Probabilistic Fix for Scaling Failures
par: Zhang, Linhai, et autres
Publié: (2026)
par: Zhang, Linhai, et autres
Publié: (2026)
IR$^3$: Contrastive Inverse Reinforcement Learning for Interpretable Detection and Mitigation of Reward Hacking
par: Beigi, Mohammad, et autres
Publié: (2026)
par: Beigi, Mohammad, et autres
Publié: (2026)
GuardFed: A Trustworthy Federated Learning Framework Against Dual-Facet Attacks
par: Li, Yanli, et autres
Publié: (2025)
par: Li, Yanli, et autres
Publié: (2025)
Documents similaires
-
Detecting the Undetectable: Combining Kolmogorov-Arnold Networks and MLP for AI-Generated Image Detection
par: Anon, Taharim Rahman, et autres
Publié: (2024) -
Turing Test on Screen: A Benchmark for Mobile GUI Agent Humanization
par: Zhu, Jiachen, et autres
Publié: (2026) -
The Generalized Turing Test: A Foundation for Comparing Intelligence
par: Mitropolsky, Daniel, et autres
Publié: (2026) -
Undetectable Conversations Between AI Agents via Pseudorandom Noise-Resilient Key Exchange
par: Vaikuntanathan, Vinod, et autres
Publié: (2026) -
Brain-Model Evaluations Need the NeuroAI Turing Test
par: Feather, Jenelle, et autres
Publié: (2025)