Dual Turing Test: A Framework for Detecting and Mitigating Undetectable AI
Fuente:
arXiv
Salvato in:
| Autore principale: | Messina, Alberto |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Detecting the Undetectable: Combining Kolmogorov-Arnold Networks and MLP for AI-Generated Image Detection
di: Anon, Taharim Rahman, et al.
Pubblicazione: (2024)
di: Anon, Taharim Rahman, et al.
Pubblicazione: (2024)
Turing Test on Screen: A Benchmark for Mobile GUI Agent Humanization
di: Zhu, Jiachen, et al.
Pubblicazione: (2026)
di: Zhu, Jiachen, et al.
Pubblicazione: (2026)
The Generalized Turing Test: A Foundation for Comparing Intelligence
di: Mitropolsky, Daniel, et al.
Pubblicazione: (2026)
di: Mitropolsky, Daniel, et al.
Pubblicazione: (2026)
Undetectable Conversations Between AI Agents via Pseudorandom Noise-Resilient Key Exchange
di: Vaikuntanathan, Vinod, et al.
Pubblicazione: (2026)
di: Vaikuntanathan, Vinod, et al.
Pubblicazione: (2026)
Brain-Model Evaluations Need the NeuroAI Turing Test
di: Feather, Jenelle, et al.
Pubblicazione: (2025)
di: Feather, Jenelle, et al.
Pubblicazione: (2025)
An Undetectable Watermark for Generative Image Models
di: Gunn, Sam, et al.
Pubblicazione: (2024)
di: Gunn, Sam, et al.
Pubblicazione: (2024)
Introducing Background Temperature to Characterise Hidden Randomness in Large Language Models
di: Messina, Alberto, et al.
Pubblicazione: (2026)
di: Messina, Alberto, et al.
Pubblicazione: (2026)
Undetectable Backdoors in Model Parameters: Hiding Sparse Secrets in High Dimensions
di: Choudhary, Sarthak, et al.
Pubblicazione: (2026)
di: Choudhary, Sarthak, et al.
Pubblicazione: (2026)
Detecting and Mitigating the Correct-Answer Extinction Window in Test-Time Reinforcement Learning with Majority Voting
di: Lin, Hongxiang, et al.
Pubblicazione: (2026)
di: Lin, Hongxiang, et al.
Pubblicazione: (2026)
Adversarial Activation Patching: A Framework for Detecting and Mitigating Emergent Deception in Safety-Aligned Transformers
di: Ravindran, Santhosh Kumar
Pubblicazione: (2025)
di: Ravindran, Santhosh Kumar
Pubblicazione: (2025)
DGP: A Dual-Granularity Prompting Framework for Fraud Detection with Graph-Enhanced LLMs
di: Li, Yuan, et al.
Pubblicazione: (2025)
di: Li, Yuan, et al.
Pubblicazione: (2025)
Neural Paging: Learning Context Management Policies for Turing-Complete Agents
di: Chen, Liang, et al.
Pubblicazione: (2026)
di: Chen, Liang, et al.
Pubblicazione: (2026)
Adaptive Dual-Weighting Framework for Federated Learning via Out-of-Distribution Detection
di: Ling, Zhiwei, et al.
Pubblicazione: (2026)
di: Ling, Zhiwei, et al.
Pubblicazione: (2026)
DARTs: A Dual-Path Robust Framework for Anomaly Detection in High-Dimensional Multivariate Time Series
di: Liu, Xuechun, et al.
Pubblicazione: (2025)
di: Liu, Xuechun, et al.
Pubblicazione: (2025)
A Causal Framework to Measure and Mitigate Non-binary Treatment Discrimination
di: Majumdar, Ayan, et al.
Pubblicazione: (2025)
di: Majumdar, Ayan, et al.
Pubblicazione: (2025)
PSO-XAI: A PSO-Enhanced Explainable AI Framework for Reliable Breast Cancer Detection
di: Raquib, Mirza, et al.
Pubblicazione: (2025)
di: Raquib, Mirza, et al.
Pubblicazione: (2025)
Hidden in Plain Sight: Undetectable Adversarial Bias Attacks on Vulnerable Patient Populations
di: Kulkarni, Pranav, et al.
Pubblicazione: (2024)
di: Kulkarni, Pranav, et al.
Pubblicazione: (2024)
AdaMixup: A Dynamic Defense Framework for Membership Inference Attack Mitigation
di: Chen, Ying, et al.
Pubblicazione: (2025)
di: Chen, Ying, et al.
Pubblicazione: (2025)
Mitigating Label Shift in Tabular In-Context Learning via Test-Time Posterior Adjustment
di: Lee, Seunghan
Pubblicazione: (2026)
di: Lee, Seunghan
Pubblicazione: (2026)
Mitigating Overconfidence in Out-of-Distribution Detection by Capturing Extreme Activations
di: Azizmalayeri, Mohammad, et al.
Pubblicazione: (2024)
di: Azizmalayeri, Mohammad, et al.
Pubblicazione: (2024)
Adversarial Reward Auditing for Active Detection and Mitigation of Reward Hacking
di: Beigi, Mohammad, et al.
Pubblicazione: (2026)
di: Beigi, Mohammad, et al.
Pubblicazione: (2026)
Detecting and Mitigating DDoS Attacks with AI: A Survey
di: Apostu, Alexandru, et al.
Pubblicazione: (2025)
di: Apostu, Alexandru, et al.
Pubblicazione: (2025)
AIMM: An AI-Driven Multimodal Framework for Detecting Social-Media-Influenced Stock Market Manipulation
di: Neela, Sandeep
Pubblicazione: (2025)
di: Neela, Sandeep
Pubblicazione: (2025)
HeartBeatAI: An Interpretable and Robust Deep Learning Framework for Multi-Label ECG Arrhythmia Detection
di: Gupta, Shubham, et al.
Pubblicazione: (2026)
di: Gupta, Shubham, et al.
Pubblicazione: (2026)
EAGLE: A Domain Generalization Framework for AI-generated Text Detection
di: Bhattacharjee, Amrita, et al.
Pubblicazione: (2024)
di: Bhattacharjee, Amrita, et al.
Pubblicazione: (2024)
Detecting Neurovascular Instability from Multimodal Physiological Signals Using Wearable-Compatible Edge AI: A Responsible Computational Framework
di: Hoa, Truong Quynh, et al.
Pubblicazione: (2026)
di: Hoa, Truong Quynh, et al.
Pubblicazione: (2026)
STRIDE: A Systematic Framework for Selecting AI Modalities -- Agentic AI, AI Assistants, or LLM Calls
di: Asthana, Shubhi, et al.
Pubblicazione: (2025)
di: Asthana, Shubhi, et al.
Pubblicazione: (2025)
Stabilising Explainability Fragility in Cybersecurity AI: The Impact and Mitigation of Multicollinearity in Public Benchmark Datasets
di: Vourganas, Ioannis J., et al.
Pubblicazione: (2026)
di: Vourganas, Ioannis J., et al.
Pubblicazione: (2026)
Mitigating the Likelihood Paradox in Flow-based OOD Detection via Entropy Manipulation
di: Kim, Donghwan, et al.
Pubblicazione: (2026)
di: Kim, Donghwan, et al.
Pubblicazione: (2026)
Navigating Shortcuts, Spurious Correlations, and Confounders: From Origins via Detection to Mitigation
di: Steinmann, David, et al.
Pubblicazione: (2024)
di: Steinmann, David, et al.
Pubblicazione: (2024)
Position: The Turing-Completeness of Autoregressive Transformers Relies Heavily on Context Management
di: Cui, Guanyu, et al.
Pubblicazione: (2026)
di: Cui, Guanyu, et al.
Pubblicazione: (2026)
If Turing played piano with an artificial partner
di: Dotov, Dobromir, et al.
Pubblicazione: (2024)
di: Dotov, Dobromir, et al.
Pubblicazione: (2024)
A Dual-Agent Adversarial Framework for Robust Generalization in Deep Reinforcement Learning
di: Xie, Zhengpeng, et al.
Pubblicazione: (2025)
di: Xie, Zhengpeng, et al.
Pubblicazione: (2025)
JANUS: A Dual-Constraint Generative Framework for Stealthy Node Injection Attacks
di: Zhang, Jiahao, et al.
Pubblicazione: (2025)
di: Zhang, Jiahao, et al.
Pubblicazione: (2025)
Spectral Disentanglement and Enhancement: A Dual-domain Contrastive Framework for Representation Learning
di: Guo, Jinjin, et al.
Pubblicazione: (2026)
di: Guo, Jinjin, et al.
Pubblicazione: (2026)
Dual Mixture-of-Experts Framework for Discrete-Time Survival Analysis
di: Lee, Hyeonjun, et al.
Pubblicazione: (2025)
di: Lee, Hyeonjun, et al.
Pubblicazione: (2025)
"Turing Tests" For An AI Scientist
di: Yin, Xiaoxin
Pubblicazione: (2024)
di: Yin, Xiaoxin
Pubblicazione: (2024)
Test-Time Personalization: A Diagnostic Framework and Probabilistic Fix for Scaling Failures
di: Zhang, Linhai, et al.
Pubblicazione: (2026)
di: Zhang, Linhai, et al.
Pubblicazione: (2026)
IR$^3$: Contrastive Inverse Reinforcement Learning for Interpretable Detection and Mitigation of Reward Hacking
di: Beigi, Mohammad, et al.
Pubblicazione: (2026)
di: Beigi, Mohammad, et al.
Pubblicazione: (2026)
GuardFed: A Trustworthy Federated Learning Framework Against Dual-Facet Attacks
di: Li, Yanli, et al.
Pubblicazione: (2025)
di: Li, Yanli, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Detecting the Undetectable: Combining Kolmogorov-Arnold Networks and MLP for AI-Generated Image Detection
di: Anon, Taharim Rahman, et al.
Pubblicazione: (2024) -
Turing Test on Screen: A Benchmark for Mobile GUI Agent Humanization
di: Zhu, Jiachen, et al.
Pubblicazione: (2026) -
The Generalized Turing Test: A Foundation for Comparing Intelligence
di: Mitropolsky, Daniel, et al.
Pubblicazione: (2026) -
Undetectable Conversations Between AI Agents via Pseudorandom Noise-Resilient Key Exchange
di: Vaikuntanathan, Vinod, et al.
Pubblicazione: (2026) -
Brain-Model Evaluations Need the NeuroAI Turing Test
di: Feather, Jenelle, et al.
Pubblicazione: (2025)