Detecting Visual Information Manipulation Attacks in Augmented Reality: A Multimodal Semantic Reasoning Approach
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xiu, Yanming, Gorlatova, Maria |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ViDDAR: Vision Language Model-Based Task-Detrimental Content Detection for Augmented Reality
par: Xiu, Yanming, et autres
Publié: (2025)
par: Xiu, Yanming, et autres
Publié: (2025)
Benchmarking Vision-Language Models under Contradictory Virtual Content Attacks in Augmented Reality
par: Xiu, Yanming, et autres
Publié: (2026)
par: Xiu, Yanming, et autres
Publié: (2026)
User Prompting Strategies and Prompt Enhancement Methods for Open-Set Object Detection in XR Environments
par: Lin, Junfeng, et autres
Publié: (2026)
par: Lin, Junfeng, et autres
Publié: (2026)
Demonstrating Visual Information Manipulation Attacks in Augmented Reality: A Hands-On Miniature City-Based Setup
par: Xiu, Yanming, et autres
Publié: (2025)
par: Xiu, Yanming, et autres
Publié: (2025)
A Neurosymbolic Framework for Interpretable Cognitive Attack Detection in Augmented Reality
par: Chen, Rongqian, et autres
Publié: (2025)
par: Chen, Rongqian, et autres
Publié: (2025)
Toward Safe, Trustworthy and Realistic Augmented Reality User Experience
par: Xiu, Yanming
Publié: (2025)
par: Xiu, Yanming
Publié: (2025)
Advancing the Understanding and Evaluation of AR-Generated Scenes: When Vision-Language Models Shine and Stumble
par: Duan, Lin, et autres
Publié: (2025)
par: Duan, Lin, et autres
Publié: (2025)
DeepSketcher: Internalizing Visual Manipulation for Multimodal Reasoning
par: Zhang, Chi, et autres
Publié: (2025)
par: Zhang, Chi, et autres
Publié: (2025)
SEER-VAR: Semantic Egocentric Environment Reasoner for Vehicle Augmented Reality
par: Lai, Yuzhi, et autres
Publié: (2025)
par: Lai, Yuzhi, et autres
Publié: (2025)
REVEAL: Reference-Grounded Reasoning for Multimodal Manipulation Detection
par: Zhou, Jun, et autres
Publié: (2026)
par: Zhou, Jun, et autres
Publié: (2026)
Cultivating Forensic Reasoning for Generalizable Multimodal Manipulation Detection
par: Zhang, Yuchen, et autres
Publié: (2026)
par: Zhang, Yuchen, et autres
Publié: (2026)
MIGA: Mutual Information-Guided Attack on Denoising Models for Semantic Manipulation
par: Li, Guanghao, et autres
Publié: (2025)
par: Li, Guanghao, et autres
Publié: (2025)
Multimodal Multilabel Classification by CLIP
par: Guo, Yanming
Publié: (2024)
par: Guo, Yanming
Publié: (2024)
RASR: Retrieval-Augmented Semantic Reasoning for Fake News Video Detection
par: Li, Hui, et autres
Publié: (2026)
par: Li, Hui, et autres
Publié: (2026)
Semantic-Aware Label Placement for Augmented Reality in Street View
par: Jia, Jianqing, et autres
Publié: (2019)
par: Jia, Jianqing, et autres
Publié: (2019)
VisCRA: A Visual Chain Reasoning Attack for Jailbreaking Multimodal Large Language Models
par: Sima, Bingrui, et autres
Publié: (2025)
par: Sima, Bingrui, et autres
Publié: (2025)
Semantic Visual Anomaly Detection and Reasoning in AI-Generated Images
par: Tan, Chuangchuang, et autres
Publié: (2025)
par: Tan, Chuangchuang, et autres
Publié: (2025)
VRSA: Jailbreaking Multimodal Large Language Models through Visual Reasoning Sequential Attack
par: Zhao, Shiji, et autres
Publié: (2025)
par: Zhao, Shiji, et autres
Publié: (2025)
A Parametric Approach to Adversarial Augmentation for Cross-Domain Iris Presentation Attack Detection
par: Pal, Debasmita, et autres
Publié: (2024)
par: Pal, Debasmita, et autres
Publié: (2024)
HV-Attack: Hierarchical Visual Attack for Multimodal Retrieval Augmented Generation
par: Luo, Linyin, et autres
Publié: (2025)
par: Luo, Linyin, et autres
Publié: (2025)
UniShield: Unified Face Attack Detection via KG-Informed Multimodal Reasoning
par: Li, Hongrui, et autres
Publié: (2026)
par: Li, Hongrui, et autres
Publié: (2026)
AeroRAG: Structured Multimodal Retrieval-Augmented LLM for Fine-Grained Aerial Visual Reasoning
par: Xue, Junxiao, et autres
Publié: (2026)
par: Xue, Junxiao, et autres
Publié: (2026)
Beyond Artificial Misalignment: Detecting and Grounding Semantic-Coordinated Multimodal Manipulations
par: Shen, Jinjie, et autres
Publié: (2025)
par: Shen, Jinjie, et autres
Publié: (2025)
Semantic-Enriched Latent Visual Reasoning
par: Xu, Tianrun, et autres
Publié: (2026)
par: Xu, Tianrun, et autres
Publié: (2026)
Towards an Incremental Unified Multimodal Anomaly Detection: Augmenting Multimodal Denoising From an Information Bottleneck Perspective
par: Long, Kaifang, et autres
Publié: (2026)
par: Long, Kaifang, et autres
Publié: (2026)
VERIFY: A Benchmark of Visual Explanation and Reasoning for Investigating Multimodal Reasoning Fidelity
par: Bi, Jing, et autres
Publié: (2025)
par: Bi, Jing, et autres
Publié: (2025)
SplatLoc: 3D Gaussian Splatting-based Visual Localization for Augmented Reality
par: Zhai, Hongjia, et autres
Publié: (2024)
par: Zhai, Hongjia, et autres
Publié: (2024)
Uncertainty-based Detection of Adversarial Attacks in Semantic Segmentation
par: Maag, Kira, et autres
Publié: (2023)
par: Maag, Kira, et autres
Publié: (2023)
NoisyRollout: Reinforcing Visual Reasoning with Data Augmentation
par: Liu, Xiangyan, et autres
Publié: (2025)
par: Liu, Xiangyan, et autres
Publié: (2025)
ReasonCD: A Multimodal Reasoning Large Model for Implicit Change-of-Interest Semantic Mining
par: Huang, Zhenyang, et autres
Publié: (2025)
par: Huang, Zhenyang, et autres
Publié: (2025)
Say It, See It: A Systematic Evaluation on Speech-Based 3D Content Generation Methods in Augmented Reality
par: Xiu, Yanming, et autres
Publié: (2025)
par: Xiu, Yanming, et autres
Publié: (2025)
Backdoor Attack on Vision Language Models with Stealthy Semantic Manipulation
par: Zhong, Zhiyuan, et autres
Publié: (2025)
par: Zhong, Zhiyuan, et autres
Publié: (2025)
Think Proprioceptively: Embodied Visual Reasoning for VLA Manipulation
par: Wang, Fangyuan, et autres
Publié: (2026)
par: Wang, Fangyuan, et autres
Publié: (2026)
Adversarial Patch Attack for Ship Detection via Localized Augmentation
par: Liu, Chun, et autres
Publié: (2025)
par: Liu, Chun, et autres
Publié: (2025)
Challenging Vision-Language Models with Physically Deployable Multimodal Semantic Lighting Attacks
par: Zhao, Yingying, et autres
Publié: (2026)
par: Zhao, Yingying, et autres
Publié: (2026)
Benchmarking Multimodal Mathematical Reasoning with Explicit Visual Dependency
par: Wang, Zhikai, et autres
Publié: (2025)
par: Wang, Zhikai, et autres
Publié: (2025)
Visual Dominance and Emerging Multimodal Approaches in Distracted Driving Detection: A Review of Machine Learning Techniques
par: Dontoh, Anthony, et autres
Publié: (2025)
par: Dontoh, Anthony, et autres
Publié: (2025)
GeoVista: Web-Augmented Agentic Visual Reasoning for Geolocalization
par: Wang, Yikun, et autres
Publié: (2025)
par: Wang, Yikun, et autres
Publié: (2025)
Visual-Augmented Dynamic Semantic Prototype for Generative Zero-Shot Learning
par: Hou, Wenjin, et autres
Publié: (2024)
par: Hou, Wenjin, et autres
Publié: (2024)
Simultaneous Tactile-Visual Perception for Learning Multimodal Robot Manipulation
par: Li, Yuyang, et autres
Publié: (2025)
par: Li, Yuyang, et autres
Publié: (2025)
Documents similaires
-
ViDDAR: Vision Language Model-Based Task-Detrimental Content Detection for Augmented Reality
par: Xiu, Yanming, et autres
Publié: (2025) -
Benchmarking Vision-Language Models under Contradictory Virtual Content Attacks in Augmented Reality
par: Xiu, Yanming, et autres
Publié: (2026) -
User Prompting Strategies and Prompt Enhancement Methods for Open-Set Object Detection in XR Environments
par: Lin, Junfeng, et autres
Publié: (2026) -
Demonstrating Visual Information Manipulation Attacks in Augmented Reality: A Hands-On Miniature City-Based Setup
par: Xiu, Yanming, et autres
Publié: (2025) -
A Neurosymbolic Framework for Interpretable Cognitive Attack Detection in Augmented Reality
par: Chen, Rongqian, et autres
Publié: (2025)