Guardado en:
| Autores principales: | Zhao, Haoren, Chen, Tianyi, Wang, Zhen |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2504.04716 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
WinDeskGround: A Benchmark for Robust GUI Grounding in Complex Multi-Window Desktop Environments
por: Zhao, Haoren, et al.
Publicado: (2026)
por: Zhao, Haoren, et al.
Publicado: (2026)
POINTS-GUI-G: GUI-Grounding Journey
por: Zhao, Zhongyin, et al.
Publicado: (2026)
por: Zhao, Zhongyin, et al.
Publicado: (2026)
SparkUI-Parser: Enhancing GUI Perception with Robust Grounding and Parsing
por: Jing, Hongyi, et al.
Publicado: (2025)
por: Jing, Hongyi, et al.
Publicado: (2025)
Generalist Scanner Meets Specialist Locator: A Synergistic Coarse-to-Fine Framework for Robust GUI Grounding
por: Li, Zhecheng, et al.
Publicado: (2025)
por: Li, Zhecheng, et al.
Publicado: (2025)
Chain of Attack: On the Robustness of Vision-Language Models Against Transfer-Based Adversarial Attacks
por: Xie, Peng, et al.
Publicado: (2024)
por: Xie, Peng, et al.
Publicado: (2024)
AutoGUI: Scaling GUI Grounding with Automatic Functionality Annotations from LLMs
por: Li, Hongxin, et al.
Publicado: (2025)
por: Li, Hongxin, et al.
Publicado: (2025)
Phi-Ground Tech Report: Advancing Perception in GUI Grounding
por: Zhang, Miaosen, et al.
Publicado: (2025)
por: Zhang, Miaosen, et al.
Publicado: (2025)
Attack Deterministic Conditional Image Generative Models for Diverse and Controllable Generation
por: Chu, Tianyi, et al.
Publicado: (2024)
por: Chu, Tianyi, et al.
Publicado: (2024)
GoClick: Lightweight Element Grounding Model for Autonomous GUI Interaction
por: Li, Hongxin, et al.
Publicado: (2026)
por: Li, Hongxin, et al.
Publicado: (2026)
Towards GUI Agents: Vision-Language Diffusion Models for GUI Grounding
por: Kumbhar, Shrinidhi, et al.
Publicado: (2026)
por: Kumbhar, Shrinidhi, et al.
Publicado: (2026)
GUI-C$^2$: Coarse-to-Fine GUI Grounding via Difficulty-Aware Reinforcement Learning
por: Li, Junlong, et al.
Publicado: (2026)
por: Li, Junlong, et al.
Publicado: (2026)
Learning GUI Grounding with Spatial Reasoning from Visual Feedback
por: Zhao, Yu, et al.
Publicado: (2025)
por: Zhao, Yu, et al.
Publicado: (2025)
Robust Identity Perceptual Watermark Against Deepfake Face Swapping
por: Wang, Tianyi, et al.
Publicado: (2023)
por: Wang, Tianyi, et al.
Publicado: (2023)
Trifuse: Enhancing Attention-Based GUI Grounding via Multimodal Fusion
por: Ma, Longhui, et al.
Publicado: (2026)
por: Ma, Longhui, et al.
Publicado: (2026)
GUI-ARP: Enhancing Grounding with Adaptive Region Perception for GUI Agents
por: Ye, Xianhang, et al.
Publicado: (2025)
por: Ye, Xianhang, et al.
Publicado: (2025)
How Auxiliary Reasoning Unleashes GUI Grounding in VLMs
por: Li, Weiming, et al.
Publicado: (2025)
por: Li, Weiming, et al.
Publicado: (2025)
Robustness of Vision Language Models Against Split-Image Harmful Input Attacks
por: Rashid, Md Rafi Ur, et al.
Publicado: (2026)
por: Rashid, Md Rafi Ur, et al.
Publicado: (2026)
Robust Spiking Neural Networks Against Adversarial Attacks
por: Wang, Shuai, et al.
Publicado: (2026)
por: Wang, Shuai, et al.
Publicado: (2026)
Attention-driven GUI Grounding: Leveraging Pretrained Multimodal Large Language Models without Fine-Tuning
por: Xu, Hai-Ming, et al.
Publicado: (2024)
por: Xu, Hai-Ming, et al.
Publicado: (2024)
Unified Prompt Attack Against Text-to-Image Generation Models
por: Peng, Duo, et al.
Publicado: (2025)
por: Peng, Duo, et al.
Publicado: (2025)
AdaZoom-GUI: Adaptive Zoom-based GUI Grounding with Instruction Refinement
por: Pei, Siqi, et al.
Publicado: (2026)
por: Pei, Siqi, et al.
Publicado: (2026)
GUI-Actor: Coordinate-Free Visual Grounding for GUI Agents
por: Wu, Qianhui, et al.
Publicado: (2025)
por: Wu, Qianhui, et al.
Publicado: (2025)
Read Anywhere Pointed: Layout-aware GUI Screen Reading with Tree-of-Lens Grounding
por: Fan, Yue, et al.
Publicado: (2024)
por: Fan, Yue, et al.
Publicado: (2024)
MVP: Multiple View Prediction Improves GUI Grounding
por: Zhang, Yunzhu, et al.
Publicado: (2025)
por: Zhang, Yunzhu, et al.
Publicado: (2025)
GUI-G$^2$: Gaussian Reward Modeling for GUI Grounding
por: Tang, Fei, et al.
Publicado: (2025)
por: Tang, Fei, et al.
Publicado: (2025)
SIFT-Graph: Benchmarking Multimodal Defense Against Image Adversarial Attacks With Robust Feature Graph
por: He, Jingjie, et al.
Publicado: (2025)
por: He, Jingjie, et al.
Publicado: (2025)
GUI-Bee: Align GUI Action Grounding to Novel Environments via Autonomous Exploration
por: Fan, Yue, et al.
Publicado: (2025)
por: Fan, Yue, et al.
Publicado: (2025)
R-VLM: Region-Aware Vision Language Model for Precise GUI Grounding
por: Park, Joonhyung, et al.
Publicado: (2025)
por: Park, Joonhyung, et al.
Publicado: (2025)
ResGuard: Enhancing Robustness Against Known Original Attacks in Deep Watermarking
por: Wang, Hanyi, et al.
Publicado: (2026)
por: Wang, Hanyi, et al.
Publicado: (2026)
Stroke3D: Lifting 2D strokes into rigged 3D model via latent diffusion models
por: Zhao, Ruisi, et al.
Publicado: (2026)
por: Zhao, Ruisi, et al.
Publicado: (2026)
Enhancing Trustworthy GUI Grounding via Self-Critiqued Reinforcement Learning
por: Zhang, Shaojie, et al.
Publicado: (2025)
por: Zhang, Shaojie, et al.
Publicado: (2025)
Towards Unified Robustness Against Both Backdoor and Adversarial Attacks
por: Niu, Zhenxing, et al.
Publicado: (2024)
por: Niu, Zhenxing, et al.
Publicado: (2024)
Reproducibility Study on Adversarial Attacks Against Robust Transformer Trackers
por: Nokabadi, Fatemeh Nourilenjan, et al.
Publicado: (2024)
por: Nokabadi, Fatemeh Nourilenjan, et al.
Publicado: (2024)
Robust and Transferable Backdoor Attacks Against Deep Image Compression With Selective Frequency Prior
por: Yu, Yi, et al.
Publicado: (2024)
por: Yu, Yi, et al.
Publicado: (2024)
Membership Inference Attack Against Masked Image Modeling
por: Li, Zheng, et al.
Publicado: (2024)
por: Li, Zheng, et al.
Publicado: (2024)
UI-Ins: Enhancing GUI Grounding with Multi-Perspective Instruction-as-Reasoning
por: Chen, Liangyu, et al.
Publicado: (2025)
por: Chen, Liangyu, et al.
Publicado: (2025)
Improving GUI Grounding with Explicit Position-to-Coordinate Mapping
por: Wang, Suyuchen, et al.
Publicado: (2025)
por: Wang, Suyuchen, et al.
Publicado: (2025)
\textsc{GUI-Spotlight}: Adaptive Iterative Focus Refinement for Enhanced GUI Visual Grounding
por: Lei, Bin, et al.
Publicado: (2025)
por: Lei, Bin, et al.
Publicado: (2025)
BAMI: Training-Free Bias Mitigation in GUI Grounding
por: Zhang, Borui, et al.
Publicado: (2026)
por: Zhang, Borui, et al.
Publicado: (2026)
Towards Robust Content Watermarking Against Removal and Forgery Attacks
por: Zhu, Yifan, et al.
Publicado: (2026)
por: Zhu, Yifan, et al.
Publicado: (2026)
Ejemplares similares
-
WinDeskGround: A Benchmark for Robust GUI Grounding in Complex Multi-Window Desktop Environments
por: Zhao, Haoren, et al.
Publicado: (2026) -
POINTS-GUI-G: GUI-Grounding Journey
por: Zhao, Zhongyin, et al.
Publicado: (2026) -
SparkUI-Parser: Enhancing GUI Perception with Robust Grounding and Parsing
por: Jing, Hongyi, et al.
Publicado: (2025) -
Generalist Scanner Meets Specialist Locator: A Synergistic Coarse-to-Fine Framework for Robust GUI Grounding
por: Li, Zhecheng, et al.
Publicado: (2025) -
Chain of Attack: On the Robustness of Vision-Language Models Against Transfer-Based Adversarial Attacks
por: Xie, Peng, et al.
Publicado: (2024)