GUI-Robust: A Comprehensive Dataset for Testing GUI Agent Robustness in Real-World Anomalies
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Jingqi, Song, Zhilong, Chen, Jiawei, Song, Mingli, Zhou, Sheng, sun, linjun, Ouyang, Xiaogang, Chen, Chun, Wang, Can |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
D-GARA: A Dynamic Benchmarking Framework for GUI Agent Robustness in Real-World Anomalies
par: Chen, Sen, et autres
Publié: (2025)
par: Chen, Sen, et autres
Publié: (2025)
GUI Testing Arena: A Unified Benchmark for Advancing Autonomous GUI Testing Agent
par: Zhao, Kangjia, et autres
Publié: (2024)
par: Zhao, Kangjia, et autres
Publié: (2024)
CRAFT-GUI: Curriculum-Reinforced Agent For GUI Tasks
par: Nong, Songqin, et autres
Publié: (2025)
par: Nong, Songqin, et autres
Publié: (2025)
GUI-Eyes: Tool-Augmented Perception for Visual Grounding in GUI Agents
par: Chen, Chen, et autres
Publié: (2026)
par: Chen, Chen, et autres
Publié: (2026)
GUI-World: A Video Benchmark and Dataset for Multimodal GUI-oriented Understanding
par: Chen, Dongping, et autres
Publié: (2024)
par: Chen, Dongping, et autres
Publié: (2024)
MPR-GUI: Benchmarking and Enhancing Multilingual Perception and Reasoning in GUI Agents
par: Chen, Ruihan, et autres
Publié: (2025)
par: Chen, Ruihan, et autres
Publié: (2025)
History-Aware Reasoning for GUI Agents
par: Wang, Ziwei, et autres
Publié: (2025)
par: Wang, Ziwei, et autres
Publié: (2025)
GUI-PRA: Process Reward Agent for GUI Tasks
par: Xiong, Tao, et autres
Publié: (2025)
par: Xiong, Tao, et autres
Publié: (2025)
LiteGUI: Distilling Compact GUI Agents with Reinforcement Learning
par: Wu, Yubin, et autres
Publié: (2026)
par: Wu, Yubin, et autres
Publié: (2026)
META-GUI: Towards Multi-modal Conversational Agents on Mobile GUI
par: Sun, Liangtai, et autres
Publié: (2022)
par: Sun, Liangtai, et autres
Publié: (2022)
GUI-360$^\circ$: A Comprehensive Dataset and Benchmark for Computer-Using Agents
par: Mu, Jian, et autres
Publié: (2025)
par: Mu, Jian, et autres
Publié: (2025)
GTA1: GUI Test-time Scaling Agent
par: Yang, Yan, et autres
Publié: (2025)
par: Yang, Yan, et autres
Publié: (2025)
GUI-explorer: Autonomous Exploration and Mining of Transition-aware Knowledge for GUI Agent
par: Xie, Bin, et autres
Publié: (2025)
par: Xie, Bin, et autres
Publié: (2025)
ProBench: Benchmarking GUI Agents with Accurate Process Information
par: Yang, Leyang, et autres
Publié: (2025)
par: Yang, Leyang, et autres
Publié: (2025)
GUI Agents with Reinforcement Learning: Toward Digital Inhabitants
par: Hu, Junan, et autres
Publié: (2026)
par: Hu, Junan, et autres
Publié: (2026)
AppAgentX: Evolving GUI Agents as Proficient Smartphone Users
par: Jiang, Wenjia, et autres
Publié: (2025)
par: Jiang, Wenjia, et autres
Publié: (2025)
GUI Agents with Foundation Models: A Comprehensive Survey
par: Wang, Shuai, et autres
Publié: (2024)
par: Wang, Shuai, et autres
Publié: (2024)
MP-GUI: Modality Perception with MLLMs for GUI Understanding
par: Wang, Ziwei, et autres
Publié: (2025)
par: Wang, Ziwei, et autres
Publié: (2025)
GUITestScape: Towards Open-set Evaluation on Exploratory GUI Testing
par: Chen, Xiaoyi, et autres
Publié: (2026)
par: Chen, Xiaoyi, et autres
Publié: (2026)
MobileBench-OL: A Comprehensive Chinese Benchmark for Evaluating Mobile GUI Agents in Real-World Environment
par: Wu, Qinzhuo, et autres
Publié: (2026)
par: Wu, Qinzhuo, et autres
Publié: (2026)
Executable Agentic Memory for GUI Agent
par: Qin, Zerui, et autres
Publié: (2026)
par: Qin, Zerui, et autres
Publié: (2026)
GUI-ARP: Enhancing Grounding with Adaptive Region Perception for GUI Agents
par: Ye, Xianhang, et autres
Publié: (2025)
par: Ye, Xianhang, et autres
Publié: (2025)
OmniGUI: Benchmarking GUI Agents in Omni-Modal Smartphone Environments
par: Henry, Felix, et autres
Publié: (2026)
par: Henry, Felix, et autres
Publié: (2026)
MLA-Trust: Benchmarking Trustworthiness of Multimodal LLM Agents in GUI Environments
par: Yang, Xiao, et autres
Publié: (2025)
par: Yang, Xiao, et autres
Publié: (2025)
Orcust: Stepwise-Feedback Reinforcement Learning for GUI Agent
par: Lu, Junyu, et autres
Publié: (2025)
par: Lu, Junyu, et autres
Publié: (2025)
DRS-GUI: Dynamic Region Search for Training-Free GUI Grounding
par: Liu, Yichao, et autres
Publié: (2026)
par: Liu, Yichao, et autres
Publié: (2026)
GUI-Rise: Structured Reasoning and History Summarization for GUI Navigation
par: Liu, Tao, et autres
Publié: (2025)
par: Liu, Tao, et autres
Publié: (2025)
Towards Scalable Lightweight GUI Agents via Multi-role Orchestration
par: Wang, Ziwei, et autres
Publié: (2026)
par: Wang, Ziwei, et autres
Publié: (2026)
GUI-Actor: Coordinate-Free Visual Grounding for GUI Agents
par: Wu, Qianhui, et autres
Publié: (2025)
par: Wu, Qianhui, et autres
Publié: (2025)
GUI Agents: A Survey
par: Nguyen, Dang, et autres
Publié: (2024)
par: Nguyen, Dang, et autres
Publié: (2024)
GUI-GENESIS: Automated Synthesis of Efficient Environments with Verifiable Rewards for GUI Agent Post-Training
par: Cao, Yuan, et autres
Publié: (2026)
par: Cao, Yuan, et autres
Publié: (2026)
GUI-Xplore: Empowering Generalizable GUI Agents with One Exploration
par: Sun, Yuchen, et autres
Publié: (2025)
par: Sun, Yuchen, et autres
Publié: (2025)
Video2GUI: Synthesizing Large-Scale Interaction Trajectories for Generalized GUI Agent Pretraining
par: Xiong, Weimin, et autres
Publié: (2026)
par: Xiong, Weimin, et autres
Publié: (2026)
Explorer: Robust Collection of Interactable GUI Elements
par: Chaimalas, Iason, et autres
Publié: (2025)
par: Chaimalas, Iason, et autres
Publié: (2025)
EntWorld: A Holistic Environment and Benchmark for Verifiable Enterprise GUI Agents
par: Mo, Ying, et autres
Publié: (2026)
par: Mo, Ying, et autres
Publié: (2026)
MobileDreamer: Generative Sketch World Model for GUI Agent
par: Cao, Yilin, et autres
Publié: (2026)
par: Cao, Yilin, et autres
Publié: (2026)
SeeClick: Harnessing GUI Grounding for Advanced Visual GUI Agents
par: Cheng, Kanzhi, et autres
Publié: (2024)
par: Cheng, Kanzhi, et autres
Publié: (2024)
GUITester: Enabling GUI Agents for Exploratory Defect Discovery
par: Gao, Yifei, et autres
Publié: (2026)
par: Gao, Yifei, et autres
Publié: (2026)
GUI-Shepherd: Reliable Process Reward and Verification for Long-Sequence GUI Tasks
par: Chen, Cong, et autres
Publié: (2025)
par: Chen, Cong, et autres
Publié: (2025)
Towards GUI Agents: Vision-Language Diffusion Models for GUI Grounding
par: Kumbhar, Shrinidhi, et autres
Publié: (2026)
par: Kumbhar, Shrinidhi, et autres
Publié: (2026)
Documents similaires
-
D-GARA: A Dynamic Benchmarking Framework for GUI Agent Robustness in Real-World Anomalies
par: Chen, Sen, et autres
Publié: (2025) -
GUI Testing Arena: A Unified Benchmark for Advancing Autonomous GUI Testing Agent
par: Zhao, Kangjia, et autres
Publié: (2024) -
CRAFT-GUI: Curriculum-Reinforced Agent For GUI Tasks
par: Nong, Songqin, et autres
Publié: (2025) -
GUI-Eyes: Tool-Augmented Perception for Visual Grounding in GUI Agents
par: Chen, Chen, et autres
Publié: (2026) -
GUI-World: A Video Benchmark and Dataset for Multimodal GUI-oriented Understanding
par: Chen, Dongping, et autres
Publié: (2024)