Uncertainty-Aware GUI Agent: Adaptive Perception through Component Recommendation and Human-in-the-Loop Refinement
Fuente:
arXiv
Salvato in:
| Autori principali: | Hao, Chao, Wang, Shuai, Zhou, Kaiwen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ReInAgent: A Context-Aware GUI Agent Enabling Human-in-the-Loop Mobile Task Navigation
di: Jia, Haitao, et al.
Pubblicazione: (2025)
di: Jia, Haitao, et al.
Pubblicazione: (2025)
GUI-G1: Understanding R1-Zero-Like Training for Visual Grounding in GUI Agents
di: Zhou, Yuqi, et al.
Pubblicazione: (2025)
di: Zhou, Yuqi, et al.
Pubblicazione: (2025)
Less is More: Empowering GUI Agent with Context-Aware Simplification
di: Chen, Gongwei, et al.
Pubblicazione: (2025)
di: Chen, Gongwei, et al.
Pubblicazione: (2025)
GUI-ARP: Enhancing Grounding with Adaptive Region Perception for GUI Agents
di: Ye, Xianhang, et al.
Pubblicazione: (2025)
di: Ye, Xianhang, et al.
Pubblicazione: (2025)
EE-MCP: Self-Evolving MCP-GUI Agents via Automated Environment Generation and Experience Learning
di: He, Tiantian, et al.
Pubblicazione: (2026)
di: He, Tiantian, et al.
Pubblicazione: (2026)
GUI-explorer: Autonomous Exploration and Mining of Transition-aware Knowledge for GUI Agent
di: Xie, Bin, et al.
Pubblicazione: (2025)
di: Xie, Bin, et al.
Pubblicazione: (2025)
MPR-GUI: Benchmarking and Enhancing Multilingual Perception and Reasoning in GUI Agents
di: Chen, Ruihan, et al.
Pubblicazione: (2025)
di: Chen, Ruihan, et al.
Pubblicazione: (2025)
GUI-Eyes: Tool-Augmented Perception for Visual Grounding in GUI Agents
di: Chen, Chen, et al.
Pubblicazione: (2026)
di: Chen, Chen, et al.
Pubblicazione: (2026)
Learning with Challenges: Adaptive Difficulty-Aware Data Generation for Mobile GUI Agent Training
di: Kang, Linjia, et al.
Pubblicazione: (2026)
di: Kang, Linjia, et al.
Pubblicazione: (2026)
Iris: Breaking GUI Complexity with Adaptive Focus and Self-Refining
di: Ge, Zhiqi, et al.
Pubblicazione: (2024)
di: Ge, Zhiqi, et al.
Pubblicazione: (2024)
GUI Agents with Foundation Models: A Comprehensive Survey
di: Wang, Shuai, et al.
Pubblicazione: (2024)
di: Wang, Shuai, et al.
Pubblicazione: (2024)
Learning, Reasoning, Refinement: A Framework for Kahneman's Dual-System Intelligence in GUI Agents
di: Wei, Jinjie, et al.
Pubblicazione: (2025)
di: Wei, Jinjie, et al.
Pubblicazione: (2025)
Mirage-1: Augmenting and Updating GUI Agent with Hierarchical Multimodal Skills
di: Xie, Yuquan, et al.
Pubblicazione: (2025)
di: Xie, Yuquan, et al.
Pubblicazione: (2025)
PIRA-Bench: A Transition from Reactive GUI Agents to GUI-based Proactive Intent Recommendation Agents
di: Chai, Yuxiang, et al.
Pubblicazione: (2026)
di: Chai, Yuxiang, et al.
Pubblicazione: (2026)
AdaZoom-GUI: Adaptive Zoom-based GUI Grounding with Instruction Refinement
di: Pei, Siqi, et al.
Pubblicazione: (2026)
di: Pei, Siqi, et al.
Pubblicazione: (2026)
HalluClear: Diagnosing, Evaluating and Mitigating Hallucinations in GUI Agents
di: Jin, Chao, et al.
Pubblicazione: (2026)
di: Jin, Chao, et al.
Pubblicazione: (2026)
BEAP-Agent: Backtrackable Execution and Adaptive Planning for GUI Agents
di: Lu, Ziyu, et al.
Pubblicazione: (2026)
di: Lu, Ziyu, et al.
Pubblicazione: (2026)
\textsc{GUI-Spotlight}: Adaptive Iterative Focus Refinement for Enhanced GUI Visual Grounding
di: Lei, Bin, et al.
Pubblicazione: (2025)
di: Lei, Bin, et al.
Pubblicazione: (2025)
Adaptive Milestone Reward for GUI Agents
di: Zheng, Congmin, et al.
Pubblicazione: (2026)
di: Zheng, Congmin, et al.
Pubblicazione: (2026)
LiteGUI: Distilling Compact GUI Agents with Reinforcement Learning
di: Wu, Yubin, et al.
Pubblicazione: (2026)
di: Wu, Yubin, et al.
Pubblicazione: (2026)
MAGNET: Towards Adaptive GUI Agents with Memory-Driven Knowledge Evolution
di: Sun, Libo, et al.
Pubblicazione: (2026)
di: Sun, Libo, et al.
Pubblicazione: (2026)
AgentLens: Adaptive Visual Modalities for Human-Agent Interaction in Mobile GUI Agents
di: Kim, Jeonghyeon, et al.
Pubblicazione: (2026)
di: Kim, Jeonghyeon, et al.
Pubblicazione: (2026)
History-Aware Reasoning for GUI Agents
di: Wang, Ziwei, et al.
Pubblicazione: (2025)
di: Wang, Ziwei, et al.
Pubblicazione: (2025)
GUI-Shift: Enhancing VLM-Based GUI Agents through Self-supervised Reinforcement Learning
di: Gao, Longxi, et al.
Pubblicazione: (2025)
di: Gao, Longxi, et al.
Pubblicazione: (2025)
Entropy-Guided Loop: Achieving Reasoning through Uncertainty-Aware Generation
di: Correa, Andrew G. A., et al.
Pubblicazione: (2025)
di: Correa, Andrew G. A., et al.
Pubblicazione: (2025)
UI-R1: Enhancing Efficient Action Prediction of GUI Agents by Reinforcement Learning
di: Lu, Zhengxi, et al.
Pubblicazione: (2025)
di: Lu, Zhengxi, et al.
Pubblicazione: (2025)
GUI-PRA: Process Reward Agent for GUI Tasks
di: Xiong, Tao, et al.
Pubblicazione: (2025)
di: Xiong, Tao, et al.
Pubblicazione: (2025)
GUI-Robust: A Comprehensive Dataset for Testing GUI Agent Robustness in Real-World Anomalies
di: Yang, Jingqi, et al.
Pubblicazione: (2025)
di: Yang, Jingqi, et al.
Pubblicazione: (2025)
AgentRefine: Enhancing Agent Generalization through Refinement Tuning
di: Fu, Dayuan, et al.
Pubblicazione: (2025)
di: Fu, Dayuan, et al.
Pubblicazione: (2025)
CRAFT-GUI: Curriculum-Reinforced Agent For GUI Tasks
di: Nong, Songqin, et al.
Pubblicazione: (2025)
di: Nong, Songqin, et al.
Pubblicazione: (2025)
MP-GUI: Modality Perception with MLLMs for GUI Understanding
di: Wang, Ziwei, et al.
Pubblicazione: (2025)
di: Wang, Ziwei, et al.
Pubblicazione: (2025)
ScaleTrack: Scaling and back-tracking Automated GUI Agents
di: Huang, Jing, et al.
Pubblicazione: (2025)
di: Huang, Jing, et al.
Pubblicazione: (2025)
Mobile-Agent-v3.5: Multi-platform Fundamental GUI Agents
di: Xu, Haiyang, et al.
Pubblicazione: (2026)
di: Xu, Haiyang, et al.
Pubblicazione: (2026)
Collaborative Instance Object Navigation: Leveraging Uncertainty-Awareness to Minimize Human-Agent Dialogues
di: Taioli, Francesco, et al.
Pubblicazione: (2024)
di: Taioli, Francesco, et al.
Pubblicazione: (2024)
MagicGUI-RMS: A Multi-Agent Reward Model System for Self-Evolving GUI Agents via Automated Feedback Reflux
di: Li, Zecheng, et al.
Pubblicazione: (2026)
di: Li, Zecheng, et al.
Pubblicazione: (2026)
Mobile-Agent-v3: Fundamental Agents for GUI Automation
di: Ye, Jiabo, et al.
Pubblicazione: (2025)
di: Ye, Jiabo, et al.
Pubblicazione: (2025)
ProBench: Benchmarking GUI Agents with Accurate Process Information
di: Yang, Leyang, et al.
Pubblicazione: (2025)
di: Yang, Leyang, et al.
Pubblicazione: (2025)
No-Human in the Loop: Agentic Evaluation at Scale for Recommendation
di: Zhang, Tao, et al.
Pubblicazione: (2025)
di: Zhang, Tao, et al.
Pubblicazione: (2025)
GUI-Xplore: Empowering Generalizable GUI Agents with One Exploration
di: Sun, Yuchen, et al.
Pubblicazione: (2025)
di: Sun, Yuchen, et al.
Pubblicazione: (2025)
AppAgentX: Evolving GUI Agents as Proficient Smartphone Users
di: Jiang, Wenjia, et al.
Pubblicazione: (2025)
di: Jiang, Wenjia, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ReInAgent: A Context-Aware GUI Agent Enabling Human-in-the-Loop Mobile Task Navigation
di: Jia, Haitao, et al.
Pubblicazione: (2025) -
GUI-G1: Understanding R1-Zero-Like Training for Visual Grounding in GUI Agents
di: Zhou, Yuqi, et al.
Pubblicazione: (2025) -
Less is More: Empowering GUI Agent with Context-Aware Simplification
di: Chen, Gongwei, et al.
Pubblicazione: (2025) -
GUI-ARP: Enhancing Grounding with Adaptive Region Perception for GUI Agents
di: Ye, Xianhang, et al.
Pubblicazione: (2025) -
EE-MCP: Self-Evolving MCP-GUI Agents via Automated Environment Generation and Experience Learning
di: He, Tiantian, et al.
Pubblicazione: (2026)