Don't Act Blindly: Robust GUI Automation via Action-Effect Verification and Self-Correction
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Yuzhe, Xue, Xianwei, Wu, Xingyong, Chen, Mengke, Liu, Chen, He, Xinran, Shao, Run, Liu, Feiran, Xu, Huanmin, Pan, Qiutong, Wang, Haiwei |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Graph-Based Chain-of-Thought Pruning for Reducing Redundant Reflections in Reasoning LLMs
par: Yuan, Hongyuan, et autres
Publié: (2026)
par: Yuan, Hongyuan, et autres
Publié: (2026)
Don't Look into the Dark: Latent Codes for Pluralistic Image Inpainting
par: Chen, Haiwei, et autres
Publié: (2024)
par: Chen, Haiwei, et autres
Publié: (2024)
You Don't Know Until You Click:Automated GUI Testing for Production-Ready Software Evaluation
par: Bian, Yutong, et autres
Publié: (2025)
par: Bian, Yutong, et autres
Publié: (2025)
Don't Confuse! Redrawing GUI Navigation Flow in Mobile Apps for Visually Impaired Users
par: Zhang, Mengxi, et autres
Publié: (2025)
par: Zhang, Mengxi, et autres
Publié: (2025)
RISE: Reasoning Enhancement via Iterative Self-Exploration in Multi-hop Question Answering
par: He, Bolei, et autres
Publié: (2025)
par: He, Bolei, et autres
Publié: (2025)
Coding Agents Don't Know When to Act
par: Gloaguen, Thibaud, et autres
Publié: (2026)
par: Gloaguen, Thibaud, et autres
Publié: (2026)
Correction to: Don't forget the blogosphere
Publié: (2024)
Publié: (2024)
GUI-R1 : A Generalist R1-Style Vision-Language Action Model For GUI Agents
par: Luo, Run, et autres
Publié: (2025)
par: Luo, Run, et autres
Publié: (2025)
GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL
par: Yang, Rui, et autres
Publié: (2026)
par: Yang, Rui, et autres
Publié: (2026)
Select to Know: An Internal-External Knowledge Self-Selection Framework for Domain-Specific Question Answering
par: He, Bolei, et autres
Publié: (2025)
par: He, Bolei, et autres
Publié: (2025)
Don't Blind Your VLA: Aligning Visual Representations for OOD Generalization
par: Kachaev, Nikita, et autres
Publié: (2025)
par: Kachaev, Nikita, et autres
Publié: (2025)
GUI-Shepherd: Reliable Process Reward and Verification for Long-Sequence GUI Tasks
par: Chen, Cong, et autres
Publié: (2025)
par: Chen, Cong, et autres
Publié: (2025)
CAPTCHA Solving for Native GUI Agents: Automated Reasoning-Action Data Generation and Self-Corrective Training
par: Chen, Yuxi, et autres
Publié: (2026)
par: Chen, Yuxi, et autres
Publié: (2026)
GUI-Eyes: Tool-Augmented Perception for Visual Grounding in GUI Agents
par: Chen, Chen, et autres
Publié: (2026)
par: Chen, Chen, et autres
Publié: (2026)
Angles Don't Lie: Unlocking Training-Efficient RL Through the Model's Own Signals
par: Wang, Qinsi, et autres
Publié: (2025)
par: Wang, Qinsi, et autres
Publié: (2025)
Access Improvement in Healthcare: Be Quick, but Don't Hurry?
par: Allen M. Chen
Publié: (2025)
par: Allen M. Chen
Publié: (2025)
GUI-GENESIS: Automated Synthesis of Efficient Environments with Verifiable Rewards for GUI Agent Post-Training
par: Cao, Yuan, et autres
Publié: (2026)
par: Cao, Yuan, et autres
Publié: (2026)
Don't be salesmen
Publié: (1997)
Publié: (1997)
Don't let the information slip away
par: Li, Taozhe, et autres
Publié: (2026)
par: Li, Taozhe, et autres
Publié: (2026)
Don't Let It Hallucinate: Premise Verification via Retrieval-Augmented Logical Reasoning
par: Qin, Yuehan, et autres
Publié: (2025)
par: Qin, Yuehan, et autres
Publié: (2025)
Don't Explain Noise: Robust Counterfactuals for Randomized Ensembles
par: Forel, Alexandre, et autres
Publié: (2022)
par: Forel, Alexandre, et autres
Publié: (2022)
You Don't Need Public Tests to Generate Correct Code
par: Silva, Kaushitha, et autres
Publié: (2026)
par: Silva, Kaushitha, et autres
Publié: (2026)
Don't Yell at Your Robot: Physical Correction as the Collaborative Interface for Language Model Powered Robots
par: Zhang, Chuye, et autres
Publié: (2024)
par: Zhang, Chuye, et autres
Publié: (2024)
Can AI Assistants Know What They Don't Know?
par: Cheng, Qinyuan, et autres
Publié: (2024)
par: Cheng, Qinyuan, et autres
Publié: (2024)
Don’t Burn it Here
par: Walsh, Ed, et autres
Publié: (2026)
par: Walsh, Ed, et autres
Publié: (2026)
Don't Look Away
par: Cohen, Brianne
Publié: (2023)
par: Cohen, Brianne
Publié: (2023)
Don't Forget Imagination!
par: Vityaev, Evgenii E., et autres
Publié: (2025)
par: Vityaev, Evgenii E., et autres
Publié: (2025)
Don't Pay Attention
par: Hammoud, Mohammad, et autres
Publié: (2025)
par: Hammoud, Mohammad, et autres
Publié: (2025)
Don't ban the bomb
Publié: (1997)
Publié: (1997)
Don't despair, not today
par: Zhaohui Su
Publié: (2025)
par: Zhaohui Su
Publié: (2025)
(Don't) Mind the Gap
par: Frank, Natalie Priebe, et autres
Publié: (2025)
par: Frank, Natalie Priebe, et autres
Publié: (2025)
Dewey or Don't We?
par: Pendergrass, Devona J.
Publié: (2013)
par: Pendergrass, Devona J.
Publié: (2013)
Don't Neglect Nonfiction.
par: Kobrin, Beverly
Publié: (1991)
par: Kobrin, Beverly
Publié: (1991)
Don't Outsource It. Do It!
par: Nuzzo, David
Publié: (1999)
par: Nuzzo, David
Publié: (1999)
They Shoot Supervisors, Don't They?
par: Jaffe, Martin Elliot, et autres
Publié: (1987)
par: Jaffe, Martin Elliot, et autres
Publié: (1987)
Don't Interpret ‘No’ As ‘Never’
Publié: (2024)
Publié: (2024)
Don't anchor on me!
par: Ann‐Marie Tantoco, et autres
Publié: (2024)
par: Ann‐Marie Tantoco, et autres
Publié: (2024)
Don't Forget Vendors
Publié: (2024)
Publié: (2024)
Counting irreducible representations of general linear groups and unitary groups
par: Wang, Qiutong
Publié: (2025)
par: Wang, Qiutong
Publié: (2025)
Revise, Don't Freeze: Sampler-Matched Training for Self-Correcting Masked Diffusion Language Models
par: Yu, Longxuan, et autres
Publié: (2026)
par: Yu, Longxuan, et autres
Publié: (2026)
Documents similaires
-
Graph-Based Chain-of-Thought Pruning for Reducing Redundant Reflections in Reasoning LLMs
par: Yuan, Hongyuan, et autres
Publié: (2026) -
Don't Look into the Dark: Latent Codes for Pluralistic Image Inpainting
par: Chen, Haiwei, et autres
Publié: (2024) -
You Don't Know Until You Click:Automated GUI Testing for Production-Ready Software Evaluation
par: Bian, Yutong, et autres
Publié: (2025) -
Don't Confuse! Redrawing GUI Navigation Flow in Mobile Apps for Visually Impaired Users
par: Zhang, Mengxi, et autres
Publié: (2025) -
RISE: Reasoning Enhancement via Iterative Self-Exploration in Multi-hop Question Answering
par: He, Bolei, et autres
Publié: (2025)