Adaptive Milestone Reward for GUI Agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Zheng, Congmin, Mo, Xiaoyun, Ma, Xinbei, Lin, Qiqiang, Zhao, Yin, Zhu, Jiachen, Lou, Xingyu, Wang, Jun, Wang, Zhaoxiang, Liu, Weiwen, Zhang, Zhuosheng, Yu, Yong, Zhang, Weinan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Agent-Dice: Disentangling Knowledge Updates via Geometric Consensus for Agent Continual Learning
di: Wu, Zheng, et al.
Pubblicazione: (2026)
di: Wu, Zheng, et al.
Pubblicazione: (2026)
VeriOS: Query-Driven Proactive Human-Agent-GUI Interaction for Trustworthy OS Agents
di: Wu, Zheng, et al.
Pubblicazione: (2025)
di: Wu, Zheng, et al.
Pubblicazione: (2025)
Plan-MCTS: Plan Exploration for Action Exploitation in Web Navigation
di: Zhang, Weiming, et al.
Pubblicazione: (2026)
di: Zhang, Weiming, et al.
Pubblicazione: (2026)
CoCo-Agent: A Comprehensive Cognitive MLLM Agent for Smartphone GUI Automation
di: Ma, Xinbei, et al.
Pubblicazione: (2024)
di: Ma, Xinbei, et al.
Pubblicazione: (2024)
Turing Test on Screen: A Benchmark for Mobile GUI Agent Humanization
di: Zhu, Jiachen, et al.
Pubblicazione: (2026)
di: Zhu, Jiachen, et al.
Pubblicazione: (2026)
ColorBench: Benchmarking Mobile Agents with Graph-Structured Framework for Complex Long-Horizon Tasks
di: Song, Yuanyi, et al.
Pubblicazione: (2025)
di: Song, Yuanyi, et al.
Pubblicazione: (2025)
ColorBrowserAgent: Complex Long-Horizon Browser Agent with Adaptive Knowledge Evolution
di: Wang, Jihong, et al.
Pubblicazione: (2026)
di: Wang, Jihong, et al.
Pubblicazione: (2026)
ColorAgent: Building A Robust, Personalized, and Interactive OS Agent
di: Li, Ning, et al.
Pubblicazione: (2025)
di: Li, Ning, et al.
Pubblicazione: (2025)
Retrieval-Augmented Process Reward Model for Generalizable Mathematical Reasoning
di: Zhu, Jiachen, et al.
Pubblicazione: (2025)
di: Zhu, Jiachen, et al.
Pubblicazione: (2025)
CoLD: Counterfactually-Guided Length Debiasing for Process Reward Models in Mathematical Reasoning
di: Zheng, Congmin, et al.
Pubblicazione: (2025)
di: Zheng, Congmin, et al.
Pubblicazione: (2025)
Quick on the Uptake: Eliciting Implicit Intents from Human Demonstrations for Personalized Mobile-Use Agents
di: Wu, Zheng, et al.
Pubblicazione: (2025)
di: Wu, Zheng, et al.
Pubblicazione: (2025)
OS-Kairos: Adaptive Interaction for MLLM-Powered GUI Agents
di: Cheng, Pengzhou, et al.
Pubblicazione: (2025)
di: Cheng, Pengzhou, et al.
Pubblicazione: (2025)
Plan-over-Graph: Towards Parallelable LLM Agent Schedule
di: Zhang, Shiqi, et al.
Pubblicazione: (2025)
di: Zhang, Shiqi, et al.
Pubblicazione: (2025)
SE-GA: Memory-Augmented Self-Evolution for GUI Agents
di: Jin, Shilong, et al.
Pubblicazione: (2026)
di: Jin, Shilong, et al.
Pubblicazione: (2026)
MobileUse: A GUI Agent with Hierarchical Reflection for Autonomous Mobile Operation
di: Li, Ning, et al.
Pubblicazione: (2025)
di: Li, Ning, et al.
Pubblicazione: (2025)
Evolutionary Perspectives on the Evaluation of LLM-Based AI Agents: A Comprehensive Survey
di: Zhu, Jiachen, et al.
Pubblicazione: (2025)
di: Zhu, Jiachen, et al.
Pubblicazione: (2025)
A Survey of Process Reward Models: From Outcome Signals to Process Supervisions for Large Language Models
di: Zheng, Congmin, et al.
Pubblicazione: (2025)
di: Zheng, Congmin, et al.
Pubblicazione: (2025)
Superplatforms Have to Attack AI Agents
di: Lin, Jianghao, et al.
Pubblicazione: (2025)
di: Lin, Jianghao, et al.
Pubblicazione: (2025)
Caution for the Environment: Multimodal LLM Agents are Susceptible to Environmental Distractions
di: Ma, Xinbei, et al.
Pubblicazione: (2024)
di: Ma, Xinbei, et al.
Pubblicazione: (2024)
Skills on the Fly: Test-Time Adaptive Skill Synthesis for LLM Agents
di: Wang, Jingxing, et al.
Pubblicazione: (2026)
di: Wang, Jingxing, et al.
Pubblicazione: (2026)
Contexting as Recommendation: Evolutionary Collaborative Filtering for Context Engineering
di: Zhu, Jiachen, et al.
Pubblicazione: (2026)
di: Zhu, Jiachen, et al.
Pubblicazione: (2026)
HammerBench: Fine-Grained Function-Calling Evaluation in Real Mobile Device Scenarios
di: Wang, Jun, et al.
Pubblicazione: (2024)
di: Wang, Jun, et al.
Pubblicazione: (2024)
GEM: Gaussian Embedding Modeling for Out-of-Distribution Detection in GUI Agents
di: Wu, Zheng, et al.
Pubblicazione: (2025)
di: Wu, Zheng, et al.
Pubblicazione: (2025)
Faithful Mobile GUI Agents with Guided Advantage Estimator
di: Hu, Haowen, et al.
Pubblicazione: (2026)
di: Hu, Haowen, et al.
Pubblicazione: (2026)
Externalization in LLM Agents: A Unified Review of Memory, Skills, Protocols and Harness Engineering
di: Zhou, Chenyu, et al.
Pubblicazione: (2026)
di: Zhou, Chenyu, et al.
Pubblicazione: (2026)
EVA: Red-Teaming GUI Agents via Evolving Indirect Prompt Injection
di: Lu, Yijie, et al.
Pubblicazione: (2025)
di: Lu, Yijie, et al.
Pubblicazione: (2025)
Hammer: Robust Function-Calling for On-Device Language Models via Function Masking
di: Lin, Qiqiang, et al.
Pubblicazione: (2024)
di: Lin, Qiqiang, et al.
Pubblicazione: (2024)
P3: A Policy-Driven, Pace-Adaptive, and Diversity-Promoted Framework for data pruning in LLM Training
di: Yang, Yingxuan, et al.
Pubblicazione: (2024)
di: Yang, Yingxuan, et al.
Pubblicazione: (2024)
Chain-of-Trigger: An Agentic Backdoor that Paradoxically Enhances Agentic Robustness
di: Qiu, Jiyang, et al.
Pubblicazione: (2025)
di: Qiu, Jiyang, et al.
Pubblicazione: (2025)
MEGen: Generative Backdoor into Large Language Models via Model Editing
di: Qiu, Jiyang, et al.
Pubblicazione: (2024)
di: Qiu, Jiyang, et al.
Pubblicazione: (2024)
ColorEcosystem: Powering Personalized, Standardized, and Trustworthy Agentic Service in massive-agent Ecosystem
di: Wu, Fangwen, et al.
Pubblicazione: (2025)
di: Wu, Fangwen, et al.
Pubblicazione: (2025)
MagicGUI-RMS: A Multi-Agent Reward Model System for Self-Evolving GUI Agents via Automated Feedback Reflux
di: Li, Zecheng, et al.
Pubblicazione: (2026)
di: Li, Zecheng, et al.
Pubblicazione: (2026)
GUI-CIDER: Mid-training GUI Agents via Causal Internalization and Density-aware Exemplar Reselection
di: Wu, Zheng, et al.
Pubblicazione: (2026)
di: Wu, Zheng, et al.
Pubblicazione: (2026)
GUI-PRA: Process Reward Agent for GUI Tasks
di: Xiong, Tao, et al.
Pubblicazione: (2025)
di: Xiong, Tao, et al.
Pubblicazione: (2025)
Smoothing Grounding and Reasoning for MLLM-Powered GUI Agents with Query-Oriented Pivot Tasks
di: Wu, Zongru, et al.
Pubblicazione: (2025)
di: Wu, Zongru, et al.
Pubblicazione: (2025)
LaSM: Layer-wise Scaling Mechanism for Defending Pop-up Attack on GUI Agents
di: Yan, Zihe, et al.
Pubblicazione: (2025)
di: Yan, Zihe, et al.
Pubblicazione: (2025)
UIPro: Unleashing Superior Interaction Capability For GUI Agents
di: Li, Hongxin, et al.
Pubblicazione: (2025)
di: Li, Hongxin, et al.
Pubblicazione: (2025)
GUI Agents with Foundation Models: A Comprehensive Survey
di: Wang, Shuai, et al.
Pubblicazione: (2024)
di: Wang, Shuai, et al.
Pubblicazione: (2024)
ProgRM: Build Better GUI Agents with Progress Rewards
di: Zhang, Danyang, et al.
Pubblicazione: (2025)
di: Zhang, Danyang, et al.
Pubblicazione: (2025)
Hidden Ghost Hand: Unveiling Backdoor Vulnerabilities in MLLM-Powered Mobile GUI Agents
di: Cheng, Pengzhou, et al.
Pubblicazione: (2025)
di: Cheng, Pengzhou, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Agent-Dice: Disentangling Knowledge Updates via Geometric Consensus for Agent Continual Learning
di: Wu, Zheng, et al.
Pubblicazione: (2026) -
VeriOS: Query-Driven Proactive Human-Agent-GUI Interaction for Trustworthy OS Agents
di: Wu, Zheng, et al.
Pubblicazione: (2025) -
Plan-MCTS: Plan Exploration for Action Exploitation in Web Navigation
di: Zhang, Weiming, et al.
Pubblicazione: (2026) -
CoCo-Agent: A Comprehensive Cognitive MLLM Agent for Smartphone GUI Automation
di: Ma, Xinbei, et al.
Pubblicazione: (2024) -
Turing Test on Screen: A Benchmark for Mobile GUI Agent Humanization
di: Zhu, Jiachen, et al.
Pubblicazione: (2026)