Learning with Challenges: Adaptive Difficulty-Aware Data Generation for Mobile GUI Agent Training
Fuente:
arXiv
Salvato in:
| Autori principali: | Kang, Linjia, Wang, Zhimin, Zhang, Yongkang, Wu, Duo, Wang, Jinghe, Ma, Ming, Yan, Haopeng, Wang, Zhi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Collaborative Belief Reasoning with LLMs for Efficient Multi-Agent Collaboration
di: Wang, Zhimin, et al.
Pubblicazione: (2025)
di: Wang, Zhimin, et al.
Pubblicazione: (2025)
CATP-LLM: Empowering Large Language Models for Cost-Aware Tool Planning
di: Wu, Duo, et al.
Pubblicazione: (2024)
di: Wu, Duo, et al.
Pubblicazione: (2024)
MobileA3gent: Training Mobile GUI Agents Using Decentralized Self-Sourced Data from Diverse Users
di: Wang, Wenhao, et al.
Pubblicazione: (2025)
di: Wang, Wenhao, et al.
Pubblicazione: (2025)
LiteGUI: Distilling Compact GUI Agents with Reinforcement Learning
di: Wu, Yubin, et al.
Pubblicazione: (2026)
di: Wu, Yubin, et al.
Pubblicazione: (2026)
ReInAgent: A Context-Aware GUI Agent Enabling Human-in-the-Loop Mobile Task Navigation
di: Jia, Haitao, et al.
Pubblicazione: (2025)
di: Jia, Haitao, et al.
Pubblicazione: (2025)
Mobile-Agent-v3: Fundamental Agents for GUI Automation
di: Ye, Jiabo, et al.
Pubblicazione: (2025)
di: Ye, Jiabo, et al.
Pubblicazione: (2025)
MagicGUI: A Foundational Mobile GUI Agent with Scalable Data Pipeline and Reinforcement Fine-tuning
di: Tang, Liujian, et al.
Pubblicazione: (2025)
di: Tang, Liujian, et al.
Pubblicazione: (2025)
MobileRL: Online Agentic Reinforcement Learning for Mobile GUI Agents
di: Xu, Yifan, et al.
Pubblicazione: (2025)
di: Xu, Yifan, et al.
Pubblicazione: (2025)
DISCO Balances the Scales: Adaptive Domain- and Difficulty-Aware Reinforcement Learning on Imbalanced Data
di: Zhou, Yuhang, et al.
Pubblicazione: (2025)
di: Zhou, Yuhang, et al.
Pubblicazione: (2025)
Adaptive Milestone Reward for GUI Agents
di: Zheng, Congmin, et al.
Pubblicazione: (2026)
di: Zheng, Congmin, et al.
Pubblicazione: (2026)
Efficient Multi-turn RL for GUI Agents via Decoupled Training and Adaptive Data Curation
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
di: Li, Pengxiang, et al.
Pubblicazione: (2025)
Uncertainty-Aware GUI Agent: Adaptive Perception through Component Recommendation and Human-in-the-Loop Refinement
di: Hao, Chao, et al.
Pubblicazione: (2025)
di: Hao, Chao, et al.
Pubblicazione: (2025)
Mobile-Agent-v3.5: Multi-platform Fundamental GUI Agents
di: Xu, Haiyang, et al.
Pubblicazione: (2026)
di: Xu, Haiyang, et al.
Pubblicazione: (2026)
CORA: Conformal Risk-Controlled Agents for Safeguarded Mobile GUI Automation
di: Feng, Yushi, et al.
Pubblicazione: (2026)
di: Feng, Yushi, et al.
Pubblicazione: (2026)
CAPTCHA Solving for Native GUI Agents: Automated Reasoning-Action Data Generation and Self-Corrective Training
di: Chen, Yuxi, et al.
Pubblicazione: (2026)
di: Chen, Yuxi, et al.
Pubblicazione: (2026)
MobileDreamer: Generative Sketch World Model for GUI Agent
di: Cao, Yilin, et al.
Pubblicazione: (2026)
di: Cao, Yilin, et al.
Pubblicazione: (2026)
Faithful Mobile GUI Agents with Guided Advantage Estimator
di: Hu, Haowen, et al.
Pubblicazione: (2026)
di: Hu, Haowen, et al.
Pubblicazione: (2026)
MAS-Bench: A Unified Benchmark for Shortcut-Augmented Hybrid Mobile GUI Agents
di: Zhao, Pengxiang, et al.
Pubblicazione: (2025)
di: Zhao, Pengxiang, et al.
Pubblicazione: (2025)
GUI-ARP: Enhancing Grounding with Adaptive Region Perception for GUI Agents
di: Ye, Xianhang, et al.
Pubblicazione: (2025)
di: Ye, Xianhang, et al.
Pubblicazione: (2025)
AgentLens: Adaptive Visual Modalities for Human-Agent Interaction in Mobile GUI Agents
di: Kim, Jeonghyeon, et al.
Pubblicazione: (2026)
di: Kim, Jeonghyeon, et al.
Pubblicazione: (2026)
GUI-GENESIS: Automated Synthesis of Efficient Environments with Verifiable Rewards for GUI Agent Post-Training
di: Cao, Yuan, et al.
Pubblicazione: (2026)
di: Cao, Yuan, et al.
Pubblicazione: (2026)
META-GUI: Towards Multi-modal Conversational Agents on Mobile GUI
di: Sun, Liangtai, et al.
Pubblicazione: (2022)
di: Sun, Liangtai, et al.
Pubblicazione: (2022)
MAGNET: Towards Adaptive GUI Agents with Memory-Driven Knowledge Evolution
di: Sun, Libo, et al.
Pubblicazione: (2026)
di: Sun, Libo, et al.
Pubblicazione: (2026)
History-Aware Reasoning for GUI Agents
di: Wang, Ziwei, et al.
Pubblicazione: (2025)
di: Wang, Ziwei, et al.
Pubblicazione: (2025)
Adaptive Social Metaverse Streaming based on Federated Multi-Agent Deep Reinforcement Learning
di: Long, Zijian, et al.
Pubblicazione: (2025)
di: Long, Zijian, et al.
Pubblicazione: (2025)
VenusBench-Mobile: A Challenging and User-Centric Benchmark for Mobile GUI Agents with Capability Diagnostics
di: Gong, Yichen, et al.
Pubblicazione: (2026)
di: Gong, Yichen, et al.
Pubblicazione: (2026)
MPCI-Bench: A Benchmark for Multimodal Pairwise Contextual Integrity Evaluation of Language Model Agents
di: Wang, Shouju, et al.
Pubblicazione: (2026)
di: Wang, Shouju, et al.
Pubblicazione: (2026)
MIRAGE: Context-Aware Prompt Injection against Mobile GUI Agents via User-Generated Content
di: Guo, Ruoqi, et al.
Pubblicazione: (2026)
di: Guo, Ruoqi, et al.
Pubblicazione: (2026)
M$^2$-Miner: Multi-Agent Enhanced MCTS for Mobile GUI Agent Data Mining
di: Lv, Rui, et al.
Pubblicazione: (2026)
di: Lv, Rui, et al.
Pubblicazione: (2026)
Synthesizing Agentic Data for Web Agents with Progressive Difficulty Enhancement Mechanisms
di: Pandit, Shrey, et al.
Pubblicazione: (2025)
di: Pandit, Shrey, et al.
Pubblicazione: (2025)
InfiniteWeb: Scalable Web Environment Synthesis for GUI Agent Training
di: Zhang, Ziyun, et al.
Pubblicazione: (2026)
di: Zhang, Ziyun, et al.
Pubblicazione: (2026)
ANCHOR: Branch-Point Data Generation for GUI Agents
di: Wei, Jinbiao, et al.
Pubblicazione: (2026)
di: Wei, Jinbiao, et al.
Pubblicazione: (2026)
DARE: Difficulty-Adaptive Reinforcement Learning with Co-Evolved Difficulty Estimation
di: Zhou, Yang, et al.
Pubblicazione: (2026)
di: Zhou, Yang, et al.
Pubblicazione: (2026)
D$^2$Evo: Dual Difficulty-Aware Self-Evolution for Data-Efficient Reinforcement Learning
di: Zhang, Ru, et al.
Pubblicazione: (2026)
di: Zhang, Ru, et al.
Pubblicazione: (2026)
GUI-Libra: Training Native GUI Agents to Reason and Act with Action-aware Supervision and Partially Verifiable RL
di: Yang, Rui, et al.
Pubblicazione: (2026)
di: Yang, Rui, et al.
Pubblicazione: (2026)
GUI-C$^2$: Coarse-to-Fine GUI Grounding via Difficulty-Aware Reinforcement Learning
di: Li, Junlong, et al.
Pubblicazione: (2026)
di: Li, Junlong, et al.
Pubblicazione: (2026)
A3: Android Agent Arena for Mobile GUI Agents with Essential-State Procedural Evaluation
di: Chai, Yuxiang, et al.
Pubblicazione: (2025)
di: Chai, Yuxiang, et al.
Pubblicazione: (2025)
D-Artemis: A Deliberative Cognitive Framework for Mobile GUI Multi-Agents
di: Mi, Hongze, et al.
Pubblicazione: (2025)
di: Mi, Hongze, et al.
Pubblicazione: (2025)
GUI Agents for Continual Game Generation
di: Huang, Yixu, et al.
Pubblicazione: (2026)
di: Huang, Yixu, et al.
Pubblicazione: (2026)
OS-Kairos: Adaptive Interaction for MLLM-Powered GUI Agents
di: Cheng, Pengzhou, et al.
Pubblicazione: (2025)
di: Cheng, Pengzhou, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Collaborative Belief Reasoning with LLMs for Efficient Multi-Agent Collaboration
di: Wang, Zhimin, et al.
Pubblicazione: (2025) -
CATP-LLM: Empowering Large Language Models for Cost-Aware Tool Planning
di: Wu, Duo, et al.
Pubblicazione: (2024) -
MobileA3gent: Training Mobile GUI Agents Using Decentralized Self-Sourced Data from Diverse Users
di: Wang, Wenhao, et al.
Pubblicazione: (2025) -
LiteGUI: Distilling Compact GUI Agents with Reinforcement Learning
di: Wu, Yubin, et al.
Pubblicazione: (2026) -
ReInAgent: A Context-Aware GUI Agent Enabling Human-in-the-Loop Mobile Task Navigation
di: Jia, Haitao, et al.
Pubblicazione: (2025)