MobileIPL: Enhancing Mobile Agents Thinking Process via Iterative Preference Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Kun, Xu, Weikai, Liu, Yuxuan, Wang, Quandong, Gao, Pengzhi, Liu, Wei, Luan, Jian, Wang, Bin, An, Bo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Mobile-Bench-v2: A More Realistic and Comprehensive Benchmark for VLM-based Mobile Agents
por: Xu, Weikai, et al.
Publicado: (2025)
por: Xu, Weikai, et al.
Publicado: (2025)
ReachAgent: Enhancing Mobile Agent via Page Reaching and Operation
por: Wu, Qinzhuo, et al.
Publicado: (2025)
por: Wu, Qinzhuo, et al.
Publicado: (2025)
CoME: Empowering Channel-of-Mobile-Experts with Informative Hybrid-Capabilities Reasoning
por: Liu, Yuxuan, et al.
Publicado: (2026)
por: Liu, Yuxuan, et al.
Publicado: (2026)
MobileBench-OL: A Comprehensive Chinese Benchmark for Evaluating Mobile GUI Agents in Real-World Environment
por: Wu, Qinzhuo, et al.
Publicado: (2026)
por: Wu, Qinzhuo, et al.
Publicado: (2026)
Mobile-Bench: An Evaluation Benchmark for LLM-based Mobile Agents
por: Deng, Shihan, et al.
Publicado: (2024)
por: Deng, Shihan, et al.
Publicado: (2024)
MobileViews: A Million-scale and Diverse Mobile GUI Dataset
por: Gao, Longxi, et al.
Publicado: (2024)
por: Gao, Longxi, et al.
Publicado: (2024)
Scaling, Benchmarking, and Reasoning of Vision-Language Agents for Mobile GUI Navigation
por: Qu, Heng, et al.
Publicado: (2026)
por: Qu, Heng, et al.
Publicado: (2026)
BacktrackAgent: Enhancing GUI Agent with Error Detection and Backtracking Mechanism
por: Wu, Qinzhuo, et al.
Publicado: (2025)
por: Wu, Qinzhuo, et al.
Publicado: (2025)
Mobile GUI Agents under Real-world Threats: Are We There Yet?
por: Liu, Guohong, et al.
Publicado: (2025)
por: Liu, Guohong, et al.
Publicado: (2025)
SimuWoB: Simulating Real-World Mobile Apps for Fast and Faithful GUI Agent Benchmarking
por: Liu, Guohong, et al.
Publicado: (2026)
por: Liu, Guohong, et al.
Publicado: (2026)
MobileSteward: Integrating Multiple App-Oriented Agents with Self-Evolution to Automate Cross-App Instructions
por: Liu, Yuxuan, et al.
Publicado: (2025)
por: Liu, Yuxuan, et al.
Publicado: (2025)
GUI-Shift: Enhancing VLM-Based GUI Agents through Self-supervised Reinforcement Learning
por: Gao, Longxi, et al.
Publicado: (2025)
por: Gao, Longxi, et al.
Publicado: (2025)
MobileVLM: A Vision-Language Model for Better Intra- and Inter-UI Understanding
por: Wu, Qinzhuo, et al.
Publicado: (2024)
por: Wu, Qinzhuo, et al.
Publicado: (2024)
Mixture of Diverse Size Experts
por: Sun, Manxi, et al.
Publicado: (2024)
por: Sun, Manxi, et al.
Publicado: (2024)
Multilingual Machine Translation with Open Large Language Models at Practical Scale: An Empirical Study
por: Cui, Menglong, et al.
Publicado: (2025)
por: Cui, Menglong, et al.
Publicado: (2025)
STEP: Success-Rate-Aware Trajectory-Efficient Policy Optimization
por: Chen, Yuhan, et al.
Publicado: (2025)
por: Chen, Yuhan, et al.
Publicado: (2025)
SUBLLM: A Novel Efficient Architecture with Token Sequence Subsampling for LLM
por: Wang, Quandong, et al.
Publicado: (2024)
por: Wang, Quandong, et al.
Publicado: (2024)
GUI-PRA: Process Reward Agent for GUI Tasks
por: Xiong, Tao, et al.
Publicado: (2025)
por: Xiong, Tao, et al.
Publicado: (2025)
PMSS: Pretrained Matrices Skeleton Selection for LLM Fine-tuning
por: Wang, Qibin, et al.
Publicado: (2024)
por: Wang, Qibin, et al.
Publicado: (2024)
TaP: A Taxonomy-Guided Framework for Automated and Scalable Preference Data Generation
por: Jin, Renren, et al.
Publicado: (2025)
por: Jin, Renren, et al.
Publicado: (2025)
Scaling Model and Data for Multilingual Machine Translation with Open Large Language Models
por: Shang, Yuzhe, et al.
Publicado: (2026)
por: Shang, Yuzhe, et al.
Publicado: (2026)
MobileExplorer: Accelerating On-Device Inference for Mobile GUI Agents via Online Exploration
por: Huang, Runxi, et al.
Publicado: (2026)
por: Huang, Runxi, et al.
Publicado: (2026)
MobileRAG: Enhancing Mobile Agent with Retrieval-Augmented Generation
por: Loo, Gowen, et al.
Publicado: (2025)
por: Loo, Gowen, et al.
Publicado: (2025)
MobileWorld: Benchmarking Autonomous Mobile Agents in Agent-User Interactive and MCP-Augmented Environments
por: Kong, Quyu, et al.
Publicado: (2025)
por: Kong, Quyu, et al.
Publicado: (2025)
Mobile GUI Agent Privacy Personalization with Trajectory Induced Preference Optimization
por: Lin, Zhixin, et al.
Publicado: (2026)
por: Lin, Zhixin, et al.
Publicado: (2026)
Quant.npu: Enabling Efficient Mobile NPU Inference for on-device LLMs via Fully Static Quantization
por: Zhang, Jinghe, et al.
Publicado: (2026)
por: Zhang, Jinghe, et al.
Publicado: (2026)
Decentralized Federated Learning with Model Caching on Mobile Agents
por: Wang, Xiaoyu, et al.
Publicado: (2024)
por: Wang, Xiaoyu, et al.
Publicado: (2024)
MobileRL: Online Agentic Reinforcement Learning for Mobile GUI Agents
por: Xu, Yifan, et al.
Publicado: (2025)
por: Xu, Yifan, et al.
Publicado: (2025)
Mobile-Agent-E: Self-Evolving Mobile Assistant for Complex Tasks
por: Wang, Zhenhailong, et al.
Publicado: (2025)
por: Wang, Zhenhailong, et al.
Publicado: (2025)
Mobile-Agent: Autonomous Multi-Modal Mobile Device Agent with Visual Perception
por: Wang, Junyang, et al.
Publicado: (2024)
por: Wang, Junyang, et al.
Publicado: (2024)
Mobile-Agent-v2: Mobile Device Operation Assistant with Effective Navigation via Multi-Agent Collaboration
por: Wang, Junyang, et al.
Publicado: (2024)
por: Wang, Junyang, et al.
Publicado: (2024)
MobileAgentBench: An Efficient and User-Friendly Benchmark for Mobile LLM Agents
por: Wang, Luyuan, et al.
Publicado: (2024)
por: Wang, Luyuan, et al.
Publicado: (2024)
Mobile-R1: Towards Interactive Capability for VLM-Based Mobile Agent via Systematic Training
por: Gu, Jihao, et al.
Publicado: (2025)
por: Gu, Jihao, et al.
Publicado: (2025)
Agent-SAMA: State-Aware Mobile Assistant
por: Guo, Linqiang, et al.
Publicado: (2025)
por: Guo, Linqiang, et al.
Publicado: (2025)
DetermLR: Augmenting LLM-based Logical Reasoning from Indeterminacy to Determinacy
por: Sun, Hongda, et al.
Publicado: (2023)
por: Sun, Hongda, et al.
Publicado: (2023)
ExPosST: Explicit Positioning with Adaptive Masking for LLM-Based Simultaneous Machine Translation
por: Shang, Yuzhe, et al.
Publicado: (2026)
por: Shang, Yuzhe, et al.
Publicado: (2026)
PerPilot: Personalizing VLM-based Mobile Agents via Memory and Exploration
por: Wang, Xin, et al.
Publicado: (2025)
por: Wang, Xin, et al.
Publicado: (2025)
Improving Random Testing via LLM-powered UI Tarpit Escaping for Mobile Apps
por: Xu, Mengqian, et al.
Publicado: (2026)
por: Xu, Mengqian, et al.
Publicado: (2026)
PUMA: Perception-driven Unified Foothold Prior for Mobility Augmented Quadruped Parkour
por: Wang, Liang, et al.
Publicado: (2026)
por: Wang, Liang, et al.
Publicado: (2026)
Movable Antenna-Enhanced Wireless Powered Mobile Edge Computing Systems
por: Chen, Pengcheng, et al.
Publicado: (2024)
por: Chen, Pengcheng, et al.
Publicado: (2024)
Ejemplares similares
-
Mobile-Bench-v2: A More Realistic and Comprehensive Benchmark for VLM-based Mobile Agents
por: Xu, Weikai, et al.
Publicado: (2025) -
ReachAgent: Enhancing Mobile Agent via Page Reaching and Operation
por: Wu, Qinzhuo, et al.
Publicado: (2025) -
CoME: Empowering Channel-of-Mobile-Experts with Informative Hybrid-Capabilities Reasoning
por: Liu, Yuxuan, et al.
Publicado: (2026) -
MobileBench-OL: A Comprehensive Chinese Benchmark for Evaluating Mobile GUI Agents in Real-World Environment
por: Wu, Qinzhuo, et al.
Publicado: (2026) -
Mobile-Bench: An Evaluation Benchmark for LLM-based Mobile Agents
por: Deng, Shihan, et al.
Publicado: (2024)