Mobile-Agent-v2: Mobile Device Operation Assistant with Effective Navigation via Multi-Agent Collaboration
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Junyang, Xu, Haiyang, Jia, Haitao, Zhang, Xi, Yan, Ming, Shen, Weizhou, Zhang, Ji, Huang, Fei, Sang, Jitao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Mobile-Agent: Autonomous Multi-Modal Mobile Device Agent with Visual Perception
por: Wang, Junyang, et al.
Publicado: (2024)
por: Wang, Junyang, et al.
Publicado: (2024)
Mobile-Agent-V: A Video-Guided Approach for Effortless and Efficient Operational Knowledge Injection in Mobile Automation
por: Wang, Junyang, et al.
Publicado: (2025)
por: Wang, Junyang, et al.
Publicado: (2025)
Mobile-Agent-V: A Video-Guided Approach for Effortless and Efficient Operational Knowledge Injection in Mobile Automation
por: Wang, Junyang, et al.
Publicado: (2025)
por: Wang, Junyang, et al.
Publicado: (2025)
Mobile-Agent-E: Self-Evolving Mobile Assistant for Complex Tasks
por: Wang, Zhenhailong, et al.
Publicado: (2025)
por: Wang, Zhenhailong, et al.
Publicado: (2025)
STAMP: Training Explicit Memory for Mobile GUI Agents in Controllable and Scalable Virtual Environments
por: Wang, Junyang, et al.
Publicado: (2026)
por: Wang, Junyang, et al.
Publicado: (2026)
Mobile-Agent-v3.5: Multi-platform Fundamental GUI Agents
por: Xu, Haiyang, et al.
Publicado: (2026)
por: Xu, Haiyang, et al.
Publicado: (2026)
PC-Agent: A Hierarchical Multi-Agent Collaboration Framework for Complex Task Automation on PC
por: Liu, Haowei, et al.
Publicado: (2025)
por: Liu, Haowei, et al.
Publicado: (2025)
AMBER: An LLM-free Multi-dimensional Benchmark for MLLMs Hallucination Evaluation
por: Wang, Junyang, et al.
Publicado: (2023)
por: Wang, Junyang, et al.
Publicado: (2023)
ReInAgent: A Context-Aware GUI Agent Enabling Human-in-the-Loop Mobile Task Navigation
por: Jia, Haitao, et al.
Publicado: (2025)
por: Jia, Haitao, et al.
Publicado: (2025)
MobileVLM : A Fast, Strong and Open Vision Language Assistant for Mobile Devices
por: Chu, Xiangxiang, et al.
Publicado: (2023)
por: Chu, Xiangxiang, et al.
Publicado: (2023)
Small LLMs Are Weak Tool Learners: A Multi-LLM Agent
por: Shen, Weizhou, et al.
Publicado: (2024)
por: Shen, Weizhou, et al.
Publicado: (2024)
MobileExperts: A Dynamic Tool-Enabled Agent Team in Mobile Devices
por: Zhang, Jiayi, et al.
Publicado: (2024)
por: Zhang, Jiayi, et al.
Publicado: (2024)
Mobile-Agent-v3: Fundamental Agents for GUI Automation
por: Ye, Jiabo, et al.
Publicado: (2025)
por: Ye, Jiabo, et al.
Publicado: (2025)
FairCLIP: Social Bias Elimination based on Attribute Prototype Learning and Representation Neutralization
por: Wang, Junyang, et al.
Publicado: (2022)
por: Wang, Junyang, et al.
Publicado: (2022)
AppAgent v2: Advanced Agent for Flexible Mobile Interactions
por: Li, Yanda, et al.
Publicado: (2024)
por: Li, Yanda, et al.
Publicado: (2024)
MobileIE: An Extremely Lightweight and Effective ConvNet for Real-Time Image Enhancement on Mobile Devices
por: Yan, Hailong, et al.
Publicado: (2025)
por: Yan, Hailong, et al.
Publicado: (2025)
MobileGUI-RL: Advancing Mobile GUI Agent through Reinforcement Learning in Online Environment
por: Shi, Yucheng, et al.
Publicado: (2025)
por: Shi, Yucheng, et al.
Publicado: (2025)
MobileSafetyBench: Evaluating Safety of Autonomous Agents in Mobile Device Control
por: Lee, Juyong, et al.
Publicado: (2024)
por: Lee, Juyong, et al.
Publicado: (2024)
SocialBench: Sociality Evaluation of Role-Playing Conversational Agents
por: Chen, Hongzhan, et al.
Publicado: (2024)
por: Chen, Hongzhan, et al.
Publicado: (2024)
MobileRAG: Enhancing Mobile Agent with Retrieval-Augmented Generation
por: Loo, Gowen, et al.
Publicado: (2025)
por: Loo, Gowen, et al.
Publicado: (2025)
OpenMobile: Building Open Mobile Agents with Task and Trajectory Synthesis
por: Cheng, Kanzhi, et al.
Publicado: (2026)
por: Cheng, Kanzhi, et al.
Publicado: (2026)
MaVEn: An Effective Multi-granularity Hybrid Visual Encoding Framework for Multimodal Large Language Model
por: Jiang, Chaoya, et al.
Publicado: (2024)
por: Jiang, Chaoya, et al.
Publicado: (2024)
WebSailor: Navigating Super-human Reasoning for Web Agent
por: Li, Kuan, et al.
Publicado: (2025)
por: Li, Kuan, et al.
Publicado: (2025)
Multi Agent based Medical Assistant for Edge Devices
por: Gawade, Sakharam, et al.
Publicado: (2025)
por: Gawade, Sakharam, et al.
Publicado: (2025)
MobileWorld: Benchmarking Autonomous Mobile Agents in Agent-User Interactive and MCP-Augmented Environments
por: Kong, Quyu, et al.
Publicado: (2025)
por: Kong, Quyu, et al.
Publicado: (2025)
ReachAgent: Enhancing Mobile Agent via Page Reaching and Operation
por: Wu, Qinzhuo, et al.
Publicado: (2025)
por: Wu, Qinzhuo, et al.
Publicado: (2025)
From Assistants to Adversaries: Exploring the Security Risks of Mobile LLM Agents
por: Wu, Liangxuan, et al.
Publicado: (2025)
por: Wu, Liangxuan, et al.
Publicado: (2025)
Mobile-Bench-v2: A More Realistic and Comprehensive Benchmark for VLM-based Mobile Agents
por: Xu, Weikai, et al.
Publicado: (2025)
por: Xu, Weikai, et al.
Publicado: (2025)
Mobile-Bench: An Evaluation Benchmark for LLM-based Mobile Agents
por: Deng, Shihan, et al.
Publicado: (2024)
por: Deng, Shihan, et al.
Publicado: (2024)
Multi-Agent Collaboration for Multilingual Code Instruction Tuning
por: Yang, Jian, et al.
Publicado: (2025)
por: Yang, Jian, et al.
Publicado: (2025)
OSWorld-MCP: Benchmarking MCP Tool Invocation In Computer-Use Agents
por: Jia, Hongrui, et al.
Publicado: (2025)
por: Jia, Hongrui, et al.
Publicado: (2025)
Benchmarking Mobile Device Control Agents across Diverse Configurations
por: Lee, Juyong, et al.
Publicado: (2024)
por: Lee, Juyong, et al.
Publicado: (2024)
Atomic-to-Compositional Generalization for Mobile Agents with A New Benchmark and Scheduling System
por: Guo, Yuan, et al.
Publicado: (2025)
por: Guo, Yuan, et al.
Publicado: (2025)
MobileAgentBench: An Efficient and User-Friendly Benchmark for Mobile LLM Agents
por: Wang, Luyuan, et al.
Publicado: (2024)
por: Wang, Luyuan, et al.
Publicado: (2024)
MobileDiffusion: Instant Text-to-Image Generation on Mobile Devices
por: Zhao, Yang, et al.
Publicado: (2023)
por: Zhao, Yang, et al.
Publicado: (2023)
ECHO: Event-Centric Hypergraph Operations via Multi-Agent Collaboration for Multimedia Event Extraction
por: Chu, Hailong, et al.
Publicado: (2026)
por: Chu, Hailong, et al.
Publicado: (2026)
Scaling External Knowledge Input Beyond Context Windows of LLMs via Multi-Agent Collaboration
por: Liu, Zijun, et al.
Publicado: (2025)
por: Liu, Zijun, et al.
Publicado: (2025)
MobileViCLIP: An Efficient Video-Text Model for Mobile Devices
por: Yang, Min, et al.
Publicado: (2025)
por: Yang, Min, et al.
Publicado: (2025)
Don't Leave Me Out: Designing for Device Inclusivity in Mixed Reality Collaboration
por: Krug, Katja, et al.
Publicado: (2024)
por: Krug, Katja, et al.
Publicado: (2024)
Generalization in Online Reinforcement Learning for Mobile Agents
por: Gu, Li, et al.
Publicado: (2026)
por: Gu, Li, et al.
Publicado: (2026)
Ejemplares similares
-
Mobile-Agent: Autonomous Multi-Modal Mobile Device Agent with Visual Perception
por: Wang, Junyang, et al.
Publicado: (2024) -
Mobile-Agent-V: A Video-Guided Approach for Effortless and Efficient Operational Knowledge Injection in Mobile Automation
por: Wang, Junyang, et al.
Publicado: (2025) -
Mobile-Agent-V: A Video-Guided Approach for Effortless and Efficient Operational Knowledge Injection in Mobile Automation
por: Wang, Junyang, et al.
Publicado: (2025) -
Mobile-Agent-E: Self-Evolving Mobile Assistant for Complex Tasks
por: Wang, Zhenhailong, et al.
Publicado: (2025) -
STAMP: Training Explicit Memory for Mobile GUI Agents in Controllable and Scalable Virtual Environments
por: Wang, Junyang, et al.
Publicado: (2026)