AndroidLab: Training and Systematic Benchmarking of Android Autonomous Agents
Fuente:
arXiv
Saved in:
| Main Authors: | Xu, Yifan, Liu, Xiao, Sun, Xueqiao, Cheng, Siyi, Yu, Hao, Lai, Hanyu, Zhang, Shudan, Zhang, Dan, Tang, Jie, Dong, Yuxiao |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
AndroidGen: Building an Android Language Agent under Data Scarcity
by: Lai, Hanyu, et al.
Published: (2025)
by: Lai, Hanyu, et al.
Published: (2025)
AndroidWorld: A Dynamic Benchmarking Environment for Autonomous Agents
by: Rawles, Christopher, et al.
Published: (2024)
by: Rawles, Christopher, et al.
Published: (2024)
GDPR-Bench-Android: A Benchmark for Evaluating Automated GDPR Compliance Detection in Android
by: Ran, Huaijin, et al.
Published: (2025)
by: Ran, Huaijin, et al.
Published: (2025)
Android in the Zoo: Chain-of-Action-Thought for GUI Agents
by: Zhang, Jiwen, et al.
Published: (2024)
by: Zhang, Jiwen, et al.
Published: (2024)
WebRL: Training LLM Web Agents via Self-Evolving Online Curriculum Reinforcement Learning
by: Qi, Zehan, et al.
Published: (2024)
by: Qi, Zehan, et al.
Published: (2024)
Do Androids Dream of Breaking the Game? Systematically Auditing AI Agent Benchmarks with BenchJack
by: Wang, Hao, et al.
Published: (2026)
by: Wang, Hao, et al.
Published: (2026)
AgentRL: Scaling Agentic Reinforcement Learning with a Multi-Turn, Multi-Task Framework
by: Zhang, Hanchen, et al.
Published: (2025)
by: Zhang, Hanchen, et al.
Published: (2025)
AndroidLens: Long-latency Evaluation with Nested Sub-targets for Android GUI Agents
by: Cao, Yue, et al.
Published: (2025)
by: Cao, Yue, et al.
Published: (2025)
AutoGLM: Autonomous Foundation Agents for GUIs
by: Liu, Xiao, et al.
Published: (2024)
by: Liu, Xiao, et al.
Published: (2024)
ThreatIntel-Andro: Expert-Verified Benchmarking for Robust Android Malware Research
by: Bai, Hongpeng, et al.
Published: (2025)
by: Bai, Hongpeng, et al.
Published: (2025)
VisualAgentBench: Towards Large Multimodal Models as Visual Foundation Agents
by: Liu, Xiao, et al.
Published: (2024)
by: Liu, Xiao, et al.
Published: (2024)
AgentBench: Evaluating LLMs as Agents
by: Liu, Xiao, et al.
Published: (2023)
by: Liu, Xiao, et al.
Published: (2023)
On Benchmarking Code LLMs for Android Malware Analysis
by: He, Yiling, et al.
Published: (2025)
by: He, Yiling, et al.
Published: (2025)
AMEX: Android Multi-annotation Expo Dataset for Mobile GUI Agents
by: Chai, Yuxiang, et al.
Published: (2024)
by: Chai, Yuxiang, et al.
Published: (2024)
A3: Android Agent Arena for Mobile GUI Agents with Essential-State Procedural Evaluation
by: Chai, Yuxiang, et al.
Published: (2025)
by: Chai, Yuxiang, et al.
Published: (2025)
An Android Robot Head as Embodied Conversational Agent
by: Heisler, Marcel, et al.
Published: (2023)
by: Heisler, Marcel, et al.
Published: (2023)
MobileRL: Online Agentic Reinforcement Learning for Mobile GUI Agents
by: Xu, Yifan, et al.
Published: (2025)
by: Xu, Yifan, et al.
Published: (2025)
AgentDroid: A Multi-Agent Framework for Detecting Fraudulent Android Applications
by: Pan, Ruwei, et al.
Published: (2025)
by: Pan, Ruwei, et al.
Published: (2025)
Understanding the Weakness of Large Language Model Agents within a Complex Android Environment
by: Xing, Mingzhe, et al.
Published: (2024)
by: Xing, Mingzhe, et al.
Published: (2024)
Android on x86
by: Krajci, Iggy, et al.
Published: (2018)
by: Krajci, Iggy, et al.
Published: (2018)
Android para escritorio
by: Juan Manuel Fuentes Rodríguez
Published: (2016)
by: Juan Manuel Fuentes Rodríguez
Published: (2016)
AndroidControl-Curated: Revealing the True Potential of GUI Agents through Benchmark Purification
by: Leung, Ho Fai, et al.
Published: (2025)
by: Leung, Ho Fai, et al.
Published: (2025)
ComputerRL: Scaling End-to-End Online Reinforcement Learning for Computer Use Agents
by: Lai, Hanyu, et al.
Published: (2025)
by: Lai, Hanyu, et al.
Published: (2025)
On the (In)Security of Non-resettable Device Identifiers in Custom Android Systems
by: Dong, Zikan, et al.
Published: (2025)
by: Dong, Zikan, et al.
Published: (2025)
Android Source Code Smells: A Systematic Literature Review
by: Muhammad Fawad, et al.
Published: (2024)
by: Muhammad Fawad, et al.
Published: (2024)
AutoWebGLM: A Large Language Model-based Web Navigating Agent
by: Lai, Hanyu, et al.
Published: (2024)
by: Lai, Hanyu, et al.
Published: (2024)
TraceRAG: A LLM-Based Framework for Explainable Android Malware Detection and Behavior Analysis
by: Zhang, Guangyu, et al.
Published: (2025)
by: Zhang, Guangyu, et al.
Published: (2025)
Assessing Privacy Compliance of Android Third-Party SDKs
by: Meng, Mark Huasong, et al.
Published: (2024)
by: Meng, Mark Huasong, et al.
Published: (2024)
GUI Design for Android Apps
by: Cohen, Ryan, et al.
Published: (2018)
by: Cohen, Ryan, et al.
Published: (2018)
Text Finder Application for Android
by: Godase, Milind, et al.
Published: (2023)
by: Godase, Milind, et al.
Published: (2023)
XAI and Android Malware Models
by: Kulkarni, Maithili, et al.
Published: (2024)
by: Kulkarni, Maithili, et al.
Published: (2024)
GUI Design for Android Apps
by: Ryan Cohen
by: Ryan Cohen
Framework for malware analysis in Android
by: Christian Camilo Urcuqui López
Published: (2016)
by: Christian Camilo Urcuqui López
Published: (2016)
Can Large Language Models Detect Real-World Android Software Compliance Violations?
by: Zhang, Haoyi, et al.
Published: (2025)
by: Zhang, Haoyi, et al.
Published: (2025)
AutoDroid: LLM-powered Task Automation in Android
by: Wen, Hao, et al.
Published: (2023)
by: Wen, Hao, et al.
Published: (2023)
Dockerized Android: a container-based platform to build mobile Android scenarios for Cyber Ranges
by: Capone, Daniele, et al.
Published: (2022)
by: Capone, Daniele, et al.
Published: (2022)
A Comparative Study of Full Apps and Lite Apps for Android
by: Tang, Yutian, et al.
Published: (2025)
by: Tang, Yutian, et al.
Published: (2025)
LLMAID: Identifying AI Capabilities in Android Apps with LLMs
by: Liu, Pei, et al.
Published: (2025)
by: Liu, Pei, et al.
Published: (2025)
Association of Android and Gynoid Fatness With Incident Dementia and Brain Structure
by: Zhong‐Yue Liu, et al.
Published: (2025)
by: Zhong‐Yue Liu, et al.
Published: (2025)
Enhancing GUI Exploration Coverage of Android Apps with Deep Link-Integrated Monkey
by: Hu, Han, et al.
Published: (2024)
by: Hu, Han, et al.
Published: (2024)
Similar Items
-
AndroidGen: Building an Android Language Agent under Data Scarcity
by: Lai, Hanyu, et al.
Published: (2025) -
AndroidWorld: A Dynamic Benchmarking Environment for Autonomous Agents
by: Rawles, Christopher, et al.
Published: (2024) -
GDPR-Bench-Android: A Benchmark for Evaluating Automated GDPR Compliance Detection in Android
by: Ran, Huaijin, et al.
Published: (2025) -
Android in the Zoo: Chain-of-Action-Thought for GUI Agents
by: Zhang, Jiwen, et al.
Published: (2024) -
WebRL: Training LLM Web Agents via Self-Evolving Online Curriculum Reinforcement Learning
by: Qi, Zehan, et al.
Published: (2024)