MobileWorldBench: Towards Semantic World Modeling For Mobile Agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Shufan, Kallidromitis, Konstantinos, Gokul, Akash, Kato, Yusuke, Kozuka, Kazuki, Grover, Aditya |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Aligning Diffusion Models by Optimizing Human Utility
di: Li, Shufan, et al.
Pubblicazione: (2024)
di: Li, Shufan, et al.
Pubblicazione: (2024)
Reflect-DiT: Inference-Time Scaling for Text-to-Image Diffusion Transformers via In-Context Reflection
di: Li, Shufan, et al.
Pubblicazione: (2025)
di: Li, Shufan, et al.
Pubblicazione: (2025)
OmniFlow: Any-to-Any Generation with Multi-Modal Rectified Flows
di: Li, Shufan, et al.
Pubblicazione: (2024)
di: Li, Shufan, et al.
Pubblicazione: (2024)
SegLLM: Multi-round Reasoning Segmentation
di: Wang, XuDong, et al.
Pubblicazione: (2024)
di: Wang, XuDong, et al.
Pubblicazione: (2024)
LaViDa: A Large Diffusion Language Model for Multimodal Understanding
di: Li, Shufan, et al.
Pubblicazione: (2025)
di: Li, Shufan, et al.
Pubblicazione: (2025)
Guidance Contrastive Token Credit Assignment for Discrete Policy Optimization
di: Li, Shufan, et al.
Pubblicazione: (2026)
di: Li, Shufan, et al.
Pubblicazione: (2026)
MobilityBench: A Benchmark for Evaluating Route-Planning Agents in Real-World Mobility Scenarios
di: Song, Zhiheng, et al.
Pubblicazione: (2026)
di: Song, Zhiheng, et al.
Pubblicazione: (2026)
MobileBench-OL: A Comprehensive Chinese Benchmark for Evaluating Mobile GUI Agents in Real-World Environment
di: Wu, Qinzhuo, et al.
Pubblicazione: (2026)
di: Wu, Qinzhuo, et al.
Pubblicazione: (2026)
MobileDreamer: Generative Sketch World Model for GUI Agent
di: Cao, Yilin, et al.
Pubblicazione: (2026)
di: Cao, Yilin, et al.
Pubblicazione: (2026)
Mobile-Bench: An Evaluation Benchmark for LLM-based Mobile Agents
di: Deng, Shihan, et al.
Pubblicazione: (2024)
di: Deng, Shihan, et al.
Pubblicazione: (2024)
KnowU-Bench: Towards Interactive, Proactive, and Personalized Mobile Agent Evaluation
di: Chen, Tongbo, et al.
Pubblicazione: (2026)
di: Chen, Tongbo, et al.
Pubblicazione: (2026)
MobileAgentBench: An Efficient and User-Friendly Benchmark for Mobile LLM Agents
di: Wang, Luyuan, et al.
Pubblicazione: (2024)
di: Wang, Luyuan, et al.
Pubblicazione: (2024)
Mobile-Bench-v2: A More Realistic and Comprehensive Benchmark for VLM-based Mobile Agents
di: Xu, Weikai, et al.
Pubblicazione: (2025)
di: Xu, Weikai, et al.
Pubblicazione: (2025)
MobiBench: Multi-Branch, Modular Benchmark for Mobile GUI Agents
di: Im, Youngmin, et al.
Pubblicazione: (2025)
di: Im, Youngmin, et al.
Pubblicazione: (2025)
SimuWoB: Simulating Real-World Mobile Apps for Fast and Faithful GUI Agent Benchmarking
di: Liu, Guohong, et al.
Pubblicazione: (2026)
di: Liu, Guohong, et al.
Pubblicazione: (2026)
Generative Visual Code Mobile World Models
di: Koh, Woosung, et al.
Pubblicazione: (2026)
di: Koh, Woosung, et al.
Pubblicazione: (2026)
Hyperbolic Learning with Multimodal Large Language Models
di: Mandica, Paolo, et al.
Pubblicazione: (2024)
di: Mandica, Paolo, et al.
Pubblicazione: (2024)
VenusBench-Mobile: A Challenging and User-Centric Benchmark for Mobile GUI Agents with Capability Diagnostics
di: Gong, Yichen, et al.
Pubblicazione: (2026)
di: Gong, Yichen, et al.
Pubblicazione: (2026)
MobiFlow: Real-World Mobile Agent Benchmarking through Trajectory Fusion
di: Feng, Yunfei, et al.
Pubblicazione: (2026)
di: Feng, Yunfei, et al.
Pubblicazione: (2026)
DeliveryBench: Can Agents Earn Profit in Real World?
di: Mao, Lingjun, et al.
Pubblicazione: (2025)
di: Mao, Lingjun, et al.
Pubblicazione: (2025)
Toward Informed AV Decision-Making: Computational Model of Well-being and Trust in Mobility
di: Zahedi, Zahra, et al.
Pubblicazione: (2025)
di: Zahedi, Zahra, et al.
Pubblicazione: (2025)
MAS-Bench: A Unified Benchmark for Shortcut-Augmented Hybrid Mobile GUI Agents
di: Zhao, Pengxiang, et al.
Pubblicazione: (2025)
di: Zhao, Pengxiang, et al.
Pubblicazione: (2025)
Mobile-R1: Towards Interactive Capability for VLM-Based Mobile Agent via Systematic Training
di: Gu, Jihao, et al.
Pubblicazione: (2025)
di: Gu, Jihao, et al.
Pubblicazione: (2025)
Hyperbolic Active Learning for Semantic Segmentation under Domain Shift
di: Franco, Luca, et al.
Pubblicazione: (2023)
di: Franco, Luca, et al.
Pubblicazione: (2023)
From Digital Twins to World Models:Opportunities, Challenges, and Applications for Mobile Edge General Intelligence
di: Zheng, Jie, et al.
Pubblicazione: (2026)
di: Zheng, Jie, et al.
Pubblicazione: (2026)
MobileKernelBench: Can LLMs Write Efficient Kernels for Mobile Devices?
di: Zou, Xingze, et al.
Pubblicazione: (2026)
di: Zou, Xingze, et al.
Pubblicazione: (2026)
WorldModelBench: Judging Video Generation Models As World Models
di: Li, Dacheng, et al.
Pubblicazione: (2025)
di: Li, Dacheng, et al.
Pubblicazione: (2025)
PhysicianBench: Evaluating LLM Agents in Real-World EHR Environments
di: Liu, Ruoqi, et al.
Pubblicazione: (2026)
di: Liu, Ruoqi, et al.
Pubblicazione: (2026)
GhostEI-Bench: Do Mobile Agents Resilience to Environmental Injection in Dynamic On-Device Environments?
di: Chen, Chiyu, et al.
Pubblicazione: (2025)
di: Chen, Chiyu, et al.
Pubblicazione: (2025)
Agent-RewardBench: Towards a Unified Benchmark for Reward Modeling across Perception, Planning, and Safety in Real-World Multimodal Agents
di: Men, Tianyi, et al.
Pubblicazione: (2025)
di: Men, Tianyi, et al.
Pubblicazione: (2025)
Sensing and Understanding the World over Air: A Large Multimodal Model for Mobile Networks
di: Duan, Zhuoran, et al.
Pubblicazione: (2025)
di: Duan, Zhuoran, et al.
Pubblicazione: (2025)
World Models as an Intermediary between Agents and the Real World
di: Yang, Sherry
Pubblicazione: (2026)
di: Yang, Sherry
Pubblicazione: (2026)
DataClawBench: An Agent Benchmark for Exploratory Real-World Financial Data Analysis
di: Zhang, Qiaohong, et al.
Pubblicazione: (2026)
di: Zhang, Qiaohong, et al.
Pubblicazione: (2026)
MedMax: Mixed-Modal Instruction Tuning for Training Biomedical Assistants
di: Bansal, Hritik, et al.
Pubblicazione: (2024)
di: Bansal, Hritik, et al.
Pubblicazione: (2024)
WorldVLA: Towards Autoregressive Action World Model
di: Cen, Jun, et al.
Pubblicazione: (2025)
di: Cen, Jun, et al.
Pubblicazione: (2025)
LiveAgentBench: Comprehensive Benchmarking of Agentic Systems Across 104 Real-World Challenges
di: Li, Hao, et al.
Pubblicazione: (2026)
di: Li, Hao, et al.
Pubblicazione: (2026)
GATSim: Urban Mobility Simulation with Generative Agents
di: Liu, Qi, et al.
Pubblicazione: (2025)
di: Liu, Qi, et al.
Pubblicazione: (2025)
AgencyBench: Benchmarking the Frontiers of Autonomous Agents in 1M-Token Real-World Contexts
di: Li, Keyu, et al.
Pubblicazione: (2026)
di: Li, Keyu, et al.
Pubblicazione: (2026)
Grounded World Model for Semantically Generalizable Planning
di: Li, Quanyi, et al.
Pubblicazione: (2026)
di: Li, Quanyi, et al.
Pubblicazione: (2026)
Humanoid World Models: Open World Foundation Models for Humanoid Robotics
di: Ali, Muhammad Qasim, et al.
Pubblicazione: (2025)
di: Ali, Muhammad Qasim, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Aligning Diffusion Models by Optimizing Human Utility
di: Li, Shufan, et al.
Pubblicazione: (2024) -
Reflect-DiT: Inference-Time Scaling for Text-to-Image Diffusion Transformers via In-Context Reflection
di: Li, Shufan, et al.
Pubblicazione: (2025) -
OmniFlow: Any-to-Any Generation with Multi-Modal Rectified Flows
di: Li, Shufan, et al.
Pubblicazione: (2024) -
SegLLM: Multi-round Reasoning Segmentation
di: Wang, XuDong, et al.
Pubblicazione: (2024) -
LaViDa: A Large Diffusion Language Model for Multimodal Understanding
di: Li, Shufan, et al.
Pubblicazione: (2025)