PerPilot: Personalizing VLM-based Mobile Agents via Memory and Exploration
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Xin, Cui, Zhiyao, Li, Hao, Zeng, Ya, Wang, Chenxu, Song, Ruiqi, Chen, Yihang, Shao, Kun, Zhang, Qiaosheng, Liu, Jinzhuo, Ren, Siyue, Hu, Shuyue, Wang, Zhen |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Emergence of Social Norms in Generative Agent Societies: Principles and Architecture
por: Ren, Siyue, et al.
Publicado: (2024)
por: Ren, Siyue, et al.
Publicado: (2024)
Design First, Code Later: Aesthetically Pleasing Template-Free Slides Generation
por: Cui, Zhiyao, et al.
Publicado: (2026)
por: Cui, Zhiyao, et al.
Publicado: (2026)
Stop Overvaluing Multi-Agent Debate -- We Must Rethink Evaluation and Embrace Model Heterogeneity
por: Zhang, Hangfan, et al.
Publicado: (2025)
por: Zhang, Hangfan, et al.
Publicado: (2025)
Adaptive Theory of Mind for LLM-based Multi-Agent Coordination
por: Mu, Chunjiang, et al.
Publicado: (2026)
por: Mu, Chunjiang, et al.
Publicado: (2026)
Provably Efficient Information-Directed Sampling Algorithms for Multi-Agent Reinforcement Learning
por: Zhang, Qiaosheng, et al.
Publicado: (2024)
por: Zhang, Qiaosheng, et al.
Publicado: (2024)
Organizing, Orchestrating, and Benchmarking Agent Skills at Ecosystem Scale
por: Li, Hao, et al.
Publicado: (2026)
por: Li, Hao, et al.
Publicado: (2026)
PerTouch: VLM-Driven Agent for Personalized and Semantic Image Retouching
por: Chang, Zewei, et al.
Publicado: (2025)
por: Chang, Zewei, et al.
Publicado: (2025)
Graph Attention is Not Always Beneficial: A Theoretical Analysis of Graph Attention Mechanisms via Contextual Stochastic Block Models
por: Ma, Zhongtian, et al.
Publicado: (2024)
por: Ma, Zhongtian, et al.
Publicado: (2024)
Disentangling Intent from Role: Adversarial Self-Play for Persona-Invariant Safety Alignment
por: Li, Jiajia, et al.
Publicado: (2026)
por: Li, Jiajia, et al.
Publicado: (2026)
Regret Minimization in Population Network Games: Vanishing Heterogeneity and Convergence to Equilibria
por: Hu, Die, et al.
Publicado: (2025)
por: Hu, Die, et al.
Publicado: (2025)
Advancing Autonomous VLM Agents via Variational Subgoal-Conditioned Reinforcement Learning
por: Wu, Qingyuan, et al.
Publicado: (2025)
por: Wu, Qingyuan, et al.
Publicado: (2025)
Matrix Completion with Hypergraphs:Sharp Thresholds and Efficient Algorithms
por: Ma, Zhongtian, et al.
Publicado: (2024)
por: Ma, Zhongtian, et al.
Publicado: (2024)
ICL-Router: In-Context Learned Model Representations for LLM Routing
por: Wang, Chenxu, et al.
Publicado: (2025)
por: Wang, Chenxu, et al.
Publicado: (2025)
PerLTQA: A Personal Long-Term Memory Dataset for Memory Classification, Retrieval, and Synthesis in Question Answering
por: Du, Yiming, et al.
Publicado: (2024)
por: Du, Yiming, et al.
Publicado: (2024)
Reputation as a Solution to Cooperation Collapse in LLM-based MASs
por: Ren, Siyue, et al.
Publicado: (2025)
por: Ren, Siyue, et al.
Publicado: (2025)
LLMRouterBench: A Massive Benchmark and Unified Framework for LLM Routing
por: Li, Hao, et al.
Publicado: (2026)
por: Li, Hao, et al.
Publicado: (2026)
The Avengers: A Simple Recipe for Uniting Smaller Language Models to Challenge Proprietary Giants
por: Zhang, Yiqun, et al.
Publicado: (2025)
por: Zhang, Yiqun, et al.
Publicado: (2025)
AtlasVA: Self-Evolving Visual Skill Memory for Teacher-Free VLM Agents
por: Wang, Pan, et al.
Publicado: (2026)
por: Wang, Pan, et al.
Publicado: (2026)
Token-Efficient Leverage Learning in Large Language Models
por: Zeng, Yuanhao, et al.
Publicado: (2024)
por: Zeng, Yuanhao, et al.
Publicado: (2024)
DELIA: Diversity-Enhanced Learning for Instruction Adaptation in Large Language Models
por: Zeng, Yuanhao, et al.
Publicado: (2024)
por: Zeng, Yuanhao, et al.
Publicado: (2024)
Mobile-R1: Towards Interactive Capability for VLM-Based Mobile Agent via Systematic Training
por: Gu, Jihao, et al.
Publicado: (2025)
por: Gu, Jihao, et al.
Publicado: (2025)
DR-MMSearchAgent: Deepening Reasoning in Multimodal Search Agents
por: Wang, Shengqin, et al.
Publicado: (2026)
por: Wang, Shengqin, et al.
Publicado: (2026)
See, Think, Act: Online Shopper Behavior Simulation with VLM Agents
por: Zhang, Yimeng, et al.
Publicado: (2025)
por: Zhang, Yimeng, et al.
Publicado: (2025)
Misclassification Rate and Privacy-Utility Trade-offs in Graph Convolutional Networks via Subsampling Stability
por: Zhang, Yexin, et al.
Publicado: (2026)
por: Zhang, Yexin, et al.
Publicado: (2026)
Multi-clue Consistency Learning to Bridge Gaps Between General and Oriented Object in Semi-supervised Detection
por: Wang, Chenxu, et al.
Publicado: (2024)
por: Wang, Chenxu, et al.
Publicado: (2024)
LLM-Assisted Semantic Guidance for Sparsely Annotated Remote Sensing Object Detection
por: Liao, Wei, et al.
Publicado: (2025)
por: Liao, Wei, et al.
Publicado: (2025)
ProMMSearchAgent: A Generalizable Multimodal Search Agent Trained with Process-Oriented Rewards
por: Yan, Wentao, et al.
Publicado: (2026)
por: Yan, Wentao, et al.
Publicado: (2026)
Mobile-Bench-v2: A More Realistic and Comprehensive Benchmark for VLM-based Mobile Agents
por: Xu, Weikai, et al.
Publicado: (2025)
por: Xu, Weikai, et al.
Publicado: (2025)
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning
por: Wang, Changhong, et al.
Publicado: (2024)
por: Wang, Changhong, et al.
Publicado: (2024)
See, Act, Adapt: Active Perception for Unsupervised Cross-Domain Visual Adaptation via Personalized VLM-Guided Agent
por: Tang, Tianci, et al.
Publicado: (2026)
por: Tang, Tianci, et al.
Publicado: (2026)
A VLM-based Method for Visual Anomaly Detection in Robotic Scientific Laboratories
por: Lin, Shiwei, et al.
Publicado: (2025)
por: Lin, Shiwei, et al.
Publicado: (2025)
Multi-Agent, Human-Agent and Beyond: A Survey on Cooperation in Social Dilemmas
por: Mu, Chunjiang, et al.
Publicado: (2024)
por: Mu, Chunjiang, et al.
Publicado: (2024)
Overcoming the Machine Penalty with Imperfectly Fair AI Agents
por: Wang, Zhen, et al.
Publicado: (2024)
por: Wang, Zhen, et al.
Publicado: (2024)
KARMA: Leveraging Multi-Agent LLMs for Automated Knowledge Graph Enrichment
por: Lu, Yuxing, et al.
Publicado: (2025)
por: Lu, Yuxing, et al.
Publicado: (2025)
InquireMobile: Teaching VLM-based Mobile Agent to Request Human Assistance via Reinforcement Fine-Tuning
por: Ai, Qihang, et al.
Publicado: (2025)
por: Ai, Qihang, et al.
Publicado: (2025)
VLM-CAD: VLM-Optimized Collaborative Agent Design Workflow for Analog Circuit Sizing
por: Pan, Guanyuan, et al.
Publicado: (2026)
por: Pan, Guanyuan, et al.
Publicado: (2026)
Me-Agent: A Personalized Mobile Agent with Two-Level User Habit Learning for Enhanced Interaction
por: Wang, Shuoxin, et al.
Publicado: (2026)
por: Wang, Shuoxin, et al.
Publicado: (2026)
Poison Once, Control Anywhere: Clean-Text Visual Backdoors in VLM-based Mobile Agents
por: Wang, Xuan, et al.
Publicado: (2025)
por: Wang, Xuan, et al.
Publicado: (2025)
Ascites affects the benefit of carvedilol on patients with liver cirrhosis and esophageal and gastric varices
por: Ruiqi Xia, et al.
Publicado: (2024)
por: Ruiqi Xia, et al.
Publicado: (2024)
Exploration of Reproducible Generated Image Detection
por: Duan, Yihang
Publicado: (2025)
por: Duan, Yihang
Publicado: (2025)
Ejemplares similares
-
Emergence of Social Norms in Generative Agent Societies: Principles and Architecture
por: Ren, Siyue, et al.
Publicado: (2024) -
Design First, Code Later: Aesthetically Pleasing Template-Free Slides Generation
por: Cui, Zhiyao, et al.
Publicado: (2026) -
Stop Overvaluing Multi-Agent Debate -- We Must Rethink Evaluation and Embrace Model Heterogeneity
por: Zhang, Hangfan, et al.
Publicado: (2025) -
Adaptive Theory of Mind for LLM-based Multi-Agent Coordination
por: Mu, Chunjiang, et al.
Publicado: (2026) -
Provably Efficient Information-Directed Sampling Algorithms for Multi-Agent Reinforcement Learning
por: Zhang, Qiaosheng, et al.
Publicado: (2024)