Salvato in:
| Autori principali: | Ai, Qihang, Bu, Pi, Cao, Yue, Wang, Yingyao, Gu, Jihao, Xing, Jingxuan, Zhu, Zekun, Jiang, Wei, Zheng, Zhicheng, Song, Jun, Jiang, Yuning |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2508.19679 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Mobile-R1: Towards Interactive Capability for VLM-Based Mobile Agent via Systematic Training
di: Gu, Jihao, et al.
Pubblicazione: (2025)
di: Gu, Jihao, et al.
Pubblicazione: (2025)
SecAgent: Efficient Mobile GUI Agent with Semantic Context
di: Xie, Yiping, et al.
Pubblicazione: (2026)
di: Xie, Yiping, et al.
Pubblicazione: (2026)
AndroidLens: Long-latency Evaluation with Nested Sub-targets for Android GUI Agents
di: Cao, Yue, et al.
Pubblicazione: (2025)
di: Cao, Yue, et al.
Pubblicazione: (2025)
Token Preference Optimization with Self-Calibrated Visual-Anchored Rewards for Hallucination Mitigation
di: Gu, Jihao, et al.
Pubblicazione: (2024)
di: Gu, Jihao, et al.
Pubblicazione: (2024)
Thinking With Bounding Boxes: Enhancing Spatio-Temporal Video Grounding via Reinforcement Fine-Tuning
di: Gu, Xin, et al.
Pubblicazione: (2025)
di: Gu, Xin, et al.
Pubblicazione: (2025)
Parallel Thinking, Sequential Answering: Bridging NAR and AR for Efficient Reasoning
di: Ai, Qihang, et al.
Pubblicazione: (2025)
di: Ai, Qihang, et al.
Pubblicazione: (2025)
GeoSense: Evaluating Identification and Application of Geometric Principles in Multimodal Reasoning
di: Xu, Liangyu, et al.
Pubblicazione: (2025)
di: Xu, Liangyu, et al.
Pubblicazione: (2025)
Fine-Tuning Vision-Language Models for Visual Navigation Assistance
di: Li, Xiao, et al.
Pubblicazione: (2025)
di: Li, Xiao, et al.
Pubblicazione: (2025)
Mobile-Bench-v2: A More Realistic and Comprehensive Benchmark for VLM-based Mobile Agents
di: Xu, Weikai, et al.
Pubblicazione: (2025)
di: Xu, Weikai, et al.
Pubblicazione: (2025)
AgentCPM-GUI: Building Mobile-Use Agents with Reinforcement Fine-Tuning
di: Zhang, Zhong, et al.
Pubblicazione: (2025)
di: Zhang, Zhong, et al.
Pubblicazione: (2025)
Generalization in Online Reinforcement Learning for Mobile Agents
di: Gu, Li, et al.
Pubblicazione: (2026)
di: Gu, Li, et al.
Pubblicazione: (2026)
Cybathlon -- Legged Mobile Assistance for Quadriplegics
di: Scheidemann, Carmen, et al.
Pubblicazione: (2024)
di: Scheidemann, Carmen, et al.
Pubblicazione: (2024)
MobileFineTuner: A Unified End-to-End Framework for Fine-Tuning LLMs on Mobile Phones
di: Geng, Jiaxiang, et al.
Pubblicazione: (2025)
di: Geng, Jiaxiang, et al.
Pubblicazione: (2025)
PAE MobiLLM: Privacy-Aware and Efficient LLM Fine-Tuning on the Mobile Device via Additive Side-Tuning
di: Yang, Xingke, et al.
Pubblicazione: (2025)
di: Yang, Xingke, et al.
Pubblicazione: (2025)
Beyond Graph Model: Reliable VLM Fine-Tuning via Random Graph Adapter
di: Jiang, Bo, et al.
Pubblicazione: (2025)
di: Jiang, Bo, et al.
Pubblicazione: (2025)
MobileVLM : A Fast, Strong and Open Vision Language Assistant for Mobile Devices
di: Chu, Xiangxiang, et al.
Pubblicazione: (2023)
di: Chu, Xiangxiang, et al.
Pubblicazione: (2023)
MTDA-HSED: Mutual-Assistance Tuning and Dual-Branch Aggregating for Heterogeneous Sound Event Detection
di: Wang, Zehao, et al.
Pubblicazione: (2024)
di: Wang, Zehao, et al.
Pubblicazione: (2024)
Taming the Long Tail in Human Mobility Prediction
di: Xu, Xiaohang, et al.
Pubblicazione: (2024)
di: Xu, Xiaohang, et al.
Pubblicazione: (2024)
Enhancing Reinforcement Learning Fine-Tuning with an Online Refiner
di: Ma, Hao, et al.
Pubblicazione: (2026)
di: Ma, Hao, et al.
Pubblicazione: (2026)
GeoVLM-R1: Reinforcement Fine-Tuning for Improved Remote Sensing Reasoning
di: Fiaz, Mustansar, et al.
Pubblicazione: (2025)
di: Fiaz, Mustansar, et al.
Pubblicazione: (2025)
Fed MobiLLM: Efficient Federated LLM Fine-Tuning over Heterogeneous Mobile Devices via Server Assisted Side-Tuning
di: Yang, Xingke, et al.
Pubblicazione: (2025)
di: Yang, Xingke, et al.
Pubblicazione: (2025)
BoxTuning: Directly Injecting the Object Box for Multimodal Model Fine-Tuning
di: Qian, Zekun, et al.
Pubblicazione: (2026)
di: Qian, Zekun, et al.
Pubblicazione: (2026)
Comparative Analysis of Human Mobility Patterns: Utilizing Taxi and Mobile (SafeGraph) Data to Investigate Neighborhood-Scale Mobility in New York City
di: Jiang, Yuqin, et al.
Pubblicazione: (2024)
di: Jiang, Yuqin, et al.
Pubblicazione: (2024)
ReStory: VLM-augmentation of Social Human-Robot Interaction Datasets
di: Bu, Fanjun, et al.
Pubblicazione: (2024)
di: Bu, Fanjun, et al.
Pubblicazione: (2024)
Llama-Mob: Instruction-Tuning Llama-3-8B Excels in City-Scale Mobility Prediction
di: Tang, Peizhi, et al.
Pubblicazione: (2024)
di: Tang, Peizhi, et al.
Pubblicazione: (2024)
Lessons Learned from Developing a Human-Centered Guide Dog Robot for Mobility Assistance
di: Hwang, Hochul, et al.
Pubblicazione: (2024)
di: Hwang, Hochul, et al.
Pubblicazione: (2024)
Graph-to-Vision: Multi-graph Understanding and Reasoning using Vision-Language Models
di: Ai, Qihang, et al.
Pubblicazione: (2025)
di: Ai, Qihang, et al.
Pubblicazione: (2025)
Identification of Multivariate Measurement Error Models
di: Hu, Yingyao
Pubblicazione: (2025)
di: Hu, Yingyao
Pubblicazione: (2025)
Performance Analysis of Traditional VQA Models Under Limited Computational Resources
di: Gu, Jihao
Pubblicazione: (2025)
di: Gu, Jihao
Pubblicazione: (2025)
Beyond Cybathlon: On-demand Quadrupedal Assistance for People with Limited Mobility
di: Scheidemann, Carmen, et al.
Pubblicazione: (2026)
di: Scheidemann, Carmen, et al.
Pubblicazione: (2026)
Haris: an Advanced Autonomous Mobile Robot for Smart Parking Assistance
di: Hamad, Layth, et al.
Pubblicazione: (2024)
di: Hamad, Layth, et al.
Pubblicazione: (2024)
Joint Optimization of DNN Model Caching and Request Routing in Mobile Edge Computing
di: Qiu, Shuting, et al.
Pubblicazione: (2025)
di: Qiu, Shuting, et al.
Pubblicazione: (2025)
Memory-Efficient Backpropagation for Fine-Tuning LLMs on Resource-Constrained Mobile Devices
di: Song, Congzheng, et al.
Pubblicazione: (2025)
di: Song, Congzheng, et al.
Pubblicazione: (2025)
"See the World, Discover Knowledge": A Chinese Factuality Evaluation for Large Vision Language Models
di: Gu, Jihao, et al.
Pubblicazione: (2025)
di: Gu, Jihao, et al.
Pubblicazione: (2025)
Text-guided Fine-Grained Video Anomaly Understanding
di: Gu, Jihao, et al.
Pubblicazione: (2025)
di: Gu, Jihao, et al.
Pubblicazione: (2025)
MobiLLM: Enabling LLM Fine-Tuning on the Mobile Device via Server Assisted Side Tuning
di: Li, Liang, et al.
Pubblicazione: (2025)
di: Li, Liang, et al.
Pubblicazione: (2025)
SpeechAgent: An End-to-End Mobile Infrastructure for Speech Impairment Assistance
di: Lou, Haowei, et al.
Pubblicazione: (2025)
di: Lou, Haowei, et al.
Pubblicazione: (2025)
Design Topological Materials by Reinforcement Fine-Tuned Generative Model
di: Xu, Haosheng, et al.
Pubblicazione: (2025)
di: Xu, Haosheng, et al.
Pubblicazione: (2025)
ActivityEditor: Learning to Synthesize Physically Valid Human Mobility
di: Yang, Chenjie, et al.
Pubblicazione: (2026)
di: Yang, Chenjie, et al.
Pubblicazione: (2026)
Inquiring into Culture in our Foreign-Language Classrooms
di: Damaris Castro
Pubblicazione: (2007)
di: Damaris Castro
Pubblicazione: (2007)
Documenti analoghi
-
Mobile-R1: Towards Interactive Capability for VLM-Based Mobile Agent via Systematic Training
di: Gu, Jihao, et al.
Pubblicazione: (2025) -
SecAgent: Efficient Mobile GUI Agent with Semantic Context
di: Xie, Yiping, et al.
Pubblicazione: (2026) -
AndroidLens: Long-latency Evaluation with Nested Sub-targets for Android GUI Agents
di: Cao, Yue, et al.
Pubblicazione: (2025) -
Token Preference Optimization with Self-Calibrated Visual-Anchored Rewards for Hallucination Mitigation
di: Gu, Jihao, et al.
Pubblicazione: (2024) -
Thinking With Bounding Boxes: Enhancing Spatio-Temporal Video Grounding via Reinforcement Fine-Tuning
di: Gu, Xin, et al.
Pubblicazione: (2025)