AutoGLM: Autonomous Foundation Agents for GUIs
Fuente:
arXiv
Saved in:
| Main Authors: | Liu, Xiao, Qin, Bo, Liang, Dongzhu, Dong, Guang, Lai, Hanyu, Zhang, Hanchen, Zhao, Hanlin, Iong, Iat Long, Sun, Jiadai, Wang, Jiaqi, Gao, Junjie, Shan, Junjun, Liu, Kangning, Zhang, Shudan, Yao, Shuntian, Cheng, Siyi, Yao, Wentao, Zhao, Wenyi, Liu, Xinghan, Liu, Xinyi, Chen, Xinying, Yang, Xinyue, Yang, Yang, Xu, Yifan, Yang, Yu, Wang, Yujia, Xu, Yulin, Qi, Zehan, Dong, Yuxiao, Tang, Jie |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
AutoWebGLM: A Large Language Model-based Web Navigating Agent
by: Lai, Hanyu, et al.
Published: (2024)
by: Lai, Hanyu, et al.
Published: (2024)
WebRL: Training LLM Web Agents via Self-Evolving Online Curriculum Reinforcement Learning
by: Qi, Zehan, et al.
Published: (2024)
by: Qi, Zehan, et al.
Published: (2024)
MobileRL: Online Agentic Reinforcement Learning for Mobile GUI Agents
by: Xu, Yifan, et al.
Published: (2025)
by: Xu, Yifan, et al.
Published: (2025)
VisualAgentBench: Towards Large Multimodal Models as Visual Foundation Agents
by: Liu, Xiao, et al.
Published: (2024)
by: Liu, Xiao, et al.
Published: (2024)
ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools
by: GLM, Team, et al.
Published: (2024)
by: GLM, Team, et al.
Published: (2024)
ChatGLM-Math: Improving Math Problem-Solving in Large Language Models with a Self-Critique Pipeline
by: Xu, Yifan, et al.
Published: (2024)
by: Xu, Yifan, et al.
Published: (2024)
NaturalCodeBench: Examining Coding Performance Mismatch on HumanEval and Natural User Prompts
by: Zhang, Shudan, et al.
Published: (2024)
by: Zhang, Shudan, et al.
Published: (2024)
ComputerRL: Scaling End-to-End Online Reinforcement Learning for Computer Use Agents
by: Lai, Hanyu, et al.
Published: (2025)
by: Lai, Hanyu, et al.
Published: (2025)
AgentRL: Scaling Agentic Reinforcement Learning with a Multi-Turn, Multi-Task Framework
by: Zhang, Hanchen, et al.
Published: (2025)
by: Zhang, Hanchen, et al.
Published: (2025)
GLM-4-Voice: Towards Intelligent and Human-Like End-to-End Spoken Chatbot
by: Zeng, Aohan, et al.
Published: (2024)
by: Zeng, Aohan, et al.
Published: (2024)
Advancing GenAI Assisted Programming--A Comparative Study on Prompt Efficiency and Code Quality Between GPT-4 and GLM-4
by: Yang, Angus, et al.
Published: (2024)
by: Yang, Angus, et al.
Published: (2024)
GLM-5V-Turbo: Toward a Native Foundation Model for Multimodal Agents
by: V Team, et al.
Published: (2026)
by: V Team, et al.
Published: (2026)
MAESTRO: Adapting GUIs and Guiding Navigation with User Preferences in Conversational Agents with GUIs
by: Lee, Sangwook, et al.
Published: (2026)
by: Lee, Sangwook, et al.
Published: (2026)
AndroidGen: Building an Android Language Agent under Data Scarcity
by: Lai, Hanyu, et al.
Published: (2025)
by: Lai, Hanyu, et al.
Published: (2025)
Null-Space Flow Matching for MIMO Channel Estimation in Latency-Constrained Systems
by: Zhao, Junjie, et al.
Published: (2026)
by: Zhao, Junjie, et al.
Published: (2026)
AndroidLab: Training and Systematic Benchmarking of Android Autonomous Agents
by: Xu, Yifan, et al.
Published: (2024)
by: Xu, Yifan, et al.
Published: (2024)
MathGLM-Vision: Solving Mathematical Problems with Multi-Modal Large Language Model
by: Yang, Zhen, et al.
Published: (2024)
by: Yang, Zhen, et al.
Published: (2024)
Learning to Watermark LLM-generated Text via Reinforcement Learning
by: Xu, Xiaojun, et al.
Published: (2024)
by: Xu, Xiaojun, et al.
Published: (2024)
Large Language Model Unlearning
by: Yao, Yuanshun, et al.
Published: (2023)
by: Yao, Yuanshun, et al.
Published: (2023)
ChatGLM-RLHF: Practices of Aligning Large Language Models with Human Feedback
by: Hou, Zhenyu, et al.
Published: (2024)
by: Hou, Zhenyu, et al.
Published: (2024)
Environment-Aware Channel Inference via Cross-Modal Flow: From Multimodal Sensing to Wireless Channels
by: Liang, Guangming, et al.
Published: (2025)
by: Liang, Guangming, et al.
Published: (2025)
Channel Capacity-Aware Distributed Encoding for Multi-View Sensing and Edge Inference
by: Yang, Mingjie, et al.
Published: (2024)
by: Yang, Mingjie, et al.
Published: (2024)
GLM-OCR Technical Report
by: Duan, Shuaiqi, et al.
Published: (2026)
by: Duan, Shuaiqi, et al.
Published: (2026)
Embedding Compression Distortion in Video Coding for Machines
by: Sun, Yuxiao, et al.
Published: (2025)
by: Sun, Yuxiao, et al.
Published: (2025)
GLM-4.5: Agentic, Reasoning, and Coding (ARC) Foundation Models
by: 5 Team, et al.
Published: (2025)
by: 5 Team, et al.
Published: (2025)
GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning
by: V Team, et al.
Published: (2025)
by: V Team, et al.
Published: (2025)
Hindsight Planner: A Closed-Loop Few-Shot Planner for Embodied Instruction Following
by: Yang, Yuxiao, et al.
Published: (2024)
by: Yang, Yuxiao, et al.
Published: (2024)
Doppler-Resilient LEO Satellite OFDM Transmission with Affine Frequency Domain Pilot
by: Tang, Shuntian, et al.
Published: (2026)
by: Tang, Shuntian, et al.
Published: (2026)
On the Cause of Unfairness: A Training Sample Perspective
by: Yao, Yuanshun, et al.
Published: (2023)
by: Yao, Yuanshun, et al.
Published: (2023)
GLM-5: from Vibe Coding to Agentic Engineering
by: GLM-5-Team, et al.
Published: (2026)
by: GLM-5-Team, et al.
Published: (2026)
Multifunctional Surface Engineering of Ni‐Rich Layered Cathodes for Ultra‐Stable Lithium‐Ion Batteries
by: Shanzhi Dong, et al.
Published: (2025)
by: Shanzhi Dong, et al.
Published: (2025)
GLM-TTS Technical Report
by: Cui, Jiayan, et al.
Published: (2025)
by: Cui, Jiayan, et al.
Published: (2025)
Recoverable Compression: A Multimodal Vision Token Recovery Mechanism Guided by Text Information
by: Chen, Yi, et al.
Published: (2024)
by: Chen, Yi, et al.
Published: (2024)
From Pixel to Slide image: Polarization Modality-based Pathological Diagnosis Using Representation Learning
by: Dong, Jia, et al.
Published: (2024)
by: Dong, Jia, et al.
Published: (2024)
Corrections of an elliptic block in the NS sector
by: Liu, Kangning
Published: (2026)
by: Liu, Kangning
Published: (2026)
$J\bar{J}$-deformation as a Riemann bilinear dressing
by: Liu, Kangning
Published: (2026)
by: Liu, Kangning
Published: (2026)
Continuous-time structural failure time model for intermittent treatment
by: Wang, Guanbo, et al.
Published: (2024)
by: Wang, Guanbo, et al.
Published: (2024)
Investigation of the Impact of Different Types of Brewing Water on Green Tea Infusion Quality Based on RATA and GC – MS
by: Aolin Yang, et al.
Published: (2025)
by: Aolin Yang, et al.
Published: (2025)
Fusion of Integrable Defects and the Defect $g$-Function
by: He, Yang, et al.
Published: (2026)
by: He, Yang, et al.
Published: (2026)
Effects of Repeated Viewing on Attention to Bilingual Subtitles and L2 Incidental Vocabulary Learning: An Eye‐Tracking Study
by: Wenqing Zhong, et al.
Published: (2026)
by: Wenqing Zhong, et al.
Published: (2026)
Similar Items
-
AutoWebGLM: A Large Language Model-based Web Navigating Agent
by: Lai, Hanyu, et al.
Published: (2024) -
WebRL: Training LLM Web Agents via Self-Evolving Online Curriculum Reinforcement Learning
by: Qi, Zehan, et al.
Published: (2024) -
MobileRL: Online Agentic Reinforcement Learning for Mobile GUI Agents
by: Xu, Yifan, et al.
Published: (2025) -
VisualAgentBench: Towards Large Multimodal Models as Visual Foundation Agents
by: Liu, Xiao, et al.
Published: (2024) -
ChatGLM: A Family of Large Language Models from GLM-130B to GLM-4 All Tools
by: GLM, Team, et al.
Published: (2024)