Enregistré dans:
| Auteurs principaux: | Gonzalez-Pumariega, Gonzalo, Agashe, Saaket, Yang, Jiachen, Li, Ang, Wang, Xin Eric |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2604.17849 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Agent S2: A Compositional Generalist-Specialist Framework for Computer Use Agents
par: Agashe, Saaket, et autres
Publié: (2025)
par: Agashe, Saaket, et autres
Publié: (2025)
Agent S: An Open Agentic Framework that Uses Computers Like a Human
par: Agashe, Saaket, et autres
Publié: (2024)
par: Agashe, Saaket, et autres
Publié: (2024)
Scaling Agents for Computer Use
par: Gonzalez-Pumariega, Gonzalo, et autres
Publié: (2025)
par: Gonzalez-Pumariega, Gonzalo, et autres
Publié: (2025)
Self-Resource Allocation in Multi-Agent LLM Systems
par: Amayuelas, Alfonso, et autres
Publié: (2025)
par: Amayuelas, Alfonso, et autres
Publié: (2025)
EnactToM: An Evolving Benchmark for Functional Theory of Mind in Embodied Agents
par: Juneja, Gurusha, et autres
Publié: (2026)
par: Juneja, Gurusha, et autres
Publié: (2026)
Robotouille: An Asynchronous Planning Benchmark for LLM Agents
par: Gonzalez-Pumariega, Gonzalo, et autres
Publié: (2025)
par: Gonzalez-Pumariega, Gonzalo, et autres
Publié: (2025)
Query-Efficient Planning with Language Models
par: Gonzalez-Pumariega, Gonzalo, et autres
Publié: (2024)
par: Gonzalez-Pumariega, Gonzalo, et autres
Publié: (2024)
Stateful Reasoning via Insight Replay
par: Lei, Bin, et autres
Publié: (2026)
par: Lei, Bin, et autres
Publié: (2026)
LLM-Coordination: Evaluating and Analyzing Multi-agent Coordination Abilities in Large Language Models
par: Agashe, Saaket, et autres
Publié: (2023)
par: Agashe, Saaket, et autres
Publié: (2023)
Skill-Aligned Fairness in Multi-Agent Learning for Collaboration in Healthcare
par: Ekpo, Promise Osaine, et autres
Publié: (2025)
par: Ekpo, Promise Osaine, et autres
Publié: (2025)
Multi-Turn Code Generation Through Single-Step Rewards
par: Jain, Arnav Kumar, et autres
Publié: (2025)
par: Jain, Arnav Kumar, et autres
Publié: (2025)
Context Bootstrapped Reinforcement Learning
par: Agashe, Saaket, et autres
Publié: (2026)
par: Agashe, Saaket, et autres
Publié: (2026)
MCPWorld: A Unified Benchmarking Testbed for API, GUI, and Hybrid Computer Use Agents
par: Yan, Yunhe, et autres
Publié: (2025)
par: Yan, Yunhe, et autres
Publié: (2025)
A Large Language Model-Empowered Agent for Reliable and Robust Structural Analysis
par: Liu, Jiachen, et autres
Publié: (2025)
par: Liu, Jiachen, et autres
Publié: (2025)
Human-Guided Harm Recovery for Computer Use Agents
par: Li, Christy, et autres
Publié: (2026)
par: Li, Christy, et autres
Publié: (2026)
RiOSWorld: Benchmarking the Risk of Multimodal Computer-Use Agents
par: Yang, Jingyi, et autres
Publié: (2025)
par: Yang, Jingyi, et autres
Publié: (2025)
The Art of Building Verifiers for Computer Use Agents
par: Rosset, Corby, et autres
Publié: (2026)
par: Rosset, Corby, et autres
Publié: (2026)
Learning to Rewrite Tool Descriptions for Reliable LLM-Agent Tool Use
par: Guo, Ruocheng, et autres
Publié: (2026)
par: Guo, Ruocheng, et autres
Publié: (2026)
OSExpert: Computer-Use Agents Learning Professional Skills via Exploration
par: Liu, Jiateng, et autres
Publié: (2026)
par: Liu, Jiateng, et autres
Publié: (2026)
Identification of Probabilities of Causation: from Recursive to Closed-Form Bounds
par: Shu, Xin, et autres
Publié: (2025)
par: Shu, Xin, et autres
Publié: (2025)
PRO-CUA: Process-Reward Optimization for Computer Use Agents
par: He, Yifei, et autres
Publié: (2026)
par: He, Yifei, et autres
Publié: (2026)
OpenCUA: Open Foundations for Computer-Use Agents
par: Wang, Xinyuan, et autres
Publié: (2025)
par: Wang, Xinyuan, et autres
Publié: (2025)
AgentHijack: Benchmarking Computer Use Agent Robustness to Common Environment Corruptions
par: Sun, Jingwei, et autres
Publié: (2026)
par: Sun, Jingwei, et autres
Publié: (2026)
AgentHazard: A Benchmark for Evaluating Harmful Behavior in Computer-Use Agents
par: Feng, Yunhao, et autres
Publié: (2026)
par: Feng, Yunhao, et autres
Publié: (2026)
CaMeLs Can Use Computers Too: System-level Security for Computer Use Agents
par: Foerster, Hanna, et autres
Publié: (2026)
par: Foerster, Hanna, et autres
Publié: (2026)
S-Agents: Self-organizing Agents in Open-ended Environments
par: Chen, Jiaqi, et autres
Publié: (2024)
par: Chen, Jiaqi, et autres
Publié: (2024)
Grounding Computer Use Agents on Human Demonstrations
par: Feizi, Aarash, et autres
Publié: (2025)
par: Feizi, Aarash, et autres
Publié: (2025)
IntentScore: Intent-Conditioned Action Evaluation for Computer-Use Agents
par: Chen, Rongqian, et autres
Publié: (2026)
par: Chen, Rongqian, et autres
Publié: (2026)
Tool-to-Tool Matching Analysis Based Difference Score Computation Methods for Semiconductor Manufacturing
par: H., Sameera Bharadwaja, et autres
Publié: (2025)
par: H., Sameera Bharadwaja, et autres
Publié: (2025)
The Agent Use of Agent Beings: Agent Cybernetics Is the Missing Science of Foundation Agents
par: Wang, Xinrun, et autres
Publié: (2026)
par: Wang, Xinrun, et autres
Publié: (2026)
DPO Learning with LLMs-Judge Signal for Computer Use Agents
par: Luo, Man, et autres
Publié: (2025)
par: Luo, Man, et autres
Publié: (2025)
OpenComputer: Verifiable Software Worlds for Computer-Use Agents
par: Wei, Jinbiao, et autres
Publié: (2026)
par: Wei, Jinbiao, et autres
Publié: (2026)
P-Guide: Parameter-Efficient Prior Steering for Single-Pass CFG Inference
par: Peng, Xin, et autres
Publié: (2026)
par: Peng, Xin, et autres
Publié: (2026)
Curie: Toward Rigorous and Automated Scientific Experimentation with AI Agents
par: Kon, Patrick Tser Jern, et autres
Publié: (2025)
par: Kon, Patrick Tser Jern, et autres
Publié: (2025)
Reducing Cognitive Overhead in Tool Use via Multi-Small-Agent Reinforcement Learning
par: Wang, Dayu, et autres
Publié: (2025)
par: Wang, Dayu, et autres
Publié: (2025)
C-World: A Computer Use Agent Environment Creator
par: Xi, Ziqiao, et autres
Publié: (2026)
par: Xi, Ziqiao, et autres
Publié: (2026)
ComputerRL: Scaling End-to-End Online Reinforcement Learning for Computer Use Agents
par: Lai, Hanyu, et autres
Publié: (2025)
par: Lai, Hanyu, et autres
Publié: (2025)
Agent Alpha: Tree Search Unifying Generation, Exploration and Evaluation for Computer-Use Agents
par: Tang, Sizhe, et autres
Publié: (2026)
par: Tang, Sizhe, et autres
Publié: (2026)
DORAEMON: Decentralized Ontology-aware Reliable Agent with Enhanced Memory Oriented Navigation
par: Gu, Tianjun, et autres
Publié: (2025)
par: Gu, Tianjun, et autres
Publié: (2025)
Efficient Agent Training for Computer Use
par: He, Yanheng, et autres
Publié: (2025)
par: He, Yanheng, et autres
Publié: (2025)
Documents similaires
-
Agent S2: A Compositional Generalist-Specialist Framework for Computer Use Agents
par: Agashe, Saaket, et autres
Publié: (2025) -
Agent S: An Open Agentic Framework that Uses Computers Like a Human
par: Agashe, Saaket, et autres
Publié: (2024) -
Scaling Agents for Computer Use
par: Gonzalez-Pumariega, Gonzalo, et autres
Publié: (2025) -
Self-Resource Allocation in Multi-Agent LLM Systems
par: Amayuelas, Alfonso, et autres
Publié: (2025) -
EnactToM: An Evolving Benchmark for Functional Theory of Mind in Embodied Agents
par: Juneja, Gurusha, et autres
Publié: (2026)