OpenCUA: Open Foundations for Computer-Use Agents
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Xinyuan, Wang, Bowen, Lu, Dunjie, Yang, Junlin, Xie, Tianbao, Wang, Junli, Deng, Jiaqi, Guo, Xiaole, Xu, Yiheng, Wu, Chen Henry, Shen, Zhennan, Li, Zhuokai, Li, Ryan, Li, Xiaochuan, Chen, Junda, Zheng, Boyuan, Li, Peihang, Lei, Fangyu, Cao, Ruisheng, Fu, Yeqiao, Shin, Dongchan, Shin, Martin, Hu, Jiarui, Wang, Yuyan, Chen, Jixuan, Ye, Yuxiao, Zhang, Danyang, Du, Dikang, Hu, Hao, Chen, Huarong, Zhou, Zaida, Yao, Haotian, Chen, Ziwei, Gu, Qizheng, Wang, Yipu, Wang, Heng, Yang, Diyi, Zhong, Victor, Sung, Flood, Charles, Y., Yang, Zhilin, Yu, Tao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments
di: Xie, Tianbao, et al.
Pubblicazione: (2024)
di: Xie, Tianbao, et al.
Pubblicazione: (2024)
CUA-Gym: Scaling Verifiable Training Environments and Tasks for Computer-Use Agents
di: Wang, Bowen, et al.
Pubblicazione: (2026)
di: Wang, Bowen, et al.
Pubblicazione: (2026)
OpenRT: An Open-Source Red Teaming Framework for Multimodal LLMs
di: Wang, Xin, et al.
Pubblicazione: (2026)
di: Wang, Xin, et al.
Pubblicazione: (2026)
ScaleCUA: Scaling Open-Source Computer Use Agents with Cross-Platform Data
di: Liu, Zhaoyang, et al.
Pubblicazione: (2025)
di: Liu, Zhaoyang, et al.
Pubblicazione: (2025)
Towards Open-Ended Emotional Support Conversations in LLMs via Reinforcement Learning with Future-Oriented Rewards
di: Yang, Ting, et al.
Pubblicazione: (2025)
di: Yang, Ting, et al.
Pubblicazione: (2025)
Spider 2.0: Evaluating Language Models on Real-World Enterprise Text-to-SQL Workflows
di: Lei, Fangyu, et al.
Pubblicazione: (2024)
di: Lei, Fangyu, et al.
Pubblicazione: (2024)
AJAR: Adaptive Jailbreak Architecture for Red-teaming
di: Dou, Yipu, et al.
Pubblicazione: (2026)
di: Dou, Yipu, et al.
Pubblicazione: (2026)
MOSAIC: Multi-Objective Slice-Aware Iterative Curation for Alignment
di: Dou, Yipu, et al.
Pubblicazione: (2026)
di: Dou, Yipu, et al.
Pubblicazione: (2026)
Breaking the Limits of Open-Weight CLIP: An Optimization Framework for Self-supervised Fine-tuning of CLIP
di: Mehta, Anant, et al.
Pubblicazione: (2026)
di: Mehta, Anant, et al.
Pubblicazione: (2026)
MS-DFTVNet:A Long-Term Time Series Prediction Method Based on Multi-Scale Deformable Convolution
di: Li, Chenghan, et al.
Pubblicazione: (2025)
di: Li, Chenghan, et al.
Pubblicazione: (2025)
The Forecast After the Forecast: A Post-Processing Shift in Time Series
di: Liang, Daojun, et al.
Pubblicazione: (2026)
di: Liang, Daojun, et al.
Pubblicazione: (2026)
ArkAnalyzer: The Static Analysis Framework for OpenHarmony
di: Chen, Haonan, et al.
Pubblicazione: (2025)
di: Chen, Haonan, et al.
Pubblicazione: (2025)
Region-Aware Text-to-Image Generation via Hard Binding and Soft Refinement
di: Chen, Zhennan, et al.
Pubblicazione: (2024)
di: Chen, Zhennan, et al.
Pubblicazione: (2024)
OpenClaw-RL: Train Any Agent Simply by Talking
di: Wang, Yinjie, et al.
Pubblicazione: (2026)
di: Wang, Yinjie, et al.
Pubblicazione: (2026)
Language-Augmented Symbolic Planner for Open-World Task Planning
di: Chen, Guanqi, et al.
Pubblicazione: (2024)
di: Chen, Guanqi, et al.
Pubblicazione: (2024)
Suppressing Phase Segregation and Optimizing Interface Carrier Extraction in High‐Efficiency Wide Bandgap Perovskite Solar Cells
di: Xia Chen, et al.
Pubblicazione: (2026)
di: Xia Chen, et al.
Pubblicazione: (2026)
An Extensible Framework for Open Heterogeneous Collaborative Perception
di: Lu, Yifan, et al.
Pubblicazione: (2024)
di: Lu, Yifan, et al.
Pubblicazione: (2024)
Open-SQL Framework: Enhancing Text-to-SQL on Open-source Large Language Models
di: Chen, Xiaojun, et al.
Pubblicazione: (2024)
di: Chen, Xiaojun, et al.
Pubblicazione: (2024)
Stochastic Momentum Methods for Non-smooth Non-Convex Finite-Sum Coupled Compositional Optimization
di: Chen, Xingyu, et al.
Pubblicazione: (2025)
di: Chen, Xingyu, et al.
Pubblicazione: (2025)
Dynamic Skill Adaptation for Large Language Models
di: Chen, Jiaao, et al.
Pubblicazione: (2024)
di: Chen, Jiaao, et al.
Pubblicazione: (2024)
OpenAI for OpenAPI: Automated generation of REST API specification via LLMs
di: Chen, Hao, et al.
Pubblicazione: (2026)
di: Chen, Hao, et al.
Pubblicazione: (2026)
A Near-Optimal Single-Loop Stochastic Algorithm for Convex Finite-Sum Coupled Compositional Optimization
di: Wang, Bokun, et al.
Pubblicazione: (2023)
di: Wang, Bokun, et al.
Pubblicazione: (2023)
Open-World Reinforcement Learning over Long Short-Term Imagination
di: Li, Jiajian, et al.
Pubblicazione: (2024)
di: Li, Jiajian, et al.
Pubblicazione: (2024)
Spider2-V: How Far Are Multimodal Agents From Automating Data Science and Engineering Workflows?
di: Cao, Ruisheng, et al.
Pubblicazione: (2024)
di: Cao, Ruisheng, et al.
Pubblicazione: (2024)
DeCLIP: Decoupled Learning for Open-Vocabulary Dense Perception
di: Wang, Junjie, et al.
Pubblicazione: (2025)
di: Wang, Junjie, et al.
Pubblicazione: (2025)
OpenMMReasoner: Pushing the Frontiers for Multimodal Reasoning with an Open and General Recipe
di: Zhang, Kaichen, et al.
Pubblicazione: (2025)
di: Zhang, Kaichen, et al.
Pubblicazione: (2025)
TG-ASR: Translation-Guided Learning with Parallel Gated Cross Attention for Low-Resource Automatic Speech Recognition
di: Yang, Cheng-Yeh, et al.
Pubblicazione: (2026)
di: Yang, Cheng-Yeh, et al.
Pubblicazione: (2026)
CoCo-SAM3: Harnessing Concept Conflict in Open-Vocabulary Semantic Segmentation
di: Chen, Yanhui, et al.
Pubblicazione: (2026)
di: Chen, Yanhui, et al.
Pubblicazione: (2026)
VideoAgentTrek: Computer Use Pretraining from Unlabeled Videos
di: Lu, Dunjie, et al.
Pubblicazione: (2025)
di: Lu, Dunjie, et al.
Pubblicazione: (2025)
OpenAD: Open-World Autonomous Driving Benchmark for 3D Object Detection
di: Xia, Zhongyu, et al.
Pubblicazione: (2024)
di: Xia, Zhongyu, et al.
Pubblicazione: (2024)
Effects of Cerium Content on the Nonmetallic Inclusions and Impact Toughness of Transformation‐Induced Plasticity Steel
di: Lanqing Wang, et al.
Pubblicazione: (2024)
di: Lanqing Wang, et al.
Pubblicazione: (2024)
Oral Squamous Cell Carcinoma‐Risk Factors, Diagnosis, Treatment, and Prevention
di: Liping Wang, et al.
Pubblicazione: (2026)
di: Liping Wang, et al.
Pubblicazione: (2026)
DRPO: Efficient Reasoning via Decoupled Reward Policy Optimization
di: Li, Gang, et al.
Pubblicazione: (2025)
di: Li, Gang, et al.
Pubblicazione: (2025)
Multiagent Multitraversal Multimodal Self-Driving: Open MARS Dataset
di: Li, Yiming, et al.
Pubblicazione: (2024)
di: Li, Yiming, et al.
Pubblicazione: (2024)
Enhancing Rare Codes via Probability-Biased Directed Graph Attention for Long-Tail ICD Coding
di: Chen, Tianlei, et al.
Pubblicazione: (2025)
di: Chen, Tianlei, et al.
Pubblicazione: (2025)
Measuring Maximum Activations in Open Large Language Models
di: Chen, Luxuan, et al.
Pubblicazione: (2026)
di: Chen, Luxuan, et al.
Pubblicazione: (2026)
CUA-Skill: Develop Skills for Computer Using Agent
di: Chen, Tianyi, et al.
Pubblicazione: (2026)
di: Chen, Tianyi, et al.
Pubblicazione: (2026)
Feature-Space Semantic Invariance: Enhanced OOD Detection for Open-Set Domain Generalization
di: Wang, Haoliang, et al.
Pubblicazione: (2024)
di: Wang, Haoliang, et al.
Pubblicazione: (2024)
Effective Noise-aware Data Simulation for Domain-adaptive Speech Enhancement Leveraging Dynamic Stochastic Perturbation
di: Wang, Chien-Chun, et al.
Pubblicazione: (2024)
di: Wang, Chien-Chun, et al.
Pubblicazione: (2024)
Anomize: Better Open Vocabulary Video Anomaly Detection
di: Li, Fei, et al.
Pubblicazione: (2025)
di: Li, Fei, et al.
Pubblicazione: (2025)
Documenti analoghi
-
OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments
di: Xie, Tianbao, et al.
Pubblicazione: (2024) -
CUA-Gym: Scaling Verifiable Training Environments and Tasks for Computer-Use Agents
di: Wang, Bowen, et al.
Pubblicazione: (2026) -
OpenRT: An Open-Source Red Teaming Framework for Multimodal LLMs
di: Wang, Xin, et al.
Pubblicazione: (2026) -
ScaleCUA: Scaling Open-Source Computer Use Agents with Cross-Platform Data
di: Liu, Zhaoyang, et al.
Pubblicazione: (2025) -
Towards Open-Ended Emotional Support Conversations in LLMs via Reinforcement Learning with Future-Oriented Rewards
di: Yang, Ting, et al.
Pubblicazione: (2025)