CoAct-1: Computer-using Multi-Agent System with Coding Actions
Fuente:
arXiv
Guardado en:
| Autores principales: | Song, Linxin, Dai, Yutong, Prabhu, Viraj, Zhang, Jieyu, Shi, Taiwei, Li, Li, Li, Junnan, Savarese, Silvio, Chen, Zeyuan, Zhao, Jieyu, Xu, Ran, Xiong, Caiming |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
The Hallucination Tax of Reinforcement Finetuning
por: Song, Linxin, et al.
Publicado: (2025)
por: Song, Linxin, et al.
Publicado: (2025)
WALT: Web Agents that Learn Tools
por: Prabhu, Viraj, et al.
Publicado: (2025)
por: Prabhu, Viraj, et al.
Publicado: (2025)
Video-Based Reward Modeling for Computer-Use Agents
por: Song, Linxin, et al.
Publicado: (2026)
por: Song, Linxin, et al.
Publicado: (2026)
SCUBA: Salesforce Computer Use Benchmark
por: Dai, Yutong, et al.
Publicado: (2025)
por: Dai, Yutong, et al.
Publicado: (2025)
Efficient Reinforcement Finetuning via Adaptive Curriculum Learning
por: Shi, Taiwei, et al.
Publicado: (2025)
por: Shi, Taiwei, et al.
Publicado: (2025)
The Blind Spot of Agent Safety: How Benign User Instructions Expose Critical Vulnerabilities in Computer-Use Agents
por: Ding, Xuwei, et al.
Publicado: (2026)
por: Ding, Xuwei, et al.
Publicado: (2026)
Experiential Reinforcement Learning
por: Shi, Taiwei, et al.
Publicado: (2026)
por: Shi, Taiwei, et al.
Publicado: (2026)
Safer-Instruct: Aligning Language Models with Automated Preference Data
por: Shi, Taiwei, et al.
Publicado: (2023)
por: Shi, Taiwei, et al.
Publicado: (2023)
Discovering Knowledge Deficiencies of Language Models on Massive Knowledge Base
por: Song, Linxin, et al.
Publicado: (2025)
por: Song, Linxin, et al.
Publicado: (2025)
CodeTree: Agent-guided Tree Search for Code Generation with Large Language Models
por: Li, Jierui, et al.
Publicado: (2024)
por: Li, Jierui, et al.
Publicado: (2024)
CoAct: A Global-Local Hierarchy for Autonomous Agent Collaboration
por: Hou, Xinming, et al.
Publicado: (2024)
por: Hou, Xinming, et al.
Publicado: (2024)
ProVision: Programmatically Scaling Vision-centric Instruction Data for Multimodal Language Models
por: Zhang, Jieyu, et al.
Publicado: (2024)
por: Zhang, Jieyu, et al.
Publicado: (2024)
GTA1: GUI Test-time Scaling Agent
por: Yang, Yan, et al.
Publicado: (2025)
por: Yang, Yan, et al.
Publicado: (2025)
How Far Are Vision-Language Models from Constructing the Real World? A Benchmark for Physical Generative Reasoning
por: Yang, Luyu, et al.
Publicado: (2026)
por: Yang, Luyu, et al.
Publicado: (2026)
OrchVis: Hierarchical Multi-Agent Orchestration for Human Oversight
por: Zhou, Jieyu
Publicado: (2025)
por: Zhou, Jieyu
Publicado: (2025)
Trust but Verify: Programmatic VLM Evaluation in the Wild
por: Prabhu, Viraj, et al.
Publicado: (2024)
por: Prabhu, Viraj, et al.
Publicado: (2024)
Detecting and Filtering Unsafe Training Data via Data Attribution with Denoised Representation
por: Pan, Yijun, et al.
Publicado: (2025)
por: Pan, Yijun, et al.
Publicado: (2025)
CoAct: Co-Active LLM Preference Learning with Human-AI Synergy
por: Xu, Ruiyao, et al.
Publicado: (2026)
por: Xu, Ruiyao, et al.
Publicado: (2026)
W&D:Scaling Parallel Tool Calling for Efficient Deep Research Agents
por: Lin, Xiaoqiang, et al.
Publicado: (2026)
por: Lin, Xiaoqiang, et al.
Publicado: (2026)
INDICT: Code Generation with Internal Dialogues of Critiques for Both Security and Helpfulness
por: Le, Hung, et al.
Publicado: (2024)
por: Le, Hung, et al.
Publicado: (2024)
CodeXEmbed: A Generalist Embedding Model Family for Multiligual and Multi-task Code Retrieval
por: Liu, Ye, et al.
Publicado: (2024)
por: Liu, Ye, et al.
Publicado: (2024)
Reward-Guided Speculative Decoding for Efficient LLM Reasoning
por: Liao, Baohao, et al.
Publicado: (2025)
por: Liao, Baohao, et al.
Publicado: (2025)
Enabling High Data Throughput Reinforcement Learning on GPUs: A Domain Agnostic Framework for Data-Driven Scientific Research
por: Lan, Tian, et al.
Publicado: (2024)
por: Lan, Tian, et al.
Publicado: (2024)
X-InstructBLIP: A Framework for aligning X-Modal instruction-aware representations to LLMs and Emergent Cross-modal Reasoning
por: Panagopoulou, Artemis, et al.
Publicado: (2023)
por: Panagopoulou, Artemis, et al.
Publicado: (2023)
Harmonia: Algorithm-Hardware Co-Design for Memory- and Compute-Efficient BFP-based LLM Inference
por: Wang, Xinyu, et al.
Publicado: (2026)
por: Wang, Xinyu, et al.
Publicado: (2026)
PerfCodeGen: Improving Performance of LLM Generated Code with Execution Feedback
por: Peng, Yun, et al.
Publicado: (2024)
por: Peng, Yun, et al.
Publicado: (2024)
CoDA: Coding LM via Diffusion Adaptation
por: Chen, Haolin, et al.
Publicado: (2025)
por: Chen, Haolin, et al.
Publicado: (2025)
Skill Reuse as Compression in Agentic RL
por: Xu, Zhikun, et al.
Publicado: (2026)
por: Xu, Zhikun, et al.
Publicado: (2026)
Offline Training of Language Model Agents with Functions as Learnable Weights
por: Zhang, Shaokun, et al.
Publicado: (2024)
por: Zhang, Shaokun, et al.
Publicado: (2024)
DyMU: Dynamic Merging and Virtual Unmerging for Efficient VLMs
por: Wang, Zhenhailong, et al.
Publicado: (2025)
por: Wang, Zhenhailong, et al.
Publicado: (2025)
Shared Imagination: LLMs Hallucinate Alike
por: Zhou, Yilun, et al.
Publicado: (2024)
por: Zhou, Yilun, et al.
Publicado: (2024)
Asynchronous Tool Usage for Real-Time Agents
por: Ginart, Antonio A., et al.
Publicado: (2024)
por: Ginart, Antonio A., et al.
Publicado: (2024)
EcoAct: Economic Agent Determines When to Register What Action
por: Zhang, Shaokun, et al.
Publicado: (2024)
por: Zhang, Shaokun, et al.
Publicado: (2024)
Active Video Perception: Iterative Evidence Seeking for Agentic Long Video Understanding
por: Wang, Ziyang, et al.
Publicado: (2025)
por: Wang, Ziyang, et al.
Publicado: (2025)
Enterprise Deep Research: Steerable Multi-Agent Deep Research for Enterprise Analytics
por: Prabhakar, Akshara, et al.
Publicado: (2025)
por: Prabhakar, Akshara, et al.
Publicado: (2025)
Reasoning Curriculum: Bootstrapping Broad LLM Reasoning from Math
por: Pang, Bo, et al.
Publicado: (2025)
por: Pang, Bo, et al.
Publicado: (2025)
Adaptive In-conversation Team Building for Language Model Agents
por: Song, Linxin, et al.
Publicado: (2024)
por: Song, Linxin, et al.
Publicado: (2024)
BLIP3o-NEXT: Next Frontier of Native Image Generation
por: Chen, Jiuhai, et al.
Publicado: (2025)
por: Chen, Jiuhai, et al.
Publicado: (2025)
Empowering Time Series Analysis with Synthetic Data: A Survey and Outlook in the Era of Foundation Models
por: Liu, Xu, et al.
Publicado: (2025)
por: Liu, Xu, et al.
Publicado: (2025)
Moirai 2.0: When Less Is More for Time Series Forecasting
por: Liu, Chenghao, et al.
Publicado: (2025)
por: Liu, Chenghao, et al.
Publicado: (2025)
Ejemplares similares
-
The Hallucination Tax of Reinforcement Finetuning
por: Song, Linxin, et al.
Publicado: (2025) -
WALT: Web Agents that Learn Tools
por: Prabhu, Viraj, et al.
Publicado: (2025) -
Video-Based Reward Modeling for Computer-Use Agents
por: Song, Linxin, et al.
Publicado: (2026) -
SCUBA: Salesforce Computer Use Benchmark
por: Dai, Yutong, et al.
Publicado: (2025) -
Efficient Reinforcement Finetuning via Adaptive Curriculum Learning
por: Shi, Taiwei, et al.
Publicado: (2025)