Synatra: Turning Indirect Knowledge into Direct Demonstrations for Digital Agents at Scale
Fuente:
arXiv
Salvato in:
| Autori principali: | Ou, Tianyue, Xu, Frank F., Madaan, Aman, Liu, Jiarui, Lo, Robert, Sridhar, Abishek, Sengupta, Sudipta, Roth, Dan, Neubig, Graham, Zhou, Shuyan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
WebArena: A Realistic Web Environment for Building Autonomous Agents
di: Zhou, Shuyan, et al.
Pubblicazione: (2023)
di: Zhou, Shuyan, et al.
Pubblicazione: (2023)
CowPilot: A Framework for Autonomous and Human-Agent Collaborative Web Navigation
di: Huq, Faria, et al.
Pubblicazione: (2025)
di: Huq, Faria, et al.
Pubblicazione: (2025)
Beyond Browsing: API-Based Web Agents
di: Song, Yueqi, et al.
Pubblicazione: (2024)
di: Song, Yueqi, et al.
Pubblicazione: (2024)
Modeling Distinct Human Interaction in Web Agents
di: Huq, Faria, et al.
Pubblicazione: (2026)
di: Huq, Faria, et al.
Pubblicazione: (2026)
VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge
di: Song, Yueqi, et al.
Pubblicazione: (2025)
di: Song, Yueqi, et al.
Pubblicazione: (2025)
Gym-Anything: Turn any Software into an Agent Environment
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2026)
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2026)
Directed Testing of ORAN using a Partially Specified Declarative Digital Twin
di: Gatherer, Alan, et al.
Pubblicazione: (2024)
di: Gatherer, Alan, et al.
Pubblicazione: (2024)
Effective Strategies for Asynchronous Software Engineering Agents
di: Geng, Jiayi, et al.
Pubblicazione: (2026)
di: Geng, Jiayi, et al.
Pubblicazione: (2026)
Go-Browse: Training Web Agents with Structured Exploration
di: Gandhi, Apurva, et al.
Pubblicazione: (2025)
di: Gandhi, Apurva, et al.
Pubblicazione: (2025)
Analyzing Information Sharing and Coordination in Multi-Agent Planning
di: Ou, Tianyue, et al.
Pubblicazione: (2025)
di: Ou, Tianyue, et al.
Pubblicazione: (2025)
Training Versatile Coding Agents in Synthetic Environments
di: Zhu, Yiqi, et al.
Pubblicazione: (2025)
di: Zhu, Yiqi, et al.
Pubblicazione: (2025)
Learning Performance-Improving Code Edits
di: Shypula, Alexander, et al.
Pubblicazione: (2023)
di: Shypula, Alexander, et al.
Pubblicazione: (2023)
Harnessing Webpage UIs for Text-Rich Visual Understanding
di: Liu, Junpeng, et al.
Pubblicazione: (2024)
di: Liu, Junpeng, et al.
Pubblicazione: (2024)
VisualWebArena: Evaluating Multimodal Agents on Realistic Visual Web Tasks
di: Koh, Jing Yu, et al.
Pubblicazione: (2024)
di: Koh, Jing Yu, et al.
Pubblicazione: (2024)
Agent Data Protocol: Unifying Datasets for Diverse, Effective Fine-tuning of LLM Agents
di: Song, Yueqi, et al.
Pubblicazione: (2025)
di: Song, Yueqi, et al.
Pubblicazione: (2025)
Towards Global AI Inclusivity: A Large-Scale Multilingual Terminology Dataset (GIST)
di: Liu, Jiarui, et al.
Pubblicazione: (2024)
di: Liu, Jiarui, et al.
Pubblicazione: (2024)
BehaviorBox: Automated Discovery of Fine-Grained Performance Differences Between Language Models
di: Tjuatja, Lindia, et al.
Pubblicazione: (2025)
di: Tjuatja, Lindia, et al.
Pubblicazione: (2025)
Agent Workflow Memory
di: Wang, Zora Zhiruo, et al.
Pubblicazione: (2024)
di: Wang, Zora Zhiruo, et al.
Pubblicazione: (2024)
Recursive Agent Optimization
di: Gandhi, Apurva, et al.
Pubblicazione: (2026)
di: Gandhi, Apurva, et al.
Pubblicazione: (2026)
Grounding Multilingual Multimodal LLMs With Cultural Knowledge
di: Nyandwi, Jean de Dieu, et al.
Pubblicazione: (2025)
di: Nyandwi, Jean de Dieu, et al.
Pubblicazione: (2025)
Can Large Language Models be Trusted for Evaluation? Scalable Meta-Evaluation of LLMs as Evaluators via Agent Debate
di: Chern, Steffi, et al.
Pubblicazione: (2024)
di: Chern, Steffi, et al.
Pubblicazione: (2024)
When Vision-Language Models Judge Without Seeing: Exposing Informativeness Bias
di: Zou, Xiaohan, et al.
Pubblicazione: (2026)
di: Zou, Xiaohan, et al.
Pubblicazione: (2026)
Cohomogeneity One Expanding Ricci Solitons and the Expander Degree
di: Rajan, Abishek
Pubblicazione: (2025)
di: Rajan, Abishek
Pubblicazione: (2025)
AUTOCT: Automating Interpretable Clinical Trial Prediction with LLM Agents
di: Liu, Fengze, et al.
Pubblicazione: (2025)
di: Liu, Fengze, et al.
Pubblicazione: (2025)
Indirect Attention: Turning Context Misalignment into a Feature
di: Bahaduri, Bissmella, et al.
Pubblicazione: (2025)
di: Bahaduri, Bissmella, et al.
Pubblicazione: (2025)
Ambig-SWE: Interactive Agents to Overcome Underspecificity in Software Engineering
di: Vijayvargiya, Sanidhya, et al.
Pubblicazione: (2025)
di: Vijayvargiya, Sanidhya, et al.
Pubblicazione: (2025)
D2K: Turning Historical Data into Retrievable Knowledge for Recommender Systems
di: Qin, Jiarui, et al.
Pubblicazione: (2024)
di: Qin, Jiarui, et al.
Pubblicazione: (2024)
SynLexLM: Scaling Legal LLMs with Synthetic Data and Curriculum Learning
di: Upadhyay, Ojasw, et al.
Pubblicazione: (2025)
di: Upadhyay, Ojasw, et al.
Pubblicazione: (2025)
CAMP: Cumulative Agentic Masking and Pruning for Privacy Protection in Multi-Turn LLM Conversations
di: Panjwani, Aman
Pubblicazione: (2026)
di: Panjwani, Aman
Pubblicazione: (2026)
Coding Agents with Multimodal Browsing are Generalist Problem Solvers
di: Soni, Aditya Bharat, et al.
Pubblicazione: (2025)
di: Soni, Aditya Bharat, et al.
Pubblicazione: (2025)
Asking What Matters: Reward-Driven Clarification for Software Engineering Tasks
di: Vijayvargiya, Sanidhya, et al.
Pubblicazione: (2026)
di: Vijayvargiya, Sanidhya, et al.
Pubblicazione: (2026)
An Incomplete Loop: Instruction Inference, Instruction Following, and In-context Learning in Language Models
di: Liu, Emmy, et al.
Pubblicazione: (2024)
di: Liu, Emmy, et al.
Pubblicazione: (2024)
TroVE: Inducing Verifiable and Efficient Toolboxes for Solving Programmatic Tasks
di: Wang, Zhiruo, et al.
Pubblicazione: (2024)
di: Wang, Zhiruo, et al.
Pubblicazione: (2024)
What Is Missing in Multilingual Visual Reasoning and How to Fix It
di: Song, Yueqi, et al.
Pubblicazione: (2024)
di: Song, Yueqi, et al.
Pubblicazione: (2024)
On the Interplay of Pre-Training, Mid-Training, and RL on Reasoning Language Models
di: Zhang, Charlie, et al.
Pubblicazione: (2025)
di: Zhang, Charlie, et al.
Pubblicazione: (2025)
Midtraining Bridges Pretraining and Posttraining Distributions
di: Liu, Emmy, et al.
Pubblicazione: (2025)
di: Liu, Emmy, et al.
Pubblicazione: (2025)
Solving NLP Problems through Human-System Collaboration: A Discussion-based Approach
di: Kaneko, Masahiro, et al.
Pubblicazione: (2023)
di: Kaneko, Masahiro, et al.
Pubblicazione: (2023)
Direct Multi-Turn Preference Optimization for Language Agents
di: Shi, Wentao, et al.
Pubblicazione: (2024)
di: Shi, Wentao, et al.
Pubblicazione: (2024)
Language Modeling with Editable External Knowledge
di: Li, Belinda Z., et al.
Pubblicazione: (2024)
di: Li, Belinda Z., et al.
Pubblicazione: (2024)
>3kV NiO/Ga2O3 Heterojunction Diodes with Space-Modulated Junction Termination Extension and Sub-1V Turn-on
di: Gilankar, Advait, et al.
Pubblicazione: (2024)
di: Gilankar, Advait, et al.
Pubblicazione: (2024)
Documenti analoghi
-
WebArena: A Realistic Web Environment for Building Autonomous Agents
di: Zhou, Shuyan, et al.
Pubblicazione: (2023) -
CowPilot: A Framework for Autonomous and Human-Agent Collaborative Web Navigation
di: Huq, Faria, et al.
Pubblicazione: (2025) -
Beyond Browsing: API-Based Web Agents
di: Song, Yueqi, et al.
Pubblicazione: (2024) -
Modeling Distinct Human Interaction in Web Agents
di: Huq, Faria, et al.
Pubblicazione: (2026) -
VisualPuzzles: Decoupling Multimodal Reasoning Evaluation from Domain Knowledge
di: Song, Yueqi, et al.
Pubblicazione: (2025)