LLMs as Scalable, General-Purpose Simulators For Evolving Digital Agent Training
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Yiming, Yin, Da, Cui, Yuedong, Zheng, Ruichen, Li, Zhiqian, Lin, Zongyu, Wu, Di, Wu, Xueqing, Ye, Chenchen, Zhou, Yu, Chang, Kai-Wei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
VDebugger: Harnessing Execution Feedback for Debugging Visual Programs
di: Wu, Xueqing, et al.
Pubblicazione: (2024)
di: Wu, Xueqing, et al.
Pubblicazione: (2024)
On Asymmetric Optimization of Reasoning and Perception in Vision-Language Model Post-Training
di: Wu, Xueqing, et al.
Pubblicazione: (2026)
di: Wu, Xueqing, et al.
Pubblicazione: (2026)
QLASS: Boosting Language Agent Inference via Q-Guided Stepwise Search
di: Lin, Zongyu, et al.
Pubblicazione: (2025)
di: Lin, Zongyu, et al.
Pubblicazione: (2025)
KPEval: Towards Fine-Grained Semantic-Based Keyphrase Evaluation
di: Wu, Di, et al.
Pubblicazione: (2023)
di: Wu, Di, et al.
Pubblicazione: (2023)
FitText: Evolving Agent Tool Ecologies via Memetic Retrieval
di: Zheng, Kyle, et al.
Pubblicazione: (2026)
di: Zheng, Kyle, et al.
Pubblicazione: (2026)
Re-ReST: Reflection-Reinforced Self-Training for Language Agents
di: Dou, Zi-Yi, et al.
Pubblicazione: (2024)
di: Dou, Zi-Yi, et al.
Pubblicazione: (2024)
Evolving Subnetwork Training for Large Language Models
di: Li, Hanqi, et al.
Pubblicazione: (2024)
di: Li, Hanqi, et al.
Pubblicazione: (2024)
OfficeBench: Benchmarking Language Agents across Multiple Applications for Office Automation
di: Wang, Zilong, et al.
Pubblicazione: (2024)
di: Wang, Zilong, et al.
Pubblicazione: (2024)
InfiniteWeb: Scalable Web Environment Synthesis for GUI Agent Training
di: Zhang, Ziyun, et al.
Pubblicazione: (2026)
di: Zhang, Ziyun, et al.
Pubblicazione: (2026)
Position: Agentic Evolution is the Path to Evolving LLMs
di: Lin, Minhua, et al.
Pubblicazione: (2026)
di: Lin, Minhua, et al.
Pubblicazione: (2026)
A Generalizable Framework for Building Executable Domain-Specific LLMs under Data Scarcity: Demonstration on Semiconductor TCAD Simulation
di: Wang, Di, et al.
Pubblicazione: (2026)
di: Wang, Di, et al.
Pubblicazione: (2026)
Agent Lumos: Unified and Modular Training for Open-Source Language Agents
di: Yin, Da, et al.
Pubblicazione: (2023)
di: Yin, Da, et al.
Pubblicazione: (2023)
Embodied Web Agents: Bridging Physical-Digital Realms for Integrated Agent Intelligence
di: Hong, Yining, et al.
Pubblicazione: (2025)
di: Hong, Yining, et al.
Pubblicazione: (2025)
Are LLMs Capable of Data-based Statistical and Causal Reasoning? Benchmarking Advanced Quantitative Reasoning with Data
di: Liu, Xiao, et al.
Pubblicazione: (2024)
di: Liu, Xiao, et al.
Pubblicazione: (2024)
Training LLMs for Divide-and-Conquer Reasoning Elevates Test-Time Scalability
di: Liang, Xiao, et al.
Pubblicazione: (2026)
di: Liang, Xiao, et al.
Pubblicazione: (2026)
Structure-Enhanced Protein Instruction Tuning: Towards General-Purpose Protein Understanding with LLMs
di: Wu, Wei, et al.
Pubblicazione: (2024)
di: Wu, Wei, et al.
Pubblicazione: (2024)
FronTalk: Benchmarking Front-End Development as Conversational Code Generation with Multi-Modal Feedback
di: Wu, Xueqing, et al.
Pubblicazione: (2025)
di: Wu, Xueqing, et al.
Pubblicazione: (2025)
VISCO: Benchmarking Fine-Grained Critique and Correction Towards Self-Improvement in Visual Reasoning
di: Wu, Xueqing, et al.
Pubblicazione: (2024)
di: Wu, Xueqing, et al.
Pubblicazione: (2024)
CoEvolve: Training LLM Agents via Agent-Data Mutual Evolution
di: Yang, Shidong, et al.
Pubblicazione: (2026)
di: Yang, Shidong, et al.
Pubblicazione: (2026)
Kolmogorov-Arnold Representation for Symplectic Learning: Advancing Hamiltonian Neural Networks
di: Wu, Zongyu, et al.
Pubblicazione: (2025)
di: Wu, Zongyu, et al.
Pubblicazione: (2025)
An Evolving Scenario Generation Method based on Dual-modal Driver Model Trained by Multi-Agent Reinforcement Learning
di: Wu, Xinzheng, et al.
Pubblicazione: (2025)
di: Wu, Xinzheng, et al.
Pubblicazione: (2025)
Assessing the Human-Likeness of LLM-Driven Digital Twins in Simulating Health Care System Trust
di: Wu, Yuzhou, et al.
Pubblicazione: (2025)
di: Wu, Yuzhou, et al.
Pubblicazione: (2025)
Evolving, Not Training: Zero-Shot Reasoning Segmentation via Evolutionary Prompting
di: Ye, Kai, et al.
Pubblicazione: (2025)
di: Ye, Kai, et al.
Pubblicazione: (2025)
Decoding Time Series with LLMs: A Multi-Agent Framework for Cross-Domain Annotation
di: Lin, Minhua, et al.
Pubblicazione: (2024)
di: Lin, Minhua, et al.
Pubblicazione: (2024)
Synthesizing Post-Training Data for LLMs through Multi-Agent Simulation
di: Tang, Shuo, et al.
Pubblicazione: (2024)
di: Tang, Shuo, et al.
Pubblicazione: (2024)
PAL: Designing Conversational Agents as Scalable, Cooperative Patient Simulators for Palliative-Care Training
di: Sehgal, Neil K. R., et al.
Pubblicazione: (2025)
di: Sehgal, Neil K. R., et al.
Pubblicazione: (2025)
Harness Updating Is Not Harness Benefit: Disentangling Evolution Capabilities in Self-Evolving LLM Agents
di: Lin, Minhua, et al.
Pubblicazione: (2026)
di: Lin, Minhua, et al.
Pubblicazione: (2026)
EvolveSearch: An Iterative Self-Evolving Search Agent
di: Zhang, Dingchu, et al.
Pubblicazione: (2025)
di: Zhang, Dingchu, et al.
Pubblicazione: (2025)
Institutional Adoption and Correlation Dynamics: Bitcoin's Evolving Role in Financial Markets
di: Wu, Di
Pubblicazione: (2025)
di: Wu, Di
Pubblicazione: (2025)
A Modular and Scalable Simulator for Connected-UAVs Communication in 5G Networks
di: Su, Yong, et al.
Pubblicazione: (2025)
di: Su, Yong, et al.
Pubblicazione: (2025)
Evolving Agents: Interactive Simulation of Dynamic and Diverse Human Personalities
di: Li, Jiale, et al.
Pubblicazione: (2024)
di: Li, Jiale, et al.
Pubblicazione: (2024)
From Self-Evolving Synthetic Data to Verifiable-Reward RL: Post-Training Multi-turn Interactive Tool-Using Agents
di: Gao, Jiaxuan, et al.
Pubblicazione: (2026)
di: Gao, Jiaxuan, et al.
Pubblicazione: (2026)
CoopGuard: Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Round Attacks
di: Li, Siyuan, et al.
Pubblicazione: (2026)
di: Li, Siyuan, et al.
Pubblicazione: (2026)
Autogenesis: A Self-Evolving Agent Protocol
di: Zhang, Wentao, et al.
Pubblicazione: (2026)
di: Zhang, Wentao, et al.
Pubblicazione: (2026)
SEDM: Scalable Self-Evolving Distributed Memory for Agents
di: Xu, Haoran, et al.
Pubblicazione: (2025)
di: Xu, Haoran, et al.
Pubblicazione: (2025)
Self-Evolving Multi-Agent Framework for Efficient Decision Making in Real-Time Strategy Scenarios
di: Ma, Li, et al.
Pubblicazione: (2026)
di: Ma, Li, et al.
Pubblicazione: (2026)
UXCascade: Scalable Usability Testing with Simulated User Agents
di: Holter, Steffen, et al.
Pubblicazione: (2026)
di: Holter, Steffen, et al.
Pubblicazione: (2026)
MedGPT-oss: Training a General-Purpose Vision-Language Model for Biomedicine
di: Zhang, Kai, et al.
Pubblicazione: (2026)
di: Zhang, Kai, et al.
Pubblicazione: (2026)
Activation Oracles: Training and Evaluating LLMs as General-Purpose Activation Explainers
di: Karvonen, Adam, et al.
Pubblicazione: (2025)
di: Karvonen, Adam, et al.
Pubblicazione: (2025)
All Robots in One: A New Standard and Unified Dataset for Versatile, General-Purpose Embodied Agents
di: Wang, Zhiqiang, et al.
Pubblicazione: (2024)
di: Wang, Zhiqiang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
VDebugger: Harnessing Execution Feedback for Debugging Visual Programs
di: Wu, Xueqing, et al.
Pubblicazione: (2024) -
On Asymmetric Optimization of Reasoning and Perception in Vision-Language Model Post-Training
di: Wu, Xueqing, et al.
Pubblicazione: (2026) -
QLASS: Boosting Language Agent Inference via Q-Guided Stepwise Search
di: Lin, Zongyu, et al.
Pubblicazione: (2025) -
KPEval: Towards Fine-Grained Semantic-Based Keyphrase Evaluation
di: Wu, Di, et al.
Pubblicazione: (2023) -
FitText: Evolving Agent Tool Ecologies via Memetic Retrieval
di: Zheng, Kyle, et al.
Pubblicazione: (2026)