GenEnv: Difficulty-Aligned Co-Evolution Between LLM Agents and Environment Simulators
Fuente:
arXiv
Guardado en:
| Autores principales: | Guo, Jiacheng, Yang, Ling, Chen, Peter, Xiao, Qixin, Wang, Yinjie, Juan, Xinzhe, Qiu, Jiahao, Shen, Ke, Wang, Mengdi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Co-Evolving LLM Coder and Unit Tester via Reinforcement Learning
por: Wang, Yinjie, et al.
Publicado: (2025)
por: Wang, Yinjie, et al.
Publicado: (2025)
Temporal Consistency for LLM Reasoning Process Error Identification
por: Guo, Jiacheng, et al.
Publicado: (2025)
por: Guo, Jiacheng, et al.
Publicado: (2025)
RLAnything: Forge Environment, Policy, and Reward Model in Completely Dynamic RL System
por: Wang, Yinjie, et al.
Publicado: (2026)
por: Wang, Yinjie, et al.
Publicado: (2026)
Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?
por: Qi, Xuan, et al.
Publicado: (2025)
por: Qi, Xuan, et al.
Publicado: (2025)
ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization
por: Wang, Yinjie, et al.
Publicado: (2025)
por: Wang, Yinjie, et al.
Publicado: (2025)
LogicEnvGen: Task-Logic Driven Generation of Diverse Simulated Environments for Embodied AI
por: Wang, Jianan, et al.
Publicado: (2026)
por: Wang, Jianan, et al.
Publicado: (2026)
EnvGen: Generating and Adapting Environments via LLMs for Training Embodied Agents
por: Zala, Abhay, et al.
Publicado: (2024)
por: Zala, Abhay, et al.
Publicado: (2024)
OpenClaw-RL: Train Any Agent Simply by Talking
por: Wang, Yinjie, et al.
Publicado: (2026)
por: Wang, Yinjie, et al.
Publicado: (2026)
Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models
por: Wang, Yinjie, et al.
Publicado: (2025)
por: Wang, Yinjie, et al.
Publicado: (2025)
Alita-G: Self-Evolving Generative Agent for Agent Generation
por: Qiu, Jiahao, et al.
Publicado: (2025)
por: Qiu, Jiahao, et al.
Publicado: (2025)
AgentDistill: Training-Free Agent Distillation with Generalizable MCP Boxes
por: Qiu, Jiahao, et al.
Publicado: (2025)
por: Qiu, Jiahao, et al.
Publicado: (2025)
EnvSimBench: A Benchmark for Evaluating and Improving LLM-Based Environment Simulation
por: Liu, Yi, et al.
Publicado: (2026)
por: Liu, Yi, et al.
Publicado: (2026)
ResearchEnvBench: Benchmarking Agents on Environment Synthesis for Research Code Execution
por: Wang, Yubang, et al.
Publicado: (2026)
por: Wang, Yubang, et al.
Publicado: (2026)
On the Role of Preference Variance in Preference Optimization
por: Guo, Jiacheng, et al.
Publicado: (2025)
por: Guo, Jiacheng, et al.
Publicado: (2025)
Alita: Generalist Agent Enabling Scalable Agentic Reasoning with Minimal Predefinition and Maximal Self-Evolution
por: Qiu, Jiahao, et al.
Publicado: (2025)
por: Qiu, Jiahao, et al.
Publicado: (2025)
CoEnv: Driving Embodied Multi-Agent Collaboration via Compositional Environment
por: Kang, Li, et al.
Publicado: (2026)
por: Kang, Li, et al.
Publicado: (2026)
AutoEnv: Automated Environments for Measuring Cross-Environment Agent Learning
por: Zhang, Jiayi, et al.
Publicado: (2025)
por: Zhang, Jiayi, et al.
Publicado: (2025)
Learning Agent Routing From Early Experience
por: Wang, Yimin, et al.
Publicado: (2026)
por: Wang, Yimin, et al.
Publicado: (2026)
EmoAgent: Assessing and Safeguarding Human-AI Interaction for Mental Health Safety
por: Qiu, Jiahao, et al.
Publicado: (2025)
por: Qiu, Jiahao, et al.
Publicado: (2025)
EnvScaler: Scaling Tool-Interactive Environments for LLM Agent via Programmatic Synthesis
por: Song, Xiaoshuai, et al.
Publicado: (2026)
por: Song, Xiaoshuai, et al.
Publicado: (2026)
ClinEnv: An Interactive Multi-Stage Long Horizon EHR Environment for Agents
por: Lu, Yuxing, et al.
Publicado: (2026)
por: Lu, Yuxing, et al.
Publicado: (2026)
TreeBoN: Enhancing Inference-Time Alignment with Speculative Tree-Search and Best-of-N Sampling
por: Qiu, Jiahao, et al.
Publicado: (2024)
por: Qiu, Jiahao, et al.
Publicado: (2024)
Physics Supernova: AI Agent Matches Elite Gold Medalists at IPhO 2025
por: Qiu, Jiahao, et al.
Publicado: (2025)
por: Qiu, Jiahao, et al.
Publicado: (2025)
ReasonFlux-PRM: Trajectory-Aware PRMs for Long Chain-of-Thought Reasoning in LLMs
por: Zou, Jiaru, et al.
Publicado: (2025)
por: Zou, Jiaru, et al.
Publicado: (2025)
EnvFactory: Scaling Tool-Use Agents via Executable Environments Synthesis and Robust RL
por: Xu, Minrui, et al.
Publicado: (2026)
por: Xu, Minrui, et al.
Publicado: (2026)
ClawEnvKit: Automatic Environment Generation for Claw-Like Agents
por: Li, Xirui, et al.
Publicado: (2026)
por: Li, Xirui, et al.
Publicado: (2026)
DataEnvGym: Data Generation Agents in Teacher Environments with Student Feedback
por: Khan, Zaid, et al.
Publicado: (2024)
por: Khan, Zaid, et al.
Publicado: (2024)
EnvGS: Modeling View-Dependent Appearance with Environment Gaussian
por: Xie, Tao, et al.
Publicado: (2024)
por: Xie, Tao, et al.
Publicado: (2024)
ScaleEnv: Scaling Environment Synthesis from Scratch for Generalist Interactive Tool-Use Agent Training
por: Tu, Dunwei, et al.
Publicado: (2026)
por: Tu, Dunwei, et al.
Publicado: (2026)
A Review of Prominent Paradigms for LLM-Based Agents: Tool Use (Including RAG), Planning, and Feedback Learning
por: Li, Xinzhe
Publicado: (2024)
por: Li, Xinzhe
Publicado: (2024)
EnvBench: A Benchmark for Automated Environment Setup
por: Eliseeva, Aleksandra, et al.
Publicado: (2025)
por: Eliseeva, Aleksandra, et al.
Publicado: (2025)
SEAL: Synergistic Co-Evolution of Agents and Learning Environments
por: Hu, Yihao, et al.
Publicado: (2026)
por: Hu, Yihao, et al.
Publicado: (2026)
EnvPoser: Environment-aware Realistic Human Motion Estimation from Sparse Observations with Uncertainty Modeling
por: Xia, Songpengcheng, et al.
Publicado: (2024)
por: Xia, Songpengcheng, et al.
Publicado: (2024)
Fed-SE: Federated Self-Evolution for Privacy-Constrained Multi-Environment LLM Agents
por: Chen, Xiang, et al.
Publicado: (2025)
por: Chen, Xiang, et al.
Publicado: (2025)
Next-Gen CAPTCHAs: Leveraging the Cognitive Gap for Scalable and Diverse GUI-Agent Defense
por: Liu, Jiacheng, et al.
Publicado: (2026)
por: Liu, Jiacheng, et al.
Publicado: (2026)
ShuttleEnv: An Interactive Data-Driven RL Environment for Badminton Strategy Modeling
por: Li, Ang, et al.
Publicado: (2026)
por: Li, Ang, et al.
Publicado: (2026)
Mobile-Env: Building Qualified Evaluation Benchmarks for LLM-GUI Interaction
por: Zhang, Danyang, et al.
Publicado: (2023)
por: Zhang, Danyang, et al.
Publicado: (2023)
SortingEnv: An Extendable RL-Environment for an Industrial Sorting Process
por: Maus, Tom, et al.
Publicado: (2025)
por: Maus, Tom, et al.
Publicado: (2025)
daVinci-Env: Open SWE Environment Synthesis at Scale
por: Fu, Dayuan, et al.
Publicado: (2026)
por: Fu, Dayuan, et al.
Publicado: (2026)
When Does Memory Help Multi-Trajectory Inference for Tool-Use LLM Agents?
por: Li, Xinzhe, et al.
Publicado: (2026)
por: Li, Xinzhe, et al.
Publicado: (2026)
Ejemplares similares
-
Co-Evolving LLM Coder and Unit Tester via Reinforcement Learning
por: Wang, Yinjie, et al.
Publicado: (2025) -
Temporal Consistency for LLM Reasoning Process Error Identification
por: Guo, Jiacheng, et al.
Publicado: (2025) -
RLAnything: Forge Environment, Policy, and Reward Model in Completely Dynamic RL System
por: Wang, Yinjie, et al.
Publicado: (2026) -
Shallow Preference Signals: Large Language Model Aligns Even Better with Truncated Data?
por: Qi, Xuan, et al.
Publicado: (2025) -
ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization
por: Wang, Yinjie, et al.
Publicado: (2025)