Real-Time Reasoning Agents in Evolving Environments
Fuente:
arXiv
Guardado en:
| Autores principales: | Wen, Yule, Ye, Yixin, Zhang, Yanzhe, Yang, Diyi, Zhu, Hao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Contextualized Privacy Defense for LLM Agents
por: Wen, Yule, et al.
Publicado: (2026)
por: Wen, Yule, et al.
Publicado: (2026)
Searching for Privacy Risks in LLM Agents via Simulation
por: Zhang, Yanzhe, et al.
Publicado: (2025)
por: Zhang, Yanzhe, et al.
Publicado: (2025)
Sketch2Code: Evaluating Vision-Language Models for Interactive Web Design Prototyping
por: Li, Ryan, et al.
Publicado: (2024)
por: Li, Ryan, et al.
Publicado: (2024)
A Dynamic LLM-Powered Agent Network for Task-Oriented Agent Collaboration
por: Liu, Zijun, et al.
Publicado: (2023)
por: Liu, Zijun, et al.
Publicado: (2023)
DECEPTICON: How Dark Patterns Manipulate Web Agents
por: Cuvin, Phil, et al.
Publicado: (2025)
por: Cuvin, Phil, et al.
Publicado: (2025)
Agent-World: Scaling Real-World Environment Synthesis for Evolving General Agent Intelligence
por: Dong, Guanting, et al.
Publicado: (2026)
por: Dong, Guanting, et al.
Publicado: (2026)
Auditing Gender Presentation Differences in Text-to-Image Models
por: Zhang, Yanzhe, et al.
Publicado: (2023)
por: Zhang, Yanzhe, et al.
Publicado: (2023)
Generative Interfaces for Language Models
por: Chen, Jiaqi, et al.
Publicado: (2025)
por: Chen, Jiaqi, et al.
Publicado: (2025)
Distilling an End-to-End Voice Assistant Without Instruction Training Data
por: Held, William, et al.
Publicado: (2024)
por: Held, William, et al.
Publicado: (2024)
EgoNormia: Benchmarking Physical Social Norm Understanding
por: Rezaei, MohammadHossein, et al.
Publicado: (2025)
por: Rezaei, MohammadHossein, et al.
Publicado: (2025)
AutoMetrics: Approximate Human Judgements with Automatically Generated Evaluators
por: Ryan, Michael J., et al.
Publicado: (2025)
por: Ryan, Michael J., et al.
Publicado: (2025)
AgentPSO: Evolving Agent Reasoning Skill via Multi-agent Particle Swarm Optimization
por: Hwang, Hyunmin, et al.
Publicado: (2026)
por: Hwang, Hyunmin, et al.
Publicado: (2026)
TS-Reasoner: Domain-Oriented Time Series Inference Agents for Reasoning and Automated Analysis
por: Ye, Wen, et al.
Publicado: (2024)
por: Ye, Wen, et al.
Publicado: (2024)
SimWorld Studio: Automatic Environment Generation with Evolving Coding Agent for Embodied Agent Learning
por: Kang, Haoqiang, et al.
Publicado: (2026)
por: Kang, Haoqiang, et al.
Publicado: (2026)
Evolving in Tasks: Empowering the Multi-modality Large Language Model as the Computer Use Agent
por: Cheng, Yuhao, et al.
Publicado: (2025)
por: Cheng, Yuhao, et al.
Publicado: (2025)
CureAgent: A Training-Free Executor-Analyst Framework for Clinical Reasoning
por: Xie, Ting-Ting, et al.
Publicado: (2025)
por: Xie, Ting-Ting, et al.
Publicado: (2025)
ANDES: Agent Native Data Evolving Synthesis Tool for Autonomous Instruction Alignment
por: Zhao, Zhengyang, et al.
Publicado: (2026)
por: Zhao, Zhengyang, et al.
Publicado: (2026)
Learning to Build the Environment: Self-Evolving Reasoning RL via Verifiable Environment Synthesis
por: Shi, Yucheng, et al.
Publicado: (2026)
por: Shi, Yucheng, et al.
Publicado: (2026)
Genesis: Evolving Attack Strategies for LLM Web Agent Red-Teaming
por: Zhang, Zheng, et al.
Publicado: (2025)
por: Zhang, Zheng, et al.
Publicado: (2025)
SWE-smith: Scaling Data for Software Engineering Agents
por: Yang, John, et al.
Publicado: (2025)
por: Yang, John, et al.
Publicado: (2025)
SWE-chat: Coding Agent Interactions From Real Users in the Wild
por: Baumann, Joachim, et al.
Publicado: (2026)
por: Baumann, Joachim, et al.
Publicado: (2026)
AEL: Agent Evolving Learning for Open-Ended Environments
por: Xu, Wujiang, et al.
Publicado: (2026)
por: Xu, Wujiang, et al.
Publicado: (2026)
EmbodiSkill: Skill-Aware Reflection for Self-Evolving Embodied Agents
por: Ju, Ruofei, et al.
Publicado: (2026)
por: Ju, Ruofei, et al.
Publicado: (2026)
How Well Does Agent Development Reflect Real-World Work?
por: Wang, Zora Zhiruo, et al.
Publicado: (2026)
por: Wang, Zora Zhiruo, et al.
Publicado: (2026)
ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory
por: Ouyang, Siru, et al.
Publicado: (2025)
por: Ouyang, Siru, et al.
Publicado: (2025)
SCALER:Synthetic Scalable Adaptive Learning Environment for Reasoning
por: Xu, Caijun, et al.
Publicado: (2026)
por: Xu, Caijun, et al.
Publicado: (2026)
Heterogeneous Adversarial Play in Interactive Environments
por: Xu, Manjie, et al.
Publicado: (2025)
por: Xu, Manjie, et al.
Publicado: (2025)
AgentGym: Evolving Large Language Model-based Agents across Diverse Environments
por: Xi, Zhiheng, et al.
Publicado: (2024)
por: Xi, Zhiheng, et al.
Publicado: (2024)
Autogenesis: A Self-Evolving Agent Protocol
por: Zhang, Wentao, et al.
Publicado: (2026)
por: Zhang, Wentao, et al.
Publicado: (2026)
COMPASS: Enhancing Agent Long-Horizon Reasoning with Evolving Context
por: Wan, Guangya, et al.
Publicado: (2025)
por: Wan, Guangya, et al.
Publicado: (2025)
AutoLibra: Agent Metric Induction from Open-Ended Human Feedback
por: Zhu, Hao, et al.
Publicado: (2025)
por: Zhu, Hao, et al.
Publicado: (2025)
CODESKILL: Learning Self-Evolving Skills for Coding Agents
por: Li, Yanzhou, et al.
Publicado: (2026)
por: Li, Yanzhou, et al.
Publicado: (2026)
AQUAH: Automatic Quantification and Unified Agent in Hydrology
por: Yan, Songkun, et al.
Publicado: (2025)
por: Yan, Songkun, et al.
Publicado: (2025)
EvolveR: Self-Evolving LLM Agents through an Experience-Driven Lifecycle
por: Wu, Rong, et al.
Publicado: (2025)
por: Wu, Rong, et al.
Publicado: (2025)
MultiMind: Enhancing Werewolf Agents with Multimodal Reasoning and Theory of Mind
por: Zhang, Zheng, et al.
Publicado: (2025)
por: Zhang, Zheng, et al.
Publicado: (2025)
AppAgentX: Evolving GUI Agents as Proficient Smartphone Users
por: Jiang, Wenjia, et al.
Publicado: (2025)
por: Jiang, Wenjia, et al.
Publicado: (2025)
Claw-Eval-Live: A Live Agent Benchmark for Evolving Real-World Workflows
por: Li, Chenxin, et al.
Publicado: (2026)
por: Li, Chenxin, et al.
Publicado: (2026)
EvolvR: Self-Evolving Pairwise Reasoning for Story Evaluation to Enhance Generation
por: Wang, Xinda, et al.
Publicado: (2025)
por: Wang, Xinda, et al.
Publicado: (2025)
Multi-Stream Cellular Test-Time Adaptation of Real-Time Models Evolving in Dynamic Environments
por: Gérin, Benoît, et al.
Publicado: (2024)
por: Gérin, Benoît, et al.
Publicado: (2024)
TheraAgent: Multi-Agent Framework with Self-Evolving Memory and Evidence-Calibrated Reasoning for PET Theranostics
por: Chen, Zhihao, et al.
Publicado: (2026)
por: Chen, Zhihao, et al.
Publicado: (2026)
Ejemplares similares
-
Contextualized Privacy Defense for LLM Agents
por: Wen, Yule, et al.
Publicado: (2026) -
Searching for Privacy Risks in LLM Agents via Simulation
por: Zhang, Yanzhe, et al.
Publicado: (2025) -
Sketch2Code: Evaluating Vision-Language Models for Interactive Web Design Prototyping
por: Li, Ryan, et al.
Publicado: (2024) -
A Dynamic LLM-Powered Agent Network for Task-Oriented Agent Collaboration
por: Liu, Zijun, et al.
Publicado: (2023) -
DECEPTICON: How Dark Patterns Manipulate Web Agents
por: Cuvin, Phil, et al.
Publicado: (2025)