SE-Agent: Self-Evolution Trajectory Optimization in Multi-Step Reasoning with LLM-Based Agents
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lin, Jiaye, Guo, Yifu, Han, Yuzhen, Hu, Sen, Ni, Ziyi, Wang, Licheng, Chen, Mingguang, Liu, Hongzhang, Chen, Ronghao, He, Yangfan, Jiang, Daxin, Jiao, Binxing, Hu, Chen, Wang, Huacan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GitTaskBench: A Benchmark for Code Agents Solving Real-World Tasks Through Code Repository Leveraging
par: Ni, Ziyi, et autres
Publié: (2025)
par: Ni, Ziyi, et autres
Publié: (2025)
Octopus: Agentic Multimodal Reasoning with Six-Capability Orchestration
par: Guo, Yifu, et autres
Publié: (2025)
par: Guo, Yifu, et autres
Publié: (2025)
RepoMaster: Autonomous Exploration and Understanding of GitHub Repositories for Complex Task Solving
par: Wang, Huacan, et autres
Publié: (2025)
par: Wang, Huacan, et autres
Publié: (2025)
Random Policy Valuation is Enough for LLM Reasoning with Verifiable Rewards
par: He, Haoran, et autres
Publié: (2025)
par: He, Haoran, et autres
Publié: (2025)
SkillGenBench: Benchmarking Skill Generation Pipelines for LLM Agents
par: Zhou, Yifan, et autres
Publié: (2026)
par: Zhou, Yifan, et autres
Publié: (2026)
SMH-Bench: Benchmarking LLM Agents for Environment-Grounded Reasoning and Action in Smart Homes
par: Li, Kuan, et autres
Publié: (2026)
par: Li, Kuan, et autres
Publié: (2026)
Rethinking Token Pruning for Historical Screenshots in GUI Visual Agents: Semantic, Spatial, and Temporal Perspectives
par: Li, Daiqiang, et autres
Publié: (2026)
par: Li, Daiqiang, et autres
Publié: (2026)
Taint-Style Vulnerability Detection and Confirmation for Node.js Packages Using LLM Agent Reasoning
par: Ni, Ronghao, et autres
Publié: (2026)
par: Ni, Ronghao, et autres
Publié: (2026)
CloneMem: Benchmarking Long-Term Memory for AI Clones
par: Hu, Sen, et autres
Publié: (2026)
par: Hu, Sen, et autres
Publié: (2026)
ShieldLearner: A New Paradigm for Jailbreak Attack Defense in LLMs
par: Ni, Ziyi, et autres
Publié: (2025)
par: Ni, Ziyi, et autres
Publié: (2025)
RealMem: Benchmarking LLMs in Real-World Memory-Driven Interaction
par: Bian, Haonan, et autres
Publié: (2026)
par: Bian, Haonan, et autres
Publié: (2026)
HomeFlow: A Data Flywheel for Smart Home Agent Training with Verifiable Simulation
par: Gu, Yi, et autres
Publié: (2026)
par: Gu, Yi, et autres
Publié: (2026)
Learning to Compress: Unlocking the Potential of Large Language Models for Text Representation
par: Zhang, Yeqin, et autres
Publié: (2025)
par: Zhang, Yeqin, et autres
Publié: (2025)
MemGovern: Enhancing Code Agents through Learning from Governed Human Experiences
par: Wang, Qihao, et autres
Publié: (2026)
par: Wang, Qihao, et autres
Publié: (2026)
Does Memory Need Graphs? A Unified Framework and Empirical Analysis for Long-Term Dialog Memory
par: Hu, Sen, et autres
Publié: (2026)
par: Hu, Sen, et autres
Publié: (2026)
Controlled Self-Evolution for Algorithmic Code Optimization
par: Hu, Tu, et autres
Publié: (2026)
par: Hu, Tu, et autres
Publié: (2026)
ALRPHFS: Adversarially Learned Risk Patterns with Hierarchical Fast \& Slow Reasoning for Robust Agent Defense
par: Xiang, Shiyu, et autres
Publié: (2025)
par: Xiang, Shiyu, et autres
Publié: (2025)
EpochX: Building the Infrastructure for an Emergent Agent Civilization
par: Wang, Huacan, et autres
Publié: (2026)
par: Wang, Huacan, et autres
Publié: (2026)
STeCa: Step-level Trajectory Calibration for LLM Agent Learning
par: Wang, Hanlin, et autres
Publié: (2025)
par: Wang, Hanlin, et autres
Publié: (2025)
Fed-SE: Federated Self-Evolution for Privacy-Constrained Multi-Environment LLM Agents
par: Chen, Xiang, et autres
Publié: (2025)
par: Chen, Xiang, et autres
Publié: (2025)
SemaClaw: A Step Towards General-Purpose Personal AI Agents through Harness Engineering
par: Zhu, Ningyan, et autres
Publié: (2026)
par: Zhu, Ningyan, et autres
Publié: (2026)
SMART: Scalable Multi-Agent Reasoning and Trajectory Planning in Dense Environments
par: Huang, Heye, et autres
Publié: (2025)
par: Huang, Heye, et autres
Publié: (2025)
Watermarking LLM Agent Trajectories
par: Meng, Wenlong, et autres
Publié: (2026)
par: Meng, Wenlong, et autres
Publié: (2026)
EvoFSM: Controllable Self-Evolution for Deep Research with Finite State Machines
par: Zhang, Shuo, et autres
Publié: (2026)
par: Zhang, Shuo, et autres
Publié: (2026)
KnowMe-Bench: Benchmarking Person Understanding for Lifelong Digital Companions
par: Wu, Tingyu, et autres
Publié: (2026)
par: Wu, Tingyu, et autres
Publié: (2026)
SpotAgent: Grounding Visual Geo-localization in Large Vision-Language Models through Agentic Reasoning
par: Jia, Furong, et autres
Publié: (2026)
par: Jia, Furong, et autres
Publié: (2026)
Unified Context Evolution for LLM Agents
par: Zhu, Zixuan, et autres
Publié: (2026)
par: Zhu, Zixuan, et autres
Publié: (2026)
UIPress: Bringing Optical Token Compression to UI-to-Code Generation
par: Dai, Dasen, et autres
Publié: (2026)
par: Dai, Dasen, et autres
Publié: (2026)
VaaWIT: Visual-Aware Adaptation of Large Language Models for Multilingual Web Image Translation
par: Li, Bo, et autres
Publié: (2026)
par: Li, Bo, et autres
Publié: (2026)
AUITestAgent: Automatic Requirements Oriented GUI Function Testing
par: Hu, Yongxiang, et autres
Publié: (2024)
par: Hu, Yongxiang, et autres
Publié: (2024)
SheetAgent: Towards A Generalist Agent for Spreadsheet Reasoning and Manipulation via Large Language Models
par: Chen, Yibin, et autres
Publié: (2024)
par: Chen, Yibin, et autres
Publié: (2024)
Understanding Individual Agent Importance in Multi-Agent System via Counterfactual Reasoning
par: Chen, Jianming, et autres
Publié: (2024)
par: Chen, Jianming, et autres
Publié: (2024)
CoEvolve: Training LLM Agents via Agent-Data Mutual Evolution
par: Yang, Shidong, et autres
Publié: (2026)
par: Yang, Shidong, et autres
Publié: (2026)
AsyncVoice Agent: Real-Time Explanation for LLM Planning and Reasoning
par: Lin, Yueqian, et autres
Publié: (2025)
par: Lin, Yueqian, et autres
Publié: (2025)
TravelEval: A Comprehensive Benchmarking Framework for Evaluating LLM-Powered Travel Planning Agents
par: Chen, Weiyi, et autres
Publié: (2026)
par: Chen, Weiyi, et autres
Publié: (2026)
TacoMAS: Test-Time Co-Evolution of Topology and Capability in LLM-based Multi-Agent Systems
par: Xu, Chen, et autres
Publié: (2026)
par: Xu, Chen, et autres
Publié: (2026)
SAGE: Multi-Agent Self-Evolution for LLM Reasoning
par: Peng, Yulin, et autres
Publié: (2026)
par: Peng, Yulin, et autres
Publié: (2026)
Attention Mechanism for LLM-based Agents Dynamic Diffusion under Information Asymmetry
par: Zhang, Yiwen, et autres
Publié: (2025)
par: Zhang, Yiwen, et autres
Publié: (2025)
Graph-Augmented Reasoning: Evolving Step-by-Step Knowledge Graph Retrieval for LLM Reasoning
par: Wu, Wenjie, et autres
Publié: (2025)
par: Wu, Wenjie, et autres
Publié: (2025)
Watching, Reasoning, and Searching: A Video Deep Research Benchmark on Open Web for Agentic Video Reasoning
par: Liu, Chengwen, et autres
Publié: (2026)
par: Liu, Chengwen, et autres
Publié: (2026)
Documents similaires
-
GitTaskBench: A Benchmark for Code Agents Solving Real-World Tasks Through Code Repository Leveraging
par: Ni, Ziyi, et autres
Publié: (2025) -
Octopus: Agentic Multimodal Reasoning with Six-Capability Orchestration
par: Guo, Yifu, et autres
Publié: (2025) -
RepoMaster: Autonomous Exploration and Understanding of GitHub Repositories for Complex Task Solving
par: Wang, Huacan, et autres
Publié: (2025) -
Random Policy Valuation is Enough for LLM Reasoning with Verifiable Rewards
par: He, Haoran, et autres
Publié: (2025) -
SkillGenBench: Benchmarking Skill Generation Pipelines for LLM Agents
par: Zhou, Yifan, et autres
Publié: (2026)