SE-Search: Self-Evolving Search Agent via Memory and Dense Reward
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Jian, Jin, Yizhang, Liu, Dongqi, Ding, Hang, Wu, Jiafu, Chen, Dongsheng, Shen, Yunhang, Qin, Yulei, Tai, Ying, Wang, Chengjie, Yuan, Xiaotong, Wang, Yabiao |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Improving Search Agent with One Line of Code
par: Li, Jian, et autres
Publié: (2026)
par: Li, Jian, et autres
Publié: (2026)
RoleRMBench & RoleRM: Towards Reward Modeling for Profile-Based Role Play in Dialogue Systems
par: Ding, Hang, et autres
Publié: (2025)
par: Ding, Hang, et autres
Publié: (2025)
EvolveSearch: An Iterative Self-Evolving Search Agent
par: Zhang, Dingchu, et autres
Publié: (2025)
par: Zhang, Dingchu, et autres
Publié: (2025)
AdaMARP: An Adaptive Multi-Agent Interaction Framework for General Immersive Role-Playing
par: Xu, Zhenhua, et autres
Publié: (2026)
par: Xu, Zhenhua, et autres
Publié: (2026)
Disco-RAG: Discourse-Aware Retrieval-Augmented Generation
par: Liu, Dongqi, et autres
Publié: (2026)
par: Liu, Dongqi, et autres
Publié: (2026)
PVG: Progressive Vision Graph for Vision Recognition
par: Wu, Jiafu, et autres
Publié: (2023)
par: Wu, Jiafu, et autres
Publié: (2023)
PiT: Progressive Diffusion Transformer
par: Wu, Jiafu, et autres
Publié: (2025)
par: Wu, Jiafu, et autres
Publié: (2025)
A Survey on Benchmarks of Multimodal Large Language Models
par: Li, Jian, et autres
Publié: (2024)
par: Li, Jian, et autres
Publié: (2024)
AutoMaAS: Self-Evolving Multi-Agent Architecture Search for Large Language Models
par: Ma, Bo, et autres
Publié: (2025)
par: Ma, Bo, et autres
Publié: (2025)
Dr. Zero: Self-Evolving Search Agents without Training Data
par: Yue, Zhenrui, et autres
Publié: (2026)
par: Yue, Zhenrui, et autres
Publié: (2026)
AtlasVA: Self-Evolving Visual Skill Memory for Teacher-Free VLM Agents
par: Wang, Pan, et autres
Publié: (2026)
par: Wang, Pan, et autres
Publié: (2026)
Retrieval, Reward, and Training Protocols: What Matters in Training Search Agents?
par: Zhao, Yibo, et autres
Publié: (2026)
par: Zhao, Yibo, et autres
Publié: (2026)
Evolving Skill-Structured Attack Memory Enhances LLM Jailbreaking
par: Zhang, Junke, et autres
Publié: (2026)
par: Zhang, Junke, et autres
Publié: (2026)
LLaVA-VSD: Large Language-and-Vision Assistant for Visual Spatial Description
par: Jin, Yizhang, et autres
Publié: (2024)
par: Jin, Yizhang, et autres
Publié: (2024)
ReSeek: A Self-Correcting Framework for Search Agents with Instructive Rewards
par: Li, Shiyu, et autres
Publié: (2025)
par: Li, Shiyu, et autres
Publié: (2025)
EXG: Self-Evolving Agents with Experience Graphs
par: Jin, Yuxin, et autres
Publié: (2026)
par: Jin, Yuxin, et autres
Publié: (2026)
YOLO-NAS-Bench: A Surrogate Benchmark with Self-Evolving Predictors for YOLO Architecture Search
par: Li, Zhe, et autres
Publié: (2026)
par: Li, Zhe, et autres
Publié: (2026)
Knowledge-Graph Paths as Intermediate Supervision for Self-Evolving Search Agents
par: Wu, Huyu, et autres
Publié: (2026)
par: Wu, Huyu, et autres
Publié: (2026)
MemSkill: Learning and Evolving Memory Skills for Self-Evolving Agents
par: Zhang, Haozhen, et autres
Publié: (2026)
par: Zhang, Haozhen, et autres
Publié: (2026)
EvolveMem:Self-Evolving Memory Architecture via AutoResearch for LLM Agents
par: Liu, Jiaqi, et autres
Publié: (2026)
par: Liu, Jiaqi, et autres
Publié: (2026)
SELAUR: Self Evolving LLM Agent via Uncertainty-aware Rewards
par: Zhang, Dengjia, et autres
Publié: (2026)
par: Zhang, Dengjia, et autres
Publié: (2026)
SmartSearch: Process Reward-Guided Query Refinement for Search Agents
par: Wen, Tongyu, et autres
Publié: (2026)
par: Wen, Tongyu, et autres
Publié: (2026)
AdapNet: Adaptive Noise-Based Network for Low-Quality Image Retrieval
par: Zhang, Sihe, et autres
Publié: (2024)
par: Zhang, Sihe, et autres
Publié: (2024)
SwiftVideo: A Unified Framework for Few-Step Video Generation through Trajectory-Distribution Alignment
par: Sun, Yanxiao, et autres
Publié: (2025)
par: Sun, Yanxiao, et autres
Publié: (2025)
Dynamic Mixture of Latent Memories for Self-Evolving Agents
par: Yu, Dianzhi, et autres
Publié: (2026)
par: Yu, Dianzhi, et autres
Publié: (2026)
SE-GA: Memory-Augmented Self-Evolution for GUI Agents
par: Jin, Shilong, et autres
Publié: (2026)
par: Jin, Shilong, et autres
Publié: (2026)
Beyond Outcome Reward: Decoupling Search and Answering Improves LLM Agents
par: Wang, Yiding, et autres
Publié: (2025)
par: Wang, Yiding, et autres
Publié: (2025)
How to Train Your Deep Research Agent? Prompt, Reward, and Policy Optimization in Search-R1
par: Xu, Yinuo, et autres
Publié: (2026)
par: Xu, Yinuo, et autres
Publié: (2026)
Self-Evolved Reward Learning for LLMs
par: Huang, Chenghua, et autres
Publié: (2024)
par: Huang, Chenghua, et autres
Publié: (2024)
MDT-A2G: Exploring Masked Diffusion Transformers for Co-Speech Gesture Generation
par: Mao, Xiaofeng, et autres
Publié: (2024)
par: Mao, Xiaofeng, et autres
Publié: (2024)
FactorMiner: A Self-Evolving Agent with Skills and Experience Memory for Financial Alpha Discovery
par: Wang, Yanlong, et autres
Publié: (2026)
par: Wang, Yanlong, et autres
Publié: (2026)
MARRS: Masked Autoregressive Unit-based Reaction Synthesis
par: Wang, Yabiao, et autres
Publié: (2025)
par: Wang, Yabiao, et autres
Publié: (2025)
Evo-Memory: Benchmarking LLM Agent Test-time Learning with Self-Evolving Memory
par: Wei, Tianxin, et autres
Publié: (2025)
par: Wei, Tianxin, et autres
Publié: (2025)
Cycle-Consistent Search: Question Reconstructability as a Proxy Reward for Search Agent Training
par: An, Sohyun, et autres
Publié: (2026)
par: An, Sohyun, et autres
Publié: (2026)
PARMESAN: Parameter-Free Memory Search and Transduction for Dense Prediction Tasks
par: Winter, Philip Matthias, et autres
Publié: (2024)
par: Winter, Philip Matthias, et autres
Publié: (2024)
MambaGesture: Enhancing Co-Speech Gesture Generation with Mamba and Disentangled Multi-Modality Fusion
par: Fu, Chencan, et autres
Publié: (2024)
par: Fu, Chencan, et autres
Publié: (2024)
ReasoningBank: Scaling Agent Self-Evolving with Reasoning Memory
par: Ouyang, Siru, et autres
Publié: (2025)
par: Ouyang, Siru, et autres
Publié: (2025)
What Makes a Good Diffusion Planner for Decision Making?
par: Lu, Haofei, et autres
Publié: (2025)
par: Lu, Haofei, et autres
Publié: (2025)
SEDM: Scalable Self-Evolving Distributed Memory for Agents
par: Xu, Haoran, et autres
Publié: (2025)
par: Xu, Haoran, et autres
Publié: (2025)
LiveBrowseComp: Are Search Agents Searching, or Just Verifying What They Already Know?
par: Fan, HuiMing, et autres
Publié: (2026)
par: Fan, HuiMing, et autres
Publié: (2026)
Documents similaires
-
Improving Search Agent with One Line of Code
par: Li, Jian, et autres
Publié: (2026) -
RoleRMBench & RoleRM: Towards Reward Modeling for Profile-Based Role Play in Dialogue Systems
par: Ding, Hang, et autres
Publié: (2025) -
EvolveSearch: An Iterative Self-Evolving Search Agent
par: Zhang, Dingchu, et autres
Publié: (2025) -
AdaMARP: An Adaptive Multi-Agent Interaction Framework for General Immersive Role-Playing
par: Xu, Zhenhua, et autres
Publié: (2026) -
Disco-RAG: Discourse-Aware Retrieval-Augmented Generation
par: Liu, Dongqi, et autres
Publié: (2026)