Salvato in:
| Autori principali: | Chen, Yixing, Wang, Yiding, Zhu, Siqi, Yu, Haofei, Feng, Tao, Zhang, Muhan, Patwary, Mostofa, You, Jiaxuan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2510.23595 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ConsistencyChecker: Tree-based Evaluation of LLM Generalization Capabilities
di: Hong, Zhaochen, et al.
Pubblicazione: (2025)
di: Hong, Zhaochen, et al.
Pubblicazione: (2025)
Table as Thought: Exploring Structured Thoughts in LLM Reasoning
di: Sun, Zhenjie, et al.
Pubblicazione: (2025)
di: Sun, Zhenjie, et al.
Pubblicazione: (2025)
Beyond Facts: Evaluating Intent Hallucination in Large Language Models
di: Hao, Yijie, et al.
Pubblicazione: (2025)
di: Hao, Yijie, et al.
Pubblicazione: (2025)
SafeScientist: Toward Risk-Aware Scientific Discoveries by LLM Agents
di: Zhu, Kunlun, et al.
Pubblicazione: (2025)
di: Zhu, Kunlun, et al.
Pubblicazione: (2025)
Beyond Outcome Reward: Decoupling Search and Answering Improves LLM Agents
di: Wang, Yiding, et al.
Pubblicazione: (2025)
di: Wang, Yiding, et al.
Pubblicazione: (2025)
OpenTinker: Separating Concerns in Agentic Reinforcement Learning
di: Zhu, Siqi, et al.
Pubblicazione: (2026)
di: Zhu, Siqi, et al.
Pubblicazione: (2026)
LiveTradeBench: Seeking Real-World Alpha with Large Language Models
di: Yu, Haofei, et al.
Pubblicazione: (2025)
di: Yu, Haofei, et al.
Pubblicazione: (2025)
GraphRouter: A Graph-based Router for LLM Selections
di: Feng, Tao, et al.
Pubblicazione: (2024)
di: Feng, Tao, et al.
Pubblicazione: (2024)
Law in Silico: Simulating Legal Society with LLM-Based Agents
di: Wang, Yiding, et al.
Pubblicazione: (2025)
di: Wang, Yiding, et al.
Pubblicazione: (2025)
SocialVeil: Probing Social Intelligence of Language Agents under Communication Barriers
di: Xuan, Keyang, et al.
Pubblicazione: (2026)
di: Xuan, Keyang, et al.
Pubblicazione: (2026)
Maximize Your Data's Potential: Enhancing LLM Accuracy with Two-Phase Pretraining
di: Feng, Steven, et al.
Pubblicazione: (2024)
di: Feng, Steven, et al.
Pubblicazione: (2024)
In-Context Learning May Not Elicit Trustworthy Reasoning: A-Not-B Errors in Pretrained Language Models
di: Han, Pengrui, et al.
Pubblicazione: (2024)
di: Han, Pengrui, et al.
Pubblicazione: (2024)
Relational In-Context Learning via Synthetic Pre-training with Structural Prior
di: Wang, Yanbo, et al.
Pubblicazione: (2026)
di: Wang, Yanbo, et al.
Pubblicazione: (2026)
FusionFactory: Fusing LLM Capabilities with Multi-LLM Log Data
di: Feng, Tao, et al.
Pubblicazione: (2025)
di: Feng, Tao, et al.
Pubblicazione: (2025)
EvolveR: Self-Evolving LLM Agents through an Experience-Driven Lifecycle
di: Wu, Rong, et al.
Pubblicazione: (2025)
di: Wu, Rong, et al.
Pubblicazione: (2025)
Time-R1: Towards Comprehensive Temporal Reasoning in LLMs
di: Liu, Zijia, et al.
Pubblicazione: (2025)
di: Liu, Zijia, et al.
Pubblicazione: (2025)
Knowledge is Not Enough: Injecting RL Skills for Continual Adaptation
di: Tang, Pingzhi, et al.
Pubblicazione: (2026)
di: Tang, Pingzhi, et al.
Pubblicazione: (2026)
Router-R1: Teaching LLMs Multi-Round Routing and Aggregation via Reinforcement Learning
di: Zhang, Haozhen, et al.
Pubblicazione: (2025)
di: Zhang, Haozhen, et al.
Pubblicazione: (2025)
MorphAgent: Empowering Agents through Self-Evolving Profiles and Decentralized Collaboration
di: Lu, Siyuan, et al.
Pubblicazione: (2024)
di: Lu, Siyuan, et al.
Pubblicazione: (2024)
AcademicEval: Live Long-Context LLM Benchmark
di: Zhang, Haozhen, et al.
Pubblicazione: (2025)
di: Zhang, Haozhen, et al.
Pubblicazione: (2025)
GTAlign: Game-Theoretic Alignment of LLM Assistants for Social Welfare
di: Zhu, Siqi, et al.
Pubblicazione: (2025)
di: Zhu, Siqi, et al.
Pubblicazione: (2025)
From Self-Evolving Synthetic Data to Verifiable-Reward RL: Post-Training Multi-turn Interactive Tool-Using Agents
di: Gao, Jiaxuan, et al.
Pubblicazione: (2026)
di: Gao, Jiaxuan, et al.
Pubblicazione: (2026)
Which LLM Multi-Agent Protocol to Choose?
di: Du, Hongyi, et al.
Pubblicazione: (2025)
di: Du, Hongyi, et al.
Pubblicazione: (2025)
CoEvoSkills: Self-Evolving Agent Skills via Co-Evolutionary Verification
di: Zhang, Hanrong, et al.
Pubblicazione: (2026)
di: Zhang, Hanrong, et al.
Pubblicazione: (2026)
Agents of Change: Self-Evolving LLM Agents for Strategic Planning
di: Belle, Nikolas, et al.
Pubblicazione: (2025)
di: Belle, Nikolas, et al.
Pubblicazione: (2025)
Self-Evolving Multi-Agent Collaboration Networks for Software Development
di: Hu, Yue, et al.
Pubblicazione: (2024)
di: Hu, Yue, et al.
Pubblicazione: (2024)
MemSkill: Learning and Evolving Memory Skills for Self-Evolving Agents
di: Zhang, Haozhen, et al.
Pubblicazione: (2026)
di: Zhang, Haozhen, et al.
Pubblicazione: (2026)
EvoLM: Self-Evolving Language Models through Co-Evolved Discriminative Rubrics
di: Li, Shuyue Stella, et al.
Pubblicazione: (2026)
di: Li, Shuyue Stella, et al.
Pubblicazione: (2026)
Graph of Records: Boosting Retrieval Augmented Generation for Long-context Summarization with Graphs
di: Zhang, Haozhen, et al.
Pubblicazione: (2024)
di: Zhang, Haozhen, et al.
Pubblicazione: (2024)
AgentDevel: Reframing Self-Evolving LLM Agents as Release Engineering
di: Zhang, Di
Pubblicazione: (2026)
di: Zhang, Di
Pubblicazione: (2026)
Nemotron-CC-Math: A 133 Billion-Token-Scale High Quality Math Pretraining Dataset
di: Mahabadi, Rabeeh Karimi, et al.
Pubblicazione: (2025)
di: Mahabadi, Rabeeh Karimi, et al.
Pubblicazione: (2025)
Evolve as a Team: Collaborative Self-Evolution for LLM-based Multi-Agent Systems
di: Hao, Zhezheng, et al.
Pubblicazione: (2026)
di: Hao, Zhezheng, et al.
Pubblicazione: (2026)
Dive into the Agent Matrix: A Realistic Evaluation of Self-Replication Risk in LLM Agents
di: Zhang, Boxuan, et al.
Pubblicazione: (2025)
di: Zhang, Boxuan, et al.
Pubblicazione: (2025)
MDTeamGPT: A Self-Evolving LLM-based Multi-Agent Framework for Multi-Disciplinary Team Medical Consultation
di: Chen, Kai, et al.
Pubblicazione: (2025)
di: Chen, Kai, et al.
Pubblicazione: (2025)
Ratchet: A Minimal Hygiene Recipe for Self-Evolving LLM Agents
di: Zhang, Xing, et al.
Pubblicazione: (2026)
di: Zhang, Xing, et al.
Pubblicazione: (2026)
Learning to Evolve: A Self-Improving Framework for Multi-Agent Systems via Textual Parameter Graph Optimization
di: He, Shan, et al.
Pubblicazione: (2026)
di: He, Shan, et al.
Pubblicazione: (2026)
OpsAgent: An Evolving Multi-agent System for Incident Management in Microservices
di: Luo, Yu, et al.
Pubblicazione: (2025)
di: Luo, Yu, et al.
Pubblicazione: (2025)
COMAP: Co-Evolving World Models and Agent Policies for LLM Agents
di: Liu, Youwei, et al.
Pubblicazione: (2026)
di: Liu, Youwei, et al.
Pubblicazione: (2026)
Do Self-Evolving Agents Forget? Capability Degradation and Preservation in Lifelong LLM Agent Adaptation
di: Yu, Ye, et al.
Pubblicazione: (2026)
di: Yu, Ye, et al.
Pubblicazione: (2026)
Front-Loading Reasoning: The Synergy between Pretraining and Post-Training Data
di: Akter, Syeda Nahida, et al.
Pubblicazione: (2025)
di: Akter, Syeda Nahida, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ConsistencyChecker: Tree-based Evaluation of LLM Generalization Capabilities
di: Hong, Zhaochen, et al.
Pubblicazione: (2025) -
Table as Thought: Exploring Structured Thoughts in LLM Reasoning
di: Sun, Zhenjie, et al.
Pubblicazione: (2025) -
Beyond Facts: Evaluating Intent Hallucination in Large Language Models
di: Hao, Yijie, et al.
Pubblicazione: (2025) -
SafeScientist: Toward Risk-Aware Scientific Discoveries by LLM Agents
di: Zhu, Kunlun, et al.
Pubblicazione: (2025) -
Beyond Outcome Reward: Decoupling Search and Answering Improves LLM Agents
di: Wang, Yiding, et al.
Pubblicazione: (2025)