Agent-R1: A Unified and Modular Framework for Agentic Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Cheng, Mingyue, Yu, Shuo, Wang, Daoyu, Li, Qingchuan, Tao, Xiaoyu, Ouyang, Jie, Luo, Yucong, Zhou, Yitong, Liu, Qi, Chen, Enhong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
StepPO: Step-Aligned Policy Optimization for Agentic Reinforcement Learning
por: Wang, Daoyu, et al.
Publicado: (2026)
por: Wang, Daoyu, et al.
Publicado: (2026)
Revisiting the Solution of Meta KDD Cup 2024: CRAG
por: Ouyang, Jie, et al.
Publicado: (2024)
por: Ouyang, Jie, et al.
Publicado: (2024)
Multi-Source Knowledge Pruning for Retrieval-Augmented Generation: A Benchmark and Empirical Study
por: Yu, Shuo, et al.
Publicado: (2024)
por: Yu, Shuo, et al.
Publicado: (2024)
Time Series Forecasting as Reasoning: A Slow-Thinking Approach with Reinforced LLMs
por: Zhou, Yitong, et al.
Publicado: (2025)
por: Zhou, Yitong, et al.
Publicado: (2025)
TableMind++: An Uncertainty-Aware Programmatic Agent for Tool-Augmented Table Reasoning
por: Cheng, Mingyue, et al.
Publicado: (2026)
por: Cheng, Mingyue, et al.
Publicado: (2026)
Mind2Report: A Cognitive Deep Research Agent for Expert-Level Commercial Report Synthesis
por: Cheng, Mingyue, et al.
Publicado: (2026)
por: Cheng, Mingyue, et al.
Publicado: (2026)
A Survey on Knowledge-Oriented Retrieval-Augmented Generation
por: Cheng, Mingyue, et al.
Publicado: (2025)
por: Cheng, Mingyue, et al.
Publicado: (2025)
MemWeaver: A Hierarchical Memory from Textual Interactive Behaviors for Personalized Generation
por: Yu, Shuo, et al.
Publicado: (2025)
por: Yu, Shuo, et al.
Publicado: (2025)
From Hypothesis to Premises: LLM-based Backward Logical Reasoning with Selective Symbolic Translation
por: Li, Qingchuan, et al.
Publicado: (2025)
por: Li, Qingchuan, et al.
Publicado: (2025)
TextMatch: Enhancing Image-Text Consistency Through Multimodal Optimization
por: Luo, Yucong, et al.
Publicado: (2024)
por: Luo, Yucong, et al.
Publicado: (2024)
PaperScout: An Autonomous Agent for Academic Paper Search with Process-Aware Sequence-Level Policy Optimization
por: Pan, Tingyue, et al.
Publicado: (2026)
por: Pan, Tingyue, et al.
Publicado: (2026)
Benchmarking Multimodal LLMs on Recognition and Understanding over Chemical Tables
por: Zhou, Yitong, et al.
Publicado: (2025)
por: Zhou, Yitong, et al.
Publicado: (2025)
Can Slow-thinking LLMs Reason Over Time? Empirical Studies in Time Series Forecasting
por: Cheng, Mingyue, et al.
Publicado: (2025)
por: Cheng, Mingyue, et al.
Publicado: (2025)
GeoDecider: A Coarse-to-Fine Agentic Workflow for Explainable Lithology Classification
por: Wang, Jiahao, et al.
Publicado: (2026)
por: Wang, Jiahao, et al.
Publicado: (2026)
HoH: A Dynamic Benchmark for Evaluating the Impact of Outdated Information on Retrieval-Augmented Generation
por: Ouyang, Jie, et al.
Publicado: (2025)
por: Ouyang, Jie, et al.
Publicado: (2025)
Hierarchical Multimodal LLMs with Semantic Space Alignment for Enhanced Time Series Classification
por: Tao, Xiaoyu, et al.
Publicado: (2024)
por: Tao, Xiaoyu, et al.
Publicado: (2024)
TableTime: Reformulating Time Series Classification as Training-Free Table Understanding with Large Language Models
por: Wang, Jiahao, et al.
Publicado: (2024)
por: Wang, Jiahao, et al.
Publicado: (2024)
CoGenCast: A Coupled Autoregressive-Flow Generative Framework for Time Series Forecasting
por: Liu, Yaguo, et al.
Publicado: (2026)
por: Liu, Yaguo, et al.
Publicado: (2026)
STaR: Towards Effective and Stable Table Reasoning via Slow-Thinking Large Language Models
por: Zhang, Huajian, et al.
Publicado: (2025)
por: Zhang, Huajian, et al.
Publicado: (2025)
Position: Beyond Model-Centric Prediction -- Agentic Time Series Forecasting
por: Cheng, Mingyue, et al.
Publicado: (2026)
por: Cheng, Mingyue, et al.
Publicado: (2026)
CastFlow: Learning Role-Specialized Agentic Workflows for Time Series Forecasting
por: Pan, Bokai, et al.
Publicado: (2026)
por: Pan, Bokai, et al.
Publicado: (2026)
Conditional Denoising Meets Polynomial Modeling: A Flexible Decoupled Framework for Time Series Forecasting
por: Zhang, Jintao, et al.
Publicado: (2024)
por: Zhang, Jintao, et al.
Publicado: (2024)
PaperArena: An Evaluation Benchmark for Tool-Augmented Agentic Reasoning on Scientific Literature
por: Wang, Daoyu, et al.
Publicado: (2025)
por: Wang, Daoyu, et al.
Publicado: (2025)
Learning Recommender Systems with Soft Target: A Decoupled Perspective
por: Zhang, Hao, et al.
Publicado: (2024)
por: Zhang, Hao, et al.
Publicado: (2024)
Leveraging LLMs for Hypothetical Deduction in Logical Inference: A Neuro-Symbolic Approach
por: Li, Qingchuan, et al.
Publicado: (2024)
por: Li, Qingchuan, et al.
Publicado: (2024)
Are LLMs Stable Formal Logic Translators in Logical Reasoning Across Linguistically Diversified Texts?
por: Li, Qingchuan, et al.
Publicado: (2025)
por: Li, Qingchuan, et al.
Publicado: (2025)
OneCast: Structured Decomposition and Modular Generation for Cross-Domain Time Series Forecasting
por: Pan, Tingyue, et al.
Publicado: (2025)
por: Pan, Tingyue, et al.
Publicado: (2025)
BLADE: A Behavior-Level Data Augmentation Framework with Dual Fusion Modeling for Multi-Behavior Sequential Recommendation
por: Li, Yupeng, et al.
Publicado: (2025)
por: Li, Yupeng, et al.
Publicado: (2025)
StitchCUDA: An Automated Multi-Agents End-to-End GPU Programing Framework with Rubric-based Agentic Reinforcement Learning
por: Li, Shiyang, et al.
Publicado: (2026)
por: Li, Shiyang, et al.
Publicado: (2026)
EduNLP: Towards a Unified and Modularized Library for Educational Resources
por: Huang, Zhenya, et al.
Publicado: (2024)
por: Huang, Zhenya, et al.
Publicado: (2024)
MARAG-R1: Beyond Single Retriever via Reinforcement-Learned Multi-Tool Agentic Retrieval
por: Luo, Qi, et al.
Publicado: (2025)
por: Luo, Qi, et al.
Publicado: (2025)
Unlocking the Potential of Large Language Models for Explainable Recommendations
por: Luo, Yucong, et al.
Publicado: (2023)
por: Luo, Yucong, et al.
Publicado: (2023)
Graph-R1: Towards Agentic GraphRAG Framework via End-to-end Reinforcement Learning
por: Luo, Haoran, et al.
Publicado: (2025)
por: Luo, Haoran, et al.
Publicado: (2025)
TableMind: An Autonomous Programmatic Agent for Tool-Augmented Table Reasoning
por: Jiang, Chuang, et al.
Publicado: (2025)
por: Jiang, Chuang, et al.
Publicado: (2025)
TopoChunker: Topology-Aware Agentic Document Chunking Framework
por: Liu, Xiaoyu
Publicado: (2026)
por: Liu, Xiaoyu
Publicado: (2026)
MEDDxAgent: A Unified Modular Agent Framework for Explainable Automatic Differential Diagnosis
por: Rose, Daniel, et al.
Publicado: (2025)
por: Rose, Daniel, et al.
Publicado: (2025)
InstructTime++: Time Series Classification with Multimodal Language Modeling via Implicit Feature Enhancement
por: Cheng, Mingyue, et al.
Publicado: (2026)
por: Cheng, Mingyue, et al.
Publicado: (2026)
StraTA: Incentivizing Agentic Reinforcement Learning with Strategic Trajectory Abstraction
por: Xue, Xiangyuan, et al.
Publicado: (2026)
por: Xue, Xiangyuan, et al.
Publicado: (2026)
TimeDART: A Diffusion Autoregressive Transformer for Self-Supervised Time Series Representation
por: Wang, Daoyu, et al.
Publicado: (2024)
por: Wang, Daoyu, et al.
Publicado: (2024)
Demystifying Reinforcement Learning in Agentic Reasoning
por: Yu, Zhaochen, et al.
Publicado: (2025)
por: Yu, Zhaochen, et al.
Publicado: (2025)
Ejemplares similares
-
StepPO: Step-Aligned Policy Optimization for Agentic Reinforcement Learning
por: Wang, Daoyu, et al.
Publicado: (2026) -
Revisiting the Solution of Meta KDD Cup 2024: CRAG
por: Ouyang, Jie, et al.
Publicado: (2024) -
Multi-Source Knowledge Pruning for Retrieval-Augmented Generation: A Benchmark and Empirical Study
por: Yu, Shuo, et al.
Publicado: (2024) -
Time Series Forecasting as Reasoning: A Slow-Thinking Approach with Reinforced LLMs
por: Zhou, Yitong, et al.
Publicado: (2025) -
TableMind++: An Uncertainty-Aware Programmatic Agent for Tool-Augmented Table Reasoning
por: Cheng, Mingyue, et al.
Publicado: (2026)