OpenR: An Open Source Framework for Advanced Reasoning with Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Jun, Fang, Meng, Wan, Ziyu, Wen, Muning, Zhu, Jiachen, Liu, Anjie, Gong, Ziqin, Song, Yan, Chen, Lei, Ni, Lionel M., Yang, Linyi, Wen, Ying, Zhang, Weinan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reinforcing Language Agents via Policy Optimization with Action Decomposition
di: Wen, Muning, et al.
Pubblicazione: (2024)
di: Wen, Muning, et al.
Pubblicazione: (2024)
Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training
di: Feng, Xidong, et al.
Pubblicazione: (2023)
di: Feng, Xidong, et al.
Pubblicazione: (2023)
MARFT: Multi-Agent Reinforcement Fine-Tuning
di: Liao, Junwei, et al.
Pubblicazione: (2025)
di: Liao, Junwei, et al.
Pubblicazione: (2025)
Entropy-Regularized Token-Level Policy Optimization for Language Agent Reinforcement
di: Wen, Muning, et al.
Pubblicazione: (2024)
di: Wen, Muning, et al.
Pubblicazione: (2024)
Position: Agentic AI System Is a Foreseeable Pathway to AGI
di: Liao, Junwei, et al.
Pubblicazione: (2026)
di: Liao, Junwei, et al.
Pubblicazione: (2026)
ThinkBench: Dynamic Out-of-Distribution Evaluation for Robust LLM Reasoning
di: Huang, Shulin, et al.
Pubblicazione: (2025)
di: Huang, Shulin, et al.
Pubblicazione: (2025)
Autonomous Goal Detection and Cessation in Reinforcement Learning: A Case Study on Source Term Estimation
di: Shi, Yiwei, et al.
Pubblicazione: (2024)
di: Shi, Yiwei, et al.
Pubblicazione: (2024)
ReMA: Learning to Meta-think for LLMs with Multi-Agent Reinforcement Learning
di: Wan, Ziyu, et al.
Pubblicazione: (2025)
di: Wan, Ziyu, et al.
Pubblicazione: (2025)
P3: A Policy-Driven, Pace-Adaptive, and Diversity-Promoted Framework for data pruning in LLM Training
di: Yang, Yingxuan, et al.
Pubblicazione: (2024)
di: Yang, Yingxuan, et al.
Pubblicazione: (2024)
The Perceptual Bandwidth Bottleneck in Vision-Language Models: Active Visual Reasoning via Sequential Experimental Design
di: Liu, Anjie, et al.
Pubblicazione: (2026)
di: Liu, Anjie, et al.
Pubblicazione: (2026)
Understanding Agent Scaling in LLM-Based Multi-Agent Systems via Diversity
di: Yang, Yingxuan, et al.
Pubblicazione: (2026)
di: Yang, Yingxuan, et al.
Pubblicazione: (2026)
The Impact of Generative AI on Collaborative Open-Source Software Development: Evidence from GitHub Copilot
di: Song, Fangchen, et al.
Pubblicazione: (2024)
di: Song, Fangchen, et al.
Pubblicazione: (2024)
Advanced Vulnerability Scanning for Open Source Software: Detection and Mitigation of Log4j Vulnerabilities
di: Wen, Victor, et al.
Pubblicazione: (2026)
di: Wen, Victor, et al.
Pubblicazione: (2026)
OpenS2S: Advancing Fully Open-Source End-to-End Empathetic Large Speech Language Model
di: Wang, Chen, et al.
Pubblicazione: (2025)
di: Wang, Chen, et al.
Pubblicazione: (2025)
Retrieval-Augmented Process Reward Model for Generalizable Mathematical Reasoning
di: Zhu, Jiachen, et al.
Pubblicazione: (2025)
di: Zhu, Jiachen, et al.
Pubblicazione: (2025)
TRAD: Enhancing LLM Agents with Step-Wise Thought Retrieval and Aligned Decision
di: Zhou, Ruiwen, et al.
Pubblicazione: (2024)
di: Zhou, Ruiwen, et al.
Pubblicazione: (2024)
Open Sourcing GPTs: Economics of Open Sourcing Advanced AI Models
di: Habibi, Mahyar
Pubblicazione: (2025)
di: Habibi, Mahyar
Pubblicazione: (2025)
Language Games as the Pathway to Artificial Superhuman Intelligence
di: Wen, Ying, et al.
Pubblicazione: (2025)
di: Wen, Ying, et al.
Pubblicazione: (2025)
OpenPRC: A Unified Open-Source Framework for Physics-to-Task Evaluation in Physical Reservoir Computing
di: Phalak, Yogesh, et al.
Pubblicazione: (2026)
di: Phalak, Yogesh, et al.
Pubblicazione: (2026)
PARL-MT: Learning to Call Functions in Multi-Turn Conversation with Progress Awareness
di: Chai, Huacan, et al.
Pubblicazione: (2025)
di: Chai, Huacan, et al.
Pubblicazione: (2025)
Multilingual Mathematical Reasoning: Advancing Open-Source LLMs in Hindi and English
di: Anand, Avinash, et al.
Pubblicazione: (2024)
di: Anand, Avinash, et al.
Pubblicazione: (2024)
Causal Sufficiency and Necessity Improves Chain-of-Thought Reasoning
di: Yu, Xiangning, et al.
Pubblicazione: (2025)
di: Yu, Xiangning, et al.
Pubblicazione: (2025)
SIREN: An Open Source Neutrino Injection Toolkit
di: Schneider, Austin, et al.
Pubblicazione: (2024)
di: Schneider, Austin, et al.
Pubblicazione: (2024)
OpenTab: Advancing Large Language Models as Open-domain Table Reasoners
di: Kong, Kezhi, et al.
Pubblicazione: (2024)
di: Kong, Kezhi, et al.
Pubblicazione: (2024)
OpenLS-DGF: An Adaptive Open-Source Dataset Generation Framework for Machine Learning Tasks in Logic Synthesis
di: Ni, Liwei, et al.
Pubblicazione: (2024)
di: Ni, Liwei, et al.
Pubblicazione: (2024)
Looking Ahead to Avoid Being Late: Solving Hard-Constrained Traveling Salesman Problem
di: Chen, Jingxiao, et al.
Pubblicazione: (2024)
di: Chen, Jingxiao, et al.
Pubblicazione: (2024)
The EEPAS Model Revisited: Statistical Formalism and a High-Performance, Reproducible Open-Source Framework
di: Chung, Szu-Chi, et al.
Pubblicazione: (2025)
di: Chung, Szu-Chi, et al.
Pubblicazione: (2025)
Hippocrates: An Open-Source Framework for Advancing Large Language Models in Healthcare
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2024)
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2024)
Advancing Speech Quality Assessment Through Scientific Challenges and Open-source Activities
di: Huang, Wen-Chin
Pubblicazione: (2025)
di: Huang, Wen-Chin
Pubblicazione: (2025)
VLA-Arena: An Open-Source Framework for Benchmarking Vision-Language-Action Models
di: Zhang, Borong, et al.
Pubblicazione: (2025)
di: Zhang, Borong, et al.
Pubblicazione: (2025)
LintLLM: An Open-Source Verilog Linting Framework Based on Large Language Models
di: Fang, Zhigang, et al.
Pubblicazione: (2025)
di: Fang, Zhigang, et al.
Pubblicazione: (2025)
Agent Exchange: Shaping the Future of AI Agent Economics
di: Yang, Yingxuan, et al.
Pubblicazione: (2025)
di: Yang, Yingxuan, et al.
Pubblicazione: (2025)
OpenThaiGPT 1.6 and R1: Thai-Centric Open Source and Reasoning Large Language Models
di: Yuenyong, Sumeth, et al.
Pubblicazione: (2025)
di: Yuenyong, Sumeth, et al.
Pubblicazione: (2025)
Illustrious: an Open Advanced Illustration Model
di: Park, Sang Hyun, et al.
Pubblicazione: (2024)
di: Park, Sang Hyun, et al.
Pubblicazione: (2024)
An Open-Source Framework for Measurement and Analysis of Nanoscale Ionic Transport
di: Wang, Yichao, et al.
Pubblicazione: (2026)
di: Wang, Yichao, et al.
Pubblicazione: (2026)
TART: An Open-Source Tool-Augmented Framework for Explainable Table-based Reasoning
di: Lu, Xinyuan, et al.
Pubblicazione: (2024)
di: Lu, Xinyuan, et al.
Pubblicazione: (2024)
Towards Cold-Start Drafting and Continual Refining: A Value-Driven Memory Approach with Application to NPU Kernel Synthesis
di: Zheng, Yujie, et al.
Pubblicazione: (2026)
di: Zheng, Yujie, et al.
Pubblicazione: (2026)
Sagalee: an Open Source Automatic Speech Recognition Dataset for Oromo Language
di: Abu, Turi, et al.
Pubblicazione: (2025)
di: Abu, Turi, et al.
Pubblicazione: (2025)
MobileUse: A GUI Agent with Hierarchical Reflection for Autonomous Mobile Operation
di: Li, Ning, et al.
Pubblicazione: (2025)
di: Li, Ning, et al.
Pubblicazione: (2025)
UniVid: The Open-Source Unified Video Model
di: Luo, Jiabin, et al.
Pubblicazione: (2025)
di: Luo, Jiabin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Reinforcing Language Agents via Policy Optimization with Action Decomposition
di: Wen, Muning, et al.
Pubblicazione: (2024) -
Alphazero-like Tree-Search can Guide Large Language Model Decoding and Training
di: Feng, Xidong, et al.
Pubblicazione: (2023) -
MARFT: Multi-Agent Reinforcement Fine-Tuning
di: Liao, Junwei, et al.
Pubblicazione: (2025) -
Entropy-Regularized Token-Level Policy Optimization for Language Agent Reinforcement
di: Wen, Muning, et al.
Pubblicazione: (2024) -
Position: Agentic AI System Is a Foreseeable Pathway to AGI
di: Liao, Junwei, et al.
Pubblicazione: (2026)