R1-Code-Interpreter: LLMs Reason with Code via Supervised and Multi-stage Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Yongchao, Liu, Yueying, Zhou, Junwei, Hao, Yilun, Wang, Jingquan, Zhang, Yang, Li, Na, Fan, Chuchu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CodeSteer: Symbolic-Augmented Language Models via Code/Text Guidance
di: Chen, Yongchao, et al.
Pubblicazione: (2025)
di: Chen, Yongchao, et al.
Pubblicazione: (2025)
Simulation to Rules: A Dual-VLM Framework for Formal Visual Planning
di: Hao, Yilun, et al.
Pubblicazione: (2025)
di: Hao, Yilun, et al.
Pubblicazione: (2025)
AbstRaL: Augmenting LLMs' Reasoning by Reinforcing Abstract Thinking
di: Gao, Silin, et al.
Pubblicazione: (2025)
di: Gao, Silin, et al.
Pubblicazione: (2025)
Code-as-Symbolic-Planner: Foundation Model-Based Robot Planning via Symbolic Code Generation
di: Chen, Yongchao, et al.
Pubblicazione: (2025)
di: Chen, Yongchao, et al.
Pubblicazione: (2025)
ConceptGuard: Neuro-Symbolic Safety Guardrails via Sparse Interpretable Jailbreak Concepts
di: Aswal, Darpan, et al.
Pubblicazione: (2025)
di: Aswal, Darpan, et al.
Pubblicazione: (2025)
A Comparative Study of Neurosymbolic AI Approaches to Interpretable Logical Reasoning
di: Chen, Michael K.
Pubblicazione: (2025)
di: Chen, Michael K.
Pubblicazione: (2025)
Distilling Formal Logic into Neural Spaces: A Kernel Alignment Approach for Signal Temporal Logic
di: Candussio, Sara, et al.
Pubblicazione: (2026)
di: Candussio, Sara, et al.
Pubblicazione: (2026)
Evaluating Task-Oriented Dialogue Consistency through Constraint Satisfaction
di: Labruna, Tiziano, et al.
Pubblicazione: (2024)
di: Labruna, Tiziano, et al.
Pubblicazione: (2024)
Structural-Ambiguity-Aware Translation from Natural Language to Signal Temporal Logic
di: Fushimi, Kosei, et al.
Pubblicazione: (2026)
di: Fushimi, Kosei, et al.
Pubblicazione: (2026)
Verified Language Processing with Hybrid Explainability: A Technical Report
di: Fox, Oliver Robert, et al.
Pubblicazione: (2025)
di: Fox, Oliver Robert, et al.
Pubblicazione: (2025)
A Neuro-Symbolic Approach to Monitoring Salt Content in Food
di: Tayal, Anuja, et al.
Pubblicazione: (2024)
di: Tayal, Anuja, et al.
Pubblicazione: (2024)
LLMs as mirrors of societal moral standards: reflection of cultural divergence and agreement across ethical topics
di: Meijer, Mijntje, et al.
Pubblicazione: (2024)
di: Meijer, Mijntje, et al.
Pubblicazione: (2024)
Cognitive LLMs: Towards Integrating Cognitive Architectures and Large Language Models for Manufacturing Decision-making
di: Wu, Siyu, et al.
Pubblicazione: (2024)
di: Wu, Siyu, et al.
Pubblicazione: (2024)
Interpretable Concept Bottlenecks to Align Reinforcement Learning Agents
di: Delfosse, Quentin, et al.
Pubblicazione: (2024)
di: Delfosse, Quentin, et al.
Pubblicazione: (2024)
Library Learning Doesn't: The Curious Case of the Single-Use "Library"
di: Berlot-Attwell, Ian, et al.
Pubblicazione: (2024)
di: Berlot-Attwell, Ian, et al.
Pubblicazione: (2024)
Visual Set Program Synthesizer
di: Cheng, Zehua, et al.
Pubblicazione: (2026)
di: Cheng, Zehua, et al.
Pubblicazione: (2026)
Reconciling Explanations in Multi-Model Systems through Probabilistic Argumentation
di: Hong, Shengxin, et al.
Pubblicazione: (2024)
di: Hong, Shengxin, et al.
Pubblicazione: (2024)
Reasoning Abilities of Large Language Models: In-Depth Analysis on the Abstraction and Reasoning Corpus
di: Lee, Seungpil, et al.
Pubblicazione: (2024)
di: Lee, Seungpil, et al.
Pubblicazione: (2024)
Antiassociative algebra in R: introducing the evitaicossa package
di: Hankinn, Robin K. S.
Pubblicazione: (2024)
di: Hankinn, Robin K. S.
Pubblicazione: (2024)
Beyond Accuracy: Introducing a Symbolic-Mechanistic Approach to Interpretable Evaluation
di: Habibi, Reza, et al.
Pubblicazione: (2026)
di: Habibi, Reza, et al.
Pubblicazione: (2026)
Towards Semantics Lifting for Scientific Computing: A Case Study on FFT
di: Zhang, Naifeng, et al.
Pubblicazione: (2025)
di: Zhang, Naifeng, et al.
Pubblicazione: (2025)
Introducing Quantification into a Hierarchical Graph Rewriting Language
di: Mishina, Haruto, et al.
Pubblicazione: (2024)
di: Mishina, Haruto, et al.
Pubblicazione: (2024)
A Flow Extension to Coroutine Types for Deadlock Detection in Go
di: Gu, Qiqi Jason, et al.
Pubblicazione: (2026)
di: Gu, Qiqi Jason, et al.
Pubblicazione: (2026)
Strided Difference Bound Matrices
di: Pitchanathan, Arjun, et al.
Pubblicazione: (2024)
di: Pitchanathan, Arjun, et al.
Pubblicazione: (2024)
Faster List Decoding of AG Codes
di: Beelen, Peter, et al.
Pubblicazione: (2023)
di: Beelen, Peter, et al.
Pubblicazione: (2023)
Symbolic Equation Solving via Reinforcement Learning
di: Dabelow, Lennart, et al.
Pubblicazione: (2024)
di: Dabelow, Lennart, et al.
Pubblicazione: (2024)
Case Frames and Case-Based Arguments in Statutory Interpretation
di: Araszkiewicz, Michal
Pubblicazione: (2024)
di: Araszkiewicz, Michal
Pubblicazione: (2024)
Symbolic-Neural Soft-Logic Reasoning: Towards Robust and Verifiable Thinking Chains via Cooperative Evolution
di: Wang, Rui, et al.
Pubblicazione: (2026)
di: Wang, Rui, et al.
Pubblicazione: (2026)
CoMAT: Chain of Mathematically Annotated Thought Improves Mathematical Reasoning
di: Leang, Joshua Ong Jun, et al.
Pubblicazione: (2024)
di: Leang, Joshua Ong Jun, et al.
Pubblicazione: (2024)
Enhancing Zero-Shot Chain-of-Thought Reasoning in Large Language Models through Logic
di: Zhao, Xufeng, et al.
Pubblicazione: (2023)
di: Zhao, Xufeng, et al.
Pubblicazione: (2023)
Towards Automated Functional Equation Proving: A Benchmark Dataset and A Domain-Specific In-Context Agent
di: Buali, Mahdi, et al.
Pubblicazione: (2024)
di: Buali, Mahdi, et al.
Pubblicazione: (2024)
Large Language Models as Mirrors of Societal Moral Standards
di: Papadopoulou, Evi, et al.
Pubblicazione: (2024)
di: Papadopoulou, Evi, et al.
Pubblicazione: (2024)
E-Gen: Leveraging E-Graphs to Improve Continuous Representations of Symbolic Expressions
di: Zheng, Hongbo, et al.
Pubblicazione: (2025)
di: Zheng, Hongbo, et al.
Pubblicazione: (2025)
Quantum Knowledge Graph: Modeling Context-Dependent Triplet Validity
di: Wang, Yao, et al.
Pubblicazione: (2026)
di: Wang, Yao, et al.
Pubblicazione: (2026)
GOFAI meets Generative AI: Development of Expert Systems by means of Large Language Models
di: Garrido-Merchán, Eduardo C., et al.
Pubblicazione: (2025)
di: Garrido-Merchán, Eduardo C., et al.
Pubblicazione: (2025)
Neuro-Symbolic Frameworks: Conceptual Characterization and Empirical Comparative Analysis
di: Sinha, Sania, et al.
Pubblicazione: (2025)
di: Sinha, Sania, et al.
Pubblicazione: (2025)
Speaking in Words, Thinking in Logic: A Dual-Process Framework in QA Systems
di: Bui, Tuan, et al.
Pubblicazione: (2025)
di: Bui, Tuan, et al.
Pubblicazione: (2025)
ASyMOB: Algebraic Symbolic Mathematical Operations Benchmark
di: Shalyt, Michael, et al.
Pubblicazione: (2025)
di: Shalyt, Michael, et al.
Pubblicazione: (2025)
ONSEP: A Novel Online Neural-Symbolic Framework for Event Prediction Based on Large Language Model
di: Yu, Xuanqing, et al.
Pubblicazione: (2024)
di: Yu, Xuanqing, et al.
Pubblicazione: (2024)
Clifford algebra in R
di: Hankin, Robin K. S.
Pubblicazione: (2022)
di: Hankin, Robin K. S.
Pubblicazione: (2022)
Documenti analoghi
-
CodeSteer: Symbolic-Augmented Language Models via Code/Text Guidance
di: Chen, Yongchao, et al.
Pubblicazione: (2025) -
Simulation to Rules: A Dual-VLM Framework for Formal Visual Planning
di: Hao, Yilun, et al.
Pubblicazione: (2025) -
AbstRaL: Augmenting LLMs' Reasoning by Reinforcing Abstract Thinking
di: Gao, Silin, et al.
Pubblicazione: (2025) -
Code-as-Symbolic-Planner: Foundation Model-Based Robot Planning via Symbolic Code Generation
di: Chen, Yongchao, et al.
Pubblicazione: (2025) -
ConceptGuard: Neuro-Symbolic Safety Guardrails via Sparse Interpretable Jailbreak Concepts
di: Aswal, Darpan, et al.
Pubblicazione: (2025)