PRIME: Policy-Reinforced Iterative Multi-agent Execution for Algorithmic Reasoning in Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Xu, Jiawei, Yu, Zhenyu, Bi, Ziqian, Pham, Minh Duc, Qu, Xiaoyi, Zhang, Danyang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Language Models as Compilers: Simulating Pseudocode Execution Improves Algorithmic Reasoning in Language Models
von: Chae, Hyungjoo, et al.
Veröffentlicht: (2024)
von: Chae, Hyungjoo, et al.
Veröffentlicht: (2024)
Unilaw-R1: A Large Language Model for Legal Reasoning with Reinforcement Learning and Iterative Inference
von: Cai, Hua, et al.
Veröffentlicht: (2025)
von: Cai, Hua, et al.
Veröffentlicht: (2025)
PRIME: Planning and Retrieval-Integrated Memory for Enhanced Reasoning
von: Tran, Hieu, et al.
Veröffentlicht: (2025)
von: Tran, Hieu, et al.
Veröffentlicht: (2025)
Scaling Reasoning, Losing Control: Evaluating Instruction Following in Large Reasoning Models
von: Fu, Tingchen, et al.
Veröffentlicht: (2025)
von: Fu, Tingchen, et al.
Veröffentlicht: (2025)
PRIME: Large Language Model Personalization with Cognitive Dual-Memory and Personalized Thought Process
von: Zhang, Xinliang Frederick, et al.
Veröffentlicht: (2025)
von: Zhang, Xinliang Frederick, et al.
Veröffentlicht: (2025)
PIP: Perturbation-based Iterative Pruning for Large Language Models
von: Cao, Yi, et al.
Veröffentlicht: (2025)
von: Cao, Yi, et al.
Veröffentlicht: (2025)
NExT: Teaching Large Language Models to Reason about Code Execution
von: Ni, Ansong, et al.
Veröffentlicht: (2024)
von: Ni, Ansong, et al.
Veröffentlicht: (2024)
Executing Natural Language-Described Algorithms with Large Language Models: An Investigation
von: Zheng, Xin, et al.
Veröffentlicht: (2024)
von: Zheng, Xin, et al.
Veröffentlicht: (2024)
DEBATE, TRAIN, EVOLVE: Self Evolution of Language Model Reasoning
von: Srivastava, Gaurav, et al.
Veröffentlicht: (2025)
von: Srivastava, Gaurav, et al.
Veröffentlicht: (2025)
Enhancing Legal Document Retrieval: A Multi-Phase Approach with Large Language Models
von: Nguyen, Hai-Long, et al.
Veröffentlicht: (2024)
von: Nguyen, Hai-Long, et al.
Veröffentlicht: (2024)
Steering Large Language Models between Code Execution and Textual Reasoning
von: Chen, Yongchao, et al.
Veröffentlicht: (2024)
von: Chen, Yongchao, et al.
Veröffentlicht: (2024)
PRIME: A Process-Outcome Alignment Benchmark for Verifiable Reasoning in Mathematics and Engineering
von: Wang, Xiangfeng, et al.
Veröffentlicht: (2026)
von: Wang, Xiangfeng, et al.
Veröffentlicht: (2026)
Towards Large Reasoning Models: A Survey of Reinforced Reasoning with Large Language Models
von: Xu, Fengli, et al.
Veröffentlicht: (2025)
von: Xu, Fengli, et al.
Veröffentlicht: (2025)
Route-and-Reason: Scaling Large Language Model Reasoning with Reinforced Model Router
von: Shao, Chenyang, et al.
Veröffentlicht: (2025)
von: Shao, Chenyang, et al.
Veröffentlicht: (2025)
Using Large Language Models for education managements in Vietnamese with low resources
von: Minh, Duc Do, et al.
Veröffentlicht: (2025)
von: Minh, Duc Do, et al.
Veröffentlicht: (2025)
Multi3Hate: Multimodal, Multilingual, and Multicultural Hate Speech Detection with Vision-Language Models
von: Bui, Minh Duc, et al.
Veröffentlicht: (2024)
von: Bui, Minh Duc, et al.
Veröffentlicht: (2024)
Search-on-Graph: Iterative Informed Navigation for Large Language Model Reasoning on Knowledge Graphs
von: Sun, Jia Ao, et al.
Veröffentlicht: (2025)
von: Sun, Jia Ao, et al.
Veröffentlicht: (2025)
CANDLE: Iterative Conceptualization and Instantiation Distillation from Large Language Models for Commonsense Reasoning
von: Wang, Weiqi, et al.
Veröffentlicht: (2024)
von: Wang, Weiqi, et al.
Veröffentlicht: (2024)
Multi-agent KTO: Reinforcing Strategic Interactions of Large Language Model in Language Game
von: Ye, Rong, et al.
Veröffentlicht: (2025)
von: Ye, Rong, et al.
Veröffentlicht: (2025)
Towards Comprehensive Vietnamese Retrieval-Augmented Generation and Large Language Models
von: Duc, Nguyen Quang, et al.
Veröffentlicht: (2024)
von: Duc, Nguyen Quang, et al.
Veröffentlicht: (2024)
Large Language Models Discriminate Against Speakers of German Dialects
von: Bui, Minh Duc, et al.
Veröffentlicht: (2025)
von: Bui, Minh Duc, et al.
Veröffentlicht: (2025)
MERaLiON-TextLLM: Cross-Lingual Understanding of Large Language Models in Chinese, Indonesian, Malay, and Singlish
von: Huang, Xin, et al.
Veröffentlicht: (2024)
von: Huang, Xin, et al.
Veröffentlicht: (2024)
Off-Policy Value-Based Reinforcement Learning for Large Language Models
von: Wang, Peng-Yuan, et al.
Veröffentlicht: (2026)
von: Wang, Peng-Yuan, et al.
Veröffentlicht: (2026)
Meenz bleibt Meenz, but Large Language Models Do Not Speak Its Dialect
von: Bui, Minh Duc, et al.
Veröffentlicht: (2026)
von: Bui, Minh Duc, et al.
Veröffentlicht: (2026)
COMMUNITY-CROSS-INSTRUCT: Unsupervised Instruction Generation for Aligning Large Language Models to Online Communities
von: He, Zihao, et al.
Veröffentlicht: (2024)
von: He, Zihao, et al.
Veröffentlicht: (2024)
Chain of Execution Supervision Promotes General Reasoning in Large Language Models
von: Chen, Nuo, et al.
Veröffentlicht: (2025)
von: Chen, Nuo, et al.
Veröffentlicht: (2025)
Improving and Assessing the Fidelity of Large Language Models Alignment to Online Communities
von: Chu, Minh Duc, et al.
Veröffentlicht: (2024)
von: Chu, Minh Duc, et al.
Veröffentlicht: (2024)
SynAdapt: Learning Adaptive Reasoning in Large Language Models via Synthetic Continuous Chain-of-Thought
von: Wang, Jianwei, et al.
Veröffentlicht: (2025)
von: Wang, Jianwei, et al.
Veröffentlicht: (2025)
Bridging the Reasoning Gap in Vietnamese with Small Language Models via Test-Time Scaling
von: Trung, Bui The, et al.
Veröffentlicht: (2026)
von: Trung, Bui The, et al.
Veröffentlicht: (2026)
Harmony in Diversity: Multi-domain Contrastive Policy Optimization for Large Reasoning Models
von: Yu, Zongji, et al.
Veröffentlicht: (2026)
von: Yu, Zongji, et al.
Veröffentlicht: (2026)
Beyond Token-Level Policy Gradients for Complex Reasoning with Large Language Models
von: Xu, Mufan, et al.
Veröffentlicht: (2026)
von: Xu, Mufan, et al.
Veröffentlicht: (2026)
Joint Action Language Modelling for Transparent Policy Execution
von: Wulff, Theodor, et al.
Veröffentlicht: (2025)
von: Wulff, Theodor, et al.
Veröffentlicht: (2025)
Iterative Structured Pruning for Large Language Models with Multi-Domain Calibration
von: Wu, Guangxin, et al.
Veröffentlicht: (2026)
von: Wu, Guangxin, et al.
Veröffentlicht: (2026)
AI for Biomedicine in the Era of Large Language Models
von: Bi, Zhenyu, et al.
Veröffentlicht: (2024)
von: Bi, Zhenyu, et al.
Veröffentlicht: (2024)
Is GPT-OSS All You Need? Benchmarking Large Language Models for Financial Intelligence and the Surprising Efficiency Paradox
von: Bi, Ziqian, et al.
Veröffentlicht: (2025)
von: Bi, Ziqian, et al.
Veröffentlicht: (2025)
AdaReasoner: Dynamic Tool Orchestration for Iterative Visual Reasoning
von: Song, Mingyang, et al.
Veröffentlicht: (2026)
von: Song, Mingyang, et al.
Veröffentlicht: (2026)
SEAL: Steerable Reasoning Calibration of Large Language Models for Free
von: Chen, Runjin, et al.
Veröffentlicht: (2025)
von: Chen, Runjin, et al.
Veröffentlicht: (2025)
Graph Chain-of-Thought: Augmenting Large Language Models by Reasoning on Graphs
von: Jin, Bowen, et al.
Veröffentlicht: (2024)
von: Jin, Bowen, et al.
Veröffentlicht: (2024)
Affective Multimodal Agents with Proactive Knowledge Grounding for Emotionally Aligned Marketing Dialogue
von: Yu, Lin, et al.
Veröffentlicht: (2025)
von: Yu, Lin, et al.
Veröffentlicht: (2025)
Large Language Model Powered Symbolic Execution
von: Li, Yihe, et al.
Veröffentlicht: (2025)
von: Li, Yihe, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Language Models as Compilers: Simulating Pseudocode Execution Improves Algorithmic Reasoning in Language Models
von: Chae, Hyungjoo, et al.
Veröffentlicht: (2024) -
Unilaw-R1: A Large Language Model for Legal Reasoning with Reinforcement Learning and Iterative Inference
von: Cai, Hua, et al.
Veröffentlicht: (2025) -
PRIME: Planning and Retrieval-Integrated Memory for Enhanced Reasoning
von: Tran, Hieu, et al.
Veröffentlicht: (2025) -
Scaling Reasoning, Losing Control: Evaluating Instruction Following in Large Reasoning Models
von: Fu, Tingchen, et al.
Veröffentlicht: (2025) -
PRIME: Large Language Model Personalization with Cognitive Dual-Memory and Personalized Thought Process
von: Zhang, Xinliang Frederick, et al.
Veröffentlicht: (2025)