LoopRPT: Reinforcement Pre-Training for Looped Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Tang, Guo, Jiang, Shixin, Chang, Heng, Chen, Nuo, Li, Yuhan, Fan, Huiming, Li, Jia, Liu, Ming, Qin, Bing |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
GraphWiz: An Instruction-Following Language Model for Graph Problems
von: Chen, Nuo, et al.
Veröffentlicht: (2024)
von: Chen, Nuo, et al.
Veröffentlicht: (2024)
GraphArena: Evaluating and Exploring Large Language Models on Graph Computation
von: Tang, Jianheng, et al.
Veröffentlicht: (2024)
von: Tang, Jianheng, et al.
Veröffentlicht: (2024)
GCoder: Improving Large Language Model for Generalized Graph Problem Solving
von: Zhang, Qifan, et al.
Veröffentlicht: (2024)
von: Zhang, Qifan, et al.
Veröffentlicht: (2024)
LoopSCC: Towards Summarizing Multi-branch Loops within Determinate Cycles
von: Zhu, Kai, et al.
Veröffentlicht: (2024)
von: Zhu, Kai, et al.
Veröffentlicht: (2024)
How does Misinformation Affect Large Language Model Behaviors and Preferences?
von: Peng, Miao, et al.
Veröffentlicht: (2025)
von: Peng, Miao, et al.
Veröffentlicht: (2025)
Reinforcement Pre-Training
von: Dong, Qingxiu, et al.
Veröffentlicht: (2025)
von: Dong, Qingxiu, et al.
Veröffentlicht: (2025)
LingoLoop Attack: Trapping MLLMs via Linguistic Context and State Entrapment into Endless Loops
von: Fu, Jiyuan, et al.
Veröffentlicht: (2025)
von: Fu, Jiyuan, et al.
Veröffentlicht: (2025)
Scaling Latent Reasoning via Looped Language Models
von: Zhu, Rui-Jie, et al.
Veröffentlicht: (2025)
von: Zhu, Rui-Jie, et al.
Veröffentlicht: (2025)
SpecLoop: An Agentic RTL-to-Specification Framework with Formal Verification Feedback Loop
von: Chang, Fu-Chieh, et al.
Veröffentlicht: (2026)
von: Chang, Fu-Chieh, et al.
Veröffentlicht: (2026)
Semantic-Augmented Latent Topic Modeling with LLM-in-the-Loop
von: Hong, Mengze, et al.
Veröffentlicht: (2025)
von: Hong, Mengze, et al.
Veröffentlicht: (2025)
Breaking Language Barriers: Cross-Lingual Continual Pre-Training at Scale
von: Zheng, Wenzhen, et al.
Veröffentlicht: (2024)
von: Zheng, Wenzhen, et al.
Veröffentlicht: (2024)
G-Refer: Graph Retrieval-Augmented Large Language Model for Explainable Recommendation
von: Li, Yuhan, et al.
Veröffentlicht: (2025)
von: Li, Yuhan, et al.
Veröffentlicht: (2025)
Synthetic Pre-Pre-Training Improves Language Model Robustness to Noisy Pre-Training Data
von: Guo, Xu, et al.
Veröffentlicht: (2026)
von: Guo, Xu, et al.
Veröffentlicht: (2026)
Self-Critique Guided Iterative Reasoning for Multi-hop Question Answering
von: Chu, Zheng, et al.
Veröffentlicht: (2025)
von: Chu, Zheng, et al.
Veröffentlicht: (2025)
Human-in-the-Loop Generation of Adversarial Texts: A Case Study on Tibetan Script
von: Cao, Xi, et al.
Veröffentlicht: (2024)
von: Cao, Xi, et al.
Veröffentlicht: (2024)
The Oscars of AI Theater: A Survey on Role-Playing with Language Models
von: Chen, Nuo, et al.
Veröffentlicht: (2024)
von: Chen, Nuo, et al.
Veröffentlicht: (2024)
From Specific-MLLMs to Omni-MLLMs: A Survey on MLLMs Aligned with Multi-modalities
von: Jiang, Shixin, et al.
Veröffentlicht: (2024)
von: Jiang, Shixin, et al.
Veröffentlicht: (2024)
ControlMath: Controllable Data Generation Promotes Math Generalist Models
von: Chen, Nuo, et al.
Veröffentlicht: (2024)
von: Chen, Nuo, et al.
Veröffentlicht: (2024)
Neural Topic Modeling with Large Language Models in the Loop
von: Yang, Xiaohao, et al.
Veröffentlicht: (2024)
von: Yang, Xiaohao, et al.
Veröffentlicht: (2024)
LLM-based Automated Grading with Human-in-the-Loop
von: Chu, Yucheng, et al.
Veröffentlicht: (2025)
von: Chu, Yucheng, et al.
Veröffentlicht: (2025)
Structure-aware Fine-tuning for Code Pre-trained Models
von: Wu, Jiayi, et al.
Veröffentlicht: (2024)
von: Wu, Jiayi, et al.
Veröffentlicht: (2024)
Large Language Models can Contrastively Refine their Generation for Better Sentence Representation Learning
von: Wang, Huiming, et al.
Veröffentlicht: (2023)
von: Wang, Huiming, et al.
Veröffentlicht: (2023)
LoopTool: Closing the Data-Training Loop for Robust LLM Tool Calls
von: Zhang, Kangning, et al.
Veröffentlicht: (2025)
von: Zhang, Kangning, et al.
Veröffentlicht: (2025)
CHBench: A Chinese Dataset for Evaluating Health in Large Language Models
von: Guo, Chenlu, et al.
Veröffentlicht: (2024)
von: Guo, Chenlu, et al.
Veröffentlicht: (2024)
Memory-Efficient Looped Transformer: Decoupling Compute from Memory in Looped Language Models
von: Vendrell, Victor Conchello, et al.
Veröffentlicht: (2026)
von: Vendrell, Victor Conchello, et al.
Veröffentlicht: (2026)
LLM-R2: A Large Language Model Enhanced Rule-based Rewrite System for Boosting Query Efficiency
von: Li, Zhaodonghui, et al.
Veröffentlicht: (2024)
von: Li, Zhaodonghui, et al.
Veröffentlicht: (2024)
iPrOp: Interactive Prompt Optimization for Large Language Models with a Human in the Loop
von: Li, Jiahui, et al.
Veröffentlicht: (2024)
von: Li, Jiahui, et al.
Veröffentlicht: (2024)
Loop as a Bridge: Can Looped Transformers Truly Link Representation Space and Natural Language Outputs?
von: Chen, Guanxu, et al.
Veröffentlicht: (2026)
von: Chen, Guanxu, et al.
Veröffentlicht: (2026)
Generalized Category Discovery with Large Language Models in the Loop
von: An, Wenbin, et al.
Veröffentlicht: (2023)
von: An, Wenbin, et al.
Veröffentlicht: (2023)
Enhancing Automated Loop Invariant Generation for Complex Programs with Large Language Models
von: Liu, Ruibang, et al.
Veröffentlicht: (2024)
von: Liu, Ruibang, et al.
Veröffentlicht: (2024)
EditScribe: Non-Visual Image Editing with Natural Language Verification Loops
von: Chang, Ruei-Che, et al.
Veröffentlicht: (2024)
von: Chang, Ruei-Che, et al.
Veröffentlicht: (2024)
Unlocking the Potentials of Retrieval-Augmented Generation for Diffusion Language Models
von: Yu, Chuanyue, et al.
Veröffentlicht: (2026)
von: Yu, Chuanyue, et al.
Veröffentlicht: (2026)
Open-Loop Planning, Closed-Loop Verification: Speculative Verification for VLA
von: Wang, Zihua, et al.
Veröffentlicht: (2026)
von: Wang, Zihua, et al.
Veröffentlicht: (2026)
Linguistic Loops and Geometric Invariants as a Way to Pre-Verbal Thought?
von: Corradetti, Daniele, et al.
Veröffentlicht: (2025)
von: Corradetti, Daniele, et al.
Veröffentlicht: (2025)
Reinforcement Learning on Pre-Training Data
von: Li, Siheng, et al.
Veröffentlicht: (2025)
von: Li, Siheng, et al.
Veröffentlicht: (2025)
Sparse Layers are Critical to Scaling Looped Language Models
von: Lee, Ryan, et al.
Veröffentlicht: (2026)
von: Lee, Ryan, et al.
Veröffentlicht: (2026)
Breaking Language Barriers in Multilingual Mathematical Reasoning: Insights and Observations
von: Chen, Nuo, et al.
Veröffentlicht: (2023)
von: Chen, Nuo, et al.
Veröffentlicht: (2023)
Analyzing the Inherent Response Tendency of LLMs: Real-World Instructions-Driven Jailbreak
von: Du, Yanrui, et al.
Veröffentlicht: (2023)
von: Du, Yanrui, et al.
Veröffentlicht: (2023)
WinoQueer: A Community-in-the-Loop Benchmark for Anti-LGBTQ+ Bias in Large Language Models
von: Felkner, Virginia K., et al.
Veröffentlicht: (2023)
von: Felkner, Virginia K., et al.
Veröffentlicht: (2023)
BALI: Branch-Aware Loop Invariant Inference with Large Language Models
von: Wang, Mingxiu, et al.
Veröffentlicht: (2025)
von: Wang, Mingxiu, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
GraphWiz: An Instruction-Following Language Model for Graph Problems
von: Chen, Nuo, et al.
Veröffentlicht: (2024) -
GraphArena: Evaluating and Exploring Large Language Models on Graph Computation
von: Tang, Jianheng, et al.
Veröffentlicht: (2024) -
GCoder: Improving Large Language Model for Generalized Graph Problem Solving
von: Zhang, Qifan, et al.
Veröffentlicht: (2024) -
LoopSCC: Towards Summarizing Multi-branch Loops within Determinate Cycles
von: Zhu, Kai, et al.
Veröffentlicht: (2024) -
How does Misinformation Affect Large Language Model Behaviors and Preferences?
von: Peng, Miao, et al.
Veröffentlicht: (2025)