TRN-R1-Zero: Text-rich Network Reasoning via LLMs with Reinforcement Learning Only
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Yilun, Qiu, Ruihong, Huang, Zi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Text Meets Topology: Rethinking Out-of-distribution Detection in Text-Rich Networks
por: Wang, Danny, et al.
Publicado: (2025)
por: Wang, Danny, et al.
Publicado: (2025)
When to Commit? Towards Variable-Size Self-Contained Blocks for Discrete Diffusion Language Models
por: Wang, Danny, et al.
Publicado: (2026)
por: Wang, Danny, et al.
Publicado: (2026)
GCondenser: Benchmarking Graph Condensation
por: Liu, Yilun, et al.
Publicado: (2024)
por: Liu, Yilun, et al.
Publicado: (2024)
DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
por: DeepSeek-AI, et al.
Publicado: (2025)
por: DeepSeek-AI, et al.
Publicado: (2025)
Break the Block: Dynamic-size Reasoning Blocks for Diffusion Large Language Models via Monotonic Entropy Descent with Reinforcement Learning
por: Jiang, Yan, et al.
Publicado: (2026)
por: Jiang, Yan, et al.
Publicado: (2026)
Block-R1: Rethinking the Role of Block Size in Multi-domain Reinforcement Learning for Diffusion Large Language Models
por: Jiang, Yan, et al.
Publicado: (2026)
por: Jiang, Yan, et al.
Publicado: (2026)
Fleming-R1: Toward Expert-Level Medical Reasoning via Reinforcement Learning
por: Liu, Chi, et al.
Publicado: (2025)
por: Liu, Chi, et al.
Publicado: (2025)
MT-R1-Zero: Advancing LLM-based Machine Translation via R1-Zero-like Reinforcement Learning
por: Feng, Zhaopeng, et al.
Publicado: (2025)
por: Feng, Zhaopeng, et al.
Publicado: (2025)
You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories
por: Wei, Zhepei, et al.
Publicado: (2026)
por: Wei, Zhepei, et al.
Publicado: (2026)
S$^2$R: Teaching LLMs to Self-verify and Self-correct via Reinforcement Learning
por: Ma, Ruotian, et al.
Publicado: (2025)
por: Ma, Ruotian, et al.
Publicado: (2025)
Odin: Oriented Dual-module Integration for Text-rich Network Representation Learning
por: Hong, Kaifeng, et al.
Publicado: (2025)
por: Hong, Kaifeng, et al.
Publicado: (2025)
Unlocking Reasoning Capabilities in LLMs via Reinforcement Learning Exploration
por: Deng, Wenhao, et al.
Publicado: (2025)
por: Deng, Wenhao, et al.
Publicado: (2025)
PUMA: Efficient Continual Graph Learning for Node Classification with Graph Condensation
por: Liu, Yilun, et al.
Publicado: (2023)
por: Liu, Yilun, et al.
Publicado: (2023)
R-Zero: Self-Evolving Reasoning LLM from Zero Data
por: Huang, Chengsong, et al.
Publicado: (2025)
por: Huang, Chengsong, et al.
Publicado: (2025)
Absolute Zero: Reinforced Self-play Reasoning with Zero Data
por: Zhao, Andrew, et al.
Publicado: (2025)
por: Zhao, Andrew, et al.
Publicado: (2025)
Reinforcement Learning for Reasoning in Small LLMs: What Works and What Doesn't
por: Dang, Quy-Anh, et al.
Publicado: (2025)
por: Dang, Quy-Anh, et al.
Publicado: (2025)
LongWriter-Zero: Mastering Ultra-Long Text Generation via Reinforcement Learning
por: Wu, Yuhao, et al.
Publicado: (2025)
por: Wu, Yuhao, et al.
Publicado: (2025)
WebAgent-R1: Training Web Agents via End-to-End Multi-Turn Reinforcement Learning
por: Wei, Zhepei, et al.
Publicado: (2025)
por: Wei, Zhepei, et al.
Publicado: (2025)
LaDiR: Latent Diffusion Enhances LLMs for Text Reasoning
por: Kang, Haoqiang, et al.
Publicado: (2025)
por: Kang, Haoqiang, et al.
Publicado: (2025)
Router-R1: Teaching LLMs Multi-Round Routing and Aggregation via Reinforcement Learning
por: Zhang, Haozhen, et al.
Publicado: (2025)
por: Zhang, Haozhen, et al.
Publicado: (2025)
Free Energy-Driven Reinforcement Learning with Adaptive Advantage Shaping for Unsupervised Reasoning in LLMs
por: Huang, Yiming, et al.
Publicado: (2026)
por: Huang, Yiming, et al.
Publicado: (2026)
CHAMP: A Competition-level Dataset for Fine-Grained Analyses of LLMs' Mathematical Reasoning Capabilities
por: Mao, Yujun, et al.
Publicado: (2024)
por: Mao, Yujun, et al.
Publicado: (2024)
Open-Reasoner-Zero: An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model
por: Hu, Jingcheng, et al.
Publicado: (2025)
por: Hu, Jingcheng, et al.
Publicado: (2025)
SPIRAL: Self-Play on Zero-Sum Games Incentivizes Reasoning via Multi-Agent Multi-Turn Reinforcement Learning
por: Liu, Bo, et al.
Publicado: (2025)
por: Liu, Bo, et al.
Publicado: (2025)
PREDILECT: Preferences Delineated with Zero-Shot Language-based Reasoning in Reinforcement Learning
por: Holk, Simon, et al.
Publicado: (2024)
por: Holk, Simon, et al.
Publicado: (2024)
A Comprehensive Study of Decoder-Only LLMs for Text-to-Image Generation
por: Wang, Andrew Z., et al.
Publicado: (2025)
por: Wang, Andrew Z., et al.
Publicado: (2025)
Time-R1: Towards Comprehensive Temporal Reasoning in LLMs
por: Liu, Zijia, et al.
Publicado: (2025)
por: Liu, Zijia, et al.
Publicado: (2025)
KDRL: Post-Training Reasoning LLMs via Unified Knowledge Distillation and Reinforcement Learning
por: Xu, Hongling, et al.
Publicado: (2025)
por: Xu, Hongling, et al.
Publicado: (2025)
d1: Scaling Reasoning in Diffusion Large Language Models via Reinforcement Learning
por: Zhao, Siyan, et al.
Publicado: (2025)
por: Zhao, Siyan, et al.
Publicado: (2025)
Enhancing Efficiency and Exploration in Reinforcement Learning for LLMs
por: Liao, Mengqi, et al.
Publicado: (2025)
por: Liao, Mengqi, et al.
Publicado: (2025)
xRouter: Training Cost-Aware LLMs Orchestration System via Reinforcement Learning
por: Qian, Cheng, et al.
Publicado: (2025)
por: Qian, Cheng, et al.
Publicado: (2025)
Boosting Logical Fallacy Reasoning in LLMs via Logical Structure Tree
por: Lei, Yuanyuan, et al.
Publicado: (2024)
por: Lei, Yuanyuan, et al.
Publicado: (2024)
LLMs are not Zero-Shot Reasoners for Biomedical Information Extraction
por: Nagar, Aishik, et al.
Publicado: (2024)
por: Nagar, Aishik, et al.
Publicado: (2024)
Causal Reasoning Favors Encoders: On The Limits of Decoder-Only Models
por: Roy, Amartya, et al.
Publicado: (2025)
por: Roy, Amartya, et al.
Publicado: (2025)
LiveThinking: Enabling Real-Time Efficient Reasoning for AI-Powered Livestreaming via Reinforcement Learning
por: Sun, Yuhan, et al.
Publicado: (2025)
por: Sun, Yuhan, et al.
Publicado: (2025)
Learning to Reason in LLMs by Expectation Maximization
por: Lee, Junghyun, et al.
Publicado: (2025)
por: Lee, Junghyun, et al.
Publicado: (2025)
SUPERNOVA: Eliciting General Reasoning in LLMs with Reinforcement Learning on Natural Instructions
por: Suvarna, Ashima, et al.
Publicado: (2026)
por: Suvarna, Ashima, et al.
Publicado: (2026)
MMR-GRPO: Accelerating GRPO-Style Training through Diversity-Aware Reward Reweighting
por: Wei, Kangda, et al.
Publicado: (2026)
por: Wei, Kangda, et al.
Publicado: (2026)
CRAFT: Calibrated Reasoning with Answer-Faithful Traces via Reinforcement Learning for Multi-Hop Question Answering
por: Liu, Yu, et al.
Publicado: (2026)
por: Liu, Yu, et al.
Publicado: (2026)
Not All Tokens Matter: Towards Efficient LLM Reasoning via Token Significance in Reinforcement Learning
por: Liu, Hanbing, et al.
Publicado: (2025)
por: Liu, Hanbing, et al.
Publicado: (2025)
Ejemplares similares
-
Text Meets Topology: Rethinking Out-of-distribution Detection in Text-Rich Networks
por: Wang, Danny, et al.
Publicado: (2025) -
When to Commit? Towards Variable-Size Self-Contained Blocks for Discrete Diffusion Language Models
por: Wang, Danny, et al.
Publicado: (2026) -
GCondenser: Benchmarking Graph Condensation
por: Liu, Yilun, et al.
Publicado: (2024) -
DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning
por: DeepSeek-AI, et al.
Publicado: (2025) -
Break the Block: Dynamic-size Reasoning Blocks for Diffusion Large Language Models via Monotonic Entropy Descent with Reinforcement Learning
por: Jiang, Yan, et al.
Publicado: (2026)