Unilaw-R1: A Large Language Model for Legal Reasoning with Reinforcement Learning and Iterative Inference
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Cai, Hua, Zhao, Shuang, Zhang, Liang, Shen, Xuli, Xu, Qing, Shen, Weilin, Wen, Zihao, Ban, Tianke |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
EmoHead: Emotional Talking Head via Manipulating Semantic Expression Parameters
von: Shen, Xuli, et al.
Veröffentlicht: (2025)
von: Shen, Xuli, et al.
Veröffentlicht: (2025)
RLKD: Distilling LLMs' Reasoning via Reinforcement Learning
von: Xu, Shicheng, et al.
Veröffentlicht: (2025)
von: Xu, Shicheng, et al.
Veröffentlicht: (2025)
CLaw: Benchmarking Chinese Legal Knowledge in Large Language Models - A Fine-grained Corpus and Reasoning Analysis
von: Xu, Xinzhe, et al.
Veröffentlicht: (2025)
von: Xu, Xinzhe, et al.
Veröffentlicht: (2025)
PRIME: Policy-Reinforced Iterative Multi-agent Execution for Algorithmic Reasoning in Large Language Models
von: Xu, Jiawei, et al.
Veröffentlicht: (2026)
von: Xu, Jiawei, et al.
Veröffentlicht: (2026)
An Explicit Syllogistic Legal Reasoning Framework for Large Language Models
von: Zhang, Kepu, et al.
Veröffentlicht: (2025)
von: Zhang, Kepu, et al.
Veröffentlicht: (2025)
Reinforcement Learning for Reasoning in Large Language Models with One Training Example
von: Wang, Yiping, et al.
Veröffentlicht: (2025)
von: Wang, Yiping, et al.
Veröffentlicht: (2025)
Enhancing Large Language Model with Decomposed Reasoning for Emotion Cause Pair Extraction
von: Wu, Jialiang, et al.
Veröffentlicht: (2024)
von: Wu, Jialiang, et al.
Veröffentlicht: (2024)
WebGen-R1: Incentivizing Large Language Models to Generate Functional and Aesthetic Websites with Reinforcement Learning
von: Jiang, Juyong, et al.
Veröffentlicht: (2026)
von: Jiang, Juyong, et al.
Veröffentlicht: (2026)
Legal Mathematical Reasoning with LLMs: Procedural Alignment through Two-Stage Reinforcement Learning
von: Zhang, Kepu, et al.
Veröffentlicht: (2025)
von: Zhang, Kepu, et al.
Veröffentlicht: (2025)
Stable Knowledge Editing in Large Language Models
von: Wei, Zihao, et al.
Veröffentlicht: (2024)
von: Wei, Zihao, et al.
Veröffentlicht: (2024)
PIP: Perturbation-based Iterative Pruning for Large Language Models
von: Cao, Yi, et al.
Veröffentlicht: (2025)
von: Cao, Yi, et al.
Veröffentlicht: (2025)
Legal$Δ$: Enhancing Legal Reasoning in LLMs via Reinforcement Learning with Chain-of-Thought Guided Information Gain
von: Dai, Xin, et al.
Veröffentlicht: (2025)
von: Dai, Xin, et al.
Veröffentlicht: (2025)
MLaKE: Multilingual Knowledge Editing Benchmark for Large Language Models
von: Wei, Zihao, et al.
Veröffentlicht: (2024)
von: Wei, Zihao, et al.
Veröffentlicht: (2024)
Incorporating Self-Rewriting into Large Language Model Reasoning Reinforcement
von: Yao, Jiashu, et al.
Veröffentlicht: (2025)
von: Yao, Jiashu, et al.
Veröffentlicht: (2025)
Fin-R1: A Large Language Model for Financial Reasoning through Reinforcement Learning
von: Liu, Zhaowei, et al.
Veröffentlicht: (2025)
von: Liu, Zhaowei, et al.
Veröffentlicht: (2025)
Everything is Editable: Extend Knowledge Editing to Unstructured Data in Large Language Models
von: Deng, Jingcheng, et al.
Veröffentlicht: (2024)
von: Deng, Jingcheng, et al.
Veröffentlicht: (2024)
Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models
von: Wang, Yinjie, et al.
Veröffentlicht: (2025)
von: Wang, Yinjie, et al.
Veröffentlicht: (2025)
ToolCoder: A Systematic Code-Empowered Tool Learning Framework for Large Language Models
von: Ding, Hanxing, et al.
Veröffentlicht: (2025)
von: Ding, Hanxing, et al.
Veröffentlicht: (2025)
Re-Reading Improves Reasoning in Large Language Models
von: Xu, Xiaohan, et al.
Veröffentlicht: (2023)
von: Xu, Xiaohan, et al.
Veröffentlicht: (2023)
LegalDrill: Diagnosis-Driven Synthesis for Legal Reasoning in Small Language Models
von: Li, Tianchun, et al.
Veröffentlicht: (2026)
von: Li, Tianchun, et al.
Veröffentlicht: (2026)
Pseudo-Deliberation in Language Models: When Reasoning Fails to Align Values and Actions
von: Rakshit, Sushrita, et al.
Veröffentlicht: (2026)
von: Rakshit, Sushrita, et al.
Veröffentlicht: (2026)
Intent-driven In-context Learning for Few-shot Dialogue State Tracking
von: Yi, Zihao, et al.
Veröffentlicht: (2024)
von: Yi, Zihao, et al.
Veröffentlicht: (2024)
R$^2$PO: Decoupling Training Trajectories from Inference Responses for LLM Reasoning
von: Wang, Jingchu, et al.
Veröffentlicht: (2026)
von: Wang, Jingchu, et al.
Veröffentlicht: (2026)
R-Search: Empowering LLM Reasoning with Search via Multi-Reward Reinforcement Learning
von: Zhao, Qingfei, et al.
Veröffentlicht: (2025)
von: Zhao, Qingfei, et al.
Veröffentlicht: (2025)
Interleaved Reasoning for Large Language Models via Reinforcement Learning
von: Xie, Roy, et al.
Veröffentlicht: (2025)
von: Xie, Roy, et al.
Veröffentlicht: (2025)
Reverse Physician-AI Relationship: Full-process Clinical Diagnosis Driven by a Large Language Model
von: Xu, Shicheng, et al.
Veröffentlicht: (2025)
von: Xu, Shicheng, et al.
Veröffentlicht: (2025)
Graph Reasoning Paradigm: Structured and Symbolic Reasoning with Topology-Aware Reinforcement Learning for Large Language Models
von: Liu, Runxuan, et al.
Veröffentlicht: (2026)
von: Liu, Runxuan, et al.
Veröffentlicht: (2026)
InftyThink+: Effective and Efficient Infinite-Horizon Reasoning via Reinforcement Learning
von: Yan, Yuchen, et al.
Veröffentlicht: (2026)
von: Yan, Yuchen, et al.
Veröffentlicht: (2026)
LLM Latent Reasoning as Chain of Superposition
von: Deng, Jingcheng, et al.
Veröffentlicht: (2025)
von: Deng, Jingcheng, et al.
Veröffentlicht: (2025)
Enhancing Safety of Large Language Models via Embedding Space Separation
von: Zhao, Xu, et al.
Veröffentlicht: (2026)
von: Zhao, Xu, et al.
Veröffentlicht: (2026)
Language as a Latent Variable for Reasoning Optimization
von: Wu, Linjuan, et al.
Veröffentlicht: (2026)
von: Wu, Linjuan, et al.
Veröffentlicht: (2026)
OThink-SRR1: Search, Refine and Reasoning with Reinforced Learning for Large Language Models
von: Liang, Haijian, et al.
Veröffentlicht: (2026)
von: Liang, Haijian, et al.
Veröffentlicht: (2026)
Adaptive Ability Decomposing for Unlocking Large Reasoning Model Effective Reinforcement Learning
von: Chen, Zhipeng, et al.
Veröffentlicht: (2026)
von: Chen, Zhipeng, et al.
Veröffentlicht: (2026)
VLM-R1: A Stable and Generalizable R1-style Large Vision-Language Model
von: Shen, Haozhan, et al.
Veröffentlicht: (2025)
von: Shen, Haozhan, et al.
Veröffentlicht: (2025)
SEMDR: A Semantic-Aware Dual Encoder Model for Legal Judgment Prediction with Legal Clue Tracing
von: Liu, Pengjie, et al.
Veröffentlicht: (2024)
von: Liu, Pengjie, et al.
Veröffentlicht: (2024)
T1: Advancing Language Model Reasoning through Reinforcement Learning and Inference Scaling
von: Hou, Zhenyu, et al.
Veröffentlicht: (2025)
von: Hou, Zhenyu, et al.
Veröffentlicht: (2025)
d1: Scaling Reasoning in Diffusion Large Language Models via Reinforcement Learning
von: Zhao, Siyan, et al.
Veröffentlicht: (2025)
von: Zhao, Siyan, et al.
Veröffentlicht: (2025)
Concise and Organized Perception Facilitates Reasoning in Large Language Models
von: Liu, Junjie, et al.
Veröffentlicht: (2023)
von: Liu, Junjie, et al.
Veröffentlicht: (2023)
R1-Reward: Training Multimodal Reward Model Through Stable Reinforcement Learning
von: Zhang, Yi-Fan, et al.
Veröffentlicht: (2025)
von: Zhang, Yi-Fan, et al.
Veröffentlicht: (2025)
CANDLE: Iterative Conceptualization and Instantiation Distillation from Large Language Models for Commonsense Reasoning
von: Wang, Weiqi, et al.
Veröffentlicht: (2024)
von: Wang, Weiqi, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
EmoHead: Emotional Talking Head via Manipulating Semantic Expression Parameters
von: Shen, Xuli, et al.
Veröffentlicht: (2025) -
RLKD: Distilling LLMs' Reasoning via Reinforcement Learning
von: Xu, Shicheng, et al.
Veröffentlicht: (2025) -
CLaw: Benchmarking Chinese Legal Knowledge in Large Language Models - A Fine-grained Corpus and Reasoning Analysis
von: Xu, Xinzhe, et al.
Veröffentlicht: (2025) -
PRIME: Policy-Reinforced Iterative Multi-agent Execution for Algorithmic Reasoning in Large Language Models
von: Xu, Jiawei, et al.
Veröffentlicht: (2026) -
An Explicit Syllogistic Legal Reasoning Framework for Large Language Models
von: Zhang, Kepu, et al.
Veröffentlicht: (2025)