DPWriter: Reinforcement Learning with Diverse Planning Branching for Creative Writing
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Cao, Qian, Liu, Yahui, Bi, Wei, Zhao, Yi, Song, Ruihua, Wang, Xiting, Tang, Ruiming, Zhou, Guorui, Li, Han |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Evaluating Text Creativity across Diverse Domains: A Dataset and Large Language Model Evaluator
von: Cao, Qian, et al.
Veröffentlicht: (2025)
von: Cao, Qian, et al.
Veröffentlicht: (2025)
Select, Read, and Write: A Multi-Agent Framework of Full-Text-based Related Work Generation
von: Liu, Xiaochuan, et al.
Veröffentlicht: (2025)
von: Liu, Xiaochuan, et al.
Veröffentlicht: (2025)
BSharedRAG: Backbone Shared Retrieval-Augmented Generation for the E-commerce Domain
von: Guan, Kaisi, et al.
Veröffentlicht: (2024)
von: Guan, Kaisi, et al.
Veröffentlicht: (2024)
See or Guess: Counterfactually Regularized Image Captioning
von: Cao, Qian, et al.
Veröffentlicht: (2024)
von: Cao, Qian, et al.
Veröffentlicht: (2024)
RLMR: Reinforcement Learning with Mixed Rewards for Creative Writing
von: Liao, Jianxing, et al.
Veröffentlicht: (2025)
von: Liao, Jianxing, et al.
Veröffentlicht: (2025)
DeepSynth-Eval: Objectively Evaluating Information Consolidation in Deep Survey Writing
von: Zhang, Hongzhi, et al.
Veröffentlicht: (2026)
von: Zhang, Hongzhi, et al.
Veröffentlicht: (2026)
SIGHT: Reinforcement Learning with Self-Evidence and Information-Gain Diverse Branching for Search Agent
von: Zhong, Wenlin, et al.
Veröffentlicht: (2026)
von: Zhong, Wenlin, et al.
Veröffentlicht: (2026)
Entropy Ratio Clipping as a Soft Global Constraint for Stable Reinforcement Learning
von: Su, Zhenpeng, et al.
Veröffentlicht: (2025)
von: Su, Zhenpeng, et al.
Veröffentlicht: (2025)
Modifying Large Language Model Post-Training for Diverse Creative Writing
von: Chung, John Joon Young, et al.
Veröffentlicht: (2025)
von: Chung, John Joon Young, et al.
Veröffentlicht: (2025)
Weaver: Foundation Models for Creative Writing
von: Wang, Tiannan, et al.
Veröffentlicht: (2024)
von: Wang, Tiannan, et al.
Veröffentlicht: (2024)
LLM Review: Enhancing Creative Writing via Blind Peer Review Feedback
von: Li, Weiyue, et al.
Veröffentlicht: (2026)
von: Li, Weiyue, et al.
Veröffentlicht: (2026)
Accelerating Diffusion LLM Inference via Local Determinism Propagation
von: Kong, Fanheng, et al.
Veröffentlicht: (2025)
von: Kong, Fanheng, et al.
Veröffentlicht: (2025)
DARL: Encouraging Diverse Answers for General Reasoning without Verifiers
von: Huang, Chongxuan, et al.
Veröffentlicht: (2026)
von: Huang, Chongxuan, et al.
Veröffentlicht: (2026)
RLEP: Reinforcement Learning with Experience Replay for LLM Reasoning
von: Zhang, Hongzhi, et al.
Veröffentlicht: (2025)
von: Zhang, Hongzhi, et al.
Veröffentlicht: (2025)
Writing-RL: Advancing Long-form Writing via Adaptive Curriculum Reinforcement Learning
von: Lei, Xuanyu, et al.
Veröffentlicht: (2025)
von: Lei, Xuanyu, et al.
Veröffentlicht: (2025)
LiteraryTaste: A Preference Dataset for Creative Writing Personalization
von: Chung, John Joon Young, et al.
Veröffentlicht: (2025)
von: Chung, John Joon Young, et al.
Veröffentlicht: (2025)
Performance Law of Large Language Models
von: Wu, Chuhan, et al.
Veröffentlicht: (2024)
von: Wu, Chuhan, et al.
Veröffentlicht: (2024)
Minority-Aware Satisfaction Estimation in Dialogue Systems via Preference-Adaptive Reinforcement Learning
von: Fu, Yahui, et al.
Veröffentlicht: (2025)
von: Fu, Yahui, et al.
Veröffentlicht: (2025)
BranPO: Scalable Contrastive Branch Sampling for Long-Horizon Agentic Reinforcement Learning
von: Zhao, Yubao, et al.
Veröffentlicht: (2026)
von: Zhao, Yubao, et al.
Veröffentlicht: (2026)
Non-Monotonic Attention-based Read/Write Policy Learning for Simultaneous Translation
von: Ahmed, Zeeshan, et al.
Veröffentlicht: (2025)
von: Ahmed, Zeeshan, et al.
Veröffentlicht: (2025)
Enhancing Safety of Large Language Models via Embedding Space Separation
von: Zhao, Xu, et al.
Veröffentlicht: (2026)
von: Zhao, Xu, et al.
Veröffentlicht: (2026)
Fino1: On the Transferability of Reasoning-Enhanced LLMs and Reinforcement Learning to Finance
von: Qian, Lingfei, et al.
Veröffentlicht: (2025)
von: Qian, Lingfei, et al.
Veröffentlicht: (2025)
Creative Writing in the Language Arts.
von: Ediger, Marlow
Veröffentlicht: (1994)
von: Ediger, Marlow
Veröffentlicht: (1994)
Staged Specification Logic for Verifying Higher-Order Imperative Programs (Technical Report)
von: Foo, Darius, et al.
Veröffentlicht: (2023)
von: Foo, Darius, et al.
Veröffentlicht: (2023)
Igniting Creative Writing in Small Language Models: LLM-as-a-Judge versus Multi-Agent Refined Rewards
von: Wei, Xiaolong, et al.
Veröffentlicht: (2025)
von: Wei, Xiaolong, et al.
Veröffentlicht: (2025)
Interpretable Text Classification Applied to the Detection of LLM-generated Creative Writing
von: Suvanto, Minerva, et al.
Veröffentlicht: (2026)
von: Suvanto, Minerva, et al.
Veröffentlicht: (2026)
GoLongRL: Capability-Oriented Long Context Reinforcement Learning with Multitask Alignment
von: Lv, Minxuan, et al.
Veröffentlicht: (2026)
von: Lv, Minxuan, et al.
Veröffentlicht: (2026)
COIG-Writer: A High-Quality Dataset for Chinese Creative Writing with Thought Processes
von: Li, Yunwen, et al.
Veröffentlicht: (2025)
von: Li, Yunwen, et al.
Veröffentlicht: (2025)
LLMs Exhibit Significantly Lower Uncertainty in Creative Writing Than Professional Writers
von: Sui, Peiqi
Veröffentlicht: (2026)
von: Sui, Peiqi
Veröffentlicht: (2026)
Enhancing Personality Recognition in Dialogue by Data Augmentation and Heterogeneous Conversational Graph Networks
von: Fu, Yahui, et al.
Veröffentlicht: (2024)
von: Fu, Yahui, et al.
Veröffentlicht: (2024)
Plan Then Action:High-Level Planning Guidance Reinforcement Learning for LLM Reasoning
von: Dou, Zhihao, et al.
Veröffentlicht: (2025)
von: Dou, Zhihao, et al.
Veröffentlicht: (2025)
Efficient Training of Diffusion Mixture-of-Experts Models: A Practical Recipe
von: Liu, Yahui, et al.
Veröffentlicht: (2025)
von: Liu, Yahui, et al.
Veröffentlicht: (2025)
LitBench: A Benchmark and Dataset for Reliable Evaluation of Creative Writing
von: Fein, Daniel, et al.
Veröffentlicht: (2025)
von: Fein, Daniel, et al.
Veröffentlicht: (2025)
Tool-Star: Empowering LLM-Brained Multi-Tool Reasoner via Reinforcement Learning
von: Dong, Guanting, et al.
Veröffentlicht: (2025)
von: Dong, Guanting, et al.
Veröffentlicht: (2025)
StyEmp: Stylizing Empathetic Response Generation via Multi-Grained Prefix Encoder and Personality Reinforcement
von: Fu, Yahui, et al.
Veröffentlicht: (2024)
von: Fu, Yahui, et al.
Veröffentlicht: (2024)
Creative and Context-Aware Translation of East Asian Idioms with GPT-4
von: Tang, Kenan, et al.
Veröffentlicht: (2024)
von: Tang, Kenan, et al.
Veröffentlicht: (2024)
Writing in Symbiosis: Mapping Human Creative Agency in the AI Era
von: Doshi, Vivan, et al.
Veröffentlicht: (2025)
von: Doshi, Vivan, et al.
Veröffentlicht: (2025)
Reinforcement Mid-Training
von: Tian, Yijun, et al.
Veröffentlicht: (2025)
von: Tian, Yijun, et al.
Veröffentlicht: (2025)
CE-GPPO: Coordinating Entropy via Gradient-Preserving Clipping Policy Optimization in Reinforcement Learning
von: Su, Zhenpeng, et al.
Veröffentlicht: (2025)
von: Su, Zhenpeng, et al.
Veröffentlicht: (2025)
Toward an Inclusive Creative Writing
von: Adsit, Janelle
Veröffentlicht: (2022)
von: Adsit, Janelle
Veröffentlicht: (2022)
Ähnliche Einträge
-
Evaluating Text Creativity across Diverse Domains: A Dataset and Large Language Model Evaluator
von: Cao, Qian, et al.
Veröffentlicht: (2025) -
Select, Read, and Write: A Multi-Agent Framework of Full-Text-based Related Work Generation
von: Liu, Xiaochuan, et al.
Veröffentlicht: (2025) -
BSharedRAG: Backbone Shared Retrieval-Augmented Generation for the E-commerce Domain
von: Guan, Kaisi, et al.
Veröffentlicht: (2024) -
See or Guess: Counterfactually Regularized Image Captioning
von: Cao, Qian, et al.
Veröffentlicht: (2024) -
RLMR: Reinforcement Learning with Mixed Rewards for Creative Writing
von: Liao, Jianxing, et al.
Veröffentlicht: (2025)