PRewrite: Prompt Rewriting with Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Kong, Weize, Hombaiah, Spurthi Amba, Zhang, Mingyang, Mei, Qiaozhu, Bendersky, Michael |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Pathways of Thoughts: Multi-Directional Thinking for Long-form Personalized Question Answering
di: Salemi, Alireza, et al.
Pubblicazione: (2025)
di: Salemi, Alireza, et al.
Pubblicazione: (2025)
Learning to Rewrite Prompts for Personalized Text Generation
di: Li, Cheng, et al.
Pubblicazione: (2023)
di: Li, Cheng, et al.
Pubblicazione: (2023)
Retrieval Augmented Generation or Long-Context LLMs? A Comprehensive Study and Hybrid Approach
di: Li, Zhuowan, et al.
Pubblicazione: (2024)
di: Li, Zhuowan, et al.
Pubblicazione: (2024)
Reasoning-Enhanced Self-Training for Long-Form Personalized Text Generation
di: Salemi, Alireza, et al.
Pubblicazione: (2025)
di: Salemi, Alireza, et al.
Pubblicazione: (2025)
Bridging the Preference Gap between Retrievers and LLMs
di: Ke, Zixuan, et al.
Pubblicazione: (2024)
di: Ke, Zixuan, et al.
Pubblicazione: (2024)
Dr Genre: Reinforcement Learning from Decoupled LLM Feedback for Generic Text Rewriting
di: Li, Yufei, et al.
Pubblicazione: (2025)
di: Li, Yufei, et al.
Pubblicazione: (2025)
Learning to Rewrite Prompts for Bootstrapping LLMs on Downstream Tasks
di: Zhou, Qinhao, et al.
Pubblicazione: (2025)
di: Zhou, Qinhao, et al.
Pubblicazione: (2025)
Sample-Efficient Online Learning in LM Agents via Hindsight Trajectory Rewriting
di: Hu, Michael Y., et al.
Pubblicazione: (2025)
di: Hu, Michael Y., et al.
Pubblicazione: (2025)
SSR-Zero: Simple Self-Rewarding Reinforcement Learning for Machine Translation
di: Yang, Wenjie, et al.
Pubblicazione: (2025)
di: Yang, Wenjie, et al.
Pubblicazione: (2025)
The Entropy Mechanism of Reinforcement Learning for Reasoning Language Models
di: Cui, Ganqu, et al.
Pubblicazione: (2025)
di: Cui, Ganqu, et al.
Pubblicazione: (2025)
Short-form Text Rewriting with Phi Silica
di: Tadimeti, Divya, et al.
Pubblicazione: (2026)
di: Tadimeti, Divya, et al.
Pubblicazione: (2026)
No Prompt Left Behind: Exploiting Zero-Variance Prompts in LLM Reinforcement Learning via Entropy-Guided Advantage Shaping
di: Le, Thanh-Long V., et al.
Pubblicazione: (2025)
di: Le, Thanh-Long V., et al.
Pubblicazione: (2025)
Predicting Task Performance with Context-aware Scaling Laws
di: Montgomery, Kyle, et al.
Pubblicazione: (2025)
di: Montgomery, Kyle, et al.
Pubblicazione: (2025)
Predicting Compact Phrasal Rewrites with Large Language Models for ASR Post Editing
di: Zhang, Hao, et al.
Pubblicazione: (2025)
di: Zhang, Hao, et al.
Pubblicazione: (2025)
Can LLMs Effectively Leverage Graph Structural Information through Prompts, and Why?
di: Huang, Jin, et al.
Pubblicazione: (2023)
di: Huang, Jin, et al.
Pubblicazione: (2023)
Ask more, know better: Reinforce-Learned Prompt Questions for Decision Making with Large Language Models
di: Yan, Xue, et al.
Pubblicazione: (2023)
di: Yan, Xue, et al.
Pubblicazione: (2023)
SE-Bench: Benchmarking Self-Evolution with Knowledge Internalization
di: Yuan, Jiarui, et al.
Pubblicazione: (2026)
di: Yuan, Jiarui, et al.
Pubblicazione: (2026)
Hypothesis-Conditioned Query Rewriting for Decision-Useful Retrieval
di: Chang, Hangeol, et al.
Pubblicazione: (2026)
di: Chang, Hangeol, et al.
Pubblicazione: (2026)
Teaching Language Models to Critique via Reinforcement Learning
di: Xie, Zhihui, et al.
Pubblicazione: (2025)
di: Xie, Zhihui, et al.
Pubblicazione: (2025)
R-Bot: An LLM-based Query Rewrite System
di: Sun, Zhaoyan, et al.
Pubblicazione: (2024)
di: Sun, Zhaoyan, et al.
Pubblicazione: (2024)
Why is constrained neural language generation particularly challenging?
di: Garbacea, Cristina, et al.
Pubblicazione: (2022)
di: Garbacea, Cristina, et al.
Pubblicazione: (2022)
QueryBandits for Hallucination Mitigation: Exploiting Semantic Features for No-Regret Rewriting
di: Cho, Nicole, et al.
Pubblicazione: (2025)
di: Cho, Nicole, et al.
Pubblicazione: (2025)
EMORL: Ensemble Multi-Objective Reinforcement Learning for Efficient and Flexible LLM Fine-Tuning
di: Kong, Lingxiao, et al.
Pubblicazione: (2025)
di: Kong, Lingxiao, et al.
Pubblicazione: (2025)
A Survey of Reinforcement Learning for Large Reasoning Models
di: Zhang, Kaiyan, et al.
Pubblicazione: (2025)
di: Zhang, Kaiyan, et al.
Pubblicazione: (2025)
CP-Prompt: Composition-Based Cross-modal Prompting for Domain-Incremental Continual Learning
di: Feng, Yu, et al.
Pubblicazione: (2024)
di: Feng, Yu, et al.
Pubblicazione: (2024)
Effective Structured Prompting by Meta-Learning and Representative Verbalizer
di: Jiang, Weisen, et al.
Pubblicazione: (2023)
di: Jiang, Weisen, et al.
Pubblicazione: (2023)
PromptCoT: Synthesizing Olympiad-level Problems for Mathematical Reasoning in Large Language Models
di: Zhao, Xueliang, et al.
Pubblicazione: (2025)
di: Zhao, Xueliang, et al.
Pubblicazione: (2025)
Process Reinforcement through Implicit Rewards
di: Cui, Ganqu, et al.
Pubblicazione: (2025)
di: Cui, Ganqu, et al.
Pubblicazione: (2025)
Self-Guided Process Reward Optimization with Redefined Step-wise Advantage for Process Reinforcement Learning
di: Fei, Wu, et al.
Pubblicazione: (2025)
di: Fei, Wu, et al.
Pubblicazione: (2025)
Continuous QA Learning with Structured Prompts
di: Zheng, Yinhe
Pubblicazione: (2022)
di: Zheng, Yinhe
Pubblicazione: (2022)
System Prompt Optimization with Meta-Learning
di: Choi, Yumin, et al.
Pubblicazione: (2025)
di: Choi, Yumin, et al.
Pubblicazione: (2025)
Reinforcement Learning Enhanced LLMs: A Survey
di: Wang, Shuhe, et al.
Pubblicazione: (2024)
di: Wang, Shuhe, et al.
Pubblicazione: (2024)
Is There No Such Thing as a Bad Question? H4R: HalluciBot For Ratiocination, Rewriting, Ranking, and Routing
di: Watson, William, et al.
Pubblicazione: (2024)
di: Watson, William, et al.
Pubblicazione: (2024)
Agentic Critical Training
di: Liu, Weize, et al.
Pubblicazione: (2026)
di: Liu, Weize, et al.
Pubblicazione: (2026)
Learning to Hint for Reinforcement Learning
di: Xia, Yu, et al.
Pubblicazione: (2026)
di: Xia, Yu, et al.
Pubblicazione: (2026)
Tabular Transfer Learning via Prompting LLMs
di: Nam, Jaehyun, et al.
Pubblicazione: (2024)
di: Nam, Jaehyun, et al.
Pubblicazione: (2024)
Learning to Compress Prompt in Natural Language Formats
di: Chuang, Yu-Neng, et al.
Pubblicazione: (2024)
di: Chuang, Yu-Neng, et al.
Pubblicazione: (2024)
CARL: Criticality-Aware Agentic Reinforcement Learning
di: Shen, Leyang, et al.
Pubblicazione: (2025)
di: Shen, Leyang, et al.
Pubblicazione: (2025)
Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining
di: Lin, Licong, et al.
Pubblicazione: (2023)
di: Lin, Licong, et al.
Pubblicazione: (2023)
Experience Sharing in Mutual Reinforcement Learning for Heterogeneous Language Models
di: Liu, Xiaoze, et al.
Pubblicazione: (2026)
di: Liu, Xiaoze, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Pathways of Thoughts: Multi-Directional Thinking for Long-form Personalized Question Answering
di: Salemi, Alireza, et al.
Pubblicazione: (2025) -
Learning to Rewrite Prompts for Personalized Text Generation
di: Li, Cheng, et al.
Pubblicazione: (2023) -
Retrieval Augmented Generation or Long-Context LLMs? A Comprehensive Study and Hybrid Approach
di: Li, Zhuowan, et al.
Pubblicazione: (2024) -
Reasoning-Enhanced Self-Training for Long-Form Personalized Text Generation
di: Salemi, Alireza, et al.
Pubblicazione: (2025) -
Bridging the Preference Gap between Retrievers and LLMs
di: Ke, Zixuan, et al.
Pubblicazione: (2024)