Mutual Enhancement of Large Language and Reinforcement Learning Models through Bi-Directional Feedback Mechanisms: A Planning Case Study
Fuente:
arXiv
Gespeichert in:
| 1. Verfasser: | Gu, Shangding |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
TeaMs-RL: Teaching LLMs to Generate Better Instruction Datasets via Reinforcement Learning
von: Gu, Shangding, et al.
Veröffentlicht: (2024)
von: Gu, Shangding, et al.
Veröffentlicht: (2024)
StyleBench: Evaluating thinking styles in Large Language Models
von: Guo, Junyu, et al.
Veröffentlicht: (2025)
von: Guo, Junyu, et al.
Veröffentlicht: (2025)
DUAL-REFLECT: Enhancing Large Language Models for Reflective Translation through Dual Learning Feedback Mechanisms
von: Chen, Andong, et al.
Veröffentlicht: (2024)
von: Chen, Andong, et al.
Veröffentlicht: (2024)
Enhancing the Traditional Chinese Medicine Capabilities of Large Language Model through Reinforcement Learning from AI Feedback
von: Yu, Song, et al.
Veröffentlicht: (2024)
von: Yu, Song, et al.
Veröffentlicht: (2024)
MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models
von: Zhang, Yin, et al.
Veröffentlicht: (2026)
von: Zhang, Yin, et al.
Veröffentlicht: (2026)
Experience Sharing in Mutual Reinforcement Learning for Heterogeneous Language Models
von: Liu, Xiaoze, et al.
Veröffentlicht: (2026)
von: Liu, Xiaoze, et al.
Veröffentlicht: (2026)
BiTA: Bi-Directional Tuning for Lossless Acceleration in Large Language Models
von: Lin, Feng, et al.
Veröffentlicht: (2024)
von: Lin, Feng, et al.
Veröffentlicht: (2024)
Demonstrating Mutual Reinforcement Effect through Information Flow
von: Gan, Chengguang, et al.
Veröffentlicht: (2024)
von: Gan, Chengguang, et al.
Veröffentlicht: (2024)
Post-Training Large Language Models via Reinforcement Learning from Self-Feedback
von: van Niekerk, Carel, et al.
Veröffentlicht: (2025)
von: van Niekerk, Carel, et al.
Veröffentlicht: (2025)
CHAI for LLMs: Improving Code-Mixed Translation in Large Language Models through Reinforcement Learning with AI Feedback
von: Zhang, Wenbo, et al.
Veröffentlicht: (2024)
von: Zhang, Wenbo, et al.
Veröffentlicht: (2024)
FedMKT: Federated Mutual Knowledge Transfer for Large and Small Language Models
von: Fan, Tao, et al.
Veröffentlicht: (2024)
von: Fan, Tao, et al.
Veröffentlicht: (2024)
Reinforcement Learning without Human Feedback for Last Mile Fine-Tuning of Large Language Models
von: Solway, Alec
Veröffentlicht: (2024)
von: Solway, Alec
Veröffentlicht: (2024)
Direct Preference Knowledge Distillation for Large Language Models
von: Li, Yixing, et al.
Veröffentlicht: (2024)
von: Li, Yixing, et al.
Veröffentlicht: (2024)
Fin-R1: A Large Language Model for Financial Reasoning through Reinforcement Learning
von: Liu, Zhaowei, et al.
Veröffentlicht: (2025)
von: Liu, Zhaowei, et al.
Veröffentlicht: (2025)
Align-SLM: Textless Spoken Language Models with Reinforcement Learning from AI Feedback
von: Lin, Guan-Ting, et al.
Veröffentlicht: (2024)
von: Lin, Guan-Ting, et al.
Veröffentlicht: (2024)
Bootstrapping Exploration with Group-Level Natural Language Feedback in Reinforcement Learning
von: Huang, Lei, et al.
Veröffentlicht: (2026)
von: Huang, Lei, et al.
Veröffentlicht: (2026)
RLHFPoison: Reward Poisoning Attack for Reinforcement Learning with Human Feedback in Large Language Models
von: Wang, Jiongxiao, et al.
Veröffentlicht: (2023)
von: Wang, Jiongxiao, et al.
Veröffentlicht: (2023)
Enhancing Language Model Rationality with Bi-Directional Deliberation Reasoning
von: Zhang, Yadong, et al.
Veröffentlicht: (2024)
von: Zhang, Yadong, et al.
Veröffentlicht: (2024)
Adaptive Reinforcement Learning Planning: Harnessing Large Language Models for Complex Information Extraction
von: Ding, Zepeng, et al.
Veröffentlicht: (2024)
von: Ding, Zepeng, et al.
Veröffentlicht: (2024)
Unified Enhancement of the Generalization and Robustness of Language Models via Bi-Stage Optimization
von: Sun, Yudao, et al.
Veröffentlicht: (2025)
von: Sun, Yudao, et al.
Veröffentlicht: (2025)
Enhancing the Capability and Robustness of Large Language Models through Reinforcement Learning-Driven Query Refinement
von: Wang, Xiaohua, et al.
Veröffentlicht: (2024)
von: Wang, Xiaohua, et al.
Veröffentlicht: (2024)
Reinforcement Learning from Compiler and Language Server Feedback
von: Zhang, Yifan, et al.
Veröffentlicht: (2025)
von: Zhang, Yifan, et al.
Veröffentlicht: (2025)
Diver: Large Language Model Decoding with Span-Level Mutual Information Verification
von: Lu, Jinliang, et al.
Veröffentlicht: (2024)
von: Lu, Jinliang, et al.
Veröffentlicht: (2024)
MI-PRUN: Optimize Large Language Model Pruning via Mutual Information
von: Zhang, Hao, et al.
Veröffentlicht: (2026)
von: Zhang, Hao, et al.
Veröffentlicht: (2026)
Overton Pluralistic Reinforcement Learning for Large Language Models
von: Fu, Yu, et al.
Veröffentlicht: (2026)
von: Fu, Yu, et al.
Veröffentlicht: (2026)
Learning Domain Knowledge in Multimodal Large Language Models through Reinforcement Fine-Tuning
von: Cao, Qinglong, et al.
Veröffentlicht: (2026)
von: Cao, Qinglong, et al.
Veröffentlicht: (2026)
Explainable Behavior Cloning: Teaching Large Language Model Agents through Learning by Demonstration
von: Guan, Yanchu, et al.
Veröffentlicht: (2024)
von: Guan, Yanchu, et al.
Veröffentlicht: (2024)
Educational Personalized Learning Path Planning with Large Language Models
von: Ng, Chee, et al.
Veröffentlicht: (2024)
von: Ng, Chee, et al.
Veröffentlicht: (2024)
Sparse Subnetwork Enhancement for Underrepresented Languages in Large Language Models
von: Gurgurov, Daniil, et al.
Veröffentlicht: (2025)
von: Gurgurov, Daniil, et al.
Veröffentlicht: (2025)
Kongzi: A Historical Large Language Model with Fact Enhancement
von: Yang, Jiashu, et al.
Veröffentlicht: (2025)
von: Yang, Jiashu, et al.
Veröffentlicht: (2025)
Leveraging Conditional Mutual Information to Improve Large Language Model Fine-Tuning For Classification
von: Sivakaran, Thanushon, et al.
Veröffentlicht: (2025)
von: Sivakaran, Thanushon, et al.
Veröffentlicht: (2025)
Lens: Rethinking Multilingual Enhancement for Large Language Models
von: Zhao, Weixiang, et al.
Veröffentlicht: (2024)
von: Zhao, Weixiang, et al.
Veröffentlicht: (2024)
Interpreting Arithmetic Mechanism in Large Language Models through Comparative Neuron Analysis
von: Yu, Zeping, et al.
Veröffentlicht: (2024)
von: Yu, Zeping, et al.
Veröffentlicht: (2024)
Interleaved Reasoning for Large Language Models via Reinforcement Learning
von: Xie, Roy, et al.
Veröffentlicht: (2025)
von: Xie, Roy, et al.
Veröffentlicht: (2025)
Revolutionizing Reinforcement Learning Framework for Diffusion Large Language Models
von: Wang, Yinjie, et al.
Veröffentlicht: (2025)
von: Wang, Yinjie, et al.
Veröffentlicht: (2025)
Training Large Language Models for Reasoning through Reverse Curriculum Reinforcement Learning
von: Xi, Zhiheng, et al.
Veröffentlicht: (2024)
von: Xi, Zhiheng, et al.
Veröffentlicht: (2024)
Learning to Plan for Retrieval-Augmented Large Language Models from Knowledge Graphs
von: Wang, Junjie, et al.
Veröffentlicht: (2024)
von: Wang, Junjie, et al.
Veröffentlicht: (2024)
Remembering More, Risking More: Longitudinal Safety Risks in Memory-Equipped LLM Agents
von: Al-Tawaha, Ahmad, et al.
Veröffentlicht: (2026)
von: Al-Tawaha, Ahmad, et al.
Veröffentlicht: (2026)
Internal Consistency and Self-Feedback in Large Language Models: A Survey
von: Liang, Xun, et al.
Veröffentlicht: (2024)
von: Liang, Xun, et al.
Veröffentlicht: (2024)
A Large Language Model Approach to Educational Survey Feedback Analysis
von: Parker, Michael J., et al.
Veröffentlicht: (2023)
von: Parker, Michael J., et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
TeaMs-RL: Teaching LLMs to Generate Better Instruction Datasets via Reinforcement Learning
von: Gu, Shangding, et al.
Veröffentlicht: (2024) -
StyleBench: Evaluating thinking styles in Large Language Models
von: Guo, Junyu, et al.
Veröffentlicht: (2025) -
DUAL-REFLECT: Enhancing Large Language Models for Reflective Translation through Dual Learning Feedback Mechanisms
von: Chen, Andong, et al.
Veröffentlicht: (2024) -
Enhancing the Traditional Chinese Medicine Capabilities of Large Language Model through Reinforcement Learning from AI Feedback
von: Yu, Song, et al.
Veröffentlicht: (2024) -
MIRL: Mutual Information-Guided Reinforcement Learning for Vision-Language Models
von: Zhang, Yin, et al.
Veröffentlicht: (2026)