UCO: A Multi-Turn Interactive Reinforcement Learning Method for Adaptive Teaching with Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Wei, Shouang, Zhang, Min, Lin, Xin, Jiang, Bo, Kuang, Kun, Dai, Zhongxiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
EduDial: Constructing a Large-scale Multi-turn Teacher-Student Dialogue Corpus
di: Wei, Shouang, et al.
Pubblicazione: (2025)
di: Wei, Shouang, et al.
Pubblicazione: (2025)
Words & Weights: Streamlining Multi-Turn Interactions via Co-Adaptation
di: Wei, Chenxing, et al.
Pubblicazione: (2026)
di: Wei, Chenxing, et al.
Pubblicazione: (2026)
EduAgentQG: A Multi-Agent Workflow Framework for Personalized Question Generation
di: Jia, Rui, et al.
Pubblicazione: (2025)
di: Jia, Rui, et al.
Pubblicazione: (2025)
Multi-Turn Interactions for Text-to-SQL with Large Language Models
di: Xiong, Guanming, et al.
Pubblicazione: (2024)
di: Xiong, Guanming, et al.
Pubblicazione: (2024)
Multi-agent KTO: Reinforcing Strategic Interactions of Large Language Model in Language Game
di: Ye, Rong, et al.
Pubblicazione: (2025)
di: Ye, Rong, et al.
Pubblicazione: (2025)
Beyond Single-Turn: A Survey on Multi-Turn Interactions with Large Language Models
di: Li, Yubo, et al.
Pubblicazione: (2025)
di: Li, Yubo, et al.
Pubblicazione: (2025)
Refining Adaptive Zeroth-Order Optimization at Ease
di: Shu, Yao, et al.
Pubblicazione: (2025)
di: Shu, Yao, et al.
Pubblicazione: (2025)
Large Language Model-Enhanced Multi-Armed Bandits
di: Sun, Jiahang, et al.
Pubblicazione: (2025)
di: Sun, Jiahang, et al.
Pubblicazione: (2025)
Reversible Diffusion Decoding for Diffusion Language Models
di: Wang, Xinyun, et al.
Pubblicazione: (2026)
di: Wang, Xinyun, et al.
Pubblicazione: (2026)
Breaking Contextual Inertia: Reinforcement Learning with Single-Turn Anchors for Stable Multi-Turn Interaction
di: Chen, Xingwu, et al.
Pubblicazione: (2026)
di: Chen, Xingwu, et al.
Pubblicazione: (2026)
Reinforcement Learning with Promising Tokens for Large Language Models
di: Pang, Jing-Cheng, et al.
Pubblicazione: (2026)
di: Pang, Jing-Cheng, et al.
Pubblicazione: (2026)
ReviewInstruct: A Review-Driven Multi-Turn Conversations Generation Method for Large Language Models
di: Wu, Jiangxu, et al.
Pubblicazione: (2025)
di: Wu, Jiangxu, et al.
Pubblicazione: (2025)
HarmNet: A Framework for Adaptive Multi-Turn Jailbreak Attacks on Large Language Models
di: Narula, Sidhant, et al.
Pubblicazione: (2025)
di: Narula, Sidhant, et al.
Pubblicazione: (2025)
Adaptive Stopping for Multi-Turn LLM Reasoning
di: Zhou, Xiaofan, et al.
Pubblicazione: (2026)
di: Zhou, Xiaofan, et al.
Pubblicazione: (2026)
Interactive-KBQA: Multi-Turn Interactions for Knowledge Base Question Answering with Large Language Models
di: Xiong, Guanming, et al.
Pubblicazione: (2024)
di: Xiong, Guanming, et al.
Pubblicazione: (2024)
Unifying Large Language Model and Deep Reinforcement Learning for Human-in-Loop Interactive Socially-aware Navigation
di: Wang, Weizheng, et al.
Pubblicazione: (2024)
di: Wang, Weizheng, et al.
Pubblicazione: (2024)
Transient Turn Injection: Exposing Stateless Multi-Turn Vulnerabilities in Large Language Models
di: Rayhan, Naheed, et al.
Pubblicazione: (2026)
di: Rayhan, Naheed, et al.
Pubblicazione: (2026)
HAVE: Head-Adaptive Gating and ValuE Calibration for Hallucination Mitigation in Large Language Models
di: Tong, Xin, et al.
Pubblicazione: (2025)
di: Tong, Xin, et al.
Pubblicazione: (2025)
AEM: Adaptive Entropy Modulation for Multi-Turn Agentic Reinforcement Learning
di: Zhao, Haotian, et al.
Pubblicazione: (2026)
di: Zhao, Haotian, et al.
Pubblicazione: (2026)
Adaptive Multi-Subspace Representation Steering for Attribute Alignment in Large Language Models
di: Jiang, Xinyan, et al.
Pubblicazione: (2025)
di: Jiang, Xinyan, et al.
Pubblicazione: (2025)
State-Dependent Safety Failures in Multi-Turn Language Model Interaction
di: Li, Pengcheng, et al.
Pubblicazione: (2026)
di: Li, Pengcheng, et al.
Pubblicazione: (2026)
SPL: A Socratic Playground for Learning Powered by Large Language Model
di: Zhang, Liang, et al.
Pubblicazione: (2024)
di: Zhang, Liang, et al.
Pubblicazione: (2024)
ZipRL: Adaptive Multi-Turn Context Compression with Hindsight Response Replay
di: Hu, Zhexin, et al.
Pubblicazione: (2026)
di: Hu, Zhexin, et al.
Pubblicazione: (2026)
Adaptive Reinforcement Learning Planning: Harnessing Large Language Models for Complex Information Extraction
di: Ding, Zepeng, et al.
Pubblicazione: (2024)
di: Ding, Zepeng, et al.
Pubblicazione: (2024)
AgentTutor: Empowering Personalized Learning with Multi-Turn Interactive Teaching in Intelligent Education Systems
di: Liu, Yuxin, et al.
Pubblicazione: (2025)
di: Liu, Yuxin, et al.
Pubblicazione: (2025)
Sketch Then Paint: Hierarchical Reinforcement Learning for Diffusion Multi-Modal Large Language Models
di: Luo, Siqi, et al.
Pubblicazione: (2026)
di: Luo, Siqi, et al.
Pubblicazione: (2026)
PAG: Multi-Turn Reinforced LLM Self-Correction with Policy as Generative Verifier
di: Jiang, Yuhua, et al.
Pubblicazione: (2025)
di: Jiang, Yuhua, et al.
Pubblicazione: (2025)
MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
di: Bai, Ge, et al.
Pubblicazione: (2024)
di: Bai, Ge, et al.
Pubblicazione: (2024)
Beyond the Assistant Turn: User Turn Generation as a Probe of Interaction Awareness in Language Models
di: Shekkizhar, Sarath, et al.
Pubblicazione: (2026)
di: Shekkizhar, Sarath, et al.
Pubblicazione: (2026)
Adaptive Data Exploitation in Deep Reinforcement Learning
di: Yuan, Mingqi, et al.
Pubblicazione: (2025)
di: Yuan, Mingqi, et al.
Pubblicazione: (2025)
Causal Agent based on Large Language Model
di: Han, Kairong, et al.
Pubblicazione: (2024)
di: Han, Kairong, et al.
Pubblicazione: (2024)
Turn-based Multi-Agent Reinforcement Learning Model Checking
di: Gross, Dennis
Pubblicazione: (2025)
di: Gross, Dennis
Pubblicazione: (2025)
T$^2$PO: Uncertainty-Guided Exploration Control for Stable Multi-Turn Agentic Reinforcement Learning
di: Wang, Haixin, et al.
Pubblicazione: (2026)
di: Wang, Haixin, et al.
Pubblicazione: (2026)
CM2: Reinforcement Learning with Checklist Rewards for Multi-Turn and Multi-Step Agentic Tool Use
di: Zhang, Zhen, et al.
Pubblicazione: (2026)
di: Zhang, Zhen, et al.
Pubblicazione: (2026)
SPIRAL: Self-Play on Zero-Sum Games Incentivizes Reasoning via Multi-Agent Multi-Turn Reinforcement Learning
di: Liu, Bo, et al.
Pubblicazione: (2025)
di: Liu, Bo, et al.
Pubblicazione: (2025)
SLEA-RL: Step-Level Experience Augmented Reinforcement Learning for Multi-Turn Agentic Training
di: Wang, Prince Zizhuang, et al.
Pubblicazione: (2026)
di: Wang, Prince Zizhuang, et al.
Pubblicazione: (2026)
MTMCS-Bench: Evaluating Contextual Safety of Multimodal Large Language Models in Multi-Turn Dialogues
di: Liu, Zheyuan, et al.
Pubblicazione: (2026)
di: Liu, Zheyuan, et al.
Pubblicazione: (2026)
A Zero-shot Learning Method Based on Large Language Models for Multi-modal Knowledge Graph Embedding
di: Liu, Bingchen, et al.
Pubblicazione: (2025)
di: Liu, Bingchen, et al.
Pubblicazione: (2025)
Adaptive Multi-Agent Deep Reinforcement Learning for Timely Healthcare Interventions
di: Shaik, Thanveer, et al.
Pubblicazione: (2023)
di: Shaik, Thanveer, et al.
Pubblicazione: (2023)
RLFactory: A Plug-and-Play Reinforcement Learning Post-Training Framework for LLM Multi-Turn Tool-Use
di: Chai, Jiajun, et al.
Pubblicazione: (2025)
di: Chai, Jiajun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
EduDial: Constructing a Large-scale Multi-turn Teacher-Student Dialogue Corpus
di: Wei, Shouang, et al.
Pubblicazione: (2025) -
Words & Weights: Streamlining Multi-Turn Interactions via Co-Adaptation
di: Wei, Chenxing, et al.
Pubblicazione: (2026) -
EduAgentQG: A Multi-Agent Workflow Framework for Personalized Question Generation
di: Jia, Rui, et al.
Pubblicazione: (2025) -
Multi-Turn Interactions for Text-to-SQL with Large Language Models
di: Xiong, Guanming, et al.
Pubblicazione: (2024) -
Multi-agent KTO: Reinforcing Strategic Interactions of Large Language Model in Language Game
di: Ye, Rong, et al.
Pubblicazione: (2025)