Gespeichert in:
| Hauptverfasser: | Wei, Shouang, Zhang, Min, Lin, Xin, Jiang, Bo, Kuang, Kun, Dai, Zhongxiang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2511.08873 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
EduDial: Constructing a Large-scale Multi-turn Teacher-Student Dialogue Corpus
von: Wei, Shouang, et al.
Veröffentlicht: (2025)
von: Wei, Shouang, et al.
Veröffentlicht: (2025)
Words & Weights: Streamlining Multi-Turn Interactions via Co-Adaptation
von: Wei, Chenxing, et al.
Veröffentlicht: (2026)
von: Wei, Chenxing, et al.
Veröffentlicht: (2026)
EduAgentQG: A Multi-Agent Workflow Framework for Personalized Question Generation
von: Jia, Rui, et al.
Veröffentlicht: (2025)
von: Jia, Rui, et al.
Veröffentlicht: (2025)
Refining Adaptive Zeroth-Order Optimization at Ease
von: Shu, Yao, et al.
Veröffentlicht: (2025)
von: Shu, Yao, et al.
Veröffentlicht: (2025)
Multi-agent KTO: Reinforcing Strategic Interactions of Large Language Model in Language Game
von: Ye, Rong, et al.
Veröffentlicht: (2025)
von: Ye, Rong, et al.
Veröffentlicht: (2025)
Multi-Turn Interactions for Text-to-SQL with Large Language Models
von: Xiong, Guanming, et al.
Veröffentlicht: (2024)
von: Xiong, Guanming, et al.
Veröffentlicht: (2024)
Reversible Diffusion Decoding for Diffusion Language Models
von: Wang, Xinyun, et al.
Veröffentlicht: (2026)
von: Wang, Xinyun, et al.
Veröffentlicht: (2026)
Large Language Model-Enhanced Multi-Armed Bandits
von: Sun, Jiahang, et al.
Veröffentlicht: (2025)
von: Sun, Jiahang, et al.
Veröffentlicht: (2025)
Beyond Single-Turn: A Survey on Multi-Turn Interactions with Large Language Models
von: Li, Yubo, et al.
Veröffentlicht: (2025)
von: Li, Yubo, et al.
Veröffentlicht: (2025)
Breaking Contextual Inertia: Reinforcement Learning with Single-Turn Anchors for Stable Multi-Turn Interaction
von: Chen, Xingwu, et al.
Veröffentlicht: (2026)
von: Chen, Xingwu, et al.
Veröffentlicht: (2026)
MetaForge: A Self-Evolving Multimodal Agent that Retrieves, Adapts, and Forges Tools On Demand
von: Wei, Shouang, et al.
Veröffentlicht: (2026)
von: Wei, Shouang, et al.
Veröffentlicht: (2026)
Reinforcement Learning with Promising Tokens for Large Language Models
von: Pang, Jing-Cheng, et al.
Veröffentlicht: (2026)
von: Pang, Jing-Cheng, et al.
Veröffentlicht: (2026)
Adaptive Stopping for Multi-Turn LLM Reasoning
von: Zhou, Xiaofan, et al.
Veröffentlicht: (2026)
von: Zhou, Xiaofan, et al.
Veröffentlicht: (2026)
ReviewInstruct: A Review-Driven Multi-Turn Conversations Generation Method for Large Language Models
von: Wu, Jiangxu, et al.
Veröffentlicht: (2025)
von: Wu, Jiangxu, et al.
Veröffentlicht: (2025)
HarmNet: A Framework for Adaptive Multi-Turn Jailbreak Attacks on Large Language Models
von: Narula, Sidhant, et al.
Veröffentlicht: (2025)
von: Narula, Sidhant, et al.
Veröffentlicht: (2025)
Interactive-KBQA: Multi-Turn Interactions for Knowledge Base Question Answering with Large Language Models
von: Xiong, Guanming, et al.
Veröffentlicht: (2024)
von: Xiong, Guanming, et al.
Veröffentlicht: (2024)
HAVE: Head-Adaptive Gating and ValuE Calibration for Hallucination Mitigation in Large Language Models
von: Tong, Xin, et al.
Veröffentlicht: (2025)
von: Tong, Xin, et al.
Veröffentlicht: (2025)
AEM: Adaptive Entropy Modulation for Multi-Turn Agentic Reinforcement Learning
von: Zhao, Haotian, et al.
Veröffentlicht: (2026)
von: Zhao, Haotian, et al.
Veröffentlicht: (2026)
Transient Turn Injection: Exposing Stateless Multi-Turn Vulnerabilities in Large Language Models
von: Rayhan, Naheed, et al.
Veröffentlicht: (2026)
von: Rayhan, Naheed, et al.
Veröffentlicht: (2026)
PAG: Multi-Turn Reinforced LLM Self-Correction with Policy as Generative Verifier
von: Jiang, Yuhua, et al.
Veröffentlicht: (2025)
von: Jiang, Yuhua, et al.
Veröffentlicht: (2025)
Unifying Large Language Model and Deep Reinforcement Learning for Human-in-Loop Interactive Socially-aware Navigation
von: Wang, Weizheng, et al.
Veröffentlicht: (2024)
von: Wang, Weizheng, et al.
Veröffentlicht: (2024)
AgentTutor: Empowering Personalized Learning with Multi-Turn Interactive Teaching in Intelligent Education Systems
von: Liu, Yuxin, et al.
Veröffentlicht: (2025)
von: Liu, Yuxin, et al.
Veröffentlicht: (2025)
SPL: A Socratic Playground for Learning Powered by Large Language Model
von: Zhang, Liang, et al.
Veröffentlicht: (2024)
von: Zhang, Liang, et al.
Veröffentlicht: (2024)
State-Dependent Safety Failures in Multi-Turn Language Model Interaction
von: Li, Pengcheng, et al.
Veröffentlicht: (2026)
von: Li, Pengcheng, et al.
Veröffentlicht: (2026)
Adaptive Multi-Subspace Representation Steering for Attribute Alignment in Large Language Models
von: Jiang, Xinyan, et al.
Veröffentlicht: (2025)
von: Jiang, Xinyan, et al.
Veröffentlicht: (2025)
Causal Agent based on Large Language Model
von: Han, Kairong, et al.
Veröffentlicht: (2024)
von: Han, Kairong, et al.
Veröffentlicht: (2024)
SPIRAL: Self-Play on Zero-Sum Games Incentivizes Reasoning via Multi-Agent Multi-Turn Reinforcement Learning
von: Liu, Bo, et al.
Veröffentlicht: (2025)
von: Liu, Bo, et al.
Veröffentlicht: (2025)
ZipRL: Adaptive Multi-Turn Context Compression with Hindsight Response Replay
von: Hu, Zhexin, et al.
Veröffentlicht: (2026)
von: Hu, Zhexin, et al.
Veröffentlicht: (2026)
Adaptive Reinforcement Learning Planning: Harnessing Large Language Models for Complex Information Extraction
von: Ding, Zepeng, et al.
Veröffentlicht: (2024)
von: Ding, Zepeng, et al.
Veröffentlicht: (2024)
Vision Inference Former: Sustaining Visual Consistency in Multimodal Large Language Models
von: Dong, Xinpeng, et al.
Veröffentlicht: (2026)
von: Dong, Xinpeng, et al.
Veröffentlicht: (2026)
MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
von: Bai, Ge, et al.
Veröffentlicht: (2024)
von: Bai, Ge, et al.
Veröffentlicht: (2024)
Adaptive Data Exploitation in Deep Reinforcement Learning
von: Yuan, Mingqi, et al.
Veröffentlicht: (2025)
von: Yuan, Mingqi, et al.
Veröffentlicht: (2025)
Turn-based Multi-Agent Reinforcement Learning Model Checking
von: Gross, Dennis
Veröffentlicht: (2025)
von: Gross, Dennis
Veröffentlicht: (2025)
Teaching LLMs for Step-Level Automatic Math Correction via Reinforcement Learning
von: Li, Junsong, et al.
Veröffentlicht: (2025)
von: Li, Junsong, et al.
Veröffentlicht: (2025)
SLEA-RL: Step-Level Experience Augmented Reinforcement Learning for Multi-Turn Agentic Training
von: Wang, Prince Zizhuang, et al.
Veröffentlicht: (2026)
von: Wang, Prince Zizhuang, et al.
Veröffentlicht: (2026)
MTMCS-Bench: Evaluating Contextual Safety of Multimodal Large Language Models in Multi-Turn Dialogues
von: Liu, Zheyuan, et al.
Veröffentlicht: (2026)
von: Liu, Zheyuan, et al.
Veröffentlicht: (2026)
Beyond the Assistant Turn: User Turn Generation as a Probe of Interaction Awareness in Language Models
von: Shekkizhar, Sarath, et al.
Veröffentlicht: (2026)
von: Shekkizhar, Sarath, et al.
Veröffentlicht: (2026)
Source Attribution for Large Language Model-Generated Data
von: Wang, Jingtan, et al.
Veröffentlicht: (2023)
von: Wang, Jingtan, et al.
Veröffentlicht: (2023)
RLFactory: A Plug-and-Play Reinforcement Learning Post-Training Framework for LLM Multi-Turn Tool-Use
von: Chai, Jiajun, et al.
Veröffentlicht: (2025)
von: Chai, Jiajun, et al.
Veröffentlicht: (2025)
Sketch Then Paint: Hierarchical Reinforcement Learning for Diffusion Multi-Modal Large Language Models
von: Luo, Siqi, et al.
Veröffentlicht: (2026)
von: Luo, Siqi, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
EduDial: Constructing a Large-scale Multi-turn Teacher-Student Dialogue Corpus
von: Wei, Shouang, et al.
Veröffentlicht: (2025) -
Words & Weights: Streamlining Multi-Turn Interactions via Co-Adaptation
von: Wei, Chenxing, et al.
Veröffentlicht: (2026) -
EduAgentQG: A Multi-Agent Workflow Framework for Personalized Question Generation
von: Jia, Rui, et al.
Veröffentlicht: (2025) -
Refining Adaptive Zeroth-Order Optimization at Ease
von: Shu, Yao, et al.
Veröffentlicht: (2025) -
Multi-agent KTO: Reinforcing Strategic Interactions of Large Language Model in Language Game
von: Ye, Rong, et al.
Veröffentlicht: (2025)