Words & Weights: Streamlining Multi-Turn Interactions via Co-Adaptation
Fuente:
arXiv
Salvato in:
| Autori principali: | Wei, Chenxing, Wang, Hong, He, Ying, Dai, Zhongxiang, Jiang, Bo, Yu, F. Richard, Shu, Yao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Flexora: Flexible Low Rank Adaptation for Large Language Models
di: Wei, Chenxing, et al.
Pubblicazione: (2024)
di: Wei, Chenxing, et al.
Pubblicazione: (2024)
UCO: A Multi-Turn Interactive Reinforcement Learning Method for Adaptive Teaching with Large Language Models
di: Wei, Shouang, et al.
Pubblicazione: (2025)
di: Wei, Shouang, et al.
Pubblicazione: (2025)
Test-Time Policy Adaptation for Enhanced Multi-Turn Interactions with LLMs
di: Wei, Chenxing, et al.
Pubblicazione: (2025)
di: Wei, Chenxing, et al.
Pubblicazione: (2025)
PAFT: Prompt-Agnostic Fine-Tuning
di: Wei, Chenxing, et al.
Pubblicazione: (2025)
di: Wei, Chenxing, et al.
Pubblicazione: (2025)
LFPO: Likelihood-Free Policy Optimization for Masked Diffusion Models
di: Wei, Chenxing, et al.
Pubblicazione: (2026)
di: Wei, Chenxing, et al.
Pubblicazione: (2026)
Refining Adaptive Zeroth-Order Optimization at Ease
di: Shu, Yao, et al.
Pubblicazione: (2025)
di: Shu, Yao, et al.
Pubblicazione: (2025)
Reference-Sampled Boltzmann Projection for KL-Regularized RLVR: Target-Matched Weighted SFT, Finite One-Shot Gaps, and Policy Mirror Descent
di: Shu, Yao, et al.
Pubblicazione: (2026)
di: Shu, Yao, et al.
Pubblicazione: (2026)
ReDit: Reward Dithering for Improved LLM Policy Optimization
di: Wei, Chenxing, et al.
Pubblicazione: (2025)
di: Wei, Chenxing, et al.
Pubblicazione: (2025)
SAGE: Multi-Agent Self-Evolution for LLM Reasoning
di: Peng, Yulin, et al.
Pubblicazione: (2026)
di: Peng, Yulin, et al.
Pubblicazione: (2026)
MathChat: Benchmarking Mathematical Reasoning and Instruction Following in Multi-Turn Interactions
di: Liang, Zhenwen, et al.
Pubblicazione: (2024)
di: Liang, Zhenwen, et al.
Pubblicazione: (2024)
MASPOB: Bandit-Based Prompt Optimization for Multi-Agent Systems with Graph Neural Networks
di: Hong, Zhi, et al.
Pubblicazione: (2026)
di: Hong, Zhi, et al.
Pubblicazione: (2026)
Evaluating Memory in LLM Agents via Incremental Multi-Turn Interactions
di: Hu, Yuanzhe, et al.
Pubblicazione: (2025)
di: Hu, Yuanzhe, et al.
Pubblicazione: (2025)
Beyond Single-Turn: A Survey on Multi-Turn Interactions with Large Language Models
di: Li, Yubo, et al.
Pubblicazione: (2025)
di: Li, Yubo, et al.
Pubblicazione: (2025)
CoPEFT: Fast Adaptation Framework for Multi-Agent Collaborative Perception with Parameter-Efficient Fine-Tuning
di: Wei, Quanmin, et al.
Pubblicazione: (2025)
di: Wei, Quanmin, et al.
Pubblicazione: (2025)
MedKGEval: A Knowledge Graph-Based Multi-Turn Evaluation Framework for Open-Ended Patient Interactions with Clinical LLMs
di: Yu, Yuechun, et al.
Pubblicazione: (2025)
di: Yu, Yuechun, et al.
Pubblicazione: (2025)
MOTIF: Multi-strategy Optimization via Turn-based Interactive Framework
di: Kiet, Nguyen Viet Tuan, et al.
Pubblicazione: (2025)
di: Kiet, Nguyen Viet Tuan, et al.
Pubblicazione: (2025)
FedPOB: Sample-Efficient Federated Prompt Optimization via Bandits
di: Lu, Pingchen, et al.
Pubblicazione: (2025)
di: Lu, Pingchen, et al.
Pubblicazione: (2025)
EduAgentQG: A Multi-Agent Workflow Framework for Personalized Question Generation
di: Jia, Rui, et al.
Pubblicazione: (2025)
di: Jia, Rui, et al.
Pubblicazione: (2025)
Thinker: Training LLMs in Hierarchical Thinking for Deep Search via Multi-Turn Interaction
di: Xu, Jun, et al.
Pubblicazione: (2025)
di: Xu, Jun, et al.
Pubblicazione: (2025)
CoSafe: Evaluating Large Language Model Safety in Multi-Turn Dialogue Coreference
di: Yu, Erxin, et al.
Pubblicazione: (2024)
di: Yu, Erxin, et al.
Pubblicazione: (2024)
Information Gain-based Policy Optimization: A Simple and Effective Approach for Multi-Turn Search Agents
di: Wang, Guoqing, et al.
Pubblicazione: (2025)
di: Wang, Guoqing, et al.
Pubblicazione: (2025)
Adaptive Stopping for Multi-Turn LLM Reasoning
di: Zhou, Xiaofan, et al.
Pubblicazione: (2026)
di: Zhou, Xiaofan, et al.
Pubblicazione: (2026)
Sketch: A Toolkit for Streamlining LLM Operations
di: Jiang, Xin, et al.
Pubblicazione: (2024)
di: Jiang, Xin, et al.
Pubblicazione: (2024)
OptEx: Expediting First-Order Optimization with Approximately Parallelized Iterations
di: Shu, Yao, et al.
Pubblicazione: (2024)
di: Shu, Yao, et al.
Pubblicazione: (2024)
JAM: Keypoint-Guided Joint Prediction after Classification-Aware Marginal Proposal for Multi-Agent Interaction
di: Lin, Fangze, et al.
Pubblicazione: (2025)
di: Lin, Fangze, et al.
Pubblicazione: (2025)
Scheduling Your LLM Reinforcement Learning with Reasoning Trees
di: Wang, Hong, et al.
Pubblicazione: (2025)
di: Wang, Hong, et al.
Pubblicazione: (2025)
Localized Zeroth-Order Prompt Optimization
di: Hu, Wenyang, et al.
Pubblicazione: (2024)
di: Hu, Wenyang, et al.
Pubblicazione: (2024)
State-Dependent Safety Failures in Multi-Turn Language Model Interaction
di: Li, Pengcheng, et al.
Pubblicazione: (2026)
di: Li, Pengcheng, et al.
Pubblicazione: (2026)
Multi-Turn Interactions for Text-to-SQL with Large Language Models
di: Xiong, Guanming, et al.
Pubblicazione: (2024)
di: Xiong, Guanming, et al.
Pubblicazione: (2024)
RSAgent: Learning to Reason and Act for Text-Guided Segmentation via Multi-Turn Tool Invocations
di: He, Xingqi, et al.
Pubblicazione: (2025)
di: He, Xingqi, et al.
Pubblicazione: (2025)
SLOW: Strategic Logical-inference Open Workspace for Cognitive Adaptation in AI Tutoring
di: Wei, Yuang, et al.
Pubblicazione: (2026)
di: Wei, Yuang, et al.
Pubblicazione: (2026)
Building Coding Agents via Entropy-Enhanced Multi-Turn Preference Optimization
di: Yu, Jiahao, et al.
Pubblicazione: (2025)
di: Yu, Jiahao, et al.
Pubblicazione: (2025)
Breaking Contextual Inertia: Reinforcement Learning with Single-Turn Anchors for Stable Multi-Turn Interaction
di: Chen, Xingwu, et al.
Pubblicazione: (2026)
di: Chen, Xingwu, et al.
Pubblicazione: (2026)
Hybrid AI for Responsive Multi-Turn Online Conversations with Novel Dynamic Routing and Feedback Adaptation
di: Pattnayak, Priyaranjan, et al.
Pubblicazione: (2025)
di: Pattnayak, Priyaranjan, et al.
Pubblicazione: (2025)
Whom to Query for What: Adaptive Group Elicitation via Multi-Turn LLM Interactions
di: Ding, Ruomeng, et al.
Pubblicazione: (2026)
di: Ding, Ruomeng, et al.
Pubblicazione: (2026)
OrchDAG: Complex Tool Orchestration in Multi-Turn Interactions with Plan DAGs
di: Lu, Yifu, et al.
Pubblicazione: (2025)
di: Lu, Yifu, et al.
Pubblicazione: (2025)
Drift No More? Context Equilibria in Multi-Turn LLM Interactions
di: Dongre, Vardhan, et al.
Pubblicazione: (2025)
di: Dongre, Vardhan, et al.
Pubblicazione: (2025)
Not All Turns Matter: Credit Assignment for Multi-Turn Jailbreaking
di: He, Zhida, et al.
Pubblicazione: (2026)
di: He, Zhida, et al.
Pubblicazione: (2026)
InterMT: Multi-Turn Interleaved Preference Alignment with Human Feedback
di: Chen, Boyuan, et al.
Pubblicazione: (2025)
di: Chen, Boyuan, et al.
Pubblicazione: (2025)
Towards Effective Fusion and Forecasting of Multimodal Spatio-temporal Data for Smart Mobility
di: Wang, Chenxing
Pubblicazione: (2024)
di: Wang, Chenxing
Pubblicazione: (2024)
Documenti analoghi
-
Flexora: Flexible Low Rank Adaptation for Large Language Models
di: Wei, Chenxing, et al.
Pubblicazione: (2024) -
UCO: A Multi-Turn Interactive Reinforcement Learning Method for Adaptive Teaching with Large Language Models
di: Wei, Shouang, et al.
Pubblicazione: (2025) -
Test-Time Policy Adaptation for Enhanced Multi-Turn Interactions with LLMs
di: Wei, Chenxing, et al.
Pubblicazione: (2025) -
PAFT: Prompt-Agnostic Fine-Tuning
di: Wei, Chenxing, et al.
Pubblicazione: (2025) -
LFPO: Likelihood-Free Policy Optimization for Masked Diffusion Models
di: Wei, Chenxing, et al.
Pubblicazione: (2026)