A Comprehensive Evaluation of LLM Unlearning Robustness under Multi-Turn Interaction
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pan, Ruihao, Wang, Suhang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ICCU: In-Context Continual Unlearning via Pattern-Induced Refusal Rules
par: Pan, Ruihao, et autres
Publié: (2026)
par: Pan, Ruihao, et autres
Publié: (2026)
Evaluating Memory in LLM Agents via Incremental Multi-Turn Interactions
par: Hu, Yuanzhe, et autres
Publié: (2025)
par: Hu, Yuanzhe, et autres
Publié: (2025)
Catastrophic Failure of LLM Unlearning via Quantization
par: Zhang, Zhiwei, et autres
Publié: (2024)
par: Zhang, Zhiwei, et autres
Publié: (2024)
Evaluating LLM-based Agents for Multi-Turn Conversations: A Survey
par: Guan, Shengyue, et autres
Publié: (2025)
par: Guan, Shengyue, et autres
Publié: (2025)
Drift No More? Context Equilibria in Multi-Turn LLM Interactions
par: Dongre, Vardhan, et autres
Publié: (2025)
par: Dongre, Vardhan, et autres
Publié: (2025)
Dual-Space Smoothness for Robust and Balanced LLM Unlearning
par: Yan, Han, et autres
Publié: (2025)
par: Yan, Han, et autres
Publié: (2025)
Beyond Single-Turn: A Survey on Multi-Turn Interactions with Large Language Models
par: Li, Yubo, et autres
Publié: (2025)
par: Li, Yubo, et autres
Publié: (2025)
Offline Policy Evaluation of Multi-Turn LLM Health Coaching with Real Users
par: Ozolcer, Melik, et autres
Publié: (2025)
par: Ozolcer, Melik, et autres
Publié: (2025)
The Slow Drift of Support: Boundary Failures in Multi-Turn Mental Health LLM Dialogues
par: Cheng, Youyou, et autres
Publié: (2026)
par: Cheng, Youyou, et autres
Publié: (2026)
Adaptive Stopping for Multi-Turn LLM Reasoning
par: Zhou, Xiaofan, et autres
Publié: (2026)
par: Zhou, Xiaofan, et autres
Publié: (2026)
Robust LLM Unlearning with MUDMAN: Meta-Unlearning with Disruption Masking And Normalization
par: Sondej, Filip, et autres
Publié: (2025)
par: Sondej, Filip, et autres
Publié: (2025)
Drift-Bench: Diagnosing Cooperative Breakdowns in LLM Agents under Input Faults via Multi-Turn Interaction
par: Bao, Han, et autres
Publié: (2026)
par: Bao, Han, et autres
Publié: (2026)
Breaking Contextual Inertia: Reinforcement Learning with Single-Turn Anchors for Stable Multi-Turn Interaction
par: Chen, Xingwu, et autres
Publié: (2026)
par: Chen, Xingwu, et autres
Publié: (2026)
Unveiling the Impact of Multi-Modal Interactions on User Engagement: A Comprehensive Evaluation in AI-driven Conversations
par: Zhang, Lichao, et autres
Publié: (2024)
par: Zhang, Lichao, et autres
Publié: (2024)
Towards Understanding the Robustness of LLM-based Evaluations under Perturbations
par: Chaudhary, Manav, et autres
Publié: (2024)
par: Chaudhary, Manav, et autres
Publié: (2024)
CA-BERT: Leveraging Context Awareness for Enhanced Multi-Turn Chat Interaction
par: Liu, Minghao, et autres
Publié: (2024)
par: Liu, Minghao, et autres
Publié: (2024)
A Comprehensive Survey on Reinforcement Learning-based Agentic Search: Foundations, Roles, Optimizations, Evaluations, and Applications
par: Lin, Minhua, et autres
Publié: (2025)
par: Lin, Minhua, et autres
Publié: (2025)
JAL-Turn: Joint Acoustic-Linguistic Modeling for Real-Time and Robust Turn-Taking Detection in Full-Duplex Spoken Dialogue Systems
par: Yang, Guangzhao, et autres
Publié: (2026)
par: Yang, Guangzhao, et autres
Publié: (2026)
Thinker: Training LLMs in Hierarchical Thinking for Deep Search via Multi-Turn Interaction
par: Xu, Jun, et autres
Publié: (2025)
par: Xu, Jun, et autres
Publié: (2025)
A Comprehensive Survey of Machine Unlearning Techniques for Large Language Models
par: Geng, Jiahui, et autres
Publié: (2025)
par: Geng, Jiahui, et autres
Publié: (2025)
MERA: A Comprehensive LLM Evaluation in Russian
par: Fenogenova, Alena, et autres
Publié: (2024)
par: Fenogenova, Alena, et autres
Publié: (2024)
MTRouter: Cost-Aware Multi-Turn LLM Routing with History-Model Joint Embeddings
par: Zhang, Yiqun, et autres
Publié: (2026)
par: Zhang, Yiqun, et autres
Publié: (2026)
CostBench: Evaluating Multi-Turn Cost-Optimal Planning and Adaptation in Dynamic Environments for LLM Tool-Use Agents
par: Liu, Jiayu, et autres
Publié: (2025)
par: Liu, Jiayu, et autres
Publié: (2025)
When Attention Closes: How LLMs Lose the Thread in Multi-Turn Interaction
par: Dongre, Vardhan, et autres
Publié: (2026)
par: Dongre, Vardhan, et autres
Publié: (2026)
MultiChallenge: A Realistic Multi-Turn Conversation Evaluation Benchmark Challenging to Frontier LLMs
par: Sirdeshmukh, Ved, et autres
Publié: (2025)
par: Sirdeshmukh, Ved, et autres
Publié: (2025)
MTalk-Bench: Evaluating Speech-to-Speech Models in Multi-Turn Dialogues via Arena-style and Rubrics Protocols
par: Du, Yuhao, et autres
Publié: (2025)
par: Du, Yuhao, et autres
Publié: (2025)
Models Recall What They Violate: Constraint Adherence in Multi-Turn LLM Ideation
par: Kruthof, Garvin
Publié: (2026)
par: Kruthof, Garvin
Publié: (2026)
LLM-Driven Multi-Turn Task-Oriented Dialogue Synthesis for Realistic Reasoning
par: Zhu, Yu, et autres
Publié: (2026)
par: Zhu, Yu, et autres
Publié: (2026)
Unlocking the Power of Multi-Agent LLM for Reasoning: From Lazy Agents to Deliberation
par: Zhang, Zhiwei, et autres
Publié: (2025)
par: Zhang, Zhiwei, et autres
Publié: (2025)
Towards Fair and Comprehensive Evaluation of Routers in Collaborative LLM Systems
par: Wu, Wanxing, et autres
Publié: (2026)
par: Wu, Wanxing, et autres
Publié: (2026)
CoSafe: Evaluating Large Language Model Safety in Multi-Turn Dialogue Coreference
par: Yu, Erxin, et autres
Publié: (2024)
par: Yu, Erxin, et autres
Publié: (2024)
LoopServe: An Adaptive Dual-phase LLM Inference Acceleration System for Multi-Turn Dialogues
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
Agents Are All You Need for LLM Unlearning
par: Sanyal, Debdeep, et autres
Publié: (2025)
par: Sanyal, Debdeep, et autres
Publié: (2025)
Easy Turn: Integrating Acoustic and Linguistic Modalities for Robust Turn-Taking in Full-Duplex Spoken Dialogue Systems
par: Li, Guojian, et autres
Publié: (2025)
par: Li, Guojian, et autres
Publié: (2025)
MTRAG: A Multi-Turn Conversational Benchmark for Evaluating Retrieval-Augmented Generation Systems
par: Katsis, Yannis, et autres
Publié: (2025)
par: Katsis, Yannis, et autres
Publié: (2025)
StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns
par: Wan, Luanbo, et autres
Publié: (2025)
par: Wan, Luanbo, et autres
Publié: (2025)
A Functionality-Grounded Benchmark for Evaluating Web Agents in E-commerce Domains
par: Zhang, Xianren, et autres
Publié: (2025)
par: Zhang, Xianren, et autres
Publié: (2025)
MEOW: MEMOry Supervised LLM Unlearning Via Inverted Facts
par: Gu, Tianle, et autres
Publié: (2024)
par: Gu, Tianle, et autres
Publié: (2024)
Beyond One-Way Influence: Bidirectional Opinion Dynamics in Multi-Turn Human-LLM Interactions
par: Jiang, Yuyang, et autres
Publié: (2025)
par: Jiang, Yuyang, et autres
Publié: (2025)
SurveyEval: Towards Comprehensive Evaluation of LLM-Generated Academic Surveys
par: Zhao, Jiahao, et autres
Publié: (2025)
par: Zhao, Jiahao, et autres
Publié: (2025)
Documents similaires
-
ICCU: In-Context Continual Unlearning via Pattern-Induced Refusal Rules
par: Pan, Ruihao, et autres
Publié: (2026) -
Evaluating Memory in LLM Agents via Incremental Multi-Turn Interactions
par: Hu, Yuanzhe, et autres
Publié: (2025) -
Catastrophic Failure of LLM Unlearning via Quantization
par: Zhang, Zhiwei, et autres
Publié: (2024) -
Evaluating LLM-based Agents for Multi-Turn Conversations: A Survey
par: Guan, Shengyue, et autres
Publié: (2025) -
Drift No More? Context Equilibria in Multi-Turn LLM Interactions
par: Dongre, Vardhan, et autres
Publié: (2025)