A General Framework to Enhance Fine-tuning-based LLM Unlearning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ren, Jie, Dai, Zhenwei, Tang, Xianfeng, Liu, Hui, Zeng, Jingying, Li, Zhen, Goutam, Rahul, Wang, Suhang, Xing, Yue, He, Qi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Keeping an Eye on LLM Unlearning: The Hidden Risk and Remedy
par: Ren, Jie, et autres
Publié: (2025)
par: Ren, Jie, et autres
Publié: (2025)
Cite Before You Speak: Enhancing Context-Response Grounding in E-commerce Conversational LLM-Agents
par: Zeng, Jingying, et autres
Publié: (2025)
par: Zeng, Jingying, et autres
Publié: (2025)
To trust or not to trust: Attention-based Trust Management for LLM Multi-Agent Systems
par: He, Pengfei, et autres
Publié: (2025)
par: He, Pengfei, et autres
Publié: (2025)
Examples as the Prompt: A Scalable Approach for Efficient LLM Adaptation in E-Commerce
par: Zeng, Jingying, et autres
Publié: (2025)
par: Zeng, Jingying, et autres
Publié: (2025)
Adaptive Test-Time Reasoning via Reward-Guided Dual-Phase Search
par: Cui, Yingqian, et autres
Publié: (2025)
par: Cui, Yingqian, et autres
Publié: (2025)
How Far are LLMs from Real Search? A Comprehensive Study on Efficiency, Completeness, and Inherent Capabilities
par: Lin, Minhua, et autres
Publié: (2025)
par: Lin, Minhua, et autres
Publié: (2025)
AgentTTS: Large Language Model Agent for Test-time Compute-optimal Scaling Strategy in Complex Tasks
par: Wang, Fali, et autres
Publié: (2025)
par: Wang, Fali, et autres
Publié: (2025)
Stepwise Perplexity-Guided Refinement for Efficient Chain-of-Thought Reasoning in Large Language Models
par: Cui, Yingqian, et autres
Publié: (2025)
par: Cui, Yingqian, et autres
Publié: (2025)
Catastrophic Failure of LLM Unlearning via Quantization
par: Zhang, Zhiwei, et autres
Publié: (2024)
par: Zhang, Zhiwei, et autres
Publié: (2024)
SUA: Stealthy Multimodal Large Language Model Unlearning Attack
par: Zhang, Xianren, et autres
Publié: (2025)
par: Zhang, Xianren, et autres
Publié: (2025)
Bradley-Terry and Multi-Objective Reward Modeling Are Complementary
par: Zhang, Zhiwei, et autres
Publié: (2025)
par: Zhang, Zhiwei, et autres
Publié: (2025)
Comprehensive Vulnerability Analysis is Necessary for Trustworthy LLM-MAS
par: He, Pengfei, et autres
Publié: (2025)
par: He, Pengfei, et autres
Publié: (2025)
A Survey of Calibration Process for Black-Box LLMs
par: Xie, Liangru, et autres
Publié: (2024)
par: Xie, Liangru, et autres
Publié: (2024)
How Far Are LLMs from Professional Poker Players? Revisiting Game-Theoretic Reasoning with Agentic Tool Use
par: Lin, Minhua, et autres
Publié: (2026)
par: Lin, Minhua, et autres
Publié: (2026)
Exploring Memorization in Fine-tuned Language Models
par: Zeng, Shenglai, et autres
Publié: (2023)
par: Zeng, Shenglai, et autres
Publié: (2023)
TRAJECT-Bench:A Trajectory-Aware Benchmark for Evaluating Agentic Tool Use
par: He, Pengfei, et autres
Publié: (2025)
par: He, Pengfei, et autres
Publié: (2025)
SoK: Machine Unlearning for Large Language Models
par: Ren, Jie, et autres
Publié: (2025)
par: Ren, Jie, et autres
Publié: (2025)
Towards Context-Robust LLMs: A Gated Representation Fine-tuning Approach
par: Zeng, Shenglai, et autres
Publié: (2025)
par: Zeng, Shenglai, et autres
Publié: (2025)
Divide-Verify-Refine: Can LLMs Self-Align with Complex Instructions?
par: Zhang, Xianren, et autres
Publié: (2024)
par: Zhang, Xianren, et autres
Publié: (2024)
FT-Shield: A Watermark Against Unauthorized Fine-tuning in Text-to-Image Diffusion Models
par: Cui, Yingqian, et autres
Publié: (2023)
par: Cui, Yingqian, et autres
Publié: (2023)
Beyond Text: Unveiling Privacy Vulnerabilities in Multi-modal Retrieval-Augmented Generation
par: Zhang, Jiankun, et autres
Publié: (2025)
par: Zhang, Jiankun, et autres
Publié: (2025)
Exploring Query Understanding for Amazon Product Search
par: Luo, Chen, et autres
Publié: (2024)
par: Luo, Chen, et autres
Publié: (2024)
Seeing but Not Believing: Probing the Disconnect Between Visual Attention and Answer Correctness in VLMs
par: Liu, Zhining, et autres
Publié: (2025)
par: Liu, Zhining, et autres
Publié: (2025)
Learning Fair Models without Sensitive Attributes: A Generative Approach
par: Zhu, Huaisheng, et autres
Publié: (2022)
par: Zhu, Huaisheng, et autres
Publié: (2022)
MemMA: Coordinating the Memory Cycle through Multi-Agent Reasoning and In-Situ Self-Evolution
par: Lin, Minhua, et autres
Publié: (2026)
par: Lin, Minhua, et autres
Publié: (2026)
A Comprehensive Survey on Reinforcement Learning-based Agentic Search: Foundations, Roles, Optimizations, Evaluations, and Applications
par: Lin, Minhua, et autres
Publié: (2025)
par: Lin, Minhua, et autres
Publié: (2025)
Generalizing Test-time Compute-optimal Scaling as an Optimizable Graph
par: Wang, Fali, et autres
Publié: (2025)
par: Wang, Fali, et autres
Publié: (2025)
Unlocking the Power of Multi-Agent LLM for Reasoning: From Lazy Agents to Deliberation
par: Zhang, Zhiwei, et autres
Publié: (2025)
par: Zhang, Zhiwei, et autres
Publié: (2025)
Can Pre-training Indicators Reliably Predict Fine-tuning Outcomes of LLMs?
par: Zeng, Hansi, et autres
Publié: (2025)
par: Zeng, Hansi, et autres
Publié: (2025)
A Comprehensive Evaluation of LLM Unlearning Robustness under Multi-Turn Interaction
par: Pan, Ruihao, et autres
Publié: (2026)
par: Pan, Ruihao, et autres
Publié: (2026)
Harnessing the Unseen: The Hidden Influence of Intrinsic Knowledge in Long-Context Language Models
par: Fu, Yu, et autres
Publié: (2025)
par: Fu, Yu, et autres
Publié: (2025)
Learning with Less: Knowledge Distillation from Large Language Models via Unlabeled Data
par: Li, Juanhui, et autres
Publié: (2024)
par: Li, Juanhui, et autres
Publié: (2024)
SimRAG: Self-Improving Retrieval-Augmented Generation for Adapting Large Language Models to Specialized Domains
par: Xu, Ran, et autres
Publié: (2024)
par: Xu, Ran, et autres
Publié: (2024)
Code Less, Align More: Efficient LLM Fine-tuning for Code Generation with Data Pruning
par: Tsai, Yun-Da, et autres
Publié: (2024)
par: Tsai, Yun-Da, et autres
Publié: (2024)
EFUF: Efficient Fine-grained Unlearning Framework for Mitigating Hallucinations in Multimodal Large Language Models
par: Xing, Shangyu, et autres
Publié: (2024)
par: Xing, Shangyu, et autres
Publié: (2024)
DiffusionShield: A Watermark for Copyright Protection against Generative Diffusion Models
par: Cui, Yingqian, et autres
Publié: (2023)
par: Cui, Yingqian, et autres
Publié: (2023)
Towards the Resistance of Neural Network Watermarking to Fine-tuning
par: Tang, Ling, et autres
Publié: (2025)
par: Tang, Ling, et autres
Publié: (2025)
Position: Agentic Evolution is the Path to Evolving LLMs
par: Lin, Minhua, et autres
Publié: (2026)
par: Lin, Minhua, et autres
Publié: (2026)
Hierarchical Query Classification in E-commerce Search
par: He, Bing, et autres
Publié: (2024)
par: He, Bing, et autres
Publié: (2024)
Attack by Unlearning: Unlearning-Induced Adversarial Attacks on Graph Neural Networks
par: Zhang, Jiahao, et autres
Publié: (2026)
par: Zhang, Jiahao, et autres
Publié: (2026)
Documents similaires
-
Keeping an Eye on LLM Unlearning: The Hidden Risk and Remedy
par: Ren, Jie, et autres
Publié: (2025) -
Cite Before You Speak: Enhancing Context-Response Grounding in E-commerce Conversational LLM-Agents
par: Zeng, Jingying, et autres
Publié: (2025) -
To trust or not to trust: Attention-based Trust Management for LLM Multi-Agent Systems
par: He, Pengfei, et autres
Publié: (2025) -
Examples as the Prompt: A Scalable Approach for Efficient LLM Adaptation in E-Commerce
par: Zeng, Jingying, et autres
Publié: (2025) -
Adaptive Test-Time Reasoning via Reward-Guided Dual-Phase Search
par: Cui, Yingqian, et autres
Publié: (2025)