A General Framework to Enhance Fine-tuning-based LLM Unlearning
Fuente:
arXiv
Salvato in:
| Autori principali: | Ren, Jie, Dai, Zhenwei, Tang, Xianfeng, Liu, Hui, Zeng, Jingying, Li, Zhen, Goutam, Rahul, Wang, Suhang, Xing, Yue, He, Qi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Keeping an Eye on LLM Unlearning: The Hidden Risk and Remedy
di: Ren, Jie, et al.
Pubblicazione: (2025)
di: Ren, Jie, et al.
Pubblicazione: (2025)
Cite Before You Speak: Enhancing Context-Response Grounding in E-commerce Conversational LLM-Agents
di: Zeng, Jingying, et al.
Pubblicazione: (2025)
di: Zeng, Jingying, et al.
Pubblicazione: (2025)
To trust or not to trust: Attention-based Trust Management for LLM Multi-Agent Systems
di: He, Pengfei, et al.
Pubblicazione: (2025)
di: He, Pengfei, et al.
Pubblicazione: (2025)
Examples as the Prompt: A Scalable Approach for Efficient LLM Adaptation in E-Commerce
di: Zeng, Jingying, et al.
Pubblicazione: (2025)
di: Zeng, Jingying, et al.
Pubblicazione: (2025)
Adaptive Test-Time Reasoning via Reward-Guided Dual-Phase Search
di: Cui, Yingqian, et al.
Pubblicazione: (2025)
di: Cui, Yingqian, et al.
Pubblicazione: (2025)
How Far are LLMs from Real Search? A Comprehensive Study on Efficiency, Completeness, and Inherent Capabilities
di: Lin, Minhua, et al.
Pubblicazione: (2025)
di: Lin, Minhua, et al.
Pubblicazione: (2025)
AgentTTS: Large Language Model Agent for Test-time Compute-optimal Scaling Strategy in Complex Tasks
di: Wang, Fali, et al.
Pubblicazione: (2025)
di: Wang, Fali, et al.
Pubblicazione: (2025)
Stepwise Perplexity-Guided Refinement for Efficient Chain-of-Thought Reasoning in Large Language Models
di: Cui, Yingqian, et al.
Pubblicazione: (2025)
di: Cui, Yingqian, et al.
Pubblicazione: (2025)
Catastrophic Failure of LLM Unlearning via Quantization
di: Zhang, Zhiwei, et al.
Pubblicazione: (2024)
di: Zhang, Zhiwei, et al.
Pubblicazione: (2024)
SUA: Stealthy Multimodal Large Language Model Unlearning Attack
di: Zhang, Xianren, et al.
Pubblicazione: (2025)
di: Zhang, Xianren, et al.
Pubblicazione: (2025)
Bradley-Terry and Multi-Objective Reward Modeling Are Complementary
di: Zhang, Zhiwei, et al.
Pubblicazione: (2025)
di: Zhang, Zhiwei, et al.
Pubblicazione: (2025)
Comprehensive Vulnerability Analysis is Necessary for Trustworthy LLM-MAS
di: He, Pengfei, et al.
Pubblicazione: (2025)
di: He, Pengfei, et al.
Pubblicazione: (2025)
A Survey of Calibration Process for Black-Box LLMs
di: Xie, Liangru, et al.
Pubblicazione: (2024)
di: Xie, Liangru, et al.
Pubblicazione: (2024)
How Far Are LLMs from Professional Poker Players? Revisiting Game-Theoretic Reasoning with Agentic Tool Use
di: Lin, Minhua, et al.
Pubblicazione: (2026)
di: Lin, Minhua, et al.
Pubblicazione: (2026)
Exploring Memorization in Fine-tuned Language Models
di: Zeng, Shenglai, et al.
Pubblicazione: (2023)
di: Zeng, Shenglai, et al.
Pubblicazione: (2023)
TRAJECT-Bench:A Trajectory-Aware Benchmark for Evaluating Agentic Tool Use
di: He, Pengfei, et al.
Pubblicazione: (2025)
di: He, Pengfei, et al.
Pubblicazione: (2025)
SoK: Machine Unlearning for Large Language Models
di: Ren, Jie, et al.
Pubblicazione: (2025)
di: Ren, Jie, et al.
Pubblicazione: (2025)
Towards Context-Robust LLMs: A Gated Representation Fine-tuning Approach
di: Zeng, Shenglai, et al.
Pubblicazione: (2025)
di: Zeng, Shenglai, et al.
Pubblicazione: (2025)
Divide-Verify-Refine: Can LLMs Self-Align with Complex Instructions?
di: Zhang, Xianren, et al.
Pubblicazione: (2024)
di: Zhang, Xianren, et al.
Pubblicazione: (2024)
FT-Shield: A Watermark Against Unauthorized Fine-tuning in Text-to-Image Diffusion Models
di: Cui, Yingqian, et al.
Pubblicazione: (2023)
di: Cui, Yingqian, et al.
Pubblicazione: (2023)
Beyond Text: Unveiling Privacy Vulnerabilities in Multi-modal Retrieval-Augmented Generation
di: Zhang, Jiankun, et al.
Pubblicazione: (2025)
di: Zhang, Jiankun, et al.
Pubblicazione: (2025)
Exploring Query Understanding for Amazon Product Search
di: Luo, Chen, et al.
Pubblicazione: (2024)
di: Luo, Chen, et al.
Pubblicazione: (2024)
Seeing but Not Believing: Probing the Disconnect Between Visual Attention and Answer Correctness in VLMs
di: Liu, Zhining, et al.
Pubblicazione: (2025)
di: Liu, Zhining, et al.
Pubblicazione: (2025)
Learning Fair Models without Sensitive Attributes: A Generative Approach
di: Zhu, Huaisheng, et al.
Pubblicazione: (2022)
di: Zhu, Huaisheng, et al.
Pubblicazione: (2022)
MemMA: Coordinating the Memory Cycle through Multi-Agent Reasoning and In-Situ Self-Evolution
di: Lin, Minhua, et al.
Pubblicazione: (2026)
di: Lin, Minhua, et al.
Pubblicazione: (2026)
A Comprehensive Survey on Reinforcement Learning-based Agentic Search: Foundations, Roles, Optimizations, Evaluations, and Applications
di: Lin, Minhua, et al.
Pubblicazione: (2025)
di: Lin, Minhua, et al.
Pubblicazione: (2025)
Generalizing Test-time Compute-optimal Scaling as an Optimizable Graph
di: Wang, Fali, et al.
Pubblicazione: (2025)
di: Wang, Fali, et al.
Pubblicazione: (2025)
Unlocking the Power of Multi-Agent LLM for Reasoning: From Lazy Agents to Deliberation
di: Zhang, Zhiwei, et al.
Pubblicazione: (2025)
di: Zhang, Zhiwei, et al.
Pubblicazione: (2025)
Can Pre-training Indicators Reliably Predict Fine-tuning Outcomes of LLMs?
di: Zeng, Hansi, et al.
Pubblicazione: (2025)
di: Zeng, Hansi, et al.
Pubblicazione: (2025)
A Comprehensive Evaluation of LLM Unlearning Robustness under Multi-Turn Interaction
di: Pan, Ruihao, et al.
Pubblicazione: (2026)
di: Pan, Ruihao, et al.
Pubblicazione: (2026)
Harnessing the Unseen: The Hidden Influence of Intrinsic Knowledge in Long-Context Language Models
di: Fu, Yu, et al.
Pubblicazione: (2025)
di: Fu, Yu, et al.
Pubblicazione: (2025)
Learning with Less: Knowledge Distillation from Large Language Models via Unlabeled Data
di: Li, Juanhui, et al.
Pubblicazione: (2024)
di: Li, Juanhui, et al.
Pubblicazione: (2024)
SimRAG: Self-Improving Retrieval-Augmented Generation for Adapting Large Language Models to Specialized Domains
di: Xu, Ran, et al.
Pubblicazione: (2024)
di: Xu, Ran, et al.
Pubblicazione: (2024)
Code Less, Align More: Efficient LLM Fine-tuning for Code Generation with Data Pruning
di: Tsai, Yun-Da, et al.
Pubblicazione: (2024)
di: Tsai, Yun-Da, et al.
Pubblicazione: (2024)
EFUF: Efficient Fine-grained Unlearning Framework for Mitigating Hallucinations in Multimodal Large Language Models
di: Xing, Shangyu, et al.
Pubblicazione: (2024)
di: Xing, Shangyu, et al.
Pubblicazione: (2024)
DiffusionShield: A Watermark for Copyright Protection against Generative Diffusion Models
di: Cui, Yingqian, et al.
Pubblicazione: (2023)
di: Cui, Yingqian, et al.
Pubblicazione: (2023)
Towards the Resistance of Neural Network Watermarking to Fine-tuning
di: Tang, Ling, et al.
Pubblicazione: (2025)
di: Tang, Ling, et al.
Pubblicazione: (2025)
Position: Agentic Evolution is the Path to Evolving LLMs
di: Lin, Minhua, et al.
Pubblicazione: (2026)
di: Lin, Minhua, et al.
Pubblicazione: (2026)
Hierarchical Query Classification in E-commerce Search
di: He, Bing, et al.
Pubblicazione: (2024)
di: He, Bing, et al.
Pubblicazione: (2024)
Attack by Unlearning: Unlearning-Induced Adversarial Attacks on Graph Neural Networks
di: Zhang, Jiahao, et al.
Pubblicazione: (2026)
di: Zhang, Jiahao, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Keeping an Eye on LLM Unlearning: The Hidden Risk and Remedy
di: Ren, Jie, et al.
Pubblicazione: (2025) -
Cite Before You Speak: Enhancing Context-Response Grounding in E-commerce Conversational LLM-Agents
di: Zeng, Jingying, et al.
Pubblicazione: (2025) -
To trust or not to trust: Attention-based Trust Management for LLM Multi-Agent Systems
di: He, Pengfei, et al.
Pubblicazione: (2025) -
Examples as the Prompt: A Scalable Approach for Efficient LLM Adaptation in E-Commerce
di: Zeng, Jingying, et al.
Pubblicazione: (2025) -
Adaptive Test-Time Reasoning via Reward-Guided Dual-Phase Search
di: Cui, Yingqian, et al.
Pubblicazione: (2025)