Joint Flashback Adaptation for Forgetting-Resistant Instruction Tuning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Yukun, Yan, Lingyong, Li, Zhenyang, Wang, Shuaiqiang, Chen, Zhumin, Ren, Zhaochun, Yin, Dawei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
KnowTuning: Knowledge-aware Fine-tuning for Large Language Models
di: Lyu, Yougang, et al.
Pubblicazione: (2024)
di: Lyu, Yougang, et al.
Pubblicazione: (2024)
Knowing What LLMs DO NOT Know: A Simple Yet Effective Self-Detection Method
di: Zhao, Yukun, et al.
Pubblicazione: (2023)
di: Zhao, Yukun, et al.
Pubblicazione: (2023)
Retrieval Models Aren't Tool-Savvy: Benchmarking Tool Retrieval for Large Language Models
di: Shi, Zhengliang, et al.
Pubblicazione: (2025)
di: Shi, Zhengliang, et al.
Pubblicazione: (2025)
GRAF: Multi-turn Jailbreaking via Global Refinement and Active Fabrication
di: Tang, Hua, et al.
Pubblicazione: (2025)
di: Tang, Hua, et al.
Pubblicazione: (2025)
Divide-Then-Aggregate: An Efficient Tool Learning Method via Parallel Tool Invocation
di: Zhu, Dongsheng, et al.
Pubblicazione: (2025)
di: Zhu, Dongsheng, et al.
Pubblicazione: (2025)
MACPO: Weak-to-Strong Alignment via Multi-Agent Contrastive Preference Optimization
di: Lyu, Yougang, et al.
Pubblicazione: (2024)
di: Lyu, Yougang, et al.
Pubblicazione: (2024)
Is ChatGPT Good at Search? Investigating Large Language Models as Re-Ranking Agents
di: Sun, Weiwei, et al.
Pubblicazione: (2023)
di: Sun, Weiwei, et al.
Pubblicazione: (2023)
Reinforced Efficient Reasoning via Semantically Diverse Exploration
di: Zhao, Ziqi, et al.
Pubblicazione: (2026)
di: Zhao, Ziqi, et al.
Pubblicazione: (2026)
PA-RAG: RAG Alignment via Multi-Perspective Preference Optimization
di: Wu, Jiayi, et al.
Pubblicazione: (2024)
di: Wu, Jiayi, et al.
Pubblicazione: (2024)
The Real, the Better: Aligning Large Language Models with Online Human Behaviors
di: Jiang, Guanying, et al.
Pubblicazione: (2024)
di: Jiang, Guanying, et al.
Pubblicazione: (2024)
Improving the Robustness of Large Language Models via Consistency Alignment
di: Zhao, Yukun, et al.
Pubblicazione: (2024)
di: Zhao, Yukun, et al.
Pubblicazione: (2024)
Mitigating Hallucinations in Large Vision-Language Models via Entity-Centric Multimodal Preference Optimization
di: Wu, Jiulong, et al.
Pubblicazione: (2025)
di: Wu, Jiulong, et al.
Pubblicazione: (2025)
Keep the General, Inject the Specific: Structured Dialogue Fine-Tuning for Knowledge Injection without Catastrophic Forgetting
di: Hong, Yijie, et al.
Pubblicazione: (2025)
di: Hong, Yijie, et al.
Pubblicazione: (2025)
Self-Supervised Position Debiasing for Large Language Models
di: Liu, Zhongkun, et al.
Pubblicazione: (2024)
di: Liu, Zhongkun, et al.
Pubblicazione: (2024)
Analyzing and Reducing Catastrophic Forgetting in Parameter Efficient Tuning
di: Ren, Weijieying, et al.
Pubblicazione: (2024)
di: Ren, Weijieying, et al.
Pubblicazione: (2024)
Tool Learning in the Wild: Empowering Language Models as Automatic Tool Agents
di: Shi, Zhengliang, et al.
Pubblicazione: (2024)
di: Shi, Zhengliang, et al.
Pubblicazione: (2024)
UIPE: Enhancing LLM Unlearning by Removing Knowledge Related to Forgetting Targets
di: Wang, Wenyu, et al.
Pubblicazione: (2025)
di: Wang, Wenyu, et al.
Pubblicazione: (2025)
Contrastive Instruction Tuning
di: Yan, Tianyi Lorena, et al.
Pubblicazione: (2024)
di: Yan, Tianyi Lorena, et al.
Pubblicazione: (2024)
AdaSwitch: Balancing Exploration and Guidance in Knowledge Distillation via Adaptive Switching
di: Peng, Jingyu, et al.
Pubblicazione: (2025)
di: Peng, Jingyu, et al.
Pubblicazione: (2025)
MatchTIR: Fine-Grained Supervision for Tool-Integrated Reasoning via Bipartite Matching
di: Qu, Changle, et al.
Pubblicazione: (2026)
di: Qu, Changle, et al.
Pubblicazione: (2026)
GraphGPT: Graph Instruction Tuning for Large Language Models
di: Tang, Jiabin, et al.
Pubblicazione: (2023)
di: Tang, Jiabin, et al.
Pubblicazione: (2023)
Reasoning-to-Defend: Safety-Aware Reasoning Can Defend Large Language Models from Jailbreaking
di: Zhu, Junda, et al.
Pubblicazione: (2025)
di: Zhu, Junda, et al.
Pubblicazione: (2025)
MILL: Mutual Verification with Large Language Models for Zero-Shot Query Expansion
di: Jia, Pengyue, et al.
Pubblicazione: (2023)
di: Jia, Pengyue, et al.
Pubblicazione: (2023)
Enhancing RAG Efficiency with Adaptive Context Compression
di: Guo, Shuyu, et al.
Pubblicazione: (2025)
di: Guo, Shuyu, et al.
Pubblicazione: (2025)
Early Detection and Reduction of Memorisation for Domain Adaptation and Instruction Tuning
di: Slack, Dean L., et al.
Pubblicazione: (2025)
di: Slack, Dean L., et al.
Pubblicazione: (2025)
Revisiting Catastrophic Forgetting in Large Language Model Tuning
di: Li, Hongyu, et al.
Pubblicazione: (2024)
di: Li, Hongyu, et al.
Pubblicazione: (2024)
Flashback: Understanding and Mitigating Forgetting in Federated Learning
di: Aljahdali, Mohammed, et al.
Pubblicazione: (2024)
di: Aljahdali, Mohammed, et al.
Pubblicazione: (2024)
Bridging the Capability Gap: Joint Alignment Tuning for Harmonizing LLM-based Multi-Agent Systems
di: Zhu, Minghang, et al.
Pubblicazione: (2025)
di: Zhu, Minghang, et al.
Pubblicazione: (2025)
Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers
di: Shi, Zhengliang, et al.
Pubblicazione: (2025)
di: Shi, Zhengliang, et al.
Pubblicazione: (2025)
DELIA: Diversity-Enhanced Learning for Instruction Adaptation in Large Language Models
di: Zeng, Yuanhao, et al.
Pubblicazione: (2024)
di: Zeng, Yuanhao, et al.
Pubblicazione: (2024)
From Exploration to Mastery: Enabling LLMs to Master Tools via Self-Driven Interactions
di: Qu, Changle, et al.
Pubblicazione: (2024)
di: Qu, Changle, et al.
Pubblicazione: (2024)
Tool Learning with Large Language Models: A Survey
di: Qu, Changle, et al.
Pubblicazione: (2024)
di: Qu, Changle, et al.
Pubblicazione: (2024)
Improved Supervised Fine-Tuning for Large Language Models to Mitigate Catastrophic Forgetting
di: Ding, Fei, et al.
Pubblicazione: (2025)
di: Ding, Fei, et al.
Pubblicazione: (2025)
Enhancing Multimodal Continual Instruction Tuning with BranchLoRA
di: Zhang, Duzhen, et al.
Pubblicazione: (2025)
di: Zhang, Duzhen, et al.
Pubblicazione: (2025)
LLM-Specific Utility: A New Perspective for Retrieval-Augmented Generation
di: Zhang, Hengran, et al.
Pubblicazione: (2025)
di: Zhang, Hengran, et al.
Pubblicazione: (2025)
Talking to Yourself: Defying Forgetting in Large Language Models
di: Sun, Yutao, et al.
Pubblicazione: (2026)
di: Sun, Yutao, et al.
Pubblicazione: (2026)
Instruction Tuning With Loss Over Instructions
di: Shi, Zhengyan, et al.
Pubblicazione: (2024)
di: Shi, Zhengyan, et al.
Pubblicazione: (2024)
Exploring Memorization in Fine-tuned Language Models
di: Zeng, Shenglai, et al.
Pubblicazione: (2023)
di: Zeng, Shenglai, et al.
Pubblicazione: (2023)
Countering Catastrophic Forgetting of Large Language Models for Better Instruction Following via Weight-Space Model Merging
di: Lyu, Mengxian, et al.
Pubblicazione: (2026)
di: Lyu, Mengxian, et al.
Pubblicazione: (2026)
Judge Before Answer: Can MLLM Discern the False Premise in Question?
di: Li, Jidong, et al.
Pubblicazione: (2025)
di: Li, Jidong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
KnowTuning: Knowledge-aware Fine-tuning for Large Language Models
di: Lyu, Yougang, et al.
Pubblicazione: (2024) -
Knowing What LLMs DO NOT Know: A Simple Yet Effective Self-Detection Method
di: Zhao, Yukun, et al.
Pubblicazione: (2023) -
Retrieval Models Aren't Tool-Savvy: Benchmarking Tool Retrieval for Large Language Models
di: Shi, Zhengliang, et al.
Pubblicazione: (2025) -
GRAF: Multi-turn Jailbreaking via Global Refinement and Active Fabrication
di: Tang, Hua, et al.
Pubblicazione: (2025) -
Divide-Then-Aggregate: An Efficient Tool Learning Method via Parallel Tool Invocation
di: Zhu, Dongsheng, et al.
Pubblicazione: (2025)