MetaGDPO: Alleviating Catastrophic Forgetting with Metacognitive Knowledge through Group Direct Preference Optimization
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Lanxue, Xie, Yuqiang, Fang, Fang, Dong, Fanglong, Liu, Rui, Cao, Yanan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization
por: Liu, Shih-Yang, et al.
Publicado: (2026)
por: Liu, Shih-Yang, et al.
Publicado: (2026)
Revisiting Catastrophic Forgetting in Large Language Model Tuning
por: Li, Hongyu, et al.
Publicado: (2024)
por: Li, Hongyu, et al.
Publicado: (2024)
Revisiting Catastrophic Forgetting in Continual Knowledge Graph Embedding
por: Pons, Gerard, et al.
Publicado: (2026)
por: Pons, Gerard, et al.
Publicado: (2026)
GDPO: Learning to Directly Align Language Models with Diversity Using GFlowNets
por: Kwon, Oh Joon, et al.
Publicado: (2024)
por: Kwon, Oh Joon, et al.
Publicado: (2024)
How to Alleviate Catastrophic Forgetting in LLMs Finetuning? Hierarchical Layer-Wise and Element-Wise Regularization
por: Song, Shezheng, et al.
Publicado: (2025)
por: Song, Shezheng, et al.
Publicado: (2025)
Can LLMs Alleviate Catastrophic Forgetting in Graph Continual Learning? A Systematic Study
por: Cheng, Ziyang, et al.
Publicado: (2025)
por: Cheng, Ziyang, et al.
Publicado: (2025)
Keep the General, Inject the Specific: Structured Dialogue Fine-Tuning for Knowledge Injection without Catastrophic Forgetting
por: Hong, Yijie, et al.
Publicado: (2025)
por: Hong, Yijie, et al.
Publicado: (2025)
Catastrophic Forgetting in Kolmogorov-Arnold Networks
por: Rahman, Mohammad Marufur, et al.
Publicado: (2025)
por: Rahman, Mohammad Marufur, et al.
Publicado: (2025)
CORE: Mitigating Catastrophic Forgetting in Continual Learning through Cognitive Replay
por: Zhang, Jianshu, et al.
Publicado: (2024)
por: Zhang, Jianshu, et al.
Publicado: (2024)
Sequencing to Mitigate Catastrophic Forgetting in Continual Learning
por: Moussa, Hesham G., et al.
Publicado: (2025)
por: Moussa, Hesham G., et al.
Publicado: (2025)
Stable Preference Optimization: A Bilevel Approach to Catastrophic Preference Shift
por: Jian, Chengtao, et al.
Publicado: (2025)
por: Jian, Chengtao, et al.
Publicado: (2025)
Addressing Loss of Plasticity and Catastrophic Forgetting in Continual Learning
por: Elsayed, Mohamed, et al.
Publicado: (2024)
por: Elsayed, Mohamed, et al.
Publicado: (2024)
Quantifying Catastrophic Forgetting in IoT Intrusion Detection Systems
por: Banerjee, Sourasekhar, et al.
Publicado: (2026)
por: Banerjee, Sourasekhar, et al.
Publicado: (2026)
A Conformal Predictive Measure for Assessing Catastrophic Forgetting
por: Pitsiorlas, Ioannis, et al.
Publicado: (2025)
por: Pitsiorlas, Ioannis, et al.
Publicado: (2025)
On the Implicit Adversariality of Catastrophic Forgetting in Deep Continual Learning
por: Peng, Ze, et al.
Publicado: (2025)
por: Peng, Ze, et al.
Publicado: (2025)
Continual Learning and Catastrophic Forgetting
por: van de Ven, Gido M., et al.
Publicado: (2024)
por: van de Ven, Gido M., et al.
Publicado: (2024)
Meta-R1: Empowering Large Reasoning Models with Metacognition
por: Dong, Haonan, et al.
Publicado: (2025)
por: Dong, Haonan, et al.
Publicado: (2025)
Evolutionary Strategies lead to Catastrophic Forgetting in LLMs
por: Abdi, Immanuel, et al.
Publicado: (2026)
por: Abdi, Immanuel, et al.
Publicado: (2026)
CoT2-Meta: Budgeted Metacognitive Control for Test-Time Reasoning
por: Ma, Siyuan, et al.
Publicado: (2026)
por: Ma, Siyuan, et al.
Publicado: (2026)
Explaining Robustness to Catastrophic Forgetting Through Incremental Concept Formation
por: Barari, Nicki, et al.
Publicado: (2025)
por: Barari, Nicki, et al.
Publicado: (2025)
Catastrophic Forgetting Mitigation Through Plateau Phase Activity Profiling
por: Mashiach, Idan, et al.
Publicado: (2025)
por: Mashiach, Idan, et al.
Publicado: (2025)
Model Editing at Scale leads to Gradual and Catastrophic Forgetting
por: Gupta, Akshat, et al.
Publicado: (2024)
por: Gupta, Akshat, et al.
Publicado: (2024)
Analyzing and Reducing Catastrophic Forgetting in Parameter Efficient Tuning
por: Ren, Weijieying, et al.
Publicado: (2024)
por: Ren, Weijieying, et al.
Publicado: (2024)
MAD-Fact: A Multi-Agent Debate Framework for Long-Form Factuality Evaluation in LLMs
por: Ning, Yucheng, et al.
Publicado: (2025)
por: Ning, Yucheng, et al.
Publicado: (2025)
MoE-CT: A Novel Approach For Large Language Models Training With Resistance To Catastrophic Forgetting
por: Li, Tianhao, et al.
Publicado: (2024)
por: Li, Tianhao, et al.
Publicado: (2024)
Negative Preference Optimization: From Catastrophic Collapse to Effective Unlearning
por: Zhang, Ruiqi, et al.
Publicado: (2024)
por: Zhang, Ruiqi, et al.
Publicado: (2024)
Token-Importance Guided Direct Preference Optimization
por: Yang, Ning, et al.
Publicado: (2025)
por: Yang, Ning, et al.
Publicado: (2025)
Delayed Bottlenecking: Alleviating Forgetting in Pre-trained Graph Neural Networks
por: Zhao, Zhe, et al.
Publicado: (2024)
por: Zhao, Zhe, et al.
Publicado: (2024)
Mitigating Catastrophic Forgetting in Large Language Models with Self-Synthesized Rehearsal
por: Huang, Jianheng, et al.
Publicado: (2024)
por: Huang, Jianheng, et al.
Publicado: (2024)
Overcoming Catastrophic Forgetting by Exemplar Selection in Task-oriented Dialogue System
por: Chen, Chen, et al.
Publicado: (2024)
por: Chen, Chen, et al.
Publicado: (2024)
Autoregressive Direct Preference Optimization
por: Oi, Masanari, et al.
Publicado: (2026)
por: Oi, Masanari, et al.
Publicado: (2026)
Do LLMs Know Tool Irrelevance? Demystifying Structural Alignment Bias in Tool Invocations
por: Liu, Yilong, et al.
Publicado: (2026)
por: Liu, Yilong, et al.
Publicado: (2026)
Adaptive Collaboration with Humans: Metacognitive Policy Optimization for Multi-Agent LLMs with Continual Learning
por: Yang, Wei, et al.
Publicado: (2026)
por: Yang, Wei, et al.
Publicado: (2026)
Intelligent Learning Rate Distribution to reduce Catastrophic Forgetting in Transformers
por: Kenneweg, Philip, et al.
Publicado: (2024)
por: Kenneweg, Philip, et al.
Publicado: (2024)
VAGPO: Vision-augmented Asymmetric Group Preference Optimization for Graph Routing Problems
por: Liu, Shiyan, et al.
Publicado: (2025)
por: Liu, Shiyan, et al.
Publicado: (2025)
Direct Preference Optimization with Unobserved Preference Heterogeneity: The Necessity of Ternary Preferences
por: Chidambaram, Keertana, et al.
Publicado: (2025)
por: Chidambaram, Keertana, et al.
Publicado: (2025)
Gradient Correlation Subspace Learning against Catastrophic Forgetting
por: Dubnov, Tammuz, et al.
Publicado: (2024)
por: Dubnov, Tammuz, et al.
Publicado: (2024)
DeMansia: Mamba Never Forgets Any Tokens
por: Fang, Ricky
Publicado: (2024)
por: Fang, Ricky
Publicado: (2024)
PKG-DPO: Optimizing Domain-Specific AI systems with Physics Knowledge Graphs and Direct Preference Optimization
por: Kulkarni, Nitin Nagesh, et al.
Publicado: (2025)
por: Kulkarni, Nitin Nagesh, et al.
Publicado: (2025)
Knowledge Editing in Language Models via Adapted Direct Preference Optimization
por: Rozner, Amit, et al.
Publicado: (2024)
por: Rozner, Amit, et al.
Publicado: (2024)
Ejemplares similares
-
GDPO: Group reward-Decoupled Normalization Policy Optimization for Multi-reward RL Optimization
por: Liu, Shih-Yang, et al.
Publicado: (2026) -
Revisiting Catastrophic Forgetting in Large Language Model Tuning
por: Li, Hongyu, et al.
Publicado: (2024) -
Revisiting Catastrophic Forgetting in Continual Knowledge Graph Embedding
por: Pons, Gerard, et al.
Publicado: (2026) -
GDPO: Learning to Directly Align Language Models with Diversity Using GFlowNets
por: Kwon, Oh Joon, et al.
Publicado: (2024) -
How to Alleviate Catastrophic Forgetting in LLMs Finetuning? Hierarchical Layer-Wise and Element-Wise Regularization
por: Song, Shezheng, et al.
Publicado: (2025)