Fuse to Forget: Bias Reduction and Selective Memorization through Model Fusion
Fuente:
arXiv
Salvato in:
| Autori principali: | Zaman, Kerem, Choshen, Leshem, Srivastava, Shashank |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Is Chain-of-Thought Really Not Explainability? Chain-of-Thought Can Be Faithful without Hint Verbalization
di: Zaman, Kerem, et al.
Pubblicazione: (2025)
di: Zaman, Kerem, et al.
Pubblicazione: (2025)
A Causal Lens for Evaluating Faithfulness Metrics
di: Zaman, Kerem, et al.
Pubblicazione: (2025)
di: Zaman, Kerem, et al.
Pubblicazione: (2025)
A Hitchhiker's Guide to Scaling Law Estimation
di: Choshen, Leshem, et al.
Pubblicazione: (2024)
di: Choshen, Leshem, et al.
Pubblicazione: (2024)
ComPEFT: Compression for Communicating Parameter Efficient Updates via Sparsification and Quantization
di: Yadav, Prateek, et al.
Pubblicazione: (2023)
di: Yadav, Prateek, et al.
Pubblicazione: (2023)
Resolving Interference (RI): Disentangling Models for Improved Model Merging
di: Ramesh, Pratik, et al.
Pubblicazione: (2026)
di: Ramesh, Pratik, et al.
Pubblicazione: (2026)
Robustness as an Emergent Property of Task Performance
di: Ashury-Tahan, Shir, et al.
Pubblicazione: (2026)
di: Ashury-Tahan, Shir, et al.
Pubblicazione: (2026)
Elephants Never Forget: Memorization and Learning of Tabular Data in Large Language Models
di: Bordt, Sebastian, et al.
Pubblicazione: (2024)
di: Bordt, Sebastian, et al.
Pubblicazione: (2024)
tinyBenchmarks: evaluating LLMs with fewer examples
di: Polo, Felipe Maia, et al.
Pubblicazione: (2024)
di: Polo, Felipe Maia, et al.
Pubblicazione: (2024)
Beyond Binary Rewards: Training LMs to Reason About Their Uncertainty
di: Damani, Mehul, et al.
Pubblicazione: (2025)
di: Damani, Mehul, et al.
Pubblicazione: (2025)
MarginSel : Max-Margin Demonstration Selection for LLMs
di: Ambati, Rajeev Bhatt, et al.
Pubblicazione: (2025)
di: Ambati, Rajeev Bhatt, et al.
Pubblicazione: (2025)
A Survey on Model MoErging: Recycling and Routing Among Specialized Experts for Collaborative Learning
di: Yadav, Prateek, et al.
Pubblicazione: (2024)
di: Yadav, Prateek, et al.
Pubblicazione: (2024)
TextArena
di: Guertler, Leon, et al.
Pubblicazione: (2025)
di: Guertler, Leon, et al.
Pubblicazione: (2025)
Genie: Achieving Human Parity in Content-Grounded Datasets Generation
di: Yehudai, Asaf, et al.
Pubblicazione: (2024)
di: Yehudai, Asaf, et al.
Pubblicazione: (2024)
Mitigating Memorization In Language Models
di: Sakarvadia, Mansi, et al.
Pubblicazione: (2024)
di: Sakarvadia, Mansi, et al.
Pubblicazione: (2024)
Detecting Memorization in Large Language Models
di: Slonski, Eduardo
Pubblicazione: (2024)
di: Slonski, Eduardo
Pubblicazione: (2024)
Efficient multi-prompt evaluation of LLMs
di: Polo, Felipe Maia, et al.
Pubblicazione: (2024)
di: Polo, Felipe Maia, et al.
Pubblicazione: (2024)
Compress then Serve: Serving Thousands of LoRA Adapters with Little Overhead
di: Brüel-Gabrielsson, Rickard, et al.
Pubblicazione: (2024)
di: Brüel-Gabrielsson, Rickard, et al.
Pubblicazione: (2024)
Exploring Memorization in Fine-tuned Language Models
di: Zeng, Shenglai, et al.
Pubblicazione: (2023)
di: Zeng, Shenglai, et al.
Pubblicazione: (2023)
Can Gradient Descent Simulate Prompting?
di: Zhang, Eric, et al.
Pubblicazione: (2025)
di: Zhang, Eric, et al.
Pubblicazione: (2025)
Memorization in In-Context Learning
di: Golchin, Shahriar, et al.
Pubblicazione: (2024)
di: Golchin, Shahriar, et al.
Pubblicazione: (2024)
Forget What Matters, Keep the Rest: Selective Unlearning of Informative Tokens
di: Koh, Seunghee, et al.
Pubblicazione: (2026)
di: Koh, Seunghee, et al.
Pubblicazione: (2026)
Efficient Benchmarking of Language Models
di: Perlitz, Yotam, et al.
Pubblicazione: (2023)
di: Perlitz, Yotam, et al.
Pubblicazione: (2023)
An Evaluation on Large Language Model Outputs: Discourse and Memorization
di: de Wynter, Adrian, et al.
Pubblicazione: (2023)
di: de Wynter, Adrian, et al.
Pubblicazione: (2023)
Skewed Memorization in Large Language Models: Quantification and Decomposition
di: Li, Hao, et al.
Pubblicazione: (2025)
di: Li, Hao, et al.
Pubblicazione: (2025)
Graceful Forgetting in Generative Language Models
di: Jiang, Chunyang, et al.
Pubblicazione: (2025)
di: Jiang, Chunyang, et al.
Pubblicazione: (2025)
Forgetting Transformer: Softmax Attention with a Forget Gate
di: Lin, Zhixuan, et al.
Pubblicazione: (2025)
di: Lin, Zhixuan, et al.
Pubblicazione: (2025)
Pruning as a Defense: Reducing Memorization in Large Language Models
di: Gupta, Mansi, et al.
Pubblicazione: (2025)
di: Gupta, Mansi, et al.
Pubblicazione: (2025)
Unintended Memorization of Sensitive Information in Fine-Tuned Language Models
di: Szep, Marton, et al.
Pubblicazione: (2026)
di: Szep, Marton, et al.
Pubblicazione: (2026)
Learn More, Forget Less: A Gradient-Aware Data Selection Approach for LLM
di: Liu, Yibai, et al.
Pubblicazione: (2025)
di: Liu, Yibai, et al.
Pubblicazione: (2025)
Titans: Learning to Memorize at Test Time
di: Behrouz, Ali, et al.
Pubblicazione: (2024)
di: Behrouz, Ali, et al.
Pubblicazione: (2024)
Memorization Dynamics of Fill-in-the-Middle Pretraining
di: von Arx, Tobias, et al.
Pubblicazione: (2026)
di: von Arx, Tobias, et al.
Pubblicazione: (2026)
Memorization: A Close Look at Books
di: Ma, Iris, et al.
Pubblicazione: (2025)
di: Ma, Iris, et al.
Pubblicazione: (2025)
Memorize and Rank: Elevating Large Language Models for Clinical Diagnosis Prediction
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2025)
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2025)
Unveiling and Addressing Pseudo Forgetting in Large Language Models
di: Sun, Huashan, et al.
Pubblicazione: (2024)
di: Sun, Huashan, et al.
Pubblicazione: (2024)
Offline Learning and Forgetting for Reasoning with Large Language Models
di: Ni, Tianwei, et al.
Pubblicazione: (2025)
di: Ni, Tianwei, et al.
Pubblicazione: (2025)
Mapping Post-Training Forgetting in Language Models at Scale
di: Harmon, Jackson, et al.
Pubblicazione: (2025)
di: Harmon, Jackson, et al.
Pubblicazione: (2025)
Mitigating Selection Bias in Large Language Models via Permutation-Aware GRPO
di: Zheng, Jinquan, et al.
Pubblicazione: (2026)
di: Zheng, Jinquan, et al.
Pubblicazione: (2026)
Generalization v.s. Memorization: Tracing Language Models' Capabilities Back to Pretraining Data
di: Wang, Xinyi, et al.
Pubblicazione: (2024)
di: Wang, Xinyi, et al.
Pubblicazione: (2024)
Data Cartography for Detecting Memorization Hotspots and Guiding Data Interventions in Generative Models
di: Patel, Laksh, et al.
Pubblicazione: (2025)
di: Patel, Laksh, et al.
Pubblicazione: (2025)
Label-Efficient Model Selection for Text Generation
di: Ashury-Tahan, Shir, et al.
Pubblicazione: (2024)
di: Ashury-Tahan, Shir, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Is Chain-of-Thought Really Not Explainability? Chain-of-Thought Can Be Faithful without Hint Verbalization
di: Zaman, Kerem, et al.
Pubblicazione: (2025) -
A Causal Lens for Evaluating Faithfulness Metrics
di: Zaman, Kerem, et al.
Pubblicazione: (2025) -
A Hitchhiker's Guide to Scaling Law Estimation
di: Choshen, Leshem, et al.
Pubblicazione: (2024) -
ComPEFT: Compression for Communicating Parameter Efficient Updates via Sparsification and Quantization
di: Yadav, Prateek, et al.
Pubblicazione: (2023) -
Resolving Interference (RI): Disentangling Models for Improved Model Merging
di: Ramesh, Pratik, et al.
Pubblicazione: (2026)