Can Small Language Models Learn, Unlearn, and Retain Noise Patterns?
Fuente:
arXiv
Salvato in:
| Autori principali: | Scaria, Nicy, Kennedy, Silvester John Joseph, Subramani, Deepak |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Sensitivity of Small Language Models to Fine-tuning Data Contamination
di: Scaria, Nicy, et al.
Pubblicazione: (2025)
di: Scaria, Nicy, et al.
Pubblicazione: (2025)
Learning in Blocks: A Multi Agent Debate Assisted Personalized Adaptive Learning Framework for Language Learning
di: Scaria, Nicy, et al.
Pubblicazione: (2026)
di: Scaria, Nicy, et al.
Pubblicazione: (2026)
EvalYaks: Instruction Tuning Datasets and LoRA Fine-tuned Models for Automated Scoring of CEFR B2 Speaking Assessment Transcripts
di: Scaria, Nicy, et al.
Pubblicazione: (2024)
di: Scaria, Nicy, et al.
Pubblicazione: (2024)
Dissecting Physics Reasoning in Small Language Models: A Multi-Dimensional Analysis from an Educational Perspective
di: Scaria, Nicy, et al.
Pubblicazione: (2025)
di: Scaria, Nicy, et al.
Pubblicazione: (2025)
Harnessing Structured Knowledge: A Concept Map-Based Approach for High-Quality Multiple Choice Question Generation with Effective Distractors
di: Scaria, Nicy, et al.
Pubblicazione: (2025)
di: Scaria, Nicy, et al.
Pubblicazione: (2025)
Automated Educational Question Generation at Different Bloom's Skill Levels using Large Language Models: Strategies and Evaluation
di: Scaria, Nicy, et al.
Pubblicazione: (2024)
di: Scaria, Nicy, et al.
Pubblicazione: (2024)
Model Internal Sleuthing: Finding Lexical Identity and Inflectional Features in Modern Language Models
di: Li, Michael, et al.
Pubblicazione: (2025)
di: Li, Michael, et al.
Pubblicazione: (2025)
Learn while Unlearn: An Iterative Unlearning Framework for Generative Language Models
di: Tang, Haoyu, et al.
Pubblicazione: (2024)
di: Tang, Haoyu, et al.
Pubblicazione: (2024)
Rethinking Machine Unlearning for Large Language Models
di: Liu, Sijia, et al.
Pubblicazione: (2024)
di: Liu, Sijia, et al.
Pubblicazione: (2024)
Can Language Models Learn Typologically Implausible Languages?
di: Xu, Tianyang, et al.
Pubblicazione: (2025)
di: Xu, Tianyang, et al.
Pubblicazione: (2025)
Dissecting Fine-Tuning Unlearning in Large Language Models
di: Hong, Yihuai, et al.
Pubblicazione: (2024)
di: Hong, Yihuai, et al.
Pubblicazione: (2024)
Large Language Model Unlearning
di: Yao, Yuanshun, et al.
Pubblicazione: (2023)
di: Yao, Yuanshun, et al.
Pubblicazione: (2023)
Dissecting Language Models: Machine Unlearning via Selective Pruning
di: Pochinkov, Nicholas, et al.
Pubblicazione: (2024)
di: Pochinkov, Nicholas, et al.
Pubblicazione: (2024)
ZeroUnlearn: Few-Shot Knowledge Unlearning in Large Language Models
di: Lin, Yujie, et al.
Pubblicazione: (2026)
di: Lin, Yujie, et al.
Pubblicazione: (2026)
Can Small Language Models be Good Reasoners for Sequential Recommendation?
di: Wang, Yuling, et al.
Pubblicazione: (2024)
di: Wang, Yuling, et al.
Pubblicazione: (2024)
Personal Information Parroting in Language Models
di: Subramani, Nishant, et al.
Pubblicazione: (2026)
di: Subramani, Nishant, et al.
Pubblicazione: (2026)
An Analysis for Reasoning Bias of Language Models with Small Initialization
di: Yao, Junjie, et al.
Pubblicazione: (2025)
di: Yao, Junjie, et al.
Pubblicazione: (2025)
Automating Evaluation of Diffusion Model Unlearning with (Vision-) Language Model World Knowledge
di: Yeats, Eric, et al.
Pubblicazione: (2025)
di: Yeats, Eric, et al.
Pubblicazione: (2025)
Offset Unlearning for Large Language Models
di: Huang, James Y., et al.
Pubblicazione: (2024)
di: Huang, James Y., et al.
Pubblicazione: (2024)
Alternate Preference Optimization for Unlearning Factual Knowledge in Large Language Models
di: Mekala, Anmol, et al.
Pubblicazione: (2024)
di: Mekala, Anmol, et al.
Pubblicazione: (2024)
Sparse-Autoencoder-Guided Internal Representation Unlearning for Large Language Models
di: Yamashita, Tomoya, et al.
Pubblicazione: (2025)
di: Yamashita, Tomoya, et al.
Pubblicazione: (2025)
Concept Unlearning in Large Language Models via Self-Constructed Knowledge Triplets
di: Yamashita, Tomoya, et al.
Pubblicazione: (2025)
di: Yamashita, Tomoya, et al.
Pubblicazione: (2025)
Soft Prompting for Unlearning in Large Language Models
di: Bhaila, Karuna, et al.
Pubblicazione: (2024)
di: Bhaila, Karuna, et al.
Pubblicazione: (2024)
Multi-Objective Large Language Model Unlearning
di: Pan, Zibin, et al.
Pubblicazione: (2024)
di: Pan, Zibin, et al.
Pubblicazione: (2024)
Hierarchical Federated Unlearning for Large Language Models
di: Zhong, Yisheng, et al.
Pubblicazione: (2025)
di: Zhong, Yisheng, et al.
Pubblicazione: (2025)
PARAMANU-GANITA: Can Small Math Language Models Rival with Large Language Models on Mathematical Reasoning?
di: Niyogi, Mitodru, et al.
Pubblicazione: (2024)
di: Niyogi, Mitodru, et al.
Pubblicazione: (2024)
Retaining by Doing: The Role of On-Policy Data in Mitigating Forgetting
di: Chen, Howard, et al.
Pubblicazione: (2025)
di: Chen, Howard, et al.
Pubblicazione: (2025)
Tokens for Learning, Tokens for Unlearning: Mitigating Membership Inference Attacks in Large Language Models via Dual-Purpose Training
di: Tran, Toan, et al.
Pubblicazione: (2025)
di: Tran, Toan, et al.
Pubblicazione: (2025)
Fine-tuning vs. In-context Learning in Large Language Models: A Formal Language Learning Perspective
di: Ghosh, Bishwamittra, et al.
Pubblicazione: (2026)
di: Ghosh, Bishwamittra, et al.
Pubblicazione: (2026)
Learning to Unlearn while Retaining: Combating Gradient Conflicts in Machine Unlearning
di: Patel, Gaurav, et al.
Pubblicazione: (2025)
di: Patel, Gaurav, et al.
Pubblicazione: (2025)
Less Noise, Same Certificate: Retain Sensitivity for Unlearning
di: Heinzler, Carolin, et al.
Pubblicazione: (2026)
di: Heinzler, Carolin, et al.
Pubblicazione: (2026)
Align-then-Unlearn: Embedding Alignment for LLM Unlearning
di: Spohn, Philipp, et al.
Pubblicazione: (2025)
di: Spohn, Philipp, et al.
Pubblicazione: (2025)
Does Unlearning Truly Unlearn? A Black Box Evaluation of LLM Unlearning Methods
di: Doshi, Jai, et al.
Pubblicazione: (2024)
di: Doshi, Jai, et al.
Pubblicazione: (2024)
Learn and Unlearn: Addressing Misinformation in Multilingual LLMs
di: Lu, Taiming, et al.
Pubblicazione: (2024)
di: Lu, Taiming, et al.
Pubblicazione: (2024)
Learning-Time Encoding Shapes Unlearning in LLMs
di: Wu, Ruihan, et al.
Pubblicazione: (2025)
di: Wu, Ruihan, et al.
Pubblicazione: (2025)
Existing Large Language Model Unlearning Evaluations Are Inconclusive
di: Feng, Zhili, et al.
Pubblicazione: (2025)
di: Feng, Zhili, et al.
Pubblicazione: (2025)
A Neuro-inspired Interpretation of Unlearning in Large Language Models through Sample-level Unlearning Difficulty
di: Feng, Xiaohua, et al.
Pubblicazione: (2025)
di: Feng, Xiaohua, et al.
Pubblicazione: (2025)
Noise Contrastive Alignment of Language Models with Explicit Rewards
di: Chen, Huayu, et al.
Pubblicazione: (2024)
di: Chen, Huayu, et al.
Pubblicazione: (2024)
SemEval-2025 Task 4: Unlearning sensitive content from Large Language Models
di: Ramakrishna, Anil, et al.
Pubblicazione: (2025)
di: Ramakrishna, Anil, et al.
Pubblicazione: (2025)
Exploring Activation Patterns of Parameters in Language Models
di: Wang, Yudong, et al.
Pubblicazione: (2024)
di: Wang, Yudong, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Sensitivity of Small Language Models to Fine-tuning Data Contamination
di: Scaria, Nicy, et al.
Pubblicazione: (2025) -
Learning in Blocks: A Multi Agent Debate Assisted Personalized Adaptive Learning Framework for Language Learning
di: Scaria, Nicy, et al.
Pubblicazione: (2026) -
EvalYaks: Instruction Tuning Datasets and LoRA Fine-tuned Models for Automated Scoring of CEFR B2 Speaking Assessment Transcripts
di: Scaria, Nicy, et al.
Pubblicazione: (2024) -
Dissecting Physics Reasoning in Small Language Models: A Multi-Dimensional Analysis from an Educational Perspective
di: Scaria, Nicy, et al.
Pubblicazione: (2025) -
Harnessing Structured Knowledge: A Concept Map-Based Approach for High-Quality Multiple Choice Question Generation with Effective Distractors
di: Scaria, Nicy, et al.
Pubblicazione: (2025)