Mr. Snuffleupagus at SemEval-2025 Task 4: Unlearning Factual Knowledge from LLMs Using Adaptive RMU
Fuente:
arXiv
Salvato in:
| Autori principali: | Dosajh, Arjun, Sanghi, Mihika |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Annif at SemEval-2025 Task 5: Traditional XMTC augmented by LLMs
di: Suominen, Osma, et al.
Pubblicazione: (2025)
di: Suominen, Osma, et al.
Pubblicazione: (2025)
Lon-ea at SemEval-2023 Task 11: A Comparison of Activation Functions for Soft and Hard Label Prediction
di: Hosseini, Peyman, et al.
Pubblicazione: (2023)
di: Hosseini, Peyman, et al.
Pubblicazione: (2023)
PSK at SemEval-2026 Task 9: Multilingual Polarization Detection Using Ensemble Gemma Models with Synthetic Data Augmentation
di: Pulipaka, Srikar Kashyap
Pubblicazione: (2026)
di: Pulipaka, Srikar Kashyap
Pubblicazione: (2026)
Atyaephyra at SemEval-2025 Task 4: Low-Rank Negative Preference Optimization
di: Bronec, Jan, et al.
Pubblicazione: (2025)
di: Bronec, Jan, et al.
Pubblicazione: (2025)
CascadeMind at SemEval-2026 Task 4: A Hybrid Neuro-Symbolic Cascade for Narrative Similarity
di: Kawada, Sebastien, et al.
Pubblicazione: (2026)
di: Kawada, Sebastien, et al.
Pubblicazione: (2026)
SemEval-2026 Task 3: Dimensional Aspect-Based Sentiment Analysis (DimABSA)
di: Yu, Liang-Chih, et al.
Pubblicazione: (2026)
di: Yu, Liang-Chih, et al.
Pubblicazione: (2026)
Fane at SemEval-2025 Task 10: Zero-Shot Entity Framing with Large Language Models
di: Fane, Enfa, et al.
Pubblicazione: (2025)
di: Fane, Enfa, et al.
Pubblicazione: (2025)
Lisbon Computational Linguists at SemEval-2024 Task 2: Using A Mistral 7B Model and Data Augmentation
di: Guimarães, Artur, et al.
Pubblicazione: (2024)
di: Guimarães, Artur, et al.
Pubblicazione: (2024)
SemEval-2025 Task 1: AdMIRe -- Advancing Multimodal Idiomaticity Representation
di: Pickard, Thomas, et al.
Pubblicazione: (2025)
di: Pickard, Thomas, et al.
Pubblicazione: (2025)
University of Indonesia at SemEval-2025 Task 11: Evaluating State-of-the-Art Encoders for Multi-Label Emotion Detection
di: Hanif, Ikhlasul Akmal, et al.
Pubblicazione: (2025)
di: Hanif, Ikhlasul Akmal, et al.
Pubblicazione: (2025)
USTCCTSU at SemEval-2024 Task 1: Reducing Anisotropy for Cross-lingual Semantic Textual Relatedness Task
di: Li, Jianjian, et al.
Pubblicazione: (2024)
di: Li, Jianjian, et al.
Pubblicazione: (2024)
TrustAI at SemEval-2024 Task 8: A Comprehensive Analysis of Multi-domain Machine Generated Text Detection Techniques
di: Urlana, Ashok, et al.
Pubblicazione: (2024)
di: Urlana, Ashok, et al.
Pubblicazione: (2024)
Annif at the GermEval-2025 LLMs4Subjects Task: Traditional XMTC Augmented by Efficient LLMs
di: Suominen, Osma, et al.
Pubblicazione: (2025)
di: Suominen, Osma, et al.
Pubblicazione: (2025)
DNB-AI-Project at SemEval-2025 Task 5: An LLM-Ensemble Approach for Automated Subject Indexing
di: Kluge, Lisa, et al.
Pubblicazione: (2025)
di: Kluge, Lisa, et al.
Pubblicazione: (2025)
MKJ at SemEval-2026 Task 9: A Comparative Study of Generalist, Specialist, and Ensemble Strategies for Multilingual Polarization
di: Jouneghani, Maziar Kianimoghadam
Pubblicazione: (2026)
di: Jouneghani, Maziar Kianimoghadam
Pubblicazione: (2026)
PetKaz at SemEval-2024 Task 8: Can Linguistics Capture the Specifics of LLM-generated Text?
di: Petukhova, Kseniia, et al.
Pubblicazione: (2024)
di: Petukhova, Kseniia, et al.
Pubblicazione: (2024)
LLM Unlearning on Noisy Forget Sets: A Study of Incomplete, Rewritten, and Watermarked Data
di: Wang, Changsheng, et al.
Pubblicazione: (2025)
di: Wang, Changsheng, et al.
Pubblicazione: (2025)
PetKaz at SemEval-2024 Task 3: Advancing Emotion Classification with an LLM for Emotion-Cause Pair Extraction in Conversations
di: Kazakov, Roman, et al.
Pubblicazione: (2024)
di: Kazakov, Roman, et al.
Pubblicazione: (2024)
LLMs are Overconfident: Evaluating Confidence Interval Calibration with FermiEval
di: Epstein, Elliot L., et al.
Pubblicazione: (2025)
di: Epstein, Elliot L., et al.
Pubblicazione: (2025)
lmfaoooo at SemEval-2026 Task 1: Humor Is an Audience. Preference Modeling for Constrained Humor Generation
di: Tikhonov, Alexey, et al.
Pubblicazione: (2026)
di: Tikhonov, Alexey, et al.
Pubblicazione: (2026)
Unilogit: Robust Machine Unlearning for LLMs Using Uniform-Target Self-Distillation
di: Vasilev, Stefan, et al.
Pubblicazione: (2025)
di: Vasilev, Stefan, et al.
Pubblicazione: (2025)
Guided Speculative Inference for Efficient Test-Time Alignment of LLMs
di: Geuter, Jonathan, et al.
Pubblicazione: (2025)
di: Geuter, Jonathan, et al.
Pubblicazione: (2025)
Back to Basics: Revisiting REINFORCE Style Optimization for Learning from Human Feedback in LLMs
di: Ahmadian, Arash, et al.
Pubblicazione: (2024)
di: Ahmadian, Arash, et al.
Pubblicazione: (2024)
OFMU: Optimization-Driven Framework for Machine Unlearning
di: Asif, Sadia, et al.
Pubblicazione: (2025)
di: Asif, Sadia, et al.
Pubblicazione: (2025)
Merge-Bench: Resolve Merge Conflicts with Large Language Models
di: Schesch, Benedikt, et al.
Pubblicazione: (2026)
di: Schesch, Benedikt, et al.
Pubblicazione: (2026)
Quantization-Robust LLM Unlearning via Low-Rank Adaptation
di: Abitante, João Vitor Boer, et al.
Pubblicazione: (2026)
di: Abitante, João Vitor Boer, et al.
Pubblicazione: (2026)
Latent Instruction Representation Alignment: defending against jailbreaks, backdoors and undesired knowledge in LLMs
di: Easley, Eric, et al.
Pubblicazione: (2026)
di: Easley, Eric, et al.
Pubblicazione: (2026)
Dual-Phase Federated Deep Unlearning via Weight-Aware Rollback and Reconstruction
di: Zhou, Changjun, et al.
Pubblicazione: (2025)
di: Zhou, Changjun, et al.
Pubblicazione: (2025)
Representation-Aware Unlearning via Activation Signatures: From Suppression to Entity-Signature Erasure
di: Mahmood, Syed Naveed, et al.
Pubblicazione: (2026)
di: Mahmood, Syed Naveed, et al.
Pubblicazione: (2026)
CRISP: Persistent Concept Unlearning via Sparse Autoencoders
di: Ashuach, Tomer, et al.
Pubblicazione: (2025)
di: Ashuach, Tomer, et al.
Pubblicazione: (2025)
Less is More: Learning Graph Tasks with Just LLMs
di: Shirai, Sola, et al.
Pubblicazione: (2025)
di: Shirai, Sola, et al.
Pubblicazione: (2025)
ObfusQAte: A Proposed Framework to Evaluate LLM Robustness on Obfuscated Factual Question Answering
di: Ghosh, Shubhra, et al.
Pubblicazione: (2025)
di: Ghosh, Shubhra, et al.
Pubblicazione: (2025)
REMIND: Input Loss Landscapes Reveal Residual Memorization in Post-Unlearning LLMs
di: Cohen, Liran, et al.
Pubblicazione: (2025)
di: Cohen, Liran, et al.
Pubblicazione: (2025)
RAC: Efficient LLM Factuality Correction with Retrieval Augmentation
di: Li, Changmao, et al.
Pubblicazione: (2024)
di: Li, Changmao, et al.
Pubblicazione: (2024)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2023)
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2023)
LongDocFACTScore: Evaluating the Factuality of Long Document Abstractive Summarisation
di: Bishop, Jennifer A, et al.
Pubblicazione: (2023)
di: Bishop, Jennifer A, et al.
Pubblicazione: (2023)
BLP-2023 Task 2: Sentiment Analysis
di: Hasan, Md. Arid, et al.
Pubblicazione: (2023)
di: Hasan, Md. Arid, et al.
Pubblicazione: (2023)
Random Heterogeneous Neurochaos Learning Architecture for Data Classification
di: S, Remya Ajai A, et al.
Pubblicazione: (2024)
di: S, Remya Ajai A, et al.
Pubblicazione: (2024)
The Hidden Attention of Mamba Models
di: Ali, Ameen, et al.
Pubblicazione: (2024)
di: Ali, Ameen, et al.
Pubblicazione: (2024)
Ambiguity in LLMs is a concept missing problem
di: Hu, Zhibo, et al.
Pubblicazione: (2025)
di: Hu, Zhibo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Annif at SemEval-2025 Task 5: Traditional XMTC augmented by LLMs
di: Suominen, Osma, et al.
Pubblicazione: (2025) -
Lon-ea at SemEval-2023 Task 11: A Comparison of Activation Functions for Soft and Hard Label Prediction
di: Hosseini, Peyman, et al.
Pubblicazione: (2023) -
PSK at SemEval-2026 Task 9: Multilingual Polarization Detection Using Ensemble Gemma Models with Synthetic Data Augmentation
di: Pulipaka, Srikar Kashyap
Pubblicazione: (2026) -
Atyaephyra at SemEval-2025 Task 4: Low-Rank Negative Preference Optimization
di: Bronec, Jan, et al.
Pubblicazione: (2025) -
CascadeMind at SemEval-2026 Task 4: A Hybrid Neuro-Symbolic Cascade for Narrative Similarity
di: Kawada, Sebastien, et al.
Pubblicazione: (2026)