The Limits of Obliviate: Evaluating Unlearning in LLMs via Stimulus-Knowledge Entanglement-Behavior Framework
Fuente:
arXiv
Salvato in:
| Autori principali: | Shah, Aakriti, Le, Thai |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
HIP Network: Historical Information Passing Network for Extrapolation Reasoning on Temporal Knowledge Graph
di: He, Yongquan, et al.
Pubblicazione: (2024)
di: He, Yongquan, et al.
Pubblicazione: (2024)
OntoLogX: Ontology-Guided Knowledge Graph Extraction from Cybersecurity Logs with Large Language Models
di: Cotti, Luca, et al.
Pubblicazione: (2025)
di: Cotti, Luca, et al.
Pubblicazione: (2025)
SAGE: A Strategy-Aware Graph-Enhanced Generation Framework For Online Counseling
di: Aharon, Eliya Naomi, et al.
Pubblicazione: (2026)
di: Aharon, Eliya Naomi, et al.
Pubblicazione: (2026)
Automated Circuit Interpretation via Probe Prompting
di: Birardi, Giuseppe
Pubblicazione: (2025)
di: Birardi, Giuseppe
Pubblicazione: (2025)
A Domain-Agnostic Neurosymbolic Approach for Big Social Data Analysis: Evaluating Mental Health Sentiment on Social Media during COVID-19
di: Khandelwal, Vedant, et al.
Pubblicazione: (2024)
di: Khandelwal, Vedant, et al.
Pubblicazione: (2024)
Evo-DKD: Dual-Knowledge Decoding for Autonomous Ontology Evolution in Large Language Models
di: Raman, Vishal, et al.
Pubblicazione: (2025)
di: Raman, Vishal, et al.
Pubblicazione: (2025)
HyperPersona: A Multi-Level Hypergraph Framework for Text-Based Automatic Personality Prediction
di: Heydari, Sina, et al.
Pubblicazione: (2026)
di: Heydari, Sina, et al.
Pubblicazione: (2026)
Learning, Fast and Slow: Towards LLMs That Adapt Continually
di: Tiwari, Rishabh, et al.
Pubblicazione: (2026)
di: Tiwari, Rishabh, et al.
Pubblicazione: (2026)
Robustness of Spatio-temporal Graph Neural Networks for Fault Location in Partially Observable Distribution Grids
di: Karabulut, Burak, et al.
Pubblicazione: (2026)
di: Karabulut, Burak, et al.
Pubblicazione: (2026)
MeMo: Towards Language Models with Associative Memory Mechanisms
di: Zanzotto, Fabio Massimo, et al.
Pubblicazione: (2025)
di: Zanzotto, Fabio Massimo, et al.
Pubblicazione: (2025)
Enabling Transparent Cyber Threat Intelligence Combining Large Language Models and Domain Ontologies
di: Cotti, Luca, et al.
Pubblicazione: (2025)
di: Cotti, Luca, et al.
Pubblicazione: (2025)
LLM-FACETS: A Privacy-Preserving Framework for Evaluating LLM Transparency and Accountability
di: Lucas, Tom, et al.
Pubblicazione: (2026)
di: Lucas, Tom, et al.
Pubblicazione: (2026)
Learning Natural Language Constraints for Safe Reinforcement Learning of Language Agents
di: Chua, Jaymari, et al.
Pubblicazione: (2025)
di: Chua, Jaymari, et al.
Pubblicazione: (2025)
Enhancing Large Language Models through Neuro-Symbolic Integration and Ontological Reasoning
di: Vsevolodovna, Ruslan Idelfonso Magana, et al.
Pubblicazione: (2025)
di: Vsevolodovna, Ruslan Idelfonso Magana, et al.
Pubblicazione: (2025)
Unveiling the Secret Recipe: A Guide For Supervised Fine-Tuning Small LLMs
di: Pareja, Aldo, et al.
Pubblicazione: (2024)
di: Pareja, Aldo, et al.
Pubblicazione: (2024)
Conformal Path Reasoning: Trustworthy Knowledge Graph Question Answering via Path-Level Calibration
di: Lin, Shuhang, et al.
Pubblicazione: (2026)
di: Lin, Shuhang, et al.
Pubblicazione: (2026)
Learning What Matters: Probabilistic Task Selection via Mutual Information for Model Finetuning
di: Chanda, Prateek, et al.
Pubblicazione: (2025)
di: Chanda, Prateek, et al.
Pubblicazione: (2025)
MOCHA: Multi-Objective Chebyshev Annealing for Agent Skill Optimization
di: Tanjim, Md Mehrab, et al.
Pubblicazione: (2026)
di: Tanjim, Md Mehrab, et al.
Pubblicazione: (2026)
A Graph-based RAG for Energy Efficiency Question Answering
di: Campi, Riccardo, et al.
Pubblicazione: (2025)
di: Campi, Riccardo, et al.
Pubblicazione: (2025)
LLMs for Game Theory: Entropy-Guided In-Context Learning and Adaptive CoT Reasoning
di: Banfi, Tommaso Felice, et al.
Pubblicazione: (2026)
di: Banfi, Tommaso Felice, et al.
Pubblicazione: (2026)
Recurrent Memory-Augmented Transformers with Chunked Attention for Long-Context Language Modeling
di: Kashyap, Ankit
Pubblicazione: (2025)
di: Kashyap, Ankit
Pubblicazione: (2025)
ComplianceNLP: Knowledge-Graph-Augmented RAG for Multi-Framework Regulatory Gap Detection
di: Guo, Dongxin, et al.
Pubblicazione: (2026)
di: Guo, Dongxin, et al.
Pubblicazione: (2026)
Tensor Manifold-Based Graph-Vector Fusion for AI-Native Academic Literature Retrieval
di: Wei, Xing, et al.
Pubblicazione: (2026)
di: Wei, Xing, et al.
Pubblicazione: (2026)
Sample-Efficient Language Model for Hinglish Conversational AI
di: Singh, Sakshi, et al.
Pubblicazione: (2025)
di: Singh, Sakshi, et al.
Pubblicazione: (2025)
Exploring LLM-based Verilog Code Generation with Data-Efficient Fine-Tuning and Testbench Automation
di: Chen, Mu-Chi, et al.
Pubblicazione: (2026)
di: Chen, Mu-Chi, et al.
Pubblicazione: (2026)
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
di: Fadli, Samih
Pubblicazione: (2025)
di: Fadli, Samih
Pubblicazione: (2025)
Interactive LLM-assisted Curriculum Learning for Multi-Task Evolutionary Policy Search
di: Sakallioglu, Berfin, et al.
Pubblicazione: (2026)
di: Sakallioglu, Berfin, et al.
Pubblicazione: (2026)
Towards Observation Lakehouses: Living, Interactive Archives of Software Behavior
di: Kessel, Marcus
Pubblicazione: (2025)
di: Kessel, Marcus
Pubblicazione: (2025)
Survey Transfer Learning: Recycling Data with Silicon Responses
di: Amini, Ali
Pubblicazione: (2025)
di: Amini, Ali
Pubblicazione: (2025)
Mitigating Cross-Lingual Cultural Inconsistencies in LLMs via Consensus-Driven Preference Optimisation
di: Resck, Lucas, et al.
Pubblicazione: (2026)
di: Resck, Lucas, et al.
Pubblicazione: (2026)
Hopscotch: Discovering and Skipping Redundancies in Language Models
di: Eyceoz, Mustafa, et al.
Pubblicazione: (2025)
di: Eyceoz, Mustafa, et al.
Pubblicazione: (2025)
Sparsification and Reconstruction from the Perspective of Representation Geometry
di: Sun, Wenjie, et al.
Pubblicazione: (2025)
di: Sun, Wenjie, et al.
Pubblicazione: (2025)
When Reasoning Fails: Evaluating 'Thinking' LLMs for Stock Prediction
di: Sodha, Rakeshkumar H
Pubblicazione: (2025)
di: Sodha, Rakeshkumar H
Pubblicazione: (2025)
GEPA: Reflective Prompt Evolution Can Outperform Reinforcement Learning
di: Agrawal, Lakshya A, et al.
Pubblicazione: (2025)
di: Agrawal, Lakshya A, et al.
Pubblicazione: (2025)
Parameter-Efficient and Personalized Federated Training of Generative Models at the Edge
di: Khan, Kabir, et al.
Pubblicazione: (2025)
di: Khan, Kabir, et al.
Pubblicazione: (2025)
PRISMA: Preference-Reinforced Self-Training Approach for Interpretable Emotionally Intelligent Negotiation Dialogues
di: Kajare, Prajwal Vijay, et al.
Pubblicazione: (2026)
di: Kajare, Prajwal Vijay, et al.
Pubblicazione: (2026)
propella-1: Multi-Property Document Annotation for LLM Data Curation at Scale
di: Idahl, Maximilian, et al.
Pubblicazione: (2026)
di: Idahl, Maximilian, et al.
Pubblicazione: (2026)
Multi-Paradigm Agent Interaction in Practice:A Systematic Analysis of Generator-Evaluator, ReAct Loop,and Adversarial Evaluation in the buddyMe Framework
di: Wang, Xiaohua, et al.
Pubblicazione: (2026)
di: Wang, Xiaohua, et al.
Pubblicazione: (2026)
A Prescriptive Framework for Determining Optimal Days for Short-Term Traffic Counts
di: Mukwaya, Arthur, et al.
Pubblicazione: (2025)
di: Mukwaya, Arthur, et al.
Pubblicazione: (2025)
OFMU: Optimization-Driven Framework for Machine Unlearning
di: Asif, Sadia, et al.
Pubblicazione: (2025)
di: Asif, Sadia, et al.
Pubblicazione: (2025)
Documenti analoghi
-
HIP Network: Historical Information Passing Network for Extrapolation Reasoning on Temporal Knowledge Graph
di: He, Yongquan, et al.
Pubblicazione: (2024) -
OntoLogX: Ontology-Guided Knowledge Graph Extraction from Cybersecurity Logs with Large Language Models
di: Cotti, Luca, et al.
Pubblicazione: (2025) -
SAGE: A Strategy-Aware Graph-Enhanced Generation Framework For Online Counseling
di: Aharon, Eliya Naomi, et al.
Pubblicazione: (2026) -
Automated Circuit Interpretation via Probe Prompting
di: Birardi, Giuseppe
Pubblicazione: (2025) -
A Domain-Agnostic Neurosymbolic Approach for Big Social Data Analysis: Evaluating Mental Health Sentiment on Social Media during COVID-19
di: Khandelwal, Vedant, et al.
Pubblicazione: (2024)