OFMU: Optimization-Driven Framework for Machine Unlearning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Asif, Sadia, Amiri, Mohammad Mohammadi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
par: Fadli, Samih
Publié: (2025)
par: Fadli, Samih
Publié: (2025)
PRPO: Aligning Process Reward with Outcome Reward in Policy Optimization
par: Ding, Ruiyi, et autres
Publié: (2026)
par: Ding, Ruiyi, et autres
Publié: (2026)
FastGRPO: Accelerating Policy Optimization via Concurrency-aware Speculative Decoding and Online Draft Learning
par: Zhang, Yizhou, et autres
Publié: (2025)
par: Zhang, Yizhou, et autres
Publié: (2025)
Unlearning at Scale: Implementing the Right to be Forgotten in Large Language Models
par: X, Abdullah
Publié: (2025)
par: X, Abdullah
Publié: (2025)
Machine Unlearning for Masked Diffusion Language Models
par: Lee, Georu, et autres
Publié: (2026)
par: Lee, Georu, et autres
Publié: (2026)
Social Cooperation in Conversational AI Agents
par: Çelikok, Mustafa Mert, et autres
Publié: (2025)
par: Çelikok, Mustafa Mert, et autres
Publié: (2025)
FastForward Pruning: Efficient LLM Pruning via Single-Step Reinforcement Learning
par: Yuan, Xin, et autres
Publié: (2025)
par: Yuan, Xin, et autres
Publié: (2025)
Persona Features Control Emergent Misalignment
par: Wang, Miles, et autres
Publié: (2025)
par: Wang, Miles, et autres
Publié: (2025)
Autonomous Deep Agent
par: Yu, Amy, et autres
Publié: (2025)
par: Yu, Amy, et autres
Publié: (2025)
The Anti-Ouroboros Effect: Emergent Resilience in Large Language Models from Recursive Selective Feedback
par: Adapala, Sai Teja Reddy
Publié: (2025)
par: Adapala, Sai Teja Reddy
Publié: (2025)
Overclocking LLM Reasoning: Monitoring and Controlling Thinking Path Lengths in LLMs
par: Eisenstadt, Roy, et autres
Publié: (2025)
par: Eisenstadt, Roy, et autres
Publié: (2025)
Node-Level Uncertainty Estimation in LLM-Generated SQL
par: Hasson, Hilaf, et autres
Publié: (2025)
par: Hasson, Hilaf, et autres
Publié: (2025)
Reasoning Large Language Model Errors Arise from Hallucinating Critical Problem Features
par: Heyman, Alex, et autres
Publié: (2025)
par: Heyman, Alex, et autres
Publié: (2025)
ReflexGrad: Within-Episode Failure Recovery in LLM Agents via Progress-Gated Dual-Process Routing
par: Kadu, Ankush, et autres
Publié: (2025)
par: Kadu, Ankush, et autres
Publié: (2025)
How Does Unfaithful Reasoning Emerge from Autoregressive Training? A Study of Synthetic Experiments
par: Wang, Fuxin, et autres
Publié: (2026)
par: Wang, Fuxin, et autres
Publié: (2026)
Extreme AutoML: Analysis of Classification, Regression, and NLP Performance
par: Ratner, Edward, et autres
Publié: (2024)
par: Ratner, Edward, et autres
Publié: (2024)
CircuitProbe: Predicting Reasoning Circuits in Transformers via Stability Zone Detection
par: Panuganti, Rajkiran
Publié: (2026)
par: Panuganti, Rajkiran
Publié: (2026)
On Semantic Loss Fine-Tuning Approach for Preventing Model Collapse in Causal Reasoning
par: Deshmukh, Pratik, et autres
Publié: (2026)
par: Deshmukh, Pratik, et autres
Publié: (2026)
Quantization Undoes Alignment: Bias Emergence in Compressed LLMs Across Models and Precision Levels
par: Rath, Plawan Kumar, et autres
Publié: (2026)
par: Rath, Plawan Kumar, et autres
Publié: (2026)
BLOCK-EM: Preventing Emergent Misalignment via Latent Blocking
par: Ustaomeroglu, Muhammed, et autres
Publié: (2026)
par: Ustaomeroglu, Muhammed, et autres
Publié: (2026)
Task-Conditioned Routing Signatures in Sparse Mixture-of-Experts Transformers
par: Avinash, Mynampati Sri Ranganadha
Publié: (2026)
par: Avinash, Mynampati Sri Ranganadha
Publié: (2026)
Shattered Compositionality: Counterintuitive Learning Dynamics of Transformers for Arithmetic
par: Zhao, Xingyu, et autres
Publié: (2026)
par: Zhao, Xingyu, et autres
Publié: (2026)
The Geometry of Thought: How Scale Restructures Reasoning In Large Language Models
par: Anderson, Samuel Cyrenius
Publié: (2026)
par: Anderson, Samuel Cyrenius
Publié: (2026)
SCULPT: Constraint-Guided Pruned MCTS that Carves Efficient Paths for Mathematical Reasoning
par: Fang, Qitong, et autres
Publié: (2026)
par: Fang, Qitong, et autres
Publié: (2026)
On the Limits of Learned Importance Scoring for KV Cache Compression
par: Steele, Brady
Publié: (2026)
par: Steele, Brady
Publié: (2026)
Scaling Trends for Multi-Hop Contextual Reasoning in Mid-Scale Language Models
par: Steele, Brady, et autres
Publié: (2026)
par: Steele, Brady, et autres
Publié: (2026)
MaPPO: Maximum a Posteriori Preference Optimization with Prior Knowledge
par: Lan, Guangchen, et autres
Publié: (2025)
par: Lan, Guangchen, et autres
Publié: (2025)
A Confidence-Diversity Framework for Calibrating AI Judgement in Accessible Qualitative Coding Tasks
par: Zhao, Zhilong, et autres
Publié: (2025)
par: Zhao, Zhilong, et autres
Publié: (2025)
Structured Prompt Optimization Meets Reinforcement Learning for Global and Local Interpretability over Complex Text
par: Zhou, Tianyang, et autres
Publié: (2026)
par: Zhou, Tianyang, et autres
Publié: (2026)
Scalable GPU-Accelerated Euler Characteristic Curves: Optimization and Differentiable Learning for PyTorch
par: Saxena, Udit
Publié: (2025)
par: Saxena, Udit
Publié: (2025)
KerZOO: Kernel Function Informed Zeroth-Order Optimization for Accurate and Accelerated LLM Fine-Tuning
par: Mi, Zhendong, et autres
Publié: (2025)
par: Mi, Zhendong, et autres
Publié: (2025)
Why LoRA Resists Label Noise: A Theoretical Framework for Noise-Robust Parameter-Efficient Fine-Tuning
par: Steele, Brady
Publié: (2026)
par: Steele, Brady
Publié: (2026)
Less is More: Learning Graph Tasks with Just LLMs
par: Shirai, Sola, et autres
Publié: (2025)
par: Shirai, Sola, et autres
Publié: (2025)
Continuous Latent Contexts Enable Efficient Online Learning in Transformers
par: Anand, Emile, et autres
Publié: (2026)
par: Anand, Emile, et autres
Publié: (2026)
Quantization-Robust LLM Unlearning via Low-Rank Adaptation
par: Abitante, João Vitor Boer, et autres
Publié: (2026)
par: Abitante, João Vitor Boer, et autres
Publié: (2026)
Merge-Bench: Resolve Merge Conflicts with Large Language Models
par: Schesch, Benedikt, et autres
Publié: (2026)
par: Schesch, Benedikt, et autres
Publié: (2026)
Automated CAD Modeling Sequence Generation from Text Descriptions via Transformer-Based Large Language Models
par: Liao, Jianxing, et autres
Publié: (2025)
par: Liao, Jianxing, et autres
Publié: (2025)
JURY-RL: Votes Propose, Proofs Dispose for Label-Free RLVR
par: Chen, Xinjie, et autres
Publié: (2026)
par: Chen, Xinjie, et autres
Publié: (2026)
OSCToM: RL-Guided Adversarial Generation for High-Order Theory of Mind
par: Srishty, Sharmin Sultana, et autres
Publié: (2026)
par: Srishty, Sharmin Sultana, et autres
Publié: (2026)
BitCal-TTS: Bit-Calibrated Test-Time Scaling for Quantized Reasoning Models
par: Patarlapalli, Sai Babu, et autres
Publié: (2026)
par: Patarlapalli, Sai Babu, et autres
Publié: (2026)
Documents similaires
-
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
par: Fadli, Samih
Publié: (2025) -
PRPO: Aligning Process Reward with Outcome Reward in Policy Optimization
par: Ding, Ruiyi, et autres
Publié: (2026) -
FastGRPO: Accelerating Policy Optimization via Concurrency-aware Speculative Decoding and Online Draft Learning
par: Zhang, Yizhou, et autres
Publié: (2025) -
Unlearning at Scale: Implementing the Right to be Forgotten in Large Language Models
par: X, Abdullah
Publié: (2025) -
Machine Unlearning for Masked Diffusion Language Models
par: Lee, Georu, et autres
Publié: (2026)