ICU-Bench:Benchmarking Continual Unlearning in Multimodal Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wang, Yuhang, Mei, Wenjie, Zhang, Junkai, He, Guangyu, Niu, Zhenxing, Gao, Haichang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Null Space Constrained Contrastive Visual Forgetting for MLLM Unlearning
von: Wang, Yuhang, et al.
Veröffentlicht: (2026)
von: Wang, Yuhang, et al.
Veröffentlicht: (2026)
Robust MLLM Unlearning via Visual Knowledge Distillation
von: Wang, Yuhang, et al.
Veröffentlicht: (2025)
von: Wang, Yuhang, et al.
Veröffentlicht: (2025)
Towards Aligned Data Removal via Twin Machine Unlearning
von: Ji, Haoxuan, et al.
Veröffentlicht: (2024)
von: Ji, Haoxuan, et al.
Veröffentlicht: (2024)
From Assistant to Double Agent: Formalizing and Benchmarking Attacks on OpenClaw for Personalized Local AI Agent
von: Wang, Yuhang, et al.
Veröffentlicht: (2026)
von: Wang, Yuhang, et al.
Veröffentlicht: (2026)
Attention-Guided Reward for Reinforcement Learning-based Jailbreak against Large Reasoning Models
von: Lin, Zheng, et al.
Veröffentlicht: (2026)
von: Lin, Zheng, et al.
Veröffentlicht: (2026)
Guaranteed Jailbreaking Defense via Disrupt-and-Rectify Smoothing
von: Lin, Zheng, et al.
Veröffentlicht: (2026)
von: Lin, Zheng, et al.
Veröffentlicht: (2026)
A Systematic Security Evaluation of OpenClaw and Its Variants
von: Wang, Yuhang, et al.
Veröffentlicht: (2026)
von: Wang, Yuhang, et al.
Veröffentlicht: (2026)
Visual-Noise Guided In-Context Distillation for Multimodal Large Language Model Unlearning
von: Chen, Junkai, et al.
Veröffentlicht: (2026)
von: Chen, Junkai, et al.
Veröffentlicht: (2026)
The Dark Side of Function Calling: Pathways to Jailbreaking Large Language Models
von: Wu, Zihui, et al.
Veröffentlicht: (2024)
von: Wu, Zihui, et al.
Veröffentlicht: (2024)
Re-Triggering Safeguards within LLMs for Jailbreak Detection
von: Lin, Zheng, et al.
Veröffentlicht: (2026)
von: Lin, Zheng, et al.
Veröffentlicht: (2026)
SpatialBench: Benchmarking Multimodal Large Language Models for Spatial Cognition
von: Xu, Peiran, et al.
Veröffentlicht: (2025)
von: Xu, Peiran, et al.
Veröffentlicht: (2025)
MatSciBench: Benchmarking the Reasoning Ability of Large Language Models in Materials Science
von: Zhang, Junkai, et al.
Veröffentlicht: (2025)
von: Zhang, Junkai, et al.
Veröffentlicht: (2025)
OFFSIDE: Benchmarking Unlearning Misinformation in Multimodal Large Language Models
von: Zheng, Hao, et al.
Veröffentlicht: (2025)
von: Zheng, Hao, et al.
Veröffentlicht: (2025)
SUA: Stealthy Multimodal Large Language Model Unlearning Attack
von: Zhang, Xianren, et al.
Veröffentlicht: (2025)
von: Zhang, Xianren, et al.
Veröffentlicht: (2025)
PPU-Bench:Real World Benchmark for Personalized Partial Unlearning in Vision Language Models
von: Guang, Jiahui, et al.
Veröffentlicht: (2026)
von: Guang, Jiahui, et al.
Veröffentlicht: (2026)
EmoBench-M: Benchmarking Emotional Intelligence for Multimodal Large Language Models
von: Hu, He, et al.
Veröffentlicht: (2025)
von: Hu, He, et al.
Veröffentlicht: (2025)
MU-Bench: A Multitask Multimodal Benchmark for Machine Unlearning
von: Cheng, Jiali, et al.
Veröffentlicht: (2024)
von: Cheng, Jiali, et al.
Veröffentlicht: (2024)
GlitchMiner: Mining Glitch Tokens in Large Language Models via Gradient-based Discrete Optimization
von: Wu, Zihui, et al.
Veröffentlicht: (2024)
von: Wu, Zihui, et al.
Veröffentlicht: (2024)
SPM-Bench: Benchmarking Large Language Models for Scanning Probe Microscopy
von: Xiao, Peiyao, et al.
Veröffentlicht: (2026)
von: Xiao, Peiyao, et al.
Veröffentlicht: (2026)
HM-Bench: A Comprehensive Benchmark for Multimodal Large Language Models in Hyperspectral Remote Sensing
von: Zhang, Xinyu, et al.
Veröffentlicht: (2026)
von: Zhang, Xinyu, et al.
Veröffentlicht: (2026)
ASRU: Activation Steering Meets Reinforcement Unlearning for Multimodal Large Language Models
von: Guang, Jiahui, et al.
Veröffentlicht: (2026)
von: Guang, Jiahui, et al.
Veröffentlicht: (2026)
PetroBench: A Benchmark for Large Language Models in Petroleum Engineering
von: Wang, Xiang, et al.
Veröffentlicht: (2026)
von: Wang, Xiang, et al.
Veröffentlicht: (2026)
SketchJudge: A Diagnostic Benchmark for Grading Hand-drawn Diagrams with Multimodal Large Language Models
von: Su, Yuhang, et al.
Veröffentlicht: (2026)
von: Su, Yuhang, et al.
Veröffentlicht: (2026)
MLLMEraser: Achieving Test-Time Unlearning in Multimodal Large Language Models through Activation Steering
von: Ding, Chenlu, et al.
Veröffentlicht: (2025)
von: Ding, Chenlu, et al.
Veröffentlicht: (2025)
Single Image Unlearning: Efficient Machine Unlearning in Multimodal Large Language Models
von: Li, Jiaqi, et al.
Veröffentlicht: (2024)
von: Li, Jiaqi, et al.
Veröffentlicht: (2024)
From Individuals to Interactions: Benchmarking Gender Bias in Multimodal Large Language Models from the Lens of Social Relationship
von: Xu, Yue, et al.
Veröffentlicht: (2025)
von: Xu, Yue, et al.
Veröffentlicht: (2025)
EgoBench: An Interactive Egocentric Multimodal Benchmark for Tool-Using Agents
von: Liu, Yunqi, et al.
Veröffentlicht: (2026)
von: Liu, Yunqi, et al.
Veröffentlicht: (2026)
Towards Benign Memory Forgetting for Selective Multimodal Large Language Model Unlearning
von: Zeng, Zhen, et al.
Veröffentlicht: (2025)
von: Zeng, Zhen, et al.
Veröffentlicht: (2025)
RWKU: Benchmarking Real-World Knowledge Unlearning for Large Language Models
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)
von: Jin, Zhuoran, et al.
Veröffentlicht: (2024)
MPCI-Bench: A Benchmark for Multimodal Pairwise Contextual Integrity Evaluation of Language Model Agents
von: Wang, Shouju, et al.
Veröffentlicht: (2026)
von: Wang, Shouju, et al.
Veröffentlicht: (2026)
Market-Bench: Benchmarking Large Language Models on Economic and Trade Competition
von: Zheng, Yushuo, et al.
Veröffentlicht: (2026)
von: Zheng, Yushuo, et al.
Veröffentlicht: (2026)
II-Bench: An Image Implication Understanding Benchmark for Multimodal Large Language Models
von: Liu, Ziqiang, et al.
Veröffentlicht: (2024)
von: Liu, Ziqiang, et al.
Veröffentlicht: (2024)
AgriBench: A Hierarchical Agriculture Benchmark for Multimodal Large Language Models
von: Zhou, Yutong, et al.
Veröffentlicht: (2024)
von: Zhou, Yutong, et al.
Veröffentlicht: (2024)
MMUnlearner: Reformulating Multimodal Machine Unlearning in the Era of Multimodal Large Language Models
von: Huo, Jiahao, et al.
Veröffentlicht: (2025)
von: Huo, Jiahao, et al.
Veröffentlicht: (2025)
Erase Persona, Forget Lore: Benchmarking Multimodal Copyright Unlearning in Large Vision Language Models
von: Kwon, JuneHyoung, et al.
Veröffentlicht: (2026)
von: Kwon, JuneHyoung, et al.
Veröffentlicht: (2026)
Towards Reasoning-Preserving Unlearning in Multimodal Large Language Models
von: Li, Hongji, et al.
Veröffentlicht: (2025)
von: Li, Hongji, et al.
Veröffentlicht: (2025)
EngiBench: A Benchmark for Evaluating Large Language Models on Engineering Problem Solving
von: Zhou, Xiyuan, et al.
Veröffentlicht: (2025)
von: Zhou, Xiyuan, et al.
Veröffentlicht: (2025)
Benchmarking Reasoning Robustness in Large Language Models
von: Yu, Tong, et al.
Veröffentlicht: (2025)
von: Yu, Tong, et al.
Veröffentlicht: (2025)
Med-RewardBench: Benchmarking Reward Models and Judges for Medical Multimodal Large Language Models
von: Ding, Meidan, et al.
Veröffentlicht: (2025)
von: Ding, Meidan, et al.
Veröffentlicht: (2025)
VL-RouterBench: A Benchmark for Vision-Language Model Routing
von: Huang, Zhehao, et al.
Veröffentlicht: (2025)
von: Huang, Zhehao, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Null Space Constrained Contrastive Visual Forgetting for MLLM Unlearning
von: Wang, Yuhang, et al.
Veröffentlicht: (2026) -
Robust MLLM Unlearning via Visual Knowledge Distillation
von: Wang, Yuhang, et al.
Veröffentlicht: (2025) -
Towards Aligned Data Removal via Twin Machine Unlearning
von: Ji, Haoxuan, et al.
Veröffentlicht: (2024) -
From Assistant to Double Agent: Formalizing and Benchmarking Attacks on OpenClaw for Personalized Local AI Agent
von: Wang, Yuhang, et al.
Veröffentlicht: (2026) -
Attention-Guided Reward for Reinforcement Learning-based Jailbreak against Large Reasoning Models
von: Lin, Zheng, et al.
Veröffentlicht: (2026)