ICU-Bench:Benchmarking Continual Unlearning in Multimodal Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Yuhang, Mei, Wenjie, Zhang, Junkai, He, Guangyu, Niu, Zhenxing, Gao, Haichang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Null Space Constrained Contrastive Visual Forgetting for MLLM Unlearning
par: Wang, Yuhang, et autres
Publié: (2026)
par: Wang, Yuhang, et autres
Publié: (2026)
Robust MLLM Unlearning via Visual Knowledge Distillation
par: Wang, Yuhang, et autres
Publié: (2025)
par: Wang, Yuhang, et autres
Publié: (2025)
Towards Aligned Data Removal via Twin Machine Unlearning
par: Ji, Haoxuan, et autres
Publié: (2024)
par: Ji, Haoxuan, et autres
Publié: (2024)
From Assistant to Double Agent: Formalizing and Benchmarking Attacks on OpenClaw for Personalized Local AI Agent
par: Wang, Yuhang, et autres
Publié: (2026)
par: Wang, Yuhang, et autres
Publié: (2026)
Attention-Guided Reward for Reinforcement Learning-based Jailbreak against Large Reasoning Models
par: Lin, Zheng, et autres
Publié: (2026)
par: Lin, Zheng, et autres
Publié: (2026)
Guaranteed Jailbreaking Defense via Disrupt-and-Rectify Smoothing
par: Lin, Zheng, et autres
Publié: (2026)
par: Lin, Zheng, et autres
Publié: (2026)
A Systematic Security Evaluation of OpenClaw and Its Variants
par: Wang, Yuhang, et autres
Publié: (2026)
par: Wang, Yuhang, et autres
Publié: (2026)
Visual-Noise Guided In-Context Distillation for Multimodal Large Language Model Unlearning
par: Chen, Junkai, et autres
Publié: (2026)
par: Chen, Junkai, et autres
Publié: (2026)
The Dark Side of Function Calling: Pathways to Jailbreaking Large Language Models
par: Wu, Zihui, et autres
Publié: (2024)
par: Wu, Zihui, et autres
Publié: (2024)
Re-Triggering Safeguards within LLMs for Jailbreak Detection
par: Lin, Zheng, et autres
Publié: (2026)
par: Lin, Zheng, et autres
Publié: (2026)
SpatialBench: Benchmarking Multimodal Large Language Models for Spatial Cognition
par: Xu, Peiran, et autres
Publié: (2025)
par: Xu, Peiran, et autres
Publié: (2025)
MatSciBench: Benchmarking the Reasoning Ability of Large Language Models in Materials Science
par: Zhang, Junkai, et autres
Publié: (2025)
par: Zhang, Junkai, et autres
Publié: (2025)
OFFSIDE: Benchmarking Unlearning Misinformation in Multimodal Large Language Models
par: Zheng, Hao, et autres
Publié: (2025)
par: Zheng, Hao, et autres
Publié: (2025)
SUA: Stealthy Multimodal Large Language Model Unlearning Attack
par: Zhang, Xianren, et autres
Publié: (2025)
par: Zhang, Xianren, et autres
Publié: (2025)
PPU-Bench:Real World Benchmark for Personalized Partial Unlearning in Vision Language Models
par: Guang, Jiahui, et autres
Publié: (2026)
par: Guang, Jiahui, et autres
Publié: (2026)
EmoBench-M: Benchmarking Emotional Intelligence for Multimodal Large Language Models
par: Hu, He, et autres
Publié: (2025)
par: Hu, He, et autres
Publié: (2025)
MU-Bench: A Multitask Multimodal Benchmark for Machine Unlearning
par: Cheng, Jiali, et autres
Publié: (2024)
par: Cheng, Jiali, et autres
Publié: (2024)
GlitchMiner: Mining Glitch Tokens in Large Language Models via Gradient-based Discrete Optimization
par: Wu, Zihui, et autres
Publié: (2024)
par: Wu, Zihui, et autres
Publié: (2024)
SPM-Bench: Benchmarking Large Language Models for Scanning Probe Microscopy
par: Xiao, Peiyao, et autres
Publié: (2026)
par: Xiao, Peiyao, et autres
Publié: (2026)
HM-Bench: A Comprehensive Benchmark for Multimodal Large Language Models in Hyperspectral Remote Sensing
par: Zhang, Xinyu, et autres
Publié: (2026)
par: Zhang, Xinyu, et autres
Publié: (2026)
ASRU: Activation Steering Meets Reinforcement Unlearning for Multimodal Large Language Models
par: Guang, Jiahui, et autres
Publié: (2026)
par: Guang, Jiahui, et autres
Publié: (2026)
PetroBench: A Benchmark for Large Language Models in Petroleum Engineering
par: Wang, Xiang, et autres
Publié: (2026)
par: Wang, Xiang, et autres
Publié: (2026)
SketchJudge: A Diagnostic Benchmark for Grading Hand-drawn Diagrams with Multimodal Large Language Models
par: Su, Yuhang, et autres
Publié: (2026)
par: Su, Yuhang, et autres
Publié: (2026)
MLLMEraser: Achieving Test-Time Unlearning in Multimodal Large Language Models through Activation Steering
par: Ding, Chenlu, et autres
Publié: (2025)
par: Ding, Chenlu, et autres
Publié: (2025)
Single Image Unlearning: Efficient Machine Unlearning in Multimodal Large Language Models
par: Li, Jiaqi, et autres
Publié: (2024)
par: Li, Jiaqi, et autres
Publié: (2024)
From Individuals to Interactions: Benchmarking Gender Bias in Multimodal Large Language Models from the Lens of Social Relationship
par: Xu, Yue, et autres
Publié: (2025)
par: Xu, Yue, et autres
Publié: (2025)
EgoBench: An Interactive Egocentric Multimodal Benchmark for Tool-Using Agents
par: Liu, Yunqi, et autres
Publié: (2026)
par: Liu, Yunqi, et autres
Publié: (2026)
Towards Benign Memory Forgetting for Selective Multimodal Large Language Model Unlearning
par: Zeng, Zhen, et autres
Publié: (2025)
par: Zeng, Zhen, et autres
Publié: (2025)
RWKU: Benchmarking Real-World Knowledge Unlearning for Large Language Models
par: Jin, Zhuoran, et autres
Publié: (2024)
par: Jin, Zhuoran, et autres
Publié: (2024)
MPCI-Bench: A Benchmark for Multimodal Pairwise Contextual Integrity Evaluation of Language Model Agents
par: Wang, Shouju, et autres
Publié: (2026)
par: Wang, Shouju, et autres
Publié: (2026)
Market-Bench: Benchmarking Large Language Models on Economic and Trade Competition
par: Zheng, Yushuo, et autres
Publié: (2026)
par: Zheng, Yushuo, et autres
Publié: (2026)
II-Bench: An Image Implication Understanding Benchmark for Multimodal Large Language Models
par: Liu, Ziqiang, et autres
Publié: (2024)
par: Liu, Ziqiang, et autres
Publié: (2024)
AgriBench: A Hierarchical Agriculture Benchmark for Multimodal Large Language Models
par: Zhou, Yutong, et autres
Publié: (2024)
par: Zhou, Yutong, et autres
Publié: (2024)
MMUnlearner: Reformulating Multimodal Machine Unlearning in the Era of Multimodal Large Language Models
par: Huo, Jiahao, et autres
Publié: (2025)
par: Huo, Jiahao, et autres
Publié: (2025)
Erase Persona, Forget Lore: Benchmarking Multimodal Copyright Unlearning in Large Vision Language Models
par: Kwon, JuneHyoung, et autres
Publié: (2026)
par: Kwon, JuneHyoung, et autres
Publié: (2026)
Towards Reasoning-Preserving Unlearning in Multimodal Large Language Models
par: Li, Hongji, et autres
Publié: (2025)
par: Li, Hongji, et autres
Publié: (2025)
EngiBench: A Benchmark for Evaluating Large Language Models on Engineering Problem Solving
par: Zhou, Xiyuan, et autres
Publié: (2025)
par: Zhou, Xiyuan, et autres
Publié: (2025)
Benchmarking Reasoning Robustness in Large Language Models
par: Yu, Tong, et autres
Publié: (2025)
par: Yu, Tong, et autres
Publié: (2025)
Med-RewardBench: Benchmarking Reward Models and Judges for Medical Multimodal Large Language Models
par: Ding, Meidan, et autres
Publié: (2025)
par: Ding, Meidan, et autres
Publié: (2025)
VL-RouterBench: A Benchmark for Vision-Language Model Routing
par: Huang, Zhehao, et autres
Publié: (2025)
par: Huang, Zhehao, et autres
Publié: (2025)
Documents similaires
-
Null Space Constrained Contrastive Visual Forgetting for MLLM Unlearning
par: Wang, Yuhang, et autres
Publié: (2026) -
Robust MLLM Unlearning via Visual Knowledge Distillation
par: Wang, Yuhang, et autres
Publié: (2025) -
Towards Aligned Data Removal via Twin Machine Unlearning
par: Ji, Haoxuan, et autres
Publié: (2024) -
From Assistant to Double Agent: Formalizing and Benchmarking Attacks on OpenClaw for Personalized Local AI Agent
par: Wang, Yuhang, et autres
Publié: (2026) -
Attention-Guided Reward for Reinforcement Learning-based Jailbreak against Large Reasoning Models
par: Lin, Zheng, et autres
Publié: (2026)