PPU-Bench:Real World Benchmark for Personalized Partial Unlearning in Vision Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Guang, Jiahui, Zhan, Zexun, Xu, Zhenlin, Gao, Cuiyun, Wang, Haiyan, Li, Jing, Gu, Zhaoquan, Zhang, Yanchun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ASRU: Activation Steering Meets Reinforcement Unlearning for Multimodal Large Language Models
por: Guang, Jiahui, et al.
Publicado: (2026)
por: Guang, Jiahui, et al.
Publicado: (2026)
SR-Eval: Evaluating LLMs on Code Generation under Stepwise Requirement Refinement
por: Zhan, Zexun, et al.
Publicado: (2025)
por: Zhan, Zexun, et al.
Publicado: (2025)
MFC-Bench: Benchmarking Multimodal Fact-Checking with Large Vision-Language Models
por: Wang, Shengkang, et al.
Publicado: (2024)
por: Wang, Shengkang, et al.
Publicado: (2024)
FinChart-Bench: Benchmarking Financial Chart Comprehension in Vision-Language Models
por: Shu, Dong, et al.
Publicado: (2025)
por: Shu, Dong, et al.
Publicado: (2025)
DiffuSyn Bench: Evaluating Vision-Language Models on Real-World Complexities with Diffusion-Generated Synthetic Benchmarks
por: Zhou, Haokun, et al.
Publicado: (2024)
por: Zhou, Haokun, et al.
Publicado: (2024)
POINav: Benchmarking and Enhancing Final-Meters Arrival in Real-World Vision-Language Navigation
por: Gong, Ruiyan, et al.
Publicado: (2026)
por: Gong, Ruiyan, et al.
Publicado: (2026)
VLRS-Bench: A Vision-Language Reasoning Benchmark for Remote Sensing
por: Luo, Zhiming, et al.
Publicado: (2026)
por: Luo, Zhiming, et al.
Publicado: (2026)
Benchmarking Unlearning for Vision Transformers
por: Zhao, Kairan, et al.
Publicado: (2026)
por: Zhao, Kairan, et al.
Publicado: (2026)
SAUCE: Selective Concept Unlearning in Vision-Language Models with Sparse Autoencoders
por: Li, Qing, et al.
Publicado: (2025)
por: Li, Qing, et al.
Publicado: (2025)
PhysBench: Benchmarking and Enhancing Vision-Language Models for Physical World Understanding
por: Chow, Wei, et al.
Publicado: (2025)
por: Chow, Wei, et al.
Publicado: (2025)
AgroBench: Vision-Language Model Benchmark in Agriculture
por: Shinoda, Risa, et al.
Publicado: (2025)
por: Shinoda, Risa, et al.
Publicado: (2025)
EchoBench: Benchmarking Sycophancy in Medical Large Vision-Language Models
por: Yuan, Botai, et al.
Publicado: (2025)
por: Yuan, Botai, et al.
Publicado: (2025)
Benchmarking Vision Language Model Unlearning via Fictitious Facial Identity Dataset
por: Ma, Yingzi, et al.
Publicado: (2024)
por: Ma, Yingzi, et al.
Publicado: (2024)
Debiased Dual-Invariant Defense for Adversarially Robust Person Re-Identification
por: Zhou, Yuhang, et al.
Publicado: (2025)
por: Zhou, Yuhang, et al.
Publicado: (2025)
MotionBench: Benchmarking and Improving Fine-grained Video Motion Understanding for Vision Language Models
por: Hong, Wenyi, et al.
Publicado: (2025)
por: Hong, Wenyi, et al.
Publicado: (2025)
HUGE-Bench: A Benchmark for High-Level UAV Vision-Language-Action Tasks
por: Guo, Jingyu, et al.
Publicado: (2026)
por: Guo, Jingyu, et al.
Publicado: (2026)
Benchmarking Zero-Shot Recognition with Vision-Language Models: Challenges on Granularity and Specificity
por: Xu, Zhenlin, et al.
Publicado: (2023)
por: Xu, Zhenlin, et al.
Publicado: (2023)
VLBiasBench: A Comprehensive Benchmark for Evaluating Bias in Large Vision-Language Model
por: Wang, Sibo, et al.
Publicado: (2024)
por: Wang, Sibo, et al.
Publicado: (2024)
μ-Bench: A Vision-Language Benchmark for Microscopy Understanding
por: Lozano, Alejandro, et al.
Publicado: (2024)
por: Lozano, Alejandro, et al.
Publicado: (2024)
EgoPlan-Bench2: A Benchmark for Multimodal Large Language Model Planning in Real-World Scenarios
por: Qiu, Lu, et al.
Publicado: (2024)
por: Qiu, Lu, et al.
Publicado: (2024)
@Bench: Benchmarking Vision-Language Models for Human-centered Assistive Technology
por: Jiang, Xin, et al.
Publicado: (2024)
por: Jiang, Xin, et al.
Publicado: (2024)
DreamBench++: A Human-Aligned Benchmark for Personalized Image Generation
por: Peng, Yuang, et al.
Publicado: (2024)
por: Peng, Yuang, et al.
Publicado: (2024)
A Benchmark and Evaluation for Real-World Out-of-Distribution Detection Using Vision-Language Models
por: Noda, Shiho, et al.
Publicado: (2025)
por: Noda, Shiho, et al.
Publicado: (2025)
Real5-OmniDocBench: A Full-Scale Physical Reconstruction Benchmark for Robust Document Parsing in the Wild
por: Zhou, Changda, et al.
Publicado: (2026)
por: Zhou, Changda, et al.
Publicado: (2026)
BenchX: A Unified Benchmark Framework for Medical Vision-Language Pretraining on Chest X-Rays
por: Zhou, Yang, et al.
Publicado: (2024)
por: Zhou, Yang, et al.
Publicado: (2024)
DG-PPU: Dynamical Graphs based Post-processing of Point Clouds extracted from Knee Ultrasounds
por: Hwang, Injune, et al.
Publicado: (2024)
por: Hwang, Injune, et al.
Publicado: (2024)
Heron-Bench: A Benchmark for Evaluating Vision Language Models in Japanese
por: Inoue, Yuichi, et al.
Publicado: (2024)
por: Inoue, Yuichi, et al.
Publicado: (2024)
How Far Are Vision-Language Models from Constructing the Real World? A Benchmark for Physical Generative Reasoning
por: Yang, Luyu, et al.
Publicado: (2026)
por: Yang, Luyu, et al.
Publicado: (2026)
WeatherBench: A Real-World Benchmark Dataset for All-in-One Adverse Weather Image Restoration
por: Guan, Qiyuan, et al.
Publicado: (2025)
por: Guan, Qiyuan, et al.
Publicado: (2025)
Real-IAD: A Real-World Multi-View Dataset for Benchmarking Versatile Industrial Anomaly Detection
por: Wang, Chengjie, et al.
Publicado: (2024)
por: Wang, Chengjie, et al.
Publicado: (2024)
VenusBench-GD: A Comprehensive Multi-Platform GUI Benchmark for Diverse Grounding Tasks
por: Zhou, Beitong, et al.
Publicado: (2025)
por: Zhou, Beitong, et al.
Publicado: (2025)
iWorld-Bench: A Benchmark for Interactive World Models with a Unified Action Generation Framework
por: Fang, Jianjie, et al.
Publicado: (2026)
por: Fang, Jianjie, et al.
Publicado: (2026)
UniMERNet: A Universal Network for Real-World Mathematical Expression Recognition
por: Wang, Bin, et al.
Publicado: (2024)
por: Wang, Bin, et al.
Publicado: (2024)
Erase Persona, Forget Lore: Benchmarking Multimodal Copyright Unlearning in Large Vision Language Models
por: Kwon, JuneHyoung, et al.
Publicado: (2026)
por: Kwon, JuneHyoung, et al.
Publicado: (2026)
MMT-Bench: A Comprehensive Multimodal Benchmark for Evaluating Large Vision-Language Models Towards Multitask AGI
por: Ying, Kaining, et al.
Publicado: (2024)
por: Ying, Kaining, et al.
Publicado: (2024)
UnsafeBench: Benchmarking Image Safety Classifiers on Real-World and AI-Generated Images
por: Qu, Yiting, et al.
Publicado: (2024)
por: Qu, Yiting, et al.
Publicado: (2024)
Lingua-SafetyBench: A Benchmark for Safety Evaluation of Multilingual Vision-Language Models
por: Shi, Enyi, et al.
Publicado: (2026)
por: Shi, Enyi, et al.
Publicado: (2026)
VGRP-Bench: Visual Grid Reasoning Puzzle Benchmark for Large Vision-Language Models
por: Ren, Yufan, et al.
Publicado: (2025)
por: Ren, Yufan, et al.
Publicado: (2025)
HomeSafeBench: A Benchmark for Embodied Vision-Language Models in Free-Exploration Home Safety Inspection
por: Gao, Siyuan, et al.
Publicado: (2025)
por: Gao, Siyuan, et al.
Publicado: (2025)
VULCA-Bench: A Multicultural Vision-Language Benchmark for Evaluating Cultural Understanding
por: Yu, Haorui, et al.
Publicado: (2026)
por: Yu, Haorui, et al.
Publicado: (2026)
Ejemplares similares
-
ASRU: Activation Steering Meets Reinforcement Unlearning for Multimodal Large Language Models
por: Guang, Jiahui, et al.
Publicado: (2026) -
SR-Eval: Evaluating LLMs on Code Generation under Stepwise Requirement Refinement
por: Zhan, Zexun, et al.
Publicado: (2025) -
MFC-Bench: Benchmarking Multimodal Fact-Checking with Large Vision-Language Models
por: Wang, Shengkang, et al.
Publicado: (2024) -
FinChart-Bench: Benchmarking Financial Chart Comprehension in Vision-Language Models
por: Shu, Dong, et al.
Publicado: (2025) -
DiffuSyn Bench: Evaluating Vision-Language Models on Real-World Complexities with Diffusion-Generated Synthetic Benchmarks
por: Zhou, Haokun, et al.
Publicado: (2024)