Omni-SafetyBench: A Benchmark for Safety Evaluation of Audio-Visual Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Pan, Leyi, Fu, Zheyu, Zhai, Yunpeng, Tao, Shuchang, Guan, Sheng, Huang, Shiyu, Zhang, Lingzhe, Liu, Zhaoyang, Ding, Bolin, Henry, Felix, Liu, Aiwei, Wen, Lijie |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
d-TreeRPO: Towards More Reliable Policy Optimization for Diffusion Language Models
von: Pan, Leyi, et al.
Veröffentlicht: (2025)
von: Pan, Leyi, et al.
Veröffentlicht: (2025)
MicroRemed: Benchmarking LLMs in Microservices Remediation
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2025)
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2025)
A Survey on Parallel Text Generation: From Parallel Decoding to Diffusion Language Models
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2025)
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2025)
A Semantic Invariant Robust Watermark for Large Language Models
von: Liu, Aiwei, et al.
Veröffentlicht: (2023)
von: Liu, Aiwei, et al.
Veröffentlicht: (2023)
Can LLM Watermarks Robustly Prevent Unauthorized Knowledge Distillation?
von: Pan, Leyi, et al.
Veröffentlicht: (2025)
von: Pan, Leyi, et al.
Veröffentlicht: (2025)
Can Watermarked LLMs be Identified by Users via Crafted Prompts?
von: Liu, Aiwei, et al.
Veröffentlicht: (2024)
von: Liu, Aiwei, et al.
Veröffentlicht: (2024)
Video-SafetyBench: A Benchmark for Safety Evaluation of Video LVLMs
von: Liu, Xuannan, et al.
Veröffentlicht: (2025)
von: Liu, Xuannan, et al.
Veröffentlicht: (2025)
WaterSeeker: Pioneering Efficient Detection of Watermarked Segments in Large Documents
von: Pan, Leyi, et al.
Veröffentlicht: (2024)
von: Pan, Leyi, et al.
Veröffentlicht: (2024)
MarkDiffusion: An Open-Source Toolkit for Generative Watermarking of Latent Diffusion Models
von: Pan, Leyi, et al.
Veröffentlicht: (2025)
von: Pan, Leyi, et al.
Veröffentlicht: (2025)
SafetyBench: Evaluating the Safety of Large Language Models
von: Zhang, Zhexin, et al.
Veröffentlicht: (2023)
von: Zhang, Zhexin, et al.
Veröffentlicht: (2023)
MM-SafetyBench: A Benchmark for Safety Evaluation of Multimodal Large Language Models
von: Liu, Xin, et al.
Veröffentlicht: (2023)
von: Liu, Xin, et al.
Veröffentlicht: (2023)
An Unforgeable Publicly Verifiable Watermark for Large Language Models
von: Liu, Aiwei, et al.
Veröffentlicht: (2023)
von: Liu, Aiwei, et al.
Veröffentlicht: (2023)
Agent-SafetyBench: Evaluating the Safety of LLM Agents
von: Zhang, Zhexin, et al.
Veröffentlicht: (2024)
von: Zhang, Zhexin, et al.
Veröffentlicht: (2024)
Lingua-SafetyBench: A Benchmark for Safety Evaluation of Multilingual Vision-Language Models
von: Shi, Enyi, et al.
Veröffentlicht: (2026)
von: Shi, Enyi, et al.
Veröffentlicht: (2026)
A Survey of Text Watermarking in the Era of Large Language Models
von: Liu, Aiwei, et al.
Veröffentlicht: (2023)
von: Liu, Aiwei, et al.
Veröffentlicht: (2023)
XL-SafetyBench: A Country-Grounded Cross-Cultural Benchmark for LLM Safety and Cultural Sensitivity
von: Choi, Dasol, et al.
Veröffentlicht: (2026)
von: Choi, Dasol, et al.
Veröffentlicht: (2026)
ChatCite: LLM Agent with Human Workflow Guidance for Comparative Literature Summary
von: Li, Yutong, et al.
Veröffentlicht: (2024)
von: Li, Yutong, et al.
Veröffentlicht: (2024)
MCP-SafetyBench: A Benchmark for Safety Evaluation of Large Language Models with Real-World MCP Servers
von: Zong, Xuanjun, et al.
Veröffentlicht: (2025)
von: Zong, Xuanjun, et al.
Veröffentlicht: (2025)
MarkLLM: An Open-Source Toolkit for LLM Watermarking
von: Pan, Leyi, et al.
Veröffentlicht: (2024)
von: Pan, Leyi, et al.
Veröffentlicht: (2024)
On the Robustness of Document-Level Relation Extraction Models to Entity Name Variations
von: Meng, Shiao, et al.
Veröffentlicht: (2024)
von: Meng, Shiao, et al.
Veröffentlicht: (2024)
Direct Large Language Model Alignment Through Self-Rewarding Contrastive Prompt Distillation
von: Liu, Aiwei, et al.
Veröffentlicht: (2024)
von: Liu, Aiwei, et al.
Veröffentlicht: (2024)
E2E-REME: Towards End-to-End Microservices Auto-Remediation via Experience-Simulation Reinforcement Fine-Tuning
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2026)
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2026)
CuES: A Curiosity-driven and Environment-grounded Synthesis Framework for Agentic RL
von: Mai, Shinji, et al.
Veröffentlicht: (2025)
von: Mai, Shinji, et al.
Veröffentlicht: (2025)
TIS-DPO: Token-level Importance Sampling for Direct Preference Optimization With Estimated Weights
von: Liu, Aiwei, et al.
Veröffentlicht: (2024)
von: Liu, Aiwei, et al.
Veröffentlicht: (2024)
How Safe is Your Safety Metric? Automatic Concatenation Tests for Metric Reliability
von: Fandina, Ora Nova, et al.
Veröffentlicht: (2024)
von: Fandina, Ora Nova, et al.
Veröffentlicht: (2024)
mAVE: A Watermark for Joint Audio-Visual Generation Models
von: Si, Luyang, et al.
Veröffentlicht: (2026)
von: Si, Luyang, et al.
Veröffentlicht: (2026)
Optimal strategy in the game Risk or Safety
von: Jehn, Rüdiger
Veröffentlicht: (2026)
von: Jehn, Rüdiger
Veröffentlicht: (2026)
OmniVideoBench: Towards Audio-Visual Understanding Evaluation for Omni MLLMs
von: Li, Caorui, et al.
Veröffentlicht: (2025)
von: Li, Caorui, et al.
Veröffentlicht: (2025)
SwiLTra-Bench: The Swiss Legal Translation Benchmark
von: Niklaus, Joel, et al.
Veröffentlicht: (2025)
von: Niklaus, Joel, et al.
Veröffentlicht: (2025)
WeDLM: Reconciling Diffusion Language Models with Standard Causal Attention for Fast Inference
von: Liu, Aiwei, et al.
Veröffentlicht: (2025)
von: Liu, Aiwei, et al.
Veröffentlicht: (2025)
OmniPlay: Benchmarking Omni-Modal Models on Omni-Modal Game Playing
von: Bie, Fuqing, et al.
Veröffentlicht: (2025)
von: Bie, Fuqing, et al.
Veröffentlicht: (2025)
OmniGUI: Benchmarking GUI Agents in Omni-Modal Smartphone Environments
von: Henry, Felix, et al.
Veröffentlicht: (2026)
von: Henry, Felix, et al.
Veröffentlicht: (2026)
MedOmni-45°: A Safety-Performance Benchmark for Reasoning-Oriented LLMs in Medicine
von: Ji, Kaiyuan, et al.
Veröffentlicht: (2025)
von: Ji, Kaiyuan, et al.
Veröffentlicht: (2025)
LLMeBench: A Flexible Framework for Accelerating LLMs Benchmarking
von: Dalvi, Fahim, et al.
Veröffentlicht: (2023)
von: Dalvi, Fahim, et al.
Veröffentlicht: (2023)
MedMemoryBench: Benchmarking Agent Memory in Personalized Healthcare
von: Wang, Yihao, et al.
Veröffentlicht: (2026)
von: Wang, Yihao, et al.
Veröffentlicht: (2026)
LAraBench: Benchmarking Arabic AI with Large Language Models
von: Abdelali, Ahmed, et al.
Veröffentlicht: (2023)
von: Abdelali, Ahmed, et al.
Veröffentlicht: (2023)
PaperAudit-Bench: Benchmarking Error Detection in Research Papers for Critical Automated Peer Review
von: Tu, Songjun, et al.
Veröffentlicht: (2026)
von: Tu, Songjun, et al.
Veröffentlicht: (2026)
ABC Align: Large Language Model Alignment for Safety & Accuracy
von: Seneque, Gareth, et al.
Veröffentlicht: (2024)
von: Seneque, Gareth, et al.
Veröffentlicht: (2024)
Optimal Capital Structure for Life Insurance Companies Offering Surplus Participation
von: Fießinger, Felix, et al.
Veröffentlicht: (2025)
von: Fießinger, Felix, et al.
Veröffentlicht: (2025)
When No Benchmark Exists: Validating Comparative LLM Safety Scoring Without Ground-Truth Labels
von: Gautam, Sushant, et al.
Veröffentlicht: (2026)
von: Gautam, Sushant, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
d-TreeRPO: Towards More Reliable Policy Optimization for Diffusion Language Models
von: Pan, Leyi, et al.
Veröffentlicht: (2025) -
MicroRemed: Benchmarking LLMs in Microservices Remediation
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2025) -
A Survey on Parallel Text Generation: From Parallel Decoding to Diffusion Language Models
von: Zhang, Lingzhe, et al.
Veröffentlicht: (2025) -
A Semantic Invariant Robust Watermark for Large Language Models
von: Liu, Aiwei, et al.
Veröffentlicht: (2023) -
Can LLM Watermarks Robustly Prevent Unauthorized Knowledge Distillation?
von: Pan, Leyi, et al.
Veröffentlicht: (2025)