Falcon: A Cross-Modal Evaluation Dataset for Comprehensive Safety Perception
Fuente:
arXiv
Salvato in:
| Autori principali: | Xue, Qi, Jiang, Minrui, Zhang, Runjia, Xie, Xiurui, Ke, Pei, Liu, Guisong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ESVAE: An Efficient Spiking Variational Autoencoder with Reparameterizable Poisson Spiking Sampling
di: Zhan, Qiugang, et al.
Pubblicazione: (2023)
di: Zhan, Qiugang, et al.
Pubblicazione: (2023)
Bid Farewell to Seesaw: Towards Accurate Long-tail Session-based Recommendation via Dual Constraints of Hybrid Intents
di: Wang, Xiao, et al.
Pubblicazione: (2025)
di: Wang, Xiao, et al.
Pubblicazione: (2025)
Benchmarking MLLM-based Web Understanding: Reasoning, Robustness and Safety
di: Liu, Junliang, et al.
Pubblicazione: (2025)
di: Liu, Junliang, et al.
Pubblicazione: (2025)
Falcon: A Comprehensive Chinese Text-to-SQL Benchmark for Enterprise-Grade Evaluation
di: Luo, Wenzhen, et al.
Pubblicazione: (2025)
di: Luo, Wenzhen, et al.
Pubblicazione: (2025)
DataCross: A Unified Benchmark and Agent Framework for Cross-Modal Heterogeneous Data Analysis
di: Qi, Ruyi, et al.
Pubblicazione: (2026)
di: Qi, Ruyi, et al.
Pubblicazione: (2026)
Agentic Active Omni-Modal Perception for Multi-Hop Audio-Visual Reasoning
di: Xu, Ke, et al.
Pubblicazione: (2026)
di: Xu, Ke, et al.
Pubblicazione: (2026)
MindBridge: Scalable and Cross-Model Knowledge Editing via Memory-Augmented Modality
di: Li, Shuaike, et al.
Pubblicazione: (2025)
di: Li, Shuaike, et al.
Pubblicazione: (2025)
Is Your VLM for Autonomous Driving Safety-Ready? A Comprehensive Benchmark for Evaluating External and In-Cabin Risks
di: Meng, Xianhui, et al.
Pubblicazione: (2025)
di: Meng, Xianhui, et al.
Pubblicazione: (2025)
A Comprehensive Survey on Enterprise Financial Risk Analysis from Big Data and LLMs Perspective
di: Du, Huaming, et al.
Pubblicazione: (2022)
di: Du, Huaming, et al.
Pubblicazione: (2022)
On the Faithfulness of Visual Thinking: Measurement and Enhancement
di: Liu, Zujing, et al.
Pubblicazione: (2025)
di: Liu, Zujing, et al.
Pubblicazione: (2025)
The Scales of Justitia: A Comprehensive Survey on Safety Evaluation of LLMs
di: Liu, Songyang, et al.
Pubblicazione: (2025)
di: Liu, Songyang, et al.
Pubblicazione: (2025)
Towards Effective Data-Free Knowledge Distillation via Diverse Diffusion Augmentation
di: Li, Muquan, et al.
Pubblicazione: (2024)
di: Li, Muquan, et al.
Pubblicazione: (2024)
ACROSS: A Deformation-Based Cross-Modal Representation for Robotic Tactile Perception
di: Amri, Wadhah Zai El, et al.
Pubblicazione: (2024)
di: Amri, Wadhah Zai El, et al.
Pubblicazione: (2024)
OpenAgentSafety: A Comprehensive Framework for Evaluating Real-World AI Agent Safety
di: Vijayvargiya, Sanidhya, et al.
Pubblicazione: (2025)
di: Vijayvargiya, Sanidhya, et al.
Pubblicazione: (2025)
CityNet: A Comprehensive Multi-Modal Urban Dataset for Advanced Research in Urban Computing
di: Zheng, Zhengfei, et al.
Pubblicazione: (2021)
di: Zheng, Zhengfei, et al.
Pubblicazione: (2021)
When Safe Unimodal Inputs Collide: Optimizing Reasoning Chains for Cross-Modal Safety in Multimodal Large Language Models
di: Cai, Wei, et al.
Pubblicazione: (2025)
di: Cai, Wei, et al.
Pubblicazione: (2025)
Harnessing Smartphone Sensors for Enhanced Road Safety: A Comprehensive Dataset and Review
di: Khandakar, Amith, et al.
Pubblicazione: (2024)
di: Khandakar, Amith, et al.
Pubblicazione: (2024)
Rethinking Random Transformers as Adaptive Sequence Smoothers for Sleep Staging
di: Liu, Guisong, et al.
Pubblicazione: (2026)
di: Liu, Guisong, et al.
Pubblicazione: (2026)
CSR-Bench: A Benchmark for Evaluating the Cross-modal Safety and Reliability of MLLMs
di: Liu, Yuxuan, et al.
Pubblicazione: (2026)
di: Liu, Yuxuan, et al.
Pubblicazione: (2026)
MMAUD: A Comprehensive Multi-Modal Anti-UAV Dataset for Modern Miniature Drone Threats
di: Yuan, Shenghai, et al.
Pubblicazione: (2024)
di: Yuan, Shenghai, et al.
Pubblicazione: (2024)
Cross-Modal Content Optimization for Steering Web Agent Preferences
di: Jiang, Tanqiu, et al.
Pubblicazione: (2025)
di: Jiang, Tanqiu, et al.
Pubblicazione: (2025)
AISafetyLab: A Comprehensive Framework for AI Safety Evaluation and Improvement
di: Zhang, Zhexin, et al.
Pubblicazione: (2025)
di: Zhang, Zhexin, et al.
Pubblicazione: (2025)
Contra4: Evaluating Contrastive Cross-Modal Reasoning in Audio, Video, Image, and 3D
di: Panagopoulou, Artemis, et al.
Pubblicazione: (2025)
di: Panagopoulou, Artemis, et al.
Pubblicazione: (2025)
Modality Selection and Skill Segmentation via Cross-Modality Attention
di: Jiang, Jiawei, et al.
Pubblicazione: (2025)
di: Jiang, Jiawei, et al.
Pubblicazione: (2025)
WalledEval: A Comprehensive Safety Evaluation Toolkit for Large Language Models
di: Gupta, Prannaya, et al.
Pubblicazione: (2024)
di: Gupta, Prannaya, et al.
Pubblicazione: (2024)
USB: A Comprehensive and Unified Safety Evaluation Benchmark for Multimodal Large Language Models
di: Zheng, Baolin, et al.
Pubblicazione: (2025)
di: Zheng, Baolin, et al.
Pubblicazione: (2025)
DualCross: Cross-Modality Cross-Domain Adaptation for Monocular BEV Perception
di: Man, Yunze, et al.
Pubblicazione: (2023)
di: Man, Yunze, et al.
Pubblicazione: (2023)
Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets
di: Lu, Ning, et al.
Pubblicazione: (2025)
di: Lu, Ning, et al.
Pubblicazione: (2025)
Generalizability of Large Language Model-Based Agents: A Comprehensive Survey
di: Zhang, Minxing, et al.
Pubblicazione: (2025)
di: Zhang, Minxing, et al.
Pubblicazione: (2025)
Omni-Safety under Cross-Modality Conflict: Vulnerabilities, Dynamics Mechanisms and Efficient Alignment
di: Wang, Kun, et al.
Pubblicazione: (2026)
di: Wang, Kun, et al.
Pubblicazione: (2026)
CMOSE: Comprehensive Multi-Modality Online Student Engagement Dataset with High-Quality Labels
di: Wu, Chi-hsuan, et al.
Pubblicazione: (2023)
di: Wu, Chi-hsuan, et al.
Pubblicazione: (2023)
FISHER: A Foundation Model for Multi-Modal Industrial Signal Comprehensive Representation
di: Fan, Pingyi, et al.
Pubblicazione: (2025)
di: Fan, Pingyi, et al.
Pubblicazione: (2025)
Dual-Modality Multi-Stage Adversarial Safety Training: Robustifying Multimodal Web Agents Against Cross-Modal Attacks
di: Liu, Haoyu, et al.
Pubblicazione: (2026)
di: Liu, Haoyu, et al.
Pubblicazione: (2026)
Deactivating Refusal Triggers: Understanding and Mitigating Overrefusal in Safety Alignment
di: Xue, Zhiyu, et al.
Pubblicazione: (2026)
di: Xue, Zhiyu, et al.
Pubblicazione: (2026)
OS-Oracle: A Comprehensive Framework for Cross-Platform GUI Critic Models
di: Wu, Zhenyu, et al.
Pubblicazione: (2025)
di: Wu, Zhenyu, et al.
Pubblicazione: (2025)
Cross-Modal Distillation For Widely Differing Modalities
di: Zhao, Cairong, et al.
Pubblicazione: (2025)
di: Zhao, Cairong, et al.
Pubblicazione: (2025)
Enhancing LLMs for Time Series Forecasting via Structure-Guided Cross-Modal Alignment
di: Sun, Siming, et al.
Pubblicazione: (2025)
di: Sun, Siming, et al.
Pubblicazione: (2025)
EmergentBridge: Improving Zero-Shot Cross-Modal Transfer in Unified Multimodal Embedding Models
di: Xie, Jincheng, et al.
Pubblicazione: (2026)
di: Xie, Jincheng, et al.
Pubblicazione: (2026)
Falcon-X: A Time Series Foundation Model for Heterogeneous Multivariate Modeling
di: Liu, Yiding, et al.
Pubblicazione: (2026)
di: Liu, Yiding, et al.
Pubblicazione: (2026)
CCSD: Cross-Modal Compositional Self-Distillation for Robust Brain Tumor Segmentation with Missing Modalities
di: Xie, Dongqing, et al.
Pubblicazione: (2025)
di: Xie, Dongqing, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ESVAE: An Efficient Spiking Variational Autoencoder with Reparameterizable Poisson Spiking Sampling
di: Zhan, Qiugang, et al.
Pubblicazione: (2023) -
Bid Farewell to Seesaw: Towards Accurate Long-tail Session-based Recommendation via Dual Constraints of Hybrid Intents
di: Wang, Xiao, et al.
Pubblicazione: (2025) -
Benchmarking MLLM-based Web Understanding: Reasoning, Robustness and Safety
di: Liu, Junliang, et al.
Pubblicazione: (2025) -
Falcon: A Comprehensive Chinese Text-to-SQL Benchmark for Enterprise-Grade Evaluation
di: Luo, Wenzhen, et al.
Pubblicazione: (2025) -
DataCross: A Unified Benchmark and Agent Framework for Cross-Modal Heterogeneous Data Analysis
di: Qi, Ruyi, et al.
Pubblicazione: (2026)