Falcon: A Cross-Modal Evaluation Dataset for Comprehensive Safety Perception
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xue, Qi, Jiang, Minrui, Zhang, Runjia, Xie, Xiurui, Ke, Pei, Liu, Guisong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ESVAE: An Efficient Spiking Variational Autoencoder with Reparameterizable Poisson Spiking Sampling
par: Zhan, Qiugang, et autres
Publié: (2023)
par: Zhan, Qiugang, et autres
Publié: (2023)
Bid Farewell to Seesaw: Towards Accurate Long-tail Session-based Recommendation via Dual Constraints of Hybrid Intents
par: Wang, Xiao, et autres
Publié: (2025)
par: Wang, Xiao, et autres
Publié: (2025)
Benchmarking MLLM-based Web Understanding: Reasoning, Robustness and Safety
par: Liu, Junliang, et autres
Publié: (2025)
par: Liu, Junliang, et autres
Publié: (2025)
Falcon: A Comprehensive Chinese Text-to-SQL Benchmark for Enterprise-Grade Evaluation
par: Luo, Wenzhen, et autres
Publié: (2025)
par: Luo, Wenzhen, et autres
Publié: (2025)
DataCross: A Unified Benchmark and Agent Framework for Cross-Modal Heterogeneous Data Analysis
par: Qi, Ruyi, et autres
Publié: (2026)
par: Qi, Ruyi, et autres
Publié: (2026)
Agentic Active Omni-Modal Perception for Multi-Hop Audio-Visual Reasoning
par: Xu, Ke, et autres
Publié: (2026)
par: Xu, Ke, et autres
Publié: (2026)
MindBridge: Scalable and Cross-Model Knowledge Editing via Memory-Augmented Modality
par: Li, Shuaike, et autres
Publié: (2025)
par: Li, Shuaike, et autres
Publié: (2025)
Is Your VLM for Autonomous Driving Safety-Ready? A Comprehensive Benchmark for Evaluating External and In-Cabin Risks
par: Meng, Xianhui, et autres
Publié: (2025)
par: Meng, Xianhui, et autres
Publié: (2025)
A Comprehensive Survey on Enterprise Financial Risk Analysis from Big Data and LLMs Perspective
par: Du, Huaming, et autres
Publié: (2022)
par: Du, Huaming, et autres
Publié: (2022)
On the Faithfulness of Visual Thinking: Measurement and Enhancement
par: Liu, Zujing, et autres
Publié: (2025)
par: Liu, Zujing, et autres
Publié: (2025)
The Scales of Justitia: A Comprehensive Survey on Safety Evaluation of LLMs
par: Liu, Songyang, et autres
Publié: (2025)
par: Liu, Songyang, et autres
Publié: (2025)
Towards Effective Data-Free Knowledge Distillation via Diverse Diffusion Augmentation
par: Li, Muquan, et autres
Publié: (2024)
par: Li, Muquan, et autres
Publié: (2024)
ACROSS: A Deformation-Based Cross-Modal Representation for Robotic Tactile Perception
par: Amri, Wadhah Zai El, et autres
Publié: (2024)
par: Amri, Wadhah Zai El, et autres
Publié: (2024)
OpenAgentSafety: A Comprehensive Framework for Evaluating Real-World AI Agent Safety
par: Vijayvargiya, Sanidhya, et autres
Publié: (2025)
par: Vijayvargiya, Sanidhya, et autres
Publié: (2025)
CityNet: A Comprehensive Multi-Modal Urban Dataset for Advanced Research in Urban Computing
par: Zheng, Zhengfei, et autres
Publié: (2021)
par: Zheng, Zhengfei, et autres
Publié: (2021)
When Safe Unimodal Inputs Collide: Optimizing Reasoning Chains for Cross-Modal Safety in Multimodal Large Language Models
par: Cai, Wei, et autres
Publié: (2025)
par: Cai, Wei, et autres
Publié: (2025)
Harnessing Smartphone Sensors for Enhanced Road Safety: A Comprehensive Dataset and Review
par: Khandakar, Amith, et autres
Publié: (2024)
par: Khandakar, Amith, et autres
Publié: (2024)
Rethinking Random Transformers as Adaptive Sequence Smoothers for Sleep Staging
par: Liu, Guisong, et autres
Publié: (2026)
par: Liu, Guisong, et autres
Publié: (2026)
CSR-Bench: A Benchmark for Evaluating the Cross-modal Safety and Reliability of MLLMs
par: Liu, Yuxuan, et autres
Publié: (2026)
par: Liu, Yuxuan, et autres
Publié: (2026)
MMAUD: A Comprehensive Multi-Modal Anti-UAV Dataset for Modern Miniature Drone Threats
par: Yuan, Shenghai, et autres
Publié: (2024)
par: Yuan, Shenghai, et autres
Publié: (2024)
Cross-Modal Content Optimization for Steering Web Agent Preferences
par: Jiang, Tanqiu, et autres
Publié: (2025)
par: Jiang, Tanqiu, et autres
Publié: (2025)
AISafetyLab: A Comprehensive Framework for AI Safety Evaluation and Improvement
par: Zhang, Zhexin, et autres
Publié: (2025)
par: Zhang, Zhexin, et autres
Publié: (2025)
Contra4: Evaluating Contrastive Cross-Modal Reasoning in Audio, Video, Image, and 3D
par: Panagopoulou, Artemis, et autres
Publié: (2025)
par: Panagopoulou, Artemis, et autres
Publié: (2025)
Modality Selection and Skill Segmentation via Cross-Modality Attention
par: Jiang, Jiawei, et autres
Publié: (2025)
par: Jiang, Jiawei, et autres
Publié: (2025)
WalledEval: A Comprehensive Safety Evaluation Toolkit for Large Language Models
par: Gupta, Prannaya, et autres
Publié: (2024)
par: Gupta, Prannaya, et autres
Publié: (2024)
USB: A Comprehensive and Unified Safety Evaluation Benchmark for Multimodal Large Language Models
par: Zheng, Baolin, et autres
Publié: (2025)
par: Zheng, Baolin, et autres
Publié: (2025)
DualCross: Cross-Modality Cross-Domain Adaptation for Monocular BEV Perception
par: Man, Yunze, et autres
Publié: (2023)
par: Man, Yunze, et autres
Publié: (2023)
Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets
par: Lu, Ning, et autres
Publié: (2025)
par: Lu, Ning, et autres
Publié: (2025)
Generalizability of Large Language Model-Based Agents: A Comprehensive Survey
par: Zhang, Minxing, et autres
Publié: (2025)
par: Zhang, Minxing, et autres
Publié: (2025)
Omni-Safety under Cross-Modality Conflict: Vulnerabilities, Dynamics Mechanisms and Efficient Alignment
par: Wang, Kun, et autres
Publié: (2026)
par: Wang, Kun, et autres
Publié: (2026)
CMOSE: Comprehensive Multi-Modality Online Student Engagement Dataset with High-Quality Labels
par: Wu, Chi-hsuan, et autres
Publié: (2023)
par: Wu, Chi-hsuan, et autres
Publié: (2023)
FISHER: A Foundation Model for Multi-Modal Industrial Signal Comprehensive Representation
par: Fan, Pingyi, et autres
Publié: (2025)
par: Fan, Pingyi, et autres
Publié: (2025)
Dual-Modality Multi-Stage Adversarial Safety Training: Robustifying Multimodal Web Agents Against Cross-Modal Attacks
par: Liu, Haoyu, et autres
Publié: (2026)
par: Liu, Haoyu, et autres
Publié: (2026)
Deactivating Refusal Triggers: Understanding and Mitigating Overrefusal in Safety Alignment
par: Xue, Zhiyu, et autres
Publié: (2026)
par: Xue, Zhiyu, et autres
Publié: (2026)
OS-Oracle: A Comprehensive Framework for Cross-Platform GUI Critic Models
par: Wu, Zhenyu, et autres
Publié: (2025)
par: Wu, Zhenyu, et autres
Publié: (2025)
Cross-Modal Distillation For Widely Differing Modalities
par: Zhao, Cairong, et autres
Publié: (2025)
par: Zhao, Cairong, et autres
Publié: (2025)
Enhancing LLMs for Time Series Forecasting via Structure-Guided Cross-Modal Alignment
par: Sun, Siming, et autres
Publié: (2025)
par: Sun, Siming, et autres
Publié: (2025)
EmergentBridge: Improving Zero-Shot Cross-Modal Transfer in Unified Multimodal Embedding Models
par: Xie, Jincheng, et autres
Publié: (2026)
par: Xie, Jincheng, et autres
Publié: (2026)
Falcon-X: A Time Series Foundation Model for Heterogeneous Multivariate Modeling
par: Liu, Yiding, et autres
Publié: (2026)
par: Liu, Yiding, et autres
Publié: (2026)
CCSD: Cross-Modal Compositional Self-Distillation for Robust Brain Tumor Segmentation with Missing Modalities
par: Xie, Dongqing, et autres
Publié: (2025)
par: Xie, Dongqing, et autres
Publié: (2025)
Documents similaires
-
ESVAE: An Efficient Spiking Variational Autoencoder with Reparameterizable Poisson Spiking Sampling
par: Zhan, Qiugang, et autres
Publié: (2023) -
Bid Farewell to Seesaw: Towards Accurate Long-tail Session-based Recommendation via Dual Constraints of Hybrid Intents
par: Wang, Xiao, et autres
Publié: (2025) -
Benchmarking MLLM-based Web Understanding: Reasoning, Robustness and Safety
par: Liu, Junliang, et autres
Publié: (2025) -
Falcon: A Comprehensive Chinese Text-to-SQL Benchmark for Enterprise-Grade Evaluation
par: Luo, Wenzhen, et autres
Publié: (2025) -
DataCross: A Unified Benchmark and Agent Framework for Cross-Modal Heterogeneous Data Analysis
par: Qi, Ruyi, et autres
Publié: (2026)