LinguaSafe: A Comprehensive Multilingual Safety Benchmark for Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ning, Zhiyuan, Gu, Tianle, Song, Jiaxin, Hong, Shixin, Li, Lingyu, Liu, Huacan, Li, Jie, Wang, Yixu, Lingyu, Meng, Teng, Yan, Wang, Yingchun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Argus Inspection: Do Multimodal Large Language Models Possess the Eye of Panoptes?
par: Yao, Yang, et autres
Publié: (2025)
par: Yao, Yang, et autres
Publié: (2025)
The Other Mind: How Language Models Exhibit Human Temporal Cognition
par: Li, Lingyu, et autres
Publié: (2025)
par: Li, Lingyu, et autres
Publié: (2025)
Reflection-Bench: Evaluating Epistemic Agency in Large Language Models
par: Li, Lingyu, et autres
Publié: (2024)
par: Li, Lingyu, et autres
Publié: (2024)
Mechanistic Origin of Moral Indifference in Language Models
par: Li, Lingyu, et autres
Publié: (2026)
par: Li, Lingyu, et autres
Publié: (2026)
SafeVid: Toward Safety Aligned Video Large Multimodal Models
par: Wang, Yixu, et autres
Publié: (2025)
par: Wang, Yixu, et autres
Publié: (2025)
JailBound: Jailbreaking Internal Safety Boundaries of Vision-Language Models
par: Song, Jiaxin, et autres
Publié: (2025)
par: Song, Jiaxin, et autres
Publié: (2025)
Probing the Robustness of Large Language Models Safety to Latent Perturbations
par: Gu, Tianle, et autres
Publié: (2025)
par: Gu, Tianle, et autres
Publié: (2025)
HoneypotNet: Backdoor Attacks Against Model Extraction
par: Wang, Yixu, et autres
Publié: (2025)
par: Wang, Yixu, et autres
Publié: (2025)
ESC-Eval: Evaluating Emotion Support Conversations in Large Language Models
par: Zhao, Haiquan, et autres
Publié: (2024)
par: Zhao, Haiquan, et autres
Publié: (2024)
Dr. Bench: A Multidimensional Evaluation for Deep Research Agents, from Answers to Reports
par: Yao, Yang, et autres
Publié: (2025)
par: Yao, Yang, et autres
Publié: (2025)
From Sparse Decisions to Dense Reasoning: A Multi-attribute Trajectory Paradigm for Multimodal Moderation
par: Gu, Tianle, et autres
Publié: (2026)
par: Gu, Tianle, et autres
Publié: (2026)
Towards Context-Invariant Safety Alignment for Large Language Models
par: Wang, Yixu, et autres
Publié: (2026)
par: Wang, Yixu, et autres
Publié: (2026)
AgenticEval: Toward Agentic and Self-Evolving Safety Evaluation of Large Language Models
par: Wang, Yixu, et autres
Publié: (2025)
par: Wang, Yixu, et autres
Publié: (2025)
OpenRT: An Open-Source Red Teaming Framework for Multimodal LLMs
par: Wang, Xin, et autres
Publié: (2026)
par: Wang, Xin, et autres
Publié: (2026)
SentGuard: Sentence-Level Streaming Guardrails for Large Language Models
par: Yu, Jiaqi, et autres
Publié: (2026)
par: Yu, Jiaqi, et autres
Publié: (2026)
StolenLoRA: Exploring LoRA Extraction Attacks via Synthetic Data
par: Wang, Yixu, et autres
Publié: (2025)
par: Wang, Yixu, et autres
Publié: (2025)
MLLMGuard: A Multi-dimensional Safety Evaluation Suite for Multimodal Large Language Models
par: Gu, Tianle, et autres
Publié: (2024)
par: Gu, Tianle, et autres
Publié: (2024)
IDEATOR: Jailbreaking and Benchmarking Large Vision-Language Models Using Themselves
par: Wang, Ruofan, et autres
Publié: (2024)
par: Wang, Ruofan, et autres
Publié: (2024)
SAIP: A Plug-and-Play Scale-adaptive Module in Diffusion-based Inverse Problems
par: Wang, Lingyu, et autres
Publié: (2025)
par: Wang, Lingyu, et autres
Publié: (2025)
Evolve the Method, Not the Prompts: Evolutionary Synthesis of Jailbreak Attacks on LLMs
par: Chen, Yunhao, et autres
Publié: (2025)
par: Chen, Yunhao, et autres
Publié: (2025)
A Mousetrap: Fooling Large Reasoning Models for Jailbreak with Chain of Iterative Chaos
par: Yao, Yang, et autres
Publié: (2025)
par: Yao, Yang, et autres
Publié: (2025)
Return to Lacan: an approach to digital twin mind with free energy principle
par: Li, Lingyu, et autres
Publié: (2023)
par: Li, Lingyu, et autres
Publié: (2023)
Enabling self-identification in intelligent agent: insights from computational psychoanalysis
par: Li, Lingyu, et autres
Publié: (2024)
par: Li, Lingyu, et autres
Publié: (2024)
Schizophrenia Research Under the Framework of Predictive Coding: Body, Language, and Others
par: Lingyu Li, et autres
Publié: (2025)
par: Lingyu Li, et autres
Publié: (2025)
Lingua-SafetyBench: A Benchmark for Safety Evaluation of Multilingual Vision-Language Models
par: Shi, Enyi, et autres
Publié: (2026)
par: Shi, Enyi, et autres
Publié: (2026)
Perfiles de la cultura China / autores, Feng Lingyu ; Shi Weimin ; traductor, Chen Gensheng
par: Feng Lingyu
par: Feng Lingyu
Do LLMs Know When to Flip a Coin? Strategic Randomization through Reasoning and Experience
par: Yang, Lingyu
Publié: (2025)
par: Yang, Lingyu
Publié: (2025)
Harnessing the Intrinsic Knowledge of Pretrained Language Models for Challenging Text Classification Settings
par: Gao, Lingyu
Publié: (2024)
par: Gao, Lingyu
Publié: (2024)
Harnessing Agroecological Practices for Sustainable Land Restoration in Degraded Agricultural Landscapes
par: Lingyu Li, et autres
Publié: (2026)
par: Lingyu Li, et autres
Publié: (2026)
Challenges and advances of immune checkpoint therapy
par: Lingyu Li, et autres
Publié: (2024)
par: Lingyu Li, et autres
Publié: (2024)
Clinical Value of Pelvic Floor Ultrasound and Glazer Pelvic Floor Electromyography in Predicting Postpartum Stress Urinary Incontinence
par: Lingyu Yang, et autres
Publié: (2025)
par: Lingyu Yang, et autres
Publié: (2025)
A Comprehensive Assessment and Benchmark Study of Large Atomistic Foundation Models for Phonons
par: Anam, Md Zaibul, et autres
Publié: (2025)
par: Anam, Md Zaibul, et autres
Publié: (2025)
A Comprehensive Assessment and Benchmark Study of Large Atomistic Foundation Models for Phonons
par: Md Zaibul Anam, et autres
Publié: (2025)
par: Md Zaibul Anam, et autres
Publié: (2025)
SciSafeEval: A Comprehensive Benchmark for Safety Alignment of Large Language Models in Scientific Tasks
par: Li, Tianhao, et autres
Publié: (2024)
par: Li, Tianhao, et autres
Publié: (2024)
VaaWIT: Visual-Aware Adaptation of Large Language Models for Multilingual Web Image Translation
par: Li, Bo, et autres
Publié: (2026)
par: Li, Bo, et autres
Publié: (2026)
Safe Semantics, Unsafe Interpretations: Tackling Implicit Reasoning Safety in Large Vision-Language Models
par: Cai, Wei, et autres
Publié: (2025)
par: Cai, Wei, et autres
Publié: (2025)
An eigenvalue problem for self-similar patterns in Hele-Shaw flows
par: Xiao, Wang, et autres
Publié: (2024)
par: Xiao, Wang, et autres
Publié: (2024)
Identifying the Relationships Among Ecosystem Services and Their Influencing Pathways in the Jialing River Basin: An Integrated Social‐Ecological Perspective
par: Yixu Wang, et autres
Publié: (2025)
par: Yixu Wang, et autres
Publié: (2025)
MEOW: MEMOry Supervised LLM Unlearning Via Inverted Facts
par: Gu, Tianle, et autres
Publié: (2024)
par: Gu, Tianle, et autres
Publié: (2024)
Integrating emotional intelligence, memory architecture, and gestures to achieve empathetic humanoid robot interaction in an educational setting
par: Sun, Fuze, et autres
Publié: (2025)
par: Sun, Fuze, et autres
Publié: (2025)
Documents similaires
-
Argus Inspection: Do Multimodal Large Language Models Possess the Eye of Panoptes?
par: Yao, Yang, et autres
Publié: (2025) -
The Other Mind: How Language Models Exhibit Human Temporal Cognition
par: Li, Lingyu, et autres
Publié: (2025) -
Reflection-Bench: Evaluating Epistemic Agency in Large Language Models
par: Li, Lingyu, et autres
Publié: (2024) -
Mechanistic Origin of Moral Indifference in Language Models
par: Li, Lingyu, et autres
Publié: (2026) -
SafeVid: Toward Safety Aligned Video Large Multimodal Models
par: Wang, Yixu, et autres
Publié: (2025)