EPT Benchmark: Evaluation of Persian Trustworthiness in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mirbagheri, Mohammad Reza, Mirkamali, Mohammad Mahdi, Arani, Zahra Motoshaker, Javeri, Ali, Sadeghzadeh, Amir Mahdi, Jalili, Rasool |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Beyond Yao's Millionaires: Secure Multi-Party Computation of Non-Polynomial Functions
par: Najarkolaei, Seyed Reza Hoseini, et autres
Publié: (2024)
par: Najarkolaei, Seyed Reza Hoseini, et autres
Publié: (2024)
Enhanced cast-128 with adaptive s-box optimization via neural networks for image protection
par: Fadhil, Fadhil Abbas, et autres
Publié: (2025)
par: Fadhil, Fadhil Abbas, et autres
Publié: (2025)
Lateral Phishing With Large Language Models: A Large Organization Comparative Study
par: Bethany, Mazal, et autres
Publié: (2024)
par: Bethany, Mazal, et autres
Publié: (2024)
A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models
par: Wang, Yanbo, et autres
Publié: (2025)
par: Wang, Yanbo, et autres
Publié: (2025)
Identity Chain
par: Darabi, Mahdi, et autres
Publié: (2024)
par: Darabi, Mahdi, et autres
Publié: (2024)
SafeLM: Unified Privacy-Aware Optimization for Trustworthy Federated Large Language Models
par: Mohammad, Noor Islam S., et autres
Publié: (2026)
par: Mohammad, Noor Islam S., et autres
Publié: (2026)
An Investigation into Misuse of Java Security APIs by Large Language Models
par: Mousavi, Zahra, et autres
Publié: (2024)
par: Mousavi, Zahra, et autres
Publié: (2024)
AI-Powered Hybrid Intrusion Detection Framework for Cloud Security Using Novel Metaheuristic Optimization
par: Alhusseini, Maryam Mahdi, et autres
Publié: (2026)
par: Alhusseini, Maryam Mahdi, et autres
Publié: (2026)
Hidden in the Metadata: Stealth Poisoning Attacks on Multimodal Retrieval-Augmented Generation
par: Edemacu, Kennedy, et autres
Publié: (2026)
par: Edemacu, Kennedy, et autres
Publié: (2026)
Can Reinforcement Learning Unlock the Hidden Dangers in Aligned Large Language Models?
par: Karkevandi, Mohammad Bahrami, et autres
Publié: (2024)
par: Karkevandi, Mohammad Bahrami, et autres
Publié: (2024)
How Much Do Large Language Model Cheat on Evaluation? Benchmarking Overestimation under the One-Time-Pad-Based Framework
par: Liang, Zi, et autres
Publié: (2025)
par: Liang, Zi, et autres
Publié: (2025)
AI-Enhanced Intelligent NIDS Framework: Leveraging Metaheuristic Optimization for Robust Attack Detection and Prevention
par: Alhusseini, Maryam Mahdi, et autres
Publié: (2025)
par: Alhusseini, Maryam Mahdi, et autres
Publié: (2025)
PrivLM-Bench: A Multi-level Privacy Evaluation Benchmark for Language Models
par: Li, Haoran, et autres
Publié: (2023)
par: Li, Haoran, et autres
Publié: (2023)
LMO-DP: Optimizing the Randomization Mechanism for Differentially Private Fine-Tuning (Large) Language Models
par: Yang, Qin, et autres
Publié: (2024)
par: Yang, Qin, et autres
Publié: (2024)
Generalization or Memorization: Data Contamination and Trustworthy Evaluation for Large Language Models
par: Dong, Yihong, et autres
Publié: (2024)
par: Dong, Yihong, et autres
Publié: (2024)
GradID: Adversarial Detection via Intrinsic Dimensionality of Gradients
par: Razmjoo, Mohammad Mahdi, et autres
Publié: (2025)
par: Razmjoo, Mohammad Mahdi, et autres
Publié: (2025)
S-Eval: Towards Automated and Comprehensive Safety Evaluation for Large Language Models
par: Yuan, Xiaohan, et autres
Publié: (2024)
par: Yuan, Xiaohan, et autres
Publié: (2024)
ML-Bench&Guard: Policy-Grounded Multilingual Safety Benchmark and Guardrail for Large Language Models
par: Zhao, Yunhan, et autres
Publié: (2026)
par: Zhao, Yunhan, et autres
Publié: (2026)
InjecAgent: Benchmarking Indirect Prompt Injections in Tool-Integrated Large Language Model Agents
par: Zhan, Qiusi, et autres
Publié: (2024)
par: Zhan, Qiusi, et autres
Publié: (2024)
Constructing Trustworthy Smart Contracts
par: Chait-Roth, Devora, et autres
Publié: (2024)
par: Chait-Roth, Devora, et autres
Publié: (2024)
Learning to Poison Large Language Models for Downstream Manipulation
par: Zhou, Xiangyu, et autres
Publié: (2024)
par: Zhou, Xiangyu, et autres
Publié: (2024)
Malware Classification from Memory Dumps Using Machine Learning, Transformers, and Large Language Models
par: Dweib, Areej, et autres
Publié: (2025)
par: Dweib, Areej, et autres
Publié: (2025)
Learning-Based Automated Adversarial Red-Teaming for Robustness Evaluation of Large Language Models
par: Wei, Zhang, et autres
Publié: (2025)
par: Wei, Zhang, et autres
Publié: (2025)
CVE-LLM : Ontology-Assisted Automatic Vulnerability Evaluation Using Large Language Models
par: Ghosh, Rikhiya, et autres
Publié: (2025)
par: Ghosh, Rikhiya, et autres
Publié: (2025)
Large Language Models Cannot Reliably Detect Vulnerabilities in JavaScript: The First Systematic Benchmark and Evaluation
par: Fei, Qingyuan, et autres
Publié: (2025)
par: Fei, Qingyuan, et autres
Publié: (2025)
Behind the Mask: Benchmarking Camouflaged Jailbreaks in Large Language Models
par: Zheng, Youjia, et autres
Publié: (2025)
par: Zheng, Youjia, et autres
Publié: (2025)
Privacy-Aware Randomized Quantization via Linear Programming
par: Cai, Zhongteng, et autres
Publié: (2024)
par: Cai, Zhongteng, et autres
Publié: (2024)
Evaluation of the Programming Skills of Large Language Models
par: Heitz, Luc Bryan, et autres
Publié: (2024)
par: Heitz, Luc Bryan, et autres
Publié: (2024)
Copyright Traps for Large Language Models
par: Meeus, Matthieu, et autres
Publié: (2024)
par: Meeus, Matthieu, et autres
Publié: (2024)
On the Effectiveness of Membership Inference in Targeted Data Extraction from Large Language Models
par: Sahili, Ali Al, et autres
Publié: (2025)
par: Sahili, Ali Al, et autres
Publié: (2025)
Leveraging Large Language Models for Trustworthiness Assessment of Web Applications
par: Yarotskyi, Oleksandr, et autres
Publié: (2026)
par: Yarotskyi, Oleksandr, et autres
Publié: (2026)
Rethinking Backdoor Detection Evaluation for Language Models
par: Yan, Jun, et autres
Publié: (2024)
par: Yan, Jun, et autres
Publié: (2024)
Yet Another Watermark for Large Language Models
par: Bao, Siyuan, et autres
Publié: (2025)
par: Bao, Siyuan, et autres
Publié: (2025)
Large Language Models as Carriers of Hidden Messages
par: Hoscilowicz, Jakub, et autres
Publié: (2024)
par: Hoscilowicz, Jakub, et autres
Publié: (2024)
Token-Level Privacy in Large Language Models
par: Harel, Re'em, et autres
Publié: (2025)
par: Harel, Re'em, et autres
Publié: (2025)
Building Trustworthy Multimodal AI: A Review of Fairness, Transparency, and Ethics in Vision-Language Tasks
par: Saleh, Mohammad, et autres
Publié: (2025)
par: Saleh, Mohammad, et autres
Publié: (2025)
Graph of Attacks: Improved Black-Box and Interpretable Jailbreaks for LLMs
par: Akbar-Tajari, Mohammad, et autres
Publié: (2025)
par: Akbar-Tajari, Mohammad, et autres
Publié: (2025)
Evolutionary Large Language Models for Hardware Security: A Comparative Survey
par: Akyash, Mohammad, et autres
Publié: (2024)
par: Akyash, Mohammad, et autres
Publié: (2024)
Publicly-Detectable Watermarking for Language Models
par: Fairoze, Jaiden, et autres
Publié: (2023)
par: Fairoze, Jaiden, et autres
Publié: (2023)
Context-Aware Membership Inference Attacks against Pre-trained Large Language Models
par: Chang, Hongyan, et autres
Publié: (2024)
par: Chang, Hongyan, et autres
Publié: (2024)
Documents similaires
-
Beyond Yao's Millionaires: Secure Multi-Party Computation of Non-Polynomial Functions
par: Najarkolaei, Seyed Reza Hoseini, et autres
Publié: (2024) -
Enhanced cast-128 with adaptive s-box optimization via neural networks for image protection
par: Fadhil, Fadhil Abbas, et autres
Publié: (2025) -
Lateral Phishing With Large Language Models: A Large Organization Comparative Study
par: Bethany, Mazal, et autres
Publié: (2024) -
A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models
par: Wang, Yanbo, et autres
Publié: (2025) -
Identity Chain
par: Darabi, Mahdi, et autres
Publié: (2024)