Beyond Social Pressure: Benchmarking Epistemic Attack in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Au, Steven, Noronha, Sujit |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Epistemic Integrity in Large Language Models
por: Ghafouri, Bijean, et al.
Publicado: (2024)
por: Ghafouri, Bijean, et al.
Publicado: (2024)
Benchmarking Gaslighting Attacks Against Speech Large Language Models
por: Wu, Jinyang, et al.
Publicado: (2025)
por: Wu, Jinyang, et al.
Publicado: (2025)
Benchmarking Gaslighting Negation Attacks Against Multimodal Large Language Models
por: Zhu, Bin, et al.
Publicado: (2025)
por: Zhu, Bin, et al.
Publicado: (2025)
SocialMaze: A Benchmark for Evaluating Social Reasoning in Large Language Models
por: Xu, Zixiang, et al.
Publicado: (2025)
por: Xu, Zixiang, et al.
Publicado: (2025)
Beyond Prompts: Dynamic Conversational Benchmarking of Large Language Models
por: Castillo-Bolado, David, et al.
Publicado: (2024)
por: Castillo-Bolado, David, et al.
Publicado: (2024)
Beyond Benchmarking: A New Paradigm for Evaluation and Assessment of Large Language Models
por: Liu, Jin, et al.
Publicado: (2024)
por: Liu, Jin, et al.
Publicado: (2024)
Beyond Chains of Thought: Benchmarking Latent-Space Reasoning Abilities in Large Language Models
por: Hagendorff, Thilo, et al.
Publicado: (2025)
por: Hagendorff, Thilo, et al.
Publicado: (2025)
Beyond Facts: Benchmarking Distributional Reading Comprehension in Large Language Models
por: Guo, Pei-Fu, et al.
Publicado: (2026)
por: Guo, Pei-Fu, et al.
Publicado: (2026)
Representations of Fact, Fiction and Forecast in Large Language Models: Epistemics and Attitudes
por: Li, Meng, et al.
Publicado: (2025)
por: Li, Meng, et al.
Publicado: (2025)
Benchmarking and Defending Against Indirect Prompt Injection Attacks on Large Language Models
por: Yi, Jingwei, et al.
Publicado: (2023)
por: Yi, Jingwei, et al.
Publicado: (2023)
Personalized Graph-Based Retrieval for Large Language Models
por: Au, Steven, et al.
Publicado: (2025)
por: Au, Steven, et al.
Publicado: (2025)
Epistemic Diversity and Knowledge Collapse in Large Language Models
por: Wright, Dustin, et al.
Publicado: (2025)
por: Wright, Dustin, et al.
Publicado: (2025)
JBBQ: Japanese Bias Benchmark for Analyzing Social Biases in Large Language Models
por: Yanaka, Hitomi, et al.
Publicado: (2024)
por: Yanaka, Hitomi, et al.
Publicado: (2024)
Human-Level and Beyond: Benchmarking Large Language Models Against Clinical Pharmacists in Prescription Review
por: Yang, Yan, et al.
Publicado: (2025)
por: Yang, Yan, et al.
Publicado: (2025)
PeReGrINE: Evaluating Personalized Review Fidelity with User Item Graph Context
por: Au, Steven, et al.
Publicado: (2026)
por: Au, Steven, et al.
Publicado: (2026)
TF-Attack: Transferable and Fast Adversarial Attacks on Large Language Models
por: Li, Zelin, et al.
Publicado: (2024)
por: Li, Zelin, et al.
Publicado: (2024)
Jailbreaking Large Language Models with Morality Attacks
por: Su, Ying, et al.
Publicado: (2026)
por: Su, Ying, et al.
Publicado: (2026)
GPT-Fathom: Benchmarking Large Language Models to Decipher the Evolutionary Path towards GPT-4 and Beyond
por: Zheng, Shen, et al.
Publicado: (2023)
por: Zheng, Shen, et al.
Publicado: (2023)
Beyond Context to Cognitive Appraisal: Emotion Reasoning as a Theory of Mind Benchmark for Large Language Models
por: Yeo, Gerard Christopher, et al.
Publicado: (2025)
por: Yeo, Gerard Christopher, et al.
Publicado: (2025)
SI-Bench: Benchmarking Social Intelligence of Large Language Models in Human-to-Human Conversations
por: Huang, Shuai, et al.
Publicado: (2025)
por: Huang, Shuai, et al.
Publicado: (2025)
SNS-Bench-VL: Benchmarking Multimodal Large Language Models in Social Networking Services
por: Guo, Hongcheng, et al.
Publicado: (2025)
por: Guo, Hongcheng, et al.
Publicado: (2025)
Revisiting Epistemic Markers in Confidence Estimation: Can Markers Accurately Reflect Large Language Models' Uncertainty?
por: Liu, Jiayu, et al.
Publicado: (2025)
por: Liu, Jiayu, et al.
Publicado: (2025)
The Polite Liar: Epistemic Pathology in Language Models
por: DeVilling, Bentley
Publicado: (2025)
por: DeVilling, Bentley
Publicado: (2025)
AttackEval: How to Evaluate the Effectiveness of Jailbreak Attacking on Large Language Models
por: Shu, Dong, et al.
Publicado: (2024)
por: Shu, Dong, et al.
Publicado: (2024)
Beyond Prediction -- Structuring Epistemic Integrity in Artificial Reasoning Systems
por: Wright, Craig Steven
Publicado: (2025)
por: Wright, Craig Steven
Publicado: (2025)
Beyond the Leaderboard: Rethinking Medical Benchmarks for Large Language Models
por: Chen, Wenting, et al.
Publicado: (2025)
por: Chen, Wenting, et al.
Publicado: (2025)
Pramana: Fine-Tuning Large Language Models for Epistemic Reasoning through Navya-Nyaya
por: Sathish, Sharath
Publicado: (2026)
por: Sathish, Sharath
Publicado: (2026)
Epistemic Observability in Language Models
por: Mason, Tony, et al.
Publicado: (2026)
por: Mason, Tony, et al.
Publicado: (2026)
Robustness of Large Language Models Against Adversarial Attacks
por: Tao, Yiyi, et al.
Publicado: (2024)
por: Tao, Yiyi, et al.
Publicado: (2024)
Keep Security! Benchmarking Security Policy Preservation in Large Language Model Contexts Against Indirect Attacks in Question Answering
por: Chang, Hwan, et al.
Publicado: (2025)
por: Chang, Hwan, et al.
Publicado: (2025)
On Epistemic Uncertainty of Visual Tokens for Object Hallucinations in Large Vision-Language Models
por: Seo, Hoigi, et al.
Publicado: (2025)
por: Seo, Hoigi, et al.
Publicado: (2025)
BenchmarkCards: Standardized Documentation for Large Language Model Benchmarks
por: Sokol, Anna, et al.
Publicado: (2024)
por: Sokol, Anna, et al.
Publicado: (2024)
Pet-Bench: Benchmarking the Abilities of Large Language Models as E-Pets in Social Network Services
por: Guo, Hongcheng, et al.
Publicado: (2025)
por: Guo, Hongcheng, et al.
Publicado: (2025)
TAO-Attack: Toward Advanced Optimization-Based Jailbreak Attacks for Large Language Models
por: Xu, Zhi, et al.
Publicado: (2026)
por: Xu, Zhi, et al.
Publicado: (2026)
Beyond Correctness: Benchmarking Multi-dimensional Code Generation for Large Language Models
por: Zheng, Jiasheng, et al.
Publicado: (2024)
por: Zheng, Jiasheng, et al.
Publicado: (2024)
Benchmarking Linguistic Diversity of Large Language Models
por: Guo, Yanzhu, et al.
Publicado: (2024)
por: Guo, Yanzhu, et al.
Publicado: (2024)
A Survey on Large Language Model Benchmarks
por: Ni, Shiwen, et al.
Publicado: (2025)
por: Ni, Shiwen, et al.
Publicado: (2025)
Estonian Native Large Language Model Benchmark
por: Lillepalu, Helena Grete, et al.
Publicado: (2025)
por: Lillepalu, Helena Grete, et al.
Publicado: (2025)
MM-Soc: Benchmarking Multimodal Large Language Models in Social Media Platforms
por: Jin, Yiqiao, et al.
Publicado: (2024)
por: Jin, Yiqiao, et al.
Publicado: (2024)
Are Large Language Models True Healthcare Jacks-of-All-Trades? Benchmarking Across Health Professions Beyond Physician Exams
por: Luo, Zheheng, et al.
Publicado: (2024)
por: Luo, Zheheng, et al.
Publicado: (2024)
Ejemplares similares
-
Epistemic Integrity in Large Language Models
por: Ghafouri, Bijean, et al.
Publicado: (2024) -
Benchmarking Gaslighting Attacks Against Speech Large Language Models
por: Wu, Jinyang, et al.
Publicado: (2025) -
Benchmarking Gaslighting Negation Attacks Against Multimodal Large Language Models
por: Zhu, Bin, et al.
Publicado: (2025) -
SocialMaze: A Benchmark for Evaluating Social Reasoning in Large Language Models
por: Xu, Zixiang, et al.
Publicado: (2025) -
Beyond Prompts: Dynamic Conversational Benchmarking of Large Language Models
por: Castillo-Bolado, David, et al.
Publicado: (2024)