Ethical Risks in Deploying Large Language Models: An Evaluation of Medical Ethics Jailbreaking
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Chutian, Cao, Dake, Ji, Jiacheng, Fan, Yunlou, Yan, Chengze, Xu, Hanhui |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Ethical Risks of Large Language Models in Medical Consultation: An Assessment Based on Reproductive Ethics
por: Xu, Hanhui, et al.
Publicado: (2026)
por: Xu, Hanhui, et al.
Publicado: (2026)
MedEthicEval: Evaluating Large Language Models Based on Chinese Medical Ethics
por: Jin, Haoan, et al.
Publicado: (2025)
por: Jin, Haoan, et al.
Publicado: (2025)
A Human-Centric Pipeline for Aligning Large Language Models with Chinese Medical Ethics
por: Jin, Haoan, et al.
Publicado: (2026)
por: Jin, Haoan, et al.
Publicado: (2026)
Ethics Whitepaper: Whitepaper on Ethical Research into Large Language Models
por: Ungless, Eddie L., et al.
Publicado: (2024)
por: Ungless, Eddie L., et al.
Publicado: (2024)
Evaluating Proactive Risk Awareness of Large Language Models
por: Luo, Xuan, et al.
Publicado: (2026)
por: Luo, Xuan, et al.
Publicado: (2026)
Ethic-BERT: An Enhanced Deep Learning Model for Ethical and Non-Ethical Content Classification
por: Mahadi, Mahamodul Hasan, et al.
Publicado: (2025)
por: Mahadi, Mahamodul Hasan, et al.
Publicado: (2025)
ClarityEthic: Explainable Moral Judgment Utilizing Contrastive Ethical Insights from Large Language Models
por: Sun, Yuxi, et al.
Publicado: (2024)
por: Sun, Yuxi, et al.
Publicado: (2024)
A Deployment Audit of Release-Side Risk in Conformal Triage under Prevalence Shift
por: Li, Chengze, et al.
Publicado: (2026)
por: Li, Chengze, et al.
Publicado: (2026)
Evaluation of Bias Towards Medical Professionals in Large Language Models
por: Chen, Xi, et al.
Publicado: (2024)
por: Chen, Xi, et al.
Publicado: (2024)
A Comparative Analysis on Ethical Benchmarking in Large Language Models
por: Sam, Kira, et al.
Publicado: (2024)
por: Sam, Kira, et al.
Publicado: (2024)
Virtue Ethics For Ethically Tunable Robotic Assistants
por: Ramanayake, Rajitha, et al.
Publicado: (2024)
por: Ramanayake, Rajitha, et al.
Publicado: (2024)
LLM Ethics Benchmark: A Three-Dimensional Assessment System for Evaluating Moral Reasoning in Large Language Models
por: Jiao, Junfeng, et al.
Publicado: (2025)
por: Jiao, Junfeng, et al.
Publicado: (2025)
Quantifying Risk Propensities of Large Language Models: Ethical Focus and Bias Detection through Role-Play
por: Zeng, Yifan, et al.
Publicado: (2024)
por: Zeng, Yifan, et al.
Publicado: (2024)
Analyzing the Ethical Logic of Six Large Language Models
por: Neuman, W. Russell, et al.
Publicado: (2025)
por: Neuman, W. Russell, et al.
Publicado: (2025)
The Ethical Compass of the Machine: Evaluating Large Language Models for Decision Support in Construction Project Management
por: Azie, Somtochukwu, et al.
Publicado: (2025)
por: Azie, Somtochukwu, et al.
Publicado: (2025)
The Evolving Ethics of Medical Data Stewardship
por: Kesner, Adam Leon, et al.
Publicado: (2025)
por: Kesner, Adam Leon, et al.
Publicado: (2025)
Deployment and Evaluation of an EHR-integrated, Large Language Model-Powered Tool to Triage Surgical Patients
por: Wang, Jane, et al.
Publicado: (2026)
por: Wang, Jane, et al.
Publicado: (2026)
Development of Application-Specific Large Language Models to Facilitate Research Ethics Review
por: Mann, Sebastian Porsdam, et al.
Publicado: (2025)
por: Mann, Sebastian Porsdam, et al.
Publicado: (2025)
Risks from Language Models for Automated Mental Healthcare: Ethics and Structure for Implementation
por: Grabb, Declan, et al.
Publicado: (2024)
por: Grabb, Declan, et al.
Publicado: (2024)
Secure On-Premise Deployment of Open-Weights Large Language Models in Radiology: An Isolation-First Architecture with Prospective Pilot Evaluation
por: Nowak, Sebastian, et al.
Publicado: (2026)
por: Nowak, Sebastian, et al.
Publicado: (2026)
Ethical Medical Image Synthesis
por: Jin, Weina, et al.
Publicado: (2025)
por: Jin, Weina, et al.
Publicado: (2025)
Student Perspectives on Using a Large Language Model (LLM) for an Assignment on Professional Ethics
por: Grande, Virginia, et al.
Publicado: (2024)
por: Grande, Virginia, et al.
Publicado: (2024)
Ethical Framework for Responsible Foundational Models in Medical Imaging
por: Das, Abhijit, et al.
Publicado: (2024)
por: Das, Abhijit, et al.
Publicado: (2024)
Ethics by Design: A Lifecycle Framework for Trustworthy AI in Medical Imaging From Transparent Data Governance to Clinically Validated Deployment
por: Khan, Umer Sadiq, et al.
Publicado: (2025)
por: Khan, Umer Sadiq, et al.
Publicado: (2025)
No General Code of Ethics for All: Ethical Considerations in Human-bot Psycho-counseling
por: Ma, Lizhi, et al.
Publicado: (2024)
por: Ma, Lizhi, et al.
Publicado: (2024)
Simulating Ethics: Using LLM Debate Panels to Model Deliberation on Medical Dilemmas
por: Zohny, Hazem
Publicado: (2025)
por: Zohny, Hazem
Publicado: (2025)
"Pull or Not to Pull?'': Investigating Moral Biases in Leading Large Language Models Across Ethical Dilemmas
por: Ding, Junchen, et al.
Publicado: (2025)
por: Ding, Junchen, et al.
Publicado: (2025)
The Ethics of ChatGPT in Medicine and Healthcare: A Systematic Review on Large Language Models (LLMs)
por: Haltaufderheide, Joschka, et al.
Publicado: (2024)
por: Haltaufderheide, Joschka, et al.
Publicado: (2024)
TombRaider: Entering the Vault of History to Jailbreak Large Language Models
por: Ding, Junchen, et al.
Publicado: (2025)
por: Ding, Junchen, et al.
Publicado: (2025)
EthicsMH: A Pilot Benchmark for Ethical Reasoning in Mental Health AI
por: Kasu, Sai Kartheek Reddy
Publicado: (2025)
por: Kasu, Sai Kartheek Reddy
Publicado: (2025)
Ethical Concern Identification in NLP: A Corpus of ACL Anthology Ethics Statements
por: Karamolegkou, Antonia, et al.
Publicado: (2024)
por: Karamolegkou, Antonia, et al.
Publicado: (2024)
Privacy Ethics Alignment in AI: A Stakeholder-Centric Framework for Ethical AI
por: Barthwal, Ankur, et al.
Publicado: (2025)
por: Barthwal, Ankur, et al.
Publicado: (2025)
PropensityBench: Evaluating Latent Safety Risks in Large Language Models via an Agentic Approach
por: Sehwag, Udari Madhushani, et al.
Publicado: (2025)
por: Sehwag, Udari Madhushani, et al.
Publicado: (2025)
Frontier AI Ethics: Anticipating and Evaluating the Societal Impacts of Language Model Agents
por: Lazar, Seth
Publicado: (2024)
por: Lazar, Seth
Publicado: (2024)
Addressing Moral Uncertainty using Large Language Models for Ethical Decision-Making
por: Dubey, Rohit K., et al.
Publicado: (2025)
por: Dubey, Rohit K., et al.
Publicado: (2025)
Towards Trustworthy AI: A Review of Ethical and Robust Large Language Models
por: Ferdaus, Md Meftahul, et al.
Publicado: (2024)
por: Ferdaus, Md Meftahul, et al.
Publicado: (2024)
Six Interventions for the Responsible and Ethical Implementation of Medical AI Agents
por: Bisson, Tom, et al.
Publicado: (2026)
por: Bisson, Tom, et al.
Publicado: (2026)
Nudging Using Autonomous Agents: Risks and Ethical Considerations
por: Nallur, Vivek, et al.
Publicado: (2024)
por: Nallur, Vivek, et al.
Publicado: (2024)
Designing Ethical Learning for Agentic AI: Toegye Yi Hwang's Ethical Emotion Regulation Framework
por: Kim, Ji Yeon
Publicado: (2026)
por: Kim, Ji Yeon
Publicado: (2026)
Evaluation of AI Ethics Tools in Language Models: A Developers' Perspective Case Study
por: Silva, Jhessica, et al.
Publicado: (2025)
por: Silva, Jhessica, et al.
Publicado: (2025)
Ejemplares similares
-
Ethical Risks of Large Language Models in Medical Consultation: An Assessment Based on Reproductive Ethics
por: Xu, Hanhui, et al.
Publicado: (2026) -
MedEthicEval: Evaluating Large Language Models Based on Chinese Medical Ethics
por: Jin, Haoan, et al.
Publicado: (2025) -
A Human-Centric Pipeline for Aligning Large Language Models with Chinese Medical Ethics
por: Jin, Haoan, et al.
Publicado: (2026) -
Ethics Whitepaper: Whitepaper on Ethical Research into Large Language Models
por: Ungless, Eddie L., et al.
Publicado: (2024) -
Evaluating Proactive Risk Awareness of Large Language Models
por: Luo, Xuan, et al.
Publicado: (2026)