A Comparative Analysis on Ethical Benchmarking in Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Sam, Kira, Vavekanand, Raja |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
CELLM: An Efficient Communication in Large Language Models Training for Federated Learning
by: Vavekanand, Raja, et al.
Published: (2024)
by: Vavekanand, Raja, et al.
Published: (2024)
Gravix: Active Learning for Gravitational Waves Classification Algorithms
by: Vavekanand, Raja, et al.
Published: (2024)
by: Vavekanand, Raja, et al.
Published: (2024)
UAV Networks Surveillance Implementing an Effective Load-Aware Multipath Routing Protocol (ELAMRP)
by: Vavekanand, Raja, et al.
Published: (2024)
by: Vavekanand, Raja, et al.
Published: (2024)
Analyzing the Ethical Logic of Six Large Language Models
by: Neuman, W. Russell, et al.
Published: (2025)
by: Neuman, W. Russell, et al.
Published: (2025)
Ethical Risks in Deploying Large Language Models: An Evaluation of Medical Ethics Jailbreaking
by: Huang, Chutian, et al.
Published: (2026)
by: Huang, Chutian, et al.
Published: (2026)
Ethics Whitepaper: Whitepaper on Ethical Research into Large Language Models
by: Ungless, Eddie L., et al.
Published: (2024)
by: Ungless, Eddie L., et al.
Published: (2024)
Ethical Risks of Large Language Models in Medical Consultation: An Assessment Based on Reproductive Ethics
by: Xu, Hanhui, et al.
Published: (2026)
by: Xu, Hanhui, et al.
Published: (2026)
LocalValueBench: A Collaboratively Built and Extensible Benchmark for Evaluating Localized Value Alignment and Ethical Safety in Large Language Models
by: Meadows, Gwenyth Isobel, et al.
Published: (2024)
by: Meadows, Gwenyth Isobel, et al.
Published: (2024)
Towards Trustworthy AI: A Review of Ethical and Robust Large Language Models
by: Ferdaus, Md Meftahul, et al.
Published: (2024)
by: Ferdaus, Md Meftahul, et al.
Published: (2024)
Benchmarking Large Language Models on Homework Assessment in Circuit Analysis
by: Chen, Liangliang, et al.
Published: (2025)
by: Chen, Liangliang, et al.
Published: (2025)
Addressing Moral Uncertainty using Large Language Models for Ethical Decision-Making
by: Dubey, Rohit K., et al.
Published: (2025)
by: Dubey, Rohit K., et al.
Published: (2025)
REBAR: Reference Ethical Benchmark for Autonomy Readiness
by: Diller, Jonathan, et al.
Published: (2026)
by: Diller, Jonathan, et al.
Published: (2026)
Human Simulacra: Benchmarking the Personification of Large Language Models
by: Xie, Qiuejie, et al.
Published: (2024)
by: Xie, Qiuejie, et al.
Published: (2024)
Beyond Partisan Leaning: A Comparative Analysis of Political Bias in Large Language Models
by: Peng, Tai-Quan, et al.
Published: (2024)
by: Peng, Tai-Quan, et al.
Published: (2024)
TRIAGE: Ethical Benchmarking of AI Models Through Mass Casualty Simulations
by: Kirch, Nathalie Maria, et al.
Published: (2024)
by: Kirch, Nathalie Maria, et al.
Published: (2024)
CDEval: A Benchmark for Measuring the Cultural Dimensions of Large Language Models
by: Wang, Yuhang, et al.
Published: (2023)
by: Wang, Yuhang, et al.
Published: (2023)
"Pull or Not to Pull?'': Investigating Moral Biases in Leading Large Language Models Across Ethical Dilemmas
by: Ding, Junchen, et al.
Published: (2025)
by: Ding, Junchen, et al.
Published: (2025)
Denevil: Towards Deciphering and Navigating the Ethical Values of Large Language Models via Instruction Learning
by: Duan, Shitong, et al.
Published: (2023)
by: Duan, Shitong, et al.
Published: (2023)
The Ethical Compass of the Machine: Evaluating Large Language Models for Decision Support in Construction Project Management
by: Azie, Somtochukwu, et al.
Published: (2025)
by: Azie, Somtochukwu, et al.
Published: (2025)
Bilingual Bias in Large Language Models: A Taiwan Sovereignty Benchmark Study
by: Ko, Ju-Chun
Published: (2026)
by: Ko, Ju-Chun
Published: (2026)
Harnessing Large Language Models for Mental Health: Opportunities, Challenges, and Ethical Considerations
by: Pandey, Hari Mohan
Published: (2024)
by: Pandey, Hari Mohan
Published: (2024)
Safety and Security Analysis of Large Language Models: Benchmarking Risk Profile and Harm Potential
by: Akiri, Charankumar, et al.
Published: (2025)
by: Akiri, Charankumar, et al.
Published: (2025)
Quantifying Risk Propensities of Large Language Models: Ethical Focus and Bias Detection through Role-Play
by: Zeng, Yifan, et al.
Published: (2024)
by: Zeng, Yifan, et al.
Published: (2024)
Better Call GPT, Comparing Large Language Models Against Lawyers
by: Martin, Lauren, et al.
Published: (2024)
by: Martin, Lauren, et al.
Published: (2024)
Large Language Models in Architecture Studio: A Framework for Learning Outcomes
by: Rodriguez, Juan David Salazar, et al.
Published: (2025)
by: Rodriguez, Juan David Salazar, et al.
Published: (2025)
Benchmarking Political Persuasion Risks Across Frontier Large Language Models
by: Chen, Zhongren, et al.
Published: (2026)
by: Chen, Zhongren, et al.
Published: (2026)
Comparing Rationality Between Large Language Models and Humans: Insights and Open Questions
by: Alsagheer, Dana, et al.
Published: (2024)
by: Alsagheer, Dana, et al.
Published: (2024)
Evaluating Large Language Models on Spatial Tasks: A Multi-Task Benchmarking Study
by: Xu, Liuchang, et al.
Published: (2024)
by: Xu, Liuchang, et al.
Published: (2024)
Characterizing Bias: Benchmarking Large Language Models in Simplified versus Traditional Chinese
by: Lyu, Hanjia, et al.
Published: (2025)
by: Lyu, Hanjia, et al.
Published: (2025)
Applying Large Language Models to Travel Satisfaction Analysis
by: Xu, Pengfei, et al.
Published: (2025)
by: Xu, Pengfei, et al.
Published: (2025)
WinoQueer: A Community-in-the-Loop Benchmark for Anti-LGBTQ+ Bias in Large Language Models
by: Felkner, Virginia K., et al.
Published: (2023)
by: Felkner, Virginia K., et al.
Published: (2023)
Learning Cybersecurity vs. Ethical Hacking: A Comparative Pathway for Aspiring Students
by: Quttainah, Fahed
Published: (2025)
by: Quttainah, Fahed
Published: (2025)
EthicsMH: A Pilot Benchmark for Ethical Reasoning in Mental Health AI
by: Kasu, Sai Kartheek Reddy
Published: (2025)
by: Kasu, Sai Kartheek Reddy
Published: (2025)
Beyond Personhood: Agency, Accountability, and the Limits of Anthropomorphic Ethical Analysis
by: Dai, Jessica
Published: (2024)
by: Dai, Jessica
Published: (2024)
AccessEval: Benchmarking Disability Bias in Large Language Models
by: Panda, Srikant, et al.
Published: (2025)
by: Panda, Srikant, et al.
Published: (2025)
DarkBench: Benchmarking Dark Patterns in Large Language Models
by: Kran, Esben, et al.
Published: (2025)
by: Kran, Esben, et al.
Published: (2025)
Evaluating Digital Inclusiveness of Digital Agri-Food Tools Using Large Language Models: A Comparative Analysis Between Human and AI-Based Evaluations
by: Pewinya, Githma, et al.
Published: (2026)
by: Pewinya, Githma, et al.
Published: (2026)
IDEAlign: Comparing Large Language Models to Human Experts in Open-ended Interpretive Annotations
by: Nam, Hyunji, et al.
Published: (2025)
by: Nam, Hyunji, et al.
Published: (2025)
LLM Ethics Benchmark: A Three-Dimensional Assessment System for Evaluating Moral Reasoning in Large Language Models
by: Jiao, Junfeng, et al.
Published: (2025)
by: Jiao, Junfeng, et al.
Published: (2025)
A Systematic Analysis of Biases in Large Language Models
by: Zhang, Xulang, et al.
Published: (2025)
by: Zhang, Xulang, et al.
Published: (2025)
Similar Items
-
CELLM: An Efficient Communication in Large Language Models Training for Federated Learning
by: Vavekanand, Raja, et al.
Published: (2024) -
Gravix: Active Learning for Gravitational Waves Classification Algorithms
by: Vavekanand, Raja, et al.
Published: (2024) -
UAV Networks Surveillance Implementing an Effective Load-Aware Multipath Routing Protocol (ELAMRP)
by: Vavekanand, Raja, et al.
Published: (2024) -
Analyzing the Ethical Logic of Six Large Language Models
by: Neuman, W. Russell, et al.
Published: (2025) -
Ethical Risks in Deploying Large Language Models: An Evaluation of Medical Ethics Jailbreaking
by: Huang, Chutian, et al.
Published: (2026)