GreedLlama: Performance of Financial Value-Aligned Large Language Models in Moral Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yu, Jeffy, Huber, Maximilian, Tang, Kevin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Moral Imperative: The Need for Continual Superalignment of Large Language Models
par: Puthumanaillam, Gokul, et autres
Publié: (2024)
par: Puthumanaillam, Gokul, et autres
Publié: (2024)
Fairer Preferences Elicit Improved Human-Aligned Large Language Model Judgments
par: Zhou, Han, et autres
Publié: (2024)
par: Zhou, Han, et autres
Publié: (2024)
Unintended Harms of Value-Aligned LLMs: Psychological and Empirical Insights
par: Choi, Sooyung, et autres
Publié: (2025)
par: Choi, Sooyung, et autres
Publié: (2025)
Does Cross-Cultural Alignment Change the Commonsense Morality of Language Models?
par: Jinnai, Yuu
Publié: (2024)
par: Jinnai, Yuu
Publié: (2024)
Emissions and Performance Trade-off Between Small and Large Language Models
par: Garg, Anandita, et autres
Publié: (2025)
par: Garg, Anandita, et autres
Publié: (2025)
Values in the Wild: Discovering and Analyzing Values in Real-World Language Model Interactions
par: Huang, Saffron, et autres
Publié: (2025)
par: Huang, Saffron, et autres
Publié: (2025)
Predicting Learning Performance with Large Language Models: A Study in Adult Literacy
par: Zhang, Liang, et autres
Publié: (2024)
par: Zhang, Liang, et autres
Publié: (2024)
MoReBench: Evaluating Procedural and Pluralistic Moral Reasoning in Language Models, More than Outcomes
par: Chiu, Yu Ying, et autres
Publié: (2025)
par: Chiu, Yu Ying, et autres
Publié: (2025)
Assessing the Emergent Symbolic Reasoning Abilities of Llama Large Language Models
par: Petruzzellis, Flavio, et autres
Publié: (2024)
par: Petruzzellis, Flavio, et autres
Publié: (2024)
Lugha-Llama: Adapting Large Language Models for African Languages
par: Buzaaba, Happy, et autres
Publié: (2025)
par: Buzaaba, Happy, et autres
Publié: (2025)
Deliberative Alignment: Reasoning Enables Safer Language Models
par: Guan, Melody Y., et autres
Publié: (2024)
par: Guan, Melody Y., et autres
Publié: (2024)
Llama-Nemotron: Efficient Reasoning Models
par: Bercovich, Akhiad, et autres
Publié: (2025)
par: Bercovich, Akhiad, et autres
Publié: (2025)
Bias and Fairness in Large Language Models: A Survey
par: Gallegos, Isabel O., et autres
Publié: (2023)
par: Gallegos, Isabel O., et autres
Publié: (2023)
DualAlign: Generating Clinically Grounded Synthetic Data
par: Li, Rumeng, et autres
Publié: (2025)
par: Li, Rumeng, et autres
Publié: (2025)
Correlated Errors in Large Language Models
par: Kim, Elliot, et autres
Publié: (2025)
par: Kim, Elliot, et autres
Publié: (2025)
Hypothesis Generation with Large Language Models
par: Zhou, Yangqiaoyu, et autres
Publié: (2024)
par: Zhou, Yangqiaoyu, et autres
Publié: (2024)
Large Language Models are Geographically Biased
par: Manvi, Rohin, et autres
Publié: (2024)
par: Manvi, Rohin, et autres
Publié: (2024)
Psychological Counseling Ability of Large Language Models
par: Peng, Fangyu, et autres
Publié: (2025)
par: Peng, Fangyu, et autres
Publié: (2025)
Assessing Large Language Models on Climate Information
par: Bulian, Jannis, et autres
Publié: (2023)
par: Bulian, Jannis, et autres
Publié: (2023)
RedTopic: Toward Topic-Diverse Red Teaming of Large Language Models
par: Ding, Jiale, et autres
Publié: (2025)
par: Ding, Jiale, et autres
Publié: (2025)
Self-Debiasing Large Language Models: Zero-Shot Recognition and Reduction of Stereotypes
par: Gallegos, Isabel O., et autres
Publié: (2024)
par: Gallegos, Isabel O., et autres
Publié: (2024)
A Taxonomy of Stereotype Content in Large Language Models
par: Nicolas, Gandalf, et autres
Publié: (2024)
par: Nicolas, Gandalf, et autres
Publié: (2024)
Transforming Agency. On the mode of existence of Large Language Models
par: Barandiaran, Xabier E., et autres
Publié: (2024)
par: Barandiaran, Xabier E., et autres
Publié: (2024)
LLMCarbon: Modeling the end-to-end Carbon Footprint of Large Language Models
par: Faiz, Ahmad, et autres
Publié: (2023)
par: Faiz, Ahmad, et autres
Publié: (2023)
Siren's Song in the AI Ocean: A Survey on Hallucination in Large Language Models
par: Zhang, Yue, et autres
Publié: (2023)
par: Zhang, Yue, et autres
Publié: (2023)
ResumeAtlas: Revisiting Resume Classification with Large-Scale Datasets and Large Language Models
par: Heakl, Ahmed, et autres
Publié: (2024)
par: Heakl, Ahmed, et autres
Publié: (2024)
Foundational Challenges in Assuring Alignment and Safety of Large Language Models
par: Anwar, Usman, et autres
Publié: (2024)
par: Anwar, Usman, et autres
Publié: (2024)
Exploring Accuracy-Fairness Trade-off in Large Language Models
par: Zhang, Qingquan, et autres
Publié: (2024)
par: Zhang, Qingquan, et autres
Publié: (2024)
Are Large Language Models Chameleons? An Attempt to Simulate Social Surveys
par: Geng, Mingmeng, et autres
Publié: (2024)
par: Geng, Mingmeng, et autres
Publié: (2024)
Towards Large Language Models that Benefit for All: Benchmarking Group Fairness in Reward Models
par: Song, Kefan, et autres
Publié: (2025)
par: Song, Kefan, et autres
Publié: (2025)
REQUAL-LM: Reliability and Equity through Aggregation in Large Language Models
par: Ebrahimi, Sana, et autres
Publié: (2024)
par: Ebrahimi, Sana, et autres
Publié: (2024)
Reward Models Inherit Value Biases from Pretraining
par: Christian, Brian, et autres
Publié: (2026)
par: Christian, Brian, et autres
Publié: (2026)
SimBench: Benchmarking the Ability of Large Language Models to Simulate Human Behaviors
par: Hu, Tiancheng, et autres
Publié: (2025)
par: Hu, Tiancheng, et autres
Publié: (2025)
SUV: Scalable Large Language Model Copyright Compliance with Regularized Selective Unlearning
par: Xu, Tianyang, et autres
Publié: (2025)
par: Xu, Tianyang, et autres
Publié: (2025)
What's in a Name? Auditing Large Language Models for Race and Gender Bias
par: Salinas, Alejandro, et autres
Publié: (2024)
par: Salinas, Alejandro, et autres
Publié: (2024)
Large Language Models Predict Functional Outcomes after Acute Ischemic Stroke
par: Kapoor, Anjali K., et autres
Publié: (2026)
par: Kapoor, Anjali K., et autres
Publié: (2026)
Large Language Models Assume People are More Rational than We Really are
par: Liu, Ryan, et autres
Publié: (2024)
par: Liu, Ryan, et autres
Publié: (2024)
AXOLOTL: Fairness through Assisted Self-Debiasing of Large Language Model Outputs
par: Ebrahimi, Sana, et autres
Publié: (2024)
par: Ebrahimi, Sana, et autres
Publié: (2024)
Inducing Human-like Biases in Moral Reasoning Language Models
par: Karpov, Artem, et autres
Publié: (2024)
par: Karpov, Artem, et autres
Publié: (2024)
Beyond Labels: Aligning Large Language Models with Human-like Reasoning
par: Kabir, Muhammad Rafsan, et autres
Publié: (2024)
par: Kabir, Muhammad Rafsan, et autres
Publié: (2024)
Documents similaires
-
A Moral Imperative: The Need for Continual Superalignment of Large Language Models
par: Puthumanaillam, Gokul, et autres
Publié: (2024) -
Fairer Preferences Elicit Improved Human-Aligned Large Language Model Judgments
par: Zhou, Han, et autres
Publié: (2024) -
Unintended Harms of Value-Aligned LLMs: Psychological and Empirical Insights
par: Choi, Sooyung, et autres
Publié: (2025) -
Does Cross-Cultural Alignment Change the Commonsense Morality of Language Models?
par: Jinnai, Yuu
Publié: (2024) -
Emissions and Performance Trade-off Between Small and Large Language Models
par: Garg, Anandita, et autres
Publié: (2025)