Unsupervised Elicitation of Moral Values from Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Alizadeh, Meysam, Gilardi, Fabrizio, Samei, Zeynab |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Web-Browsing LLMs Can Access Social Media Profiles and Infer User Demographics
by: Alizadeh, Meysam, et al.
Published: (2025)
by: Alizadeh, Meysam, et al.
Published: (2025)
Simple Prompt Injection Attacks Can Leak Personal Data Observed by LLM Agents During Task Execution
by: Alizadeh, Meysam, et al.
Published: (2025)
by: Alizadeh, Meysam, et al.
Published: (2025)
Open-Source LLMs for Text Annotation: A Practical Guide for Model Setting and Fine-Tuning
by: Alizadeh, Meysam, et al.
Published: (2023)
by: Alizadeh, Meysam, et al.
Published: (2023)
Data marketplaces can increase the willingness to share social media data at low prices
by: Alizadeh, Meysam, et al.
Published: (2025)
by: Alizadeh, Meysam, et al.
Published: (2025)
Comparing Methods for Creating a National Random Sample of Twitter Users
by: Alizadeh, Meysam, et al.
Published: (2024)
by: Alizadeh, Meysam, et al.
Published: (2024)
Unsupervised Elicitation of Language Models
by: Wen, Jiaxin, et al.
Published: (2025)
by: Wen, Jiaxin, et al.
Published: (2025)
Exploring Relationships Between Cryptocurrency News Outlets and Influencers' Twitter Activity and Market Prices
by: Alizadeh, Meysam, et al.
Published: (2024)
by: Alizadeh, Meysam, et al.
Published: (2024)
Societal AI Research Has Become Less Interdisciplinary
by: Markus, Dror Kris, et al.
Published: (2025)
by: Markus, Dror Kris, et al.
Published: (2025)
MoralBERT: A Fine-Tuned Language Model for Capturing Moral Values in Social Discussions
by: Preniqi, Vjosa, et al.
Published: (2024)
by: Preniqi, Vjosa, et al.
Published: (2024)
Bayesian Preference Elicitation with Language Models
by: Handa, Kunal, et al.
Published: (2024)
by: Handa, Kunal, et al.
Published: (2024)
Inertia in Moral and Value Judgments of Large Language Models
by: Lee, Bruce W., et al.
Published: (2024)
by: Lee, Bruce W., et al.
Published: (2024)
AutoElicit: Using Large Language Models for Expert Prior Elicitation in Predictive Modelling
by: Capstick, Alexander, et al.
Published: (2024)
by: Capstick, Alexander, et al.
Published: (2024)
Calibrating the Confidence of Large Language Models by Eliciting Fidelity
by: Zhang, Mozhi, et al.
Published: (2024)
by: Zhang, Mozhi, et al.
Published: (2024)
Meta-Task Prompting Elicits Embeddings from Large Language Models
by: Lei, Yibin, et al.
Published: (2024)
by: Lei, Yibin, et al.
Published: (2024)
Language Models Benefit from Preparation with Elicited Knowledge
by: Yu, Jiacan, et al.
Published: (2024)
by: Yu, Jiacan, et al.
Published: (2024)
Chain-of-Dictionary Prompting Elicits Translation in Large Language Models
by: Lu, Hongyuan, et al.
Published: (2023)
by: Lu, Hongyuan, et al.
Published: (2023)
Eliciting Reasoning in Language Models with Cognitive Tools
by: Ebouky, Brown, et al.
Published: (2025)
by: Ebouky, Brown, et al.
Published: (2025)
Eliciting Personality Traits in Large Language Models
by: Hilliard, Airlie, et al.
Published: (2024)
by: Hilliard, Airlie, et al.
Published: (2024)
Hypothesis-only Biases in Large Language Model-Elicited Natural Language Inference
by: Proebsting, Grace, et al.
Published: (2024)
by: Proebsting, Grace, et al.
Published: (2024)
Causality Elicitation from Large Language Models
by: Kameyama, Takashi, et al.
Published: (2026)
by: Kameyama, Takashi, et al.
Published: (2026)
Eliciting the Priors of Large Language Models using Iterated In-Context Learning
by: Zhu, Jian-Qiao, et al.
Published: (2024)
by: Zhu, Jian-Qiao, et al.
Published: (2024)
Linguistic Minimal Pairs Elicit Linguistic Similarity in Large Language Models
by: Zhou, Xinyu, et al.
Published: (2024)
by: Zhou, Xinyu, et al.
Published: (2024)
Chain-of-Conceptual-Thought Elicits Daily Conversation in Large Language Models
by: Gu, Qingqing, et al.
Published: (2025)
by: Gu, Qingqing, et al.
Published: (2025)
Cognition-of-Thought Elicits Social-Aligned Reasoning in Large Language Models
by: Zhang, Xuanming, et al.
Published: (2025)
by: Zhang, Xuanming, et al.
Published: (2025)
On Eliciting Syntax from Language Models via Hashing
by: Wang, Yiran, et al.
Published: (2024)
by: Wang, Yiran, et al.
Published: (2024)
Eliciting Latent Knowledge from Quirky Language Models
by: Mallen, Alex, et al.
Published: (2023)
by: Mallen, Alex, et al.
Published: (2023)
The Potential of Large Language Models in Supply Chain Management: Advancing Decision-Making, Efficiency, and Innovation
by: Aghaei, Raha, et al.
Published: (2025)
by: Aghaei, Raha, et al.
Published: (2025)
Biases in Large Language Model-Elicited Text: A Case Study in Natural Language Inference
by: Proebsting, Grace, et al.
Published: (2025)
by: Proebsting, Grace, et al.
Published: (2025)
Eliciting Language Model Behaviors with Investigator Agents
by: Li, Xiang Lisa, et al.
Published: (2025)
by: Li, Xiang Lisa, et al.
Published: (2025)
The Pluralistic Moral Gap: Understanding Judgment and Value Differences between Humans and Large Language Models
by: Russo, Giuseppe, et al.
Published: (2025)
by: Russo, Giuseppe, et al.
Published: (2025)
Eliciting Causal Abilities in Large Language Models for Reasoning Tasks
by: Wang, Yajing, et al.
Published: (2024)
by: Wang, Yajing, et al.
Published: (2024)
Understanding the Cognitive Complexity in Language Elicited by Product Images
by: Chen, Yan-Ying, et al.
Published: (2024)
by: Chen, Yan-Ying, et al.
Published: (2024)
GreedLlama: Performance of Financial Value-Aligned Large Language Models in Moral Reasoning
by: Yu, Jeffy, et al.
Published: (2024)
by: Yu, Jeffy, et al.
Published: (2024)
Eliciting Informative Text Evaluations with Large Language Models
by: Lu, Yuxuan, et al.
Published: (2024)
by: Lu, Yuxuan, et al.
Published: (2024)
Mind's Eye of LLMs: Visualization-of-Thought Elicits Spatial Reasoning in Large Language Models
by: Wu, Wenshan, et al.
Published: (2024)
by: Wu, Wenshan, et al.
Published: (2024)
Eliciting the Translation Ability of Large Language Models via Multilingual Finetuning with Translation Instructions
by: Li, Jiahuan, et al.
Published: (2023)
by: Li, Jiahuan, et al.
Published: (2023)
Harnessing the Potential of Large Language Models in Modern Marketing Management: Applications, Future Directions, and Strategic Recommendations
by: Aghaei, Raha, et al.
Published: (2025)
by: Aghaei, Raha, et al.
Published: (2025)
Jailbreaking Large Language Models with Morality Attacks
by: Su, Ying, et al.
Published: (2026)
by: Su, Ying, et al.
Published: (2026)
Are Language Models Consequentialist or Deontological Moral Reasoners?
by: Samway, Keenan, et al.
Published: (2025)
by: Samway, Keenan, et al.
Published: (2025)
Reasoning Elicitation in Language Models via Counterfactual Feedback
by: Hüyük, Alihan, et al.
Published: (2024)
by: Hüyük, Alihan, et al.
Published: (2024)
Similar Items
-
Web-Browsing LLMs Can Access Social Media Profiles and Infer User Demographics
by: Alizadeh, Meysam, et al.
Published: (2025) -
Simple Prompt Injection Attacks Can Leak Personal Data Observed by LLM Agents During Task Execution
by: Alizadeh, Meysam, et al.
Published: (2025) -
Open-Source LLMs for Text Annotation: A Practical Guide for Model Setting and Fine-Tuning
by: Alizadeh, Meysam, et al.
Published: (2023) -
Data marketplaces can increase the willingness to share social media data at low prices
by: Alizadeh, Meysam, et al.
Published: (2025) -
Comparing Methods for Creating a National Random Sample of Twitter Users
by: Alizadeh, Meysam, et al.
Published: (2024)