Language Model Goal Selection Differs from Humans' in a Self-Directed Learning Task
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Molinaro, Gaia, August, Dave, Perszyk, Danielle, Collins, Anne G. E. |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Human vs. Machine: Behavioral Differences Between Expert Humans and Language Models in Wargame Simulations
par: Lamparth, Max, et autres
Publié: (2024)
par: Lamparth, Max, et autres
Publié: (2024)
PluriHarms: Benchmarking the Full Spectrum of Human Judgments on AI Harm
par: Li, Jing-Jing, et autres
Publié: (2026)
par: Li, Jing-Jing, et autres
Publié: (2026)
IROTE: Human-like Traits Elicitation of Large Language Model via In-Context Self-Reflective Optimization
par: Bai, Yuzhuo, et autres
Publié: (2025)
par: Bai, Yuzhuo, et autres
Publié: (2025)
Surveying Attitudinal Alignment Between Large Language Models Vs. Humans Towards 17 Sustainable Development Goals
par: Wu, Qingyang, et autres
Publié: (2024)
par: Wu, Qingyang, et autres
Publié: (2024)
The Human Condition as Reflected in Contemporary Large Language Models
par: Neuman, W. Russell
Publié: (2026)
par: Neuman, W. Russell
Publié: (2026)
Self-Blinding and Counterfactual Self-Simulation Mitigate Biases and Sycophancy in Large Language Models
par: Christian, Brian, et autres
Publié: (2026)
par: Christian, Brian, et autres
Publié: (2026)
A Behavioural and Representational Evaluation of Goal-Directedness in Language Model Agents
par: Arghal, Raghu, et autres
Publié: (2026)
par: Arghal, Raghu, et autres
Publié: (2026)
Evaluation of Large Language Models in Legal Applications: Challenges, Methods, and Future Directions
par: Hu, Yiran, et autres
Publié: (2026)
par: Hu, Yiran, et autres
Publié: (2026)
Should LLMs be WEIRD? Exploring WEIRDness and Human Rights in Large Language Models
par: Zhou, Ke, et autres
Publié: (2025)
par: Zhou, Ke, et autres
Publié: (2025)
Can Large Language Models Replace Human Coders? Introducing ContentBench
par: Haman, Michael
Publié: (2026)
par: Haman, Michael
Publié: (2026)
Prompt Selection Matters: Enhancing Text Annotations for Social Sciences with Large Language Models
par: Abraham, Louis, et autres
Publié: (2024)
par: Abraham, Louis, et autres
Publié: (2024)
TaCIE: Enhancing Instruction Comprehension in Large Language Models through Task-Centred Instruction Evolution
par: Yang, Jiuding, et autres
Publié: (2024)
par: Yang, Jiuding, et autres
Publié: (2024)
Ask LLMs Directly, "What shapes your bias?": Measuring Social Bias in Large Language Models
par: Shin, Jisu, et autres
Publié: (2024)
par: Shin, Jisu, et autres
Publié: (2024)
Self-Alignment of Large Language Models via Monopolylogue-based Social Scene Simulation
par: Pang, Xianghe, et autres
Publié: (2024)
par: Pang, Xianghe, et autres
Publié: (2024)
Survival at Any Cost? LLMs and the Choice Between Self-Preservation and Human Harm
par: Mohamadi, Alireza, et autres
Publié: (2025)
par: Mohamadi, Alireza, et autres
Publié: (2025)
Adapting Mental Health Prediction Tasks for Cross-lingual Learning via Meta-Training and In-context Learning with Large Language Model
par: Lifelo, Zita, et autres
Publié: (2024)
par: Lifelo, Zita, et autres
Publié: (2024)
Evaluating Large Language Models Against Human Annotators in Latent Content Analysis: Sentiment, Political Leaning, Emotional Intensity, and Sarcasm
par: Bojic, Ljubisa, et autres
Publié: (2025)
par: Bojic, Ljubisa, et autres
Publié: (2025)
Whose Preferences? Differences in Fairness Preferences and Their Impact on the Fairness of AI Utilizing Human Feedback
par: Lerner, Emilia Agis, et autres
Publié: (2024)
par: Lerner, Emilia Agis, et autres
Publié: (2024)
Can Large Language Models Simulate Human Responses? A Case Study of Stated Preference Experiments in the Context of Heating-related Choices
par: Wang, Han, et autres
Publié: (2025)
par: Wang, Han, et autres
Publié: (2025)
Large Language Model-Based Knowledge Graph System Construction for Sustainable Development Goals: An AI-Based Speculative Design Perspective
par: Lin, Yi-De, et autres
Publié: (2025)
par: Lin, Yi-De, et autres
Publié: (2025)
Large Legal Fictions: Profiling Legal Hallucinations in Large Language Models
par: Dahl, Matthew, et autres
Publié: (2024)
par: Dahl, Matthew, et autres
Publié: (2024)
Human Preferences for Constructive Interactions in Language Model Alignment
par: Kyrychenko, Yara, et autres
Publié: (2025)
par: Kyrychenko, Yara, et autres
Publié: (2025)
Different Bias Under Different Criteria: Assessing Bias in LLMs with a Fact-Based Approach
par: Ko, Changgeon, et autres
Publié: (2024)
par: Ko, Changgeon, et autres
Publié: (2024)
Denevil: Towards Deciphering and Navigating the Ethical Values of Large Language Models via Instruction Learning
par: Duan, Shitong, et autres
Publié: (2023)
par: Duan, Shitong, et autres
Publié: (2023)
Belief in the Machine: Investigating Epistemological Blind Spots of Language Models
par: Suzgun, Mirac, et autres
Publié: (2024)
par: Suzgun, Mirac, et autres
Publié: (2024)
Large Language Models Show Human-like Social Desirability Biases in Survey Responses
par: Salecha, Aadesh, et autres
Publié: (2024)
par: Salecha, Aadesh, et autres
Publié: (2024)
Cross-Language Bias Examination in Large Language Models
par: Liang, Yuxuan, et autres
Publié: (2025)
par: Liang, Yuxuan, et autres
Publié: (2025)
KidLM: Advancing Language Models for Children -- Early Insights and Future Directions
par: Nayeem, Mir Tafseer, et autres
Publié: (2024)
par: Nayeem, Mir Tafseer, et autres
Publié: (2024)
Rethinking Test-Time Scaling for Medical AI: Model and Task-Aware Strategies for LLMs and VLMs
par: Oh, Gyutaek, et autres
Publié: (2025)
par: Oh, Gyutaek, et autres
Publié: (2025)
On the Creativity of Large Language Models
par: Franceschelli, Giorgio, et autres
Publié: (2023)
par: Franceschelli, Giorgio, et autres
Publié: (2023)
Open Models, Closed Minds? On Agents Capabilities in Mimicking Human Personalities through Open Large Language Models
par: La Cava, Lucio, et autres
Publié: (2024)
par: La Cava, Lucio, et autres
Publié: (2024)
SUV: Scalable Large Language Model Copyright Compliance with Regularized Selective Unlearning
par: Xu, Tianyang, et autres
Publié: (2025)
par: Xu, Tianyang, et autres
Publié: (2025)
Evaluating Large Language Models for Detecting Antisemitism
par: Patel, Jay, et autres
Publié: (2025)
par: Patel, Jay, et autres
Publié: (2025)
Anticipating Innovation Using Large Language Models
par: Fenoaltea, Enrico Maria, et autres
Publié: (2026)
par: Fenoaltea, Enrico Maria, et autres
Publié: (2026)
Open-Ended Wargames with Large Language Models
par: Hogan, Daniel P., et autres
Publié: (2024)
par: Hogan, Daniel P., et autres
Publié: (2024)
Large Language Models for Education: A Survey
par: Xu, Hanyi, et autres
Publié: (2024)
par: Xu, Hanyi, et autres
Publié: (2024)
How Large Language Models are Designed to Hallucinate
par: Ackermann, Richard, et autres
Publié: (2025)
par: Ackermann, Richard, et autres
Publié: (2025)
Large Language Models as Misleading Assistants in Conversation
par: Hou, Betty Li, et autres
Publié: (2024)
par: Hou, Betty Li, et autres
Publié: (2024)
Evaluating Psychological Safety of Large Language Models
par: Li, Xingxuan, et autres
Publié: (2022)
par: Li, Xingxuan, et autres
Publié: (2022)
Large Language Models for Medicine: A Survey
par: Zheng, Yanxin, et autres
Publié: (2024)
par: Zheng, Yanxin, et autres
Publié: (2024)
Documents similaires
-
Human vs. Machine: Behavioral Differences Between Expert Humans and Language Models in Wargame Simulations
par: Lamparth, Max, et autres
Publié: (2024) -
PluriHarms: Benchmarking the Full Spectrum of Human Judgments on AI Harm
par: Li, Jing-Jing, et autres
Publié: (2026) -
IROTE: Human-like Traits Elicitation of Large Language Model via In-Context Self-Reflective Optimization
par: Bai, Yuzhuo, et autres
Publié: (2025) -
Surveying Attitudinal Alignment Between Large Language Models Vs. Humans Towards 17 Sustainable Development Goals
par: Wu, Qingyang, et autres
Publié: (2024) -
The Human Condition as Reflected in Contemporary Large Language Models
par: Neuman, W. Russell
Publié: (2026)