Can Finetuing LLMs on Small Human Samples Increase Heterogeneity, Alignment, and Belief-Action Coherence?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Steven, Hunt, Kyle, Tang, Shaojie, Joseph, Kenneth |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Can LLMs Truly Embody Human Personality? Analyzing AI and Human Behavior Alignment in Dispute Resolution
par: Kwon, Deuksin, et autres
Publié: (2026)
par: Kwon, Deuksin, et autres
Publié: (2026)
"Seeing the Big through the Small": Can LLMs Approximate Human Judgment Distributions on NLI from a Few Explanations?
par: Chen, Beiduo, et autres
Publié: (2024)
par: Chen, Beiduo, et autres
Publié: (2024)
Enhancing Reasoning Abilities of Small LLMs with Cognitive Alignment
par: Cai, Wenrui, et autres
Publié: (2025)
par: Cai, Wenrui, et autres
Publié: (2025)
From Implicit to Explicit: Token-Efficient Logical Supervision for Mathematical Reasoning in LLMs
par: Wang, Shaojie, et autres
Publié: (2026)
par: Wang, Shaojie, et autres
Publié: (2026)
Refining Positive and Toxic Samples for Dual Safety Self-Alignment of LLMs with Minimal Human Interventions
par: Xu, Jingxin, et autres
Publié: (2025)
par: Xu, Jingxin, et autres
Publié: (2025)
Sample-Efficient Alignment for LLMs
par: Liu, Zichen, et autres
Publié: (2024)
par: Liu, Zichen, et autres
Publié: (2024)
Impact of Decoding Methods on Human Alignment of Conversational LLMs
par: Furniturewala, Shaz, et autres
Publié: (2024)
par: Furniturewala, Shaz, et autres
Publié: (2024)
Humanity's Last Code Exam: Can Advanced LLMs Conquer Human's Hardest Code Competition?
par: Li, Xiangyang, et autres
Publié: (2025)
par: Li, Xiangyang, et autres
Publié: (2025)
Can LLMs Capture Human Preferences?
par: Goli, Ali, et autres
Publié: (2023)
par: Goli, Ali, et autres
Publié: (2023)
Rethinking the Understanding Ability across LLMs through Mutual Information
par: Wang, Shaojie, et autres
Publié: (2025)
par: Wang, Shaojie, et autres
Publié: (2025)
Can LLMs Estimate Student Struggles? Human-AI Difficulty Alignment with Proficiency Simulation for Item Difficulty Prediction
par: Li, Ming, et autres
Publié: (2025)
par: Li, Ming, et autres
Publié: (2025)
What Helps Language Models Predict Human Beliefs: Demographics or Prior Stances?
par: Malone, Joseph, et autres
Publié: (2025)
par: Malone, Joseph, et autres
Publié: (2025)
Human-Alignment and Calibration of Inference-Time Uncertainty in Large Language Models
par: Moore, Kyle, et autres
Publié: (2025)
par: Moore, Kyle, et autres
Publié: (2025)
Robustness and Confounders in the Demographic Alignment of LLMs with Human Perceptions of Offensiveness
par: Alipour, Shayan, et autres
Publié: (2024)
par: Alipour, Shayan, et autres
Publié: (2024)
VLMs May Not Globally Enhance Human Alignment over LLMs During Natural Reading
par: Wu, Jinzhou, et autres
Publié: (2026)
par: Wu, Jinzhou, et autres
Publié: (2026)
PACIFIC: Can LLMs Discern the Traits Influencing Your Preferences? Evaluating Personality-Driven Preference Alignment in LLMs
par: Zhao, Tianyu, et autres
Publié: (2026)
par: Zhao, Tianyu, et autres
Publié: (2026)
LLMs Can Infer Political Alignment from Online Conversations
par: Lee, Byunghwee, et autres
Publié: (2026)
par: Lee, Byunghwee, et autres
Publié: (2026)
Human-Instruction-Free LLM Self-Alignment with Limited Samples
par: Guo, Hongyi, et autres
Publié: (2024)
par: Guo, Hongyi, et autres
Publié: (2024)
Can you map it to English? The Role of Cross-Lingual Alignment in Multilingual Performance of LLMs
par: Ravisankar, Kartik, et autres
Publié: (2025)
par: Ravisankar, Kartik, et autres
Publié: (2025)
Why Do LLMs Struggle in Strategic Play? Broken Links Between Observations, Beliefs, and Actions
par: Sobotka, Jan, et autres
Publié: (2026)
par: Sobotka, Jan, et autres
Publié: (2026)
Personalization Increases Affective Alignment but Has Role-Dependent Effects on Epistemic Independence in LLMs
par: Kelley, Sean W., et autres
Publié: (2026)
par: Kelley, Sean W., et autres
Publié: (2026)
Adapting LLMs to Time Series Forecasting via Temporal Heterogeneity Modeling and Semantic Alignment
par: Sun, Yanru, et autres
Publié: (2025)
par: Sun, Yanru, et autres
Publié: (2025)
Vulnerability of LLMs' Stated Beliefs? LLMs Belief Resistance Check Through Strategic Persuasive Conversation Interventions
par: Huang, Fan, et autres
Publié: (2026)
par: Huang, Fan, et autres
Publié: (2026)
How Far Can LLMs Improve from Experience? Measuring Test-Time Learning Ability in LLMs with Human Comparison
par: Wang, Jiayin, et autres
Publié: (2025)
par: Wang, Jiayin, et autres
Publié: (2025)
Mind the Value-Action Gap: Do LLMs Act in Alignment with Their Values?
par: Shen, Hua, et autres
Publié: (2025)
par: Shen, Hua, et autres
Publié: (2025)
Graph-Based Alternatives to LLMs for Human Simulation
par: Suh, Joseph, et autres
Publié: (2025)
par: Suh, Joseph, et autres
Publié: (2025)
Zero-Shot Belief: A Hard Problem for LLMs
par: Murzaku, John, et autres
Publié: (2025)
par: Murzaku, John, et autres
Publié: (2025)
Alignment-Augmented Speculative Decoding with Alignment Sampling and Conditional Verification
par: Wang, Jikai, et autres
Publié: (2025)
par: Wang, Jikai, et autres
Publié: (2025)
Can LLMs Express Personality Across Cultures? Introducing CulturalPersonas for Evaluating Trait Alignment
par: Dey, Priyanka, et autres
Publié: (2025)
par: Dey, Priyanka, et autres
Publié: (2025)
Can LLMs Simulate Social Media Engagement? A Study on Action-Guided Response Generation
par: Qiu, Zhongyi, et autres
Publié: (2025)
par: Qiu, Zhongyi, et autres
Publié: (2025)
Models Can and Should Embrace the Communicative Nature of Human-Generated Math
par: Boguraev, Sasha, et autres
Publié: (2024)
par: Boguraev, Sasha, et autres
Publié: (2024)
You Can't Fight in Here! This is BBS!
par: Futrell, Richard, et autres
Publié: (2026)
par: Futrell, Richard, et autres
Publié: (2026)
Bridging the Creativity Understanding Gap: Small-Scale Human Alignment Enables Expert-Level Humor Ranking in LLMs
par: Zhou, Kuan Lok, et autres
Publié: (2025)
par: Zhou, Kuan Lok, et autres
Publié: (2025)
Multimodality and Attention Increase Alignment in Natural Language Prediction Between Humans and Computational Models
par: Kewenig, Viktor, et autres
Publié: (2023)
par: Kewenig, Viktor, et autres
Publié: (2023)
Learning to Seek Help: Dynamic Collaboration Between Small and Large Language Models
par: Zeng, Hang, et autres
Publié: (2026)
par: Zeng, Hang, et autres
Publié: (2026)
Survey-to-Behavior: Downstream Alignment of Human Values in LLMs via Survey Questions
par: Nie, Shangrui, et autres
Publié: (2025)
par: Nie, Shangrui, et autres
Publié: (2025)
APAR: LLMs Can Do Auto-Parallel Auto-Regressive Decoding
par: Liu, Mingdao, et autres
Publié: (2024)
par: Liu, Mingdao, et autres
Publié: (2024)
FilBench: Can LLMs Understand and Generate Filipino?
par: Miranda, Lester James V., et autres
Publié: (2025)
par: Miranda, Lester James V., et autres
Publié: (2025)
Can LLMs Beat Humans in Debating? A Dynamic Multi-agent Framework for Competitive Debate
par: Zhang, Yiqun, et autres
Publié: (2024)
par: Zhang, Yiqun, et autres
Publié: (2024)
HAL: Inducing Human-likeness in LLMs with Alignment
par: Hasan, Masum, et autres
Publié: (2026)
par: Hasan, Masum, et autres
Publié: (2026)
Documents similaires
-
Can LLMs Truly Embody Human Personality? Analyzing AI and Human Behavior Alignment in Dispute Resolution
par: Kwon, Deuksin, et autres
Publié: (2026) -
"Seeing the Big through the Small": Can LLMs Approximate Human Judgment Distributions on NLI from a Few Explanations?
par: Chen, Beiduo, et autres
Publié: (2024) -
Enhancing Reasoning Abilities of Small LLMs with Cognitive Alignment
par: Cai, Wenrui, et autres
Publié: (2025) -
From Implicit to Explicit: Token-Efficient Logical Supervision for Mathematical Reasoning in LLMs
par: Wang, Shaojie, et autres
Publié: (2026) -
Refining Positive and Toxic Samples for Dual Safety Self-Alignment of LLMs with Minimal Human Interventions
par: Xu, Jingxin, et autres
Publié: (2025)