XChoice: Explainable Evaluation of AI-Human Alignment in LLM-based Constrained Choice Decision Making
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Qi, Weihong, Huang, Fan, Muralidharan, Rasika, An, Jisun, Kwak, Haewoon |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Can Lessons From Human Teams Be Applied to Multi-Agent Systems? The Role of Structure, Diversity, and Interaction Dynamics
par: Muralidharan, Rasika, et autres
Publié: (2025)
par: Muralidharan, Rasika, et autres
Publié: (2025)
Understanding Moral Reasoning Trajectories in Large Language Models: Toward Probing-Based Explainability
par: Huang, Fan, et autres
Publié: (2026)
par: Huang, Fan, et autres
Publié: (2026)
ToBlend: Token-Level Blending With an Ensemble of LLMs to Attack AI-Generated Text Detection
par: Huang, Fan, et autres
Publié: (2024)
par: Huang, Fan, et autres
Publié: (2024)
Vulnerability of LLMs' Stated Beliefs? LLMs Belief Resistance Check Through Strategic Persuasive Conversation Interventions
par: Huang, Fan, et autres
Publié: (2026)
par: Huang, Fan, et autres
Publié: (2026)
PluRule: A Benchmark for Moderating Pluralistic Communities on Social Media
par: Kachwala, Zoher, et autres
Publié: (2026)
par: Kachwala, Zoher, et autres
Publié: (2026)
ChatGPT Rates Natural Language Explanation Quality Like Humans: But on Which Scales?
par: Huang, Fan, et autres
Publié: (2024)
par: Huang, Fan, et autres
Publié: (2024)
A Cross-Cultural Comparison of LLM-based Public Opinion Simulation: Evaluating Chinese and U.S. Models on Diverse Societies
par: Qi, Weihong, et autres
Publié: (2025)
par: Qi, Weihong, et autres
Publié: (2025)
CogBias: Measuring and Mitigating Cognitive Bias in Large Language Models
par: Huang, Fan, et autres
Publié: (2026)
par: Huang, Fan, et autres
Publié: (2026)
Can we trust the evaluation on ChatGPT?
par: Aiyappa, Rachith, et autres
Publié: (2023)
par: Aiyappa, Rachith, et autres
Publié: (2023)
Benchmarking zero-shot stance detection with FlanT5-XXL: Insights from training data, prompting, and decoding strategies into its near-SoTA performance
par: Aiyappa, Rachith, et autres
Publié: (2024)
par: Aiyappa, Rachith, et autres
Publié: (2024)
Human-Alignment Influences the Utility of AI-assisted Decision Making
par: Benz, Nina L. Corvelo, et autres
Publié: (2025)
par: Benz, Nina L. Corvelo, et autres
Publié: (2025)
The Moral Turing Test: Evaluating Human-LLM Alignment in Moral Decision-Making
par: Garcia, Basile, et autres
Publié: (2024)
par: Garcia, Basile, et autres
Publié: (2024)
LLM Voting: Human Choices and AI Collective Decision Making
par: Yang, Joshua C., et autres
Publié: (2024)
par: Yang, Joshua C., et autres
Publié: (2024)
Towards Human-AI Deliberation: Design and Evaluation of LLM-Empowered Deliberative AI for AI-Assisted Decision-Making
par: Ma, Shuai, et autres
Publié: (2024)
par: Ma, Shuai, et autres
Publié: (2024)
When AI Persuades: Adversarial Explanation Attacks on Human Trust in AI-Assisted Decision Making
par: Fan, Shutong, et autres
Publié: (2026)
par: Fan, Shutong, et autres
Publié: (2026)
Classical AI vs. LLMs for Decision-Maker Alignment in Health Insurance Choices
par: Mainali, Mallika, et autres
Publié: (2025)
par: Mainali, Mallika, et autres
Publié: (2025)
Agentic AI for Autonomous, Explainable, and Real-Time Credit Risk Decision-Making
par: Kubam, Chandra Sekhar
Publié: (2025)
par: Kubam, Chandra Sekhar
Publié: (2025)
Enhancing Regional Airbnb Trend Forecasting Using LLM-Based Embeddings of Accessibility and Human Mobility
par: Lee, Hongju, et autres
Publié: (2025)
par: Lee, Hongju, et autres
Publié: (2025)
ALIGN: Prompt-based Attribute Alignment for Reliable, Responsible, and Personalized LLM-based Decision-Making
par: Ravichandran, Bharadwaj, et autres
Publié: (2025)
par: Ravichandran, Bharadwaj, et autres
Publié: (2025)
Trustworthy and Explainable Decision-Making for Workforce allocation
par: Povéda, Guillaume, et autres
Publié: (2024)
par: Povéda, Guillaume, et autres
Publié: (2024)
Evaluating Human Alignment and Model Faithfulness of LLM Rationale
par: Fayyaz, Mohsen, et autres
Publié: (2024)
par: Fayyaz, Mohsen, et autres
Publié: (2024)
Holistic Explainable AI (H-XAI): Extending Transparency Beyond Developers in AI-Driven Decision Making
par: Lakkaraju, Kausik, et autres
Publié: (2025)
par: Lakkaraju, Kausik, et autres
Publié: (2025)
On Evaluating Explanation Utility for Human-AI Decision Making in NLP
par: Chaleshtori, Fateme Hashemi, et autres
Publié: (2024)
par: Chaleshtori, Fateme Hashemi, et autres
Publié: (2024)
Simulating Life Paths with Digital Twins: AI-Generated Future Selves Influence Decision-Making and Expand Human Choice
par: Poonsiriwong, Rachel, et autres
Publié: (2025)
par: Poonsiriwong, Rachel, et autres
Publié: (2025)
LLM-Based World Models Can Make Decisions Solely, But Rigorous Evaluations are Needed
par: Yang, Chang, et autres
Publié: (2024)
par: Yang, Chang, et autres
Publié: (2024)
GPTree: Towards Explainable Decision-Making via LLM-powered Decision Trees
par: Xiong, Sichao, et autres
Publié: (2024)
par: Xiong, Sichao, et autres
Publié: (2024)
Measuring Error Alignment for Decision-Making Systems
par: Xu, Binxia, et autres
Publié: (2024)
par: Xu, Binxia, et autres
Publié: (2024)
Rematch: Robust and Efficient Matching of Local Knowledge Graphs to Improve Structural and Semantic Similarity
par: Kachwala, Zoher, et autres
Publié: (2024)
par: Kachwala, Zoher, et autres
Publié: (2024)
Somatic in the East, Psychological in the West?: Investigating Clinically-Grounded Cross-Cultural Depression Symptom Expression in LLMs
par: Sakai, Shintaro, et autres
Publié: (2025)
par: Sakai, Shintaro, et autres
Publié: (2025)
Quantifying Gender Stereotypes in Japan between 1900 and 1999 with Word Embeddings
par: Sakai, Shintaro, et autres
Publié: (2025)
par: Sakai, Shintaro, et autres
Publié: (2025)
Interpretable and Explainable Surrogate Modeling for Simulations: A State-of-the-Art Survey and Perspectives on Explainable AI for Decision-Making
par: Palar, Pramudita Satria, et autres
Publié: (2026)
par: Palar, Pramudita Satria, et autres
Publié: (2026)
Human Decision-Making with Persuasive and Narrative LLM Explanations
par: Marusich, Laura R., et autres
Publié: (2026)
par: Marusich, Laura R., et autres
Publié: (2026)
Trustworthy and Responsible AI for Human-Centric Autonomous Decision-Making Systems
par: Dehghani, Farzaneh, et autres
Publié: (2024)
par: Dehghani, Farzaneh, et autres
Publié: (2024)
Argumentative Human-AI Decision-Making: Toward AI Agents That Reason With Us, Not For Us
par: Vasileiou, Stylianos Loukas, et autres
Publié: (2026)
par: Vasileiou, Stylianos Loukas, et autres
Publié: (2026)
12 Angry AI Agents: Evaluating Multi-Agent LLM Decision-Making Through Cinematic Jury Deliberation
par: Ersoz, Ahmet Bahaddin
Publié: (2026)
par: Ersoz, Ahmet Bahaddin
Publié: (2026)
The Impact of Imperfect XAI on Human-AI Decision-Making
par: Morrison, Katelyn, et autres
Publié: (2023)
par: Morrison, Katelyn, et autres
Publié: (2023)
The Effect of Explainable AI-based Decision Support on Human Task Performance: A Meta-Analysis
par: Haag, Felix
Publié: (2025)
par: Haag, Felix
Publié: (2025)
DAO-AI: Evaluating Collective Decision-Making through Agentic AI in Decentralized Governance
par: Capponi, Agostino, et autres
Publié: (2025)
par: Capponi, Agostino, et autres
Publié: (2025)
Explainable AI for Ship Collision Avoidance: Decoding Decision-Making Processes and Behavioral Intentions
par: Yoshioka, Hitoshi, et autres
Publié: (2024)
par: Yoshioka, Hitoshi, et autres
Publié: (2024)
Evaluating LLM Alignment With Human Trust Models
par: Debnath, Anushka, et autres
Publié: (2026)
par: Debnath, Anushka, et autres
Publié: (2026)
Documents similaires
-
Can Lessons From Human Teams Be Applied to Multi-Agent Systems? The Role of Structure, Diversity, and Interaction Dynamics
par: Muralidharan, Rasika, et autres
Publié: (2025) -
Understanding Moral Reasoning Trajectories in Large Language Models: Toward Probing-Based Explainability
par: Huang, Fan, et autres
Publié: (2026) -
ToBlend: Token-Level Blending With an Ensemble of LLMs to Attack AI-Generated Text Detection
par: Huang, Fan, et autres
Publié: (2024) -
Vulnerability of LLMs' Stated Beliefs? LLMs Belief Resistance Check Through Strategic Persuasive Conversation Interventions
par: Huang, Fan, et autres
Publié: (2026) -
PluRule: A Benchmark for Moderating Pluralistic Communities on Social Media
par: Kachwala, Zoher, et autres
Publié: (2026)