Value Entanglement: Conflation Between Different Kinds of Good In (Some) Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Cho, Seong Hah, Li, Junyi, Leshinskaya, Anna |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Subjective $\textit{Isms}$? On the Danger of Conflating Hate and Offence in Abusive Language Detection
di: Curry, Amanda Cercas, et al.
Pubblicazione: (2024)
di: Curry, Amanda Cercas, et al.
Pubblicazione: (2024)
Are Large Language Models Good Statisticians?
di: Zhu, Yizhang, et al.
Pubblicazione: (2024)
di: Zhu, Yizhang, et al.
Pubblicazione: (2024)
Are Large Language Models Good Prompt Optimizers?
di: Ma, Ruotian, et al.
Pubblicazione: (2024)
di: Ma, Ruotian, et al.
Pubblicazione: (2024)
Inertia in Moral and Value Judgments of Large Language Models
di: Lee, Bruce W., et al.
Pubblicazione: (2024)
di: Lee, Bruce W., et al.
Pubblicazione: (2024)
Are Large Language Models Good at Detecting Propaganda?
di: Jose, Julia, et al.
Pubblicazione: (2025)
di: Jose, Julia, et al.
Pubblicazione: (2025)
Ask Good Questions for Large Language Models
di: Wu, Qi, et al.
Pubblicazione: (2025)
di: Wu, Qi, et al.
Pubblicazione: (2025)
Just Go Parallel: Improving the Multilingual Capabilities of Large Language Models
di: Qorib, Muhammad Reza, et al.
Pubblicazione: (2025)
di: Qorib, Muhammad Reza, et al.
Pubblicazione: (2025)
The Pluralistic Moral Gap: Understanding Judgment and Value Differences between Humans and Large Language Models
di: Russo, Giuseppe, et al.
Pubblicazione: (2025)
di: Russo, Giuseppe, et al.
Pubblicazione: (2025)
Are Large Language Models Good Essay Graders?
di: Kundu, Anindita, et al.
Pubblicazione: (2024)
di: Kundu, Anindita, et al.
Pubblicazione: (2024)
What Kind of Reasoning (if any) is an LLM actually doing? On the Stochastic Nature and Abductive Appearance of Large Language Models
di: Floridi, Luciano, et al.
Pubblicazione: (2025)
di: Floridi, Luciano, et al.
Pubblicazione: (2025)
SPRI: Aligning Large Language Models with Context-Situated Principles
di: Zhan, Hongli, et al.
Pubblicazione: (2025)
di: Zhan, Hongli, et al.
Pubblicazione: (2025)
Reasoning Models Hallucinate More: Factuality-Aware Reinforcement Learning for Large Reasoning Models
di: Li, Junyi, et al.
Pubblicazione: (2025)
di: Li, Junyi, et al.
Pubblicazione: (2025)
Large Language Models Are Effective Human Annotation Assistants, But Not Good Independent Annotators
di: Gu, Feng, et al.
Pubblicazione: (2025)
di: Gu, Feng, et al.
Pubblicazione: (2025)
Preference Packing: Efficient Preference Optimization for Large Language Models
di: Cho, Jaekyung
Pubblicazione: (2026)
di: Cho, Jaekyung
Pubblicazione: (2026)
Large Language Models Produce Responses Perceived to be Empathic
di: Lee, Yoon Kyung, et al.
Pubblicazione: (2024)
di: Lee, Yoon Kyung, et al.
Pubblicazione: (2024)
Are Large Language Models a Good Replacement of Taxonomies?
di: Sun, Yushi, et al.
Pubblicazione: (2024)
di: Sun, Yushi, et al.
Pubblicazione: (2024)
Large Language Model Is Not a Good Few-shot Information Extractor, but a Good Reranker for Hard Samples!
di: Ma, Yubo, et al.
Pubblicazione: (2023)
di: Ma, Yubo, et al.
Pubblicazione: (2023)
Why Larger Language Models Do In-context Learning Differently?
di: Shi, Zhenmei, et al.
Pubblicazione: (2024)
di: Shi, Zhenmei, et al.
Pubblicazione: (2024)
Large Language Models are Good Relational Learners
di: Wu, Fang, et al.
Pubblicazione: (2025)
di: Wu, Fang, et al.
Pubblicazione: (2025)
Confabulation: The Surprising Value of Large Language Model Hallucinations
di: Sui, Peiqi, et al.
Pubblicazione: (2024)
di: Sui, Peiqi, et al.
Pubblicazione: (2024)
Prompt-Based Value Steering of Large Language Models
di: Abbo, Giulio Antonio, et al.
Pubblicazione: (2025)
di: Abbo, Giulio Antonio, et al.
Pubblicazione: (2025)
Incentivizing Dual Process Thinking for Efficient Large Language Model Reasoning
di: Cheng, Xiaoxue, et al.
Pubblicazione: (2025)
di: Cheng, Xiaoxue, et al.
Pubblicazione: (2025)
Are Large Language Models Good In-context Learners for Financial Sentiment Analysis?
di: Wei, Xinyu, et al.
Pubblicazione: (2025)
di: Wei, Xinyu, et al.
Pubblicazione: (2025)
Efficient Shapley Value-based Non-Uniform Pruning of Large Language Models
di: Sun, Chuan, et al.
Pubblicazione: (2025)
di: Sun, Chuan, et al.
Pubblicazione: (2025)
Diverse Human Value Alignment for Large Language Models via Ethical Reasoning
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
di: Wang, Jiahao, et al.
Pubblicazione: (2025)
Are Large Language Models Really Good Logical Reasoners? A Comprehensive Evaluation and Beyond
di: Xu, Fangzhi, et al.
Pubblicazione: (2023)
di: Xu, Fangzhi, et al.
Pubblicazione: (2023)
Large Language Models "Ad Referendum": How Good Are They at Machine Translation in the Legal Domain?
di: Briva-Iglesias, Vicent, et al.
Pubblicazione: (2024)
di: Briva-Iglesias, Vicent, et al.
Pubblicazione: (2024)
Set-Valued Prediction for Large Language Models with Feasibility-Aware Coverage Guarantees
di: Li, Ye, et al.
Pubblicazione: (2026)
di: Li, Ye, et al.
Pubblicazione: (2026)
Probing Ethical Framework Representations in Large Language Models: Structure, Entanglement, and Methodological Challenges
di: Xu, Weilun, et al.
Pubblicazione: (2026)
di: Xu, Weilun, et al.
Pubblicazione: (2026)
Benchmarking Multi-National Value Alignment for Large Language Models
di: Shi, Weijie, et al.
Pubblicazione: (2025)
di: Shi, Weijie, et al.
Pubblicazione: (2025)
Are Large Language Models Consistent over Value-laden Questions?
di: Moore, Jared, et al.
Pubblicazione: (2024)
di: Moore, Jared, et al.
Pubblicazione: (2024)
High-Dimension Human Value Representation in Large Language Models
di: Cahyawijaya, Samuel, et al.
Pubblicazione: (2024)
di: Cahyawijaya, Samuel, et al.
Pubblicazione: (2024)
AfroBench: How Good are Large Language Models on African Languages?
di: Ojo, Jessica, et al.
Pubblicazione: (2023)
di: Ojo, Jessica, et al.
Pubblicazione: (2023)
Small Edits, Big Consequences: Telling Good from Bad Robustness in Large Language Models
di: Ismailov, Altynbek, et al.
Pubblicazione: (2025)
di: Ismailov, Altynbek, et al.
Pubblicazione: (2025)
Is It Good Data for Multilingual Instruction Tuning or Just Bad Multilingual Evaluation for Large Language Models?
di: Chen, Pinzhen, et al.
Pubblicazione: (2024)
di: Chen, Pinzhen, et al.
Pubblicazione: (2024)
Bad Actor, Good Advisor: Exploring the Role of Large Language Models in Fake News Detection
di: Hu, Beizhe, et al.
Pubblicazione: (2023)
di: Hu, Beizhe, et al.
Pubblicazione: (2023)
BiLD: Bi-directional Logits Difference Loss for Large Language Model Distillation
di: Li, Minchong, et al.
Pubblicazione: (2024)
di: Li, Minchong, et al.
Pubblicazione: (2024)
BiasJailbreak:Analyzing Ethical Biases and Jailbreak Vulnerabilities in Large Language Models
di: Lee, Isack, et al.
Pubblicazione: (2024)
di: Lee, Isack, et al.
Pubblicazione: (2024)
Are Large Vision Language Models Good Game Players?
di: Wang, Xinyu, et al.
Pubblicazione: (2025)
di: Wang, Xinyu, et al.
Pubblicazione: (2025)
Is Large Language Model Performance on Reasoning Tasks Impacted by Different Ways Questions Are Asked?
di: Song, Seok Hwan, et al.
Pubblicazione: (2025)
di: Song, Seok Hwan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Subjective $\textit{Isms}$? On the Danger of Conflating Hate and Offence in Abusive Language Detection
di: Curry, Amanda Cercas, et al.
Pubblicazione: (2024) -
Are Large Language Models Good Statisticians?
di: Zhu, Yizhang, et al.
Pubblicazione: (2024) -
Are Large Language Models Good Prompt Optimizers?
di: Ma, Ruotian, et al.
Pubblicazione: (2024) -
Inertia in Moral and Value Judgments of Large Language Models
di: Lee, Bruce W., et al.
Pubblicazione: (2024) -
Are Large Language Models Good at Detecting Propaganda?
di: Jose, Julia, et al.
Pubblicazione: (2025)