Auditing Stance Asymmetry in Generative Explanations
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Han, Jiarui |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Compounding Disadvantage: Auditing Intersectional Bias in LLM-Generated Explanations Across Indian and American STEM Education
par: Gupta, Amogh, et autres
Publié: (2026)
par: Gupta, Amogh, et autres
Publié: (2026)
Causal Stories from Sensor Traces: Auditing Epistemic Overreach in LLM-Generated Personal Sensing Explanations
par: Zhu, Shanshan, et autres
Publié: (2026)
par: Zhu, Shanshan, et autres
Publié: (2026)
Politics of Questions in News: A Mixed-Methods Study of Interrogative Stances as Markers of Voice and Power
par: Victor, Bros, et autres
Publié: (2026)
par: Victor, Bros, et autres
Publié: (2026)
Verifying Rumors via Stance-Aware Structural Modeling
par: Nkhata, Gibson, et autres
Publié: (2025)
par: Nkhata, Gibson, et autres
Publié: (2025)
Auditing Agent Harness Safety
par: Liu, Chengzhi, et autres
Publié: (2026)
par: Liu, Chengzhi, et autres
Publié: (2026)
MemeCraft: Contextual and Stance-Driven Multimodal Meme Generation
par: Wang, Han, et autres
Publié: (2024)
par: Wang, Han, et autres
Publié: (2024)
TATA: Stance Detection via Topic-Agnostic and Topic-Aware Embeddings
par: Hanley, Hans W. A., et autres
Publié: (2023)
par: Hanley, Hans W. A., et autres
Publié: (2023)
Boundary Suppression Asymmetry in Post-trained Assistants: Over-expansion as a Controllability Cost
par: Han, Jiarui
Publié: (2026)
par: Han, Jiarui
Publié: (2026)
Evaluating LLM-Generated Legal Explanations for Regulatory Compliance in Social Media Influencer Marketing
par: Gui, Haoyang, et autres
Publié: (2025)
par: Gui, Haoyang, et autres
Publié: (2025)
Beyond the Safety Bundle: Auditing the Helpful and Harmless Dataset
par: Chehbouni, Khaoula, et autres
Publié: (2024)
par: Chehbouni, Khaoula, et autres
Publié: (2024)
AuditWen:An Open-Source Large Language Model for Audit
par: Huang, Jiajia, et autres
Publié: (2024)
par: Huang, Jiajia, et autres
Publié: (2024)
From Argumentation to Deliberation: Perspectivized Stance Vectors for Fine-grained (Dis)agreement Analysis
par: Plenz, Moritz, et autres
Publié: (2025)
par: Plenz, Moritz, et autres
Publié: (2025)
Why Should This Article Be Deleted? Transparent Stance Detection in Multilingual Wikipedia Editor Discussions
par: Kaffee, Lucie-Aimée, et autres
Publié: (2023)
par: Kaffee, Lucie-Aimée, et autres
Publié: (2023)
When AI Takes Sides on Questions of Faith: Persistent Asymmetries in AI-Mediated Faith Guidance
par: Israelsen, Brett, et autres
Publié: (2026)
par: Israelsen, Brett, et autres
Publié: (2026)
Linguistic Uncertainty and Reply Engagement on X: A Cross-Domain Replication of the Uncertainty-Reply Asymmetry
par: Soufan, Mohamed
Publié: (2026)
par: Soufan, Mohamed
Publié: (2026)
The Silicon Ceiling: Auditing GPT's Race and Gender Biases in Hiring
par: Armstrong, Lena, et autres
Publié: (2024)
par: Armstrong, Lena, et autres
Publié: (2024)
Reading Between the Tweets: Deciphering Ideological Stances of Interconnected Mixed-Ideology Communities
par: He, Zihao, et autres
Publié: (2024)
par: He, Zihao, et autres
Publié: (2024)
The Algorithmic Caricature: Auditing LLM-Generated Political Discourse Across Crisis Events
par: Gunjan, et autres
Publié: (2026)
par: Gunjan, et autres
Publié: (2026)
Selective Explanations
par: Paes, Lucas Monteiro, et autres
Publié: (2024)
par: Paes, Lucas Monteiro, et autres
Publié: (2024)
Audit Me If You Can: Query-Efficient Active Fairness Auditing of Black-Box LLMs
par: Hartmann, David, et autres
Publié: (2026)
par: Hartmann, David, et autres
Publié: (2026)
ToXCL: A Unified Framework for Toxic Speech Detection and Explanation
par: Hoang, Nhat M., et autres
Publié: (2024)
par: Hoang, Nhat M., et autres
Publié: (2024)
Down the Toxicity Rabbit Hole: A Novel Framework to Bias Audit Large Language Models
par: Dutta, Arka, et autres
Publié: (2023)
par: Dutta, Arka, et autres
Publié: (2023)
AuditGPT: Auditing Smart Contracts with ChatGPT
par: Xia, Shihao, et autres
Publié: (2024)
par: Xia, Shihao, et autres
Publié: (2024)
White-Box Sensitivity Auditing with Steering Vectors
par: Cyberey, Hannah, et autres
Publié: (2026)
par: Cyberey, Hannah, et autres
Publié: (2026)
From prosthetic memory to prosthetic denial: Auditing whether large language models are prone to mass atrocity denialism
par: Ulloa, Roberto, et autres
Publié: (2025)
par: Ulloa, Roberto, et autres
Publié: (2025)
Stanceosaurus 2.0: Classifying Stance Towards Russian and Spanish Misinformation
par: Lavrouk, Anton, et autres
Publié: (2024)
par: Lavrouk, Anton, et autres
Publié: (2024)
Commitment Checklist: Auditing Author Commitments in Peer Review
par: Chen, Chung-Chi, et autres
Publié: (2026)
par: Chen, Chung-Chi, et autres
Publié: (2026)
Prompt-Counterfactual Explanations for Generative AI System Behavior
par: Goethals, Sofie, et autres
Publié: (2026)
par: Goethals, Sofie, et autres
Publié: (2026)
Self-Explanation in Social AI Agents
par: Basappa, Rhea, et autres
Publié: (2025)
par: Basappa, Rhea, et autres
Publié: (2025)
Limited Effectiveness of LLM-based Data Augmentation for COVID-19 Misinformation Stance Detection
par: Choi, Eun Cheol, et autres
Publié: (2025)
par: Choi, Eun Cheol, et autres
Publié: (2025)
Improving Stance Detection by Leveraging Measurement Knowledge from Social Sciences: A Case Study of Dutch Political Tweets and Traditional Gender Role Division
par: Fang, Qixiang, et autres
Publié: (2022)
par: Fang, Qixiang, et autres
Publié: (2022)
Properties and Challenges of LLM-Generated Explanations
par: Kunz, Jenny, et autres
Publié: (2024)
par: Kunz, Jenny, et autres
Publié: (2024)
MIRA: A Bilingual Benchmark for Medical Information Response Audit
par: Xu, Mengyu, et autres
Publié: (2026)
par: Xu, Mengyu, et autres
Publié: (2026)
PRISM: A Methodology for Auditing Biases in Large Language Models
par: Azzopardi, Leif, et autres
Publié: (2024)
par: Azzopardi, Leif, et autres
Publié: (2024)
DetoxLLM: A Framework for Detoxification with Explanations
par: Khondaker, Md Tawkat Islam, et autres
Publié: (2024)
par: Khondaker, Md Tawkat Islam, et autres
Publié: (2024)
Who Gets Which Message? Auditing Demographic Bias in LLM-Generated Targeted Text
par: Islam, Tunazzina
Publié: (2026)
par: Islam, Tunazzina
Publié: (2026)
Frontier Lag: A Bibliometric Audit of Capability Misrepresentation in Academic AI Evaluation
par: Gringras, David, et autres
Publié: (2026)
par: Gringras, David, et autres
Publié: (2026)
A Tale of Two Identities: An Ethical Audit of Human and AI-Crafted Personas
par: Venkit, Pranav Narayanan, et autres
Publié: (2025)
par: Venkit, Pranav Narayanan, et autres
Publié: (2025)
Evaluating Reliability Asymmetries in Chinese Factual Search and AI Answers
par: Liu, Geng, et autres
Publié: (2025)
par: Liu, Geng, et autres
Publié: (2025)
GRILE: A Benchmark for Grammar Reasoning and Explanation in Romanian LLMs
par: Dumitran, Adrian-Marius, et autres
Publié: (2025)
par: Dumitran, Adrian-Marius, et autres
Publié: (2025)
Documents similaires
-
Compounding Disadvantage: Auditing Intersectional Bias in LLM-Generated Explanations Across Indian and American STEM Education
par: Gupta, Amogh, et autres
Publié: (2026) -
Causal Stories from Sensor Traces: Auditing Epistemic Overreach in LLM-Generated Personal Sensing Explanations
par: Zhu, Shanshan, et autres
Publié: (2026) -
Politics of Questions in News: A Mixed-Methods Study of Interrogative Stances as Markers of Voice and Power
par: Victor, Bros, et autres
Publié: (2026) -
Verifying Rumors via Stance-Aware Structural Modeling
par: Nkhata, Gibson, et autres
Publié: (2025) -
Auditing Agent Harness Safety
par: Liu, Chengzhi, et autres
Publié: (2026)