PoliticsBench: Benchmarking Political Values in Large Language Models with Multi-Turn Roleplay
Fuente:
arXiv
Guardado en:
| Autores principales: | Khetan, Rohan, Khetan, Ashna |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DEFT: Data Efficient Fine-Tuning for Pre-Trained Language Models via Unsupervised Core-Set Selection
por: Das, Devleena, et al.
Publicado: (2023)
por: Das, Devleena, et al.
Publicado: (2023)
Beyond One-Size-Fits-All: Multi-Domain, Multi-Task Framework for Embedding Model Selection
por: Khetan, Vivek
Publicado: (2024)
por: Khetan, Vivek
Publicado: (2024)
Political-LLM: Large Language Models in Political Science
por: Li, Lincan, et al.
Publicado: (2024)
por: Li, Lincan, et al.
Publicado: (2024)
MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
por: Bai, Ge, et al.
Publicado: (2024)
por: Bai, Ge, et al.
Publicado: (2024)
PPLqa: An Unsupervised Information-Theoretic Quality Metric for Comparing Generative Large Language Models
por: Friedland, Gerald, et al.
Publicado: (2024)
por: Friedland, Gerald, et al.
Publicado: (2024)
JMedEthicBench: A Multi-Turn Conversational Benchmark for Evaluating Medical Safety in Japanese Large Language Models
por: Liu, Junyu, et al.
Publicado: (2026)
por: Liu, Junyu, et al.
Publicado: (2026)
Human-AI Collaborative Taxonomy Construction: A Case Study in Profession-Specific Writing Assistants
por: Lee, Minhwa, et al.
Publicado: (2024)
por: Lee, Minhwa, et al.
Publicado: (2024)
MTMCS-Bench: Evaluating Contextual Safety of Multimodal Large Language Models in Multi-Turn Dialogues
por: Liu, Zheyuan, et al.
Publicado: (2026)
por: Liu, Zheyuan, et al.
Publicado: (2026)
Grounding Gaps in Language Model Generations
por: Shaikh, Omar, et al.
Publicado: (2023)
por: Shaikh, Omar, et al.
Publicado: (2023)
Assessing Political Bias in Large Language Models
por: Rettenberger, Luca, et al.
Publicado: (2024)
por: Rettenberger, Luca, et al.
Publicado: (2024)
Benchmarking Gender and Political Bias in Large Language Models
por: Yang, Jinrui, et al.
Publicado: (2025)
por: Yang, Jinrui, et al.
Publicado: (2025)
SafeDialBench: A Fine-Grained Safety Evaluation Benchmark for Large Language Models in Multi-Turn Dialogues with Diverse Jailbreak Attacks
por: Cao, Hongye, et al.
Publicado: (2025)
por: Cao, Hongye, et al.
Publicado: (2025)
Political Compass or Spinning Arrow? Towards More Meaningful Evaluations for Values and Opinions in Large Language Models
por: Röttger, Paul, et al.
Publicado: (2024)
por: Röttger, Paul, et al.
Publicado: (2024)
Benchmarking Multi-National Value Alignment for Large Language Models
por: Shi, Weijie, et al.
Publicado: (2025)
por: Shi, Weijie, et al.
Publicado: (2025)
OR-Bench: An Over-Refusal Benchmark for Large Language Models
por: Cui, Justin, et al.
Publicado: (2024)
por: Cui, Justin, et al.
Publicado: (2024)
StoryBench: A Dynamic Benchmark for Evaluating Long-Term Memory with Multi Turns
por: Wan, Luanbo, et al.
Publicado: (2025)
por: Wan, Luanbo, et al.
Publicado: (2025)
Beyond Single-Turn: A Survey on Multi-Turn Interactions with Large Language Models
por: Li, Yubo, et al.
Publicado: (2025)
por: Li, Yubo, et al.
Publicado: (2025)
ChartEditBench: Evaluating Grounded Multi-Turn Chart Editing in Multimodal Language Models
por: Kapadnis, Manav Nitin, et al.
Publicado: (2026)
por: Kapadnis, Manav Nitin, et al.
Publicado: (2026)
TaskBench: Benchmarking Large Language Models for Task Automation
por: Shen, Yongliang, et al.
Publicado: (2023)
por: Shen, Yongliang, et al.
Publicado: (2023)
Large Language Models in Politics and Democracy: A Comprehensive Survey
por: Aoki, Goshi
Publicado: (2024)
por: Aoki, Goshi
Publicado: (2024)
LocalValueBench: A Collaboratively Built and Extensible Benchmark for Evaluating Localized Value Alignment and Ethical Safety in Large Language Models
por: Meadows, Gwenyth Isobel, et al.
Publicado: (2024)
por: Meadows, Gwenyth Isobel, et al.
Publicado: (2024)
TurkBench: A Benchmark for Evaluating Turkish Large Language Models
por: Toraman, Çağrı, et al.
Publicado: (2026)
por: Toraman, Çağrı, et al.
Publicado: (2026)
Examining the Influence of Political Bias on Large Language Model Performance in Stance Classification
por: Ng, Lynnette Hui Xian, et al.
Publicado: (2024)
por: Ng, Lynnette Hui Xian, et al.
Publicado: (2024)
Measuring Political Bias in Large Language Models: What Is Said and How It Is Said
por: Bang, Yejin, et al.
Publicado: (2024)
por: Bang, Yejin, et al.
Publicado: (2024)
Mapping and Influencing the Political Ideology of Large Language Models using Synthetic Personas
por: Bernardelle, Pietro, et al.
Publicado: (2024)
por: Bernardelle, Pietro, et al.
Publicado: (2024)
DarkBench: Benchmarking Dark Patterns in Large Language Models
por: Kran, Esben, et al.
Publicado: (2025)
por: Kran, Esben, et al.
Publicado: (2025)
IrokoBench: A New Benchmark for African Languages in the Age of Large Language Models
por: Adelani, David Ifeoluwa, et al.
Publicado: (2024)
por: Adelani, David Ifeoluwa, et al.
Publicado: (2024)
BacktestBench: Benchmarking Large Language Models for Automated Quantitative Strategy Backtesting
por: Wang, Zhensheng, et al.
Publicado: (2026)
por: Wang, Zhensheng, et al.
Publicado: (2026)
SproutBench: A Benchmark for Safe and Ethical Large Language Models for Youth
por: Xing, Wenpeng, et al.
Publicado: (2025)
por: Xing, Wenpeng, et al.
Publicado: (2025)
EmoBench-M: Benchmarking Emotional Intelligence for Multimodal Large Language Models
por: Hu, He, et al.
Publicado: (2025)
por: Hu, He, et al.
Publicado: (2025)
VerifyBench: Benchmarking Reference-based Reward Systems for Large Language Models
por: Yan, Yuchen, et al.
Publicado: (2025)
por: Yan, Yuchen, et al.
Publicado: (2025)
CASE-Bench: Context-Aware SafEty Benchmark for Large Language Models
por: Sun, Guangzhi, et al.
Publicado: (2025)
por: Sun, Guangzhi, et al.
Publicado: (2025)
Debiasing Large Language Models in Thai Political Stance Detection via Counterfactual Calibration
por: Sermsri, Kasidit, et al.
Publicado: (2025)
por: Sermsri, Kasidit, et al.
Publicado: (2025)
Examining Alignment of Large Language Models through Representative Heuristics: The Case of Political Stereotypes
por: Jeoung, Sullam, et al.
Publicado: (2025)
por: Jeoung, Sullam, et al.
Publicado: (2025)
Fine-Grained Interpretation of Political Opinions in Large Language Models
por: Hu, Jingyu, et al.
Publicado: (2025)
por: Hu, Jingyu, et al.
Publicado: (2025)
On the Relationship between Truth and Political Bias in Language Models
por: Fulay, Suyash, et al.
Publicado: (2024)
por: Fulay, Suyash, et al.
Publicado: (2024)
The Polite Liar: Epistemic Pathology in Language Models
por: DeVilling, Bentley
Publicado: (2025)
por: DeVilling, Bentley
Publicado: (2025)
VLegal-Bench: Cognitively Grounded Benchmark for Vietnamese Legal Reasoning of Large Language Models
por: Dong, Nguyen Tien, et al.
Publicado: (2025)
por: Dong, Nguyen Tien, et al.
Publicado: (2025)
JailBench: A Comprehensive Chinese Security Assessment Benchmark for Large Language Models
por: Liu, Shuyi, et al.
Publicado: (2025)
por: Liu, Shuyi, et al.
Publicado: (2025)
OphthBench: A Comprehensive Benchmark for Evaluating Large Language Models in Chinese Ophthalmology
por: Zhou, Chengfeng, et al.
Publicado: (2025)
por: Zhou, Chengfeng, et al.
Publicado: (2025)
Ejemplares similares
-
DEFT: Data Efficient Fine-Tuning for Pre-Trained Language Models via Unsupervised Core-Set Selection
por: Das, Devleena, et al.
Publicado: (2023) -
Beyond One-Size-Fits-All: Multi-Domain, Multi-Task Framework for Embedding Model Selection
por: Khetan, Vivek
Publicado: (2024) -
Political-LLM: Large Language Models in Political Science
por: Li, Lincan, et al.
Publicado: (2024) -
MT-Bench-101: A Fine-Grained Benchmark for Evaluating Large Language Models in Multi-Turn Dialogues
por: Bai, Ge, et al.
Publicado: (2024) -
PPLqa: An Unsupervised Information-Theoretic Quality Metric for Comparing Generative Large Language Models
por: Friedland, Gerald, et al.
Publicado: (2024)