FINEST: Improving LLM Responses to Sensitive Topics Through Fine-Grained Evaluation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Oh, Juhyun, Lee, Nayeon, Jung, Chani, Jin, Jiho, Myung, Junho, Lee, Jongwon, Song, Taeui, Oh, Alice |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exploring Cross-Cultural Differences in English Hate Speech Annotations: From Dataset Construction to Analysis
par: Lee, Nayeon, et autres
Publié: (2023)
par: Lee, Nayeon, et autres
Publié: (2023)
RoleConflictBench: A Benchmark of Role Conflict Scenarios for Evaluating LLMs' Contextual Sensitivity
par: Shin, Jisu, et autres
Publié: (2025)
par: Shin, Jisu, et autres
Publié: (2025)
JuICE: A Benchmark for Evaluating LLM-Judge in Identifying Cultural Errors
par: Jin, Jiho, et autres
Publié: (2026)
par: Jin, Jiho, et autres
Publié: (2026)
Social Bias Benchmark for Generation: A Comparison of Generation and QA-Based Evaluations
par: Jin, Jiho, et autres
Publié: (2025)
par: Jin, Jiho, et autres
Publié: (2025)
KoBBQ: Korean Bias Benchmark for Question Answering
par: Jin, Jiho, et autres
Publié: (2023)
par: Jin, Jiho, et autres
Publié: (2023)
Flex-TravelPlanner: A Benchmark for Flexible Planning with Language Agents
par: Oh, Juhyun, et autres
Publié: (2025)
par: Oh, Juhyun, et autres
Publié: (2025)
OLA: Output Language Alignment in Code-Switched LLM Interactions
par: Oh, Juhyun, et autres
Publié: (2026)
par: Oh, Juhyun, et autres
Publié: (2026)
The Generative AI Paradox on Evaluation: What It Can Solve, It May Not Evaluate
par: Oh, Juhyun, et autres
Publié: (2024)
par: Oh, Juhyun, et autres
Publié: (2024)
Perceptions to Beliefs: Exploring Precursory Inferences for Theory of Mind in Large Language Models
par: Jung, Chani, et autres
Publié: (2024)
par: Jung, Chani, et autres
Publié: (2024)
Spotting Out-of-Character Behavior: Atomic-Level Evaluation of Persona Fidelity in Open-Ended Generation
par: Shin, Jisu, et autres
Publié: (2025)
par: Shin, Jisu, et autres
Publié: (2025)
Multi-FAct: Assessing Factuality of Multilingual LLMs using FActScore
par: Shafayat, Sheikh, et autres
Publié: (2024)
par: Shafayat, Sheikh, et autres
Publié: (2024)
Entangled in Representations: Mechanistic Investigation of Cultural Biases in Large Language Models
par: Yu, Haeun, et autres
Publié: (2025)
par: Yu, Haeun, et autres
Publié: (2025)
PapersPlease: A Benchmark for Evaluating Motivational Values of Large Language Models Based on ERG Theory
par: Myung, Junho, et autres
Publié: (2025)
par: Myung, Junho, et autres
Publié: (2025)
Culture is Everywhere: A Call for Intentionally Cultural Evaluation
par: Oh, Juhyun, et autres
Publié: (2025)
par: Oh, Juhyun, et autres
Publié: (2025)
FINEST: Stabilizing Recommendations by Rank-Preserving Fine-Tuning
par: Oh, Sejoon, et autres
Publié: (2024)
par: Oh, Sejoon, et autres
Publié: (2024)
LLM-as-a-tutor in EFL Writing Education: Focusing on Evaluation of Student-LLM Interaction
par: Han, Jieun, et autres
Publié: (2023)
par: Han, Jieun, et autres
Publié: (2023)
Shared Heritage, Distinct Writing: Rethinking Resource Selection for East Asian Historical Documents
par: Song, Seyoung, et autres
Publié: (2024)
par: Song, Seyoung, et autres
Publié: (2024)
HERITAGE: An End-to-End Web Platform for Processing Korean Historical Documents in Hanja
par: Song, Seyoung, et autres
Publié: (2025)
par: Song, Seyoung, et autres
Publié: (2025)
DiTTO-LLM: Framework for Discovering Topic-based Technology Opportunities via Large Language Model
par: Kim, Wonyoung, et autres
Publié: (2025)
par: Kim, Wonyoung, et autres
Publié: (2025)
Are they lovers or friends? Evaluating LLMs' Social Reasoning in English and Korean Dialogues
par: Kim, Eunsu, et autres
Publié: (2025)
par: Kim, Eunsu, et autres
Publié: (2025)
Uncovering Factor Level Preferences to Improve Human-Model Alignment
par: Oh, Juhyun, et autres
Publié: (2024)
par: Oh, Juhyun, et autres
Publié: (2024)
Code-Switching In-Context Learning for Cross-Lingual Transfer of Large Language Models
par: Yoo, Haneul, et autres
Publié: (2025)
par: Yoo, Haneul, et autres
Publié: (2025)
Survey of Cultural Awareness in Language Models: Text and Beyond
par: Pawar, Siddhesh, et autres
Publié: (2024)
par: Pawar, Siddhesh, et autres
Publié: (2024)
ChEDDAR: Student-ChatGPT Dialogue in EFL Writing Education
par: Han, Jieun, et autres
Publié: (2023)
par: Han, Jieun, et autres
Publié: (2023)
RECIPE4U: Student-ChatGPT Interaction Dataset in EFL Writing Education
par: Han, Jieun, et autres
Publié: (2024)
par: Han, Jieun, et autres
Publié: (2024)
MUG-Eval: A Proxy Evaluation Framework for Multilingual Generation Capabilities in Any Language
par: Song, Seyoung, et autres
Publié: (2025)
par: Song, Seyoung, et autres
Publié: (2025)
When Scaffolding Breaks: Investigating Student Interaction with LLM-Based Writing Support in Real-Time K-12 EFL Classrooms
par: Myung, Junho, et autres
Publié: (2025)
par: Myung, Junho, et autres
Publié: (2025)
LoCar: Localization-Aware Evaluation of In-Vehicle Assistants through Fine-Grained Sociolinguistic Control
par: Jeong, Seogyeong, et autres
Publié: (2026)
par: Jeong, Seogyeong, et autres
Publié: (2026)
LLM-C3MOD: A Human-LLM Collaborative System for Cross-Cultural Hate Speech Moderation
par: Park, Junyeong, et autres
Publié: (2025)
par: Park, Junyeong, et autres
Publié: (2025)
Learning to Verify Summary Facts with Fine-Grained LLM Feedback
par: Oh, Jihwan, et autres
Publié: (2024)
par: Oh, Jihwan, et autres
Publié: (2024)
LLM-as-an-Interviewer: Beyond Static Testing Through Dynamic LLM Evaluation
par: Kim, Eunsu, et autres
Publié: (2024)
par: Kim, Eunsu, et autres
Publié: (2024)
How to Correctly Report LLM-as-a-Judge Evaluations
par: Lee, Chungpa, et autres
Publié: (2025)
par: Lee, Chungpa, et autres
Publié: (2025)
CORAL: Adaptive Retrieval Loop for Culturally-Aligned Multilingual RAG
par: Lee, Nayeon, et autres
Publié: (2026)
par: Lee, Nayeon, et autres
Publié: (2026)
Topic-VQ-VAE: Leveraging Latent Codebooks for Flexible Topic-Guided Document Generation
par: Yoo, YoungJoon, et autres
Publié: (2023)
par: Yoo, YoungJoon, et autres
Publié: (2023)
GoodPoint: Learning Constructive Scientific Paper Feedback from Author Responses
par: Mun, Jimin, et autres
Publié: (2026)
par: Mun, Jimin, et autres
Publié: (2026)
Translating Hanja Historical Documents to Contemporary Korean and English
par: Son, Juhee, et autres
Publié: (2022)
par: Son, Juhee, et autres
Publié: (2022)
Open Korean Historical Corpus: A Millennia-Scale Diachronic Collection of Public Domain Texts
par: Song, Seyoung, et autres
Publié: (2025)
par: Song, Seyoung, et autres
Publié: (2025)
Not What, But How: A Communicative Audit of LLM Response Framing
par: Pawar, Siddhesh Milind, et autres
Publié: (2026)
par: Pawar, Siddhesh Milind, et autres
Publié: (2026)
Frequency Response Data-Driven Disturbance Observer Design for Flexible Joint Robots
par: Lee, Deokjin, et autres
Publié: (2025)
par: Lee, Deokjin, et autres
Publié: (2025)
LEGO-Eval: Towards Fine-Grained Evaluation on Synthesizing 3D Embodied Environments with Tool Augmentation
par: Hwangbo, Gyeom, et autres
Publié: (2025)
par: Hwangbo, Gyeom, et autres
Publié: (2025)
Documents similaires
-
Exploring Cross-Cultural Differences in English Hate Speech Annotations: From Dataset Construction to Analysis
par: Lee, Nayeon, et autres
Publié: (2023) -
RoleConflictBench: A Benchmark of Role Conflict Scenarios for Evaluating LLMs' Contextual Sensitivity
par: Shin, Jisu, et autres
Publié: (2025) -
JuICE: A Benchmark for Evaluating LLM-Judge in Identifying Cultural Errors
par: Jin, Jiho, et autres
Publié: (2026) -
Social Bias Benchmark for Generation: A Comparison of Generation and QA-Based Evaluations
par: Jin, Jiho, et autres
Publié: (2025) -
KoBBQ: Korean Bias Benchmark for Question Answering
par: Jin, Jiho, et autres
Publié: (2023)