Bias Mitigation or Cultural Commonsense? Evaluating LLMs with a Japanese Dataset
Fuente:
arXiv
Saved in:
| Main Authors: | Yamamoto, Taisei, Kumon, Ryoma, Bollegala, Danushka, Yanaka, Hitomi |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Neuron-Level Analysis of Cultural Understanding in Large Language Models
by: Yamamoto, Taisei, et al.
Published: (2025)
by: Yamamoto, Taisei, et al.
Published: (2025)
Analyzing the Inner Workings of Transformers in Compositional Generalization
by: Kumon, Ryoma, et al.
Published: (2025)
by: Kumon, Ryoma, et al.
Published: (2025)
Fine-Grained Analysis of Shared Syntactic Mechanisms in Language Models
by: Kumon, Ryoma, et al.
Published: (2026)
by: Kumon, Ryoma, et al.
Published: (2026)
Evaluating Structural Generalization in Neural Machine Translation
by: Kumon, Ryoma, et al.
Published: (2024)
by: Kumon, Ryoma, et al.
Published: (2024)
JBBQ: Japanese Bias Benchmark for Analyzing Social Biases in Large Language Models
by: Yanaka, Hitomi, et al.
Published: (2024)
by: Yanaka, Hitomi, et al.
Published: (2024)
Evaluating the Evaluation of Diversity in Commonsense Generation
by: Zhang, Tianhui, et al.
Published: (2025)
by: Zhang, Tianhui, et al.
Published: (2025)
Synthetic Data Generation for Training Diversified Commonsense Reasoning Models
by: Zhang, Tianhui, et al.
Published: (2026)
by: Zhang, Tianhui, et al.
Published: (2026)
Improving Diversity of Commonsense Generation by Large Language Models via In-Context Learning
by: Zhang, Tianhui, et al.
Published: (2024)
by: Zhang, Tianhui, et al.
Published: (2024)
Intersectional Bias in Japanese Large Language Models from a Contextualized Perspective
by: Yanaka, Hitomi, et al.
Published: (2025)
by: Yanaka, Hitomi, et al.
Published: (2025)
The Gaps between Pre-train and Downstream Settings in Bias Evaluation and Debiasing
by: Kaneko, Masahiro, et al.
Published: (2024)
by: Kaneko, Masahiro, et al.
Published: (2024)
In-Contextual Gender Bias Suppression for Large Language Models
by: Oba, Daisuke, et al.
Published: (2023)
by: Oba, Daisuke, et al.
Published: (2023)
LLMs Struggle with NLI for Perfect Aspect: A Cross-Linguistic Study in Chinese and Japanese
by: Lu, Jie, et al.
Published: (2025)
by: Lu, Jie, et al.
Published: (2025)
Evaluating Gender Bias in Large Language Models via Chain-of-Thought Prompting
by: Kaneko, Masahiro, et al.
Published: (2024)
by: Kaneko, Masahiro, et al.
Published: (2024)
Eagle: Ethical Dataset Given from Real Interactions
by: Kaneko, Masahiro, et al.
Published: (2024)
by: Kaneko, Masahiro, et al.
Published: (2024)
SCDTour: Embedding Axis Ordering and Merging for Interpretable Semantic Change Detection
by: Aida, Taichi, et al.
Published: (2025)
by: Aida, Taichi, et al.
Published: (2025)
A Semantic Distance Metric Learning approach for Lexical Semantic Change Detection
by: Aida, Taichi, et al.
Published: (2024)
by: Aida, Taichi, et al.
Published: (2024)
Investigating the Contextualised Word Embedding Dimensions Specified for Contextual and Temporal Semantic Changes
by: Aida, Taichi, et al.
Published: (2024)
by: Aida, Taichi, et al.
Published: (2024)
Map of Encoders -- Mapping Sentence Encoders using Quantum Relative Entropy
by: Zhang, Gaifan, et al.
Published: (2026)
by: Zhang, Gaifan, et al.
Published: (2026)
Evaluating the Effect of Retrieval Augmentation on Social Biases
by: Zhang, Tianhui, et al.
Published: (2025)
by: Zhang, Tianhui, et al.
Published: (2025)
Implementing a Logical Inference System for Japanese Comparatives
by: Mikami, Yosuke, et al.
Published: (2025)
by: Mikami, Yosuke, et al.
Published: (2025)
Evaluating Unsupervised Dimensionality Reduction Methods for Pretrained Sentence Embeddings
by: Zhang, Gaifan, et al.
Published: (2024)
by: Zhang, Gaifan, et al.
Published: (2024)
Enhancing Rating Prediction with Off-the-Shelf LLMs Using In-Context User Reviews
by: Ryu, Koki, et al.
Published: (2025)
by: Ryu, Koki, et al.
Published: (2025)
Can Large Language Models Robustly Perform Natural Language Inference for Japanese Comparatives?
by: Mikami, Yosuke, et al.
Published: (2025)
by: Mikami, Yosuke, et al.
Published: (2025)
Evaluating Short-Term Temporal Fluctuations of Social Biases in Social Media Data and Masked Language Models
by: Zhou, Yi, et al.
Published: (2024)
by: Zhou, Yi, et al.
Published: (2024)
Annotating Training Data for Conditional Semantic Textual Similarity Measurement using Large Language Models
by: Zhang, Gaifan, et al.
Published: (2025)
by: Zhang, Gaifan, et al.
Published: (2025)
CASE -- Condition-Aware Sentence Embeddings for Conditional Semantic Textual Similarity Measurement
by: Zhang, Gaifan, et al.
Published: (2025)
by: Zhang, Gaifan, et al.
Published: (2025)
NeuronMoE: Neuron-Guided Mixture-of-Experts for Efficient Multilingual LLM Extension
by: Li, Rongzhi, et al.
Published: (2026)
by: Li, Rongzhi, et al.
Published: (2026)
Comprehensive Evaluation of Large Language Models for Topic Modeling
by: Doi, Tomoki, et al.
Published: (2024)
by: Doi, Tomoki, et al.
Published: (2024)
What Do Vision-Language Models Encode for Personalized Image Aesthetics Assessment?
by: Ryu, Koki, et al.
Published: (2026)
by: Ryu, Koki, et al.
Published: (2026)
Improving Unsupervised Constituency Parsing via Maximizing Semantic Information
by: Chen, Junjie, et al.
Published: (2024)
by: Chen, Junjie, et al.
Published: (2024)
Unsupervised Parsing by Searching for Frequent Word Sequences among Sentences with Equivalent Predicate-Argument Structures
by: Chen, Junjie, et al.
Published: (2024)
by: Chen, Junjie, et al.
Published: (2024)
Stopping Computation for Converged Tokens in Masked Diffusion-LM Decoding
by: Oba, Daisuke, et al.
Published: (2026)
by: Oba, Daisuke, et al.
Published: (2026)
Investigating Training and Generalization in Faithful Self-Explanations of Large Language Models
by: Doi, Tomoki, et al.
Published: (2025)
by: Doi, Tomoki, et al.
Published: (2025)
Exploring Intra and Inter-language Consistency in Embeddings with ICA
by: Li, Rongzhi, et al.
Published: (2024)
by: Li, Rongzhi, et al.
Published: (2024)
Developing a Guideline for the Labovian-Structural Analysis of Oral Narratives in Japanese
by: Watahiki, Amane, et al.
Published: (2026)
by: Watahiki, Amane, et al.
Published: (2026)
Derivational Probing: Unveiling the Layer-wise Derivation of Syntactic Structures in Neural Language Models
by: Someya, Taiga, et al.
Published: (2025)
by: Someya, Taiga, et al.
Published: (2025)
J-CHAT: Japanese Large-scale Spoken Dialogue Corpus for Spoken Dialogue Language Modeling
by: Nakata, Wataru, et al.
Published: (2024)
by: Nakata, Wataru, et al.
Published: (2024)
Common to Whom? Regional Cultural Commonsense and LLM Bias in India
by: Madhusudan, Sangmitra, et al.
Published: (2026)
by: Madhusudan, Sangmitra, et al.
Published: (2026)
LLMs as Cultural Archives: Cultural Commonsense Knowledge Graph Extraction
by: Tonga, Junior Cedric, et al.
Published: (2026)
by: Tonga, Junior Cedric, et al.
Published: (2026)
Towards Automated Lexicography: Generating and Evaluating Definitions for Learner's Dictionaries
by: Ide, Yusuke, et al.
Published: (2026)
by: Ide, Yusuke, et al.
Published: (2026)
Similar Items
-
Neuron-Level Analysis of Cultural Understanding in Large Language Models
by: Yamamoto, Taisei, et al.
Published: (2025) -
Analyzing the Inner Workings of Transformers in Compositional Generalization
by: Kumon, Ryoma, et al.
Published: (2025) -
Fine-Grained Analysis of Shared Syntactic Mechanisms in Language Models
by: Kumon, Ryoma, et al.
Published: (2026) -
Evaluating Structural Generalization in Neural Machine Translation
by: Kumon, Ryoma, et al.
Published: (2024) -
JBBQ: Japanese Bias Benchmark for Analyzing Social Biases in Large Language Models
by: Yanaka, Hitomi, et al.
Published: (2024)