Towards Massive Multilingual Holistic Bias
Fuente:
arXiv
Guardado en:
| Autores principales: | Tan, Xiaoqing Ellen, Hansanti, Prangthip, Wood, Carleigh, Yu, Bokai, Ropers, Christophe, Costa-jussà, Marta R. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MuTox: Universal MUltilingual Audio-based TOXicity Dataset and Zero-shot Detector
por: Costa-jussà, Marta R., et al.
Publicado: (2024)
por: Costa-jussà, Marta R., et al.
Publicado: (2024)
2M-BELEBELE: Highly Multilingual Speech and American Sign Language Comprehension Dataset
por: Costa-jussà, Marta R., et al.
Publicado: (2024)
por: Costa-jussà, Marta R., et al.
Publicado: (2024)
Towards Red Teaming in Multimodal and Multilingual Translation
por: Ropers, Christophe, et al.
Publicado: (2024)
por: Ropers, Christophe, et al.
Publicado: (2024)
Y-NQ: English-Yorùbá Evaluation dataset for Open-Book Reading Comprehension and Text Generation
por: Costa-jussà, Marta R., et al.
Publicado: (2024)
por: Costa-jussà, Marta R., et al.
Publicado: (2024)
LCFO: Long Context and Long Form Output Dataset and Benchmarking
por: Costa-jussà, Marta R., et al.
Publicado: (2024)
por: Costa-jussà, Marta R., et al.
Publicado: (2024)
BOUQuET: dataset, Benchmark and Open initiative for Universal Quality Evaluation in Translation
por: The Omnilingual MT Team, et al.
Publicado: (2025)
por: The Omnilingual MT Team, et al.
Publicado: (2025)
RomanLens: The Role Of Latent Romanization In Multilinguality In LLMs
por: Saji, Alan, et al.
Publicado: (2025)
por: Saji, Alan, et al.
Publicado: (2025)
Sensitive Content Classification in Social Media: A Holistic Resource and Evaluation
por: Antypas, Dimosthenis, et al.
Publicado: (2024)
por: Antypas, Dimosthenis, et al.
Publicado: (2024)
Omnilingual MT: Machine Translation for 1,600 Languages
por: Omnilingual MT Team, et al.
Publicado: (2026)
por: Omnilingual MT Team, et al.
Publicado: (2026)
EduGuardBench: A Holistic Benchmark for Evaluating the Pedagogical Fidelity and Adversarial Safety of LLMs as Simulated Teachers
por: Jiang, Yilin, et al.
Publicado: (2025)
por: Jiang, Yilin, et al.
Publicado: (2025)
DimStance: Multilingual Datasets for Dimensional Stance Analysis
por: Becker, Jonas, et al.
Publicado: (2026)
por: Becker, Jonas, et al.
Publicado: (2026)
Exploring the Maze of Multilingual Modeling
por: Nezhad, Sina Bagheri, et al.
Publicado: (2023)
por: Nezhad, Sina Bagheri, et al.
Publicado: (2023)
CRISP: Persistent Concept Unlearning via Sparse Autoencoders
por: Ashuach, Tomer, et al.
Publicado: (2025)
por: Ashuach, Tomer, et al.
Publicado: (2025)
DimABSA: Building Multilingual and Multidomain Datasets for Dimensional Aspect-Based Sentiment Analysis
por: Lee, Lung-Hao, et al.
Publicado: (2026)
por: Lee, Lung-Hao, et al.
Publicado: (2026)
What Drives Performance in Multilingual Language Models?
por: Nezhad, Sina Bagheri, et al.
Publicado: (2024)
por: Nezhad, Sina Bagheri, et al.
Publicado: (2024)
idT5: Indonesian Version of Multilingual T5 Transformer
por: Fuadi, Mukhlish, et al.
Publicado: (2023)
por: Fuadi, Mukhlish, et al.
Publicado: (2023)
Ensembling Multilingual Transformers for Robust Sentiment Analysis of Tweets
por: Bilehsavar, Meysam Shirdel, et al.
Publicado: (2025)
por: Bilehsavar, Meysam Shirdel, et al.
Publicado: (2025)
Socially Responsible Data for Large Multilingual Language Models
por: Smart, Andrew, et al.
Publicado: (2024)
por: Smart, Andrew, et al.
Publicado: (2024)
ML-Promise: A Multilingual Dataset for Corporate Promise Verification
por: Seki, Yohei, et al.
Publicado: (2024)
por: Seki, Yohei, et al.
Publicado: (2024)
Towards Fundamental Language Models: Does Linguistic Competence Scale with Model Size?
por: Collado-Montañez, Jaime, et al.
Publicado: (2025)
por: Collado-Montañez, Jaime, et al.
Publicado: (2025)
Adapting Multilingual Models to Code-Mixed Tasks via Model Merging
por: Kodali, Prashant, et al.
Publicado: (2025)
por: Kodali, Prashant, et al.
Publicado: (2025)
Boosting Accuracy and Interpretability in Multilingual Hate Speech Detection Through Layer Freezing and Explainable AI
por: Bilehsavar, Meysam Shirdel, et al.
Publicado: (2026)
por: Bilehsavar, Meysam Shirdel, et al.
Publicado: (2026)
I run as fast as a rabbit, can you? A Multilingual Simile Dialogue Dataset
por: Ma, Longxuan, et al.
Publicado: (2023)
por: Ma, Longxuan, et al.
Publicado: (2023)
Tokenization and Morphology in Multilingual Language Models: A Comparative Analysis of mT5 and ByT5
por: Dang, Thao Anh, et al.
Publicado: (2024)
por: Dang, Thao Anh, et al.
Publicado: (2024)
"AGI" team at SHROOM-CAP: Data-Centric Approach to Multilingual Hallucination Detection using XLM-RoBERTa
por: Rathva, Harsh, et al.
Publicado: (2025)
por: Rathva, Harsh, et al.
Publicado: (2025)
Large Language Model (LLM) Bias Index -- LLMBI
por: Oketunji, Abiodun Finbarrs, et al.
Publicado: (2023)
por: Oketunji, Abiodun Finbarrs, et al.
Publicado: (2023)
Are Non-English Papers Reviewed Fairly? Language-of-Study Bias in NLP Peer Reviews
por: Barkhordar, Ehsan, et al.
Publicado: (2026)
por: Barkhordar, Ehsan, et al.
Publicado: (2026)
RUQuant: Towards Refining Uniform Quantization for Large Language Models
por: Liu, Han, et al.
Publicado: (2026)
por: Liu, Han, et al.
Publicado: (2026)
SAGED: A Holistic Bias-Benchmarking Pipeline for Language Models with Customisable Fairness Calibration
por: Guan, Xin, et al.
Publicado: (2024)
por: Guan, Xin, et al.
Publicado: (2024)
Big City Bias: Evaluating the Impact of Metropolitan Size on Computational Job Market Abilities of Language Models
por: Campanella, Charlie, et al.
Publicado: (2024)
por: Campanella, Charlie, et al.
Publicado: (2024)
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
por: Peters, Sydney, et al.
Publicado: (2025)
por: Peters, Sydney, et al.
Publicado: (2025)
Predictive Simultaneous Interpretation: Harnessing Large Language Models for Democratizing Real-Time Multilingual Communication
por: Iida, Kurando, et al.
Publicado: (2024)
por: Iida, Kurando, et al.
Publicado: (2024)
Towards Human Understanding of Paraphrase Types in Large Language Models
por: Meier, Dominik, et al.
Publicado: (2024)
por: Meier, Dominik, et al.
Publicado: (2024)
STLM Engineering Report: Dropout
por: Hillier, Dylan, et al.
Publicado: (2024)
por: Hillier, Dylan, et al.
Publicado: (2024)
Towards Greater Leverage: Scaling Laws for Efficient Mixture-of-Experts Language Models
por: Tian, Changxin, et al.
Publicado: (2025)
por: Tian, Changxin, et al.
Publicado: (2025)
SeLeRoSa: Sentence-Level Romanian Satire Detection Dataset
por: Smădu, Răzvan-Alexandru, et al.
Publicado: (2025)
por: Smădu, Răzvan-Alexandru, et al.
Publicado: (2025)
Measuring Massive Multitask Chinese Understanding
por: Zeng, Hui
Publicado: (2023)
por: Zeng, Hui
Publicado: (2023)
Towards interpretable models for language proficiency assessment: Predicting the CEFR level of Estonian learner texts
por: Allkivi, Kais
Publicado: (2026)
por: Allkivi, Kais
Publicado: (2026)
Surprise Calibration for Better In-Context Learning
por: Tan, Zhihang, et al.
Publicado: (2025)
por: Tan, Zhihang, et al.
Publicado: (2025)
HACHIMI: Scalable and Controllable Student Persona Generation via Orchestrated Agents
por: Jiang, Yilin, et al.
Publicado: (2026)
por: Jiang, Yilin, et al.
Publicado: (2026)
Ejemplares similares
-
MuTox: Universal MUltilingual Audio-based TOXicity Dataset and Zero-shot Detector
por: Costa-jussà, Marta R., et al.
Publicado: (2024) -
2M-BELEBELE: Highly Multilingual Speech and American Sign Language Comprehension Dataset
por: Costa-jussà, Marta R., et al.
Publicado: (2024) -
Towards Red Teaming in Multimodal and Multilingual Translation
por: Ropers, Christophe, et al.
Publicado: (2024) -
Y-NQ: English-Yorùbá Evaluation dataset for Open-Book Reading Comprehension and Text Generation
por: Costa-jussà, Marta R., et al.
Publicado: (2024) -
LCFO: Long Context and Long Form Output Dataset and Benchmarking
por: Costa-jussà, Marta R., et al.
Publicado: (2024)