Towards Global AI Inclusivity: A Large-Scale Multilingual Terminology Dataset (GIST)
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Jiarui, Ouzzani, Iman, Li, Wenkai, Zhang, Lechen, Ou, Tianyue, Bouamor, Houda, Jin, Zhijing, Diab, Mona |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Automatic Generation of Model and Data Cards: A Step Towards Responsible AI
di: Liu, Jiarui, et al.
Pubblicazione: (2024)
di: Liu, Jiarui, et al.
Pubblicazione: (2024)
Taming Object Hallucinations with Verified Atomic Confidence Estimation
di: Liu, Jiarui, et al.
Pubblicazione: (2025)
di: Liu, Jiarui, et al.
Pubblicazione: (2025)
MixSD: Mixed Contextual Self-Distillation for Knowledge Injection
di: Liu, Jiarui, et al.
Pubblicazione: (2026)
di: Liu, Jiarui, et al.
Pubblicazione: (2026)
Cross-Lingual Transfer from Related Languages: Treating Low-Resource Maltese as Multilingual Code-Switching
di: Micallef, Kurt, et al.
Pubblicazione: (2024)
di: Micallef, Kurt, et al.
Pubblicazione: (2024)
Chinese Offensive Language Detection:Current Status and Future Directions
di: Xiao, Yunze, et al.
Pubblicazione: (2024)
di: Xiao, Yunze, et al.
Pubblicazione: (2024)
BIG5-CHAT: Shaping LLM Personalities Through Training on Human-Grounded Data
di: Li, Wenkai, et al.
Pubblicazione: (2024)
di: Li, Wenkai, et al.
Pubblicazione: (2024)
Can Large Language Models Infer Causation from Correlation?
di: Jin, Zhijing, et al.
Pubblicazione: (2023)
di: Jin, Zhijing, et al.
Pubblicazione: (2023)
Analyzing the Role of Semantic Representations in the Era of Large Language Models
di: Jin, Zhijing, et al.
Pubblicazione: (2024)
di: Jin, Zhijing, et al.
Pubblicazione: (2024)
The FIGNEWS Shared Task on News Media Narratives
di: Zaghouani, Wajdi, et al.
Pubblicazione: (2024)
di: Zaghouani, Wajdi, et al.
Pubblicazione: (2024)
LAILA: A Large Trait-Based Dataset for Arabic Automated Essay Scoring
di: Bashendy, May, et al.
Pubblicazione: (2025)
di: Bashendy, May, et al.
Pubblicazione: (2025)
LLM Microscope: What Model Internals Reveal About Answer Correctness and Context Utilization
di: Liu, Jiarui, et al.
Pubblicazione: (2025)
di: Liu, Jiarui, et al.
Pubblicazione: (2025)
JobArabi: An Arabic Corpus and Analysis of Job Announcements from Social Media
di: Zaghouani, Wajdi, et al.
Pubblicazione: (2026)
di: Zaghouani, Wajdi, et al.
Pubblicazione: (2026)
ArabDiscrim: A Decade-Long Arabic Facebook Corpus on Racism and Discrimination
di: Zaghouani, Wajdi, et al.
Pubblicazione: (2026)
di: Zaghouani, Wajdi, et al.
Pubblicazione: (2026)
Evaluating Large Language Model Biases in Persona-Steered Generation
di: Liu, Andy, et al.
Pubblicazione: (2024)
di: Liu, Andy, et al.
Pubblicazione: (2024)
Humanizing Machines: Rethinking LLM Anthropomorphism Through a Multi-Level Framework of Design
di: Xiao, Yunze, et al.
Pubblicazione: (2025)
di: Xiao, Yunze, et al.
Pubblicazione: (2025)
IndicVoices: Towards building an Inclusive Multilingual Speech Dataset for Indian Languages
di: Javed, Tahir, et al.
Pubblicazione: (2024)
di: Javed, Tahir, et al.
Pubblicazione: (2024)
A Note on Bias to Complete
di: Xu, Jia, et al.
Pubblicazione: (2024)
di: Xu, Jia, et al.
Pubblicazione: (2024)
KpopMT: Translation Dataset with Terminology for Kpop Fandom
di: Kim, JiWoo, et al.
Pubblicazione: (2024)
di: Kim, JiWoo, et al.
Pubblicazione: (2024)
Toward Human-Centered AI-Assisted Terminology Work
di: Martin, Antonio San
Pubblicazione: (2025)
di: Martin, Antonio San
Pubblicazione: (2025)
Exploiting Dialect Identification in Automatic Dialectal Text Normalization
di: Alhafni, Bashar, et al.
Pubblicazione: (2024)
di: Alhafni, Bashar, et al.
Pubblicazione: (2024)
JobHop: A Large-Scale Dataset of Career Trajectories
di: Johary, Iman, et al.
Pubblicazione: (2025)
di: Johary, Iman, et al.
Pubblicazione: (2025)
Combining Discrete Wavelet and Cosine Transforms for Efficient Sentence Embedding
di: Salama, Rana, et al.
Pubblicazione: (2025)
di: Salama, Rana, et al.
Pubblicazione: (2025)
Towards Valid Student Simulation with Large Language Models
di: Yuan, Zhihao, et al.
Pubblicazione: (2026)
di: Yuan, Zhihao, et al.
Pubblicazione: (2026)
Language Model Alignment in Multilingual Trolley Problems
di: Jin, Zhijing, et al.
Pubblicazione: (2024)
di: Jin, Zhijing, et al.
Pubblicazione: (2024)
CORE: Measuring Multi-Agent LLM Interaction Quality under Game-Theoretic Pressures
di: Pandey, Punya Syon, et al.
Pubblicazione: (2025)
di: Pandey, Punya Syon, et al.
Pubblicazione: (2025)
Mafoko: Structuring and Building Open Multilingual Terminologies for South African NLP
di: Marivate, Vukosi, et al.
Pubblicazione: (2025)
di: Marivate, Vukosi, et al.
Pubblicazione: (2025)
Analyzing Information Sharing and Coordination in Multi-Agent Planning
di: Ou, Tianyue, et al.
Pubblicazione: (2025)
di: Ou, Tianyue, et al.
Pubblicazione: (2025)
Tracing Multilingual Representations in LLMs with Cross-Layer Transcoders
di: Harrasse, Abir, et al.
Pubblicazione: (2025)
di: Harrasse, Abir, et al.
Pubblicazione: (2025)
Voices of Her: Analyzing Gender Differences in the AI Publication World
di: Ding, Yiwen, et al.
Pubblicazione: (2023)
di: Ding, Yiwen, et al.
Pubblicazione: (2023)
StressRoBERTa: Cross-Condition Transfer Learning from Depression, Anxiety, and PTSD to Stress Detection
di: Alqahtani, Amal, et al.
Pubblicazione: (2025)
di: Alqahtani, Amal, et al.
Pubblicazione: (2025)
DWTSumm: Discrete Wavelet Transform for Document Summarization
di: Salama, Rana, et al.
Pubblicazione: (2026)
di: Salama, Rana, et al.
Pubblicazione: (2026)
AraFinNLP 2024: The First Arabic Financial NLP Shared Task
di: Malaysha, Sanad, et al.
Pubblicazione: (2024)
di: Malaysha, Sanad, et al.
Pubblicazione: (2024)
NiuTrans.LMT: Toward Inclusive and Scalable Multilingual Machine Translation with LLMs
di: Luo, Yingfeng, et al.
Pubblicazione: (2025)
di: Luo, Yingfeng, et al.
Pubblicazione: (2025)
Semantic Compression for Word and Sentence Embeddings using Discrete Wavelet Transform
di: Salama, Rana Aref, et al.
Pubblicazione: (2025)
di: Salama, Rana Aref, et al.
Pubblicazione: (2025)
Efficiently Identifying Low-Quality Language Subsets in Multilingual Datasets: A Case Study on a Large-Scale Multilingual Audio Dataset
di: Samir, Farhan, et al.
Pubblicazione: (2024)
di: Samir, Farhan, et al.
Pubblicazione: (2024)
Revealing Hidden Mechanisms of Cross-Country Content Moderation with Natural Language Processing
di: Yadav, Neemesh, et al.
Pubblicazione: (2025)
di: Yadav, Neemesh, et al.
Pubblicazione: (2025)
Decoding Dark Matter: Specialized Sparse Autoencoders for Interpreting Rare Concepts in Foundation Models
di: Muhamed, Aashiq, et al.
Pubblicazione: (2024)
di: Muhamed, Aashiq, et al.
Pubblicazione: (2024)
Emotion Classification in Low and Moderate Resource Languages
di: Tafreshi, Shabnam, et al.
Pubblicazione: (2024)
di: Tafreshi, Shabnam, et al.
Pubblicazione: (2024)
SimBA: Simplifying Benchmark Analysis Using Performance Matrices Alone
di: Subramani, Nishant, et al.
Pubblicazione: (2025)
di: Subramani, Nishant, et al.
Pubblicazione: (2025)
Towards Inclusive NLP: Assessing Compressed Multilingual Transformers across Diverse Language Benchmarks
di: Alshehhi, Maitha, et al.
Pubblicazione: (2025)
di: Alshehhi, Maitha, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Automatic Generation of Model and Data Cards: A Step Towards Responsible AI
di: Liu, Jiarui, et al.
Pubblicazione: (2024) -
Taming Object Hallucinations with Verified Atomic Confidence Estimation
di: Liu, Jiarui, et al.
Pubblicazione: (2025) -
MixSD: Mixed Contextual Self-Distillation for Knowledge Injection
di: Liu, Jiarui, et al.
Pubblicazione: (2026) -
Cross-Lingual Transfer from Related Languages: Treating Low-Resource Maltese as Multilingual Code-Switching
di: Micallef, Kurt, et al.
Pubblicazione: (2024) -
Chinese Offensive Language Detection:Current Status and Future Directions
di: Xiao, Yunze, et al.
Pubblicazione: (2024)