How Well Do LLMs Handle Cantonese? Benchmarking Cantonese Capabilities of Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jiang, Jiyue, Chen, Pengan, Chen, Liheng, Wang, Sheng, Bao, Qinghang, Kong, Lingpeng, Li, Yu, Wu, Chuan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Developing and Utilizing a Large-Scale Cantonese Dataset for Multi-Tasking in Large Language Models
par: Jiang, Jiyue, et autres
Publié: (2025)
par: Jiang, Jiyue, et autres
Publié: (2025)
Data Augmentation of Multi-turn Psychological Dialogue via Knowledge-driven Progressive Thought Prompting
par: Jiang, Jiyue, et autres
Publié: (2024)
par: Jiang, Jiyue, et autres
Publié: (2024)
LoRA Meets Dropout under a Unified Framework
par: Wang, Sheng, et autres
Publié: (2024)
par: Wang, Sheng, et autres
Publié: (2024)
HKCanto-Eval: A Benchmark for Evaluating Cantonese Language Understanding and Cultural Comprehension in LLMs
par: Cheng, Tsz Chung, et autres
Publié: (2025)
par: Cheng, Tsz Chung, et autres
Publié: (2025)
MoS: Unleashing Parameter Efficiency of Low-Rank Adaptation with Mixture of Shards
par: Wang, Sheng, et autres
Publié: (2024)
par: Wang, Sheng, et autres
Publié: (2024)
Large Language Models in Bioinformatics: A Survey
par: Wang, Zhenyu, et autres
Publié: (2025)
par: Wang, Zhenyu, et autres
Publié: (2025)
Evaluating Modern Large Language Models on Low-Resource and Morphologically Rich Languages:A Cross-Lingual Benchmark Across Cantonese, Japanese, and Turkish
par: Xia, Chengxuan, et autres
Publié: (2025)
par: Xia, Chengxuan, et autres
Publié: (2025)
CantoASR: Prosody-Aware ASR-LALM Collaboration for Low-Resource Cantonese
par: Chen, Dazhong, et autres
Publié: (2025)
par: Chen, Dazhong, et autres
Publié: (2025)
Human-LLM Collaborative Construction of a Cantonese Emotion Lexicon
par: Zhang, Yusong, et autres
Publié: (2024)
par: Zhang, Yusong, et autres
Publié: (2024)
Benchmarking Large Language Models on Multiple Tasks in Bioinformatics NLP with Prompting
par: Jiang, Jiyue, et autres
Publié: (2025)
par: Jiang, Jiyue, et autres
Publié: (2025)
\textsc{CantoNLU}: A benchmark for Cantonese natural language understanding
par: Min, Junghyun, et autres
Publié: (2025)
par: Min, Junghyun, et autres
Publié: (2025)
Syllable based DNN-HMM Cantonese Speech to Text System
par: Wong, Timothy, et autres
Publié: (2024)
par: Wong, Timothy, et autres
Publié: (2024)
Information Asymmetry across Language Varieties: A Case Study on Cantonese-Mandarin and Bavarian-German QA
par: Pei, Renhao, et autres
Publié: (2026)
par: Pei, Renhao, et autres
Publié: (2026)
PRoLoRA: Partial Rotation Empowers More Parameter-Efficient LoRA
par: Wang, Sheng, et autres
Publié: (2024)
par: Wang, Sheng, et autres
Publié: (2024)
CANTONMT: Investigating Back-Translation and Model-Switch Mechanisms for Cantonese-English Neural Machine Translation
par: Hong, Kung Yin, et autres
Publié: (2024)
par: Hong, Kung Yin, et autres
Publié: (2024)
Lost in the Pipeline: How Well Do Large Language Models Handle Data Preparation?
par: Spreafico, Matteo, et autres
Publié: (2025)
par: Spreafico, Matteo, et autres
Publié: (2025)
CantonMT: Cantonese to English NMT Platform with Fine-Tuned Models Using Synthetic Back-Translation Data
par: Hong, Kung Yin, et autres
Publié: (2024)
par: Hong, Kung Yin, et autres
Publié: (2024)
A Principle-Driven Adaptive Policy for Group Cognitive Stimulation Dialogue for Elderly with Cognitive Impairment
par: Jiang, Jiyue, et autres
Publié: (2026)
par: Jiang, Jiyue, et autres
Publié: (2026)
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
par: Ye, Jiacheng, et autres
Publié: (2024)
par: Ye, Jiacheng, et autres
Publié: (2024)
TreeSynth: Synthesizing Diverse Data from Scratch via Tree-Guided Subspace Partitioning
par: Wang, Sheng, et autres
Publié: (2025)
par: Wang, Sheng, et autres
Publié: (2025)
Optimizing Retrieval-Augmented Generation (RAG) for Colloquial Cantonese: A LoRA-Based Systematic Review
par: Calonge, David Santandreu, et autres
Publié: (2025)
par: Calonge, David Santandreu, et autres
Publié: (2025)
How do Large Language Models Handle Multilingualism?
par: Zhao, Yiran, et autres
Publié: (2024)
par: Zhao, Yiran, et autres
Publié: (2024)
Forewarned is Forearmed: Leveraging LLMs for Data Synthesis through Failure-Inducing Exploration
par: Li, Qintong, et autres
Publié: (2024)
par: Li, Qintong, et autres
Publié: (2024)
PromptCoT: Synthesizing Olympiad-level Problems for Mathematical Reasoning in Large Language Models
par: Zhao, Xueliang, et autres
Publié: (2025)
par: Zhao, Xueliang, et autres
Publié: (2025)
How Well Do LLMs Identify Cultural Unity in Diversity?
par: Li, Jialin, et autres
Publié: (2024)
par: Li, Jialin, et autres
Publié: (2024)
LLMs Can Also Do Well! Breaking Barriers in Semantic Role Labeling via Large Language Models
par: Li, Xinxin, et autres
Publié: (2025)
par: Li, Xinxin, et autres
Publié: (2025)
How Well Do Large Language Models Truly Ground?
par: Lee, Hyunji, et autres
Publié: (2023)
par: Lee, Hyunji, et autres
Publié: (2023)
Exploring the Reliability of Large Language Models as Customized Evaluators for Diverse NLP Tasks
par: Li, Qintong, et autres
Publié: (2023)
par: Li, Qintong, et autres
Publié: (2023)
How Well Do Large Language Models Disambiguate Swedish Words?
par: Johansson, Richard
Publié: (2024)
par: Johansson, Richard
Publié: (2024)
DynaAct: Large Language Model Reasoning with Dynamic Action Spaces
par: Zhao, Xueliang, et autres
Publié: (2025)
par: Zhao, Xueliang, et autres
Publié: (2025)
Investigation of the use of anthocyanins in Cantonese sausage as a nitrite alternative
par: Jiaqi Zhu, et autres
Publié: (2025)
par: Jiaqi Zhu, et autres
Publié: (2025)
Dream 7B: Diffusion Large Language Models
par: Ye, Jiacheng, et autres
Publié: (2025)
par: Ye, Jiacheng, et autres
Publié: (2025)
GSM-Plus: A Comprehensive Benchmark for Evaluating the Robustness of LLMs as Mathematical Problem Solvers
par: Li, Qintong, et autres
Publié: (2024)
par: Li, Qintong, et autres
Publié: (2024)
PromptCoT 2.0: Scaling Prompt Synthesis for Large Language Model Reasoning
par: Zhao, Xueliang, et autres
Publié: (2025)
par: Zhao, Xueliang, et autres
Publié: (2025)
Benchmarking Generation and Evaluation Capabilities of Large Language Models for Instruction Controllable Summarization
par: Liu, Yixin, et autres
Publié: (2023)
par: Liu, Yixin, et autres
Publié: (2023)
Understanding the Role of LLMs in Multimodal Evaluation Benchmarks
par: Jiang, Botian, et autres
Publié: (2024)
par: Jiang, Botian, et autres
Publié: (2024)
WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation
par: Li, Longhao, et autres
Publié: (2025)
par: Li, Longhao, et autres
Publié: (2025)
Linguistic Frameworks Go Toe-to-Toe at Neuro-Symbolic Language Modeling
par: Prange, Jakob, et autres
Publié: (2021)
par: Prange, Jakob, et autres
Publié: (2021)
CoCA: Regaining Safety-awareness of Multimodal Large Language Models with Constitutional Calibration
par: Gao, Jiahui, et autres
Publié: (2024)
par: Gao, Jiahui, et autres
Publié: (2024)
Do They Understand Them? An Updated Evaluation on Nonbinary Pronoun Handling in Large Language Models
par: Tang, Xushuo, et autres
Publié: (2025)
par: Tang, Xushuo, et autres
Publié: (2025)
Documents similaires
-
Developing and Utilizing a Large-Scale Cantonese Dataset for Multi-Tasking in Large Language Models
par: Jiang, Jiyue, et autres
Publié: (2025) -
Data Augmentation of Multi-turn Psychological Dialogue via Knowledge-driven Progressive Thought Prompting
par: Jiang, Jiyue, et autres
Publié: (2024) -
LoRA Meets Dropout under a Unified Framework
par: Wang, Sheng, et autres
Publié: (2024) -
HKCanto-Eval: A Benchmark for Evaluating Cantonese Language Understanding and Cultural Comprehension in LLMs
par: Cheng, Tsz Chung, et autres
Publié: (2025) -
MoS: Unleashing Parameter Efficiency of Low-Rank Adaptation with Mixture of Shards
par: Wang, Sheng, et autres
Publié: (2024)