HSKBenchmark: Modeling and Benchmarking Chinese Second Language Acquisition in Large Language Models through Curriculum Tuning
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Qihao, Wang, Xuelin, Chen, Jiale, Dong, Xuelian, Hao, Yuxin, Hao, Tianyong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Exploring Lightweight Large Language Models for Court View Generation
por: Hou, Zhitian, et al.
Publicado: (2026)
por: Hou, Zhitian, et al.
Publicado: (2026)
Large Language Models Meet Legal Artificial Intelligence: A Survey
por: Hou, Zhitian, et al.
Publicado: (2025)
por: Hou, Zhitian, et al.
Publicado: (2025)
AlignBench: Benchmarking Chinese Alignment of Large Language Models
por: Liu, Xiao, et al.
Publicado: (2023)
por: Liu, Xiao, et al.
Publicado: (2023)
Mixture-of-LoRAs: An Efficient Multitask Tuning for Large Language Models
por: Feng, Wenfeng, et al.
Publicado: (2024)
por: Feng, Wenfeng, et al.
Publicado: (2024)
Large Language Models for Classical Chinese Poetry Translation: Benchmarking, Evaluating, and Improving
por: Chen, Andong, et al.
Publicado: (2024)
por: Chen, Andong, et al.
Publicado: (2024)
Enhancing Multimodal Large Language Models for Ancient Chinese Character Evolution Analysis via Glyph-Driven Fine-Tuning
por: Song, Rui, et al.
Publicado: (2026)
por: Song, Rui, et al.
Publicado: (2026)
Large Language Models for Mathematical Analysis
por: Chen, Ziye, et al.
Publicado: (2024)
por: Chen, Ziye, et al.
Publicado: (2024)
LogicGame: Benchmarking Rule-Based Reasoning Abilities of Large Language Models
por: Gui, Jiayi, et al.
Publicado: (2024)
por: Gui, Jiayi, et al.
Publicado: (2024)
EmotionQueen: A Benchmark for Evaluating Empathy of Large Language Models
por: Chen, Yuyan, et al.
Publicado: (2024)
por: Chen, Yuyan, et al.
Publicado: (2024)
A Survey on Collaborative Mechanisms Between Large and Small Language Models
por: Chen, Yi, et al.
Publicado: (2025)
por: Chen, Yi, et al.
Publicado: (2025)
CHiSafetyBench: A Chinese Hierarchical Safety Benchmark for Large Language Models
por: Zhang, Wenjing, et al.
Publicado: (2024)
por: Zhang, Wenjing, et al.
Publicado: (2024)
Using Large Language Model for End-to-End Chinese ASR and NER
por: Li, Yuang, et al.
Publicado: (2024)
por: Li, Yuang, et al.
Publicado: (2024)
CIF-Bench: A Chinese Instruction-Following Benchmark for Evaluating the Generalizability of Large Language Models
por: LI, Yizhi, et al.
Publicado: (2024)
por: LI, Yizhi, et al.
Publicado: (2024)
InsQABench: Benchmarking Chinese Insurance Domain Question Answering with Large Language Models
por: Ding, Jing, et al.
Publicado: (2025)
por: Ding, Jing, et al.
Publicado: (2025)
Benchmarking Large Language Models on Communicative Medical Coaching: a Novel System and Dataset
por: Huang, Hengguan, et al.
Publicado: (2024)
por: Huang, Hengguan, et al.
Publicado: (2024)
OphthBench: A Comprehensive Benchmark for Evaluating Large Language Models in Chinese Ophthalmology
por: Zhou, Chengfeng, et al.
Publicado: (2025)
por: Zhou, Chengfeng, et al.
Publicado: (2025)
Evaluating Neural Language Models as Cognitive Models of Language Acquisition
por: Martínez, Héctor Javier Vázquez, et al.
Publicado: (2023)
por: Martínez, Héctor Javier Vázquez, et al.
Publicado: (2023)
TCMBench: A Comprehensive Benchmark for Evaluating Large Language Models in Traditional Chinese Medicine
por: Yue, Wenjing, et al.
Publicado: (2024)
por: Yue, Wenjing, et al.
Publicado: (2024)
Benchmarking Large Language Models on CFLUE -- A Chinese Financial Language Understanding Evaluation Dataset
por: Zhu, Jie, et al.
Publicado: (2024)
por: Zhu, Jie, et al.
Publicado: (2024)
BenCao: An Instruction-Tuned Large Language Model for Traditional Chinese Medicine
por: Xie, Jiacheng, et al.
Publicado: (2025)
por: Xie, Jiacheng, et al.
Publicado: (2025)
Kuaiji: the First Chinese Accounting Large Language Model
por: Luo, Jiayuan, et al.
Publicado: (2024)
por: Luo, Jiayuan, et al.
Publicado: (2024)
GRIP: In-Parameter Graph Reasoning through Fine-Tuning Large Language Models
por: Feng, Jiarui, et al.
Publicado: (2025)
por: Feng, Jiarui, et al.
Publicado: (2025)
Process Supervision via Verbal Critique Improves Reasoning in Large Language Models
por: Chen, Hao-Yuan
Publicado: (2026)
por: Chen, Hao-Yuan
Publicado: (2026)
CMoralEval: A Moral Evaluation Benchmark for Chinese Large Language Models
por: Yu, Linhao, et al.
Publicado: (2024)
por: Yu, Linhao, et al.
Publicado: (2024)
CollectiveSFT: Scaling Large Language Models for Chinese Medical Benchmark with Collective Instructions in Healthcare
por: Zhu, Jingwei, et al.
Publicado: (2024)
por: Zhu, Jingwei, et al.
Publicado: (2024)
AGENTIF: Benchmarking Instruction Following of Large Language Models in Agentic Scenarios
por: Qi, Yunjia, et al.
Publicado: (2025)
por: Qi, Yunjia, et al.
Publicado: (2025)
BriLLM: Brain-inspired Large Language Model
por: Zhao, Hai, et al.
Publicado: (2025)
por: Zhao, Hai, et al.
Publicado: (2025)
OFFSIDE: Benchmarking Unlearning Misinformation in Multimodal Large Language Models
por: Zheng, Hao, et al.
Publicado: (2025)
por: Zheng, Hao, et al.
Publicado: (2025)
Collab-Overcooked: Benchmarking and Evaluating Large Language Models as Collaborative Agents
por: Sun, Haochen, et al.
Publicado: (2025)
por: Sun, Haochen, et al.
Publicado: (2025)
Training Large Language Models for Reasoning through Reverse Curriculum Reinforcement Learning
por: Xi, Zhiheng, et al.
Publicado: (2024)
por: Xi, Zhiheng, et al.
Publicado: (2024)
Structure Guided Large Language Model for SQL Generation
por: Zhang, Qinggang, et al.
Publicado: (2024)
por: Zhang, Qinggang, et al.
Publicado: (2024)
Strategic Data Ordering: Enhancing Large Language Model Performance through Curriculum Learning
por: Kim, Jisu, et al.
Publicado: (2024)
por: Kim, Jisu, et al.
Publicado: (2024)
$\mathcal{S}^2$IT: Stepwise Syntax Integration Tuning for Large Language Models in Aspect Sentiment Quad Prediction
por: Chen, Bingfeng, et al.
Publicado: (2026)
por: Chen, Bingfeng, et al.
Publicado: (2026)
Enhancing Healthcare through Large Language Models: A Study on Medical Question Answering
por: Yu, Haoran, et al.
Publicado: (2024)
por: Yu, Haoran, et al.
Publicado: (2024)
Enhancing Large Language Models through Structured Reasoning
por: Dong, Yubo, et al.
Publicado: (2025)
por: Dong, Yubo, et al.
Publicado: (2025)
Mitigating Hidden Confounding by Progressive Confounder Imputation via Large Language Models
por: Yang, Hao, et al.
Publicado: (2025)
por: Yang, Hao, et al.
Publicado: (2025)
JailBench: A Comprehensive Chinese Security Assessment Benchmark for Large Language Models
por: Liu, Shuyi, et al.
Publicado: (2025)
por: Liu, Shuyi, et al.
Publicado: (2025)
Qibo: A Large Language Model for Traditional Chinese Medicine
por: Zhang, Heyi, et al.
Publicado: (2024)
por: Zhang, Heyi, et al.
Publicado: (2024)
Boosting Large Language Models with Mask Fine-Tuning
por: Zhang, Mingyuan, et al.
Publicado: (2025)
por: Zhang, Mingyuan, et al.
Publicado: (2025)
TreeEval: Benchmark-Free Evaluation of Large Language Models through Tree Planning
por: Li, Xiang, et al.
Publicado: (2024)
por: Li, Xiang, et al.
Publicado: (2024)
Ejemplares similares
-
Exploring Lightweight Large Language Models for Court View Generation
por: Hou, Zhitian, et al.
Publicado: (2026) -
Large Language Models Meet Legal Artificial Intelligence: A Survey
por: Hou, Zhitian, et al.
Publicado: (2025) -
AlignBench: Benchmarking Chinese Alignment of Large Language Models
por: Liu, Xiao, et al.
Publicado: (2023) -
Mixture-of-LoRAs: An Efficient Multitask Tuning for Large Language Models
por: Feng, Wenfeng, et al.
Publicado: (2024) -
Large Language Models for Classical Chinese Poetry Translation: Benchmarking, Evaluating, and Improving
por: Chen, Andong, et al.
Publicado: (2024)