MulCogBench: A Multi-modal Cognitive Benchmark Dataset for Evaluating Chinese and English Computational Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Yunhao, Zhang, Xiaohan, Li, Chong, Wang, Shaonan, Zong, Chengqing |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Improving In-context Learning of Multilingual Generative Language Models with Cross-lingual Alignment
von: Li, Chong, et al.
Veröffentlicht: (2023)
von: Li, Chong, et al.
Veröffentlicht: (2023)
Navigating Brain Language Representations: A Comparative Analysis of Neural Language Models and Psychologically Plausible Models
von: Zhang, Yunhao, et al.
Veröffentlicht: (2024)
von: Zhang, Yunhao, et al.
Veröffentlicht: (2024)
Computational Models to Study Language Processing in the Human Brain: A Survey
von: Wang, Shaonan, et al.
Veröffentlicht: (2024)
von: Wang, Shaonan, et al.
Veröffentlicht: (2024)
Discovering Semantic Subdimensions through Disentangled Conceptual Representations
von: Zhang, Yunhao, et al.
Veröffentlicht: (2025)
von: Zhang, Yunhao, et al.
Veröffentlicht: (2025)
Decoding the Multimodal Mind: Generalizable Brain-to-Text Translation via Multimodal Alignment and Adaptive Routing
von: Ye, Chunyu, et al.
Veröffentlicht: (2025)
von: Ye, Chunyu, et al.
Veröffentlicht: (2025)
X-Instruction: Aligning Language Model in Low-resource Languages with Self-curated Cross-lingual Instructions
von: Li, Chong, et al.
Veröffentlicht: (2024)
von: Li, Chong, et al.
Veröffentlicht: (2024)
MapGuide: A Simple yet Effective Method to Reconstruct Continuous Language from Brain Activities
von: Zhao, Xinpei, et al.
Veröffentlicht: (2024)
von: Zhao, Xinpei, et al.
Veröffentlicht: (2024)
Component-Level Lesioning of Language Models Reveals Clinically Aligned Aphasia Phenotypes
von: Wang, Yifan, et al.
Veröffentlicht: (2026)
von: Wang, Yifan, et al.
Veröffentlicht: (2026)
Computational Lesions in Multilingual Language Models Separate Shared and Language-specific Brain Alignment
von: Cui, Yang, et al.
Veröffentlicht: (2026)
von: Cui, Yang, et al.
Veröffentlicht: (2026)
Group then Scale: Dynamic Mixture-of-Experts Multilingual Language Model
von: Li, Chong, et al.
Veröffentlicht: (2025)
von: Li, Chong, et al.
Veröffentlicht: (2025)
TokAlign: Efficient Vocabulary Adaptation via Token Alignment
von: Li, Chong, et al.
Veröffentlicht: (2025)
von: Li, Chong, et al.
Veröffentlicht: (2025)
PediaBench: A Comprehensive Chinese Pediatric Dataset for Benchmarking Large Language Models
von: Zhang, Qian, et al.
Veröffentlicht: (2024)
von: Zhang, Qian, et al.
Veröffentlicht: (2024)
AlignBench: Benchmarking Chinese Alignment of Large Language Models
von: Liu, Xiao, et al.
Veröffentlicht: (2023)
von: Liu, Xiao, et al.
Veröffentlicht: (2023)
How Syntax Specialization Emerges in Language Models
von: Duan, Xufeng, et al.
Veröffentlicht: (2025)
von: Duan, Xufeng, et al.
Veröffentlicht: (2025)
CIF-Bench: A Chinese Instruction-Following Benchmark for Evaluating the Generalizability of Large Language Models
von: LI, Yizhi, et al.
Veröffentlicht: (2024)
von: LI, Yizhi, et al.
Veröffentlicht: (2024)
A Survey of Large Language Models in Discipline-specific Research: Challenges, Methods and Opportunities
von: Xiang, Lu, et al.
Veröffentlicht: (2025)
von: Xiang, Lu, et al.
Veröffentlicht: (2025)
CogLM: Tracking Cognitive Development of Large Language Models
von: Wang, Xinglin, et al.
Veröffentlicht: (2024)
von: Wang, Xinglin, et al.
Veröffentlicht: (2024)
TokAlign++: Advancing Vocabulary Adaptation via Better Token Alignment
von: Li, Chong, et al.
Veröffentlicht: (2026)
von: Li, Chong, et al.
Veröffentlicht: (2026)
Scalable MatMul-free Language Modeling
von: Zhu, Rui-Jie, et al.
Veröffentlicht: (2024)
von: Zhu, Rui-Jie, et al.
Veröffentlicht: (2024)
CogMem: A Cognitive Memory Architecture for Sustained Multi-Turn Reasoning in Large Language Models
von: Zhang, Yiran, et al.
Veröffentlicht: (2025)
von: Zhang, Yiran, et al.
Veröffentlicht: (2025)
OmniEduBench: A Comprehensive Chinese Benchmark for Evaluating Large Language Models in Education
von: Zhang, Min, et al.
Veröffentlicht: (2025)
von: Zhang, Min, et al.
Veröffentlicht: (2025)
ChineseWebText 2.0: Large-Scale High-quality Chinese Web Text with Multi-dimensional and fine-grained information
von: Zhang, Wanyue, et al.
Veröffentlicht: (2024)
von: Zhang, Wanyue, et al.
Veröffentlicht: (2024)
Parallel Scaling Law: Unveiling Reasoning Generalization through A Cross-Linguistic Perspective
von: Yang, Wen, et al.
Veröffentlicht: (2025)
von: Yang, Wen, et al.
Veröffentlicht: (2025)
MulTaBench: Benchmarking Multimodal Tabular Learning with Text and Image
von: Arazi, Alan, et al.
Veröffentlicht: (2026)
von: Arazi, Alan, et al.
Veröffentlicht: (2026)
CMMaTH: A Chinese Multi-modal Math Skill Evaluation Benchmark for Foundation Models
von: Li, Zhong-Zhi, et al.
Veröffentlicht: (2024)
von: Li, Zhong-Zhi, et al.
Veröffentlicht: (2024)
EmbodiedBench: Comprehensive Benchmarking Multi-modal Large Language Models for Vision-Driven Embodied Agents
von: Yang, Rui, et al.
Veröffentlicht: (2025)
von: Yang, Rui, et al.
Veröffentlicht: (2025)
TurnBench-MS: A Benchmark for Evaluating Multi-Turn, Multi-Step Reasoning in Large Language Models
von: Zhang, Yiran, et al.
Veröffentlicht: (2025)
von: Zhang, Yiran, et al.
Veröffentlicht: (2025)
OphthBench: A Comprehensive Benchmark for Evaluating Large Language Models in Chinese Ophthalmology
von: Zhou, Chengfeng, et al.
Veröffentlicht: (2025)
von: Zhou, Chengfeng, et al.
Veröffentlicht: (2025)
MedBench: A Comprehensive, Standardized, and Reliable Benchmarking System for Evaluating Chinese Medical Large Language Models
von: Liu, Mianxin, et al.
Veröffentlicht: (2024)
von: Liu, Mianxin, et al.
Veröffentlicht: (2024)
CliMedBench: A Large-Scale Chinese Benchmark for Evaluating Medical Large Language Models in Clinical Scenarios
von: Ouyang, Zetian, et al.
Veröffentlicht: (2024)
von: Ouyang, Zetian, et al.
Veröffentlicht: (2024)
CMQCIC-Bench: A Chinese Benchmark for Evaluating Large Language Models in Medical Quality Control Indicator Calculation
von: Yu, Guangya, et al.
Veröffentlicht: (2025)
von: Yu, Guangya, et al.
Veröffentlicht: (2025)
EmoHarbor: Evaluating Personalized Emotional Support by Simulating the User's Internal World
von: Ye, Jing, et al.
Veröffentlicht: (2026)
von: Ye, Jing, et al.
Veröffentlicht: (2026)
EssayBench: Evaluating Large Language Models in Multi-Genre Chinese Essay Writing
von: Gao, Fan, et al.
Veröffentlicht: (2025)
von: Gao, Fan, et al.
Veröffentlicht: (2025)
MulDimIF: A Multi-Dimensional Constraint Framework for Evaluating and Improving Instruction Following in Large Language Models
von: Ye, Junjie, et al.
Veröffentlicht: (2025)
von: Ye, Junjie, et al.
Veröffentlicht: (2025)
CFinBench: A Comprehensive Chinese Financial Benchmark for Large Language Models
von: Nie, Ying, et al.
Veröffentlicht: (2024)
von: Nie, Ying, et al.
Veröffentlicht: (2024)
A Chinese Dataset for Evaluating the Safeguards in Large Language Models
von: Wang, Yuxia, et al.
Veröffentlicht: (2024)
von: Wang, Yuxia, et al.
Veröffentlicht: (2024)
Language Imbalance Driven Rewarding for Multilingual Self-improving
von: Yang, Wen, et al.
Veröffentlicht: (2024)
von: Yang, Wen, et al.
Veröffentlicht: (2024)
EduBench: A Comprehensive Benchmarking Dataset for Evaluating Large Language Models in Diverse Educational Scenarios
von: Xu, Bin, et al.
Veröffentlicht: (2025)
von: Xu, Bin, et al.
Veröffentlicht: (2025)
BattleAgentBench: A Benchmark for Evaluating Cooperation and Competition Capabilities of Language Models in Multi-Agent Systems
von: Wang, Wei, et al.
Veröffentlicht: (2024)
von: Wang, Wei, et al.
Veröffentlicht: (2024)
CogGPT: Unleashing the Power of Cognitive Dynamics on Large Language Models
von: Lv, Yaojia, et al.
Veröffentlicht: (2024)
von: Lv, Yaojia, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Improving In-context Learning of Multilingual Generative Language Models with Cross-lingual Alignment
von: Li, Chong, et al.
Veröffentlicht: (2023) -
Navigating Brain Language Representations: A Comparative Analysis of Neural Language Models and Psychologically Plausible Models
von: Zhang, Yunhao, et al.
Veröffentlicht: (2024) -
Computational Models to Study Language Processing in the Human Brain: A Survey
von: Wang, Shaonan, et al.
Veröffentlicht: (2024) -
Discovering Semantic Subdimensions through Disentangled Conceptual Representations
von: Zhang, Yunhao, et al.
Veröffentlicht: (2025) -
Decoding the Multimodal Mind: Generalizable Brain-to-Text Translation via Multimodal Alignment and Adaptive Routing
von: Ye, Chunyu, et al.
Veröffentlicht: (2025)