The Impact of Visual Information in Chinese Characters: Evaluating Large Models' Ability to Recognize and Utilize Radicals
Fuente:
arXiv
Guardado en:
| Autores principales: | Wu, Xiaofeng, Stratos, Karl, Xu, Wei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Model Editing by Standard Fine-Tuning
por: Gangadhar, Govind, et al.
Publicado: (2024)
por: Gangadhar, Govind, et al.
Publicado: (2024)
ReNCE: Learning to Reason by Noise Contrastive Estimation
por: Zhang, Wenzheng, et al.
Publicado: (2026)
por: Zhang, Wenzheng, et al.
Publicado: (2026)
Evaluating LLMs on Chinese Idiom Translation
por: Yang, Cai, et al.
Publicado: (2025)
por: Yang, Cai, et al.
Publicado: (2025)
Evaluating Character Understanding of Large Language Models via Character Profiling from Fictional Works
por: Yuan, Xinfeng, et al.
Publicado: (2024)
por: Yuan, Xinfeng, et al.
Publicado: (2024)
Recognizing Limits: Investigating Infeasibility in Large Language Models
por: Zhang, Wenbo, et al.
Publicado: (2024)
por: Zhang, Wenbo, et al.
Publicado: (2024)
AC-EVAL: Evaluating Ancient Chinese Language Understanding in Large Language Models
por: Wei, Yuting, et al.
Publicado: (2024)
por: Wei, Yuting, et al.
Publicado: (2024)
CHBench: A Chinese Dataset for Evaluating Health in Large Language Models
por: Guo, Chenlu, et al.
Publicado: (2024)
por: Guo, Chenlu, et al.
Publicado: (2024)
Understanding the Ability of LLMs to Handle Character-Level Perturbation
por: Zhuo, Anyuan, et al.
Publicado: (2025)
por: Zhuo, Anyuan, et al.
Publicado: (2025)
CITI: Enhancing Tool Utilizing Ability in Large Language Models without Sacrificing General Performance
por: Hao, Yupu, et al.
Publicado: (2024)
por: Hao, Yupu, et al.
Publicado: (2024)
BrowseComp-ZH: Benchmarking Web Browsing Ability of Large Language Models in Chinese
por: Zhou, Peilin, et al.
Publicado: (2025)
por: Zhou, Peilin, et al.
Publicado: (2025)
Don't Take the Premise for Granted: Evaluating the Premise Critique Ability of Large Language Models
por: Li, Jinzhe, et al.
Publicado: (2025)
por: Li, Jinzhe, et al.
Publicado: (2025)
Evaluating Chinese Ambiguity Understanding in Large Language Models
por: Mo, Junwen, et al.
Publicado: (2026)
por: Mo, Junwen, et al.
Publicado: (2026)
C-LLM: Learn to Check Chinese Spelling Errors Character by Character
por: Li, Kunting, et al.
Publicado: (2024)
por: Li, Kunting, et al.
Publicado: (2024)
Counting Ability of Large Language Models and Impact of Tokenization
por: Zhang, Xiang, et al.
Publicado: (2024)
por: Zhang, Xiang, et al.
Publicado: (2024)
ICLEval: Evaluating In-Context Learning Ability of Large Language Models
por: Chen, Wentong, et al.
Publicado: (2024)
por: Chen, Wentong, et al.
Publicado: (2024)
ChineseSafe: A Chinese Benchmark for Evaluating Safety in Large Language Models
por: Zhang, Hengxiang, et al.
Publicado: (2024)
por: Zhang, Hengxiang, et al.
Publicado: (2024)
CharacterEval: A Chinese Benchmark for Role-Playing Conversational Agent Evaluation
por: Tu, Quan, et al.
Publicado: (2024)
por: Tu, Quan, et al.
Publicado: (2024)
CharacterBench: Benchmarking Character Customization of Large Language Models
por: Zhou, Jinfeng, et al.
Publicado: (2024)
por: Zhou, Jinfeng, et al.
Publicado: (2024)
Where is the multimodal goal post? On the Ability of Foundation Models to Recognize Contextually Important Moments
por: Surikuchi, Aditya K, et al.
Publicado: (2026)
por: Surikuchi, Aditya K, et al.
Publicado: (2026)
MedEthicEval: Evaluating Large Language Models Based on Chinese Medical Ethics
por: Jin, Haoan, et al.
Publicado: (2025)
por: Jin, Haoan, et al.
Publicado: (2025)
Impact of Non-Standard Unicode Characters on Security and Comprehension in Large Language Models
por: Daniel, Johan S, et al.
Publicado: (2024)
por: Daniel, Johan S, et al.
Publicado: (2024)
NesTools: A Dataset for Evaluating Nested Tool Learning Abilities of Large Language Models
por: Han, Han, et al.
Publicado: (2024)
por: Han, Han, et al.
Publicado: (2024)
Evaluating the Ability of Large Language Models to Reason about Cardinal Directions
por: Cohn, Anthony G, et al.
Publicado: (2024)
por: Cohn, Anthony G, et al.
Publicado: (2024)
Enhancing Multimodal Large Language Models for Ancient Chinese Character Evolution Analysis via Glyph-Driven Fine-Tuning
por: Song, Rui, et al.
Publicado: (2026)
por: Song, Rui, et al.
Publicado: (2026)
ImpRAG: Retrieval-Augmented Generation with Implicit Queries
por: Zhang, Wenzheng, et al.
Publicado: (2025)
por: Zhang, Wenzheng, et al.
Publicado: (2025)
Evaluating Language Model Character Traits
por: Ward, Francis Rhys, et al.
Publicado: (2024)
por: Ward, Francis Rhys, et al.
Publicado: (2024)
Evaluating the Ability of Large Language Models to Identify Adherence to CONSORT Reporting Guidelines in Randomized Controlled Trials: A Methodological Evaluation Study
por: He, Zhichao, et al.
Publicado: (2025)
por: He, Zhichao, et al.
Publicado: (2025)
Defining and Evaluating Visual Language Models' Basic Spatial Abilities: A Perspective from Psychometrics
por: Xu, Wenrui, et al.
Publicado: (2025)
por: Xu, Wenrui, et al.
Publicado: (2025)
Model Editing Harms General Abilities of Large Language Models: Regularization to the Rescue
por: Gu, Jia-Chen, et al.
Publicado: (2024)
por: Gu, Jia-Chen, et al.
Publicado: (2024)
Evaluation of Instruction-Following Ability for Large Language Models on Story-Ending Generation
por: Hida, Rem, et al.
Publicado: (2024)
por: Hida, Rem, et al.
Publicado: (2024)
Evaluating the Ability of Large Language Models to Reason about Cardinal Directions, Revisited
por: Cohn, Anthony G, et al.
Publicado: (2025)
por: Cohn, Anthony G, et al.
Publicado: (2025)
The GaoYao Benchmark: A Comprehensive Framework for Evaluating Multilingual and Multicultural Abilities of Large Language Models
por: Liu, Yilun, et al.
Publicado: (2026)
por: Liu, Yilun, et al.
Publicado: (2026)
InFoBench: Evaluating Instruction Following Ability in Large Language Models
por: Qin, Yiwei, et al.
Publicado: (2024)
por: Qin, Yiwei, et al.
Publicado: (2024)
Evaluating and Advancing Multimodal Large Language Models in Perception Ability Lens
por: Chen, Feng, et al.
Publicado: (2024)
por: Chen, Feng, et al.
Publicado: (2024)
Chinese SimpleQA: A Chinese Factuality Evaluation for Large Language Models
por: He, Yancheng, et al.
Publicado: (2024)
por: He, Yancheng, et al.
Publicado: (2024)
CRENER: A Character Relation Enhanced Chinese NER Model
por: Qiao, Yaqiong, et al.
Publicado: (2024)
por: Qiao, Yaqiong, et al.
Publicado: (2024)
Evaluating the Capability of Large-scale Language Models on Chinese Grammatical Error Correction Task
por: Qu, Fanyi, et al.
Publicado: (2023)
por: Qu, Fanyi, et al.
Publicado: (2023)
AlignMMBench: Evaluating Chinese Multimodal Alignment in Large Vision-Language Models
por: Wu, Yuhang, et al.
Publicado: (2024)
por: Wu, Yuhang, et al.
Publicado: (2024)
Evaluating the Generation Capabilities of Large Chinese Language Models
por: Zeng, Hui, et al.
Publicado: (2023)
por: Zeng, Hui, et al.
Publicado: (2023)
Beyond Solving Math Quiz: Evaluating the Ability of Large Reasoning Models to Ask for Information
por: Huang, Youcheng, et al.
Publicado: (2025)
por: Huang, Youcheng, et al.
Publicado: (2025)
Ejemplares similares
-
Model Editing by Standard Fine-Tuning
por: Gangadhar, Govind, et al.
Publicado: (2024) -
ReNCE: Learning to Reason by Noise Contrastive Estimation
por: Zhang, Wenzheng, et al.
Publicado: (2026) -
Evaluating LLMs on Chinese Idiom Translation
por: Yang, Cai, et al.
Publicado: (2025) -
Evaluating Character Understanding of Large Language Models via Character Profiling from Fictional Works
por: Yuan, Xinfeng, et al.
Publicado: (2024) -
Recognizing Limits: Investigating Infeasibility in Large Language Models
por: Zhang, Wenbo, et al.
Publicado: (2024)