CNMBERT: A Model for Converting Hanyu Pinyin Abbreviations to Chinese Characters
Fuente:
arXiv
Guardado en:
| Autores principales: | Feng, Zishuo, Cao, Feng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
InteChar: A Unified Oracle Bone Character List for Ancient Chinese Language Modeling
por: Diao, Xiaolei, et al.
Publicado: (2025)
por: Diao, Xiaolei, et al.
Publicado: (2025)
Bayesian Optimization for Enhanced Language Models: Optimizing Acquisition Functions
por: Bao, Zishuo, et al.
Publicado: (2025)
por: Bao, Zishuo, et al.
Publicado: (2025)
Ask-EDA: A Design Assistant Empowered by LLM, Hybrid RAG and Abbreviation De-hallucination
por: Shi, Luyao, et al.
Publicado: (2024)
por: Shi, Luyao, et al.
Publicado: (2024)
DISC: Plug-and-Play Decoding Intervention with Similarity of Characters for Chinese Spelling Check
por: Qiao, Ziheng, et al.
Publicado: (2024)
por: Qiao, Ziheng, et al.
Publicado: (2024)
BaiJia: A Large-Scale Role-Playing Agent Corpus of Chinese Historical Characters
por: Bai, Ting, et al.
Publicado: (2024)
por: Bai, Ting, et al.
Publicado: (2024)
Enhancing Multimodal Large Language Models for Ancient Chinese Character Evolution Analysis via Glyph-Driven Fine-Tuning
por: Song, Rui, et al.
Publicado: (2026)
por: Song, Rui, et al.
Publicado: (2026)
Quantifying Self-diagnostic Atomic Knowledge in Chinese Medical Foundation Model: A Computational Analysis
por: Fan, Yaxin, et al.
Publicado: (2023)
por: Fan, Yaxin, et al.
Publicado: (2023)
Reasoning Up the Instruction Ladder for Controllable Language Models
por: Zheng, Zishuo, et al.
Publicado: (2025)
por: Zheng, Zishuo, et al.
Publicado: (2025)
LawGPT: A Chinese Legal Knowledge-Enhanced Large Language Model
por: Zhou, Zhi, et al.
Publicado: (2024)
por: Zhou, Zhi, et al.
Publicado: (2024)
Convert Language Model into a Value-based Strategic Planner
por: Wang, Xiaoyu, et al.
Publicado: (2025)
por: Wang, Xiaoyu, et al.
Publicado: (2025)
From Language Models over Tokens to Language Models over Characters
por: Vieira, Tim, et al.
Publicado: (2024)
por: Vieira, Tim, et al.
Publicado: (2024)
The Joint Entity-Relation Extraction Model Based on Span and Interactive Fusion Representation for Chinese Medical Texts with Complex Semantics
por: Feng, Danni, et al.
Publicado: (2025)
por: Feng, Danni, et al.
Publicado: (2025)
InsQABench: Benchmarking Chinese Insurance Domain Question Answering with Large Language Models
por: Ding, Jing, et al.
Publicado: (2025)
por: Ding, Jing, et al.
Publicado: (2025)
FormalASR: End-to-End Spoken Chinese to Formal Text
por: Ning, Wanyi, et al.
Publicado: (2026)
por: Ning, Wanyi, et al.
Publicado: (2026)
CMB: A Comprehensive Medical Benchmark in Chinese
por: Wang, Xidong, et al.
Publicado: (2023)
por: Wang, Xidong, et al.
Publicado: (2023)
Stress-Testing Model Specs Reveals Character Differences among Language Models
por: Zhang, Jifan, et al.
Publicado: (2025)
por: Zhang, Jifan, et al.
Publicado: (2025)
Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan
por: Yao, Jui-Ming, et al.
Publicado: (2025)
por: Yao, Jui-Ming, et al.
Publicado: (2025)
CMMaTH: A Chinese Multi-modal Math Skill Evaluation Benchmark for Foundation Models
por: Li, Zhong-Zhi, et al.
Publicado: (2024)
por: Li, Zhong-Zhi, et al.
Publicado: (2024)
CFEVER: A Chinese Fact Extraction and VERification Dataset
por: Lin, Ying-Jia, et al.
Publicado: (2024)
por: Lin, Ying-Jia, et al.
Publicado: (2024)
Sequence-to-Sequence Language Models for Character and Emotion Detection in Dream Narratives
por: Cortal, Gustave
Publicado: (2024)
por: Cortal, Gustave
Publicado: (2024)
Leveraging Large Language Models for Active Merchant Non-player Characters
por: Kim, Byungjun, et al.
Publicado: (2024)
por: Kim, Byungjun, et al.
Publicado: (2024)
Counterfactual Probing for Hallucination Detection and Mitigation in Large Language Models
por: Feng, Yijun
Publicado: (2025)
por: Feng, Yijun
Publicado: (2025)
Falcon: A Comprehensive Chinese Text-to-SQL Benchmark for Enterprise-Grade Evaluation
por: Luo, Wenzhen, et al.
Publicado: (2025)
por: Luo, Wenzhen, et al.
Publicado: (2025)
Benchmarking Chinese Commonsense Reasoning with a Multi-hop Reasoning Perspective
por: You, Wangjie, et al.
Publicado: (2025)
por: You, Wangjie, et al.
Publicado: (2025)
CT2C-QA: Multimodal Question Answering over Chinese Text, Table and Chart
por: Zhao, Bowen, et al.
Publicado: (2024)
por: Zhao, Bowen, et al.
Publicado: (2024)
Advancing Topic Segmentation and Outline Generation in Chinese Texts: The Paragraph-level Topic Representation, Corpus, and Benchmark
por: Jiang, Feng, et al.
Publicado: (2023)
por: Jiang, Feng, et al.
Publicado: (2023)
Generating Visual Stories with Grounded and Coreferent Characters
por: Liu, Danyang, et al.
Publicado: (2024)
por: Liu, Danyang, et al.
Publicado: (2024)
Chinese SafetyQA: A Safety Short-form Factuality Benchmark for Large Language Models
por: Tan, Yingshui, et al.
Publicado: (2024)
por: Tan, Yingshui, et al.
Publicado: (2024)
IW-Bench: Evaluating Large Multimodal Models for Converting Image-to-Web
por: Guo, Hongcheng, et al.
Publicado: (2024)
por: Guo, Hongcheng, et al.
Publicado: (2024)
Chinese Tiny LLM: Pretraining a Chinese-Centric Large Language Model
por: Du, Xinrun, et al.
Publicado: (2024)
por: Du, Xinrun, et al.
Publicado: (2024)
The Granularity Axis: A Micro-to-Macro Latent Direction for Social Roles in Language Models
por: Qin, Chonghan, et al.
Publicado: (2026)
por: Qin, Chonghan, et al.
Publicado: (2026)
CharacterGPT: A Persona Reconstruction Framework for Role-Playing Agents
por: Park, Jeiyoon, et al.
Publicado: (2024)
por: Park, Jeiyoon, et al.
Publicado: (2024)
A Single Character can Make or Break Your LLM Evals
por: Su, Jingtong, et al.
Publicado: (2025)
por: Su, Jingtong, et al.
Publicado: (2025)
LCS: A Language Converter Strategy for Zero-Shot Neural Machine Translation
por: Sun, Zengkui, et al.
Publicado: (2024)
por: Sun, Zengkui, et al.
Publicado: (2024)
LightHouse: A Survey of AGI Hallucination
por: Wang, Feng
Publicado: (2024)
por: Wang, Feng
Publicado: (2024)
Evaluating Reward Model Generalization via Pairwise Maximum Discrepancy Competitions
por: Luo, Shunyang, et al.
Publicado: (2026)
por: Luo, Shunyang, et al.
Publicado: (2026)
Token Alignment via Character Matching for Subword Completion
por: Athiwaratkun, Ben, et al.
Publicado: (2024)
por: Athiwaratkun, Ben, et al.
Publicado: (2024)
Converting Annotated Clinical Cases into Structured Case Report Forms
por: Ferrazzi, Pietro, et al.
Publicado: (2025)
por: Ferrazzi, Pietro, et al.
Publicado: (2025)
An Empirical Study of SFT-DPO Interaction and Parameterization in Small Language Models
por: Feng, Yuming, et al.
Publicado: (2026)
por: Feng, Yuming, et al.
Publicado: (2026)
Robust Prompt Optimization for Large Language Models Against Distribution Shifts
por: Li, Moxin, et al.
Publicado: (2023)
por: Li, Moxin, et al.
Publicado: (2023)
Ejemplares similares
-
InteChar: A Unified Oracle Bone Character List for Ancient Chinese Language Modeling
por: Diao, Xiaolei, et al.
Publicado: (2025) -
Bayesian Optimization for Enhanced Language Models: Optimizing Acquisition Functions
por: Bao, Zishuo, et al.
Publicado: (2025) -
Ask-EDA: A Design Assistant Empowered by LLM, Hybrid RAG and Abbreviation De-hallucination
por: Shi, Luyao, et al.
Publicado: (2024) -
DISC: Plug-and-Play Decoding Intervention with Similarity of Characters for Chinese Spelling Check
por: Qiao, Ziheng, et al.
Publicado: (2024) -
BaiJia: A Large-Scale Role-Playing Agent Corpus of Chinese Historical Characters
por: Bai, Ting, et al.
Publicado: (2024)