Chinese Word Boundary Recovery through Character Alignment Projection
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Lusha, Li, Yuchen, Yuan, Su, Park, Jungyeul |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Parsing Through Boundaries in Chinese Word Segmentation
par: Chen, Yige, et autres
Publié: (2025)
par: Chen, Yige, et autres
Publié: (2025)
Proposing TAGbank as a Corpus of Tree-Adjoining Grammar Derivations
par: Park, Jungyeul
Publié: (2025)
par: Park, Jungyeul
Publié: (2025)
Foundations and Evaluations in NLP
par: Park, Jungyeul
Publié: (2025)
par: Park, Jungyeul
Publié: (2025)
jp-evalb: Robust Alignment-based PARSEVAL Measures
par: Park, Jungyeul, et autres
Publié: (2024)
par: Park, Jungyeul, et autres
Publié: (2024)
A gentle tutorial and a structured reformulation of Bock's algorithm for minimum directed spanning trees
par: Wang, Yuxi, et autres
Publié: (2026)
par: Wang, Yuxi, et autres
Publié: (2026)
Constituency Structure over Eojeol in Korean Treebanks
par: Park, Jungyeul, et autres
Publié: (2025)
par: Park, Jungyeul, et autres
Publié: (2025)
Frustratingly Simple Prompting-based Text Denoising
par: Park, Jungyeul, et autres
Publié: (2024)
par: Park, Jungyeul, et autres
Publié: (2024)
Word Recovery in Large Language Models Enables Character-Level Tokenization Robustness
par: Yang, Zhipeng, et autres
Publié: (2026)
par: Yang, Zhipeng, et autres
Publié: (2026)
Character-Level Chinese Dependency Parsing via Modeling Latent Intra-Word Structure
par: Hou, Yang, et autres
Publié: (2024)
par: Hou, Yang, et autres
Publié: (2024)
Mining Word Boundaries from Speech-Text Parallel Data for Cross-domain Chinese Word Segmentation
par: Wang, Xuebin, et autres
Publié: (2024)
par: Wang, Xuebin, et autres
Publié: (2024)
Refining Word-Based Grammatical Error Annotation for L2 Korean
par: Park, Jungyeul, et autres
Publié: (2026)
par: Park, Jungyeul, et autres
Publié: (2026)
Punctuation-aware treebank tree binarization
par: Klinger, Eitan, et autres
Publié: (2025)
par: Klinger, Eitan, et autres
Publié: (2025)
ylmmcl at Multilingual Text Detoxification 2025: Lexicon-Guided Detoxification and Classifier-Gated Rewriting
par: Lai-Lopez, Nicole, et autres
Publié: (2025)
par: Lai-Lopez, Nicole, et autres
Publié: (2025)
Chinese Grammatical Error Correction: A Survey
par: Qiu, Mengyang, et autres
Publié: (2025)
par: Qiu, Mengyang, et autres
Publié: (2025)
Comparative Analysis of Extrinsic Factors for NER in French
par: Yang, Grace, et autres
Publié: (2024)
par: Yang, Grace, et autres
Publié: (2024)
A tree interpretation of arc standard dependency derivation
par: Huang, Zihao, et autres
Publié: (2026)
par: Huang, Zihao, et autres
Publié: (2026)
Enriching the Korean Learner Corpus with Multi-reference Annotations and Rubric-Based Scoring
par: Song, Jayoung, et autres
Publié: (2025)
par: Song, Jayoung, et autres
Publié: (2025)
Korean Named Entity Recognition Based on Language-Specific Features
par: Chen, Yige, et autres
Publié: (2023)
par: Chen, Yige, et autres
Publié: (2023)
C-LLM: Learn to Check Chinese Spelling Errors Character by Character
par: Li, Kunting, et autres
Publié: (2024)
par: Li, Kunting, et autres
Publié: (2024)
Token Alignment via Character Matching for Subword Completion
par: Athiwaratkun, Ben, et autres
Publié: (2024)
par: Athiwaratkun, Ben, et autres
Publié: (2024)
Enhancing Korean Dependency Parsing with Morphosyntactic Features
par: Park, Jungyeul, et autres
Publié: (2025)
par: Park, Jungyeul, et autres
Publié: (2025)
Selecting Seed Words for Wordle using Character Statistics
par: de Silva, Nisansa
Publié: (2022)
par: de Silva, Nisansa
Publié: (2022)
Better heads do not guarantee better binarized constituency parsing
par: Qi, Zeyao, et autres
Publié: (2026)
par: Qi, Zeyao, et autres
Publié: (2026)
Evaluating Prompting Strategies for Grammatical Error Correction Based on Language Proficiency
par: Zeng, Min, et autres
Publié: (2024)
par: Zeng, Min, et autres
Publié: (2024)
Large Language Models Lack Understanding of Character Composition of Words
par: Shin, Andrew, et autres
Publié: (2024)
par: Shin, Andrew, et autres
Publié: (2024)
Learning Constituent Headedness
par: Qi, Zeyao, et autres
Publié: (2026)
par: Qi, Zeyao, et autres
Publié: (2026)
Exploring the Capability Boundaries of LLMs in Mastering of Chinese Chouxiang Language
par: Lin, Dianqing, et autres
Publié: (2026)
par: Lin, Dianqing, et autres
Publié: (2026)
K-UD: Revising Korean Universal Dependencies Guidelines
par: Kim, Kyuwon, et autres
Publié: (2024)
par: Kim, Kyuwon, et autres
Publié: (2024)
Revisiting Absence withSymptoms that *T* Show up Decades Later to Recover Empty Categories
par: Chen, Emily, et autres
Publié: (2024)
par: Chen, Emily, et autres
Publié: (2024)
Chinese ModernBERT with Whole-Word Masking
par: Zhao, Zeyu, et autres
Publié: (2025)
par: Zhao, Zeyu, et autres
Publié: (2025)
Eliciting Trustworthiness Priors of Large Language Models via Economic Games
par: Yan, Siyu, et autres
Publié: (2026)
par: Yan, Siyu, et autres
Publié: (2026)
A Training-free LLM-based Approach to General Chinese Character Error Correction
par: Zhou, Houquan, et autres
Publié: (2025)
par: Zhou, Houquan, et autres
Publié: (2025)
Evaluating Character Understanding of Large Language Models via Character Profiling from Fictional Works
par: Yuan, Xinfeng, et autres
Publié: (2024)
par: Yuan, Xinfeng, et autres
Publié: (2024)
Safety Alignment as Continual Learning: Mitigating the Alignment Tax via Orthogonal Gradient Projection
par: Sun, Guanglong, et autres
Publié: (2026)
par: Sun, Guanglong, et autres
Publié: (2026)
Single Character Perturbations Break LLM Alignment
par: Lin, Leon, et autres
Publié: (2024)
par: Lin, Leon, et autres
Publié: (2024)
Cross-Lingual Word Alignment for ASEAN Languages with Contrastive Learning
par: Zhang, Jingshen, et autres
Publié: (2024)
par: Zhang, Jingshen, et autres
Publié: (2024)
InCharacter: Evaluating Personality Fidelity in Role-Playing Agents through Psychological Interviews
par: Wang, Xintao, et autres
Publié: (2023)
par: Wang, Xintao, et autres
Publié: (2023)
Word Segmentation for Asian Languages: Chinese, Korean, and Japanese
par: Rho, Matthew, et autres
Publié: (2024)
par: Rho, Matthew, et autres
Publié: (2024)
Word Boundary Information Isn't Useful for Encoder Language Models
par: Gow-Smith, Edward, et autres
Publié: (2024)
par: Gow-Smith, Edward, et autres
Publié: (2024)
Word Alignment-Based Evaluation of Uniform Meaning Representations
par: Zeman, Daniel, et autres
Publié: (2026)
par: Zeman, Daniel, et autres
Publié: (2026)
Documents similaires
-
Parsing Through Boundaries in Chinese Word Segmentation
par: Chen, Yige, et autres
Publié: (2025) -
Proposing TAGbank as a Corpus of Tree-Adjoining Grammar Derivations
par: Park, Jungyeul
Publié: (2025) -
Foundations and Evaluations in NLP
par: Park, Jungyeul
Publié: (2025) -
jp-evalb: Robust Alignment-based PARSEVAL Measures
par: Park, Jungyeul, et autres
Publié: (2024) -
A gentle tutorial and a structured reformulation of Bock's algorithm for minimum directed spanning trees
par: Wang, Yuxi, et autres
Publié: (2026)