Building Tamil Treebanks
Fuente:
arXiv
Guardado en:
| Autor principal: | Sarveswaran, Kengatharaiyer |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Morphology and Syntax of the Tamil Language
por: Sarveswaran, Kengatharaiyer
Publicado: (2024)
por: Sarveswaran, Kengatharaiyer
Publicado: (2024)
Tamil Language Computing: the Present and the Future
por: Sarveswaran, Kengatharaiyer
Publicado: (2024)
por: Sarveswaran, Kengatharaiyer
Publicado: (2024)
From Phonemes to Meaning: Evaluating Large Language Models on Tamil
por: Varsha, Jeyarajalingam, et al.
Publicado: (2025)
por: Varsha, Jeyarajalingam, et al.
Publicado: (2025)
Egalitarian Language Representation in Language Models: It All Begins with Tokenizers
por: Velayuthan, Menan, et al.
Publicado: (2024)
por: Velayuthan, Menan, et al.
Publicado: (2024)
Thai Universal Dependency Treebank
por: Sriwirote, Panyut, et al.
Publicado: (2024)
por: Sriwirote, Panyut, et al.
Publicado: (2024)
A UD Treebank for Bohairic Coptic
por: Zeldes, Amir, et al.
Publicado: (2025)
por: Zeldes, Amir, et al.
Publicado: (2025)
Constituency Structure over Eojeol in Korean Treebanks
por: Park, Jungyeul, et al.
Publicado: (2025)
por: Park, Jungyeul, et al.
Publicado: (2025)
Syntactic Transfer to Kyrgyz Using the Treebank Translation Method
por: Alekseev, Anton, et al.
Publicado: (2024)
por: Alekseev, Anton, et al.
Publicado: (2024)
LuxBank: The First Universal Dependency Treebank for Luxembourgish
por: Plum, Alistair, et al.
Publicado: (2024)
por: Plum, Alistair, et al.
Publicado: (2024)
Latin Treebanks in Review: An Evaluation of Morphological Tagging Across Time
por: Hudspeth, Marisa, et al.
Publicado: (2024)
por: Hudspeth, Marisa, et al.
Publicado: (2024)
Towards the first UD Treebank of Spoken Italian: the KIParla forest
por: Pannitto, Ludovica
Publicado: (2024)
por: Pannitto, Ludovica
Publicado: (2024)
Bridging Discourse Treebanks with a Unified Rhetorical Structure Parser
por: Chistova, Elena
Publicado: (2025)
por: Chistova, Elena
Publicado: (2025)
MaiBaam: A Multi-Dialectal Bavarian Universal Dependency Treebank
por: Blaschke, Verena, et al.
Publicado: (2024)
por: Blaschke, Verena, et al.
Publicado: (2024)
Aligning the Norwegian UD Treebank with Entity and Coreference Information
por: Jørgensen, Tollef Emil, et al.
Publicado: (2023)
por: Jørgensen, Tollef Emil, et al.
Publicado: (2023)
Contrastive Learning on LLM Back Generation Treebank for Cross-domain Constituency Parsing
por: Guo, Peiming, et al.
Publicado: (2025)
por: Guo, Peiming, et al.
Publicado: (2025)
Enriching the NArabizi Treebank: A Multifaceted Approach to Supporting an Under-Resourced Language
por: Riabi, Arij, et al.
Publicado: (2023)
por: Riabi, Arij, et al.
Publicado: (2023)
Urdu Dependency Parsing and Treebank Development: A Syntactic and Morphological Perspective
por: Habib, Nudrat
Publicado: (2024)
por: Habib, Nudrat
Publicado: (2024)
Sparse Logistic Regression with High-order Features for Automatic Grammar Rule Extraction from Treebanks
por: Herrera, Santiago, et al.
Publicado: (2024)
por: Herrera, Santiago, et al.
Publicado: (2024)
Multilingual Nonce Dependency Treebanks: Understanding how Language Models represent and process syntactic structure
por: Arps, David, et al.
Publicado: (2023)
por: Arps, David, et al.
Publicado: (2023)
The UD-NewsCrawl Treebank: Reflections and Challenges from a Large-scale Tagalog Syntactic Annotation Project
por: Aquino, Angelina A., et al.
Publicado: (2025)
por: Aquino, Angelina A., et al.
Publicado: (2025)
UD-KSL Treebank v1.3: A semi-automated framework for aligning XPOS-extracted units with UPOS tags
por: Sung, Hakyung, et al.
Publicado: (2025)
por: Sung, Hakyung, et al.
Publicado: (2025)
Literary and Colloquial Tamil Dialect Identification
por: Nanmalar, M., et al.
Publicado: (2024)
por: Nanmalar, M., et al.
Publicado: (2024)
A Multi-way Parallel Named Entity Annotated Corpus for English, Tamil and Sinhala
por: Ranathunga, Surangika, et al.
Publicado: (2024)
por: Ranathunga, Surangika, et al.
Publicado: (2024)
Breaking the Silence Detecting and Mitigating Gendered Abuse in Hindi, Tamil, and Indian English Online Spaces
por: Vetagiri, Advaitha, et al.
Publicado: (2024)
por: Vetagiri, Advaitha, et al.
Publicado: (2024)
Zero-shot OCR Accuracy of Low-Resourced Languages: A Comparative Analysis on Sinhala and Tamil
por: Jayatilleke, Nevidu, et al.
Publicado: (2025)
por: Jayatilleke, Nevidu, et al.
Publicado: (2025)
Advancing Sentiment Analysis in Tamil-English Code-Mixed Texts: Challenges and Transformer-Based Solutions
por: Krasitskii, Mikhail, et al.
Publicado: (2025)
por: Krasitskii, Mikhail, et al.
Publicado: (2025)
EnTaCs: Analyzing the Relationship Between Sentiment and Language Choice in English-Tamil Code-Switching
por: Bontempo, Paul
Publicado: (2026)
por: Bontempo, Paul
Publicado: (2026)
Large Language Models for Math Education in Low-Resource Languages: A Study in Sinhala and Tamil
por: Kishanthan, Sukumar, et al.
Publicado: (2026)
por: Kishanthan, Sukumar, et al.
Publicado: (2026)
Publishing Journal Articles: 5 Tips for Success
por: Kengatharaiyer Sarveswaran, et al.
Publicado: (2025)
por: Kengatharaiyer Sarveswaran, et al.
Publicado: (2025)
Data-driven Coreference-based Ontology Building
por: Ashury-Tahan, Shir, et al.
Publicado: (2024)
por: Ashury-Tahan, Shir, et al.
Publicado: (2024)
Towards Building Multilingual Language Model for Medicine
por: Qiu, Pengcheng, et al.
Publicado: (2024)
por: Qiu, Pengcheng, et al.
Publicado: (2024)
UltraMedical: Building Specialized Generalists in Biomedicine
por: Zhang, Kaiyan, et al.
Publicado: (2024)
por: Zhang, Kaiyan, et al.
Publicado: (2024)
Building UD Cairo for Old English in the Classroom
por: Levine, Lauren, et al.
Publicado: (2025)
por: Levine, Lauren, et al.
Publicado: (2025)
Adaptive In-conversation Team Building for Language Model Agents
por: Song, Linxin, et al.
Publicado: (2024)
por: Song, Linxin, et al.
Publicado: (2024)
Building Knowledge-Guided Lexica to Model Cultural Variation
por: Havaldar, Shreya, et al.
Publicado: (2024)
por: Havaldar, Shreya, et al.
Publicado: (2024)
REInstruct: Building Instruction Data from Unlabeled Corpus
por: Chen, Shu, et al.
Publicado: (2024)
por: Chen, Shu, et al.
Publicado: (2024)
Building a Functional Machine Translation Corpus for Kpelle
por: Yamoah, Kweku Andoh, et al.
Publicado: (2025)
por: Yamoah, Kweku Andoh, et al.
Publicado: (2025)
MMWOZ: Building Multimodal Agent for Task-oriented Dialogue
por: Yang, Pu-Hai, et al.
Publicado: (2025)
por: Yang, Pu-Hai, et al.
Publicado: (2025)
Tradutor: Building a Variety Specific Translation Model
por: Sousa, Hugo, et al.
Publicado: (2025)
por: Sousa, Hugo, et al.
Publicado: (2025)
When in Doubt, Cascade: Towards Building Efficient and Capable Guardrails
por: Nagireddy, Manish, et al.
Publicado: (2024)
por: Nagireddy, Manish, et al.
Publicado: (2024)
Ejemplares similares
-
Morphology and Syntax of the Tamil Language
por: Sarveswaran, Kengatharaiyer
Publicado: (2024) -
Tamil Language Computing: the Present and the Future
por: Sarveswaran, Kengatharaiyer
Publicado: (2024) -
From Phonemes to Meaning: Evaluating Large Language Models on Tamil
por: Varsha, Jeyarajalingam, et al.
Publicado: (2025) -
Egalitarian Language Representation in Language Models: It All Begins with Tokenizers
por: Velayuthan, Menan, et al.
Publicado: (2024) -
Thai Universal Dependency Treebank
por: Sriwirote, Panyut, et al.
Publicado: (2024)