XSTEM: An exemplar-based stemming algorithm
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Baker, Kirk |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
From exemplar to copy: the scribal appropriation of a Hadewijch manuscript computationally explored
par: Haverals, Wouter, et autres
Publié: (2022)
par: Haverals, Wouter, et autres
Publié: (2022)
How well do Large Language Models Recognize Instructional Moves? Establishing Baselines for Foundation Models in Educational Discourse
par: Vanacore, Kirk, et autres
Publié: (2025)
par: Vanacore, Kirk, et autres
Publié: (2025)
Lexical categories of stem-forming roots in Mapudüngun verb forms
par: Chandía, Andrés
Publié: (2025)
par: Chandía, Andrés
Publié: (2025)
Leveraging Large Language Models for Knowledge-free Weak Supervision in Clinical Natural Language Processing
par: Hsu, Enshuo, et autres
Publié: (2024)
par: Hsu, Enshuo, et autres
Publié: (2024)
LIDDIA: Language-based Intelligent Drug Discovery Agent
par: Averly, Reza, et autres
Publié: (2025)
par: Averly, Reza, et autres
Publié: (2025)
Text classification optimization algorithm based on graph neural network
par: Gao, Erdi, et autres
Publié: (2024)
par: Gao, Erdi, et autres
Publié: (2024)
Measuring and Mitigating Persona Distortions from AI Writing Assistance
par: Röttger, Paul, et autres
Publié: (2026)
par: Röttger, Paul, et autres
Publié: (2026)
Large Language Model (LLM) AI text generation detection based on transformer deep learning algorithm
par: Mo, Yuhong, et autres
Publié: (2024)
par: Mo, Yuhong, et autres
Publié: (2024)
Gender-Neutral Large Language Models for Medical Applications: Reducing Bias in PubMed Abstracts
par: Schaefer, Elizabeth, et autres
Publié: (2025)
par: Schaefer, Elizabeth, et autres
Publié: (2025)
MALAMUTE: A Multilingual, Highly-granular, Template-free, Education-based Probing Dataset
par: Shaier, Sagi, et autres
Publié: (2024)
par: Shaier, Sagi, et autres
Publié: (2024)
Multilingual != Multicultural: Evaluating Gaps Between Multilingual Capabilities and Cultural Alignment in LLMs
par: Rystrøm, Jonathan, et autres
Publié: (2025)
par: Rystrøm, Jonathan, et autres
Publié: (2025)
On the performance of phonetic algorithms in microtext normalization
par: Doval, Yerai, et autres
Publié: (2024)
par: Doval, Yerai, et autres
Publié: (2024)
Tutor Move Taxonomy: A Theory-Aligned Framework for Analyzing Instructional Moves in Tutoring
par: Zhou, Zhuqian, et autres
Publié: (2026)
par: Zhou, Zhuqian, et autres
Publié: (2026)
LLM Reasoning Predicts When Models Are Right: Evidence from Coding Classroom Discourse
par: Ahtisham, Bakhtawar, et autres
Publié: (2026)
par: Ahtisham, Bakhtawar, et autres
Publié: (2026)
A Comparative Study of Recent Large Language Models on Generating Hospital Discharge Summaries for Lung Cancer Patients
par: Li, Yiming, et autres
Publié: (2024)
par: Li, Yiming, et autres
Publié: (2024)
Classifying populist language in American presidential and governor speeches using automatic text analysis
par: van der Veen, Olaf, et autres
Publié: (2024)
par: van der Veen, Olaf, et autres
Publié: (2024)
Dataset Featurization: Uncovering Natural Language Features through Unsupervised Data Reconstruction
par: Bravansky, Michal, et autres
Publié: (2025)
par: Bravansky, Michal, et autres
Publié: (2025)
Simulating The U.S. Senate: An LLM-Driven Agent Approach to Modeling Legislative Behavior and Bipartisanship
par: Baker, Zachary R., et autres
Publié: (2024)
par: Baker, Zachary R., et autres
Publié: (2024)
MASSIVE Multilingual Abstract Meaning Representation: A Dataset and Baselines for Hallucination Detection
par: Regan, Michael, et autres
Publié: (2024)
par: Regan, Michael, et autres
Publié: (2024)
Reward Model Overoptimisation in Iterated RLHF
par: Wolf, Lorenz, et autres
Publié: (2025)
par: Wolf, Lorenz, et autres
Publié: (2025)
A symbolic Perl algorithm for the unification of Nahuatl word spellings
par: Guzmán-Landa, Juan-José, et autres
Publié: (2025)
par: Guzmán-Landa, Juan-José, et autres
Publié: (2025)
Indian-BhED: A Dataset for Measuring India-Centric Biases in Large Language Models
par: Khandelwal, Khyati, et autres
Publié: (2023)
par: Khandelwal, Khyati, et autres
Publié: (2023)
Beyond the Binary: Capturing Diverse Preferences With Reward Regularization
par: Padmakumar, Vishakh, et autres
Publié: (2024)
par: Padmakumar, Vishakh, et autres
Publié: (2024)
Automatically Learning Construction Injury Precursors from Text
par: Baker, Henrietta, et autres
Publié: (2019)
par: Baker, Henrietta, et autres
Publié: (2019)
Almost Clinical: Linguistic properties of synthetic electronic health records
par: Sharoff, Serge, et autres
Publié: (2026)
par: Sharoff, Serge, et autres
Publié: (2026)
D3CODE: Disentangling Disagreements in Data across Cultures on Offensiveness Detection and Evaluation
par: Davani, Aida Mostafazadeh, et autres
Publié: (2024)
par: Davani, Aida Mostafazadeh, et autres
Publié: (2024)
Using Large Language Models to Generate Clinical Trial Tables and Figures
par: Yang, Yumeng, et autres
Publié: (2024)
par: Yang, Yumeng, et autres
Publié: (2024)
Exploring Knowledge Tracing in Tutor-Student Dialogues using LLMs
par: Scarlatos, Alexander, et autres
Publié: (2024)
par: Scarlatos, Alexander, et autres
Publié: (2024)
Propensity Inference: Environmental Contributors to LLM Behaviour
par: Järviniemi, Olli, et autres
Publié: (2026)
par: Järviniemi, Olli, et autres
Publié: (2026)
Mechanistic Exploration of Backdoored Large Language Model Attention Patterns
par: Baker, Mohammed Abu, et autres
Publié: (2025)
par: Baker, Mohammed Abu, et autres
Publié: (2025)
SimpleSafetyTests: a Test Suite for Identifying Critical Safety Risks in Large Language Models
par: Vidgen, Bertie, et autres
Publié: (2023)
par: Vidgen, Bertie, et autres
Publié: (2023)
Domain-Adapted Retrieval for In-Context Annotation of Pedagogical Dialogue Acts
par: Lee, Jinsook, et autres
Publié: (2026)
par: Lee, Jinsook, et autres
Publié: (2026)
A gentle tutorial and a structured reformulation of Bock's algorithm for minimum directed spanning trees
par: Wang, Yuxi, et autres
Publié: (2026)
par: Wang, Yuxi, et autres
Publié: (2026)
A chart review process aided by natural language processing and multi-wave adaptive sampling to expedite validation of code-based algorithms for large database studies
par: Wang, Shirley V, et autres
Publié: (2025)
par: Wang, Shirley V, et autres
Publié: (2025)
Investigating Non-Transitivity in LLM-as-a-Judge
par: Xu, Yi, et autres
Publié: (2025)
par: Xu, Yi, et autres
Publié: (2025)
Model Organisms Are Leaky: Perplexity Differencing Often Reveals Finetuning Objectives
par: Baker, Mohammed Abu, et autres
Publié: (2026)
par: Baker, Mohammed Abu, et autres
Publié: (2026)
Basic interactive algorithms: Preview
par: Gurevich, Yuri
Publié: (2025)
par: Gurevich, Yuri
Publié: (2025)
Acquiring Grounded Representations of Words with Situated Interactive Instruction
par: Mohan, Shiwali, et autres
Publié: (2025)
par: Mohan, Shiwali, et autres
Publié: (2025)
A mean teacher algorithm for unlearning of language models
par: Klochkov, Yegor
Publié: (2025)
par: Klochkov, Yegor
Publié: (2025)
Populism Meets AI: Advancing Populism Research with LLMs
par: Jung, Yujin J., et autres
Publié: (2025)
par: Jung, Yujin J., et autres
Publié: (2025)
Documents similaires
-
From exemplar to copy: the scribal appropriation of a Hadewijch manuscript computationally explored
par: Haverals, Wouter, et autres
Publié: (2022) -
How well do Large Language Models Recognize Instructional Moves? Establishing Baselines for Foundation Models in Educational Discourse
par: Vanacore, Kirk, et autres
Publié: (2025) -
Lexical categories of stem-forming roots in Mapudüngun verb forms
par: Chandía, Andrés
Publié: (2025) -
Leveraging Large Language Models for Knowledge-free Weak Supervision in Clinical Natural Language Processing
par: Hsu, Enshuo, et autres
Publié: (2024) -
LIDDIA: Language-based Intelligent Drug Discovery Agent
par: Averly, Reza, et autres
Publié: (2025)