Salvato in:
| Autore principale: | Jabbar, Haris |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2307.07262 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MorphTok: Morphologically Grounded Tokenization for Indian Languages
di: Brahma, Maharaj, et al.
Pubblicazione: (2025)
di: Brahma, Maharaj, et al.
Pubblicazione: (2025)
Towards Linguistically-Aware and Language-Independent Tokenization for Large Language Models (LLMs)
di: Rahman, Abrar, et al.
Pubblicazione: (2024)
di: Rahman, Abrar, et al.
Pubblicazione: (2024)
MorphBPE: A Morpho-Aware Tokenizer Bridging Linguistic Complexity for Efficient LLM Training Across Morphologies
di: Asgari, Ehsaneddin, et al.
Pubblicazione: (2025)
di: Asgari, Ehsaneddin, et al.
Pubblicazione: (2025)
Piecing Together Clues: A Benchmark for Evaluating the Detective Skills of Large Language Models
di: Gu, Zhouhong, et al.
Pubblicazione: (2023)
di: Gu, Zhouhong, et al.
Pubblicazione: (2023)
Personalized Pieces: Efficient Personalized Large Language Models through Collaborative Efforts
di: Tan, Zhaoxuan, et al.
Pubblicazione: (2024)
di: Tan, Zhaoxuan, et al.
Pubblicazione: (2024)
Which Pieces Does Unigram Tokenization Really Need?
di: Land, Sander, et al.
Pubblicazione: (2025)
di: Land, Sander, et al.
Pubblicazione: (2025)
Linguistically Informed Tokenization Improves ASR for Underresourced Languages
di: Daul, Massimo, et al.
Pubblicazione: (2025)
di: Daul, Massimo, et al.
Pubblicazione: (2025)
Linguistic Minimal Pairs Elicit Linguistic Similarity in Large Language Models
di: Zhou, Xinyu, et al.
Pubblicazione: (2024)
di: Zhou, Xinyu, et al.
Pubblicazione: (2024)
How Long Is a Piece of String? A Brief Empirical Analysis of Tokenizers
di: Roberts, Jonathan, et al.
Pubblicazione: (2026)
di: Roberts, Jonathan, et al.
Pubblicazione: (2026)
A Survey on Personalized Alignment -- The Missing Piece for Large Language Models in Real-World Applications
di: Guan, Jian, et al.
Pubblicazione: (2025)
di: Guan, Jian, et al.
Pubblicazione: (2025)
DetectBench: Can Large Language Model Detect and Piece Together Implicit Evidence?
di: Gu, Zhouhong, et al.
Pubblicazione: (2024)
di: Gu, Zhouhong, et al.
Pubblicazione: (2024)
Linguistic Intelligence in Large Language Models for Telecommunications
di: Ahmed, Tasnim, et al.
Pubblicazione: (2024)
di: Ahmed, Tasnim, et al.
Pubblicazione: (2024)
Unveiling Linguistic Regions in Large Language Models
di: Zhang, Zhihao, et al.
Pubblicazione: (2024)
di: Zhang, Zhihao, et al.
Pubblicazione: (2024)
Benchmarking Linguistic Diversity of Large Language Models
di: Guo, Yanzhu, et al.
Pubblicazione: (2024)
di: Guo, Yanzhu, et al.
Pubblicazione: (2024)
Problematic Tokens: Tokenizer Bias in Large Language Models
di: Yang, Jin, et al.
Pubblicazione: (2024)
di: Yang, Jin, et al.
Pubblicazione: (2024)
Multi-Objective Linguistic Control of Large Language Models
di: Nguyen, Dang, et al.
Pubblicazione: (2024)
di: Nguyen, Dang, et al.
Pubblicazione: (2024)
Inductive Linguistic Reasoning with Large Language Models
di: Ramji, Raghav, et al.
Pubblicazione: (2024)
di: Ramji, Raghav, et al.
Pubblicazione: (2024)
Rethinking Tokenization: Crafting Better Tokenizers for Large Language Models
di: Yang, Jinbiao
Pubblicazione: (2024)
di: Yang, Jinbiao
Pubblicazione: (2024)
Brain in a Vat: On Missing Pieces Towards Artificial General Intelligence in Large Language Models
di: Ma, Yuxi, et al.
Pubblicazione: (2023)
di: Ma, Yuxi, et al.
Pubblicazione: (2023)
The Shrinking Landscape of Linguistic Diversity in the Age of Large Language Models
di: Sourati, Zhivar, et al.
Pubblicazione: (2025)
di: Sourati, Zhivar, et al.
Pubblicazione: (2025)
Large Language Models as Proxies for Theories of Human Linguistic Cognition
di: Ziv, Imry, et al.
Pubblicazione: (2025)
di: Ziv, Imry, et al.
Pubblicazione: (2025)
Are Large Language Models the future crowd workers of Linguistics?
di: Ferrazzo, Iris
Pubblicazione: (2025)
di: Ferrazzo, Iris
Pubblicazione: (2025)
MorphNLI: A Stepwise Approach to Natural Language Inference Using Text Morphing
di: Negru, Vlad Andrei, et al.
Pubblicazione: (2025)
di: Negru, Vlad Andrei, et al.
Pubblicazione: (2025)
A Comparative Approach to Assessing Linguistic Creativity of Large Language Models and Humans
di: Dinu, Anca, et al.
Pubblicazione: (2025)
di: Dinu, Anca, et al.
Pubblicazione: (2025)
Linguistic Blind Spots of Large Language Models
di: Cheng, Jiali, et al.
Pubblicazione: (2025)
di: Cheng, Jiali, et al.
Pubblicazione: (2025)
Large Language Model as Token Compressor and Decompressor
di: Li, Wenbing, et al.
Pubblicazione: (2026)
di: Li, Wenbing, et al.
Pubblicazione: (2026)
Retrofitting Large Language Models with Dynamic Tokenization
di: Feher, Darius, et al.
Pubblicazione: (2024)
di: Feher, Darius, et al.
Pubblicazione: (2024)
Generative Linguistics, Large Language Models, and the Social Nature of Scientific Success
di: Hao, Sophie
Pubblicazione: (2025)
di: Hao, Sophie
Pubblicazione: (2025)
Probing Large Language Models in Reasoning and Translating Complex Linguistic Puzzles
di: Lin, Zheng-Lin, et al.
Pubblicazione: (2025)
di: Lin, Zheng-Lin, et al.
Pubblicazione: (2025)
Performance Evaluation of Tokenizers in Large Language Models for the Assamese Language
di: Tamang, Sagar, et al.
Pubblicazione: (2024)
di: Tamang, Sagar, et al.
Pubblicazione: (2024)
Investigating Large Language Models' Linguistic Abilities for Text Preprocessing
di: Braga, Marco, et al.
Pubblicazione: (2025)
di: Braga, Marco, et al.
Pubblicazione: (2025)
Detecting Linguistic Indicators for Stereotype Assessment with Large Language Models
di: Görge, Rebekka, et al.
Pubblicazione: (2025)
di: Görge, Rebekka, et al.
Pubblicazione: (2025)
Rethinking Personalization in Large Language Models at the Token Level
di: Zhang, Chenheng, et al.
Pubblicazione: (2026)
di: Zhang, Chenheng, et al.
Pubblicazione: (2026)
Unified Large Language Models for Misinformation Detection in Low-Resource Linguistic Settings
di: Islam, Muhammad, et al.
Pubblicazione: (2025)
di: Islam, Muhammad, et al.
Pubblicazione: (2025)
Decomposed Prompting: Probing Multilingual Linguistic Structure Knowledge in Large Language Models
di: Nie, Ercong, et al.
Pubblicazione: (2024)
di: Nie, Ercong, et al.
Pubblicazione: (2024)
The Invalsi Benchmarks: measuring Linguistic and Mathematical understanding of Large Language Models in Italian
di: Puccetti, Giovanni, et al.
Pubblicazione: (2024)
di: Puccetti, Giovanni, et al.
Pubblicazione: (2024)
Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization
di: Wang, Dixuan, et al.
Pubblicazione: (2024)
di: Wang, Dixuan, et al.
Pubblicazione: (2024)
FTP: A Fine-grained Token-wise Pruner for Large Language Models via Token Routing
di: Li, Zekai, et al.
Pubblicazione: (2024)
di: Li, Zekai, et al.
Pubblicazione: (2024)
CLEAR: A Comprehensive Linguistic Evaluation of Argument Rewriting by Large Language Models
di: Huber, Thomas, et al.
Pubblicazione: (2025)
di: Huber, Thomas, et al.
Pubblicazione: (2025)
Token-Level Privacy in Large Language Models
di: Harel, Re'em, et al.
Pubblicazione: (2025)
di: Harel, Re'em, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MorphTok: Morphologically Grounded Tokenization for Indian Languages
di: Brahma, Maharaj, et al.
Pubblicazione: (2025) -
Towards Linguistically-Aware and Language-Independent Tokenization for Large Language Models (LLMs)
di: Rahman, Abrar, et al.
Pubblicazione: (2024) -
MorphBPE: A Morpho-Aware Tokenizer Bridging Linguistic Complexity for Efficient LLM Training Across Morphologies
di: Asgari, Ehsaneddin, et al.
Pubblicazione: (2025) -
Piecing Together Clues: A Benchmark for Evaluating the Detective Skills of Large Language Models
di: Gu, Zhouhong, et al.
Pubblicazione: (2023) -
Personalized Pieces: Efficient Personalized Large Language Models through Collaborative Efforts
di: Tan, Zhaoxuan, et al.
Pubblicazione: (2024)