N-gram Prediction and Word Difference Representations for Language Modeling
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Heo, DongNyeong, Rim, Daniela Noemi, Choi, Heeyoul |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Shared Latent Space by Both Languages in Non-Autoregressive Neural Machine Translation
par: Heo, DongNyeong, et autres
Publié: (2023)
par: Heo, DongNyeong, et autres
Publié: (2023)
Generalized Probabilistic Attention Mechanism in Transformers
par: Heo, DongNyeong, et autres
Publié: (2024)
par: Heo, DongNyeong, et autres
Publié: (2024)
End-to-End Training for Back-Translation with Categorical Reparameterization Trick
par: Heo, DongNyeong, et autres
Publié: (2022)
par: Heo, DongNyeong, et autres
Publié: (2022)
Sentence Curve Language Models
par: Heo, DongNyeong, et autres
Publié: (2026)
par: Heo, DongNyeong, et autres
Publié: (2026)
Dynamic Preference Multi-Objective Reinforcement Learning for Internet Network Management
par: Heo, DongNyeong, et autres
Publié: (2025)
par: Heo, DongNyeong, et autres
Publié: (2025)
Empirical Study of Symmetrical Reasoning in Conversational Chatbots
par: Rim, Daniela N., et autres
Publié: (2024)
par: Rim, Daniela N., et autres
Publié: (2024)
Convolutional Lie Operator for Sentence Classification
par: Rim, Daniela N., et autres
Publié: (2025)
par: Rim, Daniela N., et autres
Publié: (2025)
Data Augmentation With Back translation for Low Resource languages: A case of English and Luganda
par: Kimera, Richard, et autres
Publié: (2025)
par: Kimera, Richard, et autres
Publié: (2025)
Infini-gram: Scaling Unbounded n-gram Language Models to a Trillion Tokens
par: Liu, Jiacheng, et autres
Publié: (2024)
par: Liu, Jiacheng, et autres
Publié: (2024)
Advancing AI with Integrity: Ethical Challenges and Solutions in Neural Machine Translation
par: Kimera, Richard, et autres
Publié: (2024)
par: Kimera, Richard, et autres
Publié: (2024)
From N-grams to Pre-trained Multilingual Models For Language Identification
par: Sindane, Thapelo, et autres
Publié: (2024)
par: Sindane, Thapelo, et autres
Publié: (2024)
HITgram: A Platform for Experimenting with n-gram Language Models
par: Dasgupta, Shibaranjani, et autres
Publié: (2024)
par: Dasgupta, Shibaranjani, et autres
Publié: (2024)
An Interpretable N-gram Perplexity Threat Model for Large Language Model Jailbreaks
par: Boreiko, Valentyn, et autres
Publié: (2024)
par: Boreiko, Valentyn, et autres
Publié: (2024)
Understanding Transformers via N-gram Statistics
par: Nguyen, Timothy
Publié: (2024)
par: Nguyen, Timothy
Publié: (2024)
From n-gram to Attention: How Model Architectures Learn and Propagate Bias in Language Modeling
par: Kabir, Mohsinul, et autres
Publié: (2025)
par: Kabir, Mohsinul, et autres
Publié: (2025)
Transformers Can Represent $n$-gram Language Models
par: Svete, Anej, et autres
Publié: (2024)
par: Svete, Anej, et autres
Publié: (2024)
Using Perspectival Words Is Harder Than Vocabulary Words for Humans and Even More So for Multimodal Language Models
par: Dong, Dota Tianai, et autres
Publié: (2025)
par: Dong, Dota Tianai, et autres
Publié: (2025)
Investigating Idiomaticity in Word Representations
par: He, Wei, et autres
Publié: (2024)
par: He, Wei, et autres
Publié: (2024)
On the Predictive Power of Representation Dispersion in Language Models
par: Li, Yanhong, et autres
Publié: (2025)
par: Li, Yanhong, et autres
Publié: (2025)
Word Meanings in Transformer Language Models
par: Grindrod, Jumbly, et autres
Publié: (2025)
par: Grindrod, Jumbly, et autres
Publié: (2025)
Distilling Monolingual and Crosslingual Word-in-Context Representations
par: Arase, Yuki, et autres
Publié: (2024)
par: Arase, Yuki, et autres
Publié: (2024)
Same Patient, Different Words, Different Diagnosis? Evaluating Semantic Stability in Clinical LLMs
par: Alkaeed, Mahdi, et autres
Publié: (2026)
par: Alkaeed, Mahdi, et autres
Publié: (2026)
Less is More: Understanding Word-level Textual Adversarial Attack via n-gram Frequency Descend
par: Lu, Ning, et autres
Publié: (2023)
par: Lu, Ning, et autres
Publié: (2023)
Do Large Language Models Understand Word Senses?
par: Meconi, Domenico, et autres
Publié: (2025)
par: Meconi, Domenico, et autres
Publié: (2025)
Integrating Symbolic Natural Language Understanding and Language Models for Word Sense Disambiguation
par: Zhao, Kexin, et autres
Publié: (2025)
par: Zhao, Kexin, et autres
Publié: (2025)
Exploring the Word Sense Disambiguation Capabilities of Large Language Models
par: Basile, Pierpaolo, et autres
Publié: (2025)
par: Basile, Pierpaolo, et autres
Publié: (2025)
Exploring Large Language Models for Word Games:Who is the Spy?
par: Wei, Chentian, et autres
Publié: (2025)
par: Wei, Chentian, et autres
Publié: (2025)
A Distributional Perspective on Word Learning in Neural Language Models
par: Ficarra, Filippo, et autres
Publié: (2025)
par: Ficarra, Filippo, et autres
Publié: (2025)
Language Models as Knowledge Bases for Visual Word Sense Disambiguation
par: Kritharoula, Anastasia, et autres
Publié: (2023)
par: Kritharoula, Anastasia, et autres
Publié: (2023)
Integrated Framework for LLM Evaluation with Answer Generation
par: Lee, Sujeong, et autres
Publié: (2025)
par: Lee, Sujeong, et autres
Publié: (2025)
HuDEx: Integrating Hallucination Detection and Explainability for Enhancing the Reliability of LLM responses
par: Lee, Sujeong, et autres
Publié: (2025)
par: Lee, Sujeong, et autres
Publié: (2025)
ALIGN: Word Association Learning for Cultural Alignment in Large Language Models
par: Liu, Chunhua, et autres
Publié: (2025)
par: Liu, Chunhua, et autres
Publié: (2025)
Bilingual Word Level Language Identification for Omotic Languages
par: Yigezu, Mesay Gemeda, et autres
Publié: (2025)
par: Yigezu, Mesay Gemeda, et autres
Publié: (2025)
Word Embeddings Are Steers for Language Models
par: Han, Chi, et autres
Publié: (2023)
par: Han, Chi, et autres
Publié: (2023)
LLM4Delay: Flight Delay Prediction via Cross-Modality Adaptation of Large Language Models and Aircraft Trajectory Representation
par: Phisannupawong, Thaweerath, et autres
Publié: (2025)
par: Phisannupawong, Thaweerath, et autres
Publié: (2025)
Words that make SENSE: Sensorimotor Norms in Learned Lexical Token Representations
par: Gupta, Abhinav, et autres
Publié: (2026)
par: Gupta, Abhinav, et autres
Publié: (2026)
The Same But Different: Structural Similarities and Differences in Multilingual Language Modeling
par: Zhang, Ruochen, et autres
Publié: (2024)
par: Zhang, Ruochen, et autres
Publié: (2024)
Emergent Hierarchical Structure in Large Language Models: An Information-Theoretic Framework for Multi-Scale Representation
par: Zhang, Yukin, et autres
Publié: (2025)
par: Zhang, Yukin, et autres
Publié: (2025)
Enhanced Labeling Technique for Reddit Text and Fine-Tuned Longformer Models for Classifying Depression Severity in English and Luganda
par: Kimera, Richard, et autres
Publié: (2024)
par: Kimera, Richard, et autres
Publié: (2024)
Word2World: Generating Stories and Worlds through Large Language Models
par: Nasir, Muhammad U., et autres
Publié: (2024)
par: Nasir, Muhammad U., et autres
Publié: (2024)
Documents similaires
-
Shared Latent Space by Both Languages in Non-Autoregressive Neural Machine Translation
par: Heo, DongNyeong, et autres
Publié: (2023) -
Generalized Probabilistic Attention Mechanism in Transformers
par: Heo, DongNyeong, et autres
Publié: (2024) -
End-to-End Training for Back-Translation with Categorical Reparameterization Trick
par: Heo, DongNyeong, et autres
Publié: (2022) -
Sentence Curve Language Models
par: Heo, DongNyeong, et autres
Publié: (2026) -
Dynamic Preference Multi-Objective Reinforcement Learning for Internet Network Management
par: Heo, DongNyeong, et autres
Publié: (2025)