Value-Aware Numerical Representations for Transformer Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dutulescu, Andreea, Ruseti, Stefan, Dascalu, Mihai |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Neural Grammatical Error Correction for Romanian
par: Cotet, Teodor-Mihai, et autres
Publié: (2026)
par: Cotet, Teodor-Mihai, et autres
Publié: (2026)
Training Language Models with homotokens Leads to Delayed Overfitting
par: Cosma, Adrian, et autres
Publié: (2026)
par: Cosma, Adrian, et autres
Publié: (2026)
The Strawberry Problem: Emergence of Character-level Understanding in Tokenized Language Models
par: Cosma, Adrian, et autres
Publié: (2025)
par: Cosma, Adrian, et autres
Publié: (2025)
Building Large-Scale English-Romanian Literary Translation Resources with Open Models
par: Nadas, Mihai, et autres
Publié: (2025)
par: Nadas, Mihai, et autres
Publié: (2025)
TF1-EN-3M: Three Million Synthetic Moral Fables for Training Small, Open Language Models
par: Nadas, Mihai, et autres
Publié: (2025)
par: Nadas, Mihai, et autres
Publié: (2025)
How Hard is this Test Set? NLI Characterization by Exploiting Training Dynamics
par: Cosma, Adrian, et autres
Publié: (2024)
par: Cosma, Adrian, et autres
Publié: (2024)
Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling
par: Tamoyan, Hovhannes, et autres
Publié: (2025)
par: Tamoyan, Hovhannes, et autres
Publié: (2025)
KaSA: Knowledge-Aware Singular-Value Adaptation of Large Language Models
par: Wang, Fan, et autres
Publié: (2024)
par: Wang, Fan, et autres
Publié: (2024)
Data Contamination Quiz: A Tool to Detect and Estimate Contamination in Large Language Models
par: Golchin, Shahriar, et autres
Publié: (2023)
par: Golchin, Shahriar, et autres
Publié: (2023)
Improving Reasoning Performance in Large Language Models via Representation Engineering
par: Højer, Bertram, et autres
Publié: (2025)
par: Højer, Bertram, et autres
Publié: (2025)
When Raw Data Prevails: Are Large Language Model Embeddings Effective in Numerical Data Representation for Medical Machine Learning Applications?
par: Gao, Yanjun, et autres
Publié: (2024)
par: Gao, Yanjun, et autres
Publié: (2024)
Laying Anchors: Semantically Priming Numerals in Language Modeling
par: Sharma, Mandar, et autres
Publié: (2024)
par: Sharma, Mandar, et autres
Publié: (2024)
Relative Value Biases in Large Language Models
par: Hayes, William M., et autres
Publié: (2024)
par: Hayes, William M., et autres
Publié: (2024)
Internal Value Alignment in Large Language Models through Controlled Value Vector Activation
par: Jin, Haoran, et autres
Publié: (2025)
par: Jin, Haoran, et autres
Publié: (2025)
Noise-Aware Training of Layout-Aware Language Models
par: Sarkhel, Ritesh, et autres
Publié: (2024)
par: Sarkhel, Ritesh, et autres
Publié: (2024)
Large Multimodal Models for Low-Resource Languages: A Survey
par: Lupascu, Marian, et autres
Publié: (2025)
par: Lupascu, Marian, et autres
Publié: (2025)
Value Augmented Sampling for Language Model Alignment and Personalization
par: Han, Seungwook, et autres
Publié: (2024)
par: Han, Seungwook, et autres
Publié: (2024)
Induced Numerical Instability: Hidden Costs in Multimodal Large Language Models
par: Wong, Wai Tuck, et autres
Publié: (2026)
par: Wong, Wai Tuck, et autres
Publié: (2026)
xVal: A Continuous Numerical Tokenization for Scientific Language Models
par: Golkar, Siavash, et autres
Publié: (2023)
par: Golkar, Siavash, et autres
Publié: (2023)
Time Travel in LLMs: Tracing Data Contamination in Large Language Models
par: Golchin, Shahriar, et autres
Publié: (2023)
par: Golchin, Shahriar, et autres
Publié: (2023)
ReFT: Representation Finetuning for Language Models
par: Wu, Zhengxuan, et autres
Publié: (2024)
par: Wu, Zhengxuan, et autres
Publié: (2024)
Explaining Large Language Models Decisions Using Shapley Values
par: Mohammadi, Behnam
Publié: (2024)
par: Mohammadi, Behnam
Publié: (2024)
Improving Context-Aware Preference Modeling for Language Models
par: Pitis, Silviu, et autres
Publié: (2024)
par: Pitis, Silviu, et autres
Publié: (2024)
A Large-Scale Benchmark for Evaluating Large Language Models on Medical Question Answering in Romanian
par: Rogoz, Ana-Cristina, et autres
Publié: (2025)
par: Rogoz, Ana-Cristina, et autres
Publié: (2025)
Sink-Aware Pruning for Diffusion Language Models
par: Myrzakhan, Aidar, et autres
Publié: (2026)
par: Myrzakhan, Aidar, et autres
Publié: (2026)
Neural Isomorphic Fields: A Transformer-based Algebraic Numerical Embedding
par: Sadeghi, Hamidreza, et autres
Publié: (2026)
par: Sadeghi, Hamidreza, et autres
Publié: (2026)
Leviathan: Decoupling Input and Output Representations in Language Models
par: Batley, Reza T., et autres
Publié: (2026)
par: Batley, Reza T., et autres
Publié: (2026)
Layer by Layer: Uncovering Hidden Representations in Language Models
par: Skean, Oscar, et autres
Publié: (2025)
par: Skean, Oscar, et autres
Publié: (2025)
The Linear Representation Hypothesis and the Geometry of Large Language Models
par: Park, Kiho, et autres
Publié: (2023)
par: Park, Kiho, et autres
Publié: (2023)
Reframing Data Value for Large Language Models Through the Lens of Plausibility
par: Rammal, Mohamad Rida, et autres
Publié: (2024)
par: Rammal, Mohamad Rida, et autres
Publié: (2024)
Regurgitative Training: The Value of Real Data in Training Large Language Models
par: Zhang, Jinghui, et autres
Publié: (2024)
par: Zhang, Jinghui, et autres
Publié: (2024)
Evaluating Computational Accuracy of Large Language Models in Numerical Reasoning Tasks for Healthcare Applications
par: Malghan, Arjun R.
Publié: (2025)
par: Malghan, Arjun R.
Publié: (2025)
Revisiting the Shape Convention of Transformer Language Models
par: Liao, Feng-Ting, et autres
Publié: (2026)
par: Liao, Feng-Ting, et autres
Publié: (2026)
Values in the Wild: Discovering and Analyzing Values in Real-World Language Model Interactions
par: Huang, Saffron, et autres
Publié: (2025)
par: Huang, Saffron, et autres
Publié: (2025)
PAT: Pruning-Aware Tuning for Large Language Models
par: Liu, Yijiang, et autres
Publié: (2024)
par: Liu, Yijiang, et autres
Publié: (2024)
Encoding Agent Trajectories as Representations with Sequence Transformers
par: Tsiligkaridis, Athanasios, et autres
Publié: (2024)
par: Tsiligkaridis, Athanasios, et autres
Publié: (2024)
The Confidence Manifold: Geometric Structure of Correctness Representations in Language Models
par: Cho, Seonglae, et autres
Publié: (2026)
par: Cho, Seonglae, et autres
Publié: (2026)
Representational Curvature Modulates Behavioral Uncertainty in Large Language Models
par: King, Jack, et autres
Publié: (2026)
par: King, Jack, et autres
Publié: (2026)
Language Models can Self-Improve at State-Value Estimation for Better Search
par: Mendes, Ethan, et autres
Publié: (2025)
par: Mendes, Ethan, et autres
Publié: (2025)
Improving Large Language Model Safety with Contrastive Representation Learning
par: Simko, Samuel, et autres
Publié: (2025)
par: Simko, Samuel, et autres
Publié: (2025)
Documents similaires
-
Neural Grammatical Error Correction for Romanian
par: Cotet, Teodor-Mihai, et autres
Publié: (2026) -
Training Language Models with homotokens Leads to Delayed Overfitting
par: Cosma, Adrian, et autres
Publié: (2026) -
The Strawberry Problem: Emergence of Character-level Understanding in Tokenized Language Models
par: Cosma, Adrian, et autres
Publié: (2025) -
Building Large-Scale English-Romanian Literary Translation Resources with Open Models
par: Nadas, Mihai, et autres
Publié: (2025) -
TF1-EN-3M: Three Million Synthetic Moral Fables for Training Small, Open Language Models
par: Nadas, Mihai, et autres
Publié: (2025)