Sigmoid Head for Quality Estimation under Language Ambiguity
Fuente:
arXiv
Salvato in:
| Autori principali: | Dinh, Tu Anh, Niehues, Jan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Are Generative Models Underconfident? Better Quality Estimation with Boosted Model Probability
di: Dinh, Tu Anh, et al.
Pubblicazione: (2025)
di: Dinh, Tu Anh, et al.
Pubblicazione: (2025)
Quality Estimation with $k$-nearest Neighbors and Automatic Evaluation for Model-specific Quality Estimation
di: Dinh, Tu Anh, et al.
Pubblicazione: (2024)
di: Dinh, Tu Anh, et al.
Pubblicazione: (2024)
Knockout LLM Assessment: Using Large Language Models for Evaluations through Iterative Pairwise Comparisons
di: Sandan, Isik Baran, et al.
Pubblicazione: (2025)
di: Sandan, Isik Baran, et al.
Pubblicazione: (2025)
COMET-poly: Machine Translation Metric Grounded in Other Candidates
di: Züfle, Maike, et al.
Pubblicazione: (2025)
di: Züfle, Maike, et al.
Pubblicazione: (2025)
SciEx: Benchmarking Large Language Models on Scientific Exams with Human Expert Grading and Automatic Grading
di: Dinh, Tu Anh, et al.
Pubblicazione: (2024)
di: Dinh, Tu Anh, et al.
Pubblicazione: (2024)
Tokenization and Morphology in Multilingual Language Models: A Comparative Analysis of mT5 and ByT5
di: Dang, Thao Anh, et al.
Pubblicazione: (2024)
di: Dang, Thao Anh, et al.
Pubblicazione: (2024)
SECURA: Sigmoid-Enhanced CUR Decomposition with Uninterrupted Retention and Low-Rank Adaptation in Large Language Models
di: Zhang, Yuxuan
Pubblicazione: (2025)
di: Zhang, Yuxuan
Pubblicazione: (2025)
CRISP: Persistent Concept Unlearning via Sparse Autoencoders
di: Ashuach, Tomer, et al.
Pubblicazione: (2025)
di: Ashuach, Tomer, et al.
Pubblicazione: (2025)
Is Less More? Quality, Quantity and Context in Idiom Processing with Natural Language Models
di: Knietaite, Agne, et al.
Pubblicazione: (2024)
di: Knietaite, Agne, et al.
Pubblicazione: (2024)
Towards Human Understanding of Paraphrase Types in Large Language Models
di: Meier, Dominik, et al.
Pubblicazione: (2024)
di: Meier, Dominik, et al.
Pubblicazione: (2024)
Ambiguity in LLMs is a concept missing problem
di: Hu, Zhibo, et al.
Pubblicazione: (2025)
di: Hu, Zhibo, et al.
Pubblicazione: (2025)
Is Textual Similarity Invariant under Machine Translation? Evidence Based on the Political Manifesto Corpus
di: Boratyn, Daria, et al.
Pubblicazione: (2026)
di: Boratyn, Daria, et al.
Pubblicazione: (2026)
German Text Simplification: Finetuning Large Language Models with Semi-Synthetic Data
di: Klöser, Lars, et al.
Pubblicazione: (2024)
di: Klöser, Lars, et al.
Pubblicazione: (2024)
Towards Fundamental Language Models: Does Linguistic Competence Scale with Model Size?
di: Collado-Montañez, Jaime, et al.
Pubblicazione: (2025)
di: Collado-Montañez, Jaime, et al.
Pubblicazione: (2025)
BOUQuET: dataset, Benchmark and Open initiative for Universal Quality Evaluation in Translation
di: The Omnilingual MT Team, et al.
Pubblicazione: (2025)
di: The Omnilingual MT Team, et al.
Pubblicazione: (2025)
Cross-lingual Human-Preference Alignment for Neural Machine Translation with Direct Quality Optimization
di: Uhlig, Kaden, et al.
Pubblicazione: (2024)
di: Uhlig, Kaden, et al.
Pubblicazione: (2024)
Encoder-Decoder Framework for Interactive Free Verses with Generation with Controllable High-Quality Rhyming
di: Pasini, Tommaso, et al.
Pubblicazione: (2024)
di: Pasini, Tommaso, et al.
Pubblicazione: (2024)
RomanLens: The Role Of Latent Romanization In Multilinguality In LLMs
di: Saji, Alan, et al.
Pubblicazione: (2025)
di: Saji, Alan, et al.
Pubblicazione: (2025)
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
di: Peters, Sydney, et al.
Pubblicazione: (2025)
di: Peters, Sydney, et al.
Pubblicazione: (2025)
Whose Facts Win? LLM Source Preferences under Knowledge Conflicts
di: Schuster, Jakob, et al.
Pubblicazione: (2026)
di: Schuster, Jakob, et al.
Pubblicazione: (2026)
Head-Specific Intervention Can Induce Misaligned AI Coordination in Large Language Models
di: Darm, Paul, et al.
Pubblicazione: (2025)
di: Darm, Paul, et al.
Pubblicazione: (2025)
Budget-Xfer: Budget-Constrained Source Language Selection for Cross-Lingual Transfer to African Languages
di: Idris, Tewodros Kederalah, et al.
Pubblicazione: (2026)
di: Idris, Tewodros Kederalah, et al.
Pubblicazione: (2026)
Calibrated Confidence Estimation for Tabular Question Answering
di: Voss, Lukas
Pubblicazione: (2026)
di: Voss, Lukas
Pubblicazione: (2026)
Large Language Models for Biomedical Article Classification
di: Proboszcz, Jakub, et al.
Pubblicazione: (2026)
di: Proboszcz, Jakub, et al.
Pubblicazione: (2026)
Precise Length Control in Large Language Models
di: Butcher, Bradley, et al.
Pubblicazione: (2024)
di: Butcher, Bradley, et al.
Pubblicazione: (2024)
A Review of the Marathi Natural Language Processing
di: Dani, Asang, et al.
Pubblicazione: (2024)
di: Dani, Asang, et al.
Pubblicazione: (2024)
What Drives Performance in Multilingual Language Models?
di: Nezhad, Sina Bagheri, et al.
Pubblicazione: (2024)
di: Nezhad, Sina Bagheri, et al.
Pubblicazione: (2024)
Omnilingual MT: Machine Translation for 1,600 Languages
di: Omnilingual MT Team, et al.
Pubblicazione: (2026)
di: Omnilingual MT Team, et al.
Pubblicazione: (2026)
Strategy Adaptation in Large Language Model Werewolf Agents
di: Nakamori, Fuya, et al.
Pubblicazione: (2025)
di: Nakamori, Fuya, et al.
Pubblicazione: (2025)
Mitigating Translationese in Low-resource Languages: The Storyboard Approach
di: Kuwanto, Garry, et al.
Pubblicazione: (2024)
di: Kuwanto, Garry, et al.
Pubblicazione: (2024)
Contextualising Levels of Language Resourcedness that affect NLP tasks
di: Keet, C. Maria, et al.
Pubblicazione: (2023)
di: Keet, C. Maria, et al.
Pubblicazione: (2023)
PL-Guard: Benchmarking Language Model Safety for Polish
di: Krasnodębska, Aleksandra, et al.
Pubblicazione: (2025)
di: Krasnodębska, Aleksandra, et al.
Pubblicazione: (2025)
Socially Responsible Data for Large Multilingual Language Models
di: Smart, Andrew, et al.
Pubblicazione: (2024)
di: Smart, Andrew, et al.
Pubblicazione: (2024)
SeLeRoSa: Sentence-Level Romanian Satire Detection Dataset
di: Smădu, Răzvan-Alexandru, et al.
Pubblicazione: (2025)
di: Smădu, Răzvan-Alexandru, et al.
Pubblicazione: (2025)
RUQuant: Towards Refining Uniform Quantization for Large Language Models
di: Liu, Han, et al.
Pubblicazione: (2026)
di: Liu, Han, et al.
Pubblicazione: (2026)
Large Language Models for Persian $ \leftrightarrow $ English Idiom Translation
di: Rezaeimanesh, Sara, et al.
Pubblicazione: (2024)
di: Rezaeimanesh, Sara, et al.
Pubblicazione: (2024)
Qomhra: A Bilingual Irish and English Large Language Model
di: McInerney, Joseph, et al.
Pubblicazione: (2025)
di: McInerney, Joseph, et al.
Pubblicazione: (2025)
Dialect Normalization using Large Language Models and Morphological Rules
di: Dimakis, Antonios, et al.
Pubblicazione: (2025)
di: Dimakis, Antonios, et al.
Pubblicazione: (2025)
Morphological Analysis for the Maltese Language: The Challenges of a Hybrid System
di: Borg, Claudia, et al.
Pubblicazione: (2017)
di: Borg, Claudia, et al.
Pubblicazione: (2017)
Synthetic Voice Data for Automatic Speech Recognition in African Languages
di: DeRenzi, Brian, et al.
Pubblicazione: (2025)
di: DeRenzi, Brian, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Are Generative Models Underconfident? Better Quality Estimation with Boosted Model Probability
di: Dinh, Tu Anh, et al.
Pubblicazione: (2025) -
Quality Estimation with $k$-nearest Neighbors and Automatic Evaluation for Model-specific Quality Estimation
di: Dinh, Tu Anh, et al.
Pubblicazione: (2024) -
Knockout LLM Assessment: Using Large Language Models for Evaluations through Iterative Pairwise Comparisons
di: Sandan, Isik Baran, et al.
Pubblicazione: (2025) -
COMET-poly: Machine Translation Metric Grounded in Other Candidates
di: Züfle, Maike, et al.
Pubblicazione: (2025) -
SciEx: Benchmarking Large Language Models on Scientific Exams with Human Expert Grading and Automatic Grading
di: Dinh, Tu Anh, et al.
Pubblicazione: (2024)