LongTail-Swap: benchmarking language models' abilities on rare words
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Algayres, Robin, Saint-James, Charles-Éric, Luthra, Mahi, Shen, Jiayi, Lin, Dongyan, Benchekroun, Youssef, Moritz, Rashel, Pino, Juan, Dupoux, Emmanuel |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SpidR: Learning Fast and Stable Linguistic Units for Spoken Language Models Without Supervision
par: Poli, Maxime, et autres
Publié: (2025)
par: Poli, Maxime, et autres
Publié: (2025)
SpidR-Adapt: A Universal Speech Representation Model for Few-Shot Adaptation
par: Luthra, Mahi, et autres
Publié: (2025)
par: Luthra, Mahi, et autres
Publié: (2025)
LongTail Driving Scenarios with Reasoning Traces: The KITScenes LongTail Dataset
par: Wagner, Royden, et autres
Publié: (2026)
par: Wagner, Royden, et autres
Publié: (2026)
EgoBabyVLM: Benchmarking Cross-Modal Learning from Naturalistic Egocentric Video Data
par: Lin, Dongyan, et autres
Publié: (2026)
par: Lin, Dongyan, et autres
Publié: (2026)
MauBERT: Universal Phonetic Inductive Biases for Few-Shot Acoustic Units Discovery
par: Tandazo, Angelo Ortiz, et autres
Publié: (2025)
par: Tandazo, Angelo Ortiz, et autres
Publié: (2025)
Computational Modeling of the Segmentation of Sentence Stimuli From an Infant Word‐Finding Study
par: Daniel Swingley, et autres
Publié: (2024)
par: Daniel Swingley, et autres
Publié: (2024)
BabySLM: language-acquisition-friendly benchmark of self-supervised spoken language models
par: Lavechin, Marvin, et autres
Publié: (2023)
par: Lavechin, Marvin, et autres
Publié: (2023)
Improving Spoken Language Modeling with Phoneme Classification: A Simple Fine-tuning Approach
par: Poli, Maxime, et autres
Publié: (2024)
par: Poli, Maxime, et autres
Publié: (2024)
fastabx: A library for efficient computation of ABX discriminability
par: Poli, Maxime, et autres
Publié: (2025)
par: Poli, Maxime, et autres
Publié: (2025)
Combining the flipped classroom and simulation games in engineering education: a methodological survey
par: Algayres, Muriel, et autres
Publié: (2019)
par: Algayres, Muriel, et autres
Publié: (2019)
The Mounssif Transform and Its Applications in Number Theory
par: Benchekroun, Mounssif
Publié: (2025)
par: Benchekroun, Mounssif
Publié: (2025)
Precarious Motherhood
par: Benchekroun, Rachel
Publié: (2025)
par: Benchekroun, Rachel
Publié: (2025)
Why AI systems don't learn and what to do about it: Lessons on autonomous learning from cognitive science
par: Dupoux, Emmanuel, et autres
Publié: (2026)
par: Dupoux, Emmanuel, et autres
Publié: (2026)
Swap distance minimization beyond entropy minimization in word order variation
par: Franco-Sánchez, Víctor, et autres
Publié: (2024)
par: Franco-Sánchez, Víctor, et autres
Publié: (2024)
Consistency Evaluator - Point Request Container for GAME (K562/homo_sapiens)
par: Luthra, Ishika
Publié: (2025)
par: Luthra, Ishika
Publié: (2025)
Consistency Evaluators for the GAME API
par: Luthra, Ishika
Publié: (2026)
par: Luthra, Ishika
Publié: (2026)
tmp
par: Luthra, Ishika
Publié: (2025)
par: Luthra, Ishika
Publié: (2025)
Destination Detroit
par: Luthra, Rashmi
Publié: (2023)
par: Luthra, Rashmi
Publié: (2023)
A Cortically Inspired Architecture for Modular Perceptual AI
par: Luthra, Prerna
Publié: (2026)
par: Luthra, Prerna
Publié: (2026)
TraitSpaces: Towards Interpretable Visual Creativity for Human-AI Co-Creation
par: Luthra, Prerna
Publié: (2025)
par: Luthra, Prerna
Publié: (2025)
Spirit LM: Interleaved Spoken and Written Language Model
par: Nguyen, Tu Anh, et autres
Publié: (2024)
par: Nguyen, Tu Anh, et autres
Publié: (2024)
BabyHuBERT: Multilingual Self-Supervised Learning for Segmenting Speakers in Child-Centered Long-Form Recordings
par: Charlot, Théo, et autres
Publié: (2025)
par: Charlot, Théo, et autres
Publié: (2025)
Primary Jejunal Melanoma Presenting as Widespread Metastases: Clinicopathological and Embryological Perspectives—A Case Report
par: Mahi Balcı
Publié: (2026)
par: Mahi Balcı
Publié: (2026)
Conflicto Cataluña-España: ACD de fotografías emitidas el 1-O en Cataluña
par: Wisem Mahi
Publié: (2023)
par: Wisem Mahi
Publié: (2023)
Fifteen Years of Child-Centered Long-Form Recordings: Promises, Resources, and Remaining Challenges to Validity
par: Peurey, Loann, et autres
Publié: (2025)
par: Peurey, Loann, et autres
Publié: (2025)
Simulating Articulatory Trajectories with Phonological Feature Interpolation
par: Tandazo, Angelo Ortiz, et autres
Publié: (2024)
par: Tandazo, Angelo Ortiz, et autres
Publié: (2024)
Watson-Crick conjugates of words and languages
par: Mahalingam, Kalpana, et autres
Publié: (2022)
par: Mahalingam, Kalpana, et autres
Publié: (2022)
MaterialFigBENCH: benchmark dataset with figures for evaluating college-level materials science problem-solving abilities of multimodal large language models
par: Yoshitake, Michiko, et autres
Publié: (2026)
par: Yoshitake, Michiko, et autres
Publié: (2026)
AMV-L: Lifecycle-Managed Agent Memory for Tail-Latency Control in Long-Running LLM Systems
par: Bamidele, Emmanuel
Publié: (2026)
par: Bamidele, Emmanuel
Publié: (2026)
Comment on “Overnight Dexamethasone in Primary Aldosteronism Screening in Patients on Interfering Therapy (ODEPRASC): A Diagnostic Interpretability Study Protocol”
par: Rashel Sarkar, et autres
Publié: (2026)
par: Rashel Sarkar, et autres
Publié: (2026)
Pursuing Better Decision Boundaries for Long-Tailed Object Detection via Category Information Amount
par: Ma, Yanbiao, et autres
Publié: (2025)
par: Ma, Yanbiao, et autres
Publié: (2025)
Blend matters: Impact of blending rice cultivars on milling yield and physicochemical attributes
par: Bindu Regonda, et autres
Publié: (2024)
par: Bindu Regonda, et autres
Publié: (2024)
Swap distance minimization in SOV languages. Cognitive and mathematical foundations
par: Ferrer-i-Cancho, Ramon, et autres
Publié: (2023)
par: Ferrer-i-Cancho, Ramon, et autres
Publié: (2023)
An open-source voice type classifier for child-centered daylong recordings
par: Lavechin, Marvin, et autres
Publié: (2020)
par: Lavechin, Marvin, et autres
Publié: (2020)
EmphAssess : a Prosodic Benchmark on Assessing Emphasis Transfer in Speech-to-Speech Models
par: de Seyssel, Maureen, et autres
Publié: (2023)
par: de Seyssel, Maureen, et autres
Publié: (2023)
Word maps and random words
par: Breuillard, Emmanuel, et autres
Publié: (2025)
par: Breuillard, Emmanuel, et autres
Publié: (2025)
The interplay of nonverbal behavior, affect, and language in perceptions of second language ability
par: J. Dylan Burton
Publié: (2025)
par: J. Dylan Burton
Publié: (2025)
The creative abilities of preservice world language educators
par: Anne Cummings Hlas, et autres
Publié: (2024)
par: Anne Cummings Hlas, et autres
Publié: (2024)
PPTC-R benchmark: Towards Evaluating the Robustness of Large Language Models for PowerPoint Task Completion
par: Zhang, Zekai, et autres
Publié: (2024)
par: Zhang, Zekai, et autres
Publié: (2024)
Structured Knowledge Accumulation: An Autonomous Framework for Layer-Wise Entropy Reduction in Neural Learning
par: Quantiota, Bouarfa Mahi
Publié: (2025)
par: Quantiota, Bouarfa Mahi
Publié: (2025)
Documents similaires
-
SpidR: Learning Fast and Stable Linguistic Units for Spoken Language Models Without Supervision
par: Poli, Maxime, et autres
Publié: (2025) -
SpidR-Adapt: A Universal Speech Representation Model for Few-Shot Adaptation
par: Luthra, Mahi, et autres
Publié: (2025) -
LongTail Driving Scenarios with Reasoning Traces: The KITScenes LongTail Dataset
par: Wagner, Royden, et autres
Publié: (2026) -
EgoBabyVLM: Benchmarking Cross-Modal Learning from Naturalistic Egocentric Video Data
par: Lin, Dongyan, et autres
Publié: (2026) -
MauBERT: Universal Phonetic Inductive Biases for Few-Shot Acoustic Units Discovery
par: Tandazo, Angelo Ortiz, et autres
Publié: (2025)