BLAB: Brutally Long Audio Bench
Fuente:
arXiv
Salvato in:
| Autori principali: | Ahia, Orevaoghene, Bartelds, Martijn, Ahuja, Kabir, Gonen, Hila, Hofmann, Valentin, Arora, Siddhant, Li, Shuyue Stella, Puttagunta, Vishal, Adeyemi, Mofetoluwa, Buchireddy, Charishma, Walls, Ben, Bennett, Noah, Watanabe, Shinji, Smith, Noah A., Tsvetkov, Yulia, Kumar, Sachin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MAGNET: Improving the Multilingual Fairness of Language Models with Adaptive Gradient-Based Tokenization
di: Ahia, Orevaoghene, et al.
Pubblicazione: (2024)
di: Ahia, Orevaoghene, et al.
Pubblicazione: (2024)
Voices Unheard: NLP Resources and Models for Yorùbá Regional Dialects
di: Ahia, Orevaoghene, et al.
Pubblicazione: (2024)
di: Ahia, Orevaoghene, et al.
Pubblicazione: (2024)
BASS: Benchmarking Audio LMs for Musical Structure and Semantic Reasoning
di: Jang, Min, et al.
Pubblicazione: (2026)
di: Jang, Min, et al.
Pubblicazione: (2026)
DIALECTBENCH: A NLP Benchmark for Dialects, Varieties, and Closely-Related Languages
di: Faisal, Fahim, et al.
Pubblicazione: (2024)
di: Faisal, Fahim, et al.
Pubblicazione: (2024)
Extracting Lexical Features from Dialects via Interpretable Dialect Classifiers
di: Xie, Roy, et al.
Pubblicazione: (2024)
di: Xie, Roy, et al.
Pubblicazione: (2024)
MYTE: Morphology-Driven Byte Encoding for Better and Fairer Multilingual Language Modeling
di: Limisiewicz, Tomasz, et al.
Pubblicazione: (2024)
di: Limisiewicz, Tomasz, et al.
Pubblicazione: (2024)
Finding Flawed Fictions: Evaluating Complex Reasoning in Language Models via Plot Hole Detection
di: Ahuja, Kabir, et al.
Pubblicazione: (2025)
di: Ahuja, Kabir, et al.
Pubblicazione: (2025)
FLEXITOKENS: Flexible Tokenization for Evolving Language Models
di: Owodunni, Abraham Toluwase, et al.
Pubblicazione: (2025)
di: Owodunni, Abraham Toluwase, et al.
Pubblicazione: (2025)
Frame-Level Internal Tool Use for Temporal Grounding in Audio LMs
di: An, Joesph, et al.
Pubblicazione: (2026)
di: An, Joesph, et al.
Pubblicazione: (2026)
Teaching LLMs to Abstain across Languages via Multilingual Feedback
di: Feng, Shangbin, et al.
Pubblicazione: (2024)
di: Feng, Shangbin, et al.
Pubblicazione: (2024)
Learning Syntax Without Planting Trees: Understanding Hierarchical Generalization in Transformers
di: Ahuja, Kabir, et al.
Pubblicazione: (2024)
di: Ahuja, Kabir, et al.
Pubblicazione: (2024)
IDIOLEX: Unified and Continuous Representations for Idiolectal and Stylistic Variation
di: Kantharuban, Anjali, et al.
Pubblicazione: (2026)
di: Kantharuban, Anjali, et al.
Pubblicazione: (2026)
Rewriting History: A Recipe for Interventional Analyses to Study Data Effects on Model Behavior
di: Nadkarni, Rahul, et al.
Pubblicazione: (2025)
di: Nadkarni, Rahul, et al.
Pubblicazione: (2025)
Broken Tokens? Your Language Model can Secretly Handle Non-Canonical Tokenizations
di: Zheng, Brian Siyuan, et al.
Pubblicazione: (2025)
di: Zheng, Brian Siyuan, et al.
Pubblicazione: (2025)
ComPO: Community Preferences for Language Model Personalization
di: Kumar, Sachin, et al.
Pubblicazione: (2024)
di: Kumar, Sachin, et al.
Pubblicazione: (2024)
Does Liking Yellow Imply Driving a School Bus? Semantic Leakage in Language Models
di: Gonen, Hila, et al.
Pubblicazione: (2024)
di: Gonen, Hila, et al.
Pubblicazione: (2024)
Demystifying Prompts in Language Models via Perplexity Estimation
di: Gonen, Hila, et al.
Pubblicazione: (2022)
di: Gonen, Hila, et al.
Pubblicazione: (2022)
Cognitive Foundations for Reasoning and Their Manifestation in LLMs
di: Kargupta, Priyanka, et al.
Pubblicazione: (2025)
di: Kargupta, Priyanka, et al.
Pubblicazione: (2025)
Brutalism
di: Kris F. Sealey
Pubblicazione: (2026)
di: Kris F. Sealey
Pubblicazione: (2026)
David helps Goliath: Inference-Time Collaboration Between Small Specialized and Large General Diffusion LMs
di: Han, Xiaochuang, et al.
Pubblicazione: (2023)
di: Han, Xiaochuang, et al.
Pubblicazione: (2023)
Breaking the Curse of Multilinguality with Cross-lingual Expert Language Models
di: Blevins, Terra, et al.
Pubblicazione: (2024)
di: Blevins, Terra, et al.
Pubblicazione: (2024)
Tuning Language Models by Proxy
di: Liu, Alisa, et al.
Pubblicazione: (2024)
di: Liu, Alisa, et al.
Pubblicazione: (2024)
False Friends Are Not Foes: Investigating Vocabulary Overlap in Multilingual Language Models
di: Kallini, Julie, et al.
Pubblicazione: (2025)
di: Kallini, Julie, et al.
Pubblicazione: (2025)
"Sorry, I Didn't Catch That": How Speech Models Miss What Matters Most
di: Zhou, Kaitlyn, et al.
Pubblicazione: (2026)
di: Zhou, Kaitlyn, et al.
Pubblicazione: (2026)
A Sense of Brutality
di: Sánchez, Carlos Alberto
Pubblicazione: (2022)
di: Sánchez, Carlos Alberto
Pubblicazione: (2022)
Semi-Autoregressive Streaming ASR With Label Context
di: Arora, Siddhant, et al.
Pubblicazione: (2023)
di: Arora, Siddhant, et al.
Pubblicazione: (2023)
Critical Learning Periods: Leveraging Early Training Dynamics for Efficient Data Pruning
di: Chimoto, Everlyn Asiko, et al.
Pubblicazione: (2024)
di: Chimoto, Everlyn Asiko, et al.
Pubblicazione: (2024)
The geometry of Nekrasov's gauge origami theory
di: Arbesfeld, Noah, et al.
Pubblicazione: (2026)
di: Arbesfeld, Noah, et al.
Pubblicazione: (2026)
Vafa-Witten invariants from wall-crossing for framed sheaves
di: Arbesfeld, Noah, et al.
Pubblicazione: (2026)
di: Arbesfeld, Noah, et al.
Pubblicazione: (2026)
Ads in AI Chatbots? An Analysis of How Large Language Models Navigate Conflicts of Interest
di: Wu, Addison J., et al.
Pubblicazione: (2026)
di: Wu, Addison J., et al.
Pubblicazione: (2026)
InfoGatherer: Principled Information Seeking via Evidence Retrieval and Strategic Questioning
di: Taranukhin, Maksym, et al.
Pubblicazione: (2026)
di: Taranukhin, Maksym, et al.
Pubblicazione: (2026)
Spiralformer: Low Latency Encoder for Streaming Speech Recognition with Circular Layer Skipping and Early Exiting
di: Tsunoo, Emiru, et al.
Pubblicazione: (2025)
di: Tsunoo, Emiru, et al.
Pubblicazione: (2025)
Finding Task-specific Subnetworks in Multi-task Spoken Language Understanding Model
di: Futami, Hayato, et al.
Pubblicazione: (2024)
di: Futami, Hayato, et al.
Pubblicazione: (2024)
Rapid Language Adaptation for Multilingual E2E Speech Recognition Using Encoder Prompting
di: Kashiwagi, Yosuke, et al.
Pubblicazione: (2024)
di: Kashiwagi, Yosuke, et al.
Pubblicazione: (2024)
Decoder-only Architecture for Speech Recognition with CTC Prompts and Text Data Augmentation
di: Tsunoo, Emiru, et al.
Pubblicazione: (2023)
di: Tsunoo, Emiru, et al.
Pubblicazione: (2023)
Hypothesis Clustering and Merging: Novel MultiTalker Speech Recognition with Speaker Tokens
di: Kashiwagi, Yosuke, et al.
Pubblicazione: (2024)
di: Kashiwagi, Yosuke, et al.
Pubblicazione: (2024)
Decoder-only Architecture for Streaming End-to-end Speech Recognition
di: Tsunoo, Emiru, et al.
Pubblicazione: (2024)
di: Tsunoo, Emiru, et al.
Pubblicazione: (2024)
MADFormer: Mixed Autoregressive and Diffusion Transformers for Continuous Image Generation
di: Chen, Junhao, et al.
Pubblicazione: (2025)
di: Chen, Junhao, et al.
Pubblicazione: (2025)
Brutal outdoor concrete hexagon flower pot
di: matousekfoto
Pubblicazione: (2021)
di: matousekfoto
Pubblicazione: (2021)
Voice "Cloning" is Style Transfer
di: Zhou, Kaitlyn, et al.
Pubblicazione: (2026)
di: Zhou, Kaitlyn, et al.
Pubblicazione: (2026)
Documenti analoghi
-
MAGNET: Improving the Multilingual Fairness of Language Models with Adaptive Gradient-Based Tokenization
di: Ahia, Orevaoghene, et al.
Pubblicazione: (2024) -
Voices Unheard: NLP Resources and Models for Yorùbá Regional Dialects
di: Ahia, Orevaoghene, et al.
Pubblicazione: (2024) -
BASS: Benchmarking Audio LMs for Musical Structure and Semantic Reasoning
di: Jang, Min, et al.
Pubblicazione: (2026) -
DIALECTBENCH: A NLP Benchmark for Dialects, Varieties, and Closely-Related Languages
di: Faisal, Fahim, et al.
Pubblicazione: (2024) -
Extracting Lexical Features from Dialects via Interpretable Dialect Classifiers
di: Xie, Roy, et al.
Pubblicazione: (2024)