Enregistré dans:
| Auteurs principaux: | Kaipeng, Liu, Ling, Wu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.00554 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Leveraging Lora Fine-Tuning and Knowledge Bases for Construction Identification
par: Kaipeng, Liu, et autres
Publié: (2026)
par: Kaipeng, Liu, et autres
Publié: (2026)
Improving Cross-Lingual Phonetic Representation of Low-Resource Languages Through Language Similarity Analysis
par: Kim, Minu, et autres
Publié: (2025)
par: Kim, Minu, et autres
Publié: (2025)
BMdataset: A Musicologically Curated LilyPond Dataset
par: Spanio, Matteo, et autres
Publié: (2026)
par: Spanio, Matteo, et autres
Publié: (2026)
Sensing Your Vocals: Exploring the Activity of Vocal Cord Muscles for Pitch Assessment Using Electromyography and Ultrasonography
par: Chen, Kanyu, et autres
Publié: (2026)
par: Chen, Kanyu, et autres
Publié: (2026)
Interactive Shape Sonification for Tumor Localization in Breast Cancer Surgery
par: Schütz, Laura, et autres
Publié: (2023)
par: Schütz, Laura, et autres
Publié: (2023)
If You Hold Me Without Hurting Me: Pathways to Designing Game Audio for Healthy Escapism and Player Well-being
par: Nunes, Caio, et autres
Publié: (2025)
par: Nunes, Caio, et autres
Publié: (2025)
Textarium: Entangling Annotation, Abstraction and Argument
par: Proff, Philipp, et autres
Publié: (2025)
par: Proff, Philipp, et autres
Publié: (2025)
Automatic Album Sequencing
par: Herrmann, Vincent, et autres
Publié: (2024)
par: Herrmann, Vincent, et autres
Publié: (2024)
Compositional Phoneme Approximation for L1-Grounded L2 Pronunciation Training
par: Park, Jisang, et autres
Publié: (2024)
par: Park, Jisang, et autres
Publié: (2024)
MuQ-Eval: An Open-Source Per-Sample Quality Metric for AI Music Generation Evaluation
par: Zhu, Di, et autres
Publié: (2026)
par: Zhu, Di, et autres
Publié: (2026)
Annotating and Inferring Compositional Structures in Numeral Systems Across Languages
par: Rubehn, Arne, et autres
Publié: (2025)
par: Rubehn, Arne, et autres
Publié: (2025)
A Framework for Multimodal Medical Image Interaction
par: Schütz, Laura, et autres
Publié: (2024)
par: Schütz, Laura, et autres
Publié: (2024)
From Isolates to Families: Using Neural Networks for Automated Language Affiliation
par: Blum, Frederic, et autres
Publié: (2025)
par: Blum, Frederic, et autres
Publié: (2025)
Audio Foundation Models Outperform Symbolic Representations for Piano Performance Evaluation
par: Dhiman, Jai
Publié: (2026)
par: Dhiman, Jai
Publié: (2026)
How BERT Speaks Shakespearean English? Evaluating Historical Bias in Contextual Language Models
par: Cuscito, Miriam, et autres
Publié: (2024)
par: Cuscito, Miriam, et autres
Publié: (2024)
Inferring Intentions to Speak Using Accelerometer Data In-the-Wild
par: Li, Litian, et autres
Publié: (2024)
par: Li, Litian, et autres
Publié: (2024)
CompanionCast: Toward Social Collaboration with Multi-Agent Systems in Shared Experiences
par: Wang, Yiyang, et autres
Publié: (2025)
par: Wang, Yiyang, et autres
Publié: (2025)
Improving French Synthetic Speech Quality via SSML Prosody Control
par: Ouali, Nassima Ould, et autres
Publié: (2025)
par: Ouali, Nassima Ould, et autres
Publié: (2025)
Bridging the gap in online hate speech detection: a comparative analysis of BERT and traditional models for homophobic content identification on X/Twitter
par: McGiff, Josh, et autres
Publié: (2024)
par: McGiff, Josh, et autres
Publié: (2024)
A Survey on Spoken Italian Datasets and Corpora
par: Giordano, Marco, et autres
Publié: (2025)
par: Giordano, Marco, et autres
Publié: (2025)
Accelerating Language Model Workflows with Prompt Choreography
par: Bai, TJ, et autres
Publié: (2025)
par: Bai, TJ, et autres
Publié: (2025)
Less Stress, More Privacy: Stress Detection on Anonymized Speech of Air Traffic Controllers
par: Viswanathan, Janaki, et autres
Publié: (2025)
par: Viswanathan, Janaki, et autres
Publié: (2025)
The Sound of Decoherence
par: Christie, Robson, et autres
Publié: (2024)
par: Christie, Robson, et autres
Publié: (2024)
Step-Audio-R1 Technical Report
par: Tian, Fei, et autres
Publié: (2025)
par: Tian, Fei, et autres
Publié: (2025)
Neural Proxies for Sound Synthesizers: Learning Perceptually Informed Preset Representations
par: Combes, Paolo, et autres
Publié: (2025)
par: Combes, Paolo, et autres
Publié: (2025)
Do Large Language Models Understand Conversational Implicature -- A case study with a chinese sitcom
par: Yue, Shisen, et autres
Publié: (2024)
par: Yue, Shisen, et autres
Publié: (2024)
Real-Time Emergency Vehicle Detection using Mel Spectrograms and Regular Expressions
par: Pacheco-Gonzalez, Alberto, et autres
Publié: (2023)
par: Pacheco-Gonzalez, Alberto, et autres
Publié: (2023)
Designing Digital Humans with Ambient Intelligence
par: Chen, Mengyu, et autres
Publié: (2026)
par: Chen, Mengyu, et autres
Publié: (2026)
Partial Colexifications Improve Concept Embeddings
par: Rubehn, Arne, et autres
Publié: (2025)
par: Rubehn, Arne, et autres
Publié: (2025)
Computing the Formal and Institutional Boundaries of Contemporary Genre and Literary Fiction
par: Johnson, Natasha
Publié: (2025)
par: Johnson, Natasha
Publié: (2025)
Discriminative Subspace Emersion from learning feature relevances across different populations
par: Canducci, Marco, et autres
Publié: (2025)
par: Canducci, Marco, et autres
Publié: (2025)
BERT in Plutarch's Shadows
par: Yamshchikov, Ivan P., et autres
Publié: (2022)
par: Yamshchikov, Ivan P., et autres
Publié: (2022)
Human-Robot Creative Interactions (HRCI): Exploring Creativity in Artificial Agents Using a Story-Telling Game
par: Sandoval, Eduardo Benitez, et autres
Publié: (2022)
par: Sandoval, Eduardo Benitez, et autres
Publié: (2022)
Window Size Versus Accuracy Experiments in Voice Activity Detectors
par: McKinnon, Max, et autres
Publié: (2026)
par: McKinnon, Max, et autres
Publié: (2026)
Tactile Melodies: A Desk-Mounted Haptics for Perceiving Musical Experiences
par: Moora, Raj Varshith, et autres
Publié: (2024)
par: Moora, Raj Varshith, et autres
Publié: (2024)
Orchestration of Music by Grammar Systems
par: Makiš, Jozef, et autres
Publié: (2025)
par: Makiš, Jozef, et autres
Publié: (2025)
Patent Mining by Extracting Functional Analysis Information Modelled As Graph Structure: A Patent Knowledge-base Collaborative Building Approach
par: Helal, Manal E., et autres
Publié: (2023)
par: Helal, Manal E., et autres
Publié: (2023)
Crossing the Species Divide: Transfer Learning from Speech to Animal Sounds
par: Cauzinille, Jules, et autres
Publié: (2025)
par: Cauzinille, Jules, et autres
Publié: (2025)
Spatial Audio Rendering for Real-Time Speech Translation in Virtual Meetings
par: Geleta, Margarita, et autres
Publié: (2025)
par: Geleta, Margarita, et autres
Publié: (2025)
To Retrieve or Not to Retrieve? Uncertainty Detection for Dynamic Retrieval Augmented Generation
par: Dhole, Kaustubh D.
Publié: (2025)
par: Dhole, Kaustubh D.
Publié: (2025)
Documents similaires
-
Leveraging Lora Fine-Tuning and Knowledge Bases for Construction Identification
par: Kaipeng, Liu, et autres
Publié: (2026) -
Improving Cross-Lingual Phonetic Representation of Low-Resource Languages Through Language Similarity Analysis
par: Kim, Minu, et autres
Publié: (2025) -
BMdataset: A Musicologically Curated LilyPond Dataset
par: Spanio, Matteo, et autres
Publié: (2026) -
Sensing Your Vocals: Exploring the Activity of Vocal Cord Muscles for Pitch Assessment Using Electromyography and Ultrasonography
par: Chen, Kanyu, et autres
Publié: (2026) -
Interactive Shape Sonification for Tumor Localization in Breast Cancer Surgery
par: Schütz, Laura, et autres
Publié: (2023)