Using Voice and Biofeedback to Predict User Engagement during Product Feedback Interviews
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ferrari, Alessio, Huichapa, Thaide, Spoletini, Paola, Novielli, Nicole, Fucci, Davide, Girardi, Daniela |
|---|---|
| Format: | Preprint |
| Publié: |
2021
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
STAR: Speech-to-Audio Generation via Representation Learning
par: Xie, Zeyu, et autres
Publié: (2025)
par: Xie, Zeyu, et autres
Publié: (2025)
FakeSound2: A Benchmark for Explainable and Generalizable Deepfake Sound Detection
par: Xie, Zeyu, et autres
Publié: (2025)
par: Xie, Zeyu, et autres
Publié: (2025)
PicoAudio: Enabling Precise Timestamp and Frequency Controllability of Audio Events in Text-to-audio Generation
par: Xie, Zeyu, et autres
Publié: (2024)
par: Xie, Zeyu, et autres
Publié: (2024)
AudioTime: A Temporally-aligned Audio-text Benchmark Dataset
par: Xie, Zeyu, et autres
Publié: (2024)
par: Xie, Zeyu, et autres
Publié: (2024)
Sound Safeguarding for Acoustic Measurement Using Any Sounds: Tools and Applications
par: Kawahara, Hideki, et autres
Publié: (2025)
par: Kawahara, Hideki, et autres
Publié: (2025)
CAST-TTS: A Simple Cross-Attention Framework for Unified Timbre Control in TTS
par: Zheng, Zihao, et autres
Publié: (2026)
par: Zheng, Zihao, et autres
Publié: (2026)
PicoAudio2: Temporal Controllable Text-to-Audio Generation with Natural Language Description
par: Zheng, Zihao, et autres
Publié: (2025)
par: Zheng, Zihao, et autres
Publié: (2025)
FakeSound: Deepfake General Audio Detection
par: Xie, Zeyu, et autres
Publié: (2024)
par: Xie, Zeyu, et autres
Publié: (2024)
Self-supervised Pretraining for Robust Personalized Voice Activity Detection in Adverse Conditions
par: Bovbjerg, Holger Severin, et autres
Publié: (2023)
par: Bovbjerg, Holger Severin, et autres
Publié: (2023)
Noise-Robust Target-Speaker Voice Activity Detection Through Self-Supervised Pretraining
par: Bovbjerg, Holger Severin, et autres
Publié: (2025)
par: Bovbjerg, Holger Severin, et autres
Publié: (2025)
Are Music Foundation Models Better at Singing Voice Deepfake Detection? Far-Better Fuse them with Speech Foundation Models
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
Investigating Prosodic Signatures via Speech Pre-Trained Models for Audio Deepfake Source Attribution
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
Strong Alone, Stronger Together: Synergizing Modality-Binding Foundation Models with Optimal Transport for Non-Verbal Emotion Recognition
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
Multi-View Multi-Task Modeling with Speech Foundation Models for Speech Forensic Tasks
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
Avengers Assemble: Amalgamation of Non-Semantic Features for Depression Detection
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
SeQuiFi: Mitigating Catastrophic Forgetting in Speech Emotion Recognition with Sequential Class-Finetuning
par: Jain, Sarthak, et autres
Publié: (2024)
par: Jain, Sarthak, et autres
Publié: (2024)
Representation Loss Minimization with Randomized Selection Strategy for Efficient Environmental Fake Audio Detection
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
MENASpeechBank: A Reference Voice Bank with Persona-Conditioned Multi-Turn Conversations for AudioLLMs
par: Ali, Zien Sheikh, et autres
Publié: (2026)
par: Ali, Zien Sheikh, et autres
Publié: (2026)
Sink or SWIM: Tackling Real-Time ASR at Scale
par: Bruzzone, Federico, et autres
Publié: (2026)
par: Bruzzone, Federico, et autres
Publié: (2026)
TorchFX: A modern approach to Audio DSP with PyTorch and GPU acceleration
par: Spanio, Matteo, et autres
Publié: (2025)
par: Spanio, Matteo, et autres
Publié: (2025)
A Unified Model For Voice and Accent Conversion In Speech and Singing using Self-Supervised Learning and Feature Extraction
par: Cheripally, Sowmya
Publié: (2024)
par: Cheripally, Sowmya
Publié: (2024)
SARA: Stress Test Reasoning in Audio Deepfake Detection
par: Nguyen, Binh, et autres
Publié: (2026)
par: Nguyen, Binh, et autres
Publié: (2026)
Proposal of protocols for speech materials acquisition and presentation assisted by tools based on structured test signals
par: Kawahara, Hideki, et autres
Publié: (2024)
par: Kawahara, Hideki, et autres
Publié: (2024)
Rethinking Masking Strategies for Masked Prediction-based Audio Self-supervised Learning
par: Niizumi, Daisuke, et autres
Publié: (2026)
par: Niizumi, Daisuke, et autres
Publié: (2026)
Beyond Hearing: Learning Task-Agnostic ExG Representations from Earphones via Physiology-Informed Tokenization
par: Yoon, Hyungjun, et autres
Publié: (2025)
par: Yoon, Hyungjun, et autres
Publié: (2025)
A Voice-based Triage for Type 2 Diabetes using a Conversational Virtual Assistant in the Home Environment
par: Summoogum, Kelvin, et autres
Publié: (2024)
par: Summoogum, Kelvin, et autres
Publié: (2024)
ML-ASPA: A Contemplation of Machine Learning-based Acoustic Signal Processing Analysis for Sounds, & Strains Emerging Technology
par: Ali, Ratul, et autres
Publié: (2023)
par: Ali, Ratul, et autres
Publié: (2023)
Window Size Versus Accuracy Experiments in Voice Activity Detectors
par: McKinnon, Max, et autres
Publié: (2026)
par: McKinnon, Max, et autres
Publié: (2026)
Comparison of parameters of vowel sounds of russian and english languages
par: Fedoseev, V. I., et autres
Publié: (2024)
par: Fedoseev, V. I., et autres
Publié: (2024)
Noise-Robust Keyword Spotting through Self-supervised Pretraining
par: Mørk, Jacob, et autres
Publié: (2024)
par: Mørk, Jacob, et autres
Publié: (2024)
Learning Robust Spatial Representations from Binaural Audio through Feature Distillation
par: Bovbjerg, Holger Severin, et autres
Publié: (2025)
par: Bovbjerg, Holger Severin, et autres
Publié: (2025)
Monaural Multi-Speaker Speech Separation Using Efficient Transformer Model
par: Rijal, S., et autres
Publié: (2023)
par: Rijal, S., et autres
Publié: (2023)
Detecting Check-Worthy Claims in Political Debates, Speeches, and Interviews Using Audio Data
par: Ivanov, Petar, et autres
Publié: (2023)
par: Ivanov, Petar, et autres
Publié: (2023)
Toward Low-Latency End-to-End Voice Agents for Telecommunications Using Streaming ASR, Quantized LLMs, and Real-Time TTS
par: Ethiraj, Vignesh, et autres
Publié: (2025)
par: Ethiraj, Vignesh, et autres
Publié: (2025)
Multi-Task Instruction Tuning via Data Scheduling for Low-Resource Arabic AudioLLMs
par: Bhatti, Hunzalah Hassan, et autres
Publié: (2026)
par: Bhatti, Hunzalah Hassan, et autres
Publié: (2026)
AURA: Agent for Understanding, Reasoning, and Automated Tool Use in Voice-Driven Tasks
par: Maben, Leander Melroy, et autres
Publié: (2025)
par: Maben, Leander Melroy, et autres
Publié: (2025)
Impact of Frame Rates on Speech Tokenizer: A Case Study on Mandarin and English
par: Zhang, Haoyang, et autres
Publié: (2025)
par: Zhang, Haoyang, et autres
Publié: (2025)
SeamlessEdit: Background Noise Aware Zero-Shot Speech Editing with in-Context Enhancement
par: Chen, Kuan-Yu, et autres
Publié: (2025)
par: Chen, Kuan-Yu, et autres
Publié: (2025)
Large Vocabulary Spontaneous Speech Recognition for Tigrigna
par: Kahsu, Ataklti, et autres
Publié: (2023)
par: Kahsu, Ataklti, et autres
Publié: (2023)
Text2midi-InferAlign: Improving Symbolic Music Generation with Inference-Time Alignment
par: Roy, Abhinaba, et autres
Publié: (2025)
par: Roy, Abhinaba, et autres
Publié: (2025)
Documents similaires
-
STAR: Speech-to-Audio Generation via Representation Learning
par: Xie, Zeyu, et autres
Publié: (2025) -
FakeSound2: A Benchmark for Explainable and Generalizable Deepfake Sound Detection
par: Xie, Zeyu, et autres
Publié: (2025) -
PicoAudio: Enabling Precise Timestamp and Frequency Controllability of Audio Events in Text-to-audio Generation
par: Xie, Zeyu, et autres
Publié: (2024) -
AudioTime: A Temporally-aligned Audio-text Benchmark Dataset
par: Xie, Zeyu, et autres
Publié: (2024) -
Sound Safeguarding for Acoustic Measurement Using Any Sounds: Tools and Applications
par: Kawahara, Hideki, et autres
Publié: (2025)