Vocalize: Lead Acquisition and User Engagement through Gamified Voice Competitions
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Teskeredzic, Edvin, Paric, Muamer, Sestic, Adna, Fribert, Petra, Lukac, Anamarija, Hadzic, Hadzem, Altwlkany, Kemal, Lacic, Emanuel |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Knowledge Distillation for Real-Time Classification of Early Media in Voice Communications
par: Altwlkany, Kemal, et autres
Publié: (2024)
par: Altwlkany, Kemal, et autres
Publié: (2024)
On the Language and Gender Biases in PSTN, VoIP and Neural Audio Codecs
par: Altwlkany, Kemal, et autres
Publié: (2025)
par: Altwlkany, Kemal, et autres
Publié: (2025)
A Recurrent Neural Network Approach to the Answering Machine Detection Problem
par: Altwlkany, Kemal, et autres
Publié: (2024)
par: Altwlkany, Kemal, et autres
Publié: (2024)
VocalCrypt: Novel Active Defense Against Deepfake Voice Based on Masking Effect
par: Fei, Qingyuan, et autres
Publié: (2025)
par: Fei, Qingyuan, et autres
Publié: (2025)
Small Stickers, Big Meanings: A Multilingual Sticker Semantic Understanding Dataset with a Gamified Approach
par: Chee, Heng Er Metilda, et autres
Publié: (2025)
par: Chee, Heng Er Metilda, et autres
Publié: (2025)
MultiMediate'24: Multi-Domain Engagement Estimation
par: Müller, Philipp, et autres
Publié: (2024)
par: Müller, Philipp, et autres
Publié: (2024)
Transforming Video Subjective Testing with Training, Engagement, and Real-Time Feedback
par: Rahul, Kumar, et autres
Publié: (2026)
par: Rahul, Kumar, et autres
Publié: (2026)
Voices, Faces, and Feelings: Multi-modal Emotion-Cognition Captioning for Mental Health Understanding
par: Zhou, Zhiyuan, et autres
Publié: (2026)
par: Zhou, Zhiyuan, et autres
Publié: (2026)
RenCon 2025: Revival of the Expressive Performance Rendering Competition
par: Zhang, Huan, et autres
Publié: (2026)
par: Zhang, Huan, et autres
Publié: (2026)
Balancing Semantic Relevance and Engagement in Related Video Recommendations
par: Jaspal, Amit, et autres
Publié: (2025)
par: Jaspal, Amit, et autres
Publié: (2025)
Back to Basics: Revisiting ASR in the Age of Voice Agents
par: Tay, Geeyang, et autres
Publié: (2026)
par: Tay, Geeyang, et autres
Publié: (2026)
Enkidu: Universal Frequential Perturbation for Real-Time Audio Privacy Protection against Voice Deepfakes
par: Feng, Zhou, et autres
Publié: (2025)
par: Feng, Zhou, et autres
Publié: (2025)
Muse: A Multimodal Conversational Recommendation Dataset with Scenario-Grounded User Profiles
par: Wang, Zihan, et autres
Publié: (2024)
par: Wang, Zihan, et autres
Publié: (2024)
Modeling the Impacts of Swipe Delay on User Quality of Experience in Short Video Streaming
par: Nguyen, Duc V., et autres
Publié: (2026)
par: Nguyen, Duc V., et autres
Publié: (2026)
Personalized Playback Technology: How Short Video Services Create Excellent User Experience
par: Deng, Weihui, et autres
Publié: (2024)
par: Deng, Weihui, et autres
Publié: (2024)
Movement- and Traffic-based User Identification in Commercial Virtual Reality Applications: Threats and Opportunities
par: Baldoni, Sara, et autres
Publié: (2025)
par: Baldoni, Sara, et autres
Publié: (2025)
FLARE: Full-Modality Long-Video Audiovisual Retrieval Benchmark with User-Simulated Queries
par: You, Qijie, et autres
Publié: (2026)
par: You, Qijie, et autres
Publié: (2026)
Ensembling Synchronisation-based and Face-Voice Association Paradigms for Robust Active Speaker Detection in Egocentric Recordings
par: Clarke, Jason, et autres
Publié: (2025)
par: Clarke, Jason, et autres
Publié: (2025)
DS-HGCN: A Dual-Stream Hypergraph Convolutional Network for Predicting Student Engagement via Social Contagion
par: Fan, Ziyang, et autres
Publié: (2025)
par: Fan, Ziyang, et autres
Publié: (2025)
Multimodal Engagement Analysis from Facial Videos in the Classroom
par: Sümer, Ömer, et autres
Publié: (2021)
par: Sümer, Ömer, et autres
Publié: (2021)
Transfer Learning in Vocal Education: Technical Evaluation of Limited Samples Describing Mezzo-soprano
par: Hou, Zhenyi, et autres
Publié: (2024)
par: Hou, Zhenyi, et autres
Publié: (2024)
SVDD 2024: The Inaugural Singing Voice Deepfake Detection Challenge
par: Zhang, You, et autres
Publié: (2024)
par: Zhang, You, et autres
Publié: (2024)
Leveraging User-Generated Metadata of Online Videos for Cover Song Identification
par: Hachmeier, Simon, et autres
Publié: (2024)
par: Hachmeier, Simon, et autres
Publié: (2024)
VisAug: Facilitating Speech-Rich Web Video Navigation and Engagement with Auto-Generated Visual Augmentations
par: Zhao, Baoquan, et autres
Publié: (2025)
par: Zhao, Baoquan, et autres
Publié: (2025)
HybridVC: Efficient Voice Style Conversion with Text and Audio Prompts
par: Niu, Xinlei, et autres
Publié: (2024)
par: Niu, Xinlei, et autres
Publié: (2024)
Towards Source Attribution of Singing Voice Deepfake with Multimodal Foundation Models
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
par: Phukan, Orchid Chetia, et autres
Publié: (2025)
Face-Voice Association for Audiovisual Active Speaker Detection in Egocentric Recordings
par: Clarke, Jason, et autres
Publié: (2025)
par: Clarke, Jason, et autres
Publié: (2025)
Voice Evaluation of Reasoning Ability: Diagnosing the Modality-Induced Performance Gap
par: Lin, Yueqian, et autres
Publié: (2025)
par: Lin, Yueqian, et autres
Publié: (2025)
Attentive-based Multi-level Feature Fusion for Voice Disorder Diagnosis
par: Shen, Lipeng, et autres
Publié: (2024)
par: Shen, Lipeng, et autres
Publié: (2024)
Wireless Multi-User Interactive Virtual Reality in Metaverse with Edge-Device Collaborative Computing
par: Xu, Caolu, et autres
Publié: (2024)
par: Xu, Caolu, et autres
Publié: (2024)
RVCBench: Benchmarking the Robustness of Voice Cloning Across Modern Audio Generation Models
par: Jin, Ruinan, et autres
Publié: (2026)
par: Jin, Ruinan, et autres
Publié: (2026)
U-Sticker: A Large-Scale Multi-Domain User Sticker Dataset for Retrieval and Personalization
par: Chee, Heng Er Metilda, et autres
Publié: (2025)
par: Chee, Heng Er Metilda, et autres
Publié: (2025)
Unlocking WebRTC for End User Driven Innovation
par: Singh, Kundan
Publié: (2025)
par: Singh, Kundan
Publié: (2025)
Robust Mesh Saliency Ground Truth Acquisition in VR via View Cone Sampling and Manifold Diffusion
par: Zheng, Guoquan, et autres
Publié: (2026)
par: Zheng, Guoquan, et autres
Publié: (2026)
HistLLM: A Unified Framework for LLM-Based Multimodal Recommendation with User History Encoding and Compression
par: Zhang, Chen, et autres
Publié: (2025)
par: Zhang, Chen, et autres
Publié: (2025)
REWIND: Speech Time Reversal for Enhancing Speaker Representations in Diffusion-based Voice Conversion
par: Biyani, Ishan D., et autres
Publié: (2025)
par: Biyani, Ishan D., et autres
Publié: (2025)
ecVoice: Audio Text Extraction and Optimization of Video Based on Idioms Similarity Replacement
par: Lin, Jinwei
Publié: (2024)
par: Lin, Jinwei
Publié: (2024)
D3PIA: A Discrete Denoising Diffusion Model for Piano Accompaniment Generation From Lead sheet
par: Choi, Eunjin, et autres
Publié: (2026)
par: Choi, Eunjin, et autres
Publié: (2026)
User-Generated Content and Editors in Games: A Comprehensive Survey
par: Liu, Yuyue, et autres
Publié: (2024)
par: Liu, Yuyue, et autres
Publié: (2024)
Can Current Detectors Catch Face-to-Voice Deepfake Attacks?
par: Nguyen, Nguyen Linh Bao, et autres
Publié: (2025)
par: Nguyen, Nguyen Linh Bao, et autres
Publié: (2025)
Documents similaires
-
Knowledge Distillation for Real-Time Classification of Early Media in Voice Communications
par: Altwlkany, Kemal, et autres
Publié: (2024) -
On the Language and Gender Biases in PSTN, VoIP and Neural Audio Codecs
par: Altwlkany, Kemal, et autres
Publié: (2025) -
A Recurrent Neural Network Approach to the Answering Machine Detection Problem
par: Altwlkany, Kemal, et autres
Publié: (2024) -
VocalCrypt: Novel Active Defense Against Deepfake Voice Based on Masking Effect
par: Fei, Qingyuan, et autres
Publié: (2025) -
Small Stickers, Big Meanings: A Multilingual Sticker Semantic Understanding Dataset with a Gamified Approach
par: Chee, Heng Er Metilda, et autres
Publié: (2025)