This Paper Had the Smartest Reviewers -- Flattery Detection Utilising an Audio-Textual Transformer-Based Approach
Fuente:
arXiv
Salvato in:
| Autori principali: | Christ, Lukas, Amiriparian, Shahin, Hawighorst, Friederike, Schill, Ann-Kathrin, Boutalikakis, Angelo, Graf-Vlachy, Lorenz, König, Andreas, Schuller, Björn W. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SmoothCLAP: Soft-Target Enhanced Contrastive Language\--Audio Pretraining for Affective Computing
di: Jing, Xin, et al.
Pubblicazione: (2026)
di: Jing, Xin, et al.
Pubblicazione: (2026)
Towards Multimodal Prediction of Spontaneous Humour: A Novel Dataset and First Results
di: Christ, Lukas, et al.
Pubblicazione: (2022)
di: Christ, Lukas, et al.
Pubblicazione: (2022)
Non-Verbal Vocalisations and their Challenges: Emotion, Privacy, Sparseness, and Real Life
di: Batliner, Anton, et al.
Pubblicazione: (2025)
di: Batliner, Anton, et al.
Pubblicazione: (2025)
Exploring Meta Information for Audio-based Zero-shot Bird Classification
di: Gebhard, Alexander, et al.
Pubblicazione: (2023)
di: Gebhard, Alexander, et al.
Pubblicazione: (2023)
Discovering and Causally Validating Emotion-Sensitive Neurons in Large Audio-Language Models
di: Zhao, Xiutian, et al.
Pubblicazione: (2026)
di: Zhao, Xiutian, et al.
Pubblicazione: (2026)
Audio-based Step-count Estimation for Running -- Windowing and Neural Network Baselines
di: Wagner, Philipp, et al.
Pubblicazione: (2024)
di: Wagner, Philipp, et al.
Pubblicazione: (2024)
Non-Invasive Suicide Risk Prediction Through Speech Analysis
di: Amiriparian, Shahin, et al.
Pubblicazione: (2024)
di: Amiriparian, Shahin, et al.
Pubblicazione: (2024)
From Audio Deepfake Detection to AI-Generated Music Detection -- A Pathway and Overview
di: Li, Yupei, et al.
Pubblicazione: (2024)
di: Li, Yupei, et al.
Pubblicazione: (2024)
Audio Explanation Synthesis with Generative Foundation Models
di: Akman, Alican, et al.
Pubblicazione: (2024)
di: Akman, Alican, et al.
Pubblicazione: (2024)
Exploring Gender-Specific Speech Patterns in Automatic Suicide Risk Assessment
di: Gerczuk, Maurice, et al.
Pubblicazione: (2024)
di: Gerczuk, Maurice, et al.
Pubblicazione: (2024)
DOTA-ME-CS: Daily Oriented Text Audio-Mandarin English-Code Switching Dataset
di: Li, Yupei, et al.
Pubblicazione: (2025)
di: Li, Yupei, et al.
Pubblicazione: (2025)
Neuron-Level Emotion Control in Speech-Generative Large Audio-Language Models
di: Zhao, Xiutian, et al.
Pubblicazione: (2026)
di: Zhao, Xiutian, et al.
Pubblicazione: (2026)
ParaCLAP -- Towards a general language-audio model for computational paralinguistic tasks
di: Jing, Xin, et al.
Pubblicazione: (2024)
di: Jing, Xin, et al.
Pubblicazione: (2024)
AffectSpeech: A Large-Scale Emotional Speech Dataset with Fine-Grained Textual Descriptions for Speech Emotion Captioning and Synthesis
di: Qi, Tianhua, et al.
Pubblicazione: (2026)
di: Qi, Tianhua, et al.
Pubblicazione: (2026)
Charting 15 years of progress in deep learning for speech emotion recognition: A replication study
di: Triantafyllopoulos, Andreas, et al.
Pubblicazione: (2025)
di: Triantafyllopoulos, Andreas, et al.
Pubblicazione: (2025)
Audio Enhancement for Computer Audition -- An Iterative Training Paradigm Using Sample Importance
di: Milling, Manuel, et al.
Pubblicazione: (2024)
di: Milling, Manuel, et al.
Pubblicazione: (2024)
Raw Audio Classification with Cosine Convolutional Neural Network (CosCovNN)
di: Haque, Kazi Nazmul, et al.
Pubblicazione: (2024)
di: Haque, Kazi Nazmul, et al.
Pubblicazione: (2024)
Quantifying Dimensional Independence in Speech: An Information-Theoretic Framework for Disentangled Representation Learning
di: Kashyap, Bipasha, et al.
Pubblicazione: (2026)
di: Kashyap, Bipasha, et al.
Pubblicazione: (2026)
Intelligent Cardiac Auscultation for Murmur Detection via Parallel-Attentive Models with Uncertainty Estimation
di: Zhang, Zixing, et al.
Pubblicazione: (2024)
di: Zhang, Zixing, et al.
Pubblicazione: (2024)
Cross-Dialect Bird Species Recognition with Dialect-Calibrated Augmentation
di: Ding, Jiani, et al.
Pubblicazione: (2025)
di: Ding, Jiani, et al.
Pubblicazione: (2025)
Enhancing Emotional Text-to-Speech Controllability with Natural Language Guidance through Contrastive Learning and Diffusion Models
di: Jing, Xin, et al.
Pubblicazione: (2024)
di: Jing, Xin, et al.
Pubblicazione: (2024)
Bringing the Discussion of Minima Sharpness to the Audio Domain: a Filter-Normalised Evaluation for Acoustic Scene Classification
di: Milling, Manuel, et al.
Pubblicazione: (2023)
di: Milling, Manuel, et al.
Pubblicazione: (2023)
Abusive Speech Detection in Indic Languages Using Acoustic Features
di: Spiesberger, Anika A., et al.
Pubblicazione: (2024)
di: Spiesberger, Anika A., et al.
Pubblicazione: (2024)
Can Large Language Models Aid in Annotating Speech Emotional Data? Uncovering New Frontiers
di: Latif, Siddique, et al.
Pubblicazione: (2023)
di: Latif, Siddique, et al.
Pubblicazione: (2023)
An automatic analysis of ultrasound vocalisations for the prediction of interaction context in captive Egyptian fruit bats
di: Triantafyllopoulos, Andreas, et al.
Pubblicazione: (2024)
di: Triantafyllopoulos, Andreas, et al.
Pubblicazione: (2024)
Room Impulse Response Prediction with Neural Networks: From Energy Decay Curves to Perceptual Validation
di: Muhammad, Imran, et al.
Pubblicazione: (2025)
di: Muhammad, Imran, et al.
Pubblicazione: (2025)
Deep Learning-Based Prediction of Energy Decay Curves from Room Geometry and Material Properties
di: Muhammad, Imran, et al.
Pubblicazione: (2025)
di: Muhammad, Imran, et al.
Pubblicazione: (2025)
Explainable Detection of Machine Generated Music and Early Systematic Evaluation
di: Li, Yupei, et al.
Pubblicazione: (2024)
di: Li, Yupei, et al.
Pubblicazione: (2024)
The ICASSP 2024 Audio Deep Packet Loss Concealment Challenge
di: Diener, Lorenz, et al.
Pubblicazione: (2024)
di: Diener, Lorenz, et al.
Pubblicazione: (2024)
M6: Multi-generator, Multi-domain, Multi-lingual and cultural, Multi-genres, Multi-instrument Machine-Generated Music Detection Databases
di: Li, Yupei, et al.
Pubblicazione: (2024)
di: Li, Yupei, et al.
Pubblicazione: (2024)
Explainable Speech Emotion Recognition: Weighted Attribute Fairness to Model Demographic Contributions to Social Bias
di: Ogunnubi, Tomisin, et al.
Pubblicazione: (2026)
di: Ogunnubi, Tomisin, et al.
Pubblicazione: (2026)
Computer Audition: From Task-Specific Machine Learning to Foundation Models
di: Triantafyllopoulos, Andreas, et al.
Pubblicazione: (2024)
di: Triantafyllopoulos, Andreas, et al.
Pubblicazione: (2024)
Testing Correctness, Fairness, and Robustness of Speech Emotion Recognition Models
di: Derington, Anna, et al.
Pubblicazione: (2023)
di: Derington, Anna, et al.
Pubblicazione: (2023)
Using voice analysis as an early indicator of risk for depression in young adults
di: Scherer, Klaus R., et al.
Pubblicazione: (2024)
di: Scherer, Klaus R., et al.
Pubblicazione: (2024)
Emotion-Aware Contrastive Adaptation Network for Source-Free Cross-Corpus Speech Emotion Recognition
di: Zhao, Yan, et al.
Pubblicazione: (2024)
di: Zhao, Yan, et al.
Pubblicazione: (2024)
ProsodyFM: Unsupervised Phrasing and Intonation Control for Intelligible Speech Synthesis
di: He, Xiangheng, et al.
Pubblicazione: (2024)
di: He, Xiangheng, et al.
Pubblicazione: (2024)
Domain Adapting Deep Reinforcement Learning for Real-world Speech Emotion Recognition
di: Rajapakshe, Thejan, et al.
Pubblicazione: (2022)
di: Rajapakshe, Thejan, et al.
Pubblicazione: (2022)
Wav2Small: Distilling Wav2Vec2 to 72K parameters for Low-Resource Speech emotion recognition
di: Kounadis-Bastian, Dionyssos, et al.
Pubblicazione: (2024)
di: Kounadis-Bastian, Dionyssos, et al.
Pubblicazione: (2024)
Affine Modulation-based Audiogram Fusion Network for Joint Noise Reduction and Hearing Loss Compensation
di: Ni, Ye, et al.
Pubblicazione: (2025)
di: Ni, Ye, et al.
Pubblicazione: (2025)
Audio-Cogito: Towards Deep Audio Reasoning in Large Audio Language Models
di: Li, Longhao, et al.
Pubblicazione: (2026)
di: Li, Longhao, et al.
Pubblicazione: (2026)
Documenti analoghi
-
SmoothCLAP: Soft-Target Enhanced Contrastive Language\--Audio Pretraining for Affective Computing
di: Jing, Xin, et al.
Pubblicazione: (2026) -
Towards Multimodal Prediction of Spontaneous Humour: A Novel Dataset and First Results
di: Christ, Lukas, et al.
Pubblicazione: (2022) -
Non-Verbal Vocalisations and their Challenges: Emotion, Privacy, Sparseness, and Real Life
di: Batliner, Anton, et al.
Pubblicazione: (2025) -
Exploring Meta Information for Audio-based Zero-shot Bird Classification
di: Gebhard, Alexander, et al.
Pubblicazione: (2023) -
Discovering and Causally Validating Emotion-Sensitive Neurons in Large Audio-Language Models
di: Zhao, Xiutian, et al.
Pubblicazione: (2026)