SpeakerSleuth: Can Large Audio-Language Models Judge Speaker Consistency across Multi-turn Dialogues?
Fuente:
arXiv
Salvato in:
| Autori principali: | Lee, Jonggeun, Pyo, Junseong, Seo, Gyuhyeon, Jo, Yohan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SpokenUS: A Spoken User Simulator for Task-Oriented Dialogue
di: Lee, Jonggeun, et al.
Pubblicazione: (2026)
di: Lee, Jonggeun, et al.
Pubblicazione: (2026)
SimuHome: A Temporal- and Environment-Aware Benchmark for Smart Home LLM Agents
di: Seo, Gyuhyeon, et al.
Pubblicazione: (2025)
di: Seo, Gyuhyeon, et al.
Pubblicazione: (2025)
ToolDial: Multi-turn Dialogue Generation Method for Tool-Augmented Language Models
di: Shim, Jeonghoon, et al.
Pubblicazione: (2025)
di: Shim, Jeonghoon, et al.
Pubblicazione: (2025)
Don't Adapt Small Language Models for Tools; Adapt Tool Schemas to the Models
di: Lee, Jonggeun, et al.
Pubblicazione: (2025)
di: Lee, Jonggeun, et al.
Pubblicazione: (2025)
Can Large Language Models be Effective Online Opinion Miners?
di: Heo, Ryang, et al.
Pubblicazione: (2025)
di: Heo, Ryang, et al.
Pubblicazione: (2025)
Quantifying Data Contamination in Psychometric Evaluations of LLMs
di: Han, Jongwook, et al.
Pubblicazione: (2025)
di: Han, Jongwook, et al.
Pubblicazione: (2025)
Detecting Mental Manipulation in Speech via Synthetic Multi-Speaker Dialogue
di: Chen, Run, et al.
Pubblicazione: (2026)
di: Chen, Run, et al.
Pubblicazione: (2026)
Contrastive Speaker-Aware Learning for Multi-party Dialogue Generation with LLMs
di: Sun, Tianyu, et al.
Pubblicazione: (2025)
di: Sun, Tianyu, et al.
Pubblicazione: (2025)
Advancing Multi-Party Dialogue Framework with Speaker-ware Contrastive Learning
di: Hu, Zhongtian, et al.
Pubblicazione: (2025)
di: Hu, Zhongtian, et al.
Pubblicazione: (2025)
Measuring Sycophancy of Language Models in Multi-turn Dialogues
di: Hong, Jiseung, et al.
Pubblicazione: (2025)
di: Hong, Jiseung, et al.
Pubblicazione: (2025)
Investigating Safety Vulnerabilities of Large Audio-Language Models Under Speaker Emotional Variations
di: Feng, Bo-Han, et al.
Pubblicazione: (2025)
di: Feng, Bo-Han, et al.
Pubblicazione: (2025)
Identifying Speakers in Dialogue Transcripts: A Text-based Approach Using Pretrained Language Models
di: Nguyen, Minh, et al.
Pubblicazione: (2024)
di: Nguyen, Minh, et al.
Pubblicazione: (2024)
Improving Multi-turn Dialogue Consistency with Self-Recall Thinking
di: Pang, Renning, et al.
Pubblicazione: (2026)
di: Pang, Renning, et al.
Pubblicazione: (2026)
Large Language Models Discriminate Against Speakers of German Dialects
di: Bui, Minh Duc, et al.
Pubblicazione: (2025)
di: Bui, Minh Duc, et al.
Pubblicazione: (2025)
SPECTRUM: Speaker-Enhanced Pre-Training for Long Dialogue Summarization
di: Cho, Sangwoo, et al.
Pubblicazione: (2024)
di: Cho, Sangwoo, et al.
Pubblicazione: (2024)
Can Vision-Language Models Infer Speaker's Ignorance? The Role of Visual and Linguistic Cues
di: Cho, Ye-eun, et al.
Pubblicazione: (2025)
di: Cho, Ye-eun, et al.
Pubblicazione: (2025)
Speak Out of Turn: Safety Vulnerability of Large Language Models in Multi-turn Dialogue
di: Zhou, Zhenhong, et al.
Pubblicazione: (2024)
di: Zhou, Zhenhong, et al.
Pubblicazione: (2024)
Just ASR + LLM? A Study on Speech Large Language Models' Ability to Identify and Understand Speaker in Spoken Dialogue
di: Wu, Junkai, et al.
Pubblicazione: (2024)
di: Wu, Junkai, et al.
Pubblicazione: (2024)
Can Authorship Attribution Models Distinguish Speakers in Speech Transcripts?
di: Aggazzotti, Cristina, et al.
Pubblicazione: (2023)
di: Aggazzotti, Cristina, et al.
Pubblicazione: (2023)
Spoken Stereoset: On Evaluating Social Bias Toward Speaker in Speech Large Language Models
di: Lin, Yi-Cheng, et al.
Pubblicazione: (2024)
di: Lin, Yi-Cheng, et al.
Pubblicazione: (2024)
WMT24 Test Suite: Gender Resolution in Speaker-Listener Dialogue Roles
di: Dawkins, Hillary, et al.
Pubblicazione: (2024)
di: Dawkins, Hillary, et al.
Pubblicazione: (2024)
Where Should Diffusion Enter a Language Model? Geometry-Guided Hidden-State Replacement
di: Kong, Injin, et al.
Pubblicazione: (2026)
di: Kong, Injin, et al.
Pubblicazione: (2026)
ConsistentChat: Building Skeleton-Guided Consistent Multi-Turn Dialogues for Large Language Models from Scratch
di: Chen, Jiawei, et al.
Pubblicazione: (2025)
di: Chen, Jiawei, et al.
Pubblicazione: (2025)
Improving Speaker Assignment in Speaker-Attributed ASR for Real Meeting Applications
di: Cui, Can, et al.
Pubblicazione: (2024)
di: Cui, Can, et al.
Pubblicazione: (2024)
Exploring the Factual Consistency in Dialogue Comprehension of Large Language Models
di: She, Shuaijie, et al.
Pubblicazione: (2023)
di: She, Shuaijie, et al.
Pubblicazione: (2023)
Judge as A Judge: Improving the Evaluation of Retrieval-Augmented Generation through the Judge-Consistency of Large Language Models
di: Liu, Shuliang, et al.
Pubblicazione: (2025)
di: Liu, Shuliang, et al.
Pubblicazione: (2025)
Improving Dialogue State Tracking through Combinatorial Search for In-Context Examples
di: Pyun, Haesung, et al.
Pubblicazione: (2025)
di: Pyun, Haesung, et al.
Pubblicazione: (2025)
Mechanism Shift During Post-training from Autoregressive to Masked Diffusion Language Models
di: Kong, Injin, et al.
Pubblicazione: (2026)
di: Kong, Injin, et al.
Pubblicazione: (2026)
ProPerSim: Developing Proactive and Personalized AI Assistants through User-Assistant Simulation
di: Kim, Jiho, et al.
Pubblicazione: (2025)
di: Kim, Jiho, et al.
Pubblicazione: (2025)
Survey of End-to-End Multi-Speaker Automatic Speech Recognition for Monaural Audio
di: He, Xinlu, et al.
Pubblicazione: (2025)
di: He, Xinlu, et al.
Pubblicazione: (2025)
Babel: Open Multilingual Large Language Models Serving Over 90% of Global Speakers
di: Zhao, Yiran, et al.
Pubblicazione: (2025)
di: Zhao, Yiran, et al.
Pubblicazione: (2025)
M3-SLU: Evaluating Speaker-Attributed Reasoning in Multimodal Large Language Models
di: Kwon, Yejin, et al.
Pubblicazione: (2025)
di: Kwon, Yejin, et al.
Pubblicazione: (2025)
Evaluating & Reducing Deceptive Dialogue From Language Models with Multi-turn RL
di: Abdulhai, Marwa, et al.
Pubblicazione: (2025)
di: Abdulhai, Marwa, et al.
Pubblicazione: (2025)
How Hypocritical Is Your LLM judge? Listener-Speaker Asymmetries in the Pragmatic Competence of Large Language Models
di: Sieker, Judith, et al.
Pubblicazione: (2026)
di: Sieker, Judith, et al.
Pubblicazione: (2026)
Audio-Aware Large Language Models as Judges for Speaking Styles
di: Chiang, Cheng-Han, et al.
Pubblicazione: (2025)
di: Chiang, Cheng-Han, et al.
Pubblicazione: (2025)
Investigation of Speaker Representation for Target-Speaker Speech Processing
di: Ashihara, Takanori, et al.
Pubblicazione: (2024)
di: Ashihara, Takanori, et al.
Pubblicazione: (2024)
Speaker Fuzzy Fingerprints: Benchmarking Text-Based Identification in Multiparty Dialogues
di: Ribeiro, Rui, et al.
Pubblicazione: (2025)
di: Ribeiro, Rui, et al.
Pubblicazione: (2025)
PICon: A Multi-Turn Interrogation Framework for Evaluating Persona Agent Consistency
di: Kim, Minseo, et al.
Pubblicazione: (2026)
di: Kim, Minseo, et al.
Pubblicazione: (2026)
Model Internal Sleuthing: Finding Lexical Identity and Inflectional Features in Modern Language Models
di: Li, Michael, et al.
Pubblicazione: (2025)
di: Li, Michael, et al.
Pubblicazione: (2025)
Speaker-Distinguishable CTC: Learning Speaker Distinction Using CTC for Multi-Talker Speech Recognition
di: Sakuma, Asahi, et al.
Pubblicazione: (2025)
di: Sakuma, Asahi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SpokenUS: A Spoken User Simulator for Task-Oriented Dialogue
di: Lee, Jonggeun, et al.
Pubblicazione: (2026) -
SimuHome: A Temporal- and Environment-Aware Benchmark for Smart Home LLM Agents
di: Seo, Gyuhyeon, et al.
Pubblicazione: (2025) -
ToolDial: Multi-turn Dialogue Generation Method for Tool-Augmented Language Models
di: Shim, Jeonghoon, et al.
Pubblicazione: (2025) -
Don't Adapt Small Language Models for Tools; Adapt Tool Schemas to the Models
di: Lee, Jonggeun, et al.
Pubblicazione: (2025) -
Can Large Language Models be Effective Online Opinion Miners?
di: Heo, Ryang, et al.
Pubblicazione: (2025)