Increasing faithfulness in human-human dialog summarization with Spoken Language Understanding tasks
Fuente:
arXiv
Guardado en:
| Autores principales: | Akani, Eunice, Favre, Benoit, Bechet, Frederic, Gemignani, Romain |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CareMedEval dataset: Evaluating Critical Appraisal and Reasoning in the Biomedical Field
por: Bonzi, Doria, et al.
Publicado: (2025)
por: Bonzi, Doria, et al.
Publicado: (2025)
FABLES: Evaluating faithfulness and content selection in book-length summarization
por: Kim, Yekyung, et al.
Publicado: (2024)
por: Kim, Yekyung, et al.
Publicado: (2024)
Optimizing the role of human evaluation in LLM-based spoken document summarization systems
por: Kroll, Margaret, et al.
Publicado: (2024)
por: Kroll, Margaret, et al.
Publicado: (2024)
Language models show human-like content effects on reasoning tasks
por: Dasgupta, Ishita, et al.
Publicado: (2022)
por: Dasgupta, Ishita, et al.
Publicado: (2022)
MedMeta: A Benchmark for LLMs in Synthesizing Meta-Analysis Conclusion from Medical Studies
por: Ha, Huy Hoang, et al.
Publicado: (2026)
por: Ha, Huy Hoang, et al.
Publicado: (2026)
Multi-Intent Spoken Language Understanding: Methods, Trends, and Challenges
por: Wu, Di, et al.
Publicado: (2025)
por: Wu, Di, et al.
Publicado: (2025)
ECLM: Entity Level Language Model for Spoken Language Understanding with Chain of Intent
por: Yin, Shangjian, et al.
Publicado: (2024)
por: Yin, Shangjian, et al.
Publicado: (2024)
New Semantic Task for the French Spoken Language Understanding MEDIA Benchmark
por: Alavoine, Nadège, et al.
Publicado: (2024)
por: Alavoine, Nadège, et al.
Publicado: (2024)
Fleurs-SLU: A Massively Multilingual Benchmark for Spoken Language Understanding
por: Schmidt, Fabian David, et al.
Publicado: (2025)
por: Schmidt, Fabian David, et al.
Publicado: (2025)
Effectiveness of Text, Acoustic, and Lattice-based representations in Spoken Language Understanding tasks
por: Villatoro-Tello, Esaú, et al.
Publicado: (2022)
por: Villatoro-Tello, Esaú, et al.
Publicado: (2022)
Contrastive and Consistency Learning for Neural Noisy-Channel Model in Spoken Language Understanding
por: Kim, Suyoung, et al.
Publicado: (2024)
por: Kim, Suyoung, et al.
Publicado: (2024)
Text summarization via global structure awareness
por: Zhang, Jiaquan, et al.
Publicado: (2026)
por: Zhang, Jiaquan, et al.
Publicado: (2026)
HC$^2$L: Hybrid and Cooperative Contrastive Learning for Cross-lingual Spoken Language Understanding
por: Xing, Bowen, et al.
Publicado: (2024)
por: Xing, Bowen, et al.
Publicado: (2024)
Evaluating and Improving Continual Learning in Spoken Language Understanding
por: Yang, Muqiao, et al.
Publicado: (2024)
por: Yang, Muqiao, et al.
Publicado: (2024)
Are they human? Detecting large language models by probing human memory constraints
por: Schug, Simon, et al.
Publicado: (2026)
por: Schug, Simon, et al.
Publicado: (2026)
Are self-explanations from Large Language Models faithful?
por: Madsen, Andreas, et al.
Publicado: (2024)
por: Madsen, Andreas, et al.
Publicado: (2024)
WikiNER-fr-gold: A Gold-Standard NER Corpus
por: Cao, Danrun, et al.
Publicado: (2024)
por: Cao, Danrun, et al.
Publicado: (2024)
Language models align with human judgments on key grammatical constructions
por: Hu, Jennifer, et al.
Publicado: (2024)
por: Hu, Jennifer, et al.
Publicado: (2024)
Leveraging Information Retrieval to Enhance Spoken Language Understanding Prompts in Few-Shot Learning
por: Lepagnol, Pierre, et al.
Publicado: (2025)
por: Lepagnol, Pierre, et al.
Publicado: (2025)
Panacea: A foundation model for clinical trial search, summarization, design, and recruitment
por: Lin, Jiacheng, et al.
Publicado: (2024)
por: Lin, Jiacheng, et al.
Publicado: (2024)
Tracing the ongoing emergence of human-like reasoning in Large Language Models
por: Morosi, Paolo, et al.
Publicado: (2026)
por: Morosi, Paolo, et al.
Publicado: (2026)
When Large Language Models contradict humans? Large Language Models' Sycophantic Behaviour
por: Ranaldi, Leonardo, et al.
Publicado: (2023)
por: Ranaldi, Leonardo, et al.
Publicado: (2023)
On the Fallacy of Global Token Perplexity in Spoken Language Model Evaluation
por: Hsu, Chan-Jan, et al.
Publicado: (2026)
por: Hsu, Chan-Jan, et al.
Publicado: (2026)
Chronological Thinking in Full-Duplex Spoken Dialogue Language Models
por: Wu, Donghang, et al.
Publicado: (2025)
por: Wu, Donghang, et al.
Publicado: (2025)
When the LM misunderstood the human chuckled: Analyzing garden path effects in humans and language models
por: Amouyal, Samuel Joseph, et al.
Publicado: (2025)
por: Amouyal, Samuel Joseph, et al.
Publicado: (2025)
LiveLongBench: Tackling Long-Context Understanding for Spoken Texts from Live Streams
por: Wu, Yongxuan, et al.
Publicado: (2025)
por: Wu, Yongxuan, et al.
Publicado: (2025)
Language modelling techniques for analysing the impact of human genetic variation
por: Hegde, Megha, et al.
Publicado: (2025)
por: Hegde, Megha, et al.
Publicado: (2025)
An Adapter-Based Unified Model for Multiple Spoken Language Processing Tasks
por: Suresh, Varsha, et al.
Publicado: (2024)
por: Suresh, Varsha, et al.
Publicado: (2024)
Optimal Transport Regularization for Speech Text Alignment in Spoken Language Models
por: Xu, Wenze, et al.
Publicado: (2025)
por: Xu, Wenze, et al.
Publicado: (2025)
Understanding Data Temporality Impact on Large Language Models Pre-training
por: Pilchen, Hippolyte, et al.
Publicado: (2026)
por: Pilchen, Hippolyte, et al.
Publicado: (2026)
Closing the gap between open-source and commercial large language models for medical evidence summarization
por: Zhang, Gongbo, et al.
Publicado: (2024)
por: Zhang, Gongbo, et al.
Publicado: (2024)
FairTranslate: An English-French Dataset for Gender Bias Evaluation in Machine Translation by Overcoming Gender Binarity
por: Jourdan, Fanny, et al.
Publicado: (2025)
por: Jourdan, Fanny, et al.
Publicado: (2025)
Every time I fire a conversational designer, the performance of the dialog system goes down
por: Xompero, Giancarlo A., et al.
Publicado: (2021)
por: Xompero, Giancarlo A., et al.
Publicado: (2021)
VITA-QinYu: Expressive Spoken Language Model for Role-Playing and Singing
por: Xu, Jiacheng, et al.
Publicado: (2026)
por: Xu, Jiacheng, et al.
Publicado: (2026)
An empirical evaluation of using ChatGPT to summarize disputes for recommending similar labor and employment cases in Chinese
por: Wu, Po-Hsien, et al.
Publicado: (2024)
por: Wu, Po-Hsien, et al.
Publicado: (2024)
AugSumm: towards generalizable speech summarization using synthetic labels from large language model
por: Jung, Jee-weon, et al.
Publicado: (2024)
por: Jung, Jee-weon, et al.
Publicado: (2024)
LLM should think and action as a human
por: Leung, Haun, et al.
Publicado: (2025)
por: Leung, Haun, et al.
Publicado: (2025)
SpokenWOZ: A Large-Scale Speech-Text Benchmark for Spoken Task-Oriented Dialogue Agents
por: Si, Shuzheng, et al.
Publicado: (2023)
por: Si, Shuzheng, et al.
Publicado: (2023)
Large Language Models, scientific knowledge and factuality: A framework to streamline human expert evaluation
por: Wysocka, Magdalena, et al.
Publicado: (2023)
por: Wysocka, Magdalena, et al.
Publicado: (2023)
Spoken Grammar Assessment Using LLM
por: Kopparapu, Sunil Kumar, et al.
Publicado: (2024)
por: Kopparapu, Sunil Kumar, et al.
Publicado: (2024)
Ejemplares similares
-
CareMedEval dataset: Evaluating Critical Appraisal and Reasoning in the Biomedical Field
por: Bonzi, Doria, et al.
Publicado: (2025) -
FABLES: Evaluating faithfulness and content selection in book-length summarization
por: Kim, Yekyung, et al.
Publicado: (2024) -
Optimizing the role of human evaluation in LLM-based spoken document summarization systems
por: Kroll, Margaret, et al.
Publicado: (2024) -
Language models show human-like content effects on reasoning tasks
por: Dasgupta, Ishita, et al.
Publicado: (2022) -
MedMeta: A Benchmark for LLMs in Synthesizing Meta-Analysis Conclusion from Medical Studies
por: Ha, Huy Hoang, et al.
Publicado: (2026)