CS-Sum: A Benchmark for Code-Switching Dialogue Summarization and the Limits of Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Suresh, Sathya Krishnan, Surana, Tanmay, Hao, Lim Zhi, Chng, Eng Siong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DiaSynth: Synthetic Dialogue Generation Framework for Low Resource Dialogue Applications
par: Suresh, Sathya Krishnan, et autres
Publié: (2024)
par: Suresh, Sathya Krishnan, et autres
Publié: (2024)
Listen Again and Choose the Right Answer: A New Paradigm for Automatic Speech Recognition with Large Language Models
par: Hu, Yuchen, et autres
Publié: (2024)
par: Hu, Yuchen, et autres
Publié: (2024)
GenTranslate: Large Language Models are Generative Multilingual Speech and Machine Translators
par: Hu, Yuchen, et autres
Publié: (2024)
par: Hu, Yuchen, et autres
Publié: (2024)
Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR
par: Peng, Yizhou, et autres
Publié: (2025)
par: Peng, Yizhou, et autres
Publié: (2025)
Measuring and Mitigating Toxicity in Large Language Models: A Comprehensive Replication Study
par: Surana, Mokshit, et autres
Publié: (2026)
par: Surana, Mokshit, et autres
Publié: (2026)
Large Language Models for Code Summarization
par: Szalontai, Balázs, et autres
Publié: (2024)
par: Szalontai, Balázs, et autres
Publié: (2024)
Baichuan2-Sum: Instruction Finetune Baichuan2-7B Model for Dialogue Summarization
par: Xiao, Jianfei, et autres
Publié: (2024)
par: Xiao, Jianfei, et autres
Publié: (2024)
Towards smaller, faster decoder-only transformers: Architectural variants and their implications
par: Suresh, Sathya Krishnan, et autres
Publié: (2024)
par: Suresh, Sathya Krishnan, et autres
Publié: (2024)
Benchmarking Generation and Evaluation Capabilities of Large Language Models for Instruction Controllable Summarization
par: Liu, Yixin, et autres
Publié: (2023)
par: Liu, Yixin, et autres
Publié: (2023)
Mutual Reinforcement of LLM Dialogue Synthesis and Summarization Capabilities for Few-Shot Dialogue Summarization
par: Lu, Yen-Ju, et autres
Publié: (2025)
par: Lu, Yen-Ju, et autres
Publié: (2025)
Spoken DialogSum: An Emotion-Rich Conversational Dataset for Spoken Dialogue Summarization
par: Lu, Yen-Ju, et autres
Publié: (2025)
par: Lu, Yen-Ju, et autres
Publié: (2025)
CS-Bench: A Comprehensive Benchmark for Large Language Models towards Computer Science Mastery
par: Song, Xiaoshuai, et autres
Publié: (2024)
par: Song, Xiaoshuai, et autres
Publié: (2024)
UserSumBench: A Benchmark Framework for Evaluating User Summarization Approaches
par: Wang, Chao, et autres
Publié: (2024)
par: Wang, Chao, et autres
Publié: (2024)
HateTinyLLM : Hate Speech Detection Using Tiny Large Language Models
par: Sen, Tanmay, et autres
Publié: (2024)
par: Sen, Tanmay, et autres
Publié: (2024)
Large Language Models Meet Contrastive Learning: Zero-Shot Emotion Recognition Across Languages
par: Zou, Heqing, et autres
Publié: (2025)
par: Zou, Heqing, et autres
Publié: (2025)
Punctuation Restoration for Singaporean Spoken Languages: English, Malay, and Mandarin
par: Rao, Abhinav, et autres
Publié: (2022)
par: Rao, Abhinav, et autres
Publié: (2022)
Large Language Models are Efficient Learners of Noise-Robust Speech Recognition
par: Hu, Yuchen, et autres
Publié: (2024)
par: Hu, Yuchen, et autres
Publié: (2024)
Self-Taught Recognizer: Toward Unsupervised Adaptation for Speech Foundation Models
par: Hu, Yuchen, et autres
Publié: (2024)
par: Hu, Yuchen, et autres
Publié: (2024)
Wav2code: Restore Clean Speech Representations via Codebook Lookup for Noise-Robust ASR
par: Hu, Yuchen, et autres
Publié: (2023)
par: Hu, Yuchen, et autres
Publié: (2023)
SumRec: A Framework for Recommendation using Open-Domain Dialogue
par: Asahara, Ryutaro, et autres
Publié: (2024)
par: Asahara, Ryutaro, et autres
Publié: (2024)
AutoElicit: Using Large Language Models for Expert Prior Elicitation in Predictive Modelling
par: Capstick, Alexander, et autres
Publié: (2024)
par: Capstick, Alexander, et autres
Publié: (2024)
Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model
par: Ma, Ziyang, et autres
Publié: (2025)
par: Ma, Ziyang, et autres
Publié: (2025)
Noise-aware Speech Enhancement using Diffusion Probabilistic Model
par: Hu, Yuchen, et autres
Publié: (2023)
par: Hu, Yuchen, et autres
Publié: (2023)
L3Cube-MahaSum: A Comprehensive Dataset and BART Models for Abstractive Text Summarization in Marathi
par: Deshmukh, Pranita, et autres
Publié: (2024)
par: Deshmukh, Pranita, et autres
Publié: (2024)
A Benchmark for Procedural Memory Retrieval in Language Agents
par: Kohar, Ishant, et autres
Publié: (2025)
par: Kohar, Ishant, et autres
Publié: (2025)
On the Quantization Robustness of Diffusion Language Models in Coding Benchmarks
par: Gupta, Aarav, et autres
Publié: (2026)
par: Gupta, Aarav, et autres
Publié: (2026)
CODEMENV: Benchmarking Large Language Models on Code Migration
par: Cheng, Keyuan, et autres
Publié: (2025)
par: Cheng, Keyuan, et autres
Publié: (2025)
Line Goes Up? Inherent Limitations of Benchmarks for Evaluating Large Language Models
par: Fodor, James
Publié: (2025)
par: Fodor, James
Publié: (2025)
Mitigating Semantic Drift: Evaluating LLMs' Efficacy in Psychotherapy through MI Dialogue Summarization
par: Kumar, Vivek, et autres
Publié: (2025)
par: Kumar, Vivek, et autres
Publié: (2025)
Large Language Model Selection with Limited Annotations
par: Durmazkeser, Yavuz, et autres
Publié: (2026)
par: Durmazkeser, Yavuz, et autres
Publié: (2026)
Model Hemorrhage and the Robustness Limits of Large Language Models
par: Ma, Ziyang, et autres
Publié: (2025)
par: Ma, Ziyang, et autres
Publié: (2025)
BioCoder: A Benchmark for Bioinformatics Code Generation with Large Language Models
par: Tang, Xiangru, et autres
Publié: (2023)
par: Tang, Xiangru, et autres
Publié: (2023)
CMLFormer: A Dual Decoder Transformer with Switching Point Learning for Code-Mixed Language Modeling
par: Baral, Aditeya, et autres
Publié: (2025)
par: Baral, Aditeya, et autres
Publié: (2025)
Zero-shot Context Biasing with Trie-based Decoding using Synthetic Multi-Pronunciation
par: Liu, Changsong, et autres
Publié: (2025)
par: Liu, Changsong, et autres
Publié: (2025)
Dynamic Strategy Planning for Efficient Question Answering with Large Language Models
par: Parekh, Tanmay, et autres
Publié: (2024)
par: Parekh, Tanmay, et autres
Publié: (2024)
Discrete Diffusion Language Model for Efficient Text Summarization
par: Dat, Do Huu, et autres
Publié: (2024)
par: Dat, Do Huu, et autres
Publié: (2024)
FD-Bench: A Full-Duplex Benchmarking Pipeline Designed for Full Duplex Spoken Dialogue Systems
par: Peng, Yizhou, et autres
Publié: (2025)
par: Peng, Yizhou, et autres
Publié: (2025)
CroCoSum: A Benchmark Dataset for Cross-Lingual Code-Switched Summarization
par: Zhang, Ruochen, et autres
Publié: (2023)
par: Zhang, Ruochen, et autres
Publié: (2023)
ME-Switch: A Memory-Efficient Expert Switching Framework for Large Language Models
par: Liu, Jing, et autres
Publié: (2024)
par: Liu, Jing, et autres
Publié: (2024)
SUMIE: A Synthetic Benchmark for Incremental Entity Summarization
par: Hwang, Eunjeong, et autres
Publié: (2024)
par: Hwang, Eunjeong, et autres
Publié: (2024)
Documents similaires
-
DiaSynth: Synthetic Dialogue Generation Framework for Low Resource Dialogue Applications
par: Suresh, Sathya Krishnan, et autres
Publié: (2024) -
Listen Again and Choose the Right Answer: A New Paradigm for Automatic Speech Recognition with Large Language Models
par: Hu, Yuchen, et autres
Publié: (2024) -
GenTranslate: Large Language Models are Generative Multilingual Speech and Machine Translators
par: Hu, Yuchen, et autres
Publié: (2024) -
Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR
par: Peng, Yizhou, et autres
Publié: (2025) -
Measuring and Mitigating Toxicity in Large Language Models: A Comprehensive Replication Study
par: Surana, Mokshit, et autres
Publié: (2026)