BeDiscovER: The Benchmark of Discourse Understanding in the Era of Reasoning Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Chuyuan, Carenini, Giuseppe |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
IntentGrasp: A Comprehensive Benchmark for Intent Understanding
by: Yin, Yuwei, et al.
Published: (2026)
by: Yin, Yuwei, et al.
Published: (2026)
Delta-KNN: Improving Demonstration Selection in In-Context Learning for Alzheimer's Disease Detection
by: Li, Chuyuan, et al.
Published: (2025)
by: Li, Chuyuan, et al.
Published: (2025)
Topic-Guided Reinforcement Learning with LLMs for Enhancing Multi-Document Summarization
by: Li, Chuyuan, et al.
Published: (2025)
by: Li, Chuyuan, et al.
Published: (2025)
CEMTM: Contextual Embedding-based Multimodal Topic Modeling
by: Abaskohi, Amirhossein, et al.
Published: (2025)
by: Abaskohi, Amirhossein, et al.
Published: (2025)
Improving Neural Topic Modeling with Semantically-Grounded Soft Label Distributions
by: Li, Raymond, et al.
Published: (2026)
by: Li, Raymond, et al.
Published: (2026)
Multi2: Multi-Agent Test-Time Scalable Framework for Multi-Document Processing
by: Cao, Juntai, et al.
Published: (2025)
by: Cao, Juntai, et al.
Published: (2025)
Improving Language Models with Intentional Analysis
by: Yin, Yuwei, et al.
Published: (2025)
by: Yin, Yuwei, et al.
Published: (2025)
Captioning Visualizations with Large Language Models (CVLLM): A Tutorial
by: Carenini, Giuseppe, et al.
Published: (2024)
by: Carenini, Giuseppe, et al.
Published: (2024)
ER-Reason: A Benchmark Dataset for LLM Clinical Reasoning in the Emergency Room
by: Mehandru, Nikita, et al.
Published: (2025)
by: Mehandru, Nikita, et al.
Published: (2025)
Which course? Discourse! Teaching Discourse and Generation in the Era of LLMs
by: Li, Junyi Jessy, et al.
Published: (2026)
by: Li, Junyi Jessy, et al.
Published: (2026)
SWI: Speaking with Intent in Large Language Models
by: Yin, Yuwei, et al.
Published: (2025)
by: Yin, Yuwei, et al.
Published: (2025)
A Multi-Level Benchmark for Causal Language Understanding in Social Media Discourse
by: Ding, Xiaohan, et al.
Published: (2025)
by: Ding, Xiaohan, et al.
Published: (2025)
Towards a Fully Interpretable and More Scalable RSA Model for Metaphor Understanding
by: Carenini, Gaia, et al.
Published: (2024)
by: Carenini, Gaia, et al.
Published: (2024)
Neural Multimodal Topic Modeling: A Comprehensive Evaluation
by: González-Pizarro, Felipe, et al.
Published: (2024)
by: González-Pizarro, Felipe, et al.
Published: (2024)
A Survey of Mathematical Reasoning in the Era of Multimodal Large Language Model: Benchmark, Method & Challenges
by: Yan, Yibo, et al.
Published: (2024)
by: Yan, Yibo, et al.
Published: (2024)
The Ouroboros of Benchmarking: Reasoning Evaluation in an Era of Saturation
by: Deveci, İbrahim Ethem, et al.
Published: (2025)
by: Deveci, İbrahim Ethem, et al.
Published: (2025)
Personalized Abstractive Summarization by Tri-agent Generation Pipeline
by: Xiao, Wen, et al.
Published: (2023)
by: Xiao, Wen, et al.
Published: (2023)
Towards an Analysis of Discourse and Interactional Pragmatic Reasoning Capabilities of Large Language Models
by: Robrecht, Amelie, et al.
Published: (2024)
by: Robrecht, Amelie, et al.
Published: (2024)
HyperGVL: Benchmarking and Improving Large Vision-Language Models in Hypergraph Understanding and Reasoning
by: Wei, Yanbin, et al.
Published: (2026)
by: Wei, Yanbin, et al.
Published: (2026)
FormosanBench: Benchmarking Low-Resource Austronesian Languages in the Era of Large Language Models
by: Lin, Kaiying Kevin, et al.
Published: (2025)
by: Lin, Kaiying Kevin, et al.
Published: (2025)
Evolutionary Prompt Optimization Discovers Emergent Multimodal Reasoning Strategies in Vision-Language Models
by: Bharthulwar, Sid, et al.
Published: (2025)
by: Bharthulwar, Sid, et al.
Published: (2025)
Discursive Circuits: How Do Language Models Understand Discourse Relations?
by: Miao, Yisong, et al.
Published: (2025)
by: Miao, Yisong, et al.
Published: (2025)
Self-Discover: Large Language Models Self-Compose Reasoning Structures
by: Zhou, Pei, et al.
Published: (2024)
by: Zhou, Pei, et al.
Published: (2024)
Discovering Elementary Discourse Units in Textual Data Using Canonical Correlation Analysis
by: Mehndiratta, Akanksha, et al.
Published: (2024)
by: Mehndiratta, Akanksha, et al.
Published: (2024)
OntoURL: A Benchmark for Evaluating Large Language Models on Symbolic Ontological Understanding, Reasoning and Learning
by: Zhang, Xiao, et al.
Published: (2025)
by: Zhang, Xiao, et al.
Published: (2025)
Benchmarking and Improving Large Vision-Language Models for Fundamental Visual Graph Understanding and Reasoning
by: Zhu, Yingjie, et al.
Published: (2024)
by: Zhu, Yingjie, et al.
Published: (2024)
VisEval: A Benchmark for Data Visualization in the Era of Large Language Models
by: Chen, Nan, et al.
Published: (2024)
by: Chen, Nan, et al.
Published: (2024)
DiffER: Diffusion Entity-Relation Modeling for Reversal Curse in Diffusion Large Language Models
by: He, Shaokai, et al.
Published: (2026)
by: He, Shaokai, et al.
Published: (2026)
Benchmarking Multi-Image Understanding in Vision and Language Models: Perception, Knowledge, Reasoning, and Multi-Hop Reasoning
by: Zhao, Bingchen, et al.
Published: (2024)
by: Zhao, Bingchen, et al.
Published: (2024)
Seeing is Not Understanding: A Benchmark on Perception-Cognition Disparities in Large Language Models
by: Li, Haokun, et al.
Published: (2025)
by: Li, Haokun, et al.
Published: (2025)
Benchmarking and Understanding Compositional Relational Reasoning of LLMs
by: Ni, Ruikang, et al.
Published: (2024)
by: Ni, Ruikang, et al.
Published: (2024)
Benchmarking the Medical Understanding and Reasoning of Large Language Models in Arabic Healthcare Tasks
by: AlDahoul, Nouar, et al.
Published: (2025)
by: AlDahoul, Nouar, et al.
Published: (2025)
Infusing Theory of Mind into Socially Intelligent LLM Agents
by: Hwang, EunJeong, et al.
Published: (2025)
by: Hwang, EunJeong, et al.
Published: (2025)
TRAM: Benchmarking Temporal Reasoning for Large Language Models
by: Wang, Yuqing, et al.
Published: (2023)
by: Wang, Yuqing, et al.
Published: (2023)
MixRea: Benchmarking Explicit-Implicit Reasoning in Large Language Models
by: Cai, Yuanqing, et al.
Published: (2026)
by: Cai, Yuanqing, et al.
Published: (2026)
ChartGaze: Enhancing Chart Understanding in LVLMs with Eye-Tracking Guided Attention Refinement
by: Salamatian, Ali, et al.
Published: (2025)
by: Salamatian, Ali, et al.
Published: (2025)
Towards Reasoning Era: A Survey of Long Chain-of-Thought for Reasoning Large Language Models
by: Chen, Qiguang, et al.
Published: (2025)
by: Chen, Qiguang, et al.
Published: (2025)
Inadequacies of Large Language Model Benchmarks in the Era of Generative Artificial Intelligence
by: McIntosh, Timothy R., et al.
Published: (2024)
by: McIntosh, Timothy R., et al.
Published: (2024)
The Detection and Understanding of Fictional Discourse
by: Piper, Andrew, et al.
Published: (2024)
by: Piper, Andrew, et al.
Published: (2024)
Discovering Decoupled Functional Modules in Large Language Models
by: Yu, Yanke, et al.
Published: (2026)
by: Yu, Yanke, et al.
Published: (2026)
Similar Items
-
IntentGrasp: A Comprehensive Benchmark for Intent Understanding
by: Yin, Yuwei, et al.
Published: (2026) -
Delta-KNN: Improving Demonstration Selection in In-Context Learning for Alzheimer's Disease Detection
by: Li, Chuyuan, et al.
Published: (2025) -
Topic-Guided Reinforcement Learning with LLMs for Enhancing Multi-Document Summarization
by: Li, Chuyuan, et al.
Published: (2025) -
CEMTM: Contextual Embedding-based Multimodal Topic Modeling
by: Abaskohi, Amirhossein, et al.
Published: (2025) -
Improving Neural Topic Modeling with Semantically-Grounded Soft Label Distributions
by: Li, Raymond, et al.
Published: (2026)