Rethinking Meeting Effectiveness: A Benchmark and Framework for Temporal Fine-grained Automatic Meeting Effectiveness Evaluation
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Yihang, Chu, Chenhui |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
EMS: Efficient and Effective Massively Multilingual Sentence Embedding Learning
por: Mao, Zhuoyuan, et al.
Publicado: (2022)
por: Mao, Zhuoyuan, et al.
Publicado: (2022)
When Large Language Models Meet Speech: A Survey on Integration Approaches
por: Yang, Zhengdong, et al.
Publicado: (2025)
por: Yang, Zhengdong, et al.
Publicado: (2025)
FActBench: A Benchmark for Fine-grained Automatic Evaluation of LLM-Generated Text in the Medical Domain
por: Afzal, Anum, et al.
Publicado: (2025)
por: Afzal, Anum, et al.
Publicado: (2025)
CFSafety: Comprehensive Fine-grained Safety Assessment for LLMs
por: Liu, Zhihao, et al.
Publicado: (2024)
por: Liu, Zhihao, et al.
Publicado: (2024)
Evaluating the Effectiveness of Black-Box Prompt Optimization as the Scale of LLMs Continues to Grow
por: Zhou, Ziyu, et al.
Publicado: (2025)
por: Zhou, Ziyu, et al.
Publicado: (2025)
CREAM: Comparison-Based Reference-Free ELO-Ranked Automatic Evaluation for Meeting Summarization
por: Gong, Ziwei, et al.
Publicado: (2024)
por: Gong, Ziwei, et al.
Publicado: (2024)
A Comprehensive Analysis of the Effectiveness of Large Language Models as Automatic Dialogue Evaluators
por: Zhang, Chen, et al.
Publicado: (2023)
por: Zhang, Chen, et al.
Publicado: (2023)
LoRA-FA: Efficient and Effective Low Rank Representation Fine-tuning
por: Zhang, Longteng, et al.
Publicado: (2023)
por: Zhang, Longteng, et al.
Publicado: (2023)
MathOPEval: A Fine-grained Evaluation Benchmark for Visual Operations of MLLMs in Mathematical Reasoning
por: Li, Xiaoyuan, et al.
Publicado: (2025)
por: Li, Xiaoyuan, et al.
Publicado: (2025)
Generalist Scanner Meets Specialist Locator: A Synergistic Coarse-to-Fine Framework for Robust GUI Grounding
por: Li, Zhecheng, et al.
Publicado: (2025)
por: Li, Zhecheng, et al.
Publicado: (2025)
When Scale Meets Diversity: Evaluating Language Models on Fine-Grained Multilingual Claim Verification
por: Shcharbakova, Hanna, et al.
Publicado: (2025)
por: Shcharbakova, Hanna, et al.
Publicado: (2025)
Factcheck-Bench: Fine-Grained Evaluation Benchmark for Automatic Fact-checkers
por: Wang, Yuxia, et al.
Publicado: (2023)
por: Wang, Yuxia, et al.
Publicado: (2023)
Texts or Images? A Fine-grained Analysis on the Effectiveness of Input Representations and Models for Table Question Answering
por: Zhou, Wei, et al.
Publicado: (2025)
por: Zhou, Wei, et al.
Publicado: (2025)
TemporalBench: Benchmarking Fine-grained Temporal Understanding for Multimodal Video Models
por: Cai, Mu, et al.
Publicado: (2024)
por: Cai, Mu, et al.
Publicado: (2024)
What's under the hood: Investigating Automatic Metrics on Meeting Summarization
por: Kirstein, Frederic, et al.
Publicado: (2024)
por: Kirstein, Frederic, et al.
Publicado: (2024)
M$^3$FinMeeting: A Multilingual, Multi-Sector, and Multi-Task Financial Meeting Understanding Evaluation Dataset
por: Zhu, Jie, et al.
Publicado: (2025)
por: Zhu, Jie, et al.
Publicado: (2025)
Rethinking the Unsolvable: When In-Context Search Meets Test-Time Scaling
por: Xia, Fanzeng, et al.
Publicado: (2025)
por: Xia, Fanzeng, et al.
Publicado: (2025)
A Dual-Perspective NLG Meta-Evaluation Framework with Automatic Benchmark and Better Interpretability
por: Hu, Xinyu, et al.
Publicado: (2025)
por: Hu, Xinyu, et al.
Publicado: (2025)
Looking for the Bottleneck in Fine-grained Temporal Relation Classification
por: Sousa, Hugo, et al.
Publicado: (2026)
por: Sousa, Hugo, et al.
Publicado: (2026)
When LLMs Meet Cunning Texts: A Fallacy Understanding Benchmark for Large Language Models
por: Li, Yinghui, et al.
Publicado: (2024)
por: Li, Yinghui, et al.
Publicado: (2024)
PersLitEval: Fine-grained Benchmark and Evaluation of LLMs on Persian Literature Questions
por: Niazi, Ruhallah, et al.
Publicado: (2026)
por: Niazi, Ruhallah, et al.
Publicado: (2026)
Text Meets Topology: Rethinking Out-of-distribution Detection in Text-Rich Networks
por: Wang, Danny, et al.
Publicado: (2025)
por: Wang, Danny, et al.
Publicado: (2025)
AraHalluEval: A Fine-grained Hallucination Evaluation Framework for Arabic LLMs
por: Alansari, Aisha, et al.
Publicado: (2025)
por: Alansari, Aisha, et al.
Publicado: (2025)
Fine-grained Stateful Knowledge Exploration: Effective and Efficient Graph Retrieval with Large Language Models
por: Tao, Dehao, et al.
Publicado: (2024)
por: Tao, Dehao, et al.
Publicado: (2024)
The BiGGen Bench: A Principled Benchmark for Fine-grained Evaluation of Language Models with Language Models
por: Kim, Seungone, et al.
Publicado: (2024)
por: Kim, Seungone, et al.
Publicado: (2024)
Large Language Models Meet Symbolic Provers for Logical Reasoning Evaluation
por: Qi, Chengwen, et al.
Publicado: (2025)
por: Qi, Chengwen, et al.
Publicado: (2025)
MELD-ST: An Emotion-aware Speech Translation Dataset
por: Chen, Sirou, et al.
Publicado: (2024)
por: Chen, Sirou, et al.
Publicado: (2024)
Model Tells Itself Where to Attend: Faithfulness Meets Automatic Attention Steering
por: Zhang, Qingru, et al.
Publicado: (2024)
por: Zhang, Qingru, et al.
Publicado: (2024)
Speculative Decoding Meets Quantization: Compatibility Evaluation and Hierarchical Framework Design
por: Zhang, Yudi, et al.
Publicado: (2025)
por: Zhang, Yudi, et al.
Publicado: (2025)
Recursive Language Models Meet Uncertainty: The Surprising Effectiveness of Self-Reflective Program Search for Long Context
por: Alizadeh, Keivan, et al.
Publicado: (2026)
por: Alizadeh, Keivan, et al.
Publicado: (2026)
Rethinking Composed Image Retrieval Evaluation: A Fine-Grained Benchmark from Image Editing
por: Song, Tingyu, et al.
Publicado: (2026)
por: Song, Tingyu, et al.
Publicado: (2026)
Understanding the Prompt Sensitivity
por: Liu, Yang, et al.
Publicado: (2026)
por: Liu, Yang, et al.
Publicado: (2026)
Do LLMs Align Human Values Regarding Social Biases? Judging and Explaining Social Biases with LLMs
por: Liu, Yang, et al.
Publicado: (2025)
por: Liu, Yang, et al.
Publicado: (2025)
Meet Dynamic Individual Preferences: Resolving Conflicting Human Value with Paired Fine-Tuning
por: Wang, Shanyong, et al.
Publicado: (2026)
por: Wang, Shanyong, et al.
Publicado: (2026)
MEETING DELEGATE: Benchmarking LLMs on Attending Meetings on Our Behalf
por: Hu, Lingxiang, et al.
Publicado: (2025)
por: Hu, Lingxiang, et al.
Publicado: (2025)
A Novel Evaluation Benchmark for Medical LLMs: Illuminating Safety and Effectiveness in Clinical Domains
por: Wang, Shirui, et al.
Publicado: (2025)
por: Wang, Shirui, et al.
Publicado: (2025)
Policies and Evaluation for Online Meeting Summarization
por: Schneider, Felix, et al.
Publicado: (2025)
por: Schneider, Felix, et al.
Publicado: (2025)
RPC-Bench: A Fine-grained Benchmark for Research Paper Comprehension
por: Chen, Yelin, et al.
Publicado: (2026)
por: Chen, Yelin, et al.
Publicado: (2026)
MedRCube: A Multidimensional Framework for Fine-Grained and In-Depth Evaluation of MLLMs in Medical Imaging
por: Bao, Zhijie, et al.
Publicado: (2026)
por: Bao, Zhijie, et al.
Publicado: (2026)
Evaluating the Effectiveness of Cost-Efficient Large Language Models in Benchmark Biomedical Tasks
por: Jahan, Israt, et al.
Publicado: (2025)
por: Jahan, Israt, et al.
Publicado: (2025)
Ejemplares similares
-
EMS: Efficient and Effective Massively Multilingual Sentence Embedding Learning
por: Mao, Zhuoyuan, et al.
Publicado: (2022) -
When Large Language Models Meet Speech: A Survey on Integration Approaches
por: Yang, Zhengdong, et al.
Publicado: (2025) -
FActBench: A Benchmark for Fine-grained Automatic Evaluation of LLM-Generated Text in the Medical Domain
por: Afzal, Anum, et al.
Publicado: (2025) -
CFSafety: Comprehensive Fine-grained Safety Assessment for LLMs
por: Liu, Zhihao, et al.
Publicado: (2024) -
Evaluating the Effectiveness of Black-Box Prompt Optimization as the Scale of LLMs Continues to Grow
por: Zhou, Ziyu, et al.
Publicado: (2025)