Evaluating Large Language Models in Process Mining: Capabilities, Benchmarks, and Evaluation Strategies
Fuente:
arXiv
Saved in:
| Main Authors: | Berti, Alessandro, Kourani, Humam, Hafke, Hannes, Li, Chiao-Yun, Schuster, Daniel |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
PM-LLM-Benchmark: Evaluating Large Language Models on Process Mining Tasks
by: Berti, Alessandro, et al.
Published: (2024)
by: Berti, Alessandro, et al.
Published: (2024)
Evaluating Large Language Models on Business Process Modeling: Framework, Benchmark, and Self-Improvement Analysis
by: Kourani, Humam, et al.
Published: (2024)
by: Kourani, Humam, et al.
Published: (2024)
Process Modeling With Large Language Models
by: Kourani, Humam, et al.
Published: (2024)
by: Kourani, Humam, et al.
Published: (2024)
Leveraging Large Language Models for Enhanced Process Model Comprehension
by: Kourani, Humam, et al.
Published: (2024)
by: Kourani, Humam, et al.
Published: (2024)
ProMoAI: Process Modeling with Generative AI
by: Kourani, Humam, et al.
Published: (2024)
by: Kourani, Humam, et al.
Published: (2024)
Revealing Inherent Concurrency in Event Data: A Partial Order Approach to Process Discovery
by: Kourani, Humam, et al.
Published: (2025)
by: Kourani, Humam, et al.
Published: (2025)
Hierarchical Decomposition of Separable Workflow-Nets
by: Kourani, Humam, et al.
Published: (2026)
by: Kourani, Humam, et al.
Published: (2026)
Beyond Control-Flow: Integrating the Resource Perspective into Multi-Collaborative Process Modeling from Text
by: Antonov, Anton, et al.
Published: (2026)
by: Antonov, Anton, et al.
Published: (2026)
Knowledge-Driven Hallucination in Large Language Models: An Empirical Study on Process Modeling
by: Kourani, Humam, et al.
Published: (2025)
by: Kourani, Humam, et al.
Published: (2025)
PMAx: An Agentic Framework for AI-Driven Process Mining
by: Antonov, Anton, et al.
Published: (2026)
by: Antonov, Anton, et al.
Published: (2026)
Re-Thinking Process Mining in the AI-Based Agents Era
by: Berti, Alessandro, et al.
Published: (2024)
by: Berti, Alessandro, et al.
Published: (2024)
Applying Process Mining on Scientific Workflows: a Case Study on High Performance Computing Data
by: Sadeghibogar, Zahra, et al.
Published: (2023)
by: Sadeghibogar, Zahra, et al.
Published: (2023)
PM4Py.LLM: a Comprehensive Module for Implementing PM on LLMs
by: Berti, Alessandro
Published: (2024)
by: Berti, Alessandro
Published: (2024)
Revolutionizing Database Q&A with Large Language Models: Comprehensive Benchmark and Evaluation
by: Zheng, Yihang, et al.
Published: (2024)
by: Zheng, Yihang, et al.
Published: (2024)
On the Potential of Large Language Models to Solve Semantics-Aware Process Mining Tasks
by: Rebmann, Adrian, et al.
Published: (2025)
by: Rebmann, Adrian, et al.
Published: (2025)
Bridging Domain Knowledge and Process Discovery Using Large Language Models
by: Norouzifar, Ali, et al.
Published: (2024)
by: Norouzifar, Ali, et al.
Published: (2024)
Integrating Domain Knowledge into Process Discovery Using Large Language Models
by: Norouzifar, Ali, et al.
Published: (2025)
by: Norouzifar, Ali, et al.
Published: (2025)
Evaluating SQL Understanding in Large Language Models
by: Rahaman, Ananya, et al.
Published: (2024)
by: Rahaman, Ananya, et al.
Published: (2024)
An Empirical Evaluation of Serverless Cloud Infrastructure for Large-Scale Data Processing
by: Bodner, Thomas, et al.
Published: (2025)
by: Bodner, Thomas, et al.
Published: (2025)
CPN-Py: A Python-Based Tool for Modeling and Analyzing Colored Petri Nets
by: Berti, Alessandro, et al.
Published: (2025)
by: Berti, Alessandro, et al.
Published: (2025)
OCEL 2.0 Resources -- www.ocel-standard.org
by: Koren, Istvan, et al.
Published: (2024)
by: Koren, Istvan, et al.
Published: (2024)
[Experiment, Analysis, and Benchmark] Systematic Evaluation of Plan-based Adaptive Query Processing
by: Mu, Pei, et al.
Published: (2025)
by: Mu, Pei, et al.
Published: (2025)
Systematic Evaluation of Knowledge Graph Repair with Large Language Models
by: Lin, Tung-Wei, et al.
Published: (2025)
by: Lin, Tung-Wei, et al.
Published: (2025)
IBM Multilevel Process Mining vs de facto Object-Centric Process Mining approaches
by: Ronzoni, Alberto, et al.
Published: (2025)
by: Ronzoni, Alberto, et al.
Published: (2025)
Evaluating Data Quality Tools: Measurement Capabilities and LLM Integration
by: Rehberger, Tobias, et al.
Published: (2026)
by: Rehberger, Tobias, et al.
Published: (2026)
A Systematic Review on Process Mining for Curricular Analysis
by: Calegari, Daniel, et al.
Published: (2024)
by: Calegari, Daniel, et al.
Published: (2024)
AVOCADO: The Streaming Process Mining Challenge
by: Imenkamp, Christian, et al.
Published: (2025)
by: Imenkamp, Christian, et al.
Published: (2025)
Benchmarking Large Language Models for Knowledge Graph Validation
by: Shami, Farzad, et al.
Published: (2026)
by: Shami, Farzad, et al.
Published: (2026)
Is Large Language Model Good at Database Knob Tuning? A Comprehensive Experimental Evaluation
by: Li, Yiyan, et al.
Published: (2024)
by: Li, Yiyan, et al.
Published: (2024)
RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models
by: Satriani, Dario, et al.
Published: (2025)
by: Satriani, Dario, et al.
Published: (2025)
Skill Learning Using Process Mining for Large Language Model Plan Generation
by: Redis, Andrei Cosmin, et al.
Published: (2024)
by: Redis, Andrei Cosmin, et al.
Published: (2024)
Advancing Spatial Reasoning in Large Language Models: An In-Depth Evaluation and Enhancement Using the StepGame Benchmark
by: Li, Fangjun, et al.
Published: (2024)
by: Li, Fangjun, et al.
Published: (2024)
Large Language Model-Enhanced Relational Operators: Taxonomy, Benchmark, and Analysis
by: Su, Yunxiang, et al.
Published: (2026)
by: Su, Yunxiang, et al.
Published: (2026)
Revisiting Task-Oriented Dataset Search in the Era of Large Language Models: Challenges, Benchmark, and Solution
by: Wei, Zixin, et al.
Published: (2025)
by: Wei, Zixin, et al.
Published: (2025)
Dynamic and Scalable Data Preparation for Object-Centric Process Mining
by: Bosmans, Lien, et al.
Published: (2024)
by: Bosmans, Lien, et al.
Published: (2024)
A Ground Truth Approach for Assessing Process Mining Techniques
by: Sommers, Dominique, et al.
Published: (2025)
by: Sommers, Dominique, et al.
Published: (2025)
Unlocking Non-Block-Structured Decisions: Inductive Mining with Choice Graphs
by: Kourani, Humam, et al.
Published: (2025)
by: Kourani, Humam, et al.
Published: (2025)
Reframing Spatial Reasoning Evaluation in Language Models: A Real-World Simulation Benchmark for Qualitative Reasoning
by: Li, Fangjun, et al.
Published: (2024)
by: Li, Fangjun, et al.
Published: (2024)
UniEntrezDB: Large-scale Gene Ontology Annotation Dataset and Evaluation Benchmarks with Unified Entrez Gene Identifiers
by: Miao, Yuwei, et al.
Published: (2024)
by: Miao, Yuwei, et al.
Published: (2024)
Development of Data Evaluation Benchmark for Data Wrangling Recommendation System
by: Wang, Yuqing, et al.
Published: (2024)
by: Wang, Yuqing, et al.
Published: (2024)
Similar Items
-
PM-LLM-Benchmark: Evaluating Large Language Models on Process Mining Tasks
by: Berti, Alessandro, et al.
Published: (2024) -
Evaluating Large Language Models on Business Process Modeling: Framework, Benchmark, and Self-Improvement Analysis
by: Kourani, Humam, et al.
Published: (2024) -
Process Modeling With Large Language Models
by: Kourani, Humam, et al.
Published: (2024) -
Leveraging Large Language Models for Enhanced Process Model Comprehension
by: Kourani, Humam, et al.
Published: (2024) -
ProMoAI: Process Modeling with Generative AI
by: Kourani, Humam, et al.
Published: (2024)