Grading Handwritten Engineering Exams with Multimodal Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Perš, Janez, Muhovič, Jon, Košir, Andrej, Murovec, Boštjan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MULTIAQUA: A multimodal maritime dataset and robust training strategies for multimodal semantic segmentation
di: Muhovič, Jon, et al.
Pubblicazione: (2025)
di: Muhovič, Jon, et al.
Pubblicazione: (2025)
Dense Center-Direction Regression for Object Counting and Localization with Point Supervision
di: Tabernik, Domen, et al.
Pubblicazione: (2024)
di: Tabernik, Domen, et al.
Pubblicazione: (2024)
Center Direction Network for Grasping Point Localization on Cloths
di: Tabernik, Domen, et al.
Pubblicazione: (2024)
di: Tabernik, Domen, et al.
Pubblicazione: (2024)
Benchmarking Large Language Models for Handwritten Text Recognition
di: Crosilla, Giorgia, et al.
Pubblicazione: (2025)
di: Crosilla, Giorgia, et al.
Pubblicazione: (2025)
Evaluating Large Language Models on Multimodal Chemistry Olympiad Exams
di: Cui, Yiming, et al.
Pubblicazione: (2025)
di: Cui, Yiming, et al.
Pubblicazione: (2025)
Seeing the Big Picture: Evaluating Multimodal LLMs' Ability to Interpret and Grade Handwritten Student Work
di: Henkel, Owen, et al.
Pubblicazione: (2025)
di: Henkel, Owen, et al.
Pubblicazione: (2025)
Can AI Assistance Aid in the Grading of Handwritten Answer Sheets?
di: Sil, Pritam, et al.
Pubblicazione: (2024)
di: Sil, Pritam, et al.
Pubblicazione: (2024)
Can Vision-Language Models Evaluate Handwritten Math?
di: Nath, Oikantik, et al.
Pubblicazione: (2025)
di: Nath, Oikantik, et al.
Pubblicazione: (2025)
Handwritten Text Recognition for Low Resource Languages
di: Dey, Sayantan, et al.
Pubblicazione: (2025)
di: Dey, Sayantan, et al.
Pubblicazione: (2025)
EDU-CIRCUIT-HW: Evaluating Multimodal Large Language Models on Real-World University-Level STEM Student Handwritten Solutions
di: Sun, Weiyu, et al.
Pubblicazione: (2026)
di: Sun, Weiyu, et al.
Pubblicazione: (2026)
EXAMS-V: A Multi-Discipline Multilingual Multimodal Exam Benchmark for Evaluating Vision Language Models
di: Das, Rocktim Jyoti, et al.
Pubblicazione: (2024)
di: Das, Rocktim Jyoti, et al.
Pubblicazione: (2024)
Uncovering the Handwritten Text in the Margins: End-to-end Handwritten Text Detection and Recognition
di: Cheng, Liang, et al.
Pubblicazione: (2023)
di: Cheng, Liang, et al.
Pubblicazione: (2023)
N-gram Injection into Transformers for Dynamic Language Model Adaptation in Handwritten Text Recognition
di: Meyer, Florent, et al.
Pubblicazione: (2026)
di: Meyer, Florent, et al.
Pubblicazione: (2026)
GenExam: A Multidisciplinary Text-to-Image Exam
di: Wang, Zhaokai, et al.
Pubblicazione: (2025)
di: Wang, Zhaokai, et al.
Pubblicazione: (2025)
SketchJudge: A Diagnostic Benchmark for Grading Hand-drawn Diagrams with Multimodal Large Language Models
di: Su, Yuhang, et al.
Pubblicazione: (2026)
di: Su, Yuhang, et al.
Pubblicazione: (2026)
Semi-Supervised Adaptation of Diffusion Models for Handwritten Text Generation
di: Brandenbusch, Kai
Pubblicazione: (2024)
di: Brandenbusch, Kai
Pubblicazione: (2024)
Practical Fine-Tuning of Autoregressive Models on Limited Handwritten Texts
di: Kohút, Jan, et al.
Pubblicazione: (2025)
di: Kohút, Jan, et al.
Pubblicazione: (2025)
Unlocking the Archives: Using Large Language Models to Transcribe Handwritten Historical Documents
di: Humphries, Mark, et al.
Pubblicazione: (2024)
di: Humphries, Mark, et al.
Pubblicazione: (2024)
Multimodal Large Language Models as Image Classifiers
di: Kisel, Nikita, et al.
Pubblicazione: (2026)
di: Kisel, Nikita, et al.
Pubblicazione: (2026)
Semantic Alignment for Multimodal Large Language Models
di: Wu, Tao, et al.
Pubblicazione: (2024)
di: Wu, Tao, et al.
Pubblicazione: (2024)
Leveraging Large Language Models for Multimodal Search
di: Barbany, Oriol, et al.
Pubblicazione: (2024)
di: Barbany, Oriol, et al.
Pubblicazione: (2024)
EuraGovExam: A Multilingual Multimodal Benchmark from Real-World Civil Service Exams
di: Kim, Jaeseong, et al.
Pubblicazione: (2026)
di: Kim, Jaeseong, et al.
Pubblicazione: (2026)
Quo Vadis Handwritten Text Generation for Handwritten Text Recognition?
di: Pippi, Vittorio, et al.
Pubblicazione: (2025)
di: Pippi, Vittorio, et al.
Pubblicazione: (2025)
Leveraging Structure Knowledge and Deep Models for the Detection of Abnormal Handwritten Text
di: Wang, Zi-Rui
Pubblicazione: (2024)
di: Wang, Zi-Rui
Pubblicazione: (2024)
The Return of Structural Handwritten Mathematical Expression Recognition
di: Seitz, Jakob, et al.
Pubblicazione: (2025)
di: Seitz, Jakob, et al.
Pubblicazione: (2025)
A Perspective Analysis of Handwritten Signature Technology
di: Diaz, Moises, et al.
Pubblicazione: (2024)
di: Diaz, Moises, et al.
Pubblicazione: (2024)
Uni-MuMER: Unified Multi-Task Fine-Tuning of Vision-Language Model for Handwritten Mathematical Expression Recognition
di: Li, Yu, et al.
Pubblicazione: (2025)
di: Li, Yu, et al.
Pubblicazione: (2025)
Mario: Multimodal Graph Reasoning with Large Language Models
di: Sun, Yuanfu, et al.
Pubblicazione: (2026)
di: Sun, Yuanfu, et al.
Pubblicazione: (2026)
MoME: Mixture of Multimodal Experts for Generalist Multimodal Large Language Models
di: Shen, Leyang, et al.
Pubblicazione: (2024)
di: Shen, Leyang, et al.
Pubblicazione: (2024)
MMaDA: Multimodal Large Diffusion Language Models
di: Yang, Ling, et al.
Pubblicazione: (2025)
di: Yang, Ling, et al.
Pubblicazione: (2025)
Grounding Everything in Tokens for Multimodal Large Language Models
di: Ren, Xiangxuan, et al.
Pubblicazione: (2025)
di: Ren, Xiangxuan, et al.
Pubblicazione: (2025)
Large Language Models for Multimodal Deformable Image Registration
di: Ma, Mingrui, et al.
Pubblicazione: (2024)
di: Ma, Mingrui, et al.
Pubblicazione: (2024)
Hallucination of Multimodal Large Language Models: A Survey
di: Bai, Zechen, et al.
Pubblicazione: (2024)
di: Bai, Zechen, et al.
Pubblicazione: (2024)
Improving Visual Storytelling with Multimodal Large Language Models
di: Lin, Xiaochuan, et al.
Pubblicazione: (2024)
di: Lin, Xiaochuan, et al.
Pubblicazione: (2024)
Measuring Epistemic Humility in Multimodal Large Language Models
di: Tong, Bingkui, et al.
Pubblicazione: (2025)
di: Tong, Bingkui, et al.
Pubblicazione: (2025)
Survey of Adversarial Robustness in Multimodal Large Language Models
di: Jiang, Chengze, et al.
Pubblicazione: (2025)
di: Jiang, Chengze, et al.
Pubblicazione: (2025)
Visual Representation Alignment for Multimodal Large Language Models
di: Yoon, Heeji, et al.
Pubblicazione: (2025)
di: Yoon, Heeji, et al.
Pubblicazione: (2025)
Safety of Multimodal Large Language Models on Images and Texts
di: Liu, Xin, et al.
Pubblicazione: (2024)
di: Liu, Xin, et al.
Pubblicazione: (2024)
Col-OLHTR: A Novel Framework for Multimodal Online Handwritten Text Recognition
di: Liu, Chenyu, et al.
Pubblicazione: (2025)
di: Liu, Chenyu, et al.
Pubblicazione: (2025)
Debiasing Multimodal Large Language Models via Penalization of Language Priors
di: Zhang, YiFan, et al.
Pubblicazione: (2024)
di: Zhang, YiFan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
MULTIAQUA: A multimodal maritime dataset and robust training strategies for multimodal semantic segmentation
di: Muhovič, Jon, et al.
Pubblicazione: (2025) -
Dense Center-Direction Regression for Object Counting and Localization with Point Supervision
di: Tabernik, Domen, et al.
Pubblicazione: (2024) -
Center Direction Network for Grasping Point Localization on Cloths
di: Tabernik, Domen, et al.
Pubblicazione: (2024) -
Benchmarking Large Language Models for Handwritten Text Recognition
di: Crosilla, Giorgia, et al.
Pubblicazione: (2025) -
Evaluating Large Language Models on Multimodal Chemistry Olympiad Exams
di: Cui, Yiming, et al.
Pubblicazione: (2025)