Decision-Level Ordinal Modeling for Multimodal Essay Scoring with Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Han, Su, Jiamin, liu, Li |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
EssayJudge: A Multi-Granular Benchmark for Assessing Automated Essay Scoring Capabilities of Multimodal Large Language Models
par: Su, Jiamin, et autres
Publié: (2025)
par: Su, Jiamin, et autres
Publié: (2025)
CAFES: A Collaborative Multi-Agent Framework for Multi-Granular Multimodal Essay Scoring
par: Su, Jiamin, et autres
Publié: (2025)
par: Su, Jiamin, et autres
Publié: (2025)
Evaluating Austrian A-Level German Essays with Large Language Models for Automated Essay Scoring
par: Kubesch, Jonas, et autres
Publié: (2026)
par: Kubesch, Jonas, et autres
Publié: (2026)
Rank-Then-Score: Enhancing Large Language Models for Automated Essay Scoring
par: Cai, Yida, et autres
Publié: (2025)
par: Cai, Yida, et autres
Publié: (2025)
Can Large Language Models Automatically Score Proficiency of Written Essays?
par: Mansour, Watheq, et autres
Publié: (2024)
par: Mansour, Watheq, et autres
Publié: (2024)
EssayBench: Evaluating Large Language Models in Multi-Genre Chinese Essay Writing
par: Gao, Fan, et autres
Publié: (2025)
par: Gao, Fan, et autres
Publié: (2025)
LCES: Zero-shot Automated Essay Scoring via Pairwise Comparisons Using Large Language Models
par: Shibata, Takumi, et autres
Publié: (2025)
par: Shibata, Takumi, et autres
Publié: (2025)
GLoRE: Evaluating Logical Reasoning of Large Language Models
par: liu, Hanmeng, et autres
Publié: (2023)
par: liu, Hanmeng, et autres
Publié: (2023)
Are Large Language Models Good Essay Graders?
par: Kundu, Anindita, et autres
Publié: (2024)
par: Kundu, Anindita, et autres
Publié: (2024)
Automatic Essay Scoring and Feedback Generation in Basque Language Learning
par: Azurmendi, Ekhi, et autres
Publié: (2025)
par: Azurmendi, Ekhi, et autres
Publié: (2025)
Autoregressive Score Generation for Multi-trait Essay Scoring
par: Do, Heejin, et autres
Publié: (2024)
par: Do, Heejin, et autres
Publié: (2024)
Rationale Behind Essay Scores: Enhancing S-LLM's Multi-Trait Essay Scoring with Rationale Generated by LLMs
par: Chu, SeongYeub, et autres
Publié: (2024)
par: Chu, SeongYeub, et autres
Publié: (2024)
DREsS: Dataset for Rubric-based Essay Scoring on EFL Writing
par: Yoo, Haneul, et autres
Publié: (2024)
par: Yoo, Haneul, et autres
Publié: (2024)
Towards Robust Instruction Tuning on Multimodal Large Language Models
par: Han, Wei, et autres
Publié: (2024)
par: Han, Wei, et autres
Publié: (2024)
Enhancing Marker Scoring Accuracy through Ordinal Confidence Modelling in Educational Assessments
par: Chakravarty, Abhirup, et autres
Publié: (2025)
par: Chakravarty, Abhirup, et autres
Publié: (2025)
Levels of Analysis for Large Language Models
par: Ku, Alexander Y., et autres
Publié: (2025)
par: Ku, Alexander Y., et autres
Publié: (2025)
Improve LLM-based Automatic Essay Scoring with Linguistic Features
par: Hou, Zhaoyi Joey, et autres
Publié: (2025)
par: Hou, Zhaoyi Joey, et autres
Publié: (2025)
LAMPO: Large Language Models as Preference Machines for Few-shot Ordinal Classification
par: Qin, Zhen, et autres
Publié: (2024)
par: Qin, Zhen, et autres
Publié: (2024)
SGM: Safety Glasses for Multimodal Large Language Models via Neuron-Level Detoxification
par: Wang, Hongbo, et autres
Publié: (2025)
par: Wang, Hongbo, et autres
Publié: (2025)
Cross-Modal Consistency in Multimodal Large Language Models
par: Zhang, Xiang, et autres
Publié: (2024)
par: Zhang, Xiang, et autres
Publié: (2024)
Exploring and Evaluating Multimodal Knowledge Reasoning Consistency of Multimodal Large Language Models
par: Jia, Boyu, et autres
Publié: (2025)
par: Jia, Boyu, et autres
Publié: (2025)
AI-generated Essays: Characteristics and Implications on Automated Scoring and Academic Integrity
par: Zhong, Yang, et autres
Publié: (2024)
par: Zhong, Yang, et autres
Publié: (2024)
FinTral: A Family of GPT-4 Level Multimodal Financial Large Language Models
par: Bhatia, Gagan, et autres
Publié: (2024)
par: Bhatia, Gagan, et autres
Publié: (2024)
Teach-to-Reason with Scoring: Self-Explainable Rationale-Driven Multi-Trait Essay Scoring
par: Do, Heejin, et autres
Publié: (2025)
par: Do, Heejin, et autres
Publié: (2025)
Unveiling Trust in Multimodal Large Language Models: Evaluation, Analysis, and Mitigation
par: Zhang, Yichi, et autres
Publié: (2025)
par: Zhang, Yichi, et autres
Publié: (2025)
Enhancing Decision-Making of Large Language Models via Actor-Critic
par: Dong, Heng, et autres
Publié: (2025)
par: Dong, Heng, et autres
Publié: (2025)
Applying Large Language Models and Chain-of-Thought for Automatic Scoring
par: Lee, Gyeong-Geon, et autres
Publié: (2023)
par: Lee, Gyeong-Geon, et autres
Publié: (2023)
On the Decision-Making Abilities in Role-Playing using Large Language Models
par: Shen, Chenglei, et autres
Publié: (2024)
par: Shen, Chenglei, et autres
Publié: (2024)
ChatSR: Multimodal Large Language Models for Scientific Formula Discovery
par: Li, Yanjie, et autres
Publié: (2024)
par: Li, Yanjie, et autres
Publié: (2024)
Activations as Features: Probing LLMs for Generalizable Essay Scoring Representations
par: Chi, Jinwei, et autres
Publié: (2025)
par: Chi, Jinwei, et autres
Publié: (2025)
Transformer-based Joint Modelling for Automatic Essay Scoring and Off-Topic Detection
par: Das, Sourya Dipta, et autres
Publié: (2024)
par: Das, Sourya Dipta, et autres
Publié: (2024)
Autoregressive Multi-trait Essay Scoring via Reinforcement Learning with Scoring-aware Multiple Rewards
par: Do, Heejin, et autres
Publié: (2024)
par: Do, Heejin, et autres
Publié: (2024)
InfiR : Crafting Effective Small Language Models and Multimodal Small Language Models in Reasoning
par: Xie, Congkai, et autres
Publié: (2025)
par: Xie, Congkai, et autres
Publié: (2025)
Human-AI Collaborative Essay Scoring: A Dual-Process Framework with LLMs
par: Xiao, Changrong, et autres
Publié: (2024)
par: Xiao, Changrong, et autres
Publié: (2024)
Measuring Meaning Composition in the Human Brain with Composition Scores from Large Language Models
par: Gao, Changjiang, et autres
Publié: (2024)
par: Gao, Changjiang, et autres
Publié: (2024)
Phrase-Level Adversarial Training for Mitigating Bias in Neural Network-based Automatic Essay Scoring
par: Philip, Haddad, et autres
Publié: (2024)
par: Philip, Haddad, et autres
Publié: (2024)
Cross-modal Information Flow in Multimodal Large Language Models
par: Zhang, Zhi, et autres
Publié: (2024)
par: Zhang, Zhi, et autres
Publié: (2024)
R-Capsule: Compressing High-Level Plans for Efficient Large Language Model Reasoning
par: Shan, Hongyu, et autres
Publié: (2025)
par: Shan, Hongyu, et autres
Publié: (2025)
On Fairness of Unified Multimodal Large Language Model for Image Generation
par: Liu, Ming, et autres
Publié: (2025)
par: Liu, Ming, et autres
Publié: (2025)
DIM: Dynamic Integration of Multimodal Entity Linking with Large Language Model
par: Song, Shezheng, et autres
Publié: (2024)
par: Song, Shezheng, et autres
Publié: (2024)
Documents similaires
-
EssayJudge: A Multi-Granular Benchmark for Assessing Automated Essay Scoring Capabilities of Multimodal Large Language Models
par: Su, Jiamin, et autres
Publié: (2025) -
CAFES: A Collaborative Multi-Agent Framework for Multi-Granular Multimodal Essay Scoring
par: Su, Jiamin, et autres
Publié: (2025) -
Evaluating Austrian A-Level German Essays with Large Language Models for Automated Essay Scoring
par: Kubesch, Jonas, et autres
Publié: (2026) -
Rank-Then-Score: Enhancing Large Language Models for Automated Essay Scoring
par: Cai, Yida, et autres
Publié: (2025) -
Can Large Language Models Automatically Score Proficiency of Written Essays?
par: Mansour, Watheq, et autres
Publié: (2024)