LLM Agents at the Roundtable: A Multi-Perspective and Dialectical Reasoning Framework for Essay Scoring
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jang, Jinhee, Moon, Ayoung, Jung, Minkyoung, Kim, YoungBin, Lee, Seung Jin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Plug-in and Fine-tuning: Bridging the Gap between Small Language Models and Large Language Models
par: Kim, Kyeonghyun, et autres
Publié: (2025)
par: Kim, Kyeonghyun, et autres
Publié: (2025)
Multi-News+: Cost-efficient Dataset Cleansing via LLM-based Data Annotation
par: Choi, Juhwan, et autres
Publié: (2024)
par: Choi, Juhwan, et autres
Publié: (2024)
Adverb Is the Key: Simple Text Data Augmentation with Adverb Deletion
par: Choi, Juhwan, et autres
Publié: (2024)
par: Choi, Juhwan, et autres
Publié: (2024)
GPTs Are Multilingual Annotators for Sequence Generation Tasks
par: Choi, Juhwan, et autres
Publié: (2024)
par: Choi, Juhwan, et autres
Publié: (2024)
Beyond Single-User Dialogue: Assessing Multi-User Dialogue State Tracking Capabilities of Large Language Models
par: Song, Sangmin, et autres
Publié: (2025)
par: Song, Sangmin, et autres
Publié: (2025)
SUMMPILOT: Bridging Efficiency and Customization for Interactive Summarization System
par: Yun, JungMin, et autres
Publié: (2026)
par: Yun, JungMin, et autres
Publié: (2026)
Autoregressive Score Generation for Multi-trait Essay Scoring
par: Do, Heejin, et autres
Publié: (2024)
par: Do, Heejin, et autres
Publié: (2024)
VolDoGer: LLM-assisted Datasets for Domain Generalization in Vision-Language Tasks
par: Choi, Juhwan, et autres
Publié: (2024)
par: Choi, Juhwan, et autres
Publié: (2024)
Rationale Behind Essay Scores: Enhancing S-LLM's Multi-Trait Essay Scoring with Rationale Generated by LLMs
par: Chu, SeongYeub, et autres
Publié: (2024)
par: Chu, SeongYeub, et autres
Publié: (2024)
Medal Matters: Probing LLMs' Failure Cases Through Olympic Rankings
par: Choi, Juhwan, et autres
Publié: (2024)
par: Choi, Juhwan, et autres
Publié: (2024)
Teach-to-Reason with Scoring: Self-Explainable Rationale-Driven Multi-Trait Essay Scoring
par: Do, Heejin, et autres
Publié: (2025)
par: Do, Heejin, et autres
Publié: (2025)
UniGen: Universal Domain Generalization for Sentiment Classification via Zero-shot Dataset Generation
par: Choi, Juhwan, et autres
Publié: (2024)
par: Choi, Juhwan, et autres
Publié: (2024)
CAFES: A Collaborative Multi-Agent Framework for Multi-Granular Multimodal Essay Scoring
par: Su, Jiamin, et autres
Publié: (2025)
par: Su, Jiamin, et autres
Publié: (2025)
Can David Beat Goliath? On Multi-Hop Reasoning with Resource-Constrained Agents
par: Han, Hojae, et autres
Publié: (2026)
par: Han, Hojae, et autres
Publié: (2026)
Trait-Aware Policy Optimization for Autoregressive Multi-Trait Essay Scoring
par: Wang, Zhengyang, et autres
Publié: (2026)
par: Wang, Zhengyang, et autres
Publié: (2026)
From Ground Trust to Truth: Disparities in Offensive Language Judgments on Contemporary Korean Political Discourse
par: Yu, Seunguk, et autres
Publié: (2025)
par: Yu, Seunguk, et autres
Publié: (2025)
Can Large Language Models Differentiate Harmful from Argumentative Essays? Steps Toward Ethical Essay Scoring
par: Kim, Hongjin, et autres
Publié: (2026)
par: Kim, Hongjin, et autres
Publié: (2026)
Autoregressive Multi-trait Essay Scoring via Reinforcement Learning with Scoring-aware Multiple Rewards
par: Do, Heejin, et autres
Publié: (2024)
par: Do, Heejin, et autres
Publié: (2024)
Composable Cross-prompt Essay Scoring by Merging Models
par: Lee, Sanwoo, et autres
Publié: (2025)
par: Lee, Sanwoo, et autres
Publié: (2025)
Exploring LLM Prompting Strategies for Joint Essay Scoring and Feedback Generation
par: Stahl, Maja, et autres
Publié: (2024)
par: Stahl, Maja, et autres
Publié: (2024)
CODMAS: A Dialectic Multi-Agent Collaborative Framework for Structured RTL Optimization
par: Chang, Che-Ming, et autres
Publié: (2026)
par: Chang, Che-Ming, et autres
Publié: (2026)
VG-CoT: Towards Trustworthy Visual Reasoning via Grounded Chain-of-Thought
par: Lim, Byeonggeuk, et autres
Publié: (2026)
par: Lim, Byeonggeuk, et autres
Publié: (2026)
PSYCHE: A Multi-faceted Patient Simulation Framework for Evaluation of Psychiatric Assessment Conversational Agents
par: Lee, Jingoo, et autres
Publié: (2025)
par: Lee, Jingoo, et autres
Publié: (2025)
Improve LLM-based Automatic Essay Scoring with Linguistic Features
par: Hou, Zhaoyi Joey, et autres
Publié: (2025)
par: Hou, Zhaoyi Joey, et autres
Publié: (2025)
GEMA-Score: Granular Explainable Multi-Agent Scoring Framework for Radiology Report Evaluation
par: Zhang, Zhenxuan, et autres
Publié: (2025)
par: Zhang, Zhenxuan, et autres
Publié: (2025)
MAPLE: A Meta-learning Framework for Cross-Prompt Essay Scoring
par: Albatarni, Salam, et autres
Publié: (2026)
par: Albatarni, Salam, et autres
Publié: (2026)
Rank-Then-Score: Enhancing Large Language Models for Automated Essay Scoring
par: Cai, Yida, et autres
Publié: (2025)
par: Cai, Yida, et autres
Publié: (2025)
RDBE: Reasoning Distillation-Based Evaluation Enhances Automatic Essay Scoring
par: Mohammadkhani, Ali Ghiasvand
Publié: (2024)
par: Mohammadkhani, Ali Ghiasvand
Publié: (2024)
A Training-Free Large Reasoning Model-based Knowledge Tracing Framework for Unified Prediction and Prescription
par: Lee, Unggi, et autres
Publié: (2026)
par: Lee, Unggi, et autres
Publié: (2026)
Pair2Score: Pairwise-to-Absolute Transfer for LLM-Based Essay Scoring
par: Hallaç, İbrahim Rıza, et autres
Publié: (2026)
par: Hallaç, İbrahim Rıza, et autres
Publié: (2026)
Enhancing Automated Essay Scoring with Three Techniques: Two-Stage Fine-Tuning, Score Alignment, and Self-Training
par: Choi, Hongseok, et autres
Publié: (2026)
par: Choi, Hongseok, et autres
Publié: (2026)
A Multi-Agent Framework for Mitigating Dialect Biases in Privacy Policy Question-Answering Systems
par: Klisura, Đorđe, et autres
Publié: (2025)
par: Klisura, Đorđe, et autres
Publié: (2025)
Unleashing Large Language Models' Proficiency in Zero-shot Essay Scoring
par: Lee, Sanwoo, et autres
Publié: (2024)
par: Lee, Sanwoo, et autres
Publié: (2024)
From Assumptions to Actions: Turning LLM Reasoning into Uncertainty-Aware Planning for Embodied Agents
par: Seo, SeungWon, et autres
Publié: (2026)
par: Seo, SeungWon, et autres
Publié: (2026)
Can LLM Agents Identify Spoken Dialects like a Linguist?
par: Bystrich, Tobias, et autres
Publié: (2026)
par: Bystrich, Tobias, et autres
Publié: (2026)
Query, Decompose, Compress: Structured Query Expansion for Efficient Multi-Hop Retrieval
par: Yun, JungMin, et autres
Publié: (2026)
par: Yun, JungMin, et autres
Publié: (2026)
BlockDialect: Block-wise Fine-grained Mixed Format Quantization for Energy-Efficient LLM Inference
par: Jang, Wonsuk, et autres
Publié: (2025)
par: Jang, Wonsuk, et autres
Publié: (2025)
Dual-Scale World Models for LLM Agents Towards Hard-Exploration Problems
par: Kim, Minsoo, et autres
Publié: (2025)
par: Kim, Minsoo, et autres
Publié: (2025)
Automatic Essay Scoring in a Brazilian Scenario
par: Matsuoka, Felipe Akio
Publié: (2023)
par: Matsuoka, Felipe Akio
Publié: (2023)
Position on LLM-Assisted Peer Review: Addressing Reviewer Gap through Mentoring and Feedback
par: Yun, JungMin, et autres
Publié: (2026)
par: Yun, JungMin, et autres
Publié: (2026)
Documents similaires
-
Plug-in and Fine-tuning: Bridging the Gap between Small Language Models and Large Language Models
par: Kim, Kyeonghyun, et autres
Publié: (2025) -
Multi-News+: Cost-efficient Dataset Cleansing via LLM-based Data Annotation
par: Choi, Juhwan, et autres
Publié: (2024) -
Adverb Is the Key: Simple Text Data Augmentation with Adverb Deletion
par: Choi, Juhwan, et autres
Publié: (2024) -
GPTs Are Multilingual Annotators for Sequence Generation Tasks
par: Choi, Juhwan, et autres
Publié: (2024) -
Beyond Single-User Dialogue: Assessing Multi-User Dialogue State Tracking Capabilities of Large Language Models
par: Song, Sangmin, et autres
Publié: (2025)