Quality-Conditioned Agreement in Automated Short Answer Scoring: Mid-Range Degradation and the Impact of Task-Specific Adaptation
Fuente:
arXiv
Salvato in:
| Autori principali: | Schleifer, Abigail Victoria Gurin, Ariely, Moriah, Klebanov, Beata Beigman, Salman, Asaf, Alexandron, Giora |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Anna Karenina Strikes Again: Pre-Trained LLM Embeddings May Favor High-Performing Learners
di: Schleifer, Abigail Gurin, et al.
Pubblicazione: (2024)
di: Schleifer, Abigail Gurin, et al.
Pubblicazione: (2024)
Causal‐mechanical explanations in biology: Applying automated assessment for personalized learning in the science classroom
di: Moriah Ariely, et al.
Pubblicazione: (2024)
di: Moriah Ariely, et al.
Pubblicazione: (2024)
Applying IRT to Distinguish Between Human and Generative AI Responses to Multiple-Choice Assessments
di: Strugatski, Alona, et al.
Pubblicazione: (2024)
di: Strugatski, Alona, et al.
Pubblicazione: (2024)
Monitoring Oral Reading Fluency From Electronic Shared Book Reading: Insights From a Full‐Length Book Reading Study With Relay Reader®
di: Zuowei Wang, et al.
Pubblicazione: (2024)
di: Zuowei Wang, et al.
Pubblicazione: (2024)
How Much Should I Read? An Analysis of Word Learning Opportunities in Children's Novels
di: Zuowei Wang, et al.
Pubblicazione: (2025)
di: Zuowei Wang, et al.
Pubblicazione: (2025)
Practising the nations and national identity: A longitudinal study of independence day in Israel
di: Gal Ariely
Pubblicazione: (2024)
di: Gal Ariely
Pubblicazione: (2024)
Assessment Design in the AI Era: A Method for Identifying Items Functioning Differentially for Humans and Chatbots
di: Zeinfeld, Licol, et al.
Pubblicazione: (2026)
di: Zeinfeld, Licol, et al.
Pubblicazione: (2026)
Generative Language Models with Retrieval Augmented Generation for Automated Short Answer Scoring
di: Wang, Zifan, et al.
Pubblicazione: (2024)
di: Wang, Zifan, et al.
Pubblicazione: (2024)
Automatic Short‐Answer Grading in Sustainability Education: AI –Human Agreement
di: Emrah Emirtekin, et al.
Pubblicazione: (2025)
di: Emrah Emirtekin, et al.
Pubblicazione: (2025)
Enhancing Security and Strengthening Defenses in Automated Short-Answer Grading Systems
di: Yarmohammadtoosky, Sahar, et al.
Pubblicazione: (2025)
di: Yarmohammadtoosky, Sahar, et al.
Pubblicazione: (2025)
A simulation of the plasmonic absorption of the silica glasses with copper selenide nanoparticles
di: Gurin, Valerij
Pubblicazione: (2025)
di: Gurin, Valerij
Pubblicazione: (2025)
Integer Powers Expressed as Nested Sums of Lower Powers modulo 2, 3
di: Gurin, Nikita
Pubblicazione: (2024)
di: Gurin, Nikita
Pubblicazione: (2024)
Deterministic Fokker-Planck Transport -- With Applications to Sampling, Variational Inference, Kernel Mean Embeddings & Sequential Monte Carlo
di: Klebanov, Ilja
Pubblicazione: (2024)
di: Klebanov, Ilja
Pubblicazione: (2024)
Graph Convex Hull Bounds as generalized Jensen Inequalities
di: Klebanov, Ilja
Pubblicazione: (2023)
di: Klebanov, Ilja
Pubblicazione: (2023)
Literary Studies and Well-Being
di: Schleifer, Ronald
Pubblicazione: (2023)
di: Schleifer, Ronald
Pubblicazione: (2023)
Como nació la democracia en America de Tocqueville / James T. Schleifer ; traducción de Rodrigo Ruza
di: Schleifer, James T
di: Schleifer, James T
Comunicación mediática y noticias regionales. La televisión pública en Río Negro
di: Pablo Schleifer
Pubblicazione: (2018)
di: Pablo Schleifer
Pubblicazione: (2018)
La mirada genética: el secuenciamiento del genoma del arroz en China
di: David Schleifer
Pubblicazione: (2004)
di: David Schleifer
Pubblicazione: (2004)
Estado, mercado y medios de comunicación en el capitalismo neoliberal
di: Pablo Schleifer
Pubblicazione: (2015)
di: Pablo Schleifer
Pubblicazione: (2015)
Evaluating the Consistency and Reliability of Attribution Methods in Automated Short Answer Grading (ASAG) Systems: Toward an Explainable Scoring System
di: Wallace N. Pinto, et al.
Pubblicazione: (2025)
di: Wallace N. Pinto, et al.
Pubblicazione: (2025)
Reducing the Cost: Cross-Prompt Pre-Finetuning for Short Answer Scoring
di: Funayama, Hiroaki, et al.
Pubblicazione: (2024)
di: Funayama, Hiroaki, et al.
Pubblicazione: (2024)
Beyond Scores: A Modular RAG-Based System for Automatic Short Answer Scoring with Feedback
di: Fateen, Menna, et al.
Pubblicazione: (2024)
di: Fateen, Menna, et al.
Pubblicazione: (2024)
Library Workshop on "Reading:" The Academic Librarian and the Generic Book--Alternatives to the Generic Book.
di: Schleifer, Harold B.
Pubblicazione: (1974)
di: Schleifer, Harold B.
Pubblicazione: (1974)
The Utilization of Microforms in Technical Services.
di: Schleifer, Harold B.
Pubblicazione: (1982)
di: Schleifer, Harold B.
Pubblicazione: (1982)
Grade Guard: A Smart System for Short Answer Automated Grading
di: Dadu, Niharika, et al.
Pubblicazione: (2025)
di: Dadu, Niharika, et al.
Pubblicazione: (2025)
Ordering and association of patchy particles in quasi-one-dimensional channel
di: Gurin, Péter, et al.
Pubblicazione: (2025)
di: Gurin, Péter, et al.
Pubblicazione: (2025)
Intergenerational solidarity in a developing welfare state: The case of South Korea
di: Martin Gurín, et al.
Pubblicazione: (2024)
di: Martin Gurín, et al.
Pubblicazione: (2024)
Phase Boundaries of Bulk 2D Rhombi
di: Odriozola, Gerardo, et al.
Pubblicazione: (2026)
di: Odriozola, Gerardo, et al.
Pubblicazione: (2026)
Automated Essay Scoring and Language Certification: Assessing Generalizability, Agreement and Validity for French
di: Wilkens, Rodrigo, et al.
Pubblicazione: (2026)
di: Wilkens, Rodrigo, et al.
Pubblicazione: (2026)
From Flat to Structural: Enhancing Automated Short Answer Grading with GraphRAG
di: Chu, Yucheng, et al.
Pubblicazione: (2026)
di: Chu, Yucheng, et al.
Pubblicazione: (2026)
Small Circle Expansion for Adjoint QCD$_2$ with Periodic Boundary Conditions
di: Dempsey, Ross, et al.
Pubblicazione: (2024)
di: Dempsey, Ross, et al.
Pubblicazione: (2024)
Large Language Model‐based Generation of Use Case Diagrams from Requirement Specifications
di: Simon Schleifer, et al.
Pubblicazione: (2025)
di: Simon Schleifer, et al.
Pubblicazione: (2025)
AI-assisted Automated Short Answer Grading of Handwritten University Level Mathematics Exams
di: Liu, Tianyi, et al.
Pubblicazione: (2024)
di: Liu, Tianyi, et al.
Pubblicazione: (2024)
Task-Specific Adaptation with Restricted Model Access
di: Levy, Matan, et al.
Pubblicazione: (2025)
di: Levy, Matan, et al.
Pubblicazione: (2025)
SAS-Bench: A Fine-Grained Benchmark for Evaluating Short Answer Scoring with Large Language Models
di: Lai, Peichao, et al.
Pubblicazione: (2025)
di: Lai, Peichao, et al.
Pubblicazione: (2025)
MMbeddings: Parameter-Efficient, Low-Overfitting Probabilistic Embeddings Inspired by Nonlinear Mixed Models
di: Simchoni, Giora, et al.
Pubblicazione: (2025)
di: Simchoni, Giora, et al.
Pubblicazione: (2025)
Integrating Random Effects in Variational Autoencoders for Dimensionality Reduction of Correlated Data
di: Simchoni, Giora, et al.
Pubblicazione: (2024)
di: Simchoni, Giora, et al.
Pubblicazione: (2024)
Beyond Agreement: Diagnosing the Rationale Alignment of Automated Essay Scoring Methods based on Linguistically-informed Counterfactuals
di: Wang, Yupei, et al.
Pubblicazione: (2024)
di: Wang, Yupei, et al.
Pubblicazione: (2024)
SAGE: Streaming Agreement-Driven Gradient Sketches for Representative Subset Selection
di: Jha, Ashish, et al.
Pubblicazione: (2025)
di: Jha, Ashish, et al.
Pubblicazione: (2025)
Orientational ordering and close packing properties of quasi-one-dimensional hard Gaussian overlap particles
di: Mizani, Sakineh, et al.
Pubblicazione: (2026)
di: Mizani, Sakineh, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Anna Karenina Strikes Again: Pre-Trained LLM Embeddings May Favor High-Performing Learners
di: Schleifer, Abigail Gurin, et al.
Pubblicazione: (2024) -
Causal‐mechanical explanations in biology: Applying automated assessment for personalized learning in the science classroom
di: Moriah Ariely, et al.
Pubblicazione: (2024) -
Applying IRT to Distinguish Between Human and Generative AI Responses to Multiple-Choice Assessments
di: Strugatski, Alona, et al.
Pubblicazione: (2024) -
Monitoring Oral Reading Fluency From Electronic Shared Book Reading: Insights From a Full‐Length Book Reading Study With Relay Reader®
di: Zuowei Wang, et al.
Pubblicazione: (2024) -
How Much Should I Read? An Analysis of Word Learning Opportunities in Children's Novels
di: Zuowei Wang, et al.
Pubblicazione: (2025)