Applying IRT to Distinguish Between Human and Generative AI Responses to Multiple-Choice Assessments
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Strugatski, Alona, Alexandron, Giora |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Assessment Design in the AI Era: A Method for Identifying Items Functioning Differentially for Humans and Chatbots
par: Zeinfeld, Licol, et autres
Publié: (2026)
par: Zeinfeld, Licol, et autres
Publié: (2026)
Quality-Conditioned Agreement in Automated Short Answer Scoring: Mid-Range Degradation and the Impact of Task-Specific Adaptation
par: Schleifer, Abigail Victoria Gurin, et autres
Publié: (2026)
par: Schleifer, Abigail Victoria Gurin, et autres
Publié: (2026)
Anna Karenina Strikes Again: Pre-Trained LLM Embeddings May Favor High-Performing Learners
par: Schleifer, Abigail Gurin, et autres
Publié: (2024)
par: Schleifer, Abigail Gurin, et autres
Publié: (2024)
Causal‐mechanical explanations in biology: Applying automated assessment for personalized learning in the science classroom
par: Moriah Ariely, et autres
Publié: (2024)
par: Moriah Ariely, et autres
Publié: (2024)
SciTextures: Collecting and Connecting Visual Patterns, Models, and Code Across Science and Art
par: Eppel, Sagi, et autres
Publié: (2025)
par: Eppel, Sagi, et autres
Publié: (2025)
IRT-Router: Effective and Interpretable Multi-LLM Routing via Item Response Theory
par: Song, Wei, et autres
Publié: (2025)
par: Song, Wei, et autres
Publié: (2025)
Generative Topological Networks
par: Levy-Jurgenson, Alona, et autres
Publié: (2024)
par: Levy-Jurgenson, Alona, et autres
Publié: (2024)
Distinguishing AI-Generated and Human-Written Text Through Psycholinguistic Analysis
par: Opara, Chidimma
Publié: (2025)
par: Opara, Chidimma
Publié: (2025)
Automated Generation of Curriculum-Aligned Multiple-Choice Questions for Malaysian Secondary Mathematics Using Generative AI
par: Wahid, Rohaizah Abdul, et autres
Publié: (2025)
par: Wahid, Rohaizah Abdul, et autres
Publié: (2025)
Distinguishing Task-Specific and General-Purpose AI in Regulation
par: Wang, Jennifer, et autres
Publié: (2025)
par: Wang, Jennifer, et autres
Publié: (2025)
SATA-BENCH: Select All That Apply Benchmark for Multiple Choice Questions
par: Xu, Weijie, et autres
Publié: (2025)
par: Xu, Weijie, et autres
Publié: (2025)
JE-IRT: A Geometric Lens on LLM Abilities through Joint Embedding Item Response Theory
par: Yao, Louie Hong, et autres
Publié: (2025)
par: Yao, Louie Hong, et autres
Publié: (2025)
Aligning to Illusions: Choice Blindness in Human and AI Feedback
par: Wu, Wenbin
Publié: (2026)
par: Wu, Wenbin
Publié: (2026)
Feedback Indices to Evaluate LLM Responses to Rebuttals for Multiple Choice Type Questions
par: Dunlap, Justin C., et autres
Publié: (2026)
par: Dunlap, Justin C., et autres
Publié: (2026)
CODE-GEN: A Human-in-the-Loop RAG-Based Agentic AI System for Multiple-Choice Question Generation
par: Duan, Xiaojing, et autres
Publié: (2026)
par: Duan, Xiaojing, et autres
Publié: (2026)
It is Too Many Options: Pitfalls of Multiple-Choice Questions in Generative AI and Medical Education
par: Singh, Shrutika, et autres
Publié: (2025)
par: Singh, Shrutika, et autres
Publié: (2025)
Controlling Cloze-test Question Item Difficulty with PLM-based Surrogate Models for IRT Assessment
par: Zhang, Jingshen, et autres
Publié: (2024)
par: Zhang, Jingshen, et autres
Publié: (2024)
Generating Plausible Distractors for Multiple-Choice Questions via Student Choice Prediction
par: Lee, Yooseop, et autres
Publié: (2025)
par: Lee, Yooseop, et autres
Publié: (2025)
Resisting Humanization: Ethical Front-End Design Choices in AI for Sensitive Contexts
par: Rossi, Silvia, et autres
Publié: (2026)
par: Rossi, Silvia, et autres
Publié: (2026)
When Choices Become Priors: Contrastive Decoding for Scientific Figure Multiple-Choice QA
par: Roh, Taeyun, et autres
Publié: (2026)
par: Roh, Taeyun, et autres
Publié: (2026)
Shape and Texture Recognition in Large Vision-Language Models
par: Eppel, Sagi, et autres
Publié: (2025)
par: Eppel, Sagi, et autres
Publié: (2025)
Measuring Creativity in the Age of Generative AI: Distinguishing Human and AI-Generated Creative Performance in Hiring and Talent Systems
par: Rosen, Yigal, et autres
Publié: (2026)
par: Rosen, Yigal, et autres
Publié: (2026)
StyloAI: Distinguishing AI-Generated Content with Stylometric Analysis
par: Opara, Chidimma
Publié: (2024)
par: Opara, Chidimma
Publié: (2024)
Differentiating Choices via Commonality for Multiple-Choice Question Answering
par: Deng, Wenqing, et autres
Publié: (2024)
par: Deng, Wenqing, et autres
Publié: (2024)
Does Multiple Choice Have a Future in the Age of Generative AI? A Posttest-only RCT
par: Thomas, Danielle R., et autres
Publié: (2024)
par: Thomas, Danielle R., et autres
Publié: (2024)
Automated Evaluation can Distinguish the Good and Bad AI Responses to Patient Questions about Hospitalization
par: Soni, Sarvesh, et autres
Publié: (2025)
par: Soni, Sarvesh, et autres
Publié: (2025)
Synthetic Student Responses: LLM-Extracted Features for IRT Difficulty Parameter Estimation
par: Hoyl, Matias
Publié: (2026)
par: Hoyl, Matias
Publié: (2026)
To accept or not to accept? An IRT-TOE Framework to Understand Educators' Resistance to Generative AI in Higher Education
par: Kalmus, Jan-Erik, et autres
Publié: (2024)
par: Kalmus, Jan-Erik, et autres
Publié: (2024)
Automated Generation and Tagging of Knowledge Components from Multiple-Choice Questions
par: Moore, Steven, et autres
Publié: (2024)
par: Moore, Steven, et autres
Publié: (2024)
Self-Correcting Large Language Models: Generation vs. Multiple Choice
par: Rahmani, Hossein A., et autres
Publié: (2025)
par: Rahmani, Hossein A., et autres
Publié: (2025)
Integrating ESG and AI: A Comprehensive Responsible AI Assessment Framework
par: Lee, Sung Une, et autres
Publié: (2024)
par: Lee, Sung Une, et autres
Publié: (2024)
XChoice: Explainable Evaluation of AI-Human Alignment in LLM-based Constrained Choice Decision Making
par: Qi, Weihong, et autres
Publié: (2026)
par: Qi, Weihong, et autres
Publié: (2026)
Process Matters more than Output for Distinguishing Humans from Machines
par: Rmus, Milena, et autres
Publié: (2026)
par: Rmus, Milena, et autres
Publié: (2026)
Generalization Bounds in Hybrid Quantum-Classical Machine Learning Models
par: Wu, Tongyan, et autres
Publié: (2025)
par: Wu, Tongyan, et autres
Publié: (2025)
Survival at Any Cost? LLMs and the Choice Between Self-Preservation and Human Harm
par: Mohamadi, Alireza, et autres
Publié: (2025)
par: Mohamadi, Alireza, et autres
Publié: (2025)
Improving Score Reliability of Multiple Choice Benchmarks with Consistency Evaluation and Altered Answer Choices
par: Cavalin, Paulo, et autres
Publié: (2025)
par: Cavalin, Paulo, et autres
Publié: (2025)
AI-Induced Human Responsibility (AIHR) in AI-Human teams
par: Nyilasy, Greg, et autres
Publié: (2026)
par: Nyilasy, Greg, et autres
Publié: (2026)
Modeling Human Responses to Multimodal AI Content
par: Shen, Zhiqi, et autres
Publié: (2025)
par: Shen, Zhiqi, et autres
Publié: (2025)
RFBES at SemEval-2024 Task 8: Investigating Syntactic and Semantic Features for Distinguishing AI-Generated and Human-Written Texts
par: Rad, Mohammad Heydari, et autres
Publié: (2024)
par: Rad, Mohammad Heydari, et autres
Publié: (2024)
Multiple-Choice Question Generation Using Large Language Models: Methodology and Educator Insights
par: Biancini, Giorgio, et autres
Publié: (2025)
par: Biancini, Giorgio, et autres
Publié: (2025)
Documents similaires
-
Assessment Design in the AI Era: A Method for Identifying Items Functioning Differentially for Humans and Chatbots
par: Zeinfeld, Licol, et autres
Publié: (2026) -
Quality-Conditioned Agreement in Automated Short Answer Scoring: Mid-Range Degradation and the Impact of Task-Specific Adaptation
par: Schleifer, Abigail Victoria Gurin, et autres
Publié: (2026) -
Anna Karenina Strikes Again: Pre-Trained LLM Embeddings May Favor High-Performing Learners
par: Schleifer, Abigail Gurin, et autres
Publié: (2024) -
Causal‐mechanical explanations in biology: Applying automated assessment for personalized learning in the science classroom
par: Moriah Ariely, et autres
Publié: (2024) -
SciTextures: Collecting and Connecting Visual Patterns, Models, and Code Across Science and Art
par: Eppel, Sagi, et autres
Publié: (2025)