D-GEN: Automatic Distractor Generation and Evaluation for Reliable Assessment of Generative Model
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Byun, Grace, Choi, Jinho D. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LLM-as-a-Grader: Practical Insights from Large Language Model for Short-Answer and Report Evaluation
par: Byun, Grace, et autres
Publié: (2025)
par: Byun, Grace, et autres
Publié: (2025)
Secure Multifaceted-RAG for Enterprise: Hybrid Knowledge Retrieval with Security Filtering
par: Byun, Grace, et autres
Publié: (2025)
par: Byun, Grace, et autres
Publié: (2025)
Measuring Sycophancy of Language Models in Multi-turn Dialogues
par: Hong, Jiseung, et autres
Publié: (2025)
par: Hong, Jiseung, et autres
Publié: (2025)
CRADLE Bench: A Clinician-Annotated Benchmark for Multi-Faceted Mental Health Crisis and Safety Risk Detection
par: Byun, Grace, et autres
Publié: (2025)
par: Byun, Grace, et autres
Publié: (2025)
CDGP: Automatic Cloze Distractor Generation based on Pre-trained Language Model
par: Chiang, Shang-Hsuan, et autres
Publié: (2024)
par: Chiang, Shang-Hsuan, et autres
Publié: (2024)
Diverse and Effective Synthetic Data Generation for Adaptable Zero-Shot Dialogue State Tracking
par: Finch, James D., et autres
Publié: (2024)
par: Finch, James D., et autres
Publié: (2024)
Distractor Generation in Multiple-Choice Tasks: A Survey of Methods, Datasets, and Evaluation
par: Alhazmi, Elaf, et autres
Publié: (2024)
par: Alhazmi, Elaf, et autres
Publié: (2024)
Transforming Slot Schema Induction with Generative Dialogue State Inference
par: Finch, James D., et autres
Publié: (2024)
par: Finch, James D., et autres
Publié: (2024)
Difficulty-Controllable Cloze Question Distractor Generation
par: Kang, Seokhoon, et autres
Publié: (2025)
par: Kang, Seokhoon, et autres
Publié: (2025)
Generative Induction of Dialogue Task Schemas with Streaming Refinement and Simulated Interactions
par: Finch, James D., et autres
Publié: (2025)
par: Finch, James D., et autres
Publié: (2025)
Finding A Voice: Exploring the Potential of African American Dialect and Voice Generation for Chatbots
par: Finch, Sarah E., et autres
Publié: (2025)
par: Finch, Sarah E., et autres
Publié: (2025)
What is Your Favorite Gender, MLM? Gender Bias Evaluation in Multilingual Masked Language Models
par: Yu, Jeongrok, et autres
Publié: (2024)
par: Yu, Jeongrok, et autres
Publié: (2024)
TarGEN: Targeted Data Generation with Large Language Models
par: Gupta, Himanshu, et autres
Publié: (2023)
par: Gupta, Himanshu, et autres
Publié: (2023)
Calibrating Verbalized Confidence with Self-Generated Distractors
par: Wang, Victor, et autres
Publié: (2025)
par: Wang, Victor, et autres
Publié: (2025)
Do We Still Need Audio? Rethinking Speaker Diarization with a Text-Based Approach Using Multiple Prediction Models
par: Wu, Peilin, et autres
Publié: (2025)
par: Wu, Peilin, et autres
Publié: (2025)
Unsupervised Distractor Generation via Large Language Model Distilling and Counterfactual Contrastive Decoding
par: Qu, Fanyi, et autres
Publié: (2024)
par: Qu, Fanyi, et autres
Publié: (2024)
Leveraging Explicit Reasoning for Inference Integration in Commonsense-Augmented Dialogue Models
par: Finch, Sarah E., et autres
Publié: (2024)
par: Finch, Sarah E., et autres
Publié: (2024)
ISSR: Iterative Selection with Self-Review for Vocabulary Test Distractor Generation
par: Liu, Yu-Cheng, et autres
Publié: (2025)
par: Liu, Yu-Cheng, et autres
Publié: (2025)
ETM: Modern Insights into Perspective on Text-to-SQL Evaluation in the Age of Large Language Models
par: Ascoli, Benjamin G., et autres
Publié: (2024)
par: Ascoli, Benjamin G., et autres
Publié: (2024)
SS-GEN: A Social Story Generation Framework with Large Language Models
par: Feng, Yi, et autres
Publié: (2024)
par: Feng, Yi, et autres
Publié: (2024)
Exploring Automated Distractor Generation for Math Multiple-choice Questions via Large Language Models
par: Feng, Wanyong, et autres
Publié: (2024)
par: Feng, Wanyong, et autres
Publié: (2024)
Beyond Fine-Tuning: In-Context Learning and Chain-of-Thought for Reasoned Distractor Generation
par: Alhazmi, Elaf, et autres
Publié: (2026)
par: Alhazmi, Elaf, et autres
Publié: (2026)
Tailoring Diagnostic Modeling to Individual Learners: Personalized Distractor Generation via MCTS-Guided Reasoning Reconstruction
par: Wu, Tao, et autres
Publié: (2025)
par: Wu, Tao, et autres
Publié: (2025)
TRUST: An LLM-Based Dialogue System for Trauma Understanding and Structured Assessments
par: Tu, Sichang, et autres
Publié: (2025)
par: Tu, Sichang, et autres
Publié: (2025)
Are Language Models Sensitive to Morally Irrelevant Distractors?
par: Shaw, Andrew, et autres
Publié: (2026)
par: Shaw, Andrew, et autres
Publié: (2026)
Can LLMs Model Incorrect Student Reasoning? A Case Study on Distractor Generation
par: Zengaffinen, Yanick, et autres
Publié: (2026)
par: Zengaffinen, Yanick, et autres
Publié: (2026)
†DAGGER: Distractor-Aware Graph Generation for Executable Reasoning in Math Problems
par: Nazi, Zabir Al, et autres
Publié: (2026)
par: Nazi, Zabir Al, et autres
Publié: (2026)
Enhancing Clinical Multiple-Choice Questions Benchmarks with Knowledge Graph Guided Distractor Generation
par: Yang, Running, et autres
Publié: (2025)
par: Yang, Running, et autres
Publié: (2025)
DualReward: A Dynamic Reinforcement Learning Framework for Cloze Tests Distractor Generation
par: Huang, Tianyou, et autres
Publié: (2025)
par: Huang, Tianyou, et autres
Publié: (2025)
Automated Distractor and Feedback Generation for Math Multiple-choice Questions via In-context Learning
par: McNichols, Hunter, et autres
Publié: (2023)
par: McNichols, Hunter, et autres
Publié: (2023)
Evaluating Diversity in Automatic Poetry Generation
par: Chen, Yanran, et autres
Publié: (2024)
par: Chen, Yanran, et autres
Publié: (2024)
Automatic Answerability Evaluation for Question Generation
par: Wang, Zifan, et autres
Publié: (2023)
par: Wang, Zifan, et autres
Publié: (2023)
ConvoSense: Overcoming Monotonous Commonsense Inferences for Conversational AI
par: Finch, Sarah E., et autres
Publié: (2024)
par: Finch, Sarah E., et autres
Publié: (2024)
Automating PTSD Diagnostics in Clinical Interviews: Leveraging Large Language Models for Trauma Assessments
par: Tu, Sichang, et autres
Publié: (2024)
par: Tu, Sichang, et autres
Publié: (2024)
Enhancing Distractor Generation for Multiple-Choice Questions with Retrieval Augmented Pretraining and Knowledge Graph Integration
par: Yu, Han-Cheng, et autres
Publié: (2024)
par: Yu, Han-Cheng, et autres
Publié: (2024)
DisGeM: Distractor Generation for Multiple Choice Questions with Span Masking
par: Cavusoglu, Devrim, et autres
Publié: (2024)
par: Cavusoglu, Devrim, et autres
Publié: (2024)
Learning to Correction: Explainable Feedback Generation for Visual Commonsense Reasoning Distractor
par: Chen, Jiali, et autres
Publié: (2024)
par: Chen, Jiali, et autres
Publié: (2024)
PersonaKit (PK): A Plug-and-Play Platform for User Testing Diverse Roles in Full-Duplex Dialogue
par: Jeon, Hyunbae, et autres
Publié: (2026)
par: Jeon, Hyunbae, et autres
Publié: (2026)
DYCP: Dynamic Context Pruning for Long-Form Dialogue with LLMs
par: Choi, Nayoung, et autres
Publié: (2026)
par: Choi, Nayoung, et autres
Publié: (2026)
Evaluation of Automatic Speech Recognition Using Generative Large Language Models
par: Bañeras-Roux, Thibault, et autres
Publié: (2026)
par: Bañeras-Roux, Thibault, et autres
Publié: (2026)
Documents similaires
-
LLM-as-a-Grader: Practical Insights from Large Language Model for Short-Answer and Report Evaluation
par: Byun, Grace, et autres
Publié: (2025) -
Secure Multifaceted-RAG for Enterprise: Hybrid Knowledge Retrieval with Security Filtering
par: Byun, Grace, et autres
Publié: (2025) -
Measuring Sycophancy of Language Models in Multi-turn Dialogues
par: Hong, Jiseung, et autres
Publié: (2025) -
CRADLE Bench: A Clinician-Annotated Benchmark for Multi-Faceted Mental Health Crisis and Safety Risk Detection
par: Byun, Grace, et autres
Publié: (2025) -
CDGP: Automatic Cloze Distractor Generation based on Pre-trained Language Model
par: Chiang, Shang-Hsuan, et autres
Publié: (2024)