How the Advent of Ubiquitous Large Language Models both Stymie and Turbocharge Dynamic Adversarial Question Generation
Fuente:
arXiv
Saved in:
| Main Authors: | Sung, Yoo Yeon, Mondal, Ishani, Boyd-Graber, Jordan |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
AI, Take the Wheel: What Drives Delegation and Trust in Human-Computer Cooperative Question Answering?
by: Gor, Maharshi, et al.
Published: (2026)
by: Gor, Maharshi, et al.
Published: (2026)
Large Language Models Help Humans Verify Truthfulness -- Except When They Are Convincingly Wrong
by: Si, Chenglei, et al.
Published: (2023)
by: Si, Chenglei, et al.
Published: (2023)
Labeled Interactive Topic Models
by: Seelman, Kyle, et al.
Published: (2023)
by: Seelman, Kyle, et al.
Published: (2023)
Is your benchmark truly adversarial? AdvScore: Evaluating Human-Grounded Adversarialness
by: Sung, Yoo Yeon, et al.
Published: (2024)
by: Sung, Yoo Yeon, et al.
Published: (2024)
VeriLA: A Human-Centered Evaluation Framework for Interpretable Verification of LLM Agent Failures
by: Sung, Yoo Yeon, et al.
Published: (2025)
by: Sung, Yoo Yeon, et al.
Published: (2025)
Improving the TENOR of Labeling: Re-evaluating Topic Models for Content Analysis
by: Li, Zongxia, et al.
Published: (2024)
by: Li, Zongxia, et al.
Published: (2024)
Exploring the Potential of Large Language Models for Estimating the Reading Comprehension Question Difficulty
by: Jain, Yoshee, et al.
Published: (2025)
by: Jain, Yoshee, et al.
Published: (2025)
Generate-Then-Validate: A Novel Question Generation Approach Using Small Language Models
by: Wei, Yumou, et al.
Published: (2025)
by: Wei, Yumou, et al.
Published: (2025)
An Expert Schema for Evaluating Large Language Model Errors in Scholarly Question-Answering Systems
by: Martin-Boyle, Anna, et al.
Published: (2026)
by: Martin-Boyle, Anna, et al.
Published: (2026)
A Survey of Large Language Model Agents for Question Answering
by: Yue, Murong
Published: (2025)
by: Yue, Murong
Published: (2025)
Generalization Bias in Large Language Model Summarization of Scientific Research
by: Peters, Uwe, et al.
Published: (2025)
by: Peters, Uwe, et al.
Published: (2025)
Ontologies in Design: How Imagining a Tree Reveals Possibilites and Assumptions in Large Language Models
by: Haghighi, Nava, et al.
Published: (2025)
by: Haghighi, Nava, et al.
Published: (2025)
CloChat: Understanding How People Customize, Interact, and Experience Personas in Large Language Models
by: Ha, Juhye, et al.
Published: (2024)
by: Ha, Juhye, et al.
Published: (2024)
Leveraging the Domain Adaptation of Retrieval Augmented Generation Models for Question Answering and Reducing Hallucination
by: Rakin, Salman, et al.
Published: (2024)
by: Rakin, Salman, et al.
Published: (2024)
Exploring Automated Keyword Mnemonics Generation with Large Language Models via Overgenerate-and-Rank
by: Lee, Jaewook, et al.
Published: (2024)
by: Lee, Jaewook, et al.
Published: (2024)
Educational Question Generation of Children Storybooks via Question Type Distribution Learning and Event-Centric Summarization
by: Zhao, Zhenjie, et al.
Published: (2022)
by: Zhao, Zhenjie, et al.
Published: (2022)
Are Humans as Brittle as Large Language Models?
by: Li, Jiahui, et al.
Published: (2025)
by: Li, Jiahui, et al.
Published: (2025)
TaleFrame: An Interactive Story Generation System with Fine-Grained Control and Large Language Models
by: Wang, Yunchao, et al.
Published: (2025)
by: Wang, Yunchao, et al.
Published: (2025)
A Systematic Survey of Prompt Engineering in Large Language Models: Techniques and Applications
by: Sahoo, Pranab, et al.
Published: (2024)
by: Sahoo, Pranab, et al.
Published: (2024)
Re:Member: Emotional Question Generation from Personal Memories
by: Rackauckas, Zackary, et al.
Published: (2025)
by: Rackauckas, Zackary, et al.
Published: (2025)
One-Topic-Doesn't-Fit-All: Transcreating Reading Comprehension Test for Personalized Learning
by: Han, Jieun, et al.
Published: (2025)
by: Han, Jieun, et al.
Published: (2025)
Large Language Models Pass the Turing Test
by: Jones, Cameron R., et al.
Published: (2025)
by: Jones, Cameron R., et al.
Published: (2025)
Social Skill Training with Large Language Models
by: Yang, Diyi, et al.
Published: (2024)
by: Yang, Diyi, et al.
Published: (2024)
Grounding Gaps in Language Model Generations
by: Shaikh, Omar, et al.
Published: (2023)
by: Shaikh, Omar, et al.
Published: (2023)
Leveraging Large Language Models for Identifying Knowledge Components
by: Wang, Canwen, et al.
Published: (2025)
by: Wang, Canwen, et al.
Published: (2025)
Large Language Models for Virtual Human Gesture Selection
by: Torshizi, Parisa Ghanad, et al.
Published: (2025)
by: Torshizi, Parisa Ghanad, et al.
Published: (2025)
Towards Valid Student Simulation with Large Language Models
by: Yuan, Zhihao, et al.
Published: (2026)
by: Yuan, Zhihao, et al.
Published: (2026)
Large Language Models for Depression Recognition in Spoken Language Integrating Psychological Knowledge
by: Li, Yupei, et al.
Published: (2025)
by: Li, Yupei, et al.
Published: (2025)
CFMatch: Aligning Automated Answer Equivalence Evaluation with Expert Judgments For Open-Domain Question Answering
by: Li, Zongxia, et al.
Published: (2024)
by: Li, Zongxia, et al.
Published: (2024)
AutoTutor meets Large Language Models: A Language Model Tutor with Rich Pedagogy and Guardrails
by: Chowdhury, Sankalan Pal, et al.
Published: (2024)
by: Chowdhury, Sankalan Pal, et al.
Published: (2024)
Exploring Large Language Models to generate Easy to Read content
by: Martínez, Paloma, et al.
Published: (2024)
by: Martínez, Paloma, et al.
Published: (2024)
WinClick: GUI Grounding with Multimodal Large Language Models
by: Hui, Zheng, et al.
Published: (2025)
by: Hui, Zheng, et al.
Published: (2025)
When Large Language Models are Reliable for Judging Empathic Communication
by: Kumar, Aakriti, et al.
Published: (2025)
by: Kumar, Aakriti, et al.
Published: (2025)
Dialogue Language Model with Large-Scale Persona Data Engineering
by: Hong, Mengze, et al.
Published: (2024)
by: Hong, Mengze, et al.
Published: (2024)
DiscussLLM: Teaching Large Language Models When to Speak
by: Patel, Deep Anil, et al.
Published: (2025)
by: Patel, Deep Anil, et al.
Published: (2025)
Exploring Large Language Models for Specialist-level Oncology Care
by: Palepu, Anil, et al.
Published: (2024)
by: Palepu, Anil, et al.
Published: (2024)
RealitySummary: Exploring On-Demand Mixed Reality Text Summarization and Question Answering using Large Language Models
by: Gunturu, Aditya, et al.
Published: (2024)
by: Gunturu, Aditya, et al.
Published: (2024)
RELIC: Investigating Large Language Model Responses using Self-Consistency
by: Cheng, Furui, et al.
Published: (2023)
by: Cheng, Furui, et al.
Published: (2023)
Evaluating the Usage of African-American Vernacular English in Large Language Models
by: Dunlap, Deja, et al.
Published: (2026)
by: Dunlap, Deja, et al.
Published: (2026)
PALLM: Evaluating and Enhancing PALLiative Care Conversations with Large Language Models
by: Wang, Zhiyuan, et al.
Published: (2024)
by: Wang, Zhiyuan, et al.
Published: (2024)
Similar Items
-
AI, Take the Wheel: What Drives Delegation and Trust in Human-Computer Cooperative Question Answering?
by: Gor, Maharshi, et al.
Published: (2026) -
Large Language Models Help Humans Verify Truthfulness -- Except When They Are Convincingly Wrong
by: Si, Chenglei, et al.
Published: (2023) -
Labeled Interactive Topic Models
by: Seelman, Kyle, et al.
Published: (2023) -
Is your benchmark truly adversarial? AdvScore: Evaluating Human-Grounded Adversarialness
by: Sung, Yoo Yeon, et al.
Published: (2024) -
VeriLA: A Human-Centered Evaluation Framework for Interpretable Verification of LLM Agent Failures
by: Sung, Yoo Yeon, et al.
Published: (2025)