Validity of AI-generated multiple-choice questions in medical education: a systematic review
Yavuz Selim Kıyak, Abdullah Bedir Kaya, Emre Emekli · Postgraduate Medical Journal
This review organizes the evidence on AI-generated MCQs in medical education using Messick’s validity framework. It shows that evidence is strongest for content review, but weaker for response processes, psychometrics, links with other assessments, and consequences.
Related subquestions: What can AI do for generating MCQs?