AI 질문·퀴즈 생성기 품질 체크리스트
AI가 만든 객관식과 서술형 문항의 타당성과 진단 가치를 검토하는 목록입니다.

생성된 문장을 평가에 사용하기 전에 목표, 형식, 오답 선택지, 정답과 난도를 확인하세요.
몇 초 만에 20문제를 만들었다고 좋은 평가가 되는 것은 아닙니다. 목표와 다른 능력을 측정하거나, 정답이 여러 개이거나, 같은 패턴을 반복할 수 있습니다.
프롬프트에 수준, 목표, 허용된 자료, 문항 형식, 수량, 난도, 시간, 언어와 해설 형식을 지정하세요. 각 문항이 평가하는 능력과 정답 이유도 요청합니다.
확인할 내용:
- 목표 능력을 실제로 요구하는가
- 필요한 정보가 모두 있는가
- 정답이 하나이거나 서술형 기준이 명확한가
- 오답이 실제 오개념을 반영하는가
- 길이, 문법, 위치가 답을 암시하지 않는가
- 난도가 모호한 표현에서 생기지 않는가
- 문항 구조가 실제로 다양해지는가
- 정답과 설명이 정확한가
- 보호된 출처를 복사하지 않았는가
정답표를 보지 않고 일부를 직접 풀고 중요한 평가는 두 번째 검토를 받으세요. 사용 후 선택지 분포를 분석합니다. 아무도 고르지 않은 오답은 진단 가치가 없고, 거의 모두가 고른 오답은 공통 결손이나 잘못 쓴 문항을 의미할 수 있습니다.
AI는 초안을 빠르게 합니다. 타당성은 검토, 파일럿과 실제 응답 분석에서 생깁니다.



