☰ 분류

틀린 문제 분석하는 프롬프트

오답을 모아 넣으면 왜 틀렸는지 유형을 분류합니다. 개념을 몰라서인지 실수인지 가려, 남은 시간에 무엇을 할지 정하는 데 씁니다.

분류학업 › 시험
태그분석대학생
프롬프트 (영어 본문 · 답은 한국어로 옵니다)
Analyze the questions I got wrong.

1. **Classify each by cause:**
   - Did not know the concept
   - Knew it, could not apply it
   - Misread the question
   - Arithmetic or notation slip
   - Ran out of time
2. Count the proportions and name the dominant type.
3. **Group recurring conceptual gaps.** *This matters more than any individual question.*
4. Prioritize what to do in the remaining time below. ***The prescription differs by type*** — a knowledge gap needs study, a slip needs a checking procedure, and pacing needs drilling. **Do not default to "study more".**
5. Where I have not given enough detail to classify an error, **ask rather than guessing.** The classification is the whole value here.

Then: the single change with the largest expected effect.
붙여 넣으면 맨 아래에 채울 칸(남은기간 · 오답)이 나옵니다

어떤 프롬프트인가

틀린 문제를 뭉뚱그리면 공부 시간만 늘어난다. 실수로 틀린 것은 더 외운다고 안 고쳐지고 절차가 필요한데, 이 프롬프트는 그 둘을 갈라놓는다.

모델 비교

ChatGPT가 정보 부족을 존중하면서 가장 정확하고 간결하다. Claude는 구체적이지만 일부 유형을 부당하게 합쳤고, Gemini는 풍부하나 근거 없는 추정이 많다.

ChatGPT종합 1위
46/ 50

+ 추측 없이 분류·비율·처방을 간결하고 정확하게 제시했다.

- 반복 개념 공백과 단일 변화의 근거가 다소 약하다.

Claude
42/ 50

+ 정보 한계를 밝히고 추가 질문을 구체적으로 세분화했다.

- 오독과 계산 실수를 같은 처방으로 묶은 논리가 부정확하다.

Gemini
31/ 50

+ 유형별 처방과 확인 질문을 체계적으로 제시했다.

- 문항 난도·배점·시간을 근거 없이 지어내 정확성이 낮다.

기준ChatGPTClaudeGemini앞선 모델
지시 준수998동점
정확성1084ChatGPT +25%
구체성897Claude +13%
구성·가독성998동점
분량 적정성1074ChatGPT +43%

gpt-5.6-sol가 모델 이름을 가린 채 1~10점으로 채점했습니다 (2026-09-24). 측정값이 아니라 AI 심사 결과입니다.

답 전문 보기

같은 입력을 세 모델에 넣어 받은 답을 그대로 옮겼습니다. 각 CLI(에이전트 하네스)에서 실행했습니다. ChatGPT·Claude 앱이나 웹에서는 답이 다를 수 있습니다.

넣은 입력
남은기간: 2주

오답: 3번 몰라서 틀림 / 8번 계산 실수 / 12번 문제를 잘못 읽음 / 15번 두 개 중 찍어서 틀림 / 21번 시간 부족 / 24번 몰라서 틀림 / 29번 계산 실수
gpt-5.6-luna (codex CLI · 에이전트 하네스) · 실행일 2026-09-24

현재 7개 중 6개는 분류할 수 있습니다.

문항 원인
3번 개념을 몰라서
8번 계산 실수
12번 문제를 잘못 읽음
15번 추가 정보 필요
21번 시간 부족
24번 개념을 몰라서
29번 계산 실수

분류 가능한 6개 기준 비율은 다음과 같습니다.

  • 개념을 몰라서: 2/6 = 33.3%
  • 계산 실수: 2/6 = 33.3%
  • 문제를 잘못 읽음: 1/6 = 16.7%
  • 시간 부족: 1/6 = 16.7%
  • 알고도 적용하지 못함: 0건
  • 현재 우세 유형: 공동 1위 — 개념 부족과 계산 실수

다만 15번의 “두 개 중 찍어서 틀림”은 원인이 여러 가지일 수 있습니다.

  • 개념 자체를 몰라 두 개를 구분하지 못한 것인지
  • 개념은 알았지만 적용·판단이 안 된 것인지
  • 시간이 부족해서 검토 없이 찍은 것인지
  • 문제를 잘못 읽어 선택지를 좁힌 것인지

이 중 어느 쪽이었나요? 그리고 3번·24번이 몰랐던 개념의 주제도 알려주세요. 그래야 반복되는 개념 공백을 실제 단원별로 묶을 수 있습니다.

남은 2주 처방은 원인별로 다르게 가야 합니다.

  • 개념 부족 3번·24번: 해당 개념만 짧게 학습한 뒤, 바로 유사문제 3~5개로 확인하세요. 전 범위를 다시 공부하지 마세요.
  • 계산 실수 8번·29번: 새 공부보다 계산 점검 절차를 고정하세요. 식을 한 줄씩 쓰고, 부호·단위·자리수를 마지막에 별도로 확인하세요.
  • 오독 12번: 풀이 전에 문제의 조건, 요구값, 부정어(“아닌 것”, “옳지 않은 것”)에 표시하는 습관을 들이세요.
  • 시간 부족 21번: 매일 제한시간을 둔 문제 세트를 풀고, 한 문제에 오래 막히면 표시 후 넘기는 훈련을 하세요.

현재 정보만으로 가장 효과가 클 가능성이 높은 단일 변화는:

매일 제한시간을 둔 문제 세트를 풀고, 틀린 문제를 정답이 아니라 원인별로 기록하는 것입니다.

다만 15번이 개념 부족이었다면 개념 보완이 최우선으로 올라갈 수 있고, 시간 부족이었다면 timed drilling이 확실한 1순위가 됩니다.

같은 분류의 프롬프트

시험 패턴 추출가 프롬프트
엘리트 과목 튜터 역할을 맡기는 프롬프트
적응형 AI 튜터 프롬프트
소크라테스 학습 코치 프롬프트
시험 마스터 튜터 프롬프트