+ 추측 없이 분류·비율·처방을 간결하고 정확하게 제시했다.
- 반복 개념 공백과 단일 변화의 근거가 다소 약하다.
오답을 모아 넣으면 왜 틀렸는지 유형을 분류합니다. 개념을 몰라서인지 실수인지 가려, 남은 시간에 무엇을 할지 정하는 데 씁니다.
| 분류 | 학업 › 시험 |
|---|---|
| 태그 | 분석대학생 |
Analyze the questions I got wrong. 1. **Classify each by cause:** - Did not know the concept - Knew it, could not apply it - Misread the question - Arithmetic or notation slip - Ran out of time 2. Count the proportions and name the dominant type. 3. **Group recurring conceptual gaps.** *This matters more than any individual question.* 4. Prioritize what to do in the remaining time below. ***The prescription differs by type*** — a knowledge gap needs study, a slip needs a checking procedure, and pacing needs drilling. **Do not default to "study more".** 5. Where I have not given enough detail to classify an error, **ask rather than guessing.** The classification is the whole value here. Then: the single change with the largest expected effect.
틀린 문제를 뭉뚱그리면 공부 시간만 늘어난다. 실수로 틀린 것은 더 외운다고 안 고쳐지고 절차가 필요한데, 이 프롬프트는 그 둘을 갈라놓는다.
ChatGPT가 정보 부족을 존중하면서 가장 정확하고 간결하다. Claude는 구체적이지만 일부 유형을 부당하게 합쳤고, Gemini는 풍부하나 근거 없는 추정이 많다.
+ 추측 없이 분류·비율·처방을 간결하고 정확하게 제시했다.
- 반복 개념 공백과 단일 변화의 근거가 다소 약하다.
+ 정보 한계를 밝히고 추가 질문을 구체적으로 세분화했다.
- 오독과 계산 실수를 같은 처방으로 묶은 논리가 부정확하다.
+ 유형별 처방과 확인 질문을 체계적으로 제시했다.
- 문항 난도·배점·시간을 근거 없이 지어내 정확성이 낮다.
| 기준 | ChatGPT | Claude | Gemini | 앞선 모델 |
|---|---|---|---|---|
| 지시 준수 | 9 | 9 | 8 | 동점 |
| 정확성 | 10 | 8 | 4 | ChatGPT +25% |
| 구체성 | 8 | 9 | 7 | Claude +13% |
| 구성·가독성 | 9 | 9 | 8 | 동점 |
| 분량 적정성 | 10 | 7 | 4 | ChatGPT +43% |
gpt-5.6-sol가 모델 이름을 가린 채 1~10점으로 채점했습니다 (2026-09-24). 측정값이 아니라 AI 심사 결과입니다.
같은 입력을 세 모델에 넣어 받은 답을 그대로 옮겼습니다. 각 CLI(에이전트 하네스)에서 실행했습니다. ChatGPT·Claude 앱이나 웹에서는 답이 다를 수 있습니다.
남은기간: 2주 오답: 3번 몰라서 틀림 / 8번 계산 실수 / 12번 문제를 잘못 읽음 / 15번 두 개 중 찍어서 틀림 / 21번 시간 부족 / 24번 몰라서 틀림 / 29번 계산 실수
현재 7개 중 6개는 분류할 수 있습니다.
| 문항 | 원인 |
|---|---|
| 3번 | 개념을 몰라서 |
| 8번 | 계산 실수 |
| 12번 | 문제를 잘못 읽음 |
| 15번 | 추가 정보 필요 |
| 21번 | 시간 부족 |
| 24번 | 개념을 몰라서 |
| 29번 | 계산 실수 |
분류 가능한 6개 기준 비율은 다음과 같습니다.
다만 15번의 “두 개 중 찍어서 틀림”은 원인이 여러 가지일 수 있습니다.
이 중 어느 쪽이었나요? 그리고 3번·24번이 몰랐던 개념의 주제도 알려주세요. 그래야 반복되는 개념 공백을 실제 단원별로 묶을 수 있습니다.
남은 2주 처방은 원인별로 다르게 가야 합니다.
현재 정보만으로 가장 효과가 클 가능성이 높은 단일 변화는:
매일 제한시간을 둔 문제 세트를 풀고, 틀린 문제를 정답이 아니라 원인별로 기록하는 것입니다.
다만 15번이 개념 부족이었다면 개념 보완이 최우선으로 올라갈 수 있고, 시간 부족이었다면 timed drilling이 확실한 1순위가 됩니다.
| 시험 패턴 추출가 프롬프트 | |
| 엘리트 과목 튜터 역할을 맡기는 프롬프트 | |
| 적응형 AI 튜터 프롬프트 | |
| 소크라테스 학습 코치 프롬프트 | |
| 시험 마스터 튜터 프롬프트 |