+ 핵심 주장을 빠짐없이 분류하고 검증처와 오류 신호를 제시했다.
- 일부 항목이 중복되며 ‘확신 강화’ 플래그의 정의가 다소 넓다.
틀리면 손해 나는 것부터 세 단계로 가릅니다. 어디서 확인할지도 같이 냅니다.
| 분류 | AI 사용법 › 환각·검증 |
|---|---|
| 태그 | 검토분석체크리스트 |
Go through this AI answer and mark what has to be verified before I use it. **Sort every claim into three:** 1. **Must verify** — if this is wrong, my decision is wrong. **Numbers, dates, names, rules, prices, versions, anything that changed recently** 2. **Worth checking** — wrong would be embarrassing but not damaging 3. **No check needed** — general explanation, reasoning, structure **For each item in group 1:** - **Where to check it.** ***Name the kind of source, not a URL*** — you cannot confirm a link resolves - **What the answer would look like if this were wrong.** *That is the tell to watch for* **Also flag separately:** - ***Claims stated with more confidence than the phrasing supports*** — a hedge that disappeared between the first mention and the conclusion - **Specifics too clean to be recalled** — an exact percentage, a precise date, a quoted sentence. **Precision is a hallucination signal, not a reliability signal** - **Anything that depends on a cutoff date** ⚠️ **You are checking the answer's structure, not the facts.** ***Do not confirm anything as true.*** **If you cannot tell whether something needs checking, put it in group 1.**
AI 답변을 전부 검증하면 쓸 이유가 없고, 안 하면 사고가 난다. 이 프롬프트는 틀렸을 때 손해가 나는 것만 1군으로 분리하고, 지나치게 정확한 수치처럼 환각 신호가 되는 표현을 따로 표시한다. 판단이 애매하면 무조건 1군으로 보낸다.
ChatGPT가 가장 충실하고 안전하다. Gemini는 구체적이나 사실 확인을 암시하며, Claude는 입력 자체를 바꿔 평가했다.
+ 핵심 주장을 빠짐없이 분류하고 검증처와 오류 신호를 제시했다.
- 일부 항목이 중복되며 ‘확신 강화’ 플래그의 정의가 다소 넓다.
+ HR 공지의 법적·실무적 위험에 맞춰 구체적으로 정리했다.
- OECD 수치를 2군에 두고 미확인 사실로 허위 가능성을 추정했다.
+ 요구된 세 분류와 별도 플래그의 형식 자체는 읽기 쉽다.
- 전기차 통계라는 전혀 다른 답을 심사해 요청을 사실상 불이행했다.
| 기준 | ChatGPT | Claude | Gemini | 앞선 모델 |
|---|---|---|---|---|
| 지시 준수 | 9 | 1 | 7 | ChatGPT +29% |
| 정확성 | 9 | 1 | 6 | ChatGPT +50% |
| 구체성 | 9 | 1 | 8 | ChatGPT +13% |
| 구성·가독성 | 9 | 7 | 9 | 동점 |
| 분량 적정성 | 8 | 5 | 7 | ChatGPT +14% |
gpt-5.6-sol가 모델 이름을 가린 채 1~10점으로 채점했습니다 (2026-09-24). 측정값이 아니라 AI 심사 결과입니다.
같은 입력을 세 모델에 넣어 받은 답을 그대로 옮겼습니다. 각 CLI(에이전트 하네스)에서 실행했습니다. ChatGPT·Claude 앱이나 웹에서는 답이 다를 수 있습니다.
AI 답변: 2026년 대한민국 최저임금은 시간당 10,320원으로 결정되었습니다. 이는 2025년 9,860원보다 4.7% 인상된 금액입니다. 최저임금위원회는 2025년 7월 12일 전원회의에서 사용자위원과 근로자위원 표결을 거쳐 14대 4로 이 안을 의결했습니다. 주 40시간 근무 기준 월 환산액은 약 2,156,880원이며, 2026년 1월 1일부터 5인 미만 사업장을 포함한 모든 사업장에 동일하게 적용됩니다. 최저임금법 제6조에 따르면 사용자는 최저임금 인상을 이유로 기존 임금 수준을 낮출 수 없습니다. 참고로 OECD 통계 기준 한국의 최저임금은 중위임금 대비 약 62% 수준으로 회원국 중 상위권에 속하는 것으로 알려져 있습니다. 어디에 쓸 건지: 이 내용을 우리 회사 사내 HR 뉴스레터 공지문에 그대로 인용해도 되는지 확인하려고요
아래는 사실 여부를 확인하지 않고, 검증 필요성만 분류한 것입니다. 사내 HR 공지에 그대로 인용하기 전에는 1번 항목을 모두 확인해야 합니다.
| 주장 | 어디서 확인할지 | 틀렸을 때의 신호 |
|---|---|---|
| 2026년 최저임금은 시간당 10,320원이다 | 최저임금위원회 공식 의결·고시 자료, 고용노동부 공식 고시 | 고시된 시간급이 10,320원이 아니거나 적용 연도가 다름 |
| 2025년 최저임금은 9,860원이다 | 해당 연도의 최저임금위원회 자료 및 고용노동부 고시 | 전년도 금액이 다르거나 비교 기준이 다름 |
| 전년 대비 4.7% 인상이다 | 두 연도의 공식 시간급과 산식 | 실제 증감률이 다르거나 반올림 방식이 다름 |
| 최저임금위원회가 2025년 7월 12일 전원회의에서 의결했다 | 최저임금위원회 회의록·의결 보도자료, 정부 고시의 결정 경위 | 의결 날짜, 회의 종류, 결정 주체가 다름 |
| 사용자위원·근로자위원 표결로 14대 4가 나왔다 | 최저임금위원회 공식 표결 결과·회의록 | 표결 수, 참여 위원, 표결 방식이 다름 |
| 주 40시간 기준 월 환산액이 약 2,156,880원이다 | 고용노동부 고시의 월 환산 기준 및 공식 계산 기준 | 월 환산액 또는 적용 시간 기준이 다름 |
| 2026년 1월 1일부터 적용된다 | 최저임금 고시의 시행일·적용기간 | 시행일이 다르거나 유예·예외가 존재함 |
| 5인 미만 사업장을 포함한 모든 사업장에 동일하게 적용된다 | 최저임금법, 고용노동부 적용 범위 안내, 행정해석 | 사업장 규모별 예외, 적용 제외 직군, 특례가 있음 |
| 최저임금 인상을 이유로 기존 임금 수준을 낮출 수 없다 | 최저임금법 원문, 고용노동부 법령 해석·상담 자료 | 제6조의 실제 문언이나 적용 조건이 답변과 다름 |
| OECD 기준 한국의 최저임금이 중위임금 대비 약 62%이다 | OECD 공식 통계 데이터베이스와 해당 지표의 정의·기준연도 | 비율, 기준연도, 전일제 중위임금 등 지표 정의가 다름 |
| 한국이 회원국 중 상위권이다 | 같은 OECD 표의 동일 기준 국가 비교 | 순위가 낮거나 비교 가능한 회원국 범위가 다름 |
이런 수치·날짜·조문·인용에 가까운 표현은 특히 원문 자료와 대조해야 합니다.
| 주장 증거 해부 분석 프롬프트 | |
| 팩트체크 평가 프롬프트 | |
| 주장 사실 확인 프롬프트 | |
| 형식 검증 모드 프롬프트 | |
| AI가 지어낸 인용을 잡아내는 프롬프트 |