☰ 분류

AI 답변에서 검증할 것만 골라내는 프롬프트

틀리면 손해 나는 것부터 세 단계로 가릅니다. 어디서 확인할지도 같이 냅니다.

분류AI 사용법 › 환각·검증
태그검토분석체크리스트
프롬프트 (영어 본문 · 답은 한국어로 옵니다)
Go through this AI answer and mark what has to be verified before I use it.

**Sort every claim into three:**
1. **Must verify** — if this is wrong, my decision is wrong. **Numbers, dates, names, rules, prices, versions, anything that changed recently**
2. **Worth checking** — wrong would be embarrassing but not damaging
3. **No check needed** — general explanation, reasoning, structure

**For each item in group 1:**
- **Where to check it.** ***Name the kind of source, not a URL*** — you cannot confirm a link resolves
- **What the answer would look like if this were wrong.** *That is the tell to watch for*

**Also flag separately:**
- ***Claims stated with more confidence than the phrasing supports*** — a hedge that disappeared between the first mention and the conclusion
- **Specifics too clean to be recalled** — an exact percentage, a precise date, a quoted sentence. **Precision is a hallucination signal, not a reliability signal**
- **Anything that depends on a cutoff date**

⚠️ **You are checking the answer's structure, not the facts.** ***Do not confirm anything as true.*** **If you cannot tell whether something needs checking, put it in group 1.**
붙여 넣으면 맨 아래에 채울 칸(AI 답변 · 어디에 쓸 건지)이 나옵니다

어떤 프롬프트인가

AI 답변을 전부 검증하면 쓸 이유가 없고, 안 하면 사고가 난다. 이 프롬프트는 틀렸을 때 손해가 나는 것만 1군으로 분리하고, 지나치게 정확한 수치처럼 환각 신호가 되는 표현을 따로 표시한다. 판단이 애매하면 무조건 1군으로 보낸다.

모델 비교

ChatGPT가 가장 충실하고 안전하다. Gemini는 구체적이나 사실 확인을 암시하며, Claude는 입력 자체를 바꿔 평가했다.

ChatGPT종합 1위
44/ 50

+ 핵심 주장을 빠짐없이 분류하고 검증처와 오류 신호를 제시했다.

- 일부 항목이 중복되며 ‘확신 강화’ 플래그의 정의가 다소 넓다.

Gemini
37/ 50

+ HR 공지의 법적·실무적 위험에 맞춰 구체적으로 정리했다.

- OECD 수치를 2군에 두고 미확인 사실로 허위 가능성을 추정했다.

Claude
15/ 50

+ 요구된 세 분류와 별도 플래그의 형식 자체는 읽기 쉽다.

- 전기차 통계라는 전혀 다른 답을 심사해 요청을 사실상 불이행했다.

기준ChatGPTClaudeGemini앞선 모델
지시 준수917ChatGPT +29%
정확성916ChatGPT +50%
구체성918ChatGPT +13%
구성·가독성979동점
분량 적정성857ChatGPT +14%

gpt-5.6-sol가 모델 이름을 가린 채 1~10점으로 채점했습니다 (2026-09-24). 측정값이 아니라 AI 심사 결과입니다.

답 전문 보기

같은 입력을 세 모델에 넣어 받은 답을 그대로 옮겼습니다. 각 CLI(에이전트 하네스)에서 실행했습니다. ChatGPT·Claude 앱이나 웹에서는 답이 다를 수 있습니다.

넣은 입력
AI 답변: 2026년 대한민국 최저임금은 시간당 10,320원으로 결정되었습니다. 이는 2025년 9,860원보다 4.7% 인상된 금액입니다. 최저임금위원회는 2025년 7월 12일 전원회의에서 사용자위원과 근로자위원 표결을 거쳐 14대 4로 이 안을 의결했습니다. 주 40시간 근무 기준 월 환산액은 약 2,156,880원이며, 2026년 1월 1일부터 5인 미만 사업장을 포함한 모든 사업장에 동일하게 적용됩니다. 최저임금법 제6조에 따르면 사용자는 최저임금 인상을 이유로 기존 임금 수준을 낮출 수 없습니다. 참고로 OECD 통계 기준 한국의 최저임금은 중위임금 대비 약 62% 수준으로 회원국 중 상위권에 속하는 것으로 알려져 있습니다.

어디에 쓸 건지: 이 내용을 우리 회사 사내 HR 뉴스레터 공지문에 그대로 인용해도 되는지 확인하려고요
gpt-5.6-luna (codex CLI · 에이전트 하네스) · 실행일 2026-09-24

아래는 사실 여부를 확인하지 않고, 검증 필요성만 분류한 것입니다. 사내 HR 공지에 그대로 인용하기 전에는 1번 항목을 모두 확인해야 합니다.

1. Must verify

주장 어디서 확인할지 틀렸을 때의 신호
2026년 최저임금은 시간당 10,320원이다 최저임금위원회 공식 의결·고시 자료, 고용노동부 공식 고시 고시된 시간급이 10,320원이 아니거나 적용 연도가 다름
2025년 최저임금은 9,860원이다 해당 연도의 최저임금위원회 자료 및 고용노동부 고시 전년도 금액이 다르거나 비교 기준이 다름
전년 대비 4.7% 인상이다 두 연도의 공식 시간급과 산식 실제 증감률이 다르거나 반올림 방식이 다름
최저임금위원회가 2025년 7월 12일 전원회의에서 의결했다 최저임금위원회 회의록·의결 보도자료, 정부 고시의 결정 경위 의결 날짜, 회의 종류, 결정 주체가 다름
사용자위원·근로자위원 표결로 14대 4가 나왔다 최저임금위원회 공식 표결 결과·회의록 표결 수, 참여 위원, 표결 방식이 다름
주 40시간 기준 월 환산액이 약 2,156,880원이다 고용노동부 고시의 월 환산 기준 및 공식 계산 기준 월 환산액 또는 적용 시간 기준이 다름
2026년 1월 1일부터 적용된다 최저임금 고시의 시행일·적용기간 시행일이 다르거나 유예·예외가 존재함
5인 미만 사업장을 포함한 모든 사업장에 동일하게 적용된다 최저임금법, 고용노동부 적용 범위 안내, 행정해석 사업장 규모별 예외, 적용 제외 직군, 특례가 있음
최저임금 인상을 이유로 기존 임금 수준을 낮출 수 없다 최저임금법 원문, 고용노동부 법령 해석·상담 자료 제6조의 실제 문언이나 적용 조건이 답변과 다름
OECD 기준 한국의 최저임금이 중위임금 대비 약 62%이다 OECD 공식 통계 데이터베이스와 해당 지표의 정의·기준연도 비율, 기준연도, 전일제 중위임금 등 지표 정의가 다름
한국이 회원국 중 상위권이다 같은 OECD 표의 동일 기준 국가 비교 순위가 낮거나 비교 가능한 회원국 범위가 다름

2. Worth checking

  • “참고로”라는 연결이 본문 핵심인 법정 최저임금 정보와 OECD 국제비교 정보를 자연스럽게 묶는지 확인하는 것이 좋습니다.
  • “약 62%”와 “상위권”이 같은 기준과 기준연도를 가리키는지 확인하지 않으면 문맥상 오해를 부를 수 있습니다.
  • “그대로 인용해도 되는지”에 대한 답은 문안의 정확성뿐 아니라 회사의 사내 공지·법무·노무 검토 절차에도 달려 있습니다.

3. No check needed

  • 답변이 최저임금액 → 인상률 → 의결 경위 → 월 환산액 → 적용 범위 → 법적 제한 → 국제 비교 순서로 구성되어 있다는 점.
  • HR 뉴스레터용이라면 공식 출처와 기준일을 함께 표시하는 것이 안전하다는 편집 원칙.

별도 플래그

표현보다 확신이 강해진 주장

  • 첫 문장의 “결정되었습니다”: 실제 결정 상태와 공식 고시 여부를 함께 확인해야 하는 단정형입니다.
  • “14대 4로 이 안을 의결했습니다”: 날짜·회의·표결 결과를 모두 확정적으로 제시합니다.
  • “모든 사업장에 동일하게 적용됩니다”: 예외 가능성을 배제하는 절대적 표현입니다.
  • “사용자는 … 낮출 수 없습니다”: 법 조항의 적용 조건과 예외를 생략한 단정형 법률 해석입니다.
  • “상위권에 속하는 것으로 알려져 있습니다”: “알려져 있다”는 완충 표현이 있지만, 실제로는 순위 판단을 단정하고 있습니다.

너무 깔끔한 구체성

  • 10,320원
  • 9,860원
  • 4.7%
  • 2025년 7월 12일
  • 14대 4
  • 2,156,880원
  • 2026년 1월 1일
  • 법 제6조
  • 중위임금 대비 약 62%

이런 수치·날짜·조문·인용에 가까운 표현은 특히 원문 자료와 대조해야 합니다.

컷오프 날짜에 의존하는 내용

  • “2026년 최저임금”과 “2026년 1월 1일부터”: 확인 시점에 따라 고시, 정정, 행정해석이 달라질 수 있습니다.
  • “2025년 7월 12일 의결”: 당시 회의 기록과 최종 고시가 일치하는지 확인해야 합니다.
  • OECD의 “약 62%”와 “상위권”: OECD 통계의 기준연도, 데이터 개정일, 비교 대상에 따라 달라집니다.
  • 답변에는 기준일이 명시되어 있지 않으므로, 뉴스레터에는 반드시 “○○년 ○월 ○일 기준”을 붙이는 편이 안전합니다.

같은 분류의 프롬프트

주장 증거 해부 분석 프롬프트
팩트체크 평가 프롬프트
주장 사실 확인 프롬프트
형식 검증 모드 프롬프트
AI가 지어낸 인용을 잡아내는 프롬프트