+ 자료별 비교와 개정 후보 도출 과정이 촘촘하고 실용적이다.
- 질문이 19개로 많고 문항별 실패 판별 기준이 덜 명시적이다.
"요약해줘"가 가장 약한 질문입니다. 자료가 말하지 않는 것을 묻게 합니다.
| 분류 | AI 사용법 › 자료 기반 AI |
|---|---|
| 태그 | 질문생성분석아이디어 |
Turn what I want to know into questions this tool can actually answer well. ***"Summarize this" is the weakest thing you can ask a grounded tool.*** **It returns the document's own emphasis back to you, which you already had.** **Build questions of these kinds instead:** 1. **Locating** — ***where in these sources is X addressed, and where is it not*** 2. **Comparing** — ***what do sources A and B say differently about X*** — **this is what a grounded tool is uniquely good at** 3. **Tracing** — ***what does this claim rest on, in these documents*** 4. **Boundary** — ***what do these sources not say about X.* **Ask this explicitly or the gap never surfaces** 5. **Contradiction** — ***where do these sources disagree with each other*** **Per question, write it so that:** - **A bad answer is recognisable** — ***vague enough and you cannot tell it went wrong*** - **It asks for the passage, not just the conclusion** - ***It does not presuppose an answer.* **"Why is X effective" assumes it is** **Then:** - ***Which of my questions this source set cannot answer*** — **say so rather than letting me ask and get something plausible** - **The order to ask in** — what has to be established first - **What to ask to check an answer I received** ⚠️ ***Do not state what this tool can or cannot do, its limits, or its settings from memory*** — **these change constantly and a wrong one wastes a session.** Write `[confirm in the tool]`.
자료를 넣고 요약을 시키면 그 문서가 원래 강조하던 걸 되받을 뿐이다. 자료 기반 도구가 유일하게 잘하는 건 문서 간 대조와 근거 추적이다. 이 프롬프트는 위치·대조·추적·경계·모순 다섯 유형으로 질문을 만들고, 답이 틀렸을 때 알아챌 수 있는 형태로 쓰게 한다.
Gemini는 형식 준수가 가장 철저하지만 과도하게 장황하고 일부 단정이 있다. ChatGPT는 가장 안정적이고 실무적이며, Claude는 순서가 뛰어나지만 근거 없는 사전 추정이 감점 요인이다.
+ 자료별 비교와 개정 후보 도출 과정이 촘촘하고 실용적이다.
- 질문이 19개로 많고 문항별 실패 판별 기준이 덜 명시적이다.
+ 기준선·공백·비교·근거 추적의 선후관계가 특히 명확하다.
- 자료를 보기 전부터 ‘없을 가능성’을 실패 신호로 삼은 점이 부정확하다.
+ 다섯 질문 유형과 검증 기준을 가장 명시적으로 충족했다.
- 환각 가능성과 설문 성격을 단정하며 분량도 지나치게 길다.
| 기준 | ChatGPT | Claude | Gemini | 앞선 모델 |
|---|---|---|---|---|
| 지시 준수 | 9 | 9 | 10 | Gemini +11% |
| 정확성 | 9 | 8 | 8 | ChatGPT +13% |
| 구체성 | 10 | 10 | 10 | 동점 |
| 구성·가독성 | 9 | 9 | 9 | 동점 |
| 분량 적정성 | 7 | 7 | 6 | 동점 |
gpt-5.6-sol가 모델 이름을 가린 채 1~10점으로 채점했습니다 (2026-09-24). 측정값이 아니라 AI 심사 결과입니다.
같은 입력을 세 모델에 넣어 받은 답을 그대로 옮겼습니다. 각 CLI(에이전트 하네스)에서 실행했습니다. ChatGPT·Claude 앱이나 웹에서는 답이 다를 수 있습니다.
알고 싶은 것: 우리 회사 원격근무 정책을 개정하려는데 뭘 바꿔야 할지 자료 구성: 현행 사내 정책 문서, 지난 분기 직원 설문 결과, 팀장 인터뷰 녹취 3건, 경쟁사 공개 채용공고 5건
아래처럼 물으면 “무엇을 바꿀까?”를 근거 있는 정책 개정안으로 좁혀갈 수 있습니다. 답변에는 반드시 출처명과 원문 인용을 포함하도록 하세요. 도구의 인용·검색 동작은 [confirm in the tool]로 확인하세요.
정책 문서에서 원격근무의 대상, 허용 조건, 빈도, 승인 절차, 근무시간, 출근 의무를 각각 규정한 문단을 찾아 인용해 달라. 명시적으로 규정되지 않은 항목은 “언급 없음”으로 구분해 달라.
정책 문서에서 직원, 팀장, 인사팀의 책임과 재량을 규정한 부분을 찾아 인용해 달라. 각 주체가 실제로 결정할 수 있는 범위도 원문에 근거해 설명해 달라.
정책 문서에서 예외, 사유별 처리, 위반 시 조치, 정책 적용이 어려운 상황을 다룬 부분을 찾아 달라. 해당 내용이 없으면 없는 것으로 표시해 달라.
설문에서 직원들이 원격근무와 관련해 가장 자주 언급한 어려움과 요구를 찾아 달라. 각 항목마다 응답 수·비율 또는 실제 응답 문장을 함께 제시하고, 정책 문서의 어느 조항과 관련되는지 연결해 달라.
설문 응답 중 현행 정책이 충족한다고 볼 수 있는 요구와, 정책에 반영되어 있지 않거나 모호한 요구를 나눠 달라. 각 분류의 근거가 되는 정책 문장과 설문 응답을 함께 인용해 달라.
팀장 인터뷰 3건에서 원격근무 운영상의 문제로 언급된 내용을 찾아 달라. 인터뷰이별로 같은 문제인지 다른 문제인지 구분하고, 각 판단에 해당 발언을 인용해 달라.
설문과 팀장 인터뷰가 같은 주제에 대해 일치하거나 다르게 말하는 지점을 찾아 달라. 각 자료의 원문을 나란히 인용하고, 차이가 단순한 표현 차이인지 실제 이해관계의 차이인지 자료가 말하는 범위 안에서만 설명해 달라.
경쟁사 채용공고 5건에서 원격근무 장소, 근무 방식, 출근 빈도, 시간대, 팀 협업 방식, 지원 제도를 언급한 문장을 찾아 표로 비교해 달라. 언급하지 않은 항목은 추정하지 말고 “언급 없음”으로 표시해 달라.
경쟁사 채용공고와 우리 회사 정책에서 동일한 주제를 다르게 표현하거나 다르게 규정한 부분을 찾아 달라. 각 회사의 원문을 인용하고, 차이가 ‘정책 내용의 차이’인지 ‘채용 홍보 문구의 차이’인지 구분할 수 있는 근거가 있는지 표시해 달라.
경쟁사 채용공고에 반복적으로 등장하지만 우리 회사 정책에는 나타나지 않는 원격근무 관련 주제를 찾아 달라. 반복 횟수와 해당 공고의 원문을 제시하되, 그것이 직원 선호나 효과를 입증한다고 해석하지 말라.
현행 정책의 각 주요 조항이 어떤 운영 목적이나 문제를 해결하려는 것인지, 정책 문서 자체에 근거가 있는지 찾아 달라. 근거가 정책에 없으면 설문·인터뷰에서 사후적으로 추정하지 말고 “근거 미확인”으로 표시해 달라.
설문이나 인터뷰에서 제기된 요구 중 현행 정책의 어떤 문구를 수정·추가·삭제하면 대응할 수 있는지 연결해 달라. 각 제안마다 ‘문제 제기 원문 → 관련 정책 원문 → 가능한 수정 대상’을 순서대로 제시해 달라.
정책을 바꿀 경우 서로 충돌할 수 있는 요구를 찾아 달라. 예를 들어 직원의 장소 선택권과 팀 협업·보안·고객 대응 요구가 함께 나타나는지 확인하고, 충돌을 보여 주는 원문을 인용해 달라.
우리 회사의 원격근무 정책 개정 여부를 판단하는 데 필요한 질문 중, 제공된 자료에서 답할 수 없는 것을 찾아 달라. 각 질문에 대해 ‘관련 자료 없음’ 또는 ‘자료는 있으나 판단 근거 부족’으로 구분해 달라.
다음 항목에 대해 자료가 무엇을 말하지 않는지 각각 확인해 달라: 생산성 변화, 이직률·채용 경쟁력의 변화, 법적·노무적 적합성, 보안 사고 위험, 비용 변화, 직군별 차이, 장애·돌봄 등 개인 상황별 영향. 근거가 없으면 결론을 만들지 말고 “이 자료만으로는 확인되지 않음”이라고 답해 달라.
경쟁사 채용공고에서 확인되는 내용 중, 우리 회사가 도입해야 한다고 결론 내릴 수 없는 항목을 찾아 달라. 단순한 홍보 문구인지, 구체적인 운영 약속인지 구분할 수 있는 원문 근거도 제시해 달라.
현행 정책의 서로 다른 조항 사이에 적용 조건, 승인 권한, 출근 의무 또는 예외 처리의 모순·모호성이 있는지 찾아 달라. 문제가 있다고 판단한 경우 두 문장을 모두 인용하고, 어떻게 읽히는지가 왜 충돌하는지 설명해 달라.
정책, 설문, 인터뷰에서 원격근무의 목적이나 성공 기준을 서로 다르게 전제하는 부분을 찾아 달라. 각 자료의 관련 문장을 인용하고, 실제 모순인지 단순히 다루는 주제가 다른 것인지 구분해 달라.
팀장 인터뷰에서 서로 다른 운영 원칙이나 판단 기준이 나타나는지 확인해 달라. 있다면 인터뷰별 발언을 인용하고, 현재 정책이 그 차이를 허용하는지 또는 조정하는지 정책 문서의 근거를 함께 제시해 달라.
그 다음에야 “개정안 후보를 3개로 제시해 달라”고 물어보는 것이 좋습니다. 이때도 각 후보에 대해 관련 근거 문장, 해결하려는 문제, 새로 생길 수 있는 부작용, 아직 확인되지 않은 가정을 함께 요구하세요.
답변을 받은 뒤에는 다음 질문을 그대로 사용하세요.
최종적으로는 “경쟁사가 이렇게 하므로 우리도 해야 한다”가 아니라, 현행 정책의 어떤 문구가 어떤 자료에서 확인된 문제와 연결되며, 무엇은 아직 판단할 수 없는가의 형태로 결론을 만들면 됩니다.
| 문서 근거 답변 프롬프트 | |
| 자료끼리 엇갈리는 지점을 찾아내는 프롬프트 | |
| 자료로 답할 수 없는 것을 따로 보고하게 하는 프롬프트 | |
| 자료에서 목차를 뽑는 프롬프트 | |
| 주장이 자료 어디서 나왔는지 역추적하는 프롬프트 |