작성자: Kevin
ChatGPT는 스스로 팩트 체크할 수 있을까? 6단계 체크리스트(2026)
ChatGPT는 자기 실수를 일부 잡아내지만 같은 실수를 되풀이하기도 합니다. AI 답변을 실제 출처와 대조해 검증하는 6단계 체크리스트를 소개합니다.

ChatGPT는 어느 정도는 스스로 팩트 체크를 할 수 있습니다. 답변을 다시 읽고 확신 없는 주장에 표시해 달라고 하면 몇몇 실수는 잡아냅니다. 하지만 확인하는 쪽이 답변을 쓴 모델 그대로라서, 같은 실수를 더 자신 있게 되풀이할 수 있고, 자기에게 없는 출처는 열어 볼 수도 없습니다. 보내거나 게시하거나 의지할 내용이라면 자체 점검은 1차 점검으로만 쓰고, 이름과 숫자, 날짜, 인용은 외부 출처로 확인하세요.
ChatGPT에게 팩트 체크를 시키면 벌어지는 일
2023년에 PolitiFact는 자사 팩트 체크 40건으로 ChatGPT를 테스트했습니다. 모델의 평가가 PolitiFact와 일치한 비율은 절반 정도였습니다. 질문 방식에 따라 답이 달라졌고, 평가를 거부할 때도 있었으며, 보여 줄 출처가 없었고, 계산 실수 때문에 결론이 뒤집힌 경우도 있었습니다. PolitiFact의 전문가들은 이 모델이 가끔은 도움이 되지만 믿을 만한 팩트 체커와는 거리가 멀다고 평가했습니다.
이 테스트는 예전 무료 버전으로 한 것이고, 그 뒤로 모델은 특히 웹 검색이 가능해지면서 나아졌습니다. 그래도 지금까지 유효한 교훈은 버전이 아니라 방법에 있습니다. 모델이 자기 숙제를 채점하면 사각지대도 똑같다는 것입니다. 아래 단계가 채팅창 밖의 출처로 안내하는 이유가 바로 이것입니다.
AI 답변을 검증하는 6단계 체크리스트
- 확인 가능한 주장을 뽑아내기. 답변을 훑으면서 이름, 숫자, 날짜, 인용, '연구에 따르면', 법률, 가격, 장소에 모두 밑줄을 긋습니다. 의견과 조언은 필요 없고, 사실만 대상입니다.
- 틀렸을 때의 대가로 순서 매기기. 형용사 하나가 틀린 건 문제가 안 됩니다. 하지만 고객 보고서의 통계나 소개글의 날짜가 틀렸다면 이야기가 다릅니다. 대가가 큰 주장부터 확인하세요.
- 승인이 아니라 의심을 물어보기. 아래 프롬프트를 쓰세요. '이거 맞아?'라고 물으면 대개 '네'가 돌아옵니다. 확신도에 따라 주장을 분류하게 하면 따라가 볼 짧은 목록이 생깁니다.
- 주장마다 1차 출처 찾기. 연구 자체, 회사의 공식 페이지, 정부나 표준 기관의 데이터베이스, 최초의 기사를 말하며, 그것을 그대로 옮겨 적은 다른 사이트는 아닙니다. 블로그 세 곳이 같은 말을 해도 모두 하나의 실수에서 나왔을 수 있습니다.
- 모델이 준 인용을 전부 열어 보기. 링크가 작동하는지, 페이지가 있는지, 답변이 말한 내용이 정말 거기 있는지 확인하세요. 참고문헌은 완벽해 보여도 존재하지 않을 수 있습니다. 찾을 수 없다면 그 주장을 빼거나, 출처를 댈 수 있는 주장으로 바꾸세요.
- 글을 고친 뒤 다시 읽기. 틀린 주장은 바로잡고, 확인하지 못한 주장은 미확인으로 표시하거나 삭제하며, 남기고 싶은 출처를 추가합니다. 그런 다음 전체를 한 번 더 읽으세요. 고치다 보면 어색한 이음새가 생기기 쉽습니다.
의심을 묻는 프롬프트
확인하고 싶은 답변 바로 뒤에 이 프롬프트를 붙여 넣으세요.
직전 답변에 담긴 모든 사실적 주장을 번호 목록으로 나열해 줘. 각각에 확실, 불확실, 추측 중 하나를 붙여 줘. 불확실과 추측에 대해서는 어떤 출처가 있으면 확인할 수 있는지 알려 줘. 새로운 주장은 추가하지 말고, 원래 표현을 변호하지도 마.
이렇게 해도 답변이 참이 되는 건 아닙니다. 약한 부분이 눈에 보이게 해서, 시간을 들여야 할 줄을 알려 줄 뿐입니다. '확실'도 통과 도장이 아니라 표본으로 확인할 주장으로 다루세요.
실제 예시
AI가 쓸 법한 짧은 문단에 주장이 세 개 들어 있습니다.
에펠탑은 파리 만국박람회를 위해 1887년에 완공되었습니다. 성인의 몸에는 206개의 뼈가 있습니다. 대부분의 사람은 뇌의 10퍼센트만 사용합니다.
| 주장 | 확인해 보니 | 조치 |
|---|---|---|
| 1887년에 완공 | 탑은 1889년 만국박람회에 맞춰 1889년에 완공됨. 1887년은 공사를 시작한 해. | 날짜 수정 |
| 성인의 뼈는 206개 | 해부학 참고 자료에 나오는 표준 수치 | 유지, 참고 자료 인용 |
| 뇌의 10퍼센트 | 오래된 속설 | 삭제하거나 속설이라고 명시 |
틀린 날짜와 속설 모두 읽을 때는 매끄럽습니다. 말투로는 전혀 티가 나지 않으니, 느낌이 아니라 주장 하나하나를 기준으로 확인해야 하는 것입니다.
Unflag에서 해 보기
주장을 하나씩 검색하는 일을 직접 하기 싫다면 팩트 체크가 대신 수고해 줍니다.
- 팩트 체크를 열고 로그인하세요. Unflag Plus에 포함된 기능이라 무료 계정에서는 쓸 수 없습니다. 웹에서는 최소 50단어가 필요하고, Plus는 입력 한 번에 최대 10,000자까지 지원합니다.
- AI 답변이나 초안을 붙여 넣고 '검증'을 누르세요.
- Unflag는 글에서 주장을 뽑아 하나씩 웹에서 검색한 뒤, 신뢰도와 요약, 주장별 분석, 출처가 담긴 전체 결과를 돌려줍니다.
- 주장마다 판정이 붙습니다. 진실, 거짓, 부분적으로 진실, 오해의 소지가 있음, 검증 불가능 중 하나입니다.
- 중요한 주장은 그 근거가 된 출처를 열어 보세요. 판정은 확인해 볼 단서이지, 출처를 직접 읽는 일을 대신하지 않습니다.
- 글을 고친 뒤에는 다시 쓰기(예: 글쓰기 개선)나 AI 휴머나이즈로 고친 초안을 내 글처럼 읽히게 다듬으세요. AI 휴머나이즈는 가격이나 퍼센트 같은 수치를 최대한 유지하려 하지만, 다시 쓴 뒤에는 숫자를 한 번 더 확인하세요.
2026년 10월 기준으로 Unflag Plus는 웹에서 월 8.99달러 또는 연 45.99달러입니다. 앱은 스토어를 통해 주 단위 또는 연 단위로 결제됩니다.
모델이 가장 많이 틀리는 곳
다음은 특히 조심하세요.
- 인용과 링크. 제목, 저자, 학술지, URL이 진짜처럼 보이게 지어질 수 있습니다.
- 정확한 숫자. 퍼센트, 가격, 날짜, 개수는 조금씩 어긋나기 쉽습니다.
- 인용문. 모델이 인용문과 발언자를 제시하면 원문에서 직접 찾아보세요.
- 최근 사건. 모델의 학습 데이터 이후의 일은 검색하지 않는 한 빠졌거나 틀렸을 수 있습니다.
- 틈새 분야나 지역의 사실. 작은 회사, 지역 법률, 전문 분야는 뒷받침하는 학습 데이터가 적습니다.
- 의료, 법률, 금전 조언. 모델은 질문을 준비하는 데 쓰고, 답은 자격 있는 전문가나 공식 출처에서 구하세요.
이 체크리스트가 못 하는 일
Unflag를 포함해 모든 오류를 잡아낸다고 약속할 수 있는 도구는 없습니다. 웹을 검색하는 팩트 체커는 찾아낸 내용만큼만 판단할 수 있고, '검증 불가능'은 말 그대로의 뜻일 뿐 '거짓'이 아닙니다. 사실을 확인하는 일은 문체를 점검하는 일과도 다릅니다. AI 초안이 어떻게 읽히는지가 걱정이라면, AI 감지기 점수의 의미와 우리 학교가 어떤 걸 쓰는지 알아내는 방법을 다룬 글에서 그 부분을 살펴보세요. 그리고 수업이나 직장에 AI 정책이 있다면 AI 도움을 받았다는 사실을 밝히라는 규칙까지 포함해서 그대로 따르세요.
이 글을 만든 방법
PolitiFact가 공개한 테스트를 읽고, 여기 나온 단계를 Unflag 제품과 코드에 있는 팩트 체크 흐름과 비교했으며, 2026년 10월 기준 Unflag 요금을 확인했습니다. 실제 예시는 이 글을 위해 직접 만든 것이고, 어떤 도구의 출력도 붙어 있지 않습니다.
한 줄로 정리하면 이렇습니다. ChatGPT에게 의심스러운 부분을 나열하게 하고, 중요한 주장은 1차 출처에서 확인하세요. 확인할 주장이 많을 때는 팩트 체크를 쓰면 됩니다.
자주 묻는 질문
ChatGPT는 스스로 팩트 체크할 수 있나요?
부분적으로는 가능합니다. 답변을 다시 읽고 확신 없는 주장에 표시해 달라고 하면, 뻔한 모순 같은 일부 실수는 잡아냅니다. 하지만 확인하는 쪽도 답변을 쓴 모델과 같아서, 같은 실수를 더 자신 있게 되풀이할 수 있습니다. 1차 점검용으로 쓰고, 이름과 숫자, 인용, 날짜는 외부 출처로 확인하세요.
ChatGPT는 왜 없는 출처를 지어내나요?
언어 모델은 가장 그럴듯한 다음 단어를 쓰는 것이고, 그럴듯한 인용이란 저자와 제목, 연도의 모양을 갖춘 것입니다. 검색 도구가 켜져 있지 않으면 무언가를 찾아보는 게 아닙니다. 그래서 참고문헌이 완벽해 보여도 실제로는 존재하지 않을 수 있습니다. 링크를 직접 열어 보거나 제목을 검색해 보세요.
ChatGPT가 자기 답변을 팩트 체크하게 만드는 좋은 프롬프트는 무엇인가요?
직전 답변에서 확인 가능한 주장을 모두 나열하게 하고, 각각을 확실, 불확실, 추측으로 구분하게 한 다음, 어떤 출처가 있으면 확인되는지도 말하게 하세요. '이거 맞아?'라고 물으면 '네'라는 답이 돌아오기 쉬우니 피하세요. 그런 다음 불확실과 추측 항목을 직접 검증하면 됩니다.
AI가 쓴 글을 게시하기 전에 어떻게 팩트 체크하나요?
이름, 숫자, 날짜, 인용, '연구에 따르면' 같은 문장을 모두 뽑아낸 뒤, 원 연구나 회사 공식 페이지, 공공 데이터베이스 같은 1차 출처에서 하나씩 확인하세요. 확인되지 않는 내용은 고치거나 빼야 합니다. 마지막으로 글이 내가 쓴 것처럼 읽히도록 다듬으세요.
Unflag는 AI 글의 사실 여부를 확인해 주나요?
네. Unflag Plus의 팩트 체크는 글에서 주장을 뽑아 하나씩 웹에서 검색하고, 판정과 신뢰도, 출처를 알려 줍니다. 팩트 체크도 틀릴 수 있으니, 판정을 믿기 전에 표시된 출처를 열어 보세요. 무료 계정에서는 사용할 수 없습니다.
통계와 인용을 ChatGPT에게 맡겨도 안전한가요?
확인 없이는 안전하지 않습니다. 통계, 인용, 법률이나 의료 관련 세부 내용, 최근 사건, 정확한 숫자가 들어간 내용은 모델이 가장 자주 틀리는 부분입니다. 단서로만 보고 원래 출처를 찾아서, 출처에도 같은 말이 있을 때만 남기세요.