본문 바로가기
AI에 속은 인간

AI한테 "이 사진 진짜야?" 물었더니 자신 있게 틀렸다

by 스킬사공사 2026. 9. 19.

TL;DR

  • 실험: 영국 팩트체크 단체가 챗봇 세 종류에 온라인 낭설을 물어봤더니, 오답이 67건 나왔어요.
  • 가장 아픈 곳: AI가 만든 사진과 엉뚱한 나라의 옛날 영상을 "진짜"라고 확인해 준 경우가 여럿이었어요.
  • 교훈: 챗봇은 진위 판정기가 아니에요. 속보 상황일수록 더 그래요.

SNS에서 수상한 사진이 돌면 요즘은 이렇게들 하죠. "@그록 이거 진짜야?" 그 한 줄로 끝내는 습관, 생각보다 위험할 수 있어요. 영국의 독립 팩트체크 기관 풀팩트(Full Fact)가 8월 말 공개한 다섯 달치 시험 결과를 보면요.

🧪 어떻게 시험했나

풀팩트 기자들은 독자가 실제로 물어볼 법한 중립적인 질문을 만들었어요. 그리고 낭설을 반박하는 기사를 내기 전과 후에 같은 질문을 구글 제미나이, 오픈AI 챗GPT, X(옛 트위터)의 그록에게 던졌어요. 다만 소비자용 앱이 아니라 개발자용 연결 통로(API)로 접속해 시험했다는 점은 알아둬야 해요.

🖼️ 진짜라고 우겨 준 가짜들

가장 눈에 띄는 건 이미지 판별이었어요. 유럽 저비용항공사 라이언에어의 기내 창문이라며 돌던 AI 생성 사진을 여러 모델이 진짜라고 답했어요. 가짜 정치 현수막이나 지자체 포스터를 진짜로 확인해 준 경우도 있었고요.

📎 예시

이란 미사일 공격 국면에서 그록은 2022년 사우디아라비아 화재 영상을 텔아비브 영상이라고 답했어요. 영국 글래스고 화재 영상을 이란의 공격이라고 본 모델도 여러 개였어요. 영상 속 장면을 직접 검증한 게 아니라, 그럴듯한 설명을 매끄럽게 이어 붙인 거예요.

🔧 나중엔 고쳤을까

반박 기사가 나온 뒤에는 일부가 그 기사를 인용해 답을 바로잡았어요. 그런데 제미나이 두 모델은 기사가 나온 뒤에도 같은 오답을 유지했어요. 구글은 시험에 쓴 모델이 이미 오래됐고 최신 모델은 더 낫다는 입장이었고, 오픈AI는 API 시험 결과가 소비자용 챗GPT와 다를 수 있다고 밝혔어요. 결과를 이렇게 양쪽 입장까지 같이 봐야 공정해요.

⚠️ 주의

"AI가 확인해 줬다"는 말은 근거가 아니에요. 챗봇은 사진의 출처를 추적하는 게 아니라, 그럴싸한 문장을 만들어 내는 도구에 가까워요. 그래서 모를 때도 모른다고 하기보다 아는 척 답하기 쉬워요.

💡 Tip

급한 이미지는 역검색으로 최초 게시 시점을 찾고, 같은 장면을 다룬 언론사나 팩트체크 기사를 직접 열어 보세요. AI는 그 뒤에 보조로만 쓰세요.

✅ 챗봇 답은 판정이 아니라 참고 의견으로 받아요
✅ 속보 영상과 사진일수록 출처부터 따로 확인해요
✅ 공유 버튼은 확인이 끝난 뒤에 눌러요

출처

반응형