블로그 목록
실측리포트AI검색엔진비교

같은 날 같은 질문을 두 AI에 던졌더니, 겹친 사이트는 4.1%였습니다

ChatGPT·Gemini·Claude·Perplexity가 같은 키워드에서 어떤 사이트를 인용하는지 비교했습니다. 네 엔진이 모두 인용한 사이트는 0.1%였고, 수집 시점을 맞춘 두 엔진 비교에서도 겹침은 4.1%에 그쳤습니다.

같은 날 같은 질문을 두 AI에 던졌더니, 겹친 사이트는 4.1%였습니다

"AI 검색 최적화를 했다"는 말을 들을 때 저희가 되묻는 게 있습니다. 어느 AI 기준인가요.

ChatGPT에서 인용되면 Gemini에서도 인용될까요. 상식적으로는 "좋은 콘텐츠면 어디서든 걸리겠지" 싶습니다. 세봤더니 아니었습니다.

같은 날, 같은 질문에 두 AI가 함께 인용한 사이트는 4.1%였습니다.

어떻게 셌는지부터

  • 측정 기간: 2026년 5월 20일 ~ 8월 28일
  • 엔진: ChatGPT, Gemini, Claude, Perplexity
  • 비교 단위: 같은 키워드에 대해 각 엔진이 인용한 사이트(도메인) 집합

같은 키워드에 A 엔진은 열 곳, B 엔진은 열 곳을 인용했다고 할 때, 그 둘이 몇 곳이나 겹치는지를 본 것입니다. 페이지가 아니라 사이트 기준이라 겹침이 더 잘 잡히는 조건입니다. 앞선 측정에서 확인했듯 인용은 대부분 개별 하위 페이지에서 일어나기 때문에, 페이지 단위로 세면 겹침은 이보다 더 낮게 나옵니다.

발견 1 — 네 엔진이 모두 인용한 사이트는 0.1%였습니다

네 엔진이 모두 다룬 키워드 501개를 골랐습니다. 여기서 나온 (키워드, 사이트) 조합 27,530개를 몇 개 엔진에서 인용됐는지로 나눴습니다.

인용한 엔진 수조합 수비중
1개 엔진에서만23,386개84.9%
2개 엔진3,597개13.1%
3개 엔진516개1.9%
4개 엔진 전부31개0.1%

열에 여덟다섯은 한 엔진에서만 인용됐습니다. 네 엔진 전부에서 걸린 조합은 27,530개 중 31개입니다.

다만 이 수치는 그대로 믿으면 안 됩니다. 엔진별로 수집 시점이 달랐기 때문입니다. Claude는 5월 26일 하루치, ChatGPT는 8월 22일까지의 기록이라 시점 차이만으로도 겹침이 낮아집니다. 그래서 조건을 더 좁혀 다시 셌습니다.

발견 2 — 시점을 맞춰도 겹침은 4.1%였습니다

수집 기간이 거의 같은 Perplexity와 Gemini 두 엔진만 골랐습니다. 그리고 같은 키워드를 같은 날 수집한 경우로 한정했습니다. 시점 차이를 지운 비교입니다.

  • 대상: 키워드-날짜 쌍 1,869개
  • (키워드, 날짜, 사이트) 조합 36,919개
  • 두 엔진이 함께 인용한 조합: 1,513개 (4.1%)

같은 날 같은 질문을 던졌는데, 두 AI가 함께 집어 든 사이트는 스물다섯 곳 중 한 곳꼴이었습니다. 나머지 95.9%는 한쪽만 인용했습니다.

발견 3 — 겹치는 사이트는 원래 자주 인용되던 곳입니다

그럼 그 4.1%는 어떤 사이트일까요. 두 엔진 비교에 등장한 사이트 10,209곳을 나눠 봤습니다.

구분사이트 수평균 등장 횟수
두 엔진에 함께 인용된 적 있음402곳 (3.9%)17.1회
한 엔진에만 인용됨9,807곳 (96.1%)3.1회

겹치는 사이트는 평균 17.1회 등장했고, 안 겹치는 사이트는 3.1회였습니다. 다섯 배 넘게 차이납니다.

읽는 방향은 이렇습니다. 여러 엔진에 동시에 걸리는 건 이미 폭넓게 인용되고 있는 소수 사이트에서 나타나는 현상이고, 대부분의 사이트는 특정 엔진에서만 걸립니다. 다만 이번 측정으로 "널리 인용되면 겹치게 된다"는 방향의 인과를 확인한 건 아닙니다. 두 성질이 같이 나타났다는 관측입니다.

이게 실무에서 의미하는 것

엔진 하나를 보고 전체를 판단할 수 없습니다.

ChatGPT에 우리 사이트가 나왔다고 해서 Gemini에도 나온다는 근거가 되지 못합니다. 반대도 마찬가지입니다. 한 엔진에서 안 보인다고 "AI 검색에서 우리는 안 걸린다"고 결론 내리는 것도 이릅니다.

측정을 한다면 엔진별로 따로 봐야 하고, 성과를 합산해 하나의 점수로 만들 때는 그 점수가 무엇을 평균한 값인지 알고 써야 합니다.

이번 측정의 한계

  • 4엔진 비교(발견 1)는 수집 시점이 다릅니다. Claude는 하루치, ChatGPT는 8월 22일까지입니다. 시점 차이가 겹침을 낮추는 방향으로 작용했을 수 있습니다.
  • 시점을 통제한 비교(발견 2)는 두 엔진뿐입니다. Perplexity와 Gemini의 결과이며, 다른 조합에서도 같을지는 확인하지 않았습니다.
  • 질문셋은 저희가 구성했습니다. 키워드 구성이 달라지면 비율도 달라질 수 있습니다.
  • 사이트(도메인) 기준입니다. 페이지 단위로 세면 겹침은 더 낮게 나옵니다.

정리

  1. 네 엔진이 모두 인용한 (키워드, 사이트) 조합은 27,530개 중 31개(0.1%)였습니다.
  2. 수집 시점을 맞춘 두 엔진 비교에서도 겹침은 4.1%에 그쳤습니다.
  3. 겹치는 사이트 402곳은 평균 17.1회 등장해, 한 엔진에만 걸린 사이트(3.1회)와 다섯 배 넘게 차이났습니다.

엔진마다 인용하는 사이트가 다릅니다. AI 검색 대응은 하나의 작업이 아니라 엔진 수만큼의 작업에 가깝습니다.

내 사이트가 어느 엔진에서 인용되고 있는지는 citly.co.kr에서 엔진별로 확인할 수 있습니다.