구글 1위와 챗GPT 답변 간의 72.5% 괴리

전통적인 검색 엔진에서 최상위 순위를 확보하더라도 AI 검색 서비스의 추천 목록에 이름을 올리는 것은 별개의 문제라는 조사 결과가 나왔다. 마케팅 연구 기관 디스커버러블(Discoverable)이 발표한 영국 AI 쇼트리스트 연구(UK AI Shortlist Study)에 따르면, 구글 자연 검색 1위에 오른 공급업체 웹사이트가 동일한 구매 질문에 대한 챗GPT(ChatGPT) 답변의 72.5%에서 언급되지 않은 것으로 나타났다.

이번 조사는 25개 상업 카테고리에 걸친 1,000개 구매 질문을 대상으로 진행됐다. 디스커버러블은 챗GPT를 비롯해 마이크로소프트 코파일럿(Microsoft Copilot), 제미나이(Gemini), 퍼플렉시티(Perplexity), 구글 AI 모드(Google AI Mode), 구글 AI 오버뷰(Google AI Overviews) 등 6개 소비자 AI 서비스를 테스트했다. 2026년 9월 6일과 7일에 걸쳐 3회 반복 수집한 1만 7,537건의 AI 답변과 3,000건의 구글 검색 결과를 수집해 사람이 직접 검증했다.

구글 1위 업체의 챗GPT 누락 수치는 575개 질문에 걸쳐 반복 검증된 1,632개 유효 답변 중 1,183개에 달했다. 특히 구글 상위 10위 내 공급업체 중 최소 한 곳 이상이 챗GPT 답변에 언급된 경우로 분석 대상을 좁혀도, 1위 업체의 미언급 비율은 54.0%로 절반을 넘었다.

언급과 출처 인용의 구조적 분리

이번 연구에서는 AI 답변 텍스트 내 '브랜드 언급(Mention)'과 백엔드 '출처 인용(Citation)'이 일치하지 않는 현상도 함께 관측됐다. 특정 웹사이트가 AI 모델의 검색 증강 및 답변 생성에 정보 출처로 사용되더라도, 사용자가 읽는 본문 텍스트에는 브랜드명이 전혀 표기되지 않는 사례가 확인된 것이다.

예를 들어 '초보 창업자를 위한 법인 설립(company formation for a first time founder)' 질문에서 구글 1위를 기록한 '유어 컴퍼니 포메이션스(Your Company Formations)'는 18회에 걸친 AI 답변 본문 텍스트에 단 한 번도 이름이 언급되지 않았다. 그러나 퍼플렉시티는 3회 테스트 모두에서 해당 웹사이트를 정보 출처로 인용했다. 챗GPT 분석에서 브랜드 이름 언급뿐만 아니라 출처 링크 인용까지 포함해 노출 여부를 판정할 경우, 누락률은 72.5%에서 68.0%로 4.5%포인트 낮아졌다.

반면 검색 순위와 AI 추천이 완벽하게 일치하는 경우도 있었다. '디지털 상품 판매를 위한 무료 플랫폼(free platform for selling digital products)' 질문에서 구글 1위를 차지한 페이힙(Payhip)은 3회 테스트에 걸친 18개 AI 답변 전체에서 이름이 직접 언급됐다.

기존 SEO 측정 지표의 한계와 과제

디스커버러블의 존 데이비드(Jon David)는

"구글 1위에 오르는 데는 많은 노력이 들며, 사업자는 그 결과 자신이 쉽게 발견될 것이라 합리적으로 기대하지만 챗GPT에 같은 질문을 넣었을 때 언급조차 되지 않는 격차가 발생한다"
고 설명했다.

이러한 결과는 검색 최적화 성과를 구글 순위만으로 평가하던 방식에 재검토가 필요함을 시사한다. 앞서 "검색 순위 높아도 AI 검색서 밀린다"… 마케터 56%는 차이 구분 못 해 기사에서 다룬 바와 같이, 키워드 랭킹 중심의 전통적 지표는 생성형 엔진 내부에서 일어나는 정보 탈락 현상을 포착하지 못한다. 또한 AI 가시성 점수의 착시… 인용·언급 분리 없는 측정의 맹점에서 지적했듯 텍스트 멘션과 소스 사이테이션을 분리해 파악하는 측정 체계가 요구된다.

한편 이번 연구는 영국 시장을 표본으로 진행되었으며, 검색량 가중치를 별도로 부여하지 않았다. 또한 추천 탈락에 따른 실제 매출 손실 규모나 추천 대상 기업의 적합성 자체를 직접 판정한 것은 아니라고 디스커버러블은 덧붙였다.

이 사이트가 보는 지점

구글 최상위 랭킹이 생성형 AI의 구매 추천으로 자동 연결되지 않는다는 점이 대규모 데이터로 확인됐습니다. 특히 검색 결과 1위 웹사이트가 퍼플렉시티 등에서 정보 출처로는 인용되면서도 정작 챗GPT 답변 본문의 추천 업체 이름에서는 누락되는 현상은, 인용(Citation)과 엔티티 언급(Mention)이 완전히 분리된 메커니즘으로 동작함을 입증합니다. 향후 GEO 가시성 측정은 키워드 순위 추적을 넘어, 모델이 소스로 긁어간 데이터와 사용자에게 최종 추천되는 텍스트 사이의 누락률을 개별적으로 분리해 측정하는 방향으로 재편되어야 합니다.