ChatGPT만 확인하면 충분할까? 같은 브랜드를 네 개의 AI 엔진에서 실측해 보니 차이가 세 배 이상이었습니다
작성: TriloAI 편집팀게시: 업데이트:
“툴로 확인해 봤는데, ChatGPT는 우리 브랜드를 언급하지 않더라고요.” 결론처럼 들리지만, 사실 이 말은 질문의 4분의 1에만 답한 것입니다.
같은 브랜드, 네 개 엔진의 실측 격차
아래는 저희가 직접 진행한 두 차례 스캔의 플랫폼별 결과입니다. 첫 줄은 2026년 8월 17일 TriloAI 스캔, 둘째 줄은 8월 23일 GEO by TriloAI 스캔(이때는 Google AI 개요를 포함하지 않음)으로, 브랜드·질문·플랫폼 구성이 달라 두 줄을 서로 비교할 수는 없습니다. 봐야 할 것은 같은 줄 안에서 플랫폼마다 얼마나 차이가 나는가입니다.
| 브랜드 / 날짜 | ChatGPT | Gemini | Perplexity | Google AI 개요 |
|---|---|---|---|---|
| TriloAI (2026-08-17) | 5.2% | 7.9% | 0% | 0% |
| GEO by TriloAI (2026-08-23) | 1.8% | 5.5% | 1.8% | 해당 회차 측정에 포함되지 않음 |
첫 번째 결과에서 Gemini는 ChatGPT의 1.5배였고, Perplexity와 Google AI 개요는 모두 0이었습니다. 두 번째 결과에서는 Gemini가 ChatGPT의 세 배였습니다. Perplexity만 확인했다면 첫 번째 브랜드는 아예 존재하지 않는 것처럼 보였을 것이고, Gemini만 확인했다면 그럭저럭 괜찮아 보였을 것입니다. 같은 스캔, 같은 질문이라도 어느 플랫폼을 보느냐에 따라 결론이 달라집니다.
이것은 누구의 측정이 더 정확한가의 문제가 아닙니다. 네 개의 숫자는 모두 맞습니다. 각기 독립적인 검색·순위 결정 로직을 가진 네 개의 시스템이 그대로 드러난 결과일 뿐입니다.
왜 이렇게까지 차이가 날까
- 검색 출처가 다릅니다. Perplexity는 실시간 웹 검색에 크게 의존하고, ChatGPT는 학습된 기억과 실시간 브라우징을 섞어 쓰며, Gemini는 또 자체 인덱스를 갖고 있습니다.
- 답변의 길이와 구조가 다릅니다. 여러 브랜드를 나열하는 경향의 엔진이 있는가 하면 하나만 추천하는 경향의 엔진도 있어, 목록에 포함될 확률이 크게 달라집니다.
- 업데이트 주기가 다릅니다. 웹사이트를 수정해도 각 엔진이 다시 수집하는 시점이 제각각이라, 단기적으로는 결과가 서로 맞지 않는 것이 자연스럽습니다.
더 헷갈리기 쉬운 부분: 구글에는 AI 화면이 세 개 있습니다
많은 분들이 구글의 AI를 하나의 시스템이라고 생각합니다. 실제로는 서로 독립된 화면이 최소 세 개 있으며, 인용하는 출처도 내놓는 답도 다릅니다.
| 화면 | 표시 위치 | 특징 |
|---|---|---|
| AI 개요(AI Overviews) | 일반 검색 결과 페이지 상단의 요약 | 기존 검색 결과와 함께 표시되며, 모든 검색어에서 나타나지는 않음 |
| AI 모드 | 검색 페이지의 별도 탭 | 대화형 화면으로, 참고한 웹사이트 수를 보여 줌 |
| Gemini | 독립된 앱과 웹사이트 | 완전한 대화형 어시스턴트 |
저희도 직접 이런 상황을 겪었습니다. 어느 측정에서는 Google AI 개요가 0%로 나왔는데, 같은 시기 구글 AI 모드의 답변에서는 추천 목록에 포함되어 있었습니다. 두 결과는 모순되지 않습니다. 애초에 서로 다른 시스템이기 때문입니다.
그러니 누군가 “구글 AI에서 봤어요”라고 말한다면, 먼저 어느 화면이었는지 확인해 볼 필요가 있습니다.
하나의 엔진만 보면 내리게 되는 잘못된 판단
- 현황 오판: 0%라는 결과만 보고 가시성이 전혀 없다고 판단하지만, 실제로는 다른 플랫폼에서 좋은 성과를 내고 있을 수 있습니다.
- 성과 오판: 개선 후 한 엔진에서 변화가 없다고 효과가 없다고 판단하지만, 다른 엔진은 이미 여러분을 인용하기 시작했을 수 있습니다.
- 경쟁사 오판: 엔진마다 제시하는 경쟁사 목록이 달라서, 하나만 보면 진짜 경쟁자를 놓치게 됩니다.
- 투자 방향 오판: 엔진마다 중시하는 신호가 완전히 같지는 않아서, 한 엔진의 선호에만 맞춰 최적화하면 노력에 비해 성과가 적을 수 있습니다.
그럼 전부 다 확인해야 할까
현실적인 조언은 이렇습니다. 검색 로직이 크게 다른 엔진을 최소 두 개 이상 확인하세요. 두 개만 고를 수 있다면, ChatGPT에 실시간 검색 의존도가 높은 엔진(예: Perplexity)을 더하는 조합이 대개 가장 많은 정보를 보여 줍니다. 전자는 모델의 기억을, 후자는 현재 웹 콘텐츠가 인용될 수 있는 정도를 반영하기 때문입니다.
다만 이 보고서를 고객이나 상사에게 제출해야 한다면, 주요 플랫폼이 하나라도 빠지면 반드시 질문을 받게 됩니다. 저희 전체 분석이 기본적으로 ChatGPT, Gemini, Perplexity, Google AI 개요, Claude 5개 플랫폼을 동시에 확인하는 이유입니다(중국 시장은 DeepSeek, Kimi, Qwen(통이첸원) 3개 플랫폼). 위의 두 차례 실측은 전체 분석에 Claude를 넣기 전에 한 것이라 표에 Claude가 없습니다. 고객에게 플랫폼별 차이를 설명하는 법은 AI 가시성 리포트를 고객에게 보여 주는 법에 정리했습니다.
어느 엔진이 가장 중요한가요?
고객층이 무엇을 쓰는지에 달려 있습니다. ChatGPT는 사용자가 직접 열어서 묻는 도구이고, Google AI 개요는 평소처럼 검색할 때 나타나므로 일부러 AI 도구를 열 필요가 없습니다. 두 가지는 성격이 달라서 어느 쪽이 더 중요하다고 말하기 어렵고, 그래서 저희 전체 분석은 기본적으로 5개 플랫폼을 함께 측정합니다.
왜 어떤 툴은 엔진 하나만 확인하나요?
비용 때문입니다. 엔진이 하나 늘어날 때마다 API 비용과 엔지니어링 유지보수 부담이 추가됩니다. 그런 툴이 쓸모없다는 뜻은 아니지만, 전체 중 일부만 보고 있다는 점은 알고 계셔야 합니다.
5개 플랫폼의 점수를 어떻게 하나의 숫자로 합치나요?
저희는 플랫폼별 가중치를 적용해 합산하며(가중치는 가시성 계산 방법 참고), 보고서에는 플랫폼별 세부 내역도 함께 남깁니다. 종합 점수는 추세를 보기에는 편리하지만, 의사 결정은 세부 내역을 보고 해야 합니다. 종합 3%라도 모든 플랫폼이 3%일 수도 있고, 한 곳만 두드러지게 높고 나머지는 모두 0%일 수도 있으며, 두 경우에 취해야 할 조치는 완전히 다릅니다.