본문으로 건너뛰기
목록으로 돌아가기
geo·작성: RanketAI Editorial Team·업데이트: 2026-10-07

구글 AI 모드는 외부 클릭을 18.8%p 줄였다 — 1,100명 무작위 현장 실험이 확인한 것 (2026)

구글 검색 사용자 1,100명을 무작위로 나눈 사전 등록 현장 실험에서 AI 모드만 쓰게 하자 외부 사이트로 이어진 검색 비율이 18.8%p 줄었고 만족도·신뢰도도 낮아졌습니다. AI 개요를 숨기면 클릭은 8.8%p 늘었습니다. 관찰 데이터가 아닌 인과 근거가 나온 지금, 클릭 대신 무엇을 측정해야 하는지 정리합니다.

AI 보조 작성 · RanketAI 편집팀 검수 후 발행 — 편집 정책 ›

핵심 요약: 구글 검색 사용자 1,100명을 무작위로 세 조건에 배정한 사전 등록 현장 실험(Wang 외, arXiv:2608.18352, preprint)에서 모든 검색을 AI 모드로 보내자 외부 사이트 클릭으로 이어진 검색 비율이 18.8%p 줄었습니다. 반대로 AI 개요를 숨기면 클릭은 8.8%p 늘었습니다. AI 모드 조건 참가자는 검색 만족도와 신뢰도도 낮게 평가했고, 다른 검색엔진을 쓴 비율이 높아졌습니다. 지금까지 "AI 검색이 클릭을 줄인다"는 근거 대부분은 관찰 데이터였는데, 이번에는 인과를 추정할 수 있는 실험 근거입니다. 구글이 8월 말 AI 개요를 자동으로 펼치기 시작한 지금, 클릭 대신 무엇을 측정해야 하는지 정리합니다.


3줄 요약

  • AI 모드만 쓰게 한 조건에서 외부 클릭 비율은 18.8%p 줄었고, AI 개요를 숨긴 조건에서는 8.8%p 늘었습니다. 감소 폭은 Reddit·뉴스·위키백과 같은 제3자 사이트에서도 컸습니다.
  • 클릭이 줄어든 대가로 사용자 경험이 좋아지지도 않았습니다. AI 모드 조건의 만족도·유용성·신뢰도는 모두 낮아졌고, 다른 검색엔진을 쓴 사용자 비율은 11.2%p 높아졌습니다.
  • AI 모드는 아직 구글의 기본 검색 경험이 아니지만, AI 개요 자동 확장으로 기본 화면이 그 방향으로 움직이고 있습니다. 방문 수만 KPI로 두면 답변 안에서 브랜드가 어떻게 다뤄지는지를 놓치게 됩니다.

실험은 어떻게 설계됐나

이 연구는 같은 사람들의 실제 구글 검색을 일주일 동안 바꿔 놓고 결과를 비교했습니다. 참가자는 브라우저 확장 프로그램을 설치했고, 확장 프로그램이 배정된 조건에 따라 구글 검색 화면을 실시간으로 바꿨습니다.

조건 검색 화면 역할
AI 없는 검색 AI 개요를 숨기고, AI 모드 진입은 일반 검색으로 전환 AI 기능을 제거했을 때
현재 검색 일반 구글 검색 그대로(AI 개요·AI 모드 사용 가능) 비교 기준(대조군)
AI 모드 검색 모든 검색을 AI 모드로 전환, 일반 탭 숨김 AI 모드가 기본이 됐을 때
항목 내용
표본 등록 1,444명, 실험 기간 중 검색한 참가자 1,100명, 사후 설문 완료 956명
지역 미국
기간 2026년 3월 모집, 기준 측정 3일 후 실험 7일
사전 등록 OSF
저자·연구비 펜실베이니아대·노스이스턴대 연구진, 미국 국립과학재단(NSF) 지원, 이해 상충 없음 명시

클릭률은 "구글에서 발생한 외부 클릭 수 ÷ 구글 검색 수"로 정의했습니다. 구글 내부로 이어지는 클릭(후속 검색 등)과 이미지·뉴스·쇼핑 같은 세로 검색은 제외했습니다.

이 설계가 중요한 이유는 증거의 강도입니다. 이 블로그가 GEO 연구 45편 서베이 분석에서 정리한 증거 등급 가운데 가장 높은 단계가 무작위 현장 실험입니다. 같은 기간 같은 조건의 사용자를 무작위로 나눴으므로, 조건 간 차이를 AI 기능의 효과로 해석할 수 있습니다. 상업 측정 도구 소속 저자가 운영 데이터로 쓴 연구와 달리, 연구비와 이해 상충도 명시돼 있습니다.

결과 1 — AI 모드는 외부 클릭을 18.8%p 줄였습니다

대조군(현재 구글 검색)과 비교한 외부 클릭 비율의 변화입니다.

조건 외부 클릭 비율 변화 95% 신뢰구간
AI 모드 검색 -18.8%p -22.2 ~ -15.3
AI 없는 검색 +8.8%p +2.3 ~ +15.3

자료: Wang 외, arXiv:2608.18352. 효과는 기준 측정값을 통제한 추정치입니다.

해석. AI 모드는 검색 100건당 외부 사이트로 이어지는 검색을 약 19건 줄였습니다. AI 개요만 있는 지금의 구글 검색도 AI 기능이 없는 검색보다 외부 클릭이 적었다는 뜻이기도 합니다(AI 개요를 숨기자 8.8%p 증가). 다만 AI 없는 검색 조건은 실험 중 구글 화면 구조가 바뀌어 AI 개요의 51.1%만 숨겨졌고, 연구진은 이를 보정한 추정치를 함께 보고했습니다.

감소는 특정 유형의 사이트에 한정되지 않았습니다. AI 모드 조건에서 해당 사이트를 클릭한 사용자 비율은 다음과 같이 줄었습니다.

클릭 대상 클릭한 사용자 비율 변화 (AI 모드 vs 대조군)
광고 -42.7%p (AI 모드에는 광고가 표시되지 않음)
Reddit -21.2%p
뉴스 사이트 -12.5%p
위키백과 -9.9%p

Reddit·뉴스·위키백과는 AI 답변이 자주 인용하는 제3자 출처입니다. AI 답변에 인용되는 사이트도 클릭은 덜 받는다는 점에서, 인용 여부와 방문 여부는 별개의 지표로 봐야 합니다.

결과 2 — 클릭이 줄었지만 사용자 경험도 나아지지 않았습니다

"클릭이 줄어든 것은 사용자가 답을 바로 얻었기 때문"이라는 설명은 이 실험에서 지지되지 않았습니다.

지표 (AI 모드 vs 대조군) 변화
만족도 -0.73 표준편차
주도권(원하는 대로 검색한다는 느낌) -0.66 표준편차
유용성 -0.59 표준편차
맞춤성·관련성 인식 -0.42 표준편차
구글 정보 신뢰도 (7점 척도) -0.34점
하루 검색 세션 수 -0.92회
세션당 검색 시간 +0.43분
다른 검색엔진(Bing·DuckDuckGo·Yahoo) 사용자 비율 +11.2%p

AI 모드 조건 참가자는 검색 횟수는 줄었지만 세션마다 더 오래 머물렀고, 결과를 덜 유용하고 덜 신뢰할 만하다고 평가했습니다. 반면 AI 없는 검색 조건은 설문 지표에서 대조군과 유의한 차이가 없었습니다. AI 기능을 없애도 사용자가 검색을 나쁘게 평가하지 않았다는 뜻입니다.

AI 모드 조건의 자유 응답(309명)에서는 부정적 평가가 33.6%, 긍정적 평가가 29.3%였습니다. 불만으로는 주도권 상실(17.6%), 특정 사이트로 이동하기 어려움(15.3%), 링크·출처 다양성 부족(13.4%)이 많았고, 칭찬으로는 시간 절약(14.0%)이 가장 많았습니다.

연구진은 결과를 다음과 같이 요약했습니다.

"We show that removing AI Overviews and AI Mode increases click-through rates to publishers, while an AI Mode-only experience reduces click-through rates and erodes user experience and trust in information found on Google." (AI 개요와 AI 모드를 제거하면 퍼블리셔로의 클릭률이 높아지고, AI 모드만 제공하면 클릭률이 낮아지며 사용자 경험과 구글에서 찾은 정보에 대한 신뢰가 약해진다.) — Wang 외, arXiv:2608.18352 (2026-08-18)

이 실험이 지금 중요한 이유 — 기본 화면이 AI 모드 쪽으로 움직이고 있습니다

AI 모드는 아직 구글의 기본 검색 경험이 아닙니다. 이 블로그의 팩트체크 글에서 확인했듯, 구글은 AI 모드를 기본값으로 만들 계획이 없다고 공개적으로 밝혔습니다. 실험 시작 시점 참가자의 AI 모드 사용 비율도 0.6%에 그쳤습니다. 실험의 "AI 모드 검색" 조건은 현실이 아니라 AI 모드가 기본이 된다면을 가정한 조건입니다.

다만 기본 화면은 그 방향으로 움직이고 있습니다. 구글은 2026년 8월 말 일부 검색어에서 AI 개요를 "더보기" 없이 자동으로 펼치고, 후속 질문 입력창을 처음부터 열어 두는 방식으로 바꿨습니다. 구글 대변인은 이 변화를 다음과 같이 설명했습니다.

"For some queries, AI Overviews may dynamically expand for topics where our systems determine it's most useful for people." (일부 검색어에서는 시스템이 사람들에게 가장 유용하다고 판단한 주제에 대해 AI 개요가 동적으로 확장될 수 있다.) — 구글 대변인, Search Engine Roundtable (2026-08-28)

AI 개요가 화면을 더 많이 차지하면 일반 검색 결과는 아래로 밀려납니다. 실험의 "현재 검색"과 "AI 모드 검색" 사이 어딘가로 기본 화면이 옮겨 가는 셈입니다.

한국 사용자도 이 변화의 대상입니다. 구글 AI 모드는 2025년 9월 한국어를 포함한 5개 언어로 확대됐습니다(Search Engine Roundtable). 다만 이 실험은 미국 사용자 대상이고, 한국은 네이버 검색 비중이 큰 시장이라 효과의 크기가 같다고 볼 근거는 없습니다. 국내 검색 생태계 구조는 한국 AI 검색 지형도에서 정리했습니다.

해석 — "클릭이 줄었다"는 이제 관찰이 아니라 인과입니다

이 블로그는 7월에 ChatGPT 검색의 유입 감소 연구를 다뤘습니다. ChatGPT 대화에서 외부 클릭이 발생한 세션이 5.2%에 그쳤다는 관찰이었습니다. 관찰 데이터는 "AI를 쓰는 사람이 원래 클릭을 덜 하는 사람인가"라는 질문에 답하기 어렵습니다. 이번 실험은 같은 성향의 사용자를 무작위로 나눠 이 질문을 해결했고, 구글 검색 안에서도 AI 답변이 외부 클릭을 줄인다는 인과 근거를 제시했습니다.

브랜드 입장에서 이 결과가 뜻하는 것은 세 가지입니다.

  1. 방문 수 감소가 곧 가시성 감소는 아닙니다. AI 답변 안에서 브랜드가 언급되고 출처로 인용돼도, 사용자는 클릭하지 않고 답변 안에서 판단을 끝낼 수 있습니다. 방문 수만 보면 이 노출이 측정되지 않습니다.
  2. 인용되는 출처도 클릭을 덜 받습니다. Reddit·위키백과처럼 AI가 자주 인용하는 사이트도 AI 모드에서 클릭이 크게 줄었습니다. 인용을 확보하는 목적은 클릭보다 답변 속 서술에 반영되는 것으로 바뀝니다.
  3. 답변이 마음에 들지 않을 때 사용자는 이동합니다. 특정 사이트로 이동하기 어렵다는 불만과 다른 검색엔진 사용 증가는, 사용자가 이름을 알고 직접 찾아가는 브랜드가 유리하다는 해석을 가능하게 합니다. 다만 이 실험은 브랜드 검색을 별도로 측정하지 않았으므로 가설로 남겨 둡니다.

실무 적용 — 클릭 KPI 옆에 둘 지표

클릭은 계속 측정하되, 클릭만으로는 판단하지 않는 체계가 필요합니다.

지금 보는 지표 함께 볼 지표 확인 방법
구글 오가닉 클릭 AI 기능 안의 노출 서치콘솔 생성형 AI 리포트(노출수·페이지·국가·기기·날짜, 클릭 없음)
검색 순위 AI 답변 속 브랜드 언급률·자사 도메인 인용률 같은 질문을 반복 측정해 언급·인용 여부 기록
방문 후 전환 답변 속 브랜드 서술의 정확성 답변 원문을 저장해 사실 오류·누락 확인
  1. 서치콘솔 클릭 감소를 해석할 때는 노출과 함께 봅니다. 구글의 서치콘솔 생성형 AI 리포트는 AI 개요·AI 모드 안의 노출을 보여주지만 클릭 데이터는 없습니다. 노출은 유지되는데 클릭만 줄었다면 이번 실험이 보여준 구조일 가능성이 있습니다. 노출까지 줄었다면 AI 답변의 출처 선택에서 빠졌는지 확인해야 합니다.
  2. 답변 속 노출을 측정합니다. 순위 대신 쓸 지표는 AI 상위노출 추적 지표 글에서 정리했습니다. RanketAI의 AI 브랜드 가시성 분석은 ChatGPT·Gemini·Perplexity 답변에서 브랜드 언급과 자사 도메인 인용을 측정합니다. 구글 AI 모드 화면의 답변은 측정 대상이 아니므로, AI 모드 답변이 중요하다면 핵심 질문 몇 개를 정해 직접 기록하는 방법을 병행할 수 있습니다.
  3. 답변 원문을 보관합니다. 클릭이 줄어들수록 사용자가 보는 정보는 답변 본문이 전부가 됩니다. 답변이 브랜드를 정확하게 설명하는지는 원문을 저장해야 확인할 수 있습니다.

이 연구를 인용할 때 지켜야 할 선 5가지

증거의 강도는 높지만, 조건을 함께 밝혀야 정확한 인용이 됩니다.

  1. AI 모드 강제 사용 조건입니다. 실험 전 AI 모드 사용 비율은 0.6%였고, 연구진도 강제 전환은 점진적·자발적 사용과 다르다고 밝혔습니다. "AI 모드가 클릭을 18.8%p 줄인다"가 아니라 **"모든 검색을 AI 모드로 바꾸면"**이라는 조건을 붙여야 합니다.
  2. 기간이 7일입니다. 사용자가 AI 모드에 적응한 뒤의 장기 효과는 측정하지 못했습니다.
  3. 표본이 미국 인구를 대표하지 않습니다. 참가자는 미국 인구보다 젊고(75%가 45세 미만), 학력이 높고(87%가 대졸 이상), 정치 성향이 한쪽에 치우쳐 있었습니다.
  4. AI 없는 검색 조건의 처치가 불완전했습니다. 실험 중 구글 화면 구조가 바뀌어 AI 개요의 51.1%만 숨겨졌습니다. +8.8%p는 이 조건을 고려해 읽어야 합니다.
  5. 동료심사 전 프리프린트이고, 건강·법률·금융처럼 중요도가 높은 검색은 별도로 분석하지 않았습니다. 한국어 검색에 대한 근거도 아닙니다.

자주 묻는 질문

구글이 AI 모드를 기본값으로 바꾸면 우리 사이트 트래픽이 18.8% 줄어드나요?

그렇게 단정할 수 없습니다. 18.8%p는 "검색 중 외부 클릭으로 이어진 비율"의 차이이고, 사이트별 트래픽 감소율이 아닙니다. 또한 미국 사용자를 7일 동안 강제로 전환한 조건의 결과입니다. 방향은 분명하지만 크기는 업종·질문 유형·시장에 따라 다를 수 있습니다.

AI 개요만 있는 지금의 구글 검색도 클릭을 줄이나요?

이 실험에서는 그랬습니다. AI 개요를 숨긴 조건에서 외부 클릭이 8.8%p 늘었으므로, 반대로 말하면 지금의 AI 개요가 클릭을 그만큼 줄이고 있다는 뜻입니다. AI 개요를 숨겨도 사용자 만족도는 유의하게 떨어지지 않았습니다.

한국 사용자에게도 같은 결과가 나올까요?

근거가 없습니다. 이 실험은 미국 사용자만 대상으로 했고, 한국은 네이버 검색 비중이 커서 구글 화면 변화의 영향 범위가 다릅니다. 다만 AI 모드는 2025년 9월부터 한국어로 제공되고 있어, 구글 유입 비중이 큰 사이트라면 같은 방향의 변화를 가정하고 측정 체계를 준비하는 편이 안전합니다.

클릭이 줄면 SEO는 의미가 없어지나요?

그렇지 않습니다. AI 답변도 검색 결과에서 출처를 가져오므로, 검색에서 읽히고 노출되는 기반은 여전히 필요합니다. 달라지는 것은 성과를 판단하는 지표입니다. 순위와 클릭에 더해 AI 기능 안의 노출과 답변 속 언급·인용을 함께 봐야 합니다.

예산이 적은 팀은 무엇부터 해야 하나요?

비용이 들지 않는 것부터 시작하세요. ① 서치콘솔 생성형 AI 리포트에서 노출 추이를 확인하고, ② 클릭 추이와 나란히 놓아 노출은 유지되는데 클릭만 줄었는지 구분하고, ③ 핵심 질문 몇 개를 정해 AI 답변에 브랜드가 언급되는지 정기적으로 기록합니다. 같은 질문을 같은 조건으로 반복해야 변화를 읽을 수 있습니다.

함께 읽으면 좋은 글

핵심 실행 요약

항목실무 기준
핵심 주제구글 AI 모드는 외부 클릭을 18.8%p 줄였다 — 1,100명 무작위 현장 실험이 확인한 것 (2026)
적용 대상geo 업무에 우선 적용
우선 조치입력 계약(목적·독자·자료·출력형식)부터 고정
리스크 체크근거 없는 주장, 정책 위반, 형식 미준수 여부를 검증
다음 단계실패 로그를 패턴 템플릿으로 축적해 재발을 줄임

자주 묻는 질문(FAQ)

"구글 AI 모드는 외부 클릭을 18.8%p 줄였다 — 1,100명 무작위 현장 실험이…"의 접근법을 실제 업무에 바로 적용하려면 어떻게 해야 하나요?▾

요청 입력을 표준화해 목적, 대상 독자, 참고 자료, 출력 형식을 필수로 받는 입력 계약부터 도입하세요.

구글 AI 모드은 개인 실무자에게도 적합한가요, 아니면 팀 단위 도입이 필요한가요?▾

geo처럼 반복 업무와 품질 편차가 큰 팀에서 효과가 빠르게 나타납니다.

구글 AI 모드를 처음 도입할 때 가장 흔히 발생하는 실수는 무엇인가요?▾

프롬프트 문구보다 맥락 레이어 분리와 출력 검증 루프가 실제로 작동하는지 먼저 점검하세요.

분석 근거

  • 1차 출처: Wang·Gleason·Bart·Wilson·Metaxa, "AI in Search Reduces Publisher Referrals Without Improving User Experience: Experimental Evidence" (arXiv:2608.18352, 2026-08-18, preprint) 본문 — 세 조건 설계, 표본 수, 클릭률 정의, 조건별 효과 추정치와 95% 신뢰구간, 도메인별 클릭 효과, 설문 결과, 한계 조항, 연구비·이해 상충 진술을 원문 HTML 기준으로 확인했다. 인용 블록의 영문은 원문과 대조했다. 저자 소속은 펜실베이니아대·노스이스턴대, 연구비는 미국 국립과학재단(NSF)이며 저자들은 이해 상충이 없다고 밝혔다. 사전 등록은 OSF.
  • 일부 매체가 보도한 만족도 원점수(5점 만점 4.0 → 2.9)는 논문 본문 텍스트에서 확인되지 않아 인용하지 않았다. 본문의 설문 효과는 논문이 보고한 표준화 효과(표준편차 단위)와 7점 척도 신뢰도 차이로만 적었다.
  • 구글 측 변화: AI 개요 자동 확장은 Search Engine Roundtable(2026-08-28)이 보도한 구글 대변인 설명을, AI 모드 한국어 제공은 Search Engine Roundtable(2025-09-09)을, 서치콘솔 생성형 AI 리포트는 당 블로그 기존 글(구글 공식 발표 인용)을 근거로 했다. AI 모드가 기본 검색 경험이 아니라는 점은 당 블로그 2026-08-03 팩트체크 글의 1차 출처를 따른다.
  • 이 글에는 RanketAI 자체 측정 수치가 없다. 클릭 감소를 측정한 외부 실험을 검토하고, 실무 지표 설계는 당 블로그 기존 글의 기준을 연결했다.

핵심 주장과 근거

이 섹션은 본문 핵심 주장과 근거 출처를 1:1로 대응해 빠르게 검증할 수 있도록 구성했습니다. 아래 항목에서 주장과 원문 링크를 함께 확인하세요.

외부 인용 링크

아래 링크는 본문 수치와 주장에 직접 사용한 원문 출처입니다. 항목별 원문 맥락을 확인하면 해석 차이를 줄이고 재검증 속도를 높일 수 있습니다.

AI 검색에 내 사이트는 노출되고 있을까?

ChatGPT·Perplexity·Gemini가 내 브랜드를 어떻게 답하는지 무료로 확인해 보세요.

지금 진단 시작 →

이어서 읽기

관련 포스트

관련 포스트는 현재 글의 선택 기준을 다른 상황에서 비교 검증할 수 있도록 선별했습니다. 관점을 확장하려면 아래 글을 순서대로 확인해 보세요.

AI는 지난번에 언급한 브랜드를 다시 언급한다 — 3만 5천 건 연구와 한국 SaaS 실측 (2026)

브랜드명 없는 질문 3만 5천 건을 분석한 2026년 9월 연구에서 자사 도메인이 출처로 나타나지 않은 답변의 브랜드 언급률은 3% 안팎, 자사 도메인이 인용된 답변은 49~58%였습니다. 가장 강한 예측 변수는 직전 측정의 언급 기록이었습니다. 한국 B2B SaaS 12곳 재분석과 함께 언급과 인용을 나눠 추적하는 방법을 정리합니다.

2026-10-06

GEO 점수는 무엇을 측정하나 — 질문 모음·측정 모델·판정 방식이 점수를 바꾸는 구조 (2026)

같은 질문을 같은 날 물어도 측정 모델만 바꾸면 자사 브랜드 언급률이 43%와 5%로 크게 달랐습니다. 2026년 9월 공개된 GEO 측정 방법론 논문은 가시성 점수가 질문 모음·실행 조건·가중치·판정 규칙의 조합으로 정해진다고 정리합니다. GPT-6가 출시된 지금, 측정 도구와 리포트를 검토할 때 확인할 기준을 자사 실측과 함께 정리합니다.

2026-09-24

대형 브랜드는 73%, 소형은 11% — 브랜드 규모가 AI 답변 등장률을 나누는 구조 (2026)

브랜드명 없는 카테고리 질문에서 대형 브랜드는 답변의 73%, 중견은 44%, 소형은 11%에만 등장했다는 10만 응답 규모 연구가 공개됐습니다. 표본 편중이라는 한계와 함께, 한국 B2B SaaS 12곳 실측에서 확인된 엔진별 2.5배 격차를 나란히 놓고 소형 브랜드가 실제로 손댈 수 있는 지점을 정리합니다.

2026-09-08

AI 가시성 측정에 빠진 수요 측 데이터 — 고객이 신뢰하는 출처 유형

AI 답변 속 브랜드 가시성 측정은 대부분 공급 측, 즉 내 콘텐츠가 인용됐는지만 확인합니다. 2026년 8월 공개된 103만 건 규모 구매자 페르소나 코퍼스는 수요 측 데이터의 부재를 문제로 제기하며 페르소나마다 신뢰하는 출처 유형을 함께 기록했습니다. 이 축이 실무 측정에 무엇을 더하는지, 합성 코퍼스라는 한계는 무엇인지 정리합니다.

2026-09-06

GEO 기법 효과 40%의 조건 — 45편 연구를 검토한 2026 비판적 서베이 분석

GEO 최적화로 AI 답변 가시성이 최대 40% 개선된다는 수치는 소스가 이미 답변 컨텍스트에 포함된 조건에서 측정된 값이다. 2023~2026년 GEO 연구 45편을 증거 등급으로 가려낸 비판적 서베이를 바탕으로, 재현성이 확인된 레버(주제 적합성·컨텍스트 위치)와 역효과 사례(-16%), 그리고 실무에서 무엇을 멈추고 무엇을 측정해야 하는지 정리한다.

2026-07-22