병원 SEO/GEO · 2026-08-14 · 7분
우리 병원 글, 구글 AI 학습에서 빼고 싶다면: Google-Extended가 하는 일과 못 하는 일
Google-Extended로 AI 학습을 막아도 구글 검색·AI 개요 노출은 그대로 유지됩니다. 병원 운영자를 위해 Google 공식 문서 기준으로 정리했습니다.
핵심 요약
- Google-Extended는 우리 사이트의 내용이 Gemini 같은 Google 생성형 AI 모델의 학습과 그라운딩에 쓰일지를 조절하는 토큰입니다.
- Google은 "Google-Extended는 Google 검색의 포함 여부에 영향을 주지 않으며 검색 순위 신호로도 쓰이지 않는다"고 명시합니다.
- 즉 Google-Extended를 막아도 우리 병원은 구글 검색과 AI 개요(AI Overviews)에서 사라지지 않습니다. 그쪽은 Googlebot이 담당합니다.
- 병원 입장에서 진짜 중요한 것은 "AI 크롤러 차단 여부"가 아니라, 검색 색인 기본기(크롤링 가능성·텍스트 제공·신뢰 정보)를 갖췄는지입니다.
"AI가 우리 병원 글 가져가는 거, 막아야 하는 거 아닌가요?"
병원 홈페이지를 운영하다 보면 이런 걱정을 하시는 원장님들이 많습니다.
"요즘 AI가 남의 글을 막 학습한다는데, 우리 병원 콘텐츠도 무단으로 쓰이는 것 아닌가요? robots.txt에서 AI 크롤러를 막아버리면 안 되나요?"
그런데 여기서 한 걸음 더 나가면 정반대 걱정이 붙습니다.
"막았다가 구글 AI 검색에서 우리 병원이 안 나오면 어떡하죠? 요즘 환자들이 구글에 물어보면 AI가 요약해서 답해주던데, 거기서 빠지면 손해 아닌가요?"
두 걱정이 한 문장 안에서 충돌합니다. AI 학습은 막고 싶은데, AI 검색 노출은 유지하고 싶다. 이게 가능한지, 아니면 둘 중 하나를 포기해야 하는지 헷갈리기 시작합니다.
결론부터 말씀드리면, "AI 크롤러를 막으면 구글 AI 검색에서도 사라진다"는 생각은 절반만 맞습니다. 정확히는 절반도 안 맞습니다. Google의 공식 문서를 기준으로 보면, 학습을 막는 조치와 검색·AI 개요 노출은 서로 다른 통로로 관리되기 때문입니다.
Google-Extended가 정확히 무엇인가
Google Search Central의 크롤러 문서는 Google-Extended를 이렇게 설명합니다.
"Google-Extended는 웹 게시자가 자신의 사이트에서 Google이 크롤링한 콘텐츠가 앞으로의 Gemini 모델 학습에 사용될지를 관리할 수 있는 독립 제품 토큰이다."
정리하면 이렇습니다.
- Google-Extended는 Gemini 앱과 Vertex AI(Gemini용 API)에서 콘텐츠를 학습·그라운딩에 쓰는 것을 조절합니다.
- Google-Extended는 별도의 크롤러가 아닙니다. Google 문서는 "Google-Extended는 별도의 HTTP 요청 user-agent 문자열을 갖지 않으며, 크롤링은 기존 Google user-agent로 이루어진다"고 밝힙니다.
- 조절 방법은 robots.txt에 토큰을 지정하는 것입니다.
User-agent: Google-Extended
Disallow: /
이렇게 쓰면 "우리 사이트 콘텐츠를 Gemini 모델 학습·그라운딩에는 쓰지 말라"는 의사표시가 됩니다. 특정 폴더만 빼고 싶다면 Disallow: /특정경로/처럼 범위를 좁힐 수도 있습니다.
여기까지만 보면 "그럼 이걸 막으면 구글 AI에서 빠지겠네"라고 생각하기 쉽습니다. 하지만 그 판단이 어긋나는 지점이 바로 다음입니다.
막아도 구글 검색·AI 개요에서 사라지지 않는 이유
Google은 Google-Extended에 대해 한 문장을 분명하게 덧붙입니다.
"Google-Extended는 Google 검색에서의 사이트 포함 여부에 영향을 주지 않으며, Google 검색의 순위 신호로도 사용되지 않는다."
즉 Google-Extended를 Disallow로 막아도 우리 병원 페이지는 구글 검색 결과에서 그대로 유지됩니다. 순위가 내려가지도 않습니다. 이 둘은 애초에 다른 시스템이기 때문입니다.
- 검색 색인은 Googlebot이 담당합니다. 우리 병원 페이지가 검색에 나올지, 어떤 순위에 놓일지는 Googlebot이 크롤링한 색인에서 결정됩니다.
- Gemini 학습·그라운딩은 Google-Extended가 담당합니다. 이걸 막으면 그 제품군의 학습에서만 빠집니다.
그렇다면 요즘 환자들이 자주 보는 AI 개요(구글 검색 결과 위쪽에 요약으로 뜨는 AI 답변)는 어느 쪽일까요? Google의 AI 기능 문서가 이 부분을 정확히 짚습니다.
"AI는 검색에 내장되어 있으며 검색이 작동하는 방식의 핵심이다. 그래서 Googlebot에 대한 robots.txt 지시가, 사이트가 검색을 위해 어떻게 크롤링되는지를 사이트 소유자가 관리하는 수단이 된다."
풀어 쓰면, AI 개요와 AI 모드는 별도 AI 크롤러가 아니라 검색 색인(Googlebot)을 그대로 사용합니다. 따라서 Google-Extended를 막았다고 AI 개요에서 우리 병원이 빠지지 않습니다. Google도 AI 기능 문서에서 "AI 학습과 그라운딩을 다른 시스템에서 제한하려면 Google-Extended를 참고하라"며 이 둘을 분리해 안내합니다.
정리하면 이렇게 됩니다.
| 하고 싶은 일 | 조절 수단 | Google-Extended와의 관계 |
|---|---|---|
| 구글 검색에서 빼기 | noindex 또는 Googlebot 차단 | 무관 |
| AI 개요에 안 나오게 하기 | nosnippet, data-nosnippet, noindex 등 | 무관 |
| Gemini 학습·그라운딩에서 빼기 | Google-Extended Disallow | 바로 이것 |
"그럼 AI 개요에 잘 나오려면 뭘 허용해야 하나요?"
반대 방향의 오해도 흔합니다. "AI 검색에 잘 나오게 하려면 Google-Extended를 열어두거나 뭔가 특별한 설정을 해야 하는 것 아니냐"는 질문입니다.
Google의 답은 분명합니다.
"AI 개요나 AI 모드에 나타나기 위한 추가 요건은 없으며, 별도의 특별한 최적화도 필요 없다."
즉 AI 검색 노출을 위한 비밀 스위치는 없습니다. 우리 병원 홈페이지가 구글 AI 검색에 보이는지를 가르는 것은 여전히 검색 기본기입니다.
- robots.txt나 호스팅에서 Googlebot 크롤링이 막혀 있지 않은가
- 진료과·의료진·진료시간·위치 같은 중요한 정보가 자바스크립트 뒤가 아니라 HTML 텍스트로 제공되는가
- 페이지가 사람에게 실제로 유용하고 신뢰할 수 있는가
- Search Console에서 색인 상태를 확인할 수 있는가
이 기본기가 흔들리면 Google-Extended를 어떻게 설정하든 AI 검색에 나올 근거 자체가 약해집니다. 순서가 바뀌면 안 됩니다.
병원은 Google-Extended를 막아야 할까, 열어둬야 할까
정답이 하나로 정해진 문제는 아닙니다. 다만 병원이라는 업종의 특성을 두고 판단 기준을 정리하면 이렇습니다.
열어두는 쪽(기본값)을 고려할 이유
- 막아도 검색·AI 개요 노출에는 이득이 없습니다. 노출은 어차피 Googlebot이 결정합니다.
- 정확한 병원 정보가 생성형 AI 답변의 근거로 쓰이는 것을 굳이 막을 이유가 크지 않다면, 기본값 그대로 두는 선택이 단순합니다.
막는 쪽을 고려할 이유
- 우리 병원의 고유 콘텐츠가 AI 모델 학습에 활용되는 것 자체를 원치 않는다는 방침이 뚜렷하다면, 정책적 판단으로 막을 수 있습니다.
여기서 중요한 것은, 이 선택이 검색 노출과 무관한 별개의 정책 결정이라는 점입니다. "막으면 손해 본다"거나 "열어두면 AI에 잘 나온다"는 식의 성과 기대를 근거로 결정하면 안 됩니다. 그 인과가 성립하지 않기 때문입니다.
한 가지 더 주의할 점. Google-Extended는 어디까지나 구글 제품군에 대한 토큰입니다. 구글 외의 다른 AI 서비스는 각자 별도의 크롤러 토큰을 두고 있어, 구글 하나만 조절한다고 모든 AI 학습이 통제되는 것은 아닙니다. "AI 학습을 전부 막았다"고 말하려면 그만큼 관리 대상이 늘어난다는 점을 알고 시작해야 합니다.
실무에서 가장 위험한 실수: Googlebot을 같이 막는 것
Google-Extended를 다루다가 실제로 사고가 나는 지점은 따로 있습니다. AI 크롤러를 막으려다 robots.txt 문법을 잘못 써서 Googlebot 자체를, 혹은 전체 크롤러를 막아버리는 경우입니다.
# 의도: AI 학습만 막기
# 사고: 전체 크롤러를 막아 검색에서 사라짐
User-agent: *
Disallow: /
User-agent: *에 Disallow: /를 걸면 이것은 AI 학습만 막는 것이 아니라 모든 크롤러의 전체 접근을 막는 설정입니다. 이 상태가 방치되면 병원 페이지가 검색에서 통째로 빠질 수 있습니다. AI 학습만 막으려는 의도였다면 대상은 정확히 Google-Extended로 좁혀야 합니다.
robots.txt와 noindex를 다룰 때 병원에서 자주 나오는 다른 실수들은 특정 페이지를 검색에서 빼는 방법 글에서 함께 정리해두었습니다. 한 줄 차이로 결과가 정반대가 되는 영역이라, 배포 전에 반드시 확인하시길 권합니다.
CodeShift가 이 문제를 보는 관점
CodeShift는 병원의 AI 검색 노출을 측정하는 도구(포도체크)를 월 3회 주기로 운영하고 있습니다(2026-08 기준). 여러 병원의 노출 상태를 반복해서 보면 한 가지가 분명해집니다.
병원의 AI 검색 노출은 "AI 크롤러를 열었느냐 막았느냐"에서 갈리지 않습니다. 크롤링이 막혀 있지 않은가, 중요한 정보가 텍스트로 제공되는가, 정보가 정확하고 최신인가 하는 검색 기본기에서 갈립니다. Google-Extended 설정은 그다음에 오는, 노출과는 다른 층위의 정책 문제입니다.
그래서 "AI에 잘 나오게 해달라"는 요청을 받으면, 저희는 크롤러 토큰부터 손대지 않습니다. 먼저 공개 페이지가 제대로 크롤링·색인되는 상태인지부터 확인합니다. AI 검색 노출을 실제로 어떻게 측정하는지는 병원 AI 검색 성과를 확인하는 법에서 더 자세히 다뤘습니다.
오늘 바로 점검할 것
원장님 병원 사이트에서 지금 바로 확인할 수 있는 항목입니다.
- robots.txt 열어보기:
우리병원도메인/robots.txt를 브라우저에 직접 쳐보세요.User-agent: *아래에Disallow: /가 있다면 전체 크롤링이 막힌 상태일 수 있으니 즉시 담당자와 확인하세요. - Google-Extended 규칙이 있는지 확인: robots.txt에
Google-Extended항목이 있다면, 그게 의도한 설정인지 점검하세요. 누군가 과거에 무심코 넣었을 수 있습니다. - 검색과 학습을 분리해서 보기: "AI 검색에서 빼고 싶다"인지 "AI 학습에서 빼고 싶다"인지 목적을 먼저 정하세요. 둘은 수단이 다릅니다(검색은
noindex·Googlebot, 학습은Google-Extended). - 핵심 정보가 텍스트인지 보기: 진료시간·위치·진료과·의료진 정보가 이미지나 스크립트 뒤가 아니라 페이지 텍스트로 보이는지 확인하세요.
- Search Console 색인 상태 확인: 주요 페이지가 '색인 생성됨' 상태인지 점검하세요. 여기서 막혀 있으면 크롤러 정책보다 이게 먼저입니다.
이 다섯 가지가 정리되면, Google-Extended를 열지 막을지는 성과가 아니라 병원의 정책으로 차분히 결정하면 됩니다. 판단이 서지 않거나 robots.txt 설정이 걱정되신다면 문의하기로 현재 상태부터 함께 점검하겠습니다.
결론
Google-Extended는 "우리 병원 글을 Gemini 학습에 쓸지"를 정하는 스위치이지, "구글 검색·AI 개요에 나올지"를 정하는 스위치가 아닙니다. Google은 이 둘이 별개임을 공식 문서에서 분명히 하고 있습니다. 막아도 검색에서 사라지지 않고, 열어둔다고 AI 검색에 특별히 더 잘 나오지도 않습니다.
그러니 "AI 크롤러를 막을까 말까"를 노출 걱정과 엮지 마세요. 노출은 검색 기본기의 문제이고, Google-Extended는 학습 참여에 대한 정책의 문제입니다. 두 질문을 분리하는 순간, 결정은 훨씬 단순해집니다.
참고 자료
- Google Search Central, "Google's Common Crawlers"(Google-Extended 항목) https://developers.google.com/crawling/docs/crawlers-fetchers/google-common-crawlers
- Google Search Central, "AI Features and Your Website" https://developers.google.com/search/docs/appearance/ai-features
- Google Search Central, "Robots Meta Tags Specifications"(nosnippet·data-nosnippet 등) https://developers.google.com/search/docs/crawling-indexing/robots-meta-tag
- Google Search Central, "Robots.txt Introduction and Guide" https://developers.google.com/search/docs/crawling-indexing/robots/intro