구글 검색에 우리 가게 홈페이지가 있는지 확인하는 법
요점
- 구글 검색창에
site:가게주소를 넣으면 색인에 든 페이지가 나온다. 어떤 페이지가 왜 빠졌는지는 나오지 않는다. - 빠진 이유는 구글 서치 콘솔(무료)의 URL 검사와 페이지 색인 생성 보고서에 나온다.
- 구글 도움말은 색인 생성 요청 뒤 보통 하루쯤, 길면 1~2주가 걸리며 요청한 페이지가 색인에 오르지 않을 수도 있다고 적었다.
- 구글 AI 개요와 AI 모드도 같은 검색 색인에서 문서를 찾는다. 색인에 없는 홈페이지는 구글의 인공지능 답에도 쓰이지 않는다.
색인은 검색 결과의 재료 목록이다
구글은 검색이 크롤링, 색인 생성, 검색결과 게재의 세 단계로 돌아간다고 설명한다. 로봇이 페이지를 가져가고, 구글이 그 페이지를 분석해 색인이라는 목록에 올리고, 누군가 검색하면 그 목록에서 결과를 골라 보여 준다. 가게 홈페이지가 구글 검색에 나오려면 먼저 색인에 올라 있어야 한다. 구글은 색인에 없는 페이지를 검색 결과의 후보로 삼지 않는다.
구글의 AI 개요와 AI 모드도 이 색인을 쓴다. 구글이 2026년 5월 낸 생성형 AI 안내서에 따르면 두 기능은 기존 검색의 핵심 순위 시스템으로 문서를 찾아온다. 색인에 없는 홈페이지는 구글의 인공지능 답에도 쓰이지 않는다.
1단계: site: 검색으로 훑어보기
- 구글 검색창에
site:뒤에 가게 홈페이지 주소를 붙여 넣는다. 예를 들어site:example.com이다. - 결과로 나온 페이지들이 구글 색인에 든 페이지다. 첫 화면, 메뉴, 오시는 길처럼 있어야 할 페이지가 목록에 있는지 확인한다.
- 결과가 하나도 없으면 그 주소로 색인에 든 페이지는 없다.
같은 연산자를 빙과 네이버에서도 쓸 수 있다. 세 검색엔진의 색인은 서로 따로 만들어지므로 구글에 있다고 빙이나 네이버에도 있다는 보장은 없다.
site: 검색은 색인에 든 페이지를 훑어보는 데까지만 쓸 수 있다. 메뉴 페이지가 목록에 없을 때 그 페이지가 왜 빠졌는지는 site: 검색 화면에 나오지 않는다.
2단계: 서치 콘솔의 URL 검사로 이유 보기
구글 서치 콘솔은 사이트 주인에게 무료로 열린 관리 도구다. 사이트를 등록하고 소유를 확인해야 쓸 수 있다. 등록 절차는 구글 서치 콘솔에 등록하고 사이트맵을 내는 법에 적었다.
- 서치 콘솔 맨 위의 검사 창에 확인할 페이지의 전체 주소를 붙여 넣는다.
- 결과 맨 위에 그 주소가 구글 검색결과에 나올 수 있는지에 관한 요약이 나온다.
- 「크롤링된 페이지 보기」를 누르면 구글이 받아 간 HTML과 HTTP 응답이 나온다. 화면에 보이던 가게 이름과 메뉴가 이 HTML에 없으면 홈페이지가 기계에게 빈 종이인지 확인하는 법으로 넘어간다.
- 「실제 URL 테스트」는 지금 이 순간의 페이지를 가져와 색인될 수 있는지 시험한다. 고친 직후에는 이 버튼으로 확인한다.
- 고친 페이지를 다시 읽어 가게 하려면 「색인 생성 요청」을 누른다.
구글 도움말은 색인 생성 요청에 조건을 여럿 달았다. 보통 하루쯤 걸리지만 1~2주까지 걸릴 수 있고, 요청해도 색인에 오르지 않을 수 있으며, 하루에 요청할 수 있는 수에 한도가 있다. 페이지가 많으면 사이트맵을 내라고 권한다.
색인 생성 요청은 대기열에 주소를 올리는 일이다. 대행사가 「색인 요청을 했다」고 보고했는데 글이 검색되지 않는 경우가 있다. 요청은 들어갔지만 구글이 그 페이지를 색인에 넣지 않았다. 보고서에 요청 날짜만 있고 색인 상태가 없으면 무엇이 됐는지 알 수 없다.
3단계: 페이지 색인 생성 보고서의 상태 읽기
서치 콘솔 왼쪽 메뉴의 페이지 색인 생성 보고서는 사이트 전체 페이지를 색인된 것과 안 된 것으로 나누고, 안 된 페이지에 이유를 붙인다. 가게 홈페이지에서 자주 보는 문구와 구글 도움말의 설명은 이렇다.
| 보고서 문구 | 구글 도움말의 설명 | 먼저 볼 곳 |
|---|---|---|
| 발견됨 - 현재 색인이 생성되지 않음 | 주소는 알지만 아직 가져가지 않았다. 사이트에 과부하가 걸릴 수 있어 크롤링 일정을 바꾼 경우가 많다 | 서버 응답 속도, 페이지 수 |
| 크롤링됨 - 현재 색인이 생성되지 않음 | 가져가 읽었지만 색인에 넣지 않았다. 나중에 들어갈 수도, 끝내 안 들어갈 수도 있다 | 내용이 얇은지, 비슷한 페이지가 이미 있는지 |
| URL이 robots.txt에 의해 차단됨 | 로봇 배제 파일이 이 주소를 막았다 | robots.txt |
| 중복 페이지, Google에서 사용자와 다른 표준 URL을 선택함 | 주인이 표준으로 표시한 주소 대신 구글이 다른 주소를 골랐다 | http와 https, www 유무, 끝의 / |
| 적절한 표준 태그가 포함된 대체 페이지 | 다른 표준 페이지의 대체로 제대로 연결돼 있다 | 도움말은 조치가 필요 없다고 적었다 |
| 리디렉션이 포함된 페이지 | 다른 주소로 넘어가는 주소라 색인하지 않는다 | 넘어간 주소가 색인됐는지 |
| 찾을 수 없음(404) | 요청했더니 페이지가 없었다 | 지운 페이지로 가는 링크 |
| 서버 오류 | 구글봇이 접속하지 못했거나 시간이 초과됐다 | 호스팅 상태 |
「크롤링됨 - 현재 색인이 생성되지 않음」이 사이트 전체에 넓게 퍼져 있으면 페이지 하나하나보다 사이트 전체의 내용과 구조를 봐야 한다. 구글 도움말은 두 「현재 색인이 생성되지 않음」 상태 모두 크롤링을 위해 주소를 다시 제출할 필요는 없다고 적었다.
로봇이 페이지를 가져가지 못하는 경우
- 로봇 배제 파일이 막고 있다. 제작 업체가 개발 중에 넣어 둔
User-agent: *와Disallow: /두 줄이 공개 뒤에도 남아 있으면 사이트 전체가 막힌다. 주소 뒤에/robots.txt를 붙여 열면 누구나 확인할 수 있다. - 링크가 없다. 로봇은 링크를 따라 주소를 안다. 구글은
href속성이 있는<a>요소만 링크로 알아본다고 문서에 적었다. 누르면 화면만 바뀌는 단추로 메뉴 페이지를 연결한 홈페이지에서는 로봇이 메뉴 페이지의 주소를 알 길이 없다. - 원본 파일에 텍스트가 없다. 화면은 멀쩡한데 서버가 보내는 파일에는 실행 명령만 있는 경우다. 구글은 명령을 나중에 실행해 보지만 그 대기가 길어지거나 실패하면 페이지는 빈 채로 남는다.
세 경우 모두 무료로, 몇 분 안에 확인할 수 있다.