검색엔진이 들어오게 만드는 최소 설정
검색엔진은 발견 → 크롤 → 색인 순서로 움직입니다. 첫 단계에서 막히면 뒤는 아예 일어나지 않습니다.
가장 먼저 확인할 세 가지
의외로 사이트맵이 404인 경우가 많습니다. 검색엔진이 계속 요청하는데 없는 상태입니다.
| 항목 | 확인 방법 | 없으면 |
|---|---|---|
robots.txt | 루트에서 접속 | 크롤 정책을 못 알려줌 |
sitemap.xml | 루트에서 접속 | 페이지 발견이 늦어짐 |
| 내부 링크 | 메인에서 각 페이지로 연결 | 사이트맵보다 중요합니다 |
내부 링크가 사이트맵보다 강합니다
사이트맵은 “여기 페이지가 있습니다”라는 목록일 뿐입니다. 실제로 링크가 걸려 있어야 중요하다고 판단합니다.
이미 크롤되고 있는 메인 페이지에서 새 페이지로 링크를 거는 것이 가장 빠른 방법입니다.
페이지마다 있어야 할 것
- 고유한 title — 페이지마다 달라야 합니다
- meta description — 한국어는 80자 안팎이 보입니다
- canonical — 중복 주소 문제를 막습니다
- 구조화 데이터 — 검색 결과 표시가 풍부해집니다
- h1 하나 — 무엇에 관한 페이지인지
네이버는 따로 챙겨야 합니다
구글에 잡힌다고 네이버에 잡히는 것이 아닙니다. 네이버 서치어드바이저에 별도로 등록하고 사이트맵을 제출해야 합니다.
한국 대상 서비스라면 이걸 빠뜨리면 안 됩니다.
속도도 요소입니다
압축(gzip·brotli), HTTP/2, 캐시 설정만 해도 상당히 개선됩니다. 이미지 최적화가 대부분의 경우 가장 큰 효과를 냅니다.
발견 → 크롤 → 색인 → 순위
검색 노출은 네 단계를 거칩니다. 앞 단계가 막히면 뒤는 아예 일어나지 않습니다. 순위를 고민하기 전에 앞의 세 단계부터 확인해야 합니다.
| 단계 | 무엇이 필요한가 | 확인 방법 |
|---|---|---|
| 발견 | 링크 또는 사이트맵 | 서치콘솔 검색 결과 |
| 크롤 | robots 허용, 응답 200 | 서버 로그의 봇 기록 |
| 색인 | 고유하고 충분한 콘텐츠 | site: 검색 |
| 순위 | 관련성·신뢰도 | 실제 검색 |
서버 로그를 보면 크롤러가 실제로 오는지, 어떤 페이지를 가져가는지 알 수 있습니다. 이게 가장 정확한 확인 방법입니다.
내부 링크가 사이트맵보다 강한 이유
사이트맵은 “여기 페이지가 있습니다”라는 신고일 뿐입니다. 반면 링크는 “이 페이지가 중요합니다”라는 추천입니다.
이미 신뢰가 쌓인 페이지에서 링크를 받으면 그 신뢰의 일부가 전달됩니다. 그래서 메인 페이지에서 링크를 거는 것이 가장 효과가 큽니다.
- 메인에서 주요 페이지로 링크
- 글에서 관련 글로 링크
- 카테고리 페이지로 묶기
- 고아 페이지가 없는지 확인 — 어디서도 링크되지 않는 페이지
페이지별 필수 요소 점검표
| 요소 | 기준 | 흔한 실수 |
|---|---|---|
| title | 페이지마다 고유, 검색어 포함 | 전 페이지 동일 |
| meta description | 한국어 80자 안팎 | 비어 있음 |
| canonical | 정규 주소 지정 | 누락 또는 잘못된 주소 |
| h1 | 페이지당 하나 | 여러 개 또는 없음 |
| 구조화 데이터 | 콘텐츠 유형에 맞게 | 문법 오류 |
| alt 속성 | 이미지 설명 | 비어 있음 |
네이버는 별도로 챙겨야 합니다
구글에 잡힌다고 네이버에 잡히는 것이 아닙니다. 크롤러도 다르고(Yeti) 평가 방식도 다릅니다.
한국 대상 서비스라면 네이버 서치어드바이저 등록이 필수입니다. 등록하지 않으면 크롤 자체가 거의 오지 않는 경우가 있습니다.
- 서치어드바이저에서 사이트 소유확인
- 사이트맵 제출
- robots.txt 확인
- 수집 요청으로 주요 페이지 개별 요청
- 웹마스터 도구에서 수집 현황 주기적 확인
AI 검색 대응
ChatGPT·Perplexity 같은 AI가 답변에 인용할 때는 구조가 명확한 글을 선호합니다. 전통 SEO와 겹치는 부분이 많지만 강조점이 조금 다릅니다.
- 질문 형태의 소제목과 그 아래 명확한 답
- 표와 목록 — 비교·나열은 문단보다 인용되기 쉽습니다
- FAQ 구조와 FAQPage 구조화 데이터
- 출처와 근거를 밝힌 서술
- 최신 날짜 표기
AI 크롤러(GPTBot, ClaudeBot 등)를 robots.txt에서 차단하지 않았는지도 확인해야 합니다. 차단하면 인용 대상에서 빠집니다.
속도 — 무엇부터 고칠까
| 항목 | 효과 | 난이도 |
|---|---|---|
| 이미지 최적화·지연 로딩 | 가장 큼 | 낮음 |
| 압축(gzip/brotli) | 큼 | 낮음 |
| 캐시 헤더 | 재방문에 큼 | 낮음 |
| 불필요한 스크립트 제거 | 큼 | 중간 |
| HTTP/2·3 | 중간 | 낮음 |
| CDN | 지역에 따라 큼 | 중간 |
대부분의 사이트에서 이미지가 용량의 70% 이상을 차지합니다. 여기부터 손보는 것이 효율적입니다.