내가 만든 사이트에서 콘텐츠가 사람들에게 잘 도달하는 일은 중요하다. 특히 검색 엔진 최적화가 중요하다. 네이버 블로그, 네이버 카페의 경우 네이버 가두리이기 때문에 글로벌 도달과 검색에서 문제가 된다. 좋은 콘텐츠는 더 많이 바이럴 되는 것이 중요하다. 그것이 바로 구글과 같은 검색 엔진이 원하는 것이다. vibequant.cc의 검색엔진 최적화를 진행하면서 다음 절차를 정리했다.

항목 내용
대상 vibequant.cc 및 하위 도메인(docs / tech / play / cti)
인프라 전제 Cloudflare DNS + Cloudflare Pages 계열 정적 호스팅, 다중 서브도메인, 한/영/중/일 다국어 아카이브
기준 시점 2026년 7월
근거 Google Search Central 공식 문서·블로그, 네이버 서치어드바이저, IndexNow 규격, Cloudflare 공식 문서
목표 검색엔진과 AI 검색·에이전트가 동일한 기반에서 잘 읽는 사이트를 만드는 실무 절차 확립

서론: 세 줄 요약

  1. AI 검색을 위한 별도 인덱스나 별도 제출 절차는 존재하지 않는다. 구글은 AI 기능에 노출되려면 먼저 일반 검색에 색인되고 스니펫 표시 자격이 있어야 한다고 명시했다. 따라서 SEO와 AI 가독성은 별개 과업이 아니라 같은 과업의 두 측면이다.
  2. 작업 순서를 틀리면 비용이 커진다. 등록·제출보다 인프라 점검이 먼저다. 잘못된 상태로 색인되면 되돌리는 데 수 주가 걸린다.
  3. 한국어 콘텐츠 사이트가 구글만 최적화하는 것은 절반을 버리는 선택이다. 네이버·빙 채널과 IndexNow는 Cloudflare 환경에서 거의 무료로 확보된다.

1. 전체 절차 개요

Phase 목적 소요 산출물
1 인프라 정합성 점검 1~2일 정규화·응답코드·미리보기 도메인 정리 완료
2 속성 등록과 소유권 확인 1일 GSC 도메인 속성 + 호스트별 접두어 속성
3 크롤링·색인 파이프라인 구축 2~3일 robots.txt, 사이트맵 인덱스, 제출 완료
4 온페이지 최적화 1~2주 Title/Meta/canonical/구조화 데이터/hreflang
5 AI 가독 구조 확립 1~2주 시맨틱 구조, 엔티티 선언, AI 노출 정책
6 국내·기타 검색 채널 확장 2~3일 네이버·빙 등록, IndexNow 자동화
7 측정 체계 구축 지속 주간·월간 점검 루틴, 데이터 백업 자동화

Phase 1을 건너뛰고 2로 가지 말 것. 이것이 이번 작업에서 가장 값비싸게 배운 부분이다. 미리보기 도메인이 색인되거나 SPA 폴백이 200을 반환하는 상태로 사이트맵을 제출하면, 구글은 그 상태를 학습한 뒤 정정에 수 주를 쓴다.


2. Phase 1 — 인프라 정합성 점검 (Cloudflare 정적 호스팅)

정적 호스팅에서 색인 문제의 대부분은 콘텐츠가 아니라 배포 설정에서 발생한다. 등록 전에 아래를 전수 확인한다.

점검 항목 확인 방법 방치 시 증상
미리보기 배포 도메인(*.pages.dev) 색인 site:pages.dev 검색, 해당 URL 응답 헤더 확인 프로덕션과 동일 콘텐츠 중복 색인. 정규 URL 판정 혼란
trailing slash 일관성 /path/path/ 양쪽 접근 동일 콘텐츠 2개 URL. 신호 분산
www 처리 www.vibequant.cc 접근 미처리 시 중복 호스트
404 응답 코드 존재하지 않는 URL의 HTTP 상태 SPA 폴백이 200을 반환하면 soft 404 대량 발생
_headers 파일 저장소 직접 확인 스테이징용 X-Robots-Tag: noindex가 프로덕션에 남으면 전면 색인 차단 사고
Bot Fight Mode / WAF 규칙 Cloudflare Security 설정 과도한 봇 차단이 정상 크롤러를 막음
SSL/TLS 모드 Cloudflare SSL/TLS 설정 Flexible은 리디렉션 루프·혼합 콘텐츠 원인. Full (strict) 권장

조치 지침

  • 미리보기 배포에는 X-Robots-Tag: noindex 헤더를 적용하거나 Cloudflare Access로 접근을 제한한다.
  • URL 형태(trailing slash, www)는 하나로 정하고 나머지는 301로 통일한 뒤, 전 페이지에 자기 참조 canonical을 명시한다.
  • Always Use HTTPS와 Automatic HTTPS Rewrites를 켠다. HSTS는 정책이 확정된 뒤에 적용한다. 되돌리기 어렵다.
  • _headers로 인한 전면 noindex는 되돌린 뒤에도 색인 회복에 수 주가 걸린다. 배포 전 확인 항목으로 고정한다.

3. Phase 2 — 속성 등록과 소유권 확인

3.1 속성 유형

유형 포괄 범위 소유권 확인 수단 판단
도메인 속성(vibequant.cc) 모든 하위 도메인 + http/https + www 유무 전체 DNS TXTonly 필수
URL 접두어 속성(https://docs.vibequant.cc/) 해당 접두어 하위만 HTML 파일, 메타 태그, GA, GTM, DNS 병행 권장

3.2 Cloudflare DNS에서 소유권 확인

  1. GSC에서 도메인 속성 추가 → 제공된 TXT 값 복사
  2. Cloudflare Dashboard → 해당 존 → DNS → Records → Add record
    • Type TXT / Name @ / Content google-site-verification=...
  3. GSC에서 확인 클릭 (Cloudflare DNS 전파는 통상 수 분)

TXT 레코드를 삭제하면 소유권이 해제된다. 인증 후에도 영구 보존한다.


4. Phase 3 — 크롤링·색인 파이프라인

4.1 robots.txt

호스트별로 각각 필요하다. 정적 사이트라면 각 프로젝트의 public/robots.txt에 배치한다.

User-agent: *
Allow: /

Sitemap: https://docs.vibequant.cc/sitemap.xml

Sitemap: 지시자는 구글·빙·네이버가 공통으로 읽는 표준 채널이다. GSC 제출과 별도로 반드시 넣어둔다.

4.2 사이트맵 구조 (하위 도메인 다중 운영)

사이트맵은 원칙적으로 자신이 위치한 호스트의 URL만 포함해야 한다. 따라서 다음 구조가 안전하다.

https://vibequant.cc/sitemap.xml          <- 사이트맵 인덱스
  ├─ https://vibequant.cc/sitemap-main.xml
  ├─ https://docs.vibequant.cc/sitemap.xml
  ├─ https://tech.vibequant.cc/sitemap.xml
  ├─ https://play.vibequant.cc/sitemap.xml
  └─ https://cti.vibequant.cc/sitemap.xml
  • 인덱스가 타 호스트 사이트맵을 참조하는 교차 제출은 참조 대상 호스트의 소유권이 확인되어 있을 때 유효하다. 3.1절대로 도메인 속성을 등록해두면 하위 도메인 전체 소유권이 확보되므로 이 구조가 성립한다.
  • 각 호스트의 robots.txt에는 자기 호스트 사이트맵을 명시한다.
  • <lastmod>는 실제 콘텐츠 수정 시각만 기입한다. 빌드마다 전체를 현재 시각으로 갱신하면 신호 자체가 무시된다. 정적 사이트 생성기의 기본 동작이 이 실수를 유발하므로 반드시 확인한다.
  • 사이트맵에는 최종 URL만 담는다. 리디렉션 대상이 섞이면 색인 보고서에 페이지에 리디렉션 있음이 쌓인다.
  • 단일 사이트맵 상한은 URL 50,000개 / 비압축 50MB. CTI 아카이브 증가 시 분할 기준으로 기억해둔다.

4.3 URL 검사와 색인 생성 요청

  • URL 검사로 색인 상태, 정규 URL 판정, 크롤링 시점, 구조화 데이터 인식 여부를 개별 확인한다.
  • 색인 생성 요청은 일일 할당량이 있고, 요청이 색인이나 순위를 보장하지 않는다. 신규 발행 시 1건씩 쓰는 도구다.
  • 다량 URL의 발견은 사이트맵과 내부 링크가 담당한다. 이 원칙을 뒤집지 말 것.

4.4 쓰지 말아야 할 채널 두 가지

채널 현재 상태 조치
사이트맵 ping (google.com/ping?sitemap=) 2023년 6월 폐기 예고, 2024년 1월부터 404 CI/CD·배포 스크립트에서 제거. robots.txt + GSC로 충분
Google Indexing API 폐기는 아니나 JobPostingBroadcastEvent 전용 일반 문서·칼럼에는 사용 불가. 이 API로 블로그를 색인시킨다는 가이드는 근거 없음

5. Phase 4 — 온페이지 최적화

5.1 사이트 구조와 내부 링크

하위 도메인은 크롤러 관점에서 각각 별개의 사이트에 가깝다. 도메인 속성으로 묶어도 이 사실은 변하지 않는다.

  • 루트(vibequant.cc)를 허브로 두고 4개 하위 도메인 대표 섹션으로 명시적 링크를 건다.
  • 각 하위 도메인에서 루트로 돌아오는 글로벌 내비게이션을 공통 배치한다.
  • 콘텐츠 간 상호 인용(CTI 리포트 → 관련 기술 문서, 칼럼 → 근거 데이터)을 본문 링크로 연결한다. 신규 페이지 발견 경로로 가장 잘 작동한다.
  • 주요 섹션(/essays, /lab, /research, /about)은 루트에서 2클릭 이내에 도달 가능해야 한다.

5.2 Title / Meta / Canonical

요소 기준
Title 60자 내외(한글 30자 내외). 페이지 고유 주제 + 사이트명. 파일명 기반 자동 생성 제목이 남아 있는지 전수 점검
Meta Description 순위 요소는 아니되 CTR에 직접 작용. 페이지마다 고유하게 작성
H1 페이지당 1개. Title과 완전히 동일할 필요는 없음
Canonical 자기 참조 canonical을 전 페이지에 명시. 정적 빌드에서 누락되기 쉬움
OG / Twitter Card 순위 요소는 아니되, SNS가 주 유입 경로라면 우선순위 높음

5.3 구조화 데이터

  • Article 또는 TechArticle: headline, datePublished, dateModified, author
  • Organization: 루트 페이지 1회. sameAs에 GitHub·ORCID·ETNews 필자 페이지·SSRN 저자 페이지 명시
  • Person: 저자 프로필에 ORCID를 identifier로 포함
  • BreadcrumbList: 하위 도메인 계층 구조 전달

리치 결과 테스트로 검증한 뒤 GSC 구조화 데이터 보고서에서 인식 여부를 재확인한다.

5.4 성능

모바일 우선 색인이 적용되므로 점검 필요성은 유지되지만, 점검 도구가 바뀌었다. GSC의 모바일 사용성 보고서와 모바일 친화성 테스트 도구·API는 2023년 12월 1일 종료됐다.

도구 성격
PageSpeed Insights 실측(CrUX) + 실험실(Lighthouse) 동시 확인
Chrome DevTools Lighthouse 로컬 실험실 측정, 접근성·SEO 감사 포함
GSC Core Web Vitals 실사용자 데이터 기반 사이트 전체 추세

정적 호스팅이면 대개 양호하나, play 서브도메인처럼 스크립트가 무거운 곳은 INP를 별도로 확인한다.

5.5 다국어(hreflang)

hreflang은 언어별 URL이 분리되어 있을 때만 의미가 있다. 한 페이지에 한국어와 영어가 섞여 있는 상태에서는 적용 대상이 아니다. 언어별 URL 체계 정리가 선행 조건이다.

<link rel="alternate" hreflang="ko" href="https://cti.vibequant.cc/ko/report-001" />
<link rel="alternate" hreflang="en" href="https://cti.vibequant.cc/en/report-001" />
<link rel="alternate" hreflang="ja" href="https://cti.vibequant.cc/ja/report-001" />
<link rel="alternate" hreflang="zh" href="https://cti.vibequant.cc/zh/report-001" />
<link rel="alternate" hreflang="x-default" href="https://cti.vibequant.cc/en/report-001" />
  • 상호 참조 필수. A가 B를 가리키면 B도 A를 가리켜야 하며, 자기 자신도 포함한다.
  • x-default를 반드시 지정한다.
  • 4개 언어로 CTI 리포트를 발행하는 구조라면 실익이 크다.

6. Phase 5 — AI가 잘 읽는 웹사이트 만들기

6.1 출발점: AI 노출에 별도 인덱스는 없다

구글 공식 문서의 핵심 진술은 다음과 같다.

  • AI Overviews와 AI Mode는 일반 검색 인덱스를 사용한다. Googlebot이 크롤링한 내용이 원천이다.
  • 페이지가 AI 기능에 나타나려면 먼저 색인되어 있고 스니펫 표시 자격이 있어야 한다.
  • 별도의 AI 인덱스도, 별도의 제출 절차도 없다. AI 기능 노출을 위한 추가 요구사항은 존재하지 않는다.
  • 새로운 기계 판독용 파일, AI 전용 마크업, Markdown 버전, 콘텐츠 청킹, AI 전용 리라이팅은 모두 불필요하다.

따라서 "AI 최적화"라는 별도 작업 라인을 만들 필요가 없다. Phase 1~4가 곧 AI 최적화다. 그 위에 얹을 것은 기법이 아니라 문서 구조의 규율이다.

6.2 문서 구조 규율 여덟 가지

AI가 콘텐츠를 인용하려면 사실 단위를 추출할 수 있어야 한다. 실제로 효과가 있었던 것은 아래와 같은 평범한 항목들이다.

# 규율 이유
1 서버에서 완성된 HTML을 제공한다 클라이언트 JS 렌더링에 의존하면 크롤러·에이전트별로 읽히는 정도가 달라진다. 정적 생성이 최선
2 제목 계층을 의미대로 쓴다 h1 1개, h2·h3가 실제 논리 구조와 일치. 스타일 목적의 제목 태그 사용 금지
3 1주제 1URL 한 페이지에 여러 주제를 몰아넣으면 어느 쿼리에도 정확히 대응하지 못한다
4 결론을 앞에 놓는다 문서 상단 2~3문장 요약이 인용 단위로 그대로 쓰인다. 서론을 길게 쓰는 학술 관행이 여기서는 불리하게 작동한다
5 표와 정의 목록을 쓴다 비교·수치·분류는 산문보다 표가 정확히 추출된다. 표에는 캡션이나 선행 문장으로 문맥을 붙인다
6 모든 섹션에 앵커 ID를 부여한다 인용 시 페이지 단위가 아니라 섹션 단위로 참조된다
7 날짜·저자·출처를 본문에 명시한다 datePublished/dateModified와 본문 표기를 일치시킨다. CTI 리포트의 TLP 등급·신뢰도 평가는 그 자체로 강한 신뢰 신호다
8 이미지 안의 정보를 텍스트로 중복 제공한다 차트만 있고 수치가 텍스트에 없으면 그 데이터는 읽히지 않는다. alt와 캡션, 또는 본문 표로 병기

추가로, PDF보다 HTML을 1차 형식으로 둔다. 논문·리포트를 PDF로만 배포하면 색인 품질과 인용 가능성이 함께 떨어진다. HTML 본문을 정본으로 두고 PDF를 부가 다운로드로 제공하는 편이 낫다.

6.3 엔티티를 명시적으로 선언한다

AI 답변은 개별 페이지가 아니라 주체(엔티티) 단위로 신뢰를 축적한다. 동명 조직·패키지가 존재하는 상황에서는 특히 중요하다(9장 참조).

  • Organization·Person 스키마의 sameAs에 GitHub, ORCID, SSRN 저자 페이지, ETNews 필자 페이지를 모두 연결한다.
  • /about 페이지에 경력·전문 분야·발행 채널을 산문으로 명시한다. 스키마만으로는 부족하다.
  • 저자 표기를 전 채널에서 동일 문자열로 통일한다. 표기가 갈리면 엔티티가 쪼개진다.

6.4 AI 노출 통제 수단 세 가지 — 혼동 주의

이 세 가지는 자주 뒤섞여 설명되지만 전혀 다른 것을 통제한다.

수단 통제 대상 일반 검색 영향 AI Overviews / AI Mode 노출 영향
GSC 설정 → Search generative AI 토글 생성형 AI 기능에서의 노출과 근거 활용 없음 (구글이 순위 신호로 쓰지 않는다고 명시) 옵트아웃 시 노출·트래픽 0
robots.txt Google-Extended Gemini 계열 모델 학습 및 Gemini 앱 그라운딩 없음 없음. AI Overviews는 일반 검색 인덱스를 쓰므로 차단해도 노출은 유지된다
nosnippet / max-snippet / data-nosnippet 스니펫으로 보여줄 수 있는 텍스트 범위 있음. 일반 검색 스니펫도 함께 사라진다 AI 기능 노출 억제에 작용
(noindex) 색인 자체 검색에서 완전 제거 당연히 제거

가장 흔한 오류는 Google-Extended를 차단하면 AI Overviews에서 빠진다고 믿는 것이다. 그렇지 않다. 학습과 실시간 그라운딩은 다른 문제다.

정책 결정 시 유의점: 원문 열람을 중시해 nosnippet을 쓰면 일반 검색 CTR이 함께 무너진다. TLP:GREEN·CC BY-NC-SA로 배포하는 아카이브라면 확산 우선인지 원문 열람 우선인지 먼저 정하고, 노출 데이터를 몇 주 관찰한 뒤 결정하는 것이 합리적이다.

6.5 llms.txt의 실제 위치

목적을 구분해서 판단해야 한다.

목적 유효성
Google Search / AI Overviews 순위·가시성 무효. 구글이 2026년 6월 공식 문서에 사용하지 않으며 순위에 긍정·부정 영향이 없음을 명시
Claude, Perplexity 등 일부 AI 검색의 문서 탐색 유효하다는 관측 존재
코딩 에이전트(Cursor, Copilot 등)의 문서 참조 실질적 유효. Stripe·Cloudflare·Anthropic 등이 이 목적으로 발행

결론: docs.vibequant.cc처럼 도구·API 문서를 제공하는 서브도메인에는 발행 가치가 있고, 칼럼·CTI 아카이브에 SEO 목적으로 발행할 이유는 없다. 한 2026년 조사에서는 30만 도메인 중 채택률이 약 10%, 발행된 파일 대다수가 실제로 조회되지 않은 것으로 보고됐다. 발행하려면 에이전트용 문서 인덱스로서 실제 유용성을 갖추도록 작성해야 한다.

6.6 Cloudflare의 AI 크롤러 정책 — 2026년 9월 15일 기본값 변경

Cloudflare 사용자는 이 일정을 알고 있어야 한다.

사항 내용
변경 시점 2026년 9월 15일
내용 검색·에이전트·학습 용도를 분리하지 않는 "혼용(mixed-use)" 크롤러를 광고가 있는 페이지에서 기본 차단
적용 대상 신규 고객, 기존 고객의 신규 사이트, 기존 무료 요금제 고객 전체
과금 모델 Pay Per Crawl → Pay Per Use로 전환. 크롤링 시점이 아니라 AI 답변에 실제로 사용될 때 지급

vibequant.cc는 광고를 게재하지 않으므로 기본 차단 대상 조건에는 해당하지 않을 가능성이 높다. 다만 무료 요금제 기본값 전환 대상에 포함되므로, 9월 15일 전에 현재 설정을 확인해두는 편이 안전하다.

병행해서 AI Crawl Control(구 AI Audit)을 확인한다. 전 요금제에서 설정 없이 동작하며, 어떤 AI 서비스가 어떤 빈도로 접근하는지, robots.txt 지시를 실제로 준수하는지 대시보드에서 볼 수 있다. AI 경유 노출을 관리하려는 입장에서는 차단 도구이기 전에 관측 도구로서 가치가 크다.

주의: AI 크롤러를 광범위하게 차단하면 AI 검색 경유 인용과 유입도 함께 사라진다. 크롤링 대비 리퍼럴 비율이 나쁜 것은 사실이지만, 인용 노출 자체에 가치를 두는 아카이브라면 전면 차단은 자기 목적에 반한다.


7. Phase 6 — 국내 및 기타 검색 채널

7.1 네이버 서치어드바이저

  1. searchadvisor.naver.com → 웹마스터 도구
  2. 사이트 등록 (호스트별로 각각. 네이버에는 도메인 속성 개념이 없다)
  3. 소유 확인: HTML 파일 업로드 또는 메타 태그. HTML 태그 방식은 재인증이 필요할 수 있으므로 만료일을 확인한다
  4. 요청 → 사이트맵 제출RSS 제출. RSS가 있으면 수집 속도가 유의미하게 빨라진다
  5. 검증 → 웹 페이지 최적화, robots.txt 진단 활용

www와 non-www를 동시에 등록하지 말 것. 네이버는 별개 사이트로 취급하며 신호가 분산된다. 등록 후 실제 노출까지 통상 1~4주가 걸린다.

7.2 빙 웹마스터 도구

GSC에서 속성 임포트가 가능하므로 설정 부담이 거의 없다. 일부 AI 검색이 빙 인덱스를 참조하는 구조이므로 규모 대비 우선순위가 높다.

7.3 IndexNow

항목 내용
지원 Bing, Naver(2023년 7월부터), Yandex, Seznam, Yep 등
미지원 Google
효과 크롤러 방문을 기다리지 않고 변경 즉시 통보. 한 곳에 알리면 참여 엔진에 공유

Cloudflare 사용자에게 가장 저렴한 경로는 Crawler Hints다. Cloudflare는 2021년부터 Crawler Hints로 IndexNow를 네이티브 지원하며, 대시보드에서 켜면 캐시된 콘텐츠 변경 시 CDN 레이어에서 자동 통보한다. 코드 작업이 없다.

전제 조건: 해당 도메인이 Cloudflare 프록시(오렌지 클라우드)를 경유해야 한다. DNS-only 상태면 Cloudflare가 트래픽을 보지 못하므로 동작하지 않는다. 이 경우 배포 후 사이트맵을 읽어 IndexNow 엔드포인트로 POST하는 Worker가 대안이다.

7.4 다음(카카오)

다음 검색등록과 웹마스터 도구는 별도 절차이며 robots.txt 수정이 요구된다. 트래픽 기여도를 감안해 우선순위는 마지막에 둔다.


8. Phase 7 — 측정 체계

8.1 성과(Performance) 보고서

기능 용도
쿼리 그룹(Query Groups) 유사 검색어를 묶어 주제 단위 성과 파악. 롱테일이 흩어진 기술 문서 사이트에 효과적
브랜드 / 비브랜드 필터 브랜드 검색과 주제 검색 분리. 9장 진단에 필수
24시간(시간별) 뷰 신규 발행 직후 유입 확인, SNS 공유 효과 측정
Recommendations GSC 자동 제안. 참고용이며 우선순위는 직접 판단

8.2 페이지 색인 생성(Page indexing) 보고서

확인 순서와 해석:

  1. 색인 생성됨 페이지 수가 사이트맵 제출 URL 수와 벌어지는 폭
  2. 색인이 생성되지 않음 사유별 판독
    • 크롤링됨 - 현재 색인이 생성되지 않음: 품질·중복 판정. 콘텐츠 문제이며 기술적 수정으로 해결되지 않는다
    • 대체 페이지(적절한 정규 태그 있음): 정상. 변형 URL이 정리되고 있다는 신호
    • 페이지에 리디렉션 있음: 사이트맵에 리디렉션 대상이 들어간 경우
  3. 사이트맵 보고서에서 각 하위 도메인 사이트맵의 읽기 성공 여부

8.3 생성형 AI 성과 보고서

2026년 6월 3일 도입됐다. AI Overviews, AI Mode, Discover의 생성형 AI 영역에서 자사 URL이 노출된 횟수를 별도 뷰로 제공한다.

사항 내용
제공 지표 노출수만. 클릭·CTR·쿼리 없음
분할 기준 페이지 / 국가 / 기기 / 날짜(시간~월 단위)
데이터 시작 2026년 5월 18일경. 소급 이력 없음
롤아웃 영국 일부 사이트 시작 → 순차 확대(6월 23일 확대). 국내 계정에서 아직 보이지 않을 수 있음
총계 영향 없음. 기존 성과 보고서에 포함돼 있던 데이터를 분리 표시하는 것

클릭 데이터가 없으므로 "노출은 늘었는데 클릭이 정체"인 구간의 원인을 이 보고서만으로 단정할 수 없다. 노출 추세와 실제 유입을 병렬로 보되, 인과 판단은 보류하는 것이 맞다.

8.4 그 외 보고서

  • Core Web Vitals: 실사용자(CrUX) 기반 추세
  • HTTPS: 혼합 콘텐츠·비HTTPS 페이지 탐지 (2022년 9월부터 제공되는 상시 보고서)
  • robots.txt 보고서: 호스트별 인식 상태와 오류
  • 구조화 데이터 / 리치 결과: 5.3절 적용 후 검증
  • 크롤링 통계(설정 하위): 응답 시간, 상태 코드 분포. Phase 1의 WAF 과차단 여부를 여기서 확인

8.5 데이터 보존과 백업

  • 성과 보고서 보존 기간은 16개월이다. 그 이상은 조회할 수 없다.
  • 장기 추적이 필요하면 BigQuery 대량 데이터 내보내기 또는 Search Console API로 정기 백업한다. 후자는 GitHub Actions 스케줄 잡으로 저비용 구현이 가능하다.
  • 개인정보 보호 임계값 미달 쿼리는 표시되지 않으므로, 쿼리 합계와 총계 불일치는 정상이다.

8.6 Cloudflare 지표와 교차 검증

GSC는 검색 노출·클릭을, Cloudflare Web Analytics는 실제 도착 트래픽을 본다. 두 수치의 괴리 자체가 정보다.

패턴 해석
GSC 클릭 ≫ CF 세션 측정 스크립트 누락, 또는 즉시 이탈
GSC 노출 증가 · 클릭 정체 Title·Description 문제, 또는 AI 요약이 클릭을 흡수
CF 트래픽 존재 · GSC 데이터 없음 검색 외 유입(SNS, 직접, GitHub 레퍼러)이 주 경로

세 번째 패턴이 초기 상태일 가능성이 높다. 그렇다면 SEO는 기존 유입을 개선하는 작업이 아니라 새 채널을 여는 작업이며, 성과 판단 시점을 그만큼 뒤로 잡아야 한다.


9. 진행 중 확인한 브랜드 엔티티 문제

vibequant 키워드 검색 결과 상위는 다음이 점유하고 있다.

경합 대상 성격
vibequant.com 음악 산업 데이터 사이언스 컨설팅 기업 (동명, .com 보유)
vibequant (PyPI / GitHub) 금융 데이터 분석용 Python 패키지
github.com/vibequant 동명 GitHub 조직

같은 검색에서 vibequant.cc 자체는 나타나지 않았다. 색인이 아직 형성되지 않은 상태로 보이며, Phase 1~3이 최우선 과제라는 근거가 된다.

전략적 함의:

  1. 브랜드 단독 키워드를 KPI로 삼지 않는다. .com 동명 기업이 자리를 잡고 있고 패키지 이름이 개발자 검색 의도를 흡수한다.
  2. 엔티티를 구조적으로 분리한다. 6.3절의 sameAs 연결이 여기서 직접 효과를 낸다.
  3. 주제 롱테일이 실질적 유입 경로다. "토큰 언락 72시간 충격", "Kimsuky APT43", "MCP 보안 구조", "CEX HFT 인프라 한계" 같은 구체 주제어에는 경합자가 없다. Title·H1·내부 링크를 이쪽에 집중한다.
  4. 비브랜드 노출 증가만 초기 지표로 삼는다. 브랜드 필터로 두 흐름을 분리 측정한다.

10. 흔히 잘못 알려진 것들

작업 중 확인한 결과, 국내외 가이드에서 여전히 반복되는 잘못된 정보다.

통용되는 설명 실제
GSC에서 모바일 사용성을 점검하라 모바일 사용성 보고서·모바일 친화성 테스트 도구·API는 2023년 12월 1일 종료. Lighthouse / PageSpeed Insights로 대체
'색인(Coverage)' 보고서를 확인하라 현재 명칭은 페이지 색인 생성(Page indexing)
HTTPS 보고서는 최근 신설됐다 2022년 9월 출시. 2023년 Page Experience 보고서 정리 후 Core Web Vitals와 함께 개별 유지된 것
사이트맵 하나에 모든 하위 도메인 URL을 담아도 된다 원칙적으로 동일 호스트만. 교차 제출은 소유권 확인이 전제
사이트맵 ping으로 즉시 알릴 수 있다 404. 2024년 1월부터 동작하지 않음
Indexing API로 새 글을 빨리 색인시킬 수 있다 JobPosting·BroadcastEvent 전용. 일반 문서에 사용 불가
Google-Extended를 차단하면 AI Overviews에서 빠진다 빠지지 않는다. 학습·그라운딩 통제 토큰이며 검색 인덱스와 무관
llms.txt가 AI 검색 순위에 도움이 된다 구글 Search는 사용하지 않으며 순위에 무영향. 에이전트·일부 AI 검색 대상으로는 별개 논의
AI 검색용 별도 마크업·Markdown 버전이 필요하다 불필요. 구글은 추가 요구사항이 없다고 명시
SEO 적용 후 10~14일이면 결과가 보인다 색인 반영 확인에만 유효한 창. 순위 형성은 통상 4~12주

11. 실행 체크리스트

P0 — 기반과 색인 형성 (1~2주)

# 작업 완료
1 2장 인프라 점검표 전항 확인 (미리보기 도메인, soft 404, _headers, trailing slash, WAF) [ ]
2 GSC 도메인 속성 등록 + Cloudflare DNS TXT 소유권 확인 [ ]
3 하위 도메인별 URL 접두어 속성 병행 등록 [ ]
4 호스트별 robots.txt 생성 및 Sitemap: 지시자 명시 [ ]
5 호스트별 사이트맵 + 루트 사이트맵 인덱스 구성, lastmod 정확성 확인 [ ]
6 GSC 사이트맵 제출 및 읽기 성공 확인 [ ]
7 주요 페이지 10~20건 URL 검사 + 색인 요청 [ ]
8 배포 스크립트에서 폐기된 사이트맵 ping 호출 제거 [ ]

P1 — 채널 확장 (2~3주)

# 작업 완료
9 네이버 서치어드바이저 호스트별 등록 + 사이트맵/RSS 제출 [ ]
10 빙 웹마스터 도구 GSC 임포트 [ ]
11 Cloudflare Crawler Hints(IndexNow) 활성화 및 프록시 상태 확인 [ ]
12 Cloudflare AI Crawl Control 대시보드 확인, 9월 15일 기본값 변경 대비 설정 점검 [ ]

P2 — 온페이지와 AI 가독 구조 (4~6주)

# 작업 완료
13 전 페이지 Title / Meta Description / canonical 전수 점검 [ ]
14 Article·Organization(sameAs 포함)·Person(ORCID)·BreadcrumbList 스키마 적용 [ ]
15 6.2절 문서 구조 규율 8항을 템플릿 수준에 반영 (제목 계층, 요약 선행, 앵커 ID, 표 캡션) [ ]
16 차트·이미지 내 수치를 텍스트로 병기 [ ]
17 PDF 전용 배포 문서를 HTML 정본 + PDF 부가 구조로 전환 [ ]
18 하위 도메인 간 상호 내부 링크 구조 정비 [ ]
19 PageSpeed Insights 측정 및 Core Web Vitals 개선 [ ]
20 언어별 URL이 분리된 콘텐츠에 hreflang 적용(상호 참조 + x-default) [ ]

P3 — 운영 (지속)

# 작업 완료
21 성과 보고서 주간 점검 (브랜드/비브랜드 분리, 쿼리 그룹) [ ]
22 페이지 색인 생성 보고서 월간 점검 및 제외 사유 처리 [ ]
23 생성형 AI 성과 보고서 접근 가능 여부 확인 및 AI 노출 정책 결정 [ ]
24 Search Console API 또는 BigQuery로 16개월 이전 데이터 백업 자동화 [ ]
25 docs 서브도메인 대상 llms.txt 발행 검토 (에이전트 목적 한정) [ ]

12. 기대 타임라인

시점 관찰 가능한 변화
1~3일 소유권 확인 완료, 사이트맵 읽기 성공, GSC 데이터 수집 개시
1~2주 색인 생성된 페이지 수 증가 시작. 색인 요청한 개별 URL 반영
2~4주 네이버 노출 개시. 브랜드 검색 결과 등장
4~8주 비브랜드 롱테일 노출 형성. 첫 유의미한 쿼리 데이터 확보
8~12주 순위 안정화 시작. 이 시점 데이터로 콘텐츠 전략 조정 판단

8주 이전 데이터로 전략을 뒤집지 말 것. 표본이 부족한 구간의 순위 변동은 대부분 노이즈다.


13. 출처

  • Google Search Central, "AI Features and Your Website" — AI 기능 노출 요건, 별도 인덱스·제출 절차 없음, 통제 수단(nosnippet / Google-Extended) 구분
  • Google Search Central, AI 최적화 가이드 "Mythbusting generative AI search" 절 (2026-06 업데이트) — llms.txt 및 AI 전용 마크업 불필요 명시
  • Google Search Central Blog, "Introducing Search Generative AI performance reports in Search Console" (2026-06-03) — https://developers.google.com/search/blog/2026/06/gen-ai-performance-reports
  • Google Search Central Blog, "The role of page experience in creating helpful content" (2023-04) — 모바일 사용성 보고서·모바일 친화성 테스트 종료, Core Web Vitals / HTTPS 보고서 유지 — https://developers.google.com/search/blog/2023/04/page-experience-in-search
  • Google Search Central Blog, "Sitemaps ping endpoint is going away" (2023-06) — https://developers.google.com/search/blog/2023/06/sitemaps-lastmod-ping
  • Search Engine Land, "The SEO's guide to Google Search Console" — GSC 기능 연혁(HTTPS 보고서 2022-09, Recommendations 2024-08, Query Groups 2025-10, 브랜드 필터 2025-11)
  • Search Engine Land, "Google officially drops Mobile Usability report..." (2023-12-04)
  • Cloudflare Blog, "Your site, your rules: new AI traffic options for all customers" (2026-07) — 혼용 크롤러 기본 차단, Pay Per Use 전환
  • Cloudflare Docs, AI Crawl Control 개요 — https://developers.cloudflare.com/ai-crawl-control/
  • Bing Webmaster Blog, "Cloudflare Supports IndexNow via one-click Integration" (2021-11)
  • IndexNow.org FAQ — 참여 검색엔진 목록 및 엔드포인트 규격
  • 네이버 웹마스터 공식 공지 — IndexNow 지원 개시(2023-07)
  • 네이버 서치어드바이저 등록 절차 및 노출 소요 기간 관련 실무 문서(2026)