지난 글에서 백링크 채널 열 곳의 rel 속성을 받아서 확인한 기록을 적었다. 그 뒤로 실제로 링크를 몇 개 만들었고, 하나는 예상보다 일찍 결과가 나왔다.

결론부터 적으면 이렇다. 링크는 구글을 데려왔다. 그런데 색인시키지는 못했다.

무슨 일이 있었나

9월 29일에 국내 개발 뉴스 사이트 한 곳에 글을 하나 올렸다. cron 표현식에 관한 글이었고, 본문이 아니라 URL 칸에 링크를 하나 넣었다.

그 링크의 마크업을 나중에 받아서 확인했다.

1<a href="https://cron.withuse.io/cron-every-5-minutes/">

rel 속성이 아예 없다. 문서 전체에서 nofollow는 0회 나온다. 마크업상 추천표로 셀 수 있는 링크다.

그리고 일주일 뒤 Search Console에서 그 대상 페이지를 URL 검사했더니:

상태             크롤링됨 - 현재 색인이 생성되지 않음
최근 크롤링       2026-09-29        ← 글을 올린 바로 그날
크롤링 허용       예
페이지 가져오기    성공
색인 생성 허용     예
Google 선택 표준   검사된 URL

최근 크롤링 날짜가 링크를 건 날과 같다.

표본 하나로 인과를 단정할 수는 없다. 다만 그 페이지는 그 전 며칠 동안 크롤링되지 않았고, 링크가 걸린 날 크롤링됐고, 그 뒤로는 다시 조용하다. 링크를 타고 왔다고 보는 쪽이 자연스럽다.

그래서 뭐가 확인됐나

막는 것이 하나도 없다는 점이 중요하다.

  • robots.txt는 Allow: /
  • X-Robots-Tag 헤더 없음
  • meta robots는 index, follow
  • canonical은 자기 자신을 가리키고 구글도 그걸 그대로 채택했다
  • 수동 조치 없음, 보안 문제 없음

구글은 이 페이지를 찾았고, 읽었고, 색인하지 않기로 했다.

이건 기술 문제가 아니다. 발견의 문제도 아니다. 판단의 문제다.

이게 왜 유용한 기록인가

색인이 안 될 때 가장 먼저 의심하는 건 보통 “구글이 아직 못 찾았나"다. 그래서 사이트맵을 다시 내고, 색인 요청을 누르고, 내부 링크를 더 건다.

나도 6주 동안 그걸 했다. 사이트맵 제출, 색인 요청 15건, 호스트별 속성 등록. 전부 변화가 없었다.

이번 건은 그 가설을 깨끗하게 지운다. 구글은 링크를 타고 당일에 왔다. 발견이 병목이었다면 여기서 뭔가 달라졌어야 한다. 달라지지 않았다.

남는 설명은 둘 중 하나다.

  1. 이 페이지가 색인에 보탤 것이 없다고 판단됐다
  2. 사이트 전체가 그렇게 판단됐고 개별 페이지는 그 판정을 물려받는다

비교해볼 만한 사례

비슷한 시기에, AI로 콘텐츠를 대량 생성해서 올리는 사이트를 하나 봤다. 사이트맵에 URL이 2,090개 있었고, 6개 언어로 같은 글을 복제하면서 hreflang조차 걸지 않았다. 그런데 색인은 잘 되고 있었다.

구조를 비교해보니 내 사이트와 다른 점이 몇 개 보였다.

내 사이트그 사이트
콘텐츠 유형유틸리티 도구 + 레퍼런스뉴스 기사
스키마WebApplication · TechArticleNewsArticle · NewsMediaOrganization
주제UUID · Base64 · cron의료 · 치과
발행한 달째 정지넉 달째 매일

가장 설명력이 있어 보이는 건 주제에 빈칸이 있느냐다.

“임플란트 주위염 레이저 치료의 근거"를 한국어로 검색하면 답이 거의 없다. 올리면 색인에 보탬이 된다.

“UUID v4 생성"이나 “crontab 문법"은 10년 된 정답이 이미 있다. crontab.guru, jwt.io, MDN이 그 자리를 지키고 있다. 내 페이지가 색인에 보태는 것이 없다.

Search Console 커뮤니티에서 받은 답변 중 하나가 정확히 그 얘기였다. 구글이 요즘 유틸리티 도구 사이트를 덜 색인하고, 이미 비슷한 사이트가 많아서 하나 더 필요하지 않을 가능성이 크다는 것이었다.

내가 놓친 것

여기까지 정리하고 나서 내 페이지들을 다시 봤는데, 불편한 걸 하나 발견했다.

cron-every-5-minutes라는 페이지에는 사실 새로운 내용이 들어 있다. */45가 “45분마다"가 아니라 45분과 15분을 교대한다는 것, 그리고 60 % step == 0이면 간격이 일정하다는 판별법. 직접 돌려서 확인한 것이다.

그런데 제목과 주소가 “cron every 5 minutes"를 겨냥하고 있다. 이미 수백 개가 있는 질문이다.

발견을 해놓고 상품 키워드로 포장한 셈이다. 구글 입장에서는 “또 하나의 cron 기초 페이지"로 보였을 것이다.

다음에 쓰는 글부터는 제목과 주소를 알아낸 것 자체로 잡으려고 한다. cron-every-5-minutes가 아니라 cron step이 시간을 나누지 않을 때처럼.

지금 상태

외부 링크   0 → (측정 대기)
색인        4 / 54
미색인      50

링크를 본격적으로 만들기 시작한 게 10월 6일이다. 구글이 그 링크들을 등록하고 사이트를 다시 평가하기까지는 시간이 더 걸린다. 11월 중순에 다시 적겠다.

측정 대상 사이트는 withuse.io 이고, 위에서 URL 검사 결과를 옮긴 페이지는 cron 표현식 가이드 다.