지난 글에서 백링크 채널 열 곳의 rel 속성을 받아서 확인한 기록을 적었다.
그 뒤로 실제로 링크를 몇 개 만들었고, 하나는 예상보다 일찍 결과가 나왔다.
결론부터 적으면 이렇다. 링크는 구글을 데려왔다. 그런데 색인시키지는 못했다.
무슨 일이 있었나
9월 29일에 국내 개발 뉴스 사이트 한 곳에 글을 하나 올렸다. cron 표현식에 관한 글이었고, 본문이 아니라 URL 칸에 링크를 하나 넣었다.
그 링크의 마크업을 나중에 받아서 확인했다.
1<a href="https://cron.withuse.io/cron-every-5-minutes/">
rel 속성이 아예 없다. 문서 전체에서 nofollow는 0회 나온다.
마크업상 추천표로 셀 수 있는 링크다.
그리고 일주일 뒤 Search Console에서 그 대상 페이지를 URL 검사했더니:
상태 크롤링됨 - 현재 색인이 생성되지 않음
최근 크롤링 2026-09-29 ← 글을 올린 바로 그날
크롤링 허용 예
페이지 가져오기 성공
색인 생성 허용 예
Google 선택 표준 검사된 URL
최근 크롤링 날짜가 링크를 건 날과 같다.
표본 하나로 인과를 단정할 수는 없다. 다만 그 페이지는 그 전 며칠 동안 크롤링되지 않았고, 링크가 걸린 날 크롤링됐고, 그 뒤로는 다시 조용하다. 링크를 타고 왔다고 보는 쪽이 자연스럽다.
그래서 뭐가 확인됐나
막는 것이 하나도 없다는 점이 중요하다.
robots.txt는Allow: /X-Robots-Tag헤더 없음- meta robots는
index, follow - canonical은 자기 자신을 가리키고 구글도 그걸 그대로 채택했다
- 수동 조치 없음, 보안 문제 없음
구글은 이 페이지를 찾았고, 읽었고, 색인하지 않기로 했다.
이건 기술 문제가 아니다. 발견의 문제도 아니다. 판단의 문제다.
이게 왜 유용한 기록인가
색인이 안 될 때 가장 먼저 의심하는 건 보통 “구글이 아직 못 찾았나"다. 그래서 사이트맵을 다시 내고, 색인 요청을 누르고, 내부 링크를 더 건다.
나도 6주 동안 그걸 했다. 사이트맵 제출, 색인 요청 15건, 호스트별 속성 등록. 전부 변화가 없었다.
이번 건은 그 가설을 깨끗하게 지운다. 구글은 링크를 타고 당일에 왔다. 발견이 병목이었다면 여기서 뭔가 달라졌어야 한다. 달라지지 않았다.
남는 설명은 둘 중 하나다.
- 이 페이지가 색인에 보탤 것이 없다고 판단됐다
- 사이트 전체가 그렇게 판단됐고 개별 페이지는 그 판정을 물려받는다
비교해볼 만한 사례
비슷한 시기에, AI로 콘텐츠를 대량 생성해서 올리는 사이트를 하나 봤다.
사이트맵에 URL이 2,090개 있었고, 6개 언어로 같은 글을 복제하면서
hreflang조차 걸지 않았다. 그런데 색인은 잘 되고 있었다.
구조를 비교해보니 내 사이트와 다른 점이 몇 개 보였다.
| 내 사이트 | 그 사이트 | |
|---|---|---|
| 콘텐츠 유형 | 유틸리티 도구 + 레퍼런스 | 뉴스 기사 |
| 스키마 | WebApplication · TechArticle | NewsArticle · NewsMediaOrganization |
| 주제 | UUID · Base64 · cron | 의료 · 치과 |
| 발행 | 한 달째 정지 | 넉 달째 매일 |
가장 설명력이 있어 보이는 건 주제에 빈칸이 있느냐다.
“임플란트 주위염 레이저 치료의 근거"를 한국어로 검색하면 답이 거의 없다. 올리면 색인에 보탬이 된다.
“UUID v4 생성"이나 “crontab 문법"은 10년 된 정답이 이미 있다.
crontab.guru, jwt.io, MDN이 그 자리를 지키고 있다.
내 페이지가 색인에 보태는 것이 없다.
Search Console 커뮤니티에서 받은 답변 중 하나가 정확히 그 얘기였다. 구글이 요즘 유틸리티 도구 사이트를 덜 색인하고, 이미 비슷한 사이트가 많아서 하나 더 필요하지 않을 가능성이 크다는 것이었다.
내가 놓친 것
여기까지 정리하고 나서 내 페이지들을 다시 봤는데, 불편한 걸 하나 발견했다.
cron-every-5-minutes라는 페이지에는 사실 새로운 내용이 들어 있다.
*/45가 “45분마다"가 아니라 45분과 15분을 교대한다는 것, 그리고
60 % step == 0이면 간격이 일정하다는 판별법. 직접 돌려서 확인한 것이다.
그런데 제목과 주소가 “cron every 5 minutes"를 겨냥하고 있다. 이미 수백 개가 있는 질문이다.
발견을 해놓고 상품 키워드로 포장한 셈이다. 구글 입장에서는 “또 하나의 cron 기초 페이지"로 보였을 것이다.
다음에 쓰는 글부터는 제목과 주소를 알아낸 것 자체로 잡으려고 한다.
cron-every-5-minutes가 아니라 cron step이 시간을 나누지 않을 때처럼.
지금 상태
외부 링크 0 → (측정 대기)
색인 4 / 54
미색인 50
링크를 본격적으로 만들기 시작한 게 10월 6일이다. 구글이 그 링크들을 등록하고 사이트를 다시 평가하기까지는 시간이 더 걸린다. 11월 중순에 다시 적겠다.
측정 대상 사이트는 withuse.io 이고, 위에서 URL 검사 결과를 옮긴 페이지는 cron 표현식 가이드 다.
