왜 이 파일이 있나. 고치고 → 결과 보고 → 버리면 남는 게 하나도 없다.
다음에 다른 사이트에서 같은 상황을 만나도 처음부터 다시 추측하게 된다.그래서 한 것 / 왜 될 거라 봤나 / 실제로 어떻게 됐나 / 그래서 일반화되나를 여기 쌓는다.
이게 쌓여야 "우리는 SEO·GEO 를 안다"고 말할 수 있다. 안 쌓이면 매번 초보다.
- 사이트별 진행 중인 가설 = 각 저장소의
SEO_HYPOTHESES.md(예:cue/SEO_HYPOTHESES.md)- 규칙 =
docs/SEO_GEO.md— 🔴 규칙은 여기 증거에서만 나온다. 추측으로 규칙을 쓰지 마라- 이 파일 = 그 사이를 잇는 증거 원장
| 뜻 | |
|---|---|
| ✅ 효과 확인 | 재보니 지표가 움직였다. 근거 숫자를 같이 적는다 |
| ❌ 효과 없음 | 재봤는데 안 움직였다. 이게 제일 값나가는 기록이다 — 다음에 같은 걸 또 안 한다 |
| 🌫 모름 | 다른 변수와 섞여서 못 가린다 / 표본이 부족하다 / 아직 이르다. 모른다고 적는 게 맞다. 🚫 추측으로 ✅ 를 주지 마라 |
| ⏳ 관찰 중 | 조치는 끝났고 확인일이 아직 안 됐다 |
🚫 여러 조치를 한 배포에 몰아넣고 ✅ 를 주지 마라. 그러면 전부 🌫 가 된다.
어쩔 수 없이 몰아넣었으면 몰아넣었다고 적어라 — 그게 정직한 기록이다.
맥락: GSC 실측에서 색인 0개 / 620개 미색인 / 클릭 0. 사이트는 7월부터 살아 있었다.
⚠️ 이날 조치를 하룻밤에 몰아서 했다. 그래서 개별 효과를 가릴 수 없다.
아래 판정은 대부분 ⏳ 이고, 2~4주 뒤 GSC 숫자로만 갈린다. 이건 이 원장의 첫 반성이다 —
다음부터는 나눠서 배포하고 사이에 관찰 구간을 둔다.
| # | 무엇을 | 왜 될 거라 봤나 | 판정 | 근거 |
|---|---|---|---|---|
| E1 | /jobs 허브에 공고 495장 서버 렌더 |
sitemap 에만 있고 내부 링크 0인 페이지는 Discovered 큐에 갇힌다(Onely) | ⏳ | 고아 383→0. 색인 변화는 9/25 판정 |
| E2 | 글 40편 author → Person + 발행일 |
구글 Who/How/Why 의 Who 가 비어 있었다 | ⏳ | 재크롤돼야 안다 |
| E3 | sitemap lastmod 0 → 519 + 재제출 |
재방문 우선순위 신호 | ⏳ | 읽음 8/15→8/28 (재제출 직후라 lastmod 효과와 못 가림 🌫) |
| E4 | sitemap 에서 301 /blog 제거, /insights 추가 |
리다이렉트 제출은 크롤 예산 낭비 + 사이트맵 신뢰 하락 | ⏳ | 발견 619→611 |
| E5 | 홈 공고 섹션 서버 렌더(851건·10개사) | 봇에게 "지금 무슨 공고가 있나"가 0이었다(§6-2) | ⏳ | 봇 가시 텍스트 증가 |
| E6 | notes 유료 제품 40장 서버 본문 |
카피가 R2 HTML 에 있는데 JS 로만 그렸다 | ⏳ | 344자 → 1,681자 |
| E7 | 목록·허브 페이지 유형별 JSON-LD | Organization 만으로는 "이 페이지가 뭔지" 아무도 말 안 함 | ⏳ | — |
| E8 | robots 에 AI 봇 5종 명시(전 도메인) | GEO 노출 의도 명시 | 🌫 | Allow: / 로 이미 통과였다. 실효는 정책 고정뿐일 수 있다 |
| E9 | llms.txt 정비 |
— | ❌ | 구글이 공식으로 "검색에 영향 없음" 확인(2026-05 가이드). 비구글 보조. 🚫 여기 시간 더 쓰지 마라 |
| E10 | apex 제품 페이지 → cue 깊은 링크 4개 | 형제 사이트 860페이지가 이미 링크하는데 전부 홈으로만 갔다 | ⏳ | 9/11 확인 |
| E11 | /pricing sitemap 추가 + Product 스키마 |
밖(apex)에서 링크받는 200 페이지를 우리가 제출 안 하고 있었다 | ⏳ | — |
| E12 | cue 이벤트 허용목록 12 → 22종 | 클라이언트가 22종 쏘는데 서버가 12종만 받아 10종을 조용히 버리고 있었다 | ✅ | real_start·real_done·solo_convert 등 퍼널 핵심이 유실 중이었다. 즉시 확인 가능한 버그 |
| 원래 생각 | 실측 | 그래서 |
|---|---|---|
| "형제 사이트에서 cue 로 링크를 걸어야 한다"(H6) | 이미 860페이지가 걸고 있었다. 다만 전부 홈으로만 | 문제는 링크 수 가 아니라 어디로 가느냐. 깊은 링크로 방향을 바꿨다 |
| "구글 0개는 우리 콘텐츠가 얇아서"(H5 초안) | 네이버가 같은 페이지를 색인했다(H7) | 품질이 아니라 크롤 예산 배분 문제. H5 를 다시 썼다 |
📌 일반화: 가설을 세웠으면 조치 전에 전제부터 재라. 두 번 다 전제가 틀렸고,
안 재고 실행했으면 엉뚱한 걸 고치고 "효과 없음"으로 결론냈을 것이다.
| 배운 것 | 승격 |
|---|---|
| sitemap 은 발견만 시킨다. 크롤 우선순위는 내부 링크가 정한다 | SEO_GEO.md §23 |
| 점검기 FAIL 0 ≠ 색인됨. "안 뺄 이유"와 "올 이유"는 다르다 | §23 |
| 크롤 실패한 소스의 공고를 마감 처리하면 색인 자산이 지워진다 | cue/CLAUDE.md |
| 카피가 있는데 JS 로만 그리면 봇에겐 없는 것 (notes 40장·cue 홈) | §5 재확인 |
점검기(seo_check.py) 결함 8종 — 상세는 SEO_GEO.md §22.
교훈: 측정 결과가 이상하면 대상보다 자를 먼저 의심한다. 이날 오탐이 정탐보다 많았다.
| 자가 틀려서 생긴 오판 | 실제 |
|---|---|
| cue "FAIL 0" | 첫 페이지 1장만 봤다 → 실제 FAIL 15 |
| mark "sitemap 1 URL, 표면이 없다" | sitemapindex 를 안 따라갔다 → 실제 773장 |
| notes "canonical·lang 없음" | 따옴표 없는 속성을 못 읽었다 → 넷 다 있었다 |
/company/* "고유도 26.9%, 발행 금지선" |
나브·푸터를 포함해 쟀다 → 실제 63.4% |
계기: 구글 색인 0개로 40일째 막혀 있는데, 한국 서비스가 네이버를 한 번도 안 봤다.
| 엔진 | 색인 | 확인 방법 | 판정 |
|---|---|---|---|
| 구글 | 0개 | GSC | ❌ 40일째 크롤 안 옴 |
| 네이버 | 최소 10 URL | 고유 문구 검색 → cue URL 등장 | ✅ 홈·/about·/companies·/jobs·/spike·/prep + 글 2편 + 공고 1건 |
| 빙 | 0개 | 글 고유 문구 "Kafka를 외우지 말고" → 결과 없음 |
❌ IndexNow 를 매 크롤마다 쏘는데 안 들어감 |
콘텐츠 문제가 아니다. 네이버는 같은 페이지를 색인했다. 개별 글과 공고 페이지까지 들어갔다.
같은 HTML·같은 스키마·같은 본문인데 한 엔진은 넣고 한 엔진은 안 넣는다.
→ 구글 0개의 원인은 페이지 품질이 아니라 도메인 단위 크롤 수요다.
→ SEO_GEO.md §3~§20(페이지 규격)을 더 손봐도 구글 색인은 안 움직일 가능성이 크다.
→ 움직이는 건 §23(내부 링크)과 색인 API 다. H1·H4 의 중요도가 올라간다.
IndexNow 는 매 크롤마다 pinged 29 urls ok=true 를 찍고 있는데 색인이 0이다.
핑이 갔다는 것과 받아들여졌다는 건 다르다. 빙 웹마스터 계정이 없어서 지금껏 확인할 방법이 없었다.
빙은 ChatGPT 검색의 백엔드라 GEO 와 직결된다 — 여기가 0이면 ChatGPT 에 인용될 일도 없다.
| 할 것 | 누가 |
|---|---|
| 빙 웹마스터 계정 개설 + GSC 에서 사이트 가져오기 (5분) | 🙋 사람 — 계정 생성은 내가 못 한다 |
| 네이버 서치어드바이저 상태 확인 | 🙋 사람 — 브라우저 확장 사이트 제한에 막힘 (소유확인 파일 3개가 저장소에 있으니 등록은 돼 있을 것) |
📌 일반화: 새 사이트를 볼 때 구글만 보지 마라. 엔진별 색인을 나란히 재면
"우리 콘텐츠가 문제인가"와 "이 엔진이 안 오는 건가"를 한 번에 가를 수 있다.
한 엔진이라도 색인했으면 콘텐츠는 무죄다.
우리가 따르고 있지만 우리 데이터로는 아직 확인 못 한 것들. 🚫 확인 전에 규칙으로 올리지 마라.
| 통설 | 출처 | 우리 검증 상태 |
|---|---|---|
| 신규 도메인은 Discovered 에 7~21일 머문다 | 업계 | 🌫 우리는 40일째다. 더 오래 걸리거나 다른 원인 |
| 내부 링크가 크롤 우선순위를 정한다 | Onely | ⏳ E1 이 정확히 이 실험이다 |
| 조치 효과는 2~4주 | 업계 통설 | ⏳ 9/25 에 우리 숫자로 확인 |
| 콘텐츠 신선도가 AI 인용을 3배 올린다 | SE Ranking 130만 인용 | 🌫 우리는 아직 인용 0이라 잴 수가 없다 |
| 브랜드 언급 > 백링크 (3배) | Ahrefs 7.5만 브랜드 | 🌫 우리 규모에서 확인 불가 |
FAQPage 리치결과 종료(2026-05-07) |
구글 | ✅ 1차 출처. 새로 넣지 않는다 |
cue 에서 배운 걸 mark·notes·heyreci·apex 에 적용할 때 이 순서로 확인한다.
seo_check.py --live --domain <도메인> --orphanscue/SEO_HYPOTHESES.md 표)