METHODOLOGY · GEO-READINESS-V4.0
점수보다 먼저, 무엇을 얼마나 확인했는지 보여 줍니다.
AI Optics는 발견 가능한 공개 페이지의 기술·콘텐츠 신호를 결정적인 규칙으로 검사합니다. 실제 AI 답변의 언급·인용·순위는 측정하지 않습니다.
이용 범위와 적용 기준
일반 사용자는 입력 URL·홈페이지·대표 내부 페이지를 합쳐 최대 5페이지의 정적 분석과 요약 리포트를 이용합니다. 표본 내 성공률을 전체 사이트 커버리지로 표현하지 않으며 Browser·Lighthouse는 일반 진단에 포함되지 않습니다.
관리자는 동일 origin에서 발견 가능한 최대 1,000페이지, 전체 2시간·1GiB 범위의 분석과 Browser·Lighthouse 측정을 이용합니다. 아래 전수 수집 흐름과 한도는 관리자 전체 진단에 해당합니다.
확인된 결과는 생성 시각부터 24시간 동안 관리자에게 보관됩니다. 일반 세션은 단절 후 60초 이내 재연결할 수 있고, 유예 만료 시 작업과 접근 권한은 종료됩니다. 명시적 삭제는 결과도 삭제합니다.
현재 공통 기본 기준: AI Optics 기본 평가 기준 · v1
등급 시작 점수: A 85 · B 70 · C 50점. D는 C 시작 점수 미만입니다.
접수 시 선택된 발행본을 대기·실행·완료까지 유지합니다. 기본값이 바뀌어도 기존 결과는 재평가하지 않습니다. 서로 다른 기준의 점수 증감은 비교하지 않습니다.
진단 흐름
- 사이트 범위 발견입력 URL, 홈, sitemap과 내부 링크를 하나의 frontier로 확인합니다.
- 콘텐츠·구조 분석원본 구조와 정제된 본문을 분리해 규칙을 평가합니다.
- 브라우저 렌더링 검증분석 성공 페이지의 안전한 숫자·불리언 신호만 비교합니다.
- Lighthouse 정밀 측정렌더링 위험도가 높은 페이지를 최대 5개 측정합니다.
- 인텔리전스 리포트 합성점수, 범위, 실패, 수정 우선순위를 하나의 보고서로 정리합니다.
분석 범위
입력 URL과 정확히 같은 origin에서 query·fragment·credentials를 제거하고, robots.txt가 허용한 HTML을 분석합니다. sitemap과 수집된 페이지의 내부 링크에서 발견하지 못한 고립 페이지는 전체 사이트에 존재하더라도 알 수 없습니다.
- 페이지
- 최대 1,000
- 전체 시간
- 최대 120분
- 전체 전송량
- 최대 1GiB
- Lighthouse
- 위험 페이지 최대 5개
frontier가 소진되면 전체 발견 범위 분석, 페이지·시간·용량 한도에 먼저 도달하거나 일부 페이지가 실패하면 제한 범위 분석으로 표시합니다. 서브도메인, 외부 사이트, PDF 본문, 로그인·쿠키가 필요한 페이지는 제외합니다.
점수 계산
| 분야 | 비중 | 대표 신호 |
|---|---|---|
| 접근·발견 | 30% | HTTP·HTTPS, noindex, canonical, robots, sitemap |
| 구조·메타 | 25% | title, description, OG, lang, 제목 구조, JSON-LD |
| 답변 추출 | 25% | 본문 깊이, 직접 답변, 목록·표, 중복, 추출성 |
| 신뢰·최신성 | 20% | 저자·조직, 날짜 일치, About·Contact, 외부 근거 |
pass100%,warn50%,fail0%를 적용합니다.unknown과not_applicable은 점수 분모에서 제외합니다.- 수집·분석 실패 페이지는 0점으로 넣지 않고 실패 건수와 페이지 분석률로 별도 표시합니다.
- 페이지 분석률은 분석 성공 페이지를 현재 발견된 적격 페이지로 나눈 값입니다. robots 제외 페이지는 분모에서 제외하며 발견 중에는 분모가 달라질 수 있습니다.
- 규칙 확인률은 평가 가능한 규칙 중 확인한 가중치 비율로, 페이지 분석률과 다릅니다. 가상 예시: 적격 50페이지 중 1페이지만 분석해 모든 규칙을 확인했다면 페이지 분석률은 2%, 규칙 확인률은 100%입니다.
- 분석 성공 페이지의 평가 가능한 항목이 있으면 `분석된 N페이지 기준` 점수와 등급을 제공합니다. 활성 항목이 모두 해당 없음·미확인이면 점수는 산출하지 않습니다.
- 활성 항목 배점 합계는 100점이며, 분야 비중은 항목 배점의 합계입니다. 비활성 항목과 그 분야 전체는 실패가 아닌 `평가 제외`입니다.
- 현재 등급 시작 점수는 A 85, B 70, C 50점입니다.
현재 기준의 검사 항목·배점 확인
- HTTP 응답 상태 · 4점
최종 HTTP 2xx
- HTTPS · 2점
HTTPS 최종 URL
- 색인 허용 · 5점
noindex 없음
- 검색 크롤러 정책 · 6점
검색 크롤러 5종 허용
- 스니펫 허용 · 2점
스니펫 금지 지시 없음
- 페이지 canonical · 3점
유효한 self-canonical
- canonical 일관성 · 2점
표본 canonical 정합률 90% 이상
- 사이트맵 발견 · 2점
사이트맵 발견
- 사이트맵 상태 · 2점
정상 사이트맵
- 내부 발견성 · 2점
대표 페이지로 향하는 내부 링크
- 문서 제목 · 3점
설명적인 title
- 메타 설명 · 2점
설명적인 meta description
- 주제 정합 · 2점
주요 메타데이터의 주제 일치
- 문서 언어 · 1점
유효한 lang 속성
- 다국어 대체 URL · 1점
다국어 페이지의 hreflang
- 주 제목 · 3점
의미 있는 H1 한 개
- 제목 계층 · 2점
순차적인 heading 계층
- 주 본문 영역 · 2점
명시적인 주 본문 영역
- JSON-LD 유효성 · 3점
유효한 JSON-LD 또는 도입 검토
- JSON-LD 완전성 · 2점
핵심 속성 완전성 80% 이상
- 구조화 데이터와 화면 정합 · 2점
구조화 데이터와 visible text 정합
- 메타데이터 고유성 · 2점
표본 title·description 고유
- 주 본문 추출 · 4점
명시적 영역에서 본문 추출
- 페이지 유형별 충분성 · 4점
페이지 유형별 최소 본문
- 섹션 구조 · 2점
본문 섹션 제목
- 질문형 탐색 단서 · 2점
주요 질문을 표현한 제목
- 직접 답변 · 4점
질문 다음의 직접 답변
- 목록과 표 · 2점
적용 가능한 구조화 표현
- 페이지 내 반복 · 2점
낮은 중복 문단 비율
- 페이지 간 중복 · 3점
표본 간 shingle 유사도 75% 미만
- 보일러플레이트 비율 · 2점
주 본문 중심 문서
- 발행 주체 · 2점
명시적인 발행 주체
- 주체 구조화 데이터 · 2점
Organization 계열 schema
- 주체 일관성 · 2점
발행 주체 신호의 사이트 전체 일관성
- 저자 표시 · 3점
기사의 visible author
- 저자 구조화 데이터 · 2점
연결된 author schema
- 표시 날짜 · 2점
visible 발행·수정 날짜
- 날짜 정합 · 2점
visible·structured date 일치
- 소개·연락 경로 · 2점
about 또는 contact 경로
- 출처 표시 · 3점
식별 가능한 출처 구조
큰 사이트가 점수를 지배하지 않게 하는 방법
페이지를 페이지 유형 × 첫 번째 경로 구간으로 묶고 그룹별 규칙 평균을 다시 같은 비중으로 평균합니다. 따라서 글이 많은 블로그 한 구간이 홈페이지·제품·고객지원 영역의 결과를 압도하지 않습니다. 사이트 전용 규칙은 한 번만 반영합니다.
브라우저 측정은 점수와 분리합니다
정적 분석에 성공한 페이지에는 경량 렌더링 검증을 시도합니다. 정적 HTML과 렌더 후 제목·H1·main·schema·본문량 차이가 큰 페이지를 우선해 Lighthouse를 최대 5개 실행합니다. Performance, Accessibility, Best Practices, SEO는 독립 실험실 결과이며 AI 검색 준비도 점수에 합산하지 않습니다.
원본 DOM, 본문, LHR, trace, screenshot과 selector는 저장하지 않습니다. 브라우저 환경이 없거나 일부 실행이 실패해도 정적 분석 보고서는 계속 제공합니다.
결정성과 분석 안전성
- URL과 결과 정렬에는 공용 Unicode code-point 순서를 사용합니다.
- 페이지별 artifact와 규칙을 격리해 병리 문서 하나가 전체 진단을 중단시키지 않게 합니다.
- HTML·JSON-LD·robots 복잡도 한도를 넘으면 해당 규칙을 미확인으로 처리합니다.
- SSRF 방어, DNS 재검사, 공개 IP 확인과 redirect 제한을 페이지마다 적용합니다.
- 원본 HTML·본문·DNS 주소·예외 메시지·URL query를 결과에 넣지 않습니다.
점수에 넣지 않는 참고 신호
llms.txt, RSS·Atom, PDF 링크, JavaScript 의존 가능성, 사용자 요청형 크롤러 정책과 Lighthouse 결과는 설명만 제공하고 준비도 점수에는 반영하지 않습니다. 학습 목적 크롤러 차단도 감점하지 않습니다.
공식 기준 문서
해석 시 주의: 준비도 점수는 분석에 성공한 공개 페이지의 구조적 상태입니다. 특정 AI 제품의 언급·인용·추천·순위를 보장하거나 예측하지 않습니다.