GEO-SCORE · 오픈소스 AEO 지표

귀사 웹사이트,
AI가 인용할 수 있을까요

구간 채점 항목 21개, 합계 100점. 명령어 한 줄, 약 20초. MIT 라이선스에 기계 판독 가능. 누구나 같은 기준으로 귀사의 점수를 재계산할 수 있습니다. 경쟁사도 포함해서요.

설치할 것 없이, 지금 바로 귀사 사이트를 측정해 보세요:

curl -sL https://raw.githubusercontent.com/jianruntech/geo-score/main/cli/geo_score.py \
  | python3 - 귀사도메인.com --brief

명령어를 실행할 줄 아신다면 직접 하세요. 모르시거나, 실행했는데 무엇을 고쳐야 할지 모르시겠다면 저희가 실행하고 결과를 설명해 드리겠습니다. 비용은 없습니다.

표준 라이브러리만 사용, Python 3.8 이상. 릴리스 때 점수가 떨어지면 배포를 막아 주는 GitHub Action 버전도 있습니다.

AIV의 다섯 축 RUBRIC v1.1
AIV의 다섯 축 가로 막대 그래프. 가로축은 가중치 점수로 0에서 40. 크롤링 가능 15점, 이해 가능 22점, 인용 가능한 콘텐츠 35점, 브랜드 신뢰도 18점, 질문 적합도 10점, 합계 100점. 크롤링 가능 15 이해 가능 22 인용 가능한 콘텐츠 35 브랜드 신뢰도 18 질문 적합도 10 0510152025303540가중치(점)
다섯 축의 합은 100점. 인용 가능한 콘텐츠가 35점으로 가장 큰 비중입니다. 답변 엔진이 검색하는 것은 사이트가 아니라 문단이기 때문입니다. 단독으로 성립하고 그대로 인용할 수 있는 한 문단을 찾습니다.

세 개의 게이트: 하나라도 안 되면 나머지는 헛수고

21개 항목 중 세 개는 게이트입니다. 어느 하나라도 0점이면 정규화 결과는 40점에서 막힙니다. 감점이 아니라 상한입니다. 이 세 가지가 안 되면, 나머지 열여덟 항목이 아무리 좋아도 엔진에 닿지 않기 때문입니다.

크롤러가 허용되는가 robots.txt

robots.txt에서 AI 검색 크롤러를 이름으로 막으면 콘텐츠는 엔진 색인에 들어가지 않습니다. 이것은 때로 편집상의 결정입니다. 출판사와 의료 사이트가 인용되지 않기를 선택하는 것은 합리적이며, 지표는 그대로 기록할 뿐 설정 오류라고 부르지 않습니다.

크롤러가 가져올 수 있는가 실제 접근성

실제 검색용 UA 열 개로 하나씩 탐색합니다. 브라우저에는 200을, 크롤러에는 403을 돌려주는 사이트가 있습니다. 가장 발견되지 않는 유형입니다. 회사 안에서 보면 사이트가 멀쩡하기 때문입니다.

본문이 HTML 안에 있는가 서버 사이드 렌더링

본문이 JavaScript 실행 후에만 존재하는 사이트에서 크롤러가 받는 것은 빈 껍데기입니다. 콘텐츠는 있고 브라우저에는 보이지만 엔진은 읽지 못합니다. 이 그룹은 거의 확실히 의도한 것이 아닙니다.

유명 사이트 314곳 실측: 4분의 1은 전혀 인용될 수 없다

순위표는 고정된 공개 명단입니다. 370곳 등재, 314곳 측정, 20개 업종 각각 10곳 이상. 그보다 적은 '업종 중앙값'은 아무것도 말해 주지 않습니다. 원본 데이터는 저장소에 있고, 직접 다시 실행해 확인할 수 있습니다.

314곳 중 인용될 수 없는 80곳을 원인별로 세 그룹으로 분류
원인사이트 수성격
robots.txt에서 이름으로 차단19편집상의 결정. 인용되지 않기를 선택
본문이 JS 실행 후에만 존재45거의 확실히 의도한 것이 아님
크롤러에 오류 응답16브라우저에는 200, 크롤러에는 403. 내부에서는 알 수 없음

중앙값 56점, 범위 12~98. 이 세 그룹을 합치면 80곳으로 실측의 25%입니다. 그리고 이 비율은 다섯 번의 독립 표본에서 모두 24~25%였습니다. 표본은 38곳에서 314곳까지 늘어났습니다.

해외 진출 기업이라면 더 직접적인 숫자가 하나 있습니다. 중국 시장을 겨냥한 사이트의 중앙값은 40, 나머지는 59로 19점 차이. 다섯 번의 표본에서 이 차이는 16~23점 사이였습니다. 콘텐츠 품질의 차이가 아니라, 읽힐 수 있느냐의 차이입니다.

다섯 등급: 현재 위치이지, 판결이 아니다

외부 벤치마크에 따르면 대부분의 상업 사이트는 30~55점에 있습니다. 40점대는 정상이지 경보가 아닙니다. 'AI 검색을 위한 준비를 아직 하지 않았다'는 뜻이지 '사이트를 못 만들었다'는 뜻이 아닙니다.

AIV 다섯 등급의 점수 범위와 의미
등급점수의미
선도83–100우위를 확보함. 초점은 유지와 확장으로
기반 확립66–82기반은 갖춰졌고, 결함은 콘텐츠 깊이와 브랜드 자산에 집중
성장기51–65주요 항목은 진행 중. 부족한 것은 체계성과 일관성
초기31–50기초 항목에 뚜렷한 결함이 있으나 대부분 며칠이면 보완 가능
미착수0–30AI 검색을 위한 준비를 아직 하지 않음. 개선 여지가 가장 큼

이 점수를 믿을 수 있는 이유

측정 도구에서 가장 먼저 따져야 할 것은 그 도구 자체가 정확한가입니다. 그래서 아래 세 가지를 모두 저장소에 적어 두었고, 누구나 확인할 수 있습니다.

  1. 임계값은 감으로 정하지 않았습니다. 보정 기록에 각 등급의 경계를 어떻게 정했는지, 네 개의 공개 벤치마크와 어떻게 맞췄는지 적었습니다. 저희가 틀렸다고 인정한 대목도 그대로 들어 있습니다. 공개 전에 예측한 점수 분포 구간은 빗나갔고, 실측이 그것을 뒤집었습니다. 기록에는 두 숫자를 모두 남겼습니다.
  2. 재현 정확도는 실측한 것이지 주장이 아닙니다. 순위표 전체를 두 번 실행해 사이트별로 대조: 96%가 ±5 이내, 45%는 완전히 일치. 따라서 개별 사이트의 점수는 ±5로 읽어 주세요. 중앙값은 안정적입니다. 불안정한 것은 게이트 점검으로, 두 번 사이에 다섯 곳이 뒤집혔습니다. 봇 방어가 크롤러에 다르게 응답했기 때문입니다. 전체 데이터
  3. 저희가 직접 잡은 버그도 적혀 있습니다. 예를 들어 Python 3.11 미만에서는 307/308 리다이렉트를 따라가지 않아, 같은 사이트의 점수가 누구의 Python으로 실행하느냐에 달려 있었습니다. 또 요청 헤더에서 영어를 우선하면 일부 중국어 사이트가 국제판을 돌려주었습니다. 후자는 헤더를 바꿔서 해결되지 않기 때문에, 방침은 숨기지 않고 기록하는 것입니다. 결과에 실제로 측정한 도메인을 명시합니다.
  4. 저희 순위표 페이지도 같은 지표로 측정합니다. 현재 87점, 등급 '선도'. 점수와 결함을 모두 공개합니다. 아직 부족한 항목까지 포함해서요.

문제를 찾았다. 그다음은?

지표가 답하는 것은 하나뿐입니다. 엔진이 귀사를 인용할 수 있는가. 인용할 것인가는 경쟁과 질문 의도에 달려 있고, 어떤 외부 감사도 관찰할 수 없습니다. 그래서 순위도, 인용량도 약속하지 않습니다. 저장소에서 수정 제안을 주지 않는 것도 의도한 것입니다. 채점은 공개, 수정은 저희의 일.

  1. 무료 AIV 점검. 저희가 실행한 뒤, 지표가 못 하는 부분을 합니다. 어떤 결함이 진짜이고 어떤 것은 무시해도 되는지, 어느 단계를 먼저 고칠지, 고칠 가치가 있는지. 점수 자체는 직접 실행해 재확인할 수 있습니다. 그것이 오픈소스의 의미입니다.
  2. AEO 진단 · 118만 원부터. AIV 기준값 보고서 + 해외 경쟁사와의 격차 + 30일 실행 목록. 보고서 자체가 역량의 증명입니다. 그것을 가지고 직접 고치셔도 됩니다.
  3. 전 과정 동반 지원 + AIV 대시보드. 월 단위로 비교하고, 같은 점수로 이야기합니다. 경계는 분명히 적어 두었습니다: 운영 대행 없음, ROI 기반 수수료 없음, 인력 대체 약속 없음.

자주 묻는 질문

이건 SEO와 같은 것인가요

같은 질문이 아닙니다. 전통적인 SEO는 몇 위인가를 묻지만, 답변 엔진은 순위를 매기지 않습니다. 문단을 검색하고, 답을 조립하고, 출처를 표시합니다.

그래서 인용되는 조건이 바뀌었습니다. 본문이 HTML 안에 있어야 하고, 첫 문단이 단독으로 성립해야 하며, 숫자에 출처가 있어야 하고, 저자를 검증할 수 있어야 합니다. SEO 도구는 이런 것을 거의 측정하지 않습니다. 순위 논리에서는 중요하지 않기 때문입니다.

결론SEO를 잘한 사이트가 AIV가 높다는 보장은 없고, 그 반대도 마찬가지입니다. 순위표에는 두 경우 모두 많습니다.

점수가 낮으면 제 웹사이트가 나쁘다는 뜻인가요

대부분 그렇지 않습니다. 순위표 중앙값은 56점에 불과하고, 40점대는 흔합니다. 낮은 점수는 보통 'AI 검색을 위한 준비를 한 적이 없다'는 뜻이지 '사이트를 못 만들었다'는 뜻이 아니며, 두 경우의 해결 방법은 전혀 다릅니다.

게이트 때문에 40점에 막힌 사이트는 특히 원인을 확인해야 합니다. 본문이 JavaScript 실행 후에만 존재한다면 콘텐츠는 좋은데 엔진이 못 읽는 것이고, robots.txt에서 이름을 지정해 막고 있다면 그건 애초에 귀사의 결정이었을 수 있습니다.

저장소에서 수정 제안을 주지 않는 이유는요

의도한 것입니다. 공개한 것은 측정 기준입니다. 지표, 점검 항목, 판단 기준, 원본 데이터. 목적은 점수를 검증하고, 재현하고, 반박할 수 있게 하는 것입니다.

어떻게 고칠지, 무엇부터 고칠지, 몇 인일을 들일지, 누가 할지는 저희의 납품 내용입니다. 이 둘을 분리해야 지표를 남들이 중립적 기준으로 쓸 수 있습니다. 저희 경쟁사도 포함해서요.

순위표의 점수를 제가 직접 재계산할 수 있나요

네, 그게 설계 목표입니다. 지표는 기계 판독이 가능하고 각 구간에 '샘플 8페이지 중 몇 페이지 해당'이 명시돼 있어, 두 사람이 같은 사이트를 재면 산술적으로 일치합니다. 원본 데이터, 채점 스크립트, 페이지 생성 스크립트가 모두 저장소에 있습니다.

참고다시 실행하면 ±5의 자연스러운 흔들림이 있습니다(샘플 페이지가 바뀌고, 사이트의 봇 방어가 바뀝니다). 두 사이트를 비교할 때 5점 미만의 차이는 결론으로 삼지 마세요.

순위표에 제 사이트가 없습니다. 추가할 수 있나요

네. 저장소에 전용 제출 창구가 있으며, 먼저 직접 실행해서 결과 줄을 붙여 주셔야 합니다. 특히 업종과 언어 커버리지가 얇은 사이트가 필요합니다. 비영어 사이트, 규제 산업, 플랫폼, 미디어.

참고점수는 낮은 것을 포함해 공개됩니다. 제출 템플릿에 명시돼 있고, 자기 사이트가 아니어도 추천할 수 있습니다. 모든 점검은 공개 URL에 대해서만 실행됩니다.

지표가 오픈소스인데, 왜 굳이 무료 점검을 요청해야 하나요?

지표는 숫자만 내놓을 뿐, 판단은 내놓지 않기 때문입니다. 직접 실행해서 얻는 점수와 저희가 내는 점수는 같습니다. 그게 공개한 이유이고, 저희가 매긴 모든 점수는 검증할 수 있습니다. 무료 점검이 더해 주는 것은 지표가 못 하는 세 가지입니다. 첫째, 결과 읽기: 다시 실행하면 점수가 ±5쯤 자연스럽게 흔들리고, 게이트 항목은 사이트의 봇 차단 정책에 따라 뒤집히기 때문에 진짜 결함과 노이즈를 사람이 가려야 합니다. 둘째, 비즈니스에 대입하기: 9개 단계 중 무엇을 먼저 고쳐야 하는지, 지표는 귀사가 무엇을 파는지 모릅니다. 셋째, 고칠 가치가 있는지와 작업량 판단: 채점은 공개했고, 고치는 것은 저희 일입니다. 명령어를 실행할 줄 아신다면 직접 하세요. 모르시거나, 실행했는데 다음에 뭘 해야 할지 모르시겠다면 저희에게 문의하세요. 비용은 없습니다.