GEO-SCORE · オープンソースのAEO指標
あなたのサイトは、
AIに引用されるか
21項目の段階評価、合計100点。コマンド1行、約20秒。指標はMITライセンスで公開され、機械可読です。誰でも同じ基準であなたのスコアを再計算できます。競合他社も含めて。
今すぐ自分のサイトを測る。インストールは不要です:
curl -sL https://raw.githubusercontent.com/jianruntech/geo-score/main/cli/geo_score.py \
| python3 - あなたのドメイン.com --brief
コマンドを実行できる方はご自身で。できない方、実行したが何を直せばよいか分からない方は、私たちが実行して結果をご説明します。無料です。
標準ライブラリのみ、Python 3.8以上で動作。GitHub Action版もあり、リリース時に後退があればブロックできます。
3つのゲート:ひとつでも欠けると、残りは無意味
21項目のうち3つはゲートです。どれかひとつでも0点なら、正規化後の結果は40点で頭打ち。減点ではなく上限です。この3つが成立しないとき、残り18項目がどれだけ良くても、エンジンには届きません。
robots.txtでAI検索クローラーを名指しで遮断すると、コンテンツはエンジンの索引に入りません。これは編集上の判断であることもあります。出版社や医療サイトが引用されないことを選ぶのは合理的で、指標はそのまま記録し、設定ミスとは呼びません。
実在する検索用UAを10種類、順に試します。ブラウザには200を返し、クローラーには403を返すサイトがあります。もっとも気づかれにくい失敗です。社内から見れば、サイトは正常に見えるからです。
本文がJavaScriptの実行後にしか存在しないサイトでは、クローラーが受け取るのは空の殻です。コンテンツはあり、ブラウザでは見えますが、エンジンには読めません。このグループはほぼ確実に意図したものではありません。
著名サイト314件を実測:4分の1はAIに引用されない
ランキングは固定の公開リストです。370サイトを掲載し、314サイトを測定、20業種それぞれ10サイト以上。それ未満の「業種中央値」には意味がありません。生データはリポジトリにあり、ご自身で再実行して確認できます。
| 原因 | サイト数 | 性質 |
|---|---|---|
| robots.txtで名指しで遮断 | 19 | 編集上の判断。引用されないことを選んだ |
| 本文がJS実行後にしか存在しない | 45 | ほぼ確実に意図したものではない |
| クローラーにエラーを返す | 16 | ブラウザには200、クローラーには403。社内からは分からない |
中央値は56点、範囲は12〜98。この3グループで合計80サイト、実測の25%にあたります。しかもこの割合は5回の独立したサンプリングでいずれも24〜25%。サンプルは38サイトから314サイトまで拡大しました。
海外展開する企業にはもうひとつ直接的な発見があります。中国市場向けサイトの中央値は40、それ以外は59で、19点の差。5回のサンプリングでこの差は16〜23点の範囲に収まりました。差はコンテンツの質ではなく、読めるかどうかです。
5つの段階:現在地であって、判決ではない
外部のベンチマークでは、商用サイトの多くは30〜55点に収まります。40点台は普通のことで、警報ではありません。「AI検索向けの対応をまだしていない」ことを示すのであって、「サイトの出来が悪い」ことではありません。
| 段階 | スコア | 意味 |
|---|---|---|
| 先行 | 83–100 | 優位を確立済み。重点は維持と拡大へ |
| 基盤堅固 | 66–82 | 基盤は整い、欠落はコンテンツの深さとブランド資産に集中 |
| 成長期 | 51–65 | 主要項目は着手済み。足りないのは体系性と一貫性 |
| 初期段階 | 31–50 | 基礎項目に明確な欠落があるが、多くは数人日で補える |
| 未着手 | 0–30 | AI検索向けの対応をまだしていない。伸びしろが最大 |
なぜこのスコアを信頼できるのか
測定ツールについて真っ先に疑うべきなのは、その道具自体が正確かどうかです。だからこの3点はすべてリポジトリに書いてあり、誰でも確認できます。
- しきい値は勘で決めていません。 校正記録 に各段階の境界をどう決めたかを記し、4つの公開ベンチマークと突き合わせています。自分たちの誤りを公に認めた箇所も、ひとつそのまま残してあります。 公開前に予測したスコア分布の区間は外れており、実測がそれを覆しました。記録には両方の数字を残しています。
- 再現精度は実測したものであり、主張ではありません。 ランキング全体を2回実行してサイトごとに比較:96%のサイトが±5以内、45%は完全一致。 したがって個別サイトのスコアは±5で読んでください。中央値は安定しています。安定しないのはゲート検査で、2回の間に5サイトが反転しました。 ボット対策のクローラーへの応答が変わったためです。 全データ
- 自分たちで見つけたバグも書いてあります。 例えば、Python 3.11未満では307/308リダイレクトが追従されず、同じサイトのスコアが実行するPythonのバージョンに左右されていました。 また、リクエストヘッダーで英語を優先すると、一部の中国語サイトが国際版を返してきました。 後者はヘッダーの変更では解決しないので、方針は隠さず記録すること。結果には実際に測定したドメインを明記します。
- 私たち自身のランキングページも同じ指標で測っています。 現在87点、段階は「先行」。スコアも欠落も公開しています。まだ足りない項目も含めて。
問題が見つかった。その後は?
指標が答えるのはひとつだけ。エンジンがあなたを引用できるか。引用するかは競合と質問の意図次第で、サイト外の監査では観測できません。だから順位も引用数も約束しません。リポジトリで修正の提案をしないのも意図的です。採点は公開、修正は私たちの仕事。
- 無料AIVチェック。私たちが測定し、そのうえで指標にはできない判断を加えます。どの欠落が本物で、どれは無視してよいか、どの工程から直すべきか、直す価値があるか。スコア自体はご自身で実行して確かめられます。それがオープンソースにしている理由です。
- AEO診断 · 135,000円〜。AIV基準値レポート+海外競合との差+30日間の行動リスト。 レポート自体が能力の証明です。それを持ってご自身で直していただいても構いません。
- 全工程伴走+AIVダッシュボード。月次で比較し、同じスコアで語ります。 境界は明示しています:運用代行はしない、ROI連動の成果報酬は取らない、人員の置き換えは約束しない。
よくある質問
これはSEOと同じことですか
同じ問いではありません。従来のSEOは何位かを問いますが、回答エンジンは順位を付けません。 段落を検索し、回答を組み立て、出典を示します。
だから引用される条件が変わりました。本文がHTMLの中にあること、冒頭の段落が単独で成立すること、 数字に出典があること、著者が検証可能であること。SEOツールはこれらをほとんど測りません。順位のロジックでは重要でないからです。
結論SEOが良くできたサイトでもAIVが高いとは限らず、その逆も成り立ちます。ランキングにはどちらの例も多くあります。
スコアが低いと、私のサイトは悪いということですか
ほとんどの場合、そうではありません。ランキングの中央値は56点で、40点台はごく普通です。 低いスコアはたいてい「AI検索向けの対応をしていない」ことを意味し、「サイトの出来が悪い」ことではありません。 この2つの対処法はまったく違います。
ゲートで40点に頭打ちされたサイトは特に原因を確認してください。本文がJavaScript実行後にしか存在しないなら、 コンテンツ自体は良く、エンジンが読めないだけ。robots.txtで名指しで遮断しているなら、それは御社自身の判断だったのかもしれません。
なぜリポジトリでは修正の提案をしないのですか
意図的です。公開しているのは測定の基準。指標、検査項目、判定基準、生データ。 目的は、スコアを検証・再現・反論できるようにすることです。
どう直すか、どれから直すか、何人日かけるか、誰が実行するかは、私たちの納品内容です。 この2つを分けておくからこそ、指標を中立的な基準として他社が使えます。競合他社も含めて。
ランキングのスコアを自分で再計算できますか
できます。それが設計目標です。指標は機械可読で、各段階に「サンプル8ページ中何ページ該当」と明記されているので、 2人が同じサイトを測れば算術的に一致します。生データ、採点スクリプト、ページ生成スクリプトはすべてリポジトリにあります。
注意再実行には±5の自然な揺れがあります(サンプルページが変わる、サイトのボット対策が変わる)。 2つのサイトを比較するとき、5点未満の差を結論にしないでください。
ランキングに自分のサイトがありません。追加できますか
できます。リポジトリに専用の申請窓口があり、まずご自身で実行して結果の行を貼っていただきます。 特に欲しいのは業種と言語のカバーが薄いサイト。英語以外のサイト、規制業種、プラットフォーム、メディアです。
ご注意スコアは低いものも含めて公開されます。申請テンプレートに明記しており、 自社以外のサイトを推薦することもできます。すべての検査は公開URLに対してのみ実行します。
指標は公開されているのに、なぜ無料チェックを頼む必要があるのですか?
指標が出すのは数字であって、判断ではないからです。ご自身で実行して得たスコアと、私たちが出すスコアは同じもの。それが公開する意味で、私たちが付けた点はすべて検証できます。チェックが加えるのは、指標にはできない3つのことです。1つ目は結果を読むこと。再実行では±5の自然な揺れがあり、ゲート項目はサイトのボット遮断ポリシーで反転するため、本当の欠落とノイズを人が見分ける必要があります。2つ目はビジネスに戻すこと。9工程のどこから直すべきか、指標はあなたが何を売っているか知りません。3つ目は直す価値と工数を示すこと。採点は公開し、修正は私たちの仕事です。コマンドを実行できる方はご自身で。できない方、実行したが次に何をすべきか分からない方は、私たちにご相談ください。無料です。