GEO-SCORE · BAREMO AEO ABIERTO

¿Puede la IA citar
tu sitio web?

21 comprobaciones escalonadas, 100 puntos. Un comando, unos 20 segundos. Licencia MIT y legible por máquina: cualquiera puede reproducir tu puntuación con el mismo método, incluidos tus competidores.

Puntúa tu propio sitio ahora mismo, sin instalar nada:

curl -sL https://raw.githubusercontent.com/jianruntech/geo-score/main/cli/geo_score.py \
  | python3 - tu-dominio.com --brief

Si sabes ejecutar un comando, ejecútalo. Si no, o lo ejecutaste y no sabes qué cambiar, deja que lo ejecutemos y te expliquemos el resultado. Sin cargo.

Solo biblioteca estándar, Python 3.8 o superior. También hay una GitHub Action que puede bloquear un despliegue si hay regresión.

Los cinco pilares del AIV BAREMO v1.1
Los cinco pilares del AIV Gráfico de barras horizontal; el eje horizontal es el peso en puntos, de 0 a 40. Rastreable 15, comprensible 22, contenido citable 35, credibilidad de marca 18, ajuste a la pregunta 10, total 100. Rastreable 15 Comprensible 22 Contenido citable 35 Credibilidad de marca 18 Ajuste a la pregunta 10 0510152025303540Peso (puntos)
Los cinco pilares suman 100. El contenido citable vale 35, la mayor parte, porque los motores de respuesta recuperan párrafos, no sitios: buscan un párrafo que se sostenga solo y se pueda citar directamente.

Tres umbrales: si falla uno, el resto no sirve de nada

Tres de las 21 comprobaciones son umbrales. Un cero en cualquiera de ellas y el resultado normalizado queda limitado a 40: no es una penalización, es un techo. Si esas tres fallan, da igual lo bien resueltas que estén las otras dieciocho: no llegan al motor.

¿Se permite a los rastreadores? robots.txt

Si en robots.txt se bloquea por nombre a los rastreadores de recuperación de IA, el contenido nunca entra en el índice del motor. A veces es una decisión editorial: que editoriales y sitios médicos decidan no ser citados es perfectamente razonable; el baremo lo registra tal cual y no lo llama error de configuración.

¿Pueden entrar los rastreadores? Alcance real

Sondeado con diez agentes de usuario reales de recuperación, uno a uno. Algunos sitios devuelven 200 al navegador y 403 al rastreador: el fallo que nadie nota, porque desde dentro de la empresa el sitio se ve bien.

¿Está el texto en el HTML? Renderizado en servidor

Cuando el texto solo existe después de ejecutar JavaScript, el rastreador recibe una cáscara vacía. El contenido está y el navegador lo muestra, pero el motor no puede leerlo. Este grupo es casi con seguridad involuntario.

314 sitios conocidos medidos: una cuarta parte no se puede citar en absoluto

La clasificación es una lista pública fija: 370 sitios listados, 314 medidos, al menos 10 sitios en cada uno de los 20 sectores; una mediana sectorial con menos no dice nada. Los datos brutos están en el repositorio y puedes repetir la medición tú mismo.

Los 80 sitios no citables de 314, agrupados por causa
CausaSitiosNaturaleza
Bloqueo por nombre en robots.txt19Decisión editorial: eligieron no ser citados
El texto solo existe tras ejecutar JS45Casi con seguridad involuntario
Errores servidos a los rastreadores16200 al navegador, 403 al rastreador; invisible desde dentro

Mediana 56, rango de 12 a 98. Los tres grupos suman 80 sitios, el 25 % de los medidos, y esa proporción se ha mantenido en 24–25 % en cinco muestras independientes, desde 38 sitios hasta 314.

Un dato más para quien se expande al exterior: los sitios orientados al mercado chino tienen una mediana de 40, el resto 59: 19 puntos de diferencia. En las cinco muestras la diferencia estuvo entre 16 y 23. La diferencia no está en la calidad del contenido, sino en si se puede leer.

Cinco niveles: una etapa, no un veredicto

Los benchmarks externos muestran que la mayoría de los sitios comerciales se sitúan entre 30 y 55. Una puntuación de cuarenta y pico es normal, no una alarma: significa que el sitio aún no se ha preparado para la recuperación por IA, no que esté mal hecho.

Rangos de puntuación y significado de los cinco niveles AIV
NivelPuntuaciónSignificado
Líder83–100Ventaja consolidada; el foco pasa a mantenerla y ampliarla
Base sólida66–82Cimientos completos; los huecos se concentran en profundidad de contenido y activos de marca
En crecimiento51–65Los elementos principales están en marcha; falta sistema y coherencia
Inicial31–50Huecos claros en lo básico, la mayoría resolubles en unos días de trabajo
Sin empezar0–30Nada preparado aún para la recuperación por IA; el mayor margen de mejora

Por qué se puede confiar en esta puntuación

De una herramienta de medición, lo primero que hay que poner en duda es su propia precisión. Por eso estas tres cosas están en el repositorio, a la vista de cualquiera.

  1. Los umbrales no se inventaron. El registro de calibración explica cómo se fijó cada límite de nivel y con qué cuatro referencias públicas se contrastó. También recoge un error que reconocimos: antes de publicar predijimos mal la distribución de puntuaciones, la medición nos desmintió y en el registro siguen las dos cifras.
  2. La reproducibilidad está medida, no declarada. Toda la clasificación se ejecutó dos veces y se comparó sitio por sitio: el 96 % queda dentro de ±5 y el 45 % es idéntico. Así que lee la puntuación de un sitio concreto como ±5; la mediana es estable. Lo inestable son las comprobaciones de umbral: cinco sitios cambiaron entre ejecuciones porque su protección antibots respondió distinto a los rastreadores. Datos completos
  3. Los errores que encontramos nosotros también están anotados. Por ejemplo, las redirecciones 307/308 no se seguían en Python anterior a 3.11, así que la puntuación de un sitio dependía de qué Python la ejecutaba; y una cabecera de petición con el inglés primero hacía que algunos sitios chinos devolvieran su edición internacional. Lo segundo no se resuelve cambiando cabeceras, así que el enfoque es registrar, no ocultar: el resultado indica qué dominio se midió realmente.
  4. Nuestra propia página de clasificación se mide con el mismo baremo. Actualmente 87, nivel Líder. La puntuación y los huecos son públicos, incluidos los puntos que aún faltan.

Ya has encontrado problemas. ¿Y ahora qué?

El baremo responde a una sola pregunta: si el motor puede citarte. Si lo hará depende de la competencia y de la intención de la consulta, algo que ninguna auditoría externa puede observar; por eso no prometemos ni posiciones ni volumen de citas. El repositorio tampoco da, a propósito, recomendaciones de corrección: la puntuación es abierta; la corrección es nuestro trabajo.

  1. Lectura rápida AIV gratuita. La ejecutamos y después hacemos la parte que el baremo no puede: qué huecos son reales y cuáles puedes ignorar, qué eslabón arreglar primero, si vale la pena. La puntuación en sí la puedes reproducir ejecutándola tú: para eso es el código abierto.
  2. Diagnóstico AEO · desde 760 €. Informe de línea base AIV + distancia con la competencia internacional + lista de acciones a 30 días. El informe es en sí una prueba de capacidad: tómalo y corrige por tu cuenta si lo prefieres.
  3. Acompañamiento integral + panel AIV. Comparación mes a mes, con una sola puntuación como lenguaje común. Los límites están a la vista: sin gestión de cuentas, sin cobro por resultados, sin promesa de sustituir personal.

Preguntas frecuentes

¿Esto es lo mismo que el SEO?

No es la misma pregunta. El SEO clásico pregunta en qué posición estás; los motores de respuesta no posicionan: recuperan párrafos, montan una respuesta y atribuyen fuentes.

Así que las condiciones para ser citado han cambiado: el texto tiene que estar en el HTML, el párrafo inicial tiene que sostenerse solo, las cifras necesitan fuente y el autor tiene que ser verificable. Las herramientas de SEO apenas comprueban nada de esto, porque en la lógica del posicionamiento no importa.

Conclusión Un sitio con buen SEO no necesariamente puntúa alto en AIV, y al revés también. En la clasificación abundan los dos casos.

¿Una puntuación baja significa que mi sitio es malo?

Normalmente no. La mediana de la clasificación es solo 56, y las puntuaciones de cuarenta y pico son normales. Una puntuación baja suele significar que el sitio nunca se ha preparado para la recuperación por IA, no que esté mal hecho; y las soluciones para una cosa y otra no tienen nada que ver.

Los sitios limitados a 40 por un umbral necesitan especialmente ver por qué: si el texto solo existe después de ejecutar JavaScript, tu contenido está bien, solo que el motor no puede leerlo; si robots.txt bloquea por nombre, puede que haya sido una decisión de tu propia empresa.

¿Por qué el repositorio no da recomendaciones de corrección?

Es deliberado. Lo abierto es la medición: el baremo, las comprobaciones, los criterios, los datos brutos; para que la puntuación se pueda verificar, reproducir y cuestionar.

Cómo corregir, qué corregir primero, cuántos días de trabajo, quién lo hace: eso es lo que entregamos. Mantener las dos cosas separadas es lo que permite que otros usen el baremo como estándar neutral, incluidos nuestros competidores.

¿Puedo reproducir yo mismo las puntuaciones de la clasificación?

Sí, ese es el objetivo del diseño. El baremo es legible por máquina y cada nivel indica cuántas de las 8 páginas muestreadas cumplen, así que dos personas que midan el mismo sitio obtienen la misma aritmética. Los datos brutos, el script de puntuación y el generador de páginas están en el repositorio.

Nota Una nueva ejecución varía ±5 de forma natural (cambian las páginas muestreadas, cambia la protección antibots). Al comparar dos sitios, no tomes una diferencia menor de 5 puntos como conclusión.

Mi sitio no está en la clasificación. ¿Se puede añadir?

Sí. El repositorio tiene una vía de envío específica que pide ejecutar la puntuación primero y pegar la línea de resultado. Nos faltan sobre todo sitios de sectores e idiomas poco cubiertos: sitios no anglófonos, sectores regulados, plataformas, medios.

Aviso Las puntuaciones son públicas, incluidas las bajas. Está indicado en la plantilla de envío, y puedes proponer sitios que no sean tuyos: todas las comprobaciones se ejecutan solo sobre URL públicas.

Si el baremo es de código abierto, ¿para qué pedirles una lectura rápida gratuita?

Porque el baremo produce números, no criterio. La puntuación que obtienes al ejecutarlo es la misma que obtenemos nosotros; ese es justamente el sentido de publicarlo como código abierto: cada punto que te damos se puede comprobar. La lectura rápida añade tres cosas que el baremo no puede hacer. Una, interpretar el resultado: una nueva ejecución varía ±5 de forma natural y las comprobaciones de umbral cambian con la política antibots del sitio, así que alguien tiene que distinguir los huecos reales del ruido. Dos, situarlo en tu negocio: cuál de los nueve eslabones arreglar primero; el baremo no tiene ni idea de qué vendes. Tres, decir si vale la pena arreglarlo y cuánto trabajo lleva: la puntuación es abierta, la corrección es nuestro trabajo. Si sabes ejecutar un comando, ejecútalo. Si no, o lo ejecutaste y no sabes qué hacer después, pregúntanos. Sin cargo.