Metodología v1
Esta página describe íntegramente cómo medimos. La metodología se congela por ediciones (constitución, regla 3): lo que se publica en una edición se midió con la versión aquí documentada en ese momento, y los cambios entre versiones quedan en el registro de cambios al pie. Versión v1 · vigente desde agosto de 2026.
Qué medimos
Dos cosas distintas, con dos instrumentos distintos:
- Preparación técnica («agent-readiness»): si la web de una marca puede ser leída y entendida por los asistentes de IA y sus rastreadores. Instrumento: el escáner técnico (abajo).
- Visibilidad real («share of voice»): con qué frecuencia y en qué posición los asistentes mencionan cada marca al responder preguntas reales de consumidores. Instrumento: el muestreo de respuestas (abajo). Se activa con la primera edición mensual.
El censo
Cada sector tiene un censo público de marcas y dominios. Criterio de inclusión: operar en España en el sector, con web propia activa. El censo se amplía continuamente —incluida cualquier marca que los propios asistentes mencionen y aún no esté censada—; ninguna marca puede pagar por entrar, salir o cambiar de sector. Sectores iniciales: software de facturación, seguros de coche y colchones de venta directa.
Escáner técnico: la nota 0–100
Un rastreador propio audita cada web del censo sin ejecutar JavaScript y sin eludir ninguna protección. Los pesos de la nota:
| Dimensión | Qué comprobamos | Peso |
|---|---|---|
| Acceso de rastreadores de IA | Si robots.txt declara acceso a la portada para GPTBot (8),
PerplexityBot (8), OAI-SearchBot (7), ClaudeBot (7) y Google-Extended (5).
Sin robots.txt, la convención del protocolo es acceso permitido y así se
puntúa. | 35 |
| Contenido legible sin JavaScript | Caracteres de texto visible que la portada sirve a un cliente que no ejecuta JS: ≥ 2.000 → 25 · ≥ 800 → 15 · ≥ 300 → 8 · menos → 0. | 25 |
| Datos estructurados | JSON-LD (schema.org) presente en portada (10) y con tipos sustantivos para un agente —Product, Offer, Organization, LocalBusiness, SoftwareApplication, FAQPage, Service, etc.— (10). Tipos puramente decorativos (WebSite, BreadcrumbList…) no puntúan el segundo tramo. | 20 |
| llms.txt | Fichero /llms.txt real (un 200 que devuelve HTML no
cuenta). | 10 |
| Sitemap | Declarado en robots.txt o presente en
/sitemap.xml. | 7 |
| Feed | RSS/Atom enlazado en portada. | 3 |
Qué representa el censo, y qué no. El censo reúne las marcas con presencia reconocible en cada sector, no una muestra aleatoria del comercio electrónico español. Nuestras cifras describen a las marcas censadas de esos sectores y no deben leerse como «el X % de las webs españolas»: los líderes de un sector tienen equipos técnicos que la media del comercio online no tiene, así que sus resultados serán mejores que los del conjunto. Cuando publiquemos un dato sobre el país entero será con un censo diseñado para eso, y se dirá.
Fiabilidad de una sola pasada. Algunas webs responden de forma intermitente: la misma dirección rechaza el escaneo una vez y lo acepta cinco minutos después. Cada comprobación que falla por corte de red o rechazo temporal se reintenta antes de darla por negativa; un 404, que es una respuesta definitiva, no se reintenta. Y como esos rechazos van y vienen, la nota que publicamos es la del escaneo válido más reciente: si en alguna pasada su web nos respondió, esa es la medición que vale. Solo aparece como «no auditable» quien no nos ha dejado leerla ninguna vez. También descartamos las respuestas que no son la web de la marca —pantallas de verificación antibot y dominios aparcados en el registrador—, porque puntuarlas sería publicar la nota de otra página creyendo que es la suya.
Webs que rechazan el escaneo. Algunas webs responden a nuestro rastreador con
un 401, 403 o 429: su cortafuegos rechaza a los clientes que no reconoce. Esas webs
no reciben nota —no puntuamos a ciegas lo que no hemos podido leer— y aparecen
en el censo indicando exactamente eso. Publicamos el hecho porque es informativo en sí mismo: un
sitio que rechaza a los clientes que no identifica suele rechazar también a los rastreadores de
las IAs, aunque su robots.txt diga lo contrario.
Limitaciones conocidas de v1, publicadas a propósito: (a) el escáner se identifica como un navegador corriente, no simula los user-agents de cada rastreador de IA, de modo que mide lo declarado en robots.txt más lo servido a un cliente sin JS; (b) solo audita la portada, no el resto del sitio; (c) no evalúa todavía la accesibilidad del proceso de compra para agentes. Las tres son candidatas a v2.
Muestreo de share of voice
El diseño de v1, que entra en vigor con la primera edición mensual:
- Universo de preguntas: 40–60 preguntas por sector, redactadas como pregunta un consumidor real, en cuatro categorías: recomendación abierta («¿qué programa de facturación me recomiendas?»), comparativa entre marcas, «mejor X para Y» (perfiles y casos de uso) y variantes locales por provincia donde aplique. El universo completo se publica y se congela por edición.
- Asistentes: ChatGPT (con búsqueda activada) y Perplexity en las primeras ediciones; Gemini y Claude en cuanto el presupuesto lo permita. Siempre vía API, con el modelo y la configuración exactos registrados por muestra.
- Muestras: cada pregunta se lanza entre 5 y 10 veces por asistente y edición, en días distintos del mes, porque las respuestas de los LLM varían entre ejecuciones. El tamaño de muestra exacto de cada edición se publica con ella.
- Extracción: de cada respuesta se extraen automáticamente las marcas mencionadas, su orden de mención y las fuentes citadas. La extracción la hace un modelo de lenguaje con instrucciones publicadas, y es revisable: la respuesta íntegra queda archivada.
- Métricas publicadas: share of voice (porcentaje de respuestas en las que aparece la marca), posición media de mención, y el ranking de fuentes más citadas por los asistentes en cada sector.
Datos crudos y reproducibilidad
Cada respuesta muestreada se archiva íntegra (pregunta, respuesta completa, modelo, fecha, fuentes) y cada escaneo técnico guarda las respuestas HTTP originales. Publicamos con cada edición los agregados y el universo de preguntas; el archivo crudo completo se conserva de forma permanente y sustenta cualquier verificación o réplica.
Registro de cambios
- v1 — agosto de 2026. Versión inicial: escáner técnico (pesos arriba) y diseño del muestreo. Sin ediciones publicadas todavía con esta versión.