NombradIA

El índice de visibilidad en IA

Metodología v1

Esta página describe íntegramente cómo medimos. La metodología se congela por ediciones (constitución, regla 3): lo que se publica en una edición se midió con la versión aquí documentada en ese momento, y los cambios entre versiones quedan en el registro de cambios al pie. Versión v1 · vigente desde agosto de 2026.

Qué medimos

Dos cosas distintas, con dos instrumentos distintos:

  1. Preparación técnica («agent-readiness»): si la web de una marca puede ser leída y entendida por los asistentes de IA y sus rastreadores. Instrumento: el escáner técnico (abajo).
  2. Visibilidad real («share of voice»): con qué frecuencia y en qué posición los asistentes mencionan cada marca al responder preguntas reales de consumidores. Instrumento: el muestreo de respuestas (abajo). Se activa con la primera edición mensual.

El censo

Cada sector tiene un censo público de marcas y dominios. Criterio de inclusión: operar en España en el sector, con web propia activa. El censo se amplía continuamente —incluida cualquier marca que los propios asistentes mencionen y aún no esté censada—; ninguna marca puede pagar por entrar, salir o cambiar de sector. Sectores iniciales: software de facturación, seguros de coche y colchones de venta directa.

Escáner técnico: la nota 0–100

Un rastreador propio audita cada web del censo sin ejecutar JavaScript y sin eludir ninguna protección. Los pesos de la nota:

DimensiónQué comprobamosPeso
Acceso de rastreadores de IA Si robots.txt declara acceso a la portada para GPTBot (8), PerplexityBot (8), OAI-SearchBot (7), ClaudeBot (7) y Google-Extended (5). Sin robots.txt, la convención del protocolo es acceso permitido y así se puntúa.35
Contenido legible sin JavaScript Caracteres de texto visible que la portada sirve a un cliente que no ejecuta JS: ≥ 2.000 → 25 · ≥ 800 → 15 · ≥ 300 → 8 · menos → 0.25
Datos estructurados JSON-LD (schema.org) presente en portada (10) y con tipos sustantivos para un agente —Product, Offer, Organization, LocalBusiness, SoftwareApplication, FAQPage, Service, etc.— (10). Tipos puramente decorativos (WebSite, BreadcrumbList…) no puntúan el segundo tramo.20
llms.txtFichero /llms.txt real (un 200 que devuelve HTML no cuenta).10
SitemapDeclarado en robots.txt o presente en /sitemap.xml.7
FeedRSS/Atom enlazado en portada.3

Qué representa el censo, y qué no. El censo reúne las marcas con presencia reconocible en cada sector, no una muestra aleatoria del comercio electrónico español. Nuestras cifras describen a las marcas censadas de esos sectores y no deben leerse como «el X % de las webs españolas»: los líderes de un sector tienen equipos técnicos que la media del comercio online no tiene, así que sus resultados serán mejores que los del conjunto. Cuando publiquemos un dato sobre el país entero será con un censo diseñado para eso, y se dirá.

Fiabilidad de una sola pasada. Algunas webs responden de forma intermitente: la misma dirección rechaza el escaneo una vez y lo acepta cinco minutos después. Cada comprobación que falla por corte de red o rechazo temporal se reintenta antes de darla por negativa; un 404, que es una respuesta definitiva, no se reintenta. Y como esos rechazos van y vienen, la nota que publicamos es la del escaneo válido más reciente: si en alguna pasada su web nos respondió, esa es la medición que vale. Solo aparece como «no auditable» quien no nos ha dejado leerla ninguna vez. También descartamos las respuestas que no son la web de la marca —pantallas de verificación antibot y dominios aparcados en el registrador—, porque puntuarlas sería publicar la nota de otra página creyendo que es la suya.

Webs que rechazan el escaneo. Algunas webs responden a nuestro rastreador con un 401, 403 o 429: su cortafuegos rechaza a los clientes que no reconoce. Esas webs no reciben nota —no puntuamos a ciegas lo que no hemos podido leer— y aparecen en el censo indicando exactamente eso. Publicamos el hecho porque es informativo en sí mismo: un sitio que rechaza a los clientes que no identifica suele rechazar también a los rastreadores de las IAs, aunque su robots.txt diga lo contrario.

Limitaciones conocidas de v1, publicadas a propósito: (a) el escáner se identifica como un navegador corriente, no simula los user-agents de cada rastreador de IA, de modo que mide lo declarado en robots.txt más lo servido a un cliente sin JS; (b) solo audita la portada, no el resto del sitio; (c) no evalúa todavía la accesibilidad del proceso de compra para agentes. Las tres son candidatas a v2.

Muestreo de share of voice

El diseño de v1, que entra en vigor con la primera edición mensual:

Datos crudos y reproducibilidad

Cada respuesta muestreada se archiva íntegra (pregunta, respuesta completa, modelo, fecha, fuentes) y cada escaneo técnico guarda las respuestas HTTP originales. Publicamos con cada edición los agregados y el universo de preguntas; el archivo crudo completo se conserva de forma permanente y sustenta cualquier verificación o réplica.

Registro de cambios