Saltar al contenido

Por qué tu negocio no sale en ChatGPT: las causas, medidas en webs españolas

Por Salva Nadal · · Guías

Cuando un asistente de IA recomienda tres negocios y el tuyo no está, casi nunca es por una razón misteriosa. Cada noche auditamos las webs de tres sectores españoles (software de facturación, seguros de coche y colchones) y las causas se repiten. Aquí están, por orden de frecuencia, con la cifra de cuántas webs las tienen a día 5 de septiembre de 2026 y con ejemplos con nombre. Lo que no hemos medido todavía va marcado como hipótesis.

Antes de seguir: si todavía no has comprobado bien qué dice la IA de tu negocio (varias preguntas, varias veces, varios asistentes, sin tu nombre en la pregunta), empieza por cómo comprobarlo bien. Las causas de abajo explican por qué no sales; el dato de si sales o no hay que medirlo antes.

De dónde salen estas cifras

Censo del 05/09/2026: 203 webs censadas, 189 auditadas (66 de software de facturación, 66 de seguros de coche y 71 de colchones de venta directa; 14 no se pudieron auditar, ver la causa 5). El escáner lee solo la portada, sin ejecutar JavaScript y sin hacerse pasar por un navegador, y mide lo mismo en todas: si el robots.txt deja pasar a los rastreadores de IA, cuánto texto se lee sin JavaScript, si hay datos estructurados y si publica llms.txt, sitemap y feed. Los datos completos están en /estadisticas/ y en /datos/ (CSV y JSON, CC BY 4.0), y el método en la metodología.

Causa 1: tu web le cierra la puerta a la IA (11 de 189, el 6 %)

Los asistentes que buscan en internet usan rastreadores con nombre y apellido: GPTBot y OAI-SearchBot (OpenAI), ClaudeBot (Anthropic), PerplexityBot, Google-Extended. Si tu robots.txt les dice que no entren, no entran, y no pueden recomendar lo que no han leído. El 05/09/2026, 11 de las 189 webs auditadas bloqueaban al menos a uno de esos cinco. ClaudeBot era el más bloqueado (10 webs), seguido de GPTBot (9), Google-Extended (6), PerplexityBot (3) y OAI-SearchBot (2).

Con nombres: Sumex, un fabricante de colchones, bloquea a los cinco y tiene la nota más baja del censo (18 sobre 100). Relax también bloquea a los cinco, con una web que por lo demás está bien hecha (8.561 caracteres legibles y datos estructurados). Generali bloquea a GPTBot y a ClaudeBot. En el sector de colchones son 7 de 68 las que bloquean; en facturación y en seguros, 2 de cada uno.

Un matiz que importa: la mayoría de estos bloqueos apuntan a GPTBot, que OpenAI usa para entrenar sus modelos, y no a OAI-SearchBot, que es el que ChatGPT usa cuando busca para responder a un cliente. Solo 2 webs bloquean a OAI-SearchBot. Es decir: casi todas las que cierran la puerta lo hacen a medias, probablemente porque copiaron una lista de bloqueo de 2023 sin saber lo que hacía. Nuestra hipótesis, pendiente de medir con el muestreo de respuestas, es que bloquear a GPTBot pesa menos hoy de lo que parece y bloquear a OAI-SearchBot o PerplexityBot pesa mucho más.

Cómo verlo en tu web: abre tudominio.es/robots.txt y busca las líneas User-agent: GPTBot o similares seguidas de Disallow: /. Tu ficha en nuestro censo lo dice en la primera línea.

Causa 2: tu portada está vacía para quien no ejecuta JavaScript (14 de 189, el 7 %)

Muchas webs se pintan enteras con JavaScript: el servidor manda un esqueleto y el navegador del visitante monta el texto. Un rastreador de IA, en general, no ejecuta ese JavaScript o no espera a que termine; lee lo que llega del servidor. Si lo que llega es un esqueleto, para la IA tu web no dice nada.

El 05/09/2026, 14 de las 189 webs auditadas servían menos de 500 caracteres de texto legible en su portada sin JavaScript. Nueve servían exactamente cero, y no son webs pequeñas: siete de seguros de coche, Roams (comparador; nota 72 gracias al resto de señales), Tuio, Occident, Seguros Bilbao, Plus Ultra, Unión Alcoyana y SegurosBroker; y dos de software de facturación, Storyous y Aplifisa. En el otro extremo, la mediana del censo es de 8.428 caracteres legibles en portada.

Esto lo aprendimos antes en casa que en el censo: otro proyecto nuestro servía 518 caracteres en su página principal porque todo lo pintaba JavaScript; al servir el texto desde el servidor, las páginas indexables pasaron de 48 a 426 en dos días. La prueba es la misma para cualquiera: desde una terminal, curl https://tudominio.es/, y mira si el texto de tu portada aparece. Si solo ves etiquetas y ficheros .js, esta es tu causa.

Causa 3: no le dices a la IA qué eres, dónde estás ni qué vendes (51 de 189, el 27 %)

Los datos estructurados (schema.org) son un bloque en el código de la web que declara, en un formato que las máquinas leen sin ambigüedad, qué es el negocio, cómo se llama, dónde está, qué horario tiene, qué vende y a qué precio. El 05/09/2026, 51 de las 189 webs auditadas no declaraban ni un solo tipo de schema.org en su portada. Por sectores, la diferencia es grande: en seguros de coche, 26 de 59 (el 44 %); en colchones, 15 de 68 (el 22 %); en software de facturación, 10 de 62 (el 16 %).

Cuando existe, lo más habitual es lo mínimo: Organization (113 webs) y WebSite (107). Solo 42 declaran una dirección postal y 17 una oferta con precio. El ejemplo de web completa está en el propio censo: Gomarco, nota 100, declara organización, migas de pan, buscador interno e imágenes, y además publica llms.txt, sitemap y feed.

Que un asistente lea el schema no garantiza que te recomiende, y es honesto decirlo así. Lo que sí hemos comprobado, en el caso de las floristerías de Valencia que medimos el 30/08/2026, es que las diferencias entre webs son enormes en lo que un asistente puede entender de ellas: una de las floristerías más recomendadas declaraba su horario en formato estructurado en 26 de sus 26 páginas; otra lo tenía como texto suelto en 9 de 25 páginas y en ningún formato legible por máquina, con un enlace de portada que devolvía un error 404 y el mismo título repetido en 9 páginas. Nuestra hipótesis es que esa diferencia de legibilidad acaba pesando en quién sale y quién no; la vamos a medir edición a edición.

Causa 4: no estás en las páginas que la IA lee para responder (hipótesis con dato)

Esta es la causa que menos depende de tu web y más de fuera de ella. Cuando un asistente busca para responder, no lee tu web primero: lee las páginas que el buscador le devuelve para la pregunta del cliente, y de ahí saca los nombres. En las 10 respuestas sobre floristerías en Valencia del 30/08/2026, las fuentes más citadas fueron tripadvisor.es, interflora.es, tusfloristas.com, valenciasecreta.com, salir.com y espanafloristeria.com, cinco veces cada una. Las webs de las propias floristerías se citaron mucho menos.

Traducido: si tu negocio no está en los directorios, comparadores, guías locales y medios que la IA lee para tu tipo de pregunta, el asistente no tiene de dónde sacar tu nombre, por buena que sea tu web. Cuáles son esas páginas cambia con cada sector y cada ciudad. Lo marcamos como hipótesis porque tenemos las fuentes de un sector en una ciudad, no de todos; el hecho es que, en ese caso, la IA citó más a los directorios que a las webs propias.

Causa 5: tu web bloquea a quien no reconoce (14 de 203 no se pudieron auditar)

14 webs del censo no tienen nota porque respondieron con un error 403 («prohibido») a nuestro escáner, que se identifica como lo que es y no finge ser un navegador. Entre ellas hay grandes marcas: Allianz, Sage, Wolters Kluwer, Santalucía, SegurCaixa Adeslas. Lo curioso es que varias de esas webs responden con normalidad desde una conexión doméstica y solo rechazan la petición cuando viene de un servidor de un centro de datos, que es exactamente desde donde piden las páginas los asistentes de IA.

No podemos afirmar que esas 14 estén invisibles para ChatGPT (hipótesis: depende de qué rastreadores tenga cada cortafuegos en su lista blanca). El hecho medido es que un cliente que se identifica y pide la portada desde un servidor recibe un 403. Si tu web tiene un cortafuegos «anti-bots» agresivo, comprueba qué hace con los rastreadores de IA.

«La IA no encuentra mi negocio»: cuando el problema no es la web, es que no hay web

Hay un caso anterior a todas las causas de arriba: el negocio no tiene web propia. Solo Instagram, o un perfil de Google, o una página en un directorio. Nos pasó con la primera floristería que quiso medirse con nosotros: en su ciudad no hay ningún dominio suyo que auditar. Para un asistente que busca, ese negocio existe solo si alguien más lo nombra (un directorio, una reseña, un medio local), y con el nombre que ese alguien haya usado.

Ahí, lo que está en tu mano es una hipótesis razonable que todavía no hemos medido: el mismo nombre, dirección y teléfono escritos igual en todos los sitios donde apareces; una descripción de lo que haces y dónde, con la ciudad, en cada perfil; y, cuando puedas, una web mínima con texto legible sin JavaScript. Que la IA te nombre por ello no está en tu mano: nadie puede prometer lo que responde una IA.

Qué hacer con esto

Las causas 1, 2 y 3 se ven en tu web en diez minutos y se arreglan sin pagar a nadie: abrir el robots.txt, hacer un curl a la portada y mirar si hay un bloque schema.org. Si tu negocio está en uno de los tres sectores del censo, tu ficha ya lo dice, con la nota y el desglose: búscala en el censo de software de facturación, seguros de coche o colchones, y si es tuya, reclámala (es gratis y no cambia la nota). Las causas 4 y 5 requieren mirar fuera de tu web, y ahí es donde una medición con fuentes te dice a qué páginas ir.

Arreglar las cinco causas no te pone en la respuesta: te quita los motivos por los que seguro no estabas. Lo que pase después se mide, no se promete.

Preguntas rápidas

¿Cómo sé si mi web bloquea a ChatGPT?

Abre tudominio.es/robots.txt en el navegador y busca «GPTBot», «OAI-SearchBot», «ClaudeBot» o «PerplexityBot» seguidos de «Disallow: /». Si tu web está en nuestro censo, la ficha lo indica en la primera línea. El 05/09/2026 lo hacían 11 de 189 webs auditadas.

¿Mi web con mucho JavaScript es invisible para la IA?

Depende de lo que sirva el servidor antes de ejecutarlo. Prueba con curl desde una terminal: si el texto de tu portada está en la respuesta, bien; si solo hay etiquetas y ficheros .js, la IA lee una página vacía. 14 de 189 webs auditadas servían menos de 500 caracteres; 7, cero.

¿Basta con arreglar la web para que ChatGPT me recomiende?

No. En las 10 respuestas sobre floristerías de Valencia que medimos, la IA citó más a directorios y guías (tripadvisor.es, interflora.es, tusfloristas.com) que a las webs de las floristerías. La web es la condición; estar en las fuentes que la IA lee es el resto, y nadie puede garantizar el resultado.

Cifras: censo agent-readiness de nombradia.com, medición del 05/09/2026 (203 webs censadas, 189 auditadas; fichero censo.json, campos rastreadores_bloqueados, texto_sin_js y schema_org). Fuentes citadas y comparación de floristerías: 30/08/2026 (10 respuestas; rastreo de 25 páginas por web con nuestro rastreador). Las notas de las fichas cambian cada noche. Todo lo llamado hipótesis está pendiente de medir.

¿Y tu negocio?

Comprueba gratis qué responde la IA en tu sector y tu zona, y si tu web se puede leer: míralo en un minuto. Y si quieres que lo midamos cada semana y te digamos qué hacer, mira los planes.

Boletín El índice: tres datos medidos cada mes, sin publicidad. Pídelo a hola@nombradia.com.