Herramienta gratuita
¿Puede la IA leer tu web?
Cuando alguien le pregunta a ChatGPT por un servicio como el tuyo, la respuesta sale de webs que esos sistemas han conseguido leer. Muchas no lo consiguen y sus dueños no lo saben, porque en pantalla se ven perfectas. Esto lo comprueba en unos segundos, gratis y sin registro.
El criterio
La mitad de la nota es una sola cosa
Hay herramientas que te puntúan contra quince estándares emergentes. Casi ninguno lo consume nadie todavía. Este análisis reparte el peso según lo que hoy te cuesta clientes de verdad.
50%
Contenido legible
Si tu texto está en el HTML o solo aparece después de ejecutar JavaScript. Es lo único de la lista que ya te está costando visibilidad hoy.
25%
Descubrimiento
robots.txt, sitemap y llms.txt: los archivos que le dicen a un agente qué tienes y dónde.
15%
Acceso de bots
Si estás dejando entrar (o bloqueando por error) a los rastreadores de OpenAI, Anthropic, Google y Perplexity.
10%
Protocolos
Estándares en borrador. Pesan poco a propósito, porque hoy casi nadie los consume.
Lo que no cuenta
Tres cosas que otros puntúan y aquí casi no
No porque sean falsas, sino porque describen capacidades que la mayoría de webs no tiene ni necesita. Declararlas en vacío no te hace más «agent ready», te hace menos fiable.
Los protocolos de pago para agentes
x402, ACP, UCP y compañía dejan que un agente pague por ti. Suenan a futuro y aparecen en todos los checklists. Si tu web no vende online, no aplican, y montarlos implica wallet con criptomonedas o pasarela de pago con comisión. Declararlos sin soportarlos es peor que no tenerlos.
Las tarjetas de servidor MCP
Anunciar un servidor MCP tiene sentido si tienes una API que un agente pueda usar. Para una web de servicios, es publicar la dirección de una oficina que no existe. Primero el endpoint, después el anuncio.
Los registros DNS de agente
Un TXT en _agent.tudominio.com dice dónde está tu endpoint y qué protocolo habla. Igual que el anterior: útil cuando hay algo detrás, decorativo cuando no. Por eso aquí vale 4 puntos sobre 100 y no la mitad del informe.
FAQ
Preguntas Frecuentes
¿Qué significa que una web sea «legible para la IA»?
Que un programa pueda entender qué ofreces sin ser una persona mirando una pantalla. En la práctica se reduce a tres cosas: que tu texto esté en el HTML que devuelve el servidor, que declares quién eres con datos estructurados, y que no estés bloqueando por error a los rastreadores que alimentan a ChatGPT, Claude o Perplexity.
¿Por qué el contenido detrás de JavaScript es un problema?
Porque los rastreadores que alimentan los modelos de lenguaje, en su mayoría, descargan el HTML y ahí se quedan: no ejecutan JavaScript como hace tu navegador. Si tu web monta el contenido en el cliente, tú la ves perfecta y ellos ven una página vacía. Google sí renderiza JavaScript, con retraso y de forma imperfecta; los demás normalmente no. Por eso este check pesa la mitad de la nota.
¿Debería bloquear los bots de IA en mi robots.txt?
Depende de cuál, y la diferencia importa. Los bots de búsqueda (OAI-SearchBot, Claude-User, PerplexityBot) son los que leen tu web para citarte con enlace en una respuesta: bloquearlos es renunciar a esas visitas. Los bots de entrenamiento (GPTBot, ClaudeBot, Google-Extended, CCBot) usan tu contenido para entrenar modelos, y ahí bloquear es una decisión legítima. El error frecuente es bloquear los primeros creyendo que se bloquean los segundos.
¿Qué es llms.txt y hace falta de verdad?
Es un archivo de texto en la raíz de tu dominio con un índice en markdown de lo que ofreces, pensado para que lo lea un modelo. Seamos honestos: hoy ningún proveedor grande ha confirmado que lo consuma. Cuesta un archivo y sirve para elegir cómo te resumen si algún día se generaliza, por eso está en la lista, pero pesa poco y quien te lo venda como urgente te está vendiendo humo.
¿Guardáis mi dominio o los resultados?
No. El análisis se hace en el momento, se te devuelve y no se almacena nada: ni el dominio, ni el informe, ni tu IP más allá del límite temporal que evita que alguien abuse del servicio. Tampoco hay que registrarse ni dejar un email.
¿Qué descarga exactamente el analizador de mi web?
Cinco archivos públicos, siempre los mismos: la portada, /robots.txt, /llms.txt, /sitemap.xml y /.well-known/security.txt. Además consulta si existe un registro TXT en _agent.tudominio.com. Se identifica con el user-agent NazarcodeAgentScan y no envía formularios, no inicia sesión ni toca nada que no sea público.
¿Prefieres que lo revisemos contigo? Somos una agencia de desarrollo web en Granada y también hacemos posicionamiento SEO. Nuestra propia web pasa este mismo análisis.