Por qué un bloqueo invisible cuesta visibilidad
Cada vez más gente encuentra negocios a través de asistentes de IA que leen la web y citan fuentes. Para
aparecer en esas respuestas, tu sitio tiene que dejar entrar a los bots que recogen ese contenido. El problema
es que bloquearlos casi nunca es una decisión consciente: viene de una plantilla que traía esas directivas, de
una regla general que alguien puso pensando en otros bots, o de un servicio de seguridad que los bloqueó por
defecto. El dueño no lo sabe, y mientras tanto su sitio está invisible justo en el canal que más crece.
Esta herramienta existe para que esa decisión deje de ser un accidente. En segundos sabes qué bots de IA
tienes permitidos y cuáles bloqueados, y distingues si el bloqueo es específico o viene de la regla general,
porque la solución cambia según el caso. Si descubres que estás cerrando puertas sin querer, el siguiente paso
es generar un robots.txt correcto, y para eso tenemos el
generador de llms.txt y robots.txt.
La capa que el robots.txt no muestra
Hay una honestidad que esta herramienta no se salta: el robots.txt es solo una de las dos capas donde se puede
bloquear a la IA. La otra es la capa de red, y es la que casi nadie revisa. Servicios como Cloudflare ofrecen
opciones para bloquear a los bots de IA que actúan antes de que lleguen a tu sitio, devolviéndoles un error, y
ese bloqueo no aparece en ningún robots.txt por más que lo leas. Es perfectamente posible tener un robots.txt
impecable y seguir invisible para la IA porque Cloudflare la está frenando en la puerta.
Por eso, si esta herramienta te da verde pero usas Cloudflare u otro servicio de seguridad, todavía conviene
revisar sus reglas de bots de IA, que a veces se activan solas. Esa verificación a nivel de red no se puede
hacer desde el navegador —requiere probar el acceso con la identidad de cada bot— y es parte de lo que
revisamos en nuestro trabajo de AEO. Si quieres estar seguro de que nada te está bloqueando, en ninguna de las
dos capas, conversemos.
Preguntas frecuentes
¿Qué comprueba exactamente esta herramienta?
Lee tu robots.txt y te dice, bot de IA por bot de IA, si lo estás permitiendo o bloqueando. Revisa los rastreadores que más importan en 2026 —GPTBot y OAI-SearchBot de OpenAI, ClaudeBot, PerplexityBot, Google-Extended, y otros— y para cada uno indica si está bloqueado por una regla específica, bloqueado por la regla general que aplica a todos, o permitido. Así, en lugar de leer a mano un archivo lleno de directivas, ves de un vistazo qué puertas tienes abiertas y cuáles cerradas para la IA. Es la forma rápida de detectar si estás perdiendo visibilidad en buscadores de IA sin saberlo.
¿Por qué a veces no puede leer mi robots.txt automáticamente?
Por una restricción del navegador llamada CORS, que impide que una web lea directamente archivos de otro dominio. Lo intentamos primero de forma directa y, si falla, mediante un proxy público; pero algunos sitios bloquean ambos caminos, lo cual es perfectamente normal. Cuando eso pasa, la herramienta te lo dice con honestidad y te da un enlace para abrir tu propio robots.txt: solo tienes que copiar su contenido y pegarlo en la pestaña "Pegar robots.txt", que analiza exactamente igual. El resultado es el mismo, solo cambia cómo llega el archivo.
¿Si mi robots.txt sale limpio, seguro que no bloqueo a la IA?
No necesariamente, y esta es la advertencia más importante de la herramienta. El robots.txt es la capa declarativa —lo que tú le pides a los bots—, pero hay otra capa, la de red, donde servicios como Cloudflare pueden bloquear a los bots de IA antes de que lleguen a tu sitio, devolviéndoles un error. Ese bloqueo no aparece en el robots.txt, así que un robots.txt impecable puede convivir con un bloqueo de red que te deja igual de invisible. Si usas Cloudflare u otro servicio de seguridad, conviene revisar también sus reglas de bots de IA, que a veces se activan por defecto sin que el dueño se entere. Esa verificación a nivel de red la podemos hacer nosotros.
¿Qué significa "bloqueado por la regla general"?
Significa que ese bot no tiene una regla propia en tu robots.txt, pero le aplica la regla que vale para todos los bots —la que se escribe como User-agent dos puntos asterisco— y esa regla bloquea el acceso. Es una situación común y traicionera: alguien puso un bloqueo general pensando en otra cosa, y sin querer dejó fuera también a los bots de IA. La herramienta distingue ese caso del bloqueo específico —donde alguien nombró al bot a propósito— porque la solución es distinta: si es por la regla general, hay que permitir explícitamente a los bots de IA que sí quieres dejar entrar.
¿Debería desbloquear a todos los bots de IA?
Para casi todos los negocios que quieren visibilidad, sí: estar disponible para que ChatGPT, Perplexity o Gemini te lean y te citen es un canal de descubrimiento que crece. Si descubres que estás bloqueando a estos bots sin querer, lo más probable es que te convenga abrir. La excepción razonable es que quieras impedir el uso de tu contenido para entrenar modelos pero sí permitir que te citen: en ese caso se bloquean los bots de entrenamiento y se permiten los de búsqueda. Si quieres generar el robots.txt correcto según la política que elijas, tenemos una herramienta para eso: el <a href="/herramientas/generador-llms-txt/">generador de llms.txt y robots.txt</a>.
¿La herramienta guarda los dominios que verifico?
No. El análisis del robots.txt ocurre en tu navegador y no almacenamos los dominios que consultas ni asociamos nada contigo. Cuando hace falta el proxy público para leer un robots.txt, esa petición pasa por un servicio externo gratuito sobre cuyos registros no tenemos control, pero por nuestra parte no guardamos historial ni usamos los datos para nada más allá de mostrarte el resultado. Si prefieres no usar el proxy, puedes copiar tu robots.txt y pegarlo directamente, y entonces nada sale de tu navegador.