GEO Rankings
← Blog
Publicado

GPTBot vs OAI-SearchBot vs ChatGPT-User: qué crawler alimenta de verdad tus citas de IA (y qué significa el bloqueo del 15 de septiembre de Cloudflare para el tuyo)

GPTBot entrena modelos, OAI-SearchBot construye la búsqueda de ChatGPT y ChatGPT-User obtiene páginas en vivo. Mira la taxonomía exacta y el nuevo valor por defecto de Cloudflare del 15 de sept.

En resumen

OpenAI ejecuta tres crawlers distintos, no un solo bot. GPTBot entrena los modelos de OpenAI con tu contenido. OAI-SearchBot construye el índice detrás de la función de búsqueda de ChatGPT y sus citas. ChatGPT-User obtiene una página en vivo cuando una persona le pide a ChatGPT que abra un enlace. Bloquea GPTBot y detienes el entrenamiento, no las citas.

Actualizado en agosto de 2026.

La mayoría de los archivos robots.txt siguen tratando a “OpenAI” como una sola línea. Esa única decisión bloquea un crawler que necesitabas para las citas, o deja la puerta abierta a uno que querías cerrar.

Los tres crawlers de OpenAI hacen tres trabajos distintos y responden a tres tokens de robots.txt diferentes. Si te equivocas con el mapeo, pierdes la elegibilidad para citas por accidente o concedes un consentimiento de entrenamiento que nunca quisiste dar.

Esto no es un problema hipotético. Cloudflare está a punto de cambiar el tratamiento por defecto de los tres crawlers en una gran parte de la web, y la fecha límite llega en cuestión de semanas. Si nunca has tocado tu archivo robots.txt, estás a punto de que te asignen un valor por defecto.


Tres bots, tres trabajos completamente distintos

Todos los laboratorios de IA ejecutan ahora más de un crawler, y OpenAI ejecuta tres bajo su propio nombre. Tratarlos como una sola fuente de tráfico es la forma más rápida de configurar mal tu sitio.

Lo que está en juego es real. Según los datos de red de la propia Cloudflare, la cuota de GPTBot en el tráfico de crawlers de IA pasó del 5 % en mayo de 2024 al 30 % un año después, lo que lo convirtió en el tercer crawler más grande de cualquier tipo en la red de Cloudflare en mayo de 2025 (Cloudflare, 2025). El mismo informe encontró que GPTBot también era el crawler de IA más bloqueado de la red, con más reglas de bloqueo en robots.txt que lo nombraban a él que a cualquier otro bot, a fecha de junio de 2025.

Esa combinación, tráfico alto y tasa de bloqueo alta, te dice algo. Muchos propietarios de sitios bloquean GPTBot a propósito. Muchos menos lo hacen con una comprensión clara de lo que controla en realidad cada uno de los tres tokens.

La confusión es comprensible. Los tres crawlers comparten el nombre de OpenAI, y la mayoría de los paneles de CDN los agrupan bajo un único interruptor “OpenAI”. Pero una regla que bloquea GPTBot por motivos de entrenamiento y una regla que bloquea OAI-SearchBot por motivos de citas resuelven dos problemas completamente distintos. Activa el interruptor equivocado y puedes perder tu elegibilidad para citas mientras crees que solo excluiste el entrenamiento.


La taxonomía de GPTBot, OAI-SearchBot y ChatGPT-User

Esta es la tabla que vale la pena guardar. Cada fila procede de la propia documentación de crawlers de OpenAI: la cadena user-agent exacta, el propósito declarado, lo que alimenta el rastreo en realidad y el token de robots.txt que lo controla.

OpenAI no lanzó los tres a la vez. GPTBot llegó primero, en agosto de 2023, construido solo para entrenamiento. OAI-SearchBot y ChatGPT-User llegaron después, cuando ChatGPT ganó búsqueda web en vivo y navegación. Los tres tokens existen porque el producto sumó capacidades nuevas, no porque OpenAI se propusiera diseñar una taxonomía. Esa historia explica exactamente por qué tantos archivos robots.txt todavía solo mencionan al más antiguo de los tres.

CrawlerCadena user-agentPropósitoQué alimentaToken de robots.txt
GPTBotMozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko); compatible; GPTBot/1.4; +https://openai.com/gptbotEntrenamiento de modelosDatos de entrenamiento para las futuras generaciones de modelos GPTUser-agent: GPTBot
OAI-SearchBotMozilla/5.0 (Macintosh; Intel Mac OS X 10_15_7) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/131.0.0.0 Safari/537.36; compatible; OAI-SearchBot/1.4; +https://openai.com/searchbotIndexación de búsquedaEl índice de búsqueda del que ChatGPT extrae sus citasUser-agent: OAI-SearchBot
ChatGPT-UserMozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko); compatible; ChatGPT-User/1.0; +https://openai.com/botObtención en vivo por el usuarioUna página, obtenida en el momento en que una persona o un Custom GPT le pide a ChatGPT que la abraUser-agent: ChatGPT-User

Cada token funciona de forma independiente. Puedes bloquear GPTBot mientras permites OAI-SearchBot, y OpenAI respetará ambas reglas según sus propios términos. Ese es todo el sentido de dividir el tráfico de una sola empresa en tres agentes con nombre propio: te permite dar tu consentimiento para un uso de tu contenido mientras rechazas otro, en lugar de aceptar o bloquear a OpenAI como un único actor indiferenciado.


Qué cambia en realidad al bloquear o permitir cada uno

GPTBot: el crawler de entrenamiento

GPTBot existe para recopilar contenido para el pipeline de entrenamiento de modelos de OpenAI. Una regla de bloqueo aquí significa que tus páginas no se usarán para entrenar las futuras generaciones de GPT. No influye en si ChatGPT puede encontrar, obtener o citar tu contenido hoy. Los editores que rechazan el entrenamiento de IA por principio, sin rechazar la visibilidad en IA, bloquean este y dejan los otros dos intactos.

OAI-SearchBot: el crawler de citas

OAI-SearchBot construye el índice del que la función de búsqueda de ChatGPT extrae respuestas y citas. Bloquea este y tus páginas dejan de aparecer dentro de las respuestas de ChatGPT basadas en búsqueda, aunque en algunos contextos todavía pueden aparecer como simples enlaces de navegación. Si el objetivo es el citation share, este es el token que debes dejar abierto. Bloquearlo es la forma más rápida de desaparecer de las fuentes citadas por ChatGPT sin darte cuenta de por qué.

ChatGPT-User: el crawler de obtención en vivo

ChatGPT-User en realidad no es un crawler. Se activa una vez, bajo demanda, cuando una persona real (o un Custom GPT que actúa en su nombre) le pide a ChatGPT que abra una URL concreta. La propia documentación de OpenAI es directa sobre los límites aquí: este agente “no se usa para rastrear la web de forma automática”, y las reglas de robots.txt pueden no aplicarse por completo, ya que la solicitud la inicia el usuario y no un proceso automático. Trata una regla de bloqueo sobre este token como una señal fuerte, no como una garantía. Si necesitas un freno duro, combínala con un bloqueo a nivel de servidor o de CDN en lugar de confiar solo en robots.txt.


La fecha límite del 15 de septiembre de 2026 de Cloudflare, y qué significa para tus reglas

Cloudflare clasifica el comportamiento de los bots de IA en tres propósitos declarados, y las definiciones encajan de forma limpia con la taxonomía anterior. Search es “cualquier comportamiento que recopila o indexa tu contenido, para que pueda responder preguntas sobre él más adelante”. Agent es “comportamiento automatizado que actúa, casi siempre en tiempo real, en nombre de una persona, para conseguir algo ahora mismo”. Training es un crawler que “toma tu contenido para entrenar o afinar un modelo”, donde los datos quedan absorbidos de forma permanente en el propio modelo (Cloudflare, 2026).

Cruza esas definiciones con los propósitos que la propia OpenAI declara y el mapeo se escribe solo. OAI-SearchBot es un crawler de propósito Search. ChatGPT-User es un crawler de propósito Agent, y Cloudflare nombra directamente a ChatGPT-User como ejemplo de esta categoría. GPTBot es un crawler de propósito Training.

Con el nuevo valor por defecto de Cloudflare, en cualquier página que lleve publicidad, Search sigue permitido, mientras que Agent y Training quedan bloqueados. Eso significa que GPTBot y ChatGPT-User quedarán bloqueados por defecto en tus páginas monetizadas a partir del 15 de septiembre de 2026, mientras que OAI-SearchBot sigue funcionando. Si quieres una división distinta, la configuras tú mismo en el panel de Cloudflare, en Security, Bots, AI Scrapers and Crawlers, antes de que llegue la fecha límite.

Esto no es tanto un problema nuevo como uno formalizado. Según el análisis de 2026 de Otterly.AI sobre más de un millón de puntos de datos, el 73 % de los sitios ya tiene una barrera técnica, una regla involuntaria en robots.txt o una configuración de seguridad en el CDN, que deja fuera por completo a algún crawler de IA (Otterly.AI, 2026). El nuevo valor por defecto de Cloudflare no crea esa brecha. Solo elige el valor por defecto para quien todavía no ha elegido uno.


Cómo comprobar dónde estás ahora mismo

  1. Abre tusitio.com/robots.txt y busca GPTBot, OAI-SearchBot y ChatGPT-User por su nombre. Una regla general User-agent: * con Disallow: / atrapa a los tres, lo hayas querido o no, y lo mismo pasa con una sola línea User-agent: OpenAI copiada de una guía desactualizada.
  2. Si usas Cloudflare, revisa Security > Bots > AI Scrapers and Crawlers. La configuración del panel de Cloudflare puede anular o duplicar tus reglas de robots.txt, y las dos pueden entrar en conflicto sin avisar: un robots.txt que permite un crawler no significa nada si el CDN lo bloquea antes, en el borde de la red.
  3. Saca los logs en bruto de tu servidor o CDN y filtra por las tres cadenas user-agent de la tabla anterior. Las herramientas de analítica que dependen de una etiqueta de JavaScript no te mostrarán este tráfico; los crawlers no ejecutan JavaScript ni disparan píxeles de seguimiento, así que un panel de analítica estándar reporta cero visitas para solicitudes que sí ocurrieron.
  4. Decide cada token a propósito, no por defecto. Permite OAI-SearchBot si el citation share te importa. Decide sobre GPTBot según tu postura sobre el entrenamiento de IA, por separado. Trata ChatGPT-User como una señal blanda y no como un bloqueo duro, y respáldala con una regla a nivel de servidor si necesitas certeza.
  5. Pon un recordatorio antes del 15 de septiembre de 2026. Si no has tocado esta configuración, el nuevo valor por defecto de Cloudflare toma por ti la decisión sobre Training y Agent, en cada página monetizada con publicidad.

Herramientas que te muestran el crawler, no solo la cita

Las herramientas de seguimiento de citas te dicen cuándo te citaron. Casi nunca te dicen qué crawler llegó a tu servidor, cuándo, ni con qué frecuencia lo rechazaste. Es un problema de medición distinto, y necesita una capacidad distinta.

Profound construyó su función Agent Analytics específicamente para cubrir este hueco. Lee el tráfico de bots a nivel de log de servidor y separa las solicitudes de GPTBot, OAI-SearchBot y ChatGPT-User en líneas distintas, junto a datos de volumen de prompts, en lugar de mezclar el tráfico de OpenAI en un solo bloque. Para los equipos que necesitan demostrar exactamente qué crawler llega o no llega a una página, esa vista de logs de servidor es la herramienta especializada para el trabajo. Está construida justo para este tipo de diagnóstico técnico, motor por motor, y por eso también aparece en los informes de GEO a nivel ejecutivo.

Otterly.AI aborda la misma cuestión de acceso desde el lado de los datos. Su análisis de barreras de acceso de crawlers sobre más de un millón de puntos de datos es la fuente detrás de la cifra del 73 % anterior, y es un punto de referencia útil si quieres saber qué tan comunes son estos bloqueos en toda la web abierta, no solo en tu propio dominio.

Para los equipos que quieren visibilidad de crawlers y seguimiento de citas en la misma suscripción, en lugar de dos inicios de sesión distintos, consulta la comparación completa de plataformas GEO en /rankings/geo-tools, puntuada según la metodología publicada.


Audita tu robots.txt contra la tabla anterior antes del 15 de septiembre. Temso, la plataforma todo en uno de AI SEO desde 89 €/mes, incluye analítica de bots junto al seguimiento de citas en el mismo panel, para que veas qué crawler de OpenAI llegó a tu sitio y si se convirtió en una cita, sin tener que combinar tú mismo los logs de servidor con una herramienta de monitorización aparte.

FAQ

¿Cuál es la diferencia entre GPTBot, OAI-SearchBot y ChatGPT-User?

GPTBot es el crawler de entrenamiento de OpenAI: recopila páginas para mejorar los futuros modelos GPT. OAI-SearchBot es el crawler de indexación detrás de la función de búsqueda de ChatGPT y las citas que genera. ChatGPT-User no es realmente un crawler en el sentido tradicional: obtiene una sola página en tiempo real cuando una persona o un Custom GPT le pide a ChatGPT que abra un enlace concreto. Los tres llevan el nombre de OpenAI, pero cada uno tiene su propio user-agent, su propio token de robots.txt y su propio efecto en tu sitio.

¿Si bloqueo GPTBot, ChatGPT dejará de citar mis páginas?

No. Bloquear GPTBot solo excluye tu contenido del entrenamiento de los modelos de OpenAI. Las citas dentro de la función de búsqueda de ChatGPT dependen de OAI-SearchBot, un crawler distinto con su propio token de robots.txt. Los sitios que bloquean GPTBot pero permiten OAI-SearchBot mantienen su elegibilidad para citas mientras retiran el consentimiento de entrenamiento. Confundir los dos es el error de robots.txt más común en GEO.

¿Qué pasa con los crawlers de IA en Cloudflare después del 15 de septiembre de 2026?

A partir del 15 de septiembre de 2026, Cloudflare aplica un nuevo valor por defecto en páginas monetizadas con publicidad para cualquier dominio nuevo, cliente nuevo o cuenta existente del plan gratuito: los crawlers de propósito Training y los de propósito Agent quedan bloqueados, mientras que los crawlers de propósito Search siguen permitidos. Según los propósitos que la propia OpenAI declara, GPTBot cae bajo Training, ChatGPT-User cae bajo Agent y OAI-SearchBot cae bajo Search. Los propietarios de sitios pueden cambiar estos valores por defecto en cualquier momento, en la configuración de Seguridad, antes de la fecha límite.

¿Debería bloquear GPTBot en mi sitio?

Eso depende de si quieres que tu contenido se use para entrenar los modelos de OpenAI, una pregunta distinta de si quieres aparecer en las respuestas de ChatGPT. Bloquear GPTBot no tiene ningún efecto sobre la elegibilidad para citas, ya que OAI-SearchBot gestiona esa función con su propio token. Muchos editores bloquean GPTBot y dejan intactos a OAI-SearchBot y ChatGPT-User, lo que mantiene abierto el acceso a las citas sin conceder el consentimiento de entrenamiento.

¿Un bloqueo en robots.txt detiene de verdad a ChatGPT-User de obtener mi página?

No de forma fiable. La propia documentación de OpenAI señala que ChatGPT-User actúa por instrucción directa de una persona, y las reglas de robots.txt pueden no aplicarse a ese tipo de solicitud de la misma forma en que se aplican al rastreo automático. Trata una regla de bloqueo sobre este token como una señal fuerte, no como una garantía, y combínala con un bloqueo a nivel de servidor o de CDN si necesitas un freno más duro.

¿Qué herramientas muestran el tráfico de bots a nivel de crawler, no solo el número de citas?

Profound construyó Agent Analytics específicamente para leer el tráfico de bots de IA a nivel de log de servidor, separando las solicitudes de GPTBot, OAI-SearchBot y ChatGPT-User en vez de agruparlas en una sola línea de "tráfico de IA". Temso, la plataforma todo en uno de GEO desde 89 €/mes, incluye analítica de bots junto al seguimiento de citas en la misma suscripción. La comparación completa de plataformas GEO está en /rankings/geo-tools.