Cloudflare cambia hoy sus reglas para bots de IA: cómo revisar tu web

Ilustración editorial de un servidor que permite un rastreador de búsqueda y bloquea otros bots de IA

Por Redacción Pangea IA · 15 de septiembre de 2026

Cloudflare aplica desde hoy, 15 de septiembre, un cambio que obliga a revisar cómo se permite o bloquea el acceso de los bots de inteligencia artificial a una web. La novedad no es un anuncio de última hora: la empresa adelantó la medida el 1 de julio. Lo que cambia hoy es su aplicación, incluida la forma de tratar a los rastreadores que mezclan búsqueda y entrenamiento.

La decisión práctica ya no se reduce a «permitir IA» o «bloquear IA». Cloudflare separa tres comportamientos —Search, Agent y Training— y ofrece tres respuestas para cada uno: bloquear en toda la web, bloquear únicamente en páginas con anuncios o no bloquear. La configuración está disponible para todos los clientes, incluido el plan gratuito, según la documentación oficial de Cloudflare.

Esta guía explica qué revisar y cómo decidir sin confundir visibilidad, agentes y entrenamiento. No propone una configuración universal: una tienda, un medio y una intranet pública pueden tener objetivos distintos.

Qué cambia exactamente el 15 de septiembre

Cloudflare clasifica el tráfico automatizado por el uso que declara o detecta. Search corresponde a rastreadores que recopilan o indexan contenido para responder consultas más adelante. Agent abarca automatizaciones que visitan una página en tiempo real por encargo de una persona, como un agente que consulta información o realiza una tarea. Training se refiere a la recopilación destinada a entrenar o ajustar modelos.

Desde hoy, los dominios nuevos incorporados a Cloudflare reciben como valores predeterminados el bloqueo de Training y Agent en las páginas que muestran anuncios, mientras Search permanece permitido. «Predeterminado» no significa obligatorio: el propietario puede cambiar cada opción.

Hay un segundo cambio más delicado. Los rastreadores multipropósito que combinan Search y Training quedan sujetos a todas las funciones con las que estén clasificados. Si una configuración bloquea Training, ese rastreador mixto también puede quedar bloqueado aunque el propietario mantenga Search permitido. Cloudflare cita como ejemplos Googlebot, Applebot y BingBot. Por eso conviene comprobar el efecto antes de asumir que bloquear entrenamiento nunca afectará al rastreo relacionado con buscadores.

La anterior opción general «Block AI bots» queda obsoleta el 15 de septiembre. La documentación la presenta como una función en retirada y dirige a los controles separados. Quien configuró la web hace meses no debería dar por hecho que conserva exactamente el mismo comportamiento.

Antes de tocar nada: define qué quieres conservar

El ajuste correcto depende de una pregunta sencilla: ¿qué intercambio espera la web a cambio del acceso automatizado? Una publicación puede querer aparecer en buscadores, limitar el entrenamiento y permitir que un asistente consulte una página cuando un lector lo solicita. Otra puede preferir bloquear agentes en áreas con publicidad para proteger visitas y recursos.

Conviene anotar por separado cuatro objetivos: visibilidad en buscadores, apariciones en respuestas de IA, acceso de agentes y uso para entrenamiento. Nuestra guía para aparecer en ChatGPT y otros buscadores con IA explica por qué rastreo, indexación y citación no son la misma cosa. Permitir una visita no garantiza aparecer; bloquearla sí puede impedir que un sistema lea el contenido.

También merece la pena identificar qué páginas sostienen el negocio. La opción «bloquear en páginas con anuncios» utiliza la detección automatizada de Cloudflare y permite una política distinta para esas páginas. No equivale a bloquear toda la zona ni a seleccionar manualmente cada URL.

Cómo revisar la configuración paso a paso

  1. Accede a la zona que quieres revisar. La política se configura por web, de modo que una cuenta con varios dominios necesita revisar cada zona relevante.
  2. Abre Security Settings. La ruta documentada por Cloudflare es Security Settings > Configure AI bot policies.
  3. Revisa Search, Agent y Training por separado. Para cada comportamiento, comprueba si está en Block, Block on pages with ads o Allow.
  4. Presta especial atención a Training. Desde el 15 de septiembre, bloquear esta categoría también puede bloquear rastreadores mixtos clasificados a la vez como búsqueda y entrenamiento.
  5. Guarda un registro de la decisión. Anota fecha, zona, valor anterior, valor nuevo y motivo. Será necesario para interpretar después un cambio de rastreo o de tráfico.
  6. Comprueba el resultado con tus propias herramientas. Observa los registros o analíticas de bots que tengas disponibles y revisa las herramientas de los buscadores. No atribuyas una variación de tráfico a este ajuste sin comparar fechas y causas.

Los nombres anteriores corresponden a la interfaz documentada por Cloudflare el 15 de septiembre de 2026. La empresa puede traducir o reorganizar el panel, pero la guía oficial mantiene esa ruta y las tres opciones de mitigación.

Tres configuraciones orientativas

ObjetivoPunto de partida para evaluar
Priorizar descubrimiento y visitasMantener Search permitido; evaluar Agent y Training por separado. Vigilar especialmente los rastreadores mixtos.
Proteger contenido con publicidadValorar el bloqueo de Agent o Training solo en páginas con anuncios, sin asumir que Search quedará intacto en todos los casos.
Máximo control sobre reutilizaciónBloquear Training y decidir aparte sobre Agent. Medir el posible efecto en rastreadores que tengan más de una finalidad.
Escenarios de análisis propuestos por Pangea IA; no son recomendaciones automáticas para todas las webs.

En una tienda, permitir agentes puede facilitar que un asistente consulte disponibilidad o complete una tarea para el usuario, pero también aumenta tráfico automatizado. En un medio, la prioridad puede ser separar el rastreo que aporta referencias del que absorbe contenido sin visitas. En una web corporativa, quizá importe más reducir carga y controlar cómo se reutiliza la documentación pública.

La decisión no debe basarse únicamente en el nombre del bot. Cloudflare defiende clasificarlo por conducta porque un mismo operador puede utilizar rastreadores diferentes o un rastreador con varios propósitos. Ese cambio de enfoque es precisamente el motivo por el que la configuración antigua necesita revisión.

Qué papel tiene robots.txt

Cloudflare también utiliza Content Signals en robots.txt para expresar preferencias como permitir búsqueda, rechazar entrenamiento o limitar la reutilización. Sin embargo, la propia compañía aclara que esos valores comunican una preferencia; no ejecutan por sí solos el bloqueo.

La diferencia es importante. robots.txt funciona como una instrucción para rastreadores que deciden respetarla. Las reglas de Cloudflare actúan en la capa de acceso y pueden detener solicitudes clasificadas. Cambiar únicamente el archivo robots.txt no reproduce necesariamente el resultado de una política de bloqueo.

Tampoco hay que confundir «no usar para entrenamiento» con «no conservar ningún dato». En nuestra cobertura sobre las garantías de datos que reclaman NVIDIA y Palantir diferenciamos procesamiento, retención y entrenamiento. En el rastreo web ocurre algo parecido: la finalidad declarada y el acceso técnico son capas diferentes.

Errores frecuentes y cómo evitarlos

Bloquear Training y dar por garantizado el SEO

La separación entre Search y Training parece resolver el dilema, pero los rastreadores mixtos complican la decisión. Si uno está clasificado en ambas categorías, la regla más restrictiva puede prevalecer. Antes de cambiar, identifica qué buscadores te importan y prepara una medición.

Pensar que los nuevos valores afectan igual a todo el mundo

Cloudflare especifica que los nuevos dominios reciben los valores predeterminados para páginas con anuncios. Las webs existentes pueden conservar elecciones previas, haber aceptado los nuevos valores o tener la opción antigua. La única respuesta fiable está en la configuración de cada zona.

Confundir agentes con entrenamiento

Un agente puede visitar una página para responder a una petición inmediata sin estar entrenando un modelo con ella. Bloquear Agent puede impedir funciones útiles para usuarios reales que emplean asistentes. Permitirlo, por otro lado, consume recursos y requiere confiar en la clasificación y el comportamiento del operador.

Esperar un efecto instantáneo en visitas

El bloqueo de solicitudes puede verse pronto en registros, pero sus consecuencias sobre indexación, respuestas y tráfico tardan en aparecer. Además, una caída puede coincidir con cambios de algoritmo, demanda o contenido. Conserva una línea base y compara periodos equivalentes.

Cómo medir si la decisión funciona

Una revisión útil combina métricas técnicas y editoriales. En lo técnico, cuenta solicitudes automatizadas permitidas y bloqueadas, ancho de banda y respuestas con error. En lo editorial, observa páginas indexadas, referencias recibidas, apariciones verificables y sesiones procedentes de buscadores o asistentes.

El objetivo no es maximizar o minimizar bots de forma abstracta. Es mantener el tráfico automatizado que aporta valor y limitar el que no encaja con la estrategia. La distinción importa especialmente ahora que la búsqueda tradicional y las respuestas generadas se mezclan. Nuestro análisis sobre ChatGPT como rival de Google en la UE ofrece contexto sobre esa convergencia.

Para una pyme, proponemos revisar primero una sola zona, documentar la política y observarla durante un periodo suficiente antes de copiarla a todas las webs. Si el acceso de un rastreador importante cambia, será más fácil localizar la causa y revertir la decisión.

Conclusión: hoy toca revisar, no bloquear a ciegas

El cambio de Cloudflare aporta controles más precisos, pero también hace visible una tensión real: algunos rastreadores combinan búsqueda y entrenamiento. Desde el 15 de septiembre, una prohibición de Training puede alcanzar a esos bots multipropósito. La medida da más poder al propietario, aunque exige entender qué está configurando.

La actuación razonable es comprobar Search, Agent y Training por separado, anotar el estado y medir el resultado. Una web que vive de ser descubierta no debería sacrificar visibilidad por una interpretación apresurada; una que protege contenido tampoco necesita aceptar todos los usos para seguir abierta a lectores.

Lecturas relacionadas

Fuentes consultadas

Consulta realizada el 15 de septiembre de 2026. Cloudflare: nuevas opciones para gestionar el tráfico de IA — anuncio del 1 de julio con la fecha de entrada en vigor. Documentación de Cloudflare sobre las políticas de bots de IA — configuración y alcance vigentes. Registro de cambios de Cloudflare — resumen técnico de los nuevos valores. TechCrunch: impacto para editores y rastreadores multipropósito — contexto periodístico independiente. La activación del 15 de septiembre es la novedad que motiva esta guía; el anuncio original se publicó el 1 de julio.

La imagen destacada es una ilustración editorial generada con IA. No reproduce la interfaz real de Cloudflare ni el aspecto de rastreadores concretos.

Recibe las nuevas publicaciones de Pangea IA

Suscríbete gratis y recibe por correo las nuevas noticias, guías y análisis sobre inteligencia artificial.

Deja una respuesta