Cloudflare corta el dilema: diga no al entrenamiento de IA y síguase viendo en Google, Apple y Bing

Cloudflare corta el dilema: diga no al entrenamiento de IA y síguase viendo en Google, Apple y Bing

19-09-2026 4:25:51
Compartir:

Durante años, dueños de sitios enfrentaron un dilema incómodo: si querían impedir que su contenido alimentara modelos de inteligencia artificial, a veces también perdían la posibilidad de aparecer en la búsqueda. El motivo es técnico y muy concreto: varios robots «de uso mixto» hacen las dos cosas a la vez —indexar para Google, Apple o Bing y recopilar texto para entrenamiento—.

El 15 de septiembre de 2026, Cloudflare anunció un control pensado justo para cortar ese tradeoff: Disallow AI Training. En lenguaje de pyme: puede decir «sí quiero que me encuentren en la búsqueda» y, al mismo tiempo, «no quiero que usen mi web para entrenar modelos», sin tener que apagar el robot completo.

Emprendedora mexicana revisa ajustes de seguridad web en laptop en oficina luminosa
Pyme revisando controles de crawlers sin perder SEO

El dilema que vivían las pymes (y por qué importaba)

Cloudflare explica que casi nadie quiere desaparecer de la búsqueda: menos del 1 % de los sitios en su red eligen bloquear bots de Search. En cambio, el entrenamiento es otra historia: alrededor del 17 % ya usa algún mecanismo para frenar que su contenido sirva para entrenar IA. Esas dos cifras, en palabras simples, dicen: «la gente quiere visitas de Google; no necesariamente quiere regalar su texto a un modelo».

Un archivo robots.txt solo no basta: cualquiera puede publicarlo, pero no identifica con certeza quién rastrea ni puede detener a quien lo ignore. Cloudflare, como red, promete publicar la preferencia, identificar al crawler, clasificar para qué viene y bloquear a quien no respete la regla —con transparencia en Cloudflare Radar—.

Equipo en coworking discute robots.txt y preferencias de bots en monitor
Bot Preference Sync: una preferencia, varios buscadores

Qué es «Disallow AI Training» y la etiqueta Accountable

El nuevo ajuste se llama así porque publica una preferencia de tipo Disallow (no permitir entrenamiento) a través de Bot Preference Sync, que escribe esas reglas en el robots.txt del dominio. Los crawlers mixtos que Cloudflare marca como Accountable pueden seguir entrando para búsqueda; el resto del tráfico de entrenamiento se bloquea.

Para ganar la designación Accountable, el operador debe cumplir o comprometerse a: un opt-out de entrenamiento (robots.txt o similar); un camino para salir de resúmenes de IA; visibilidad a nivel URL de cómo se usó el contenido; y la garantía de que rechazar entrenamiento no baja el ranking de búsqueda tradicional. Apple, Google y Microsoft cumplen o se comprometieron en plazos concretos. También se consideran Accountable crawlers de Amazon, Anthropic, Meta y OpenAI que separan el robot de búsqueda del de entrenamiento: bloquear el de entrenamiento no tumba el SEO.

Detalle útil sobre Bing: hoy el opt-out de entrenamiento vía robots.txt aún se está construyendo (meta hacia principios de 2027). Mientras tanto, Microsoft ofrece controles con la etiqueta NOARCHIVE y herramientas en Webmaster Tools; Cloudflare aclara que Disallow AI Training todavía no transmite sola la preferencia a Bing por robots.txt.

Mujer de espalda frente a laptop con panel de Security Settings borroso
Disallow AI Training vs Block: la diferencia que salva su ranking

Ojo: «Block» ahora también corta Googlebot

Esto es lo más fácil de equivocar. Antes, «Block» y «Block on pages with ads» no aplicaban a crawlers mixtos porque cortarlos podía sacar el sitio de la búsqueda. Desde el 15 de septiembre, esos modos sí aplican a mixtos —incluidos Applebot, Bingbot y Googlebot—. Si solo quiere frenar entrenamiento y conservar SEO, use Disallow AI Training, no Block.

Además, el interruptor genérico «Block AI Bots» se depreca a favor de tres controles independientes: Search, Training y Agent. Managed Robots.txt migra a Bot Preference Sync. Los controles están disponibles en todos los planes de Cloudflare, en Security Settings por dominio.

Qué hacer hoy si su pyme está en Cloudflare

Dueña de negocio y colega marcan checklist de Cloudflare en mesa de trabajo
Qué hacer hoy: Security Settings → Training → Disallow AI Training
  1. Entre al panel de Cloudflare del dominio.
  2. Vaya a Security Settings (ajustes de seguridad) del sitio.
  3. En el control de Training, elija Disallow AI Training.
  4. Deje Search en Allow si quiere seguir apareciendo en Google, Apple y Bing.
  5. No pulse Block «por si acaso»: eso también detiene a los robots de búsqueda mixtos.

Si el dominio es nuevo y monetiza con anuncios, Cloudflare recomienda un preset más restrictivo (Search permitido, Training en Disallow, agentes bloqueados en páginas con ads). Puede cambiarlo cuando quiera.

Lo que viene: resúmenes de IA (y por qué importan al negocio)

Cloudflare dice que el siguiente foco son los resúmenes de IA en la búsqueda. Más de la mitad de los consumidores ya leen resúmenes; quienes lo hacen tienen más de 40 % de probabilidad adicional de terminar la búsqueda ahí mismo —es decir, menos clics al sitio—. Pero quienes llegan referidos por búsqueda con IA convierten entre 3 y 5 veces más que el tráfico de búsqueda tradicional: menos visitas, a veces más intención de compra. Un medio financiado por publicidad puede querer volumen; una tienda, calidad. El control fino de cuánto contenido entra en el resumen es la siguiente pieza.

Por qué esto es brand-safe para su negocio

No se trata de pelear con la inteligencia artificial ni de acusar a nadie: es un control de producto. Usted decide si su blog, catálogo o landing alimenta un modelo, sin renunciar a las visitas que llegan desde la búsqueda. Para una pyme mexicana que vive del tráfico orgánico, esa separación —antes imposible con crawlers mixtos— es la pieza que faltaba.

Si administra varios dominios, revise dominio por dominio: los ajustes de Training, Search y Agent son por zona. Y si alguien del equipo marcó «Block AI Bots» hace meses, confirme la migración automática a Disallow AI Training en Training y Allow en Search; Cloudflare documenta tablas de migración para no llevarse sorpresas el día del cambio.

Fuentes

Si su pyme necesita un sitio claro, rápido y listo para estos controles de crawlers, revise las opciones de Presticorp para pymes: diseño y hosting pensados para que Google lo encuentre… y usted decida qué se entrena con su contenido.

Compartir:

0 Comentarios

Deja un comentario

Landing pages especializadas

¿Proyecto totalmente personalizado? Contáctanos.

Si tu proyecto requiere una solución más enfocada, entra directo a la landing ideal para tu negocio y envíanos tu información en el formulario correspondiente.