Si llevas una peluquería, un restaurante o una consulta, seguro que piensas que la IA va de otras cosas: de empresas grandes, de buscadores, de marketing. La realidad es más cercana. Programas que trabajan para asistentes de IA ya pueden estar leyendo tu web ahora mismo. Aquí va cómo comprobarlo sin ser técnico y qué hacer después.
Qué es un agente de IA (y en qué se diferencia del robot de Google)
Llevas años conviviendo con robots en tu web. El del buscador entra, lee tus páginas y se va a indexarlas: su trabajo acaba en archivar y clasificar. Un agente de IA hace más: es un programa que entra en tu web en nombre de una persona, con un encargo concreto.
Si alguien le pide a su asistente «busca un dentista que abra el sábado y dime cuánto cuesta la primera visita», el agente visita webs reales: consulta horarios, compara precios y, en algunos casos, prepara una reserva o una compra para que la persona solo tenga que confirmar.
En las estadísticas o los registros del hosting estos programas aparecen con nombres como GPTBot, ClaudeBot o PerplexityBot. No son virus: son las «cabezas visibles» de asistentes que quizá tus clientes ya usan a diario.
Por qué tu web pequeña ya les interesa
Es fácil pensar «para qué van a mirar mi web, si soy un negocio de barrio». El motivo es simple: cuando alguien pregunta a un asistente «¿qué restaurante abre el domingo cerca de mí?», la respuesta no sale de la nada. Sale de leer webs como la tuya: horario actualizado, carta con precios, servicios, disponibilidad.
Cada vez más preguntas de este tipo se resuelven así, y por eso el tráfico automatizado crece también en negocios pequeños y locales, no solo en grandes portales. No hace falta que seas famoso: basta con que estés cerca y con que tu web responda a esa pregunta.
Esto tiene dos caras. La oportunidad: que un asistente te mencione cuando alguien busca lo que vendes, algo de lo que ya hablamos en otra entrada. El riesgo: que junto a los visitantes útiles lleguen otros que abusan. De las dos caras va este artículo.
Señales de que ya recibes visitas de IA (sin ser técnico)
No hace falta saber programar. Con estas cinco señales te haces una foto bastante fiel:
- Mira las estadísticas o los registros de tu hosting. Busca user agents con nombres como GPTBot, ClaudeBot o PerplexityBot. Muchos paneles los listan en un apartado de «crawlers» o «bots».
- Revisa tu analítica en busca de visitas raras. Tráfico «directo», sin referencia, que no hace clic en nada y no pasa de la primera página suele ser lectura automatizada.
- Cuenta los formularios fantasma. Envíos repetidos o reservas que nadie confirma ni contesta el teléfono pueden ser formularios rellenados por programas.
- Vigila los recursos del servidor. Picos de consumo o una web de repente lenta sin visitantes reales es una señal clásica de tráfico automatizado.
- Si no puedes ver nada de esto, pregunta. Pide a tu hosting el listado de crawlers del último mes. Es una petición normal y te lo tienen que dar.
Tráfico de IA legítimo y tráfico de IA abusivo no son lo mismo
Que un agente lea tu horario, tu carta o tus precios no es un ataque. Es la parte legítima, y de ahí puede salir un cliente: alguien preguntó, un asistente buscó, tu web respondió. Incluso puedes facilitar ese trabajo haciendo la web legible para asistentes sin exponer datos.
Lo problemático es otra cosa: programas que intentan sacar datos que no son públicos, que spamean formularios, que prueban inyecciones de prompt para manipular a otras IAs o que machacan el servidor hasta tumbarlo.
Bloquearlo todo a ciegas te deja sin lo bueno y sin protección contra lo malo: ni apareces donde un asistente compara negocios locales, ni frenas de verdad al que abusa. La pregunta razonable no es «¿sí o no a la IA?», sino «¿esta petición concreta es legítima o no?».
Qué debe hacer un firewall pensado para agentes de IA
Un firewall clásico mira IPs y reglas fijas, pensadas para personas. Los agentes piden otro enfoque. Si vas a valorar una solución, estos criterios te sirven de lista de la compra:
- Decidir en cada petición. Un filtro rápido y determinista (sin IA) que permita, bloquee o ponga en cuarentena al momento, sin esperar a que pase algo gordo.
- Ante la duda, bloquear. Lo que se llama fail-closed: las peticiones sospechosas por contenido (una inyección de prompt, un intento de sacar datos) se juzgan después, y si no llega veredicto, se bloquean.
- Cuidar la privacidad incluso defendiéndote. No hace falta guardar la IP de cada visitante en claro: un hash diario basta para detectar repetición sin acumular datos personales.
- Aprender de los ataques. Lo que se juzga como ataque debería convertirse en regla que proteja al resto de webs durante un tiempo, no solo a la tuya.
- Facilitar lo legítimo a la vez. Que la web sea legible por asistentes (por ejemplo, con un manifiesto /.well-known/agent.json y un servidor MCP) exponiendo solo lo que ya es público.
WordNext Guardian es un ejemplo de este enfoque: un carril rápido determinista decide en cada petición, aplica fail-closed cuando no hay veredicto, guarda un hash diario en lugar de la IP en claro, convierte los ataques en reglas para todas las webs durante 30 días y mantiene la web legible por asistentes exponiendo solo lo público.
Qué hacer hoy mismo: plan de cuatro pasos
- Mira tus estadísticas o registros y anota qué user agents de IA aparecen y con qué frecuencia.
- Fíjate en qué páginas tocan más. Horarios, carta y precios suelen ser las más leídas: son las que responden a las preguntas típicas.
- Decide qué quieres que puedan hacer los agentes. ¿Que lean lo público? ¿Que puedan reservar, siempre con confirmación de la persona? ¿Nada? Es tu web y tu norma.
- Si no puedes ver nada de esto, pídeselo a tu proveedor o valora una plataforma que traiga de serie la analítica sin cookies y el control de este tráfico.
Una tarde mirando estadísticas con curiosidad te dirá más que un mes de preocupación difusa.
Preguntas frecuentes
¿Puedo saber qué agentes de IA visitan mi web si no tengo acceso a los registros del servidor?
Sí. El panel de estadísticas del hosting y la analítica de tu plataforma suelen bastar. Y si no, pide a tu proveedor el listado de crawlers del último mes.
¿Basta el archivo robots.txt para controlar a los agentes de IA?
No. robots.txt es una recomendación que los bots educados suelen respetar, pero no es una barrera de seguridad ni todos los agentes la siguen. Un firewall sí decide y aplica en cada petición.
¿Debería bloquear por completo a los agentes de IA?
Bloquearlo todo también te saca de las respuestas donde un asistente compara negocios locales. Lo razonable es permitir leer lo público y frenar el abuso petición a petición.
¿Un agente de IA puede reservar o comprar en mi web sin mi permiso?
Eso es justo lo que debe impedir un firewall agéntico. En WordNext, una IA solo puede reservar o preparar una compra si el negocio lo activa, y siempre con confirmación de la persona o un mandato firmado por ella; el precio lo calcula siempre el servidor.
Los agentes de IA ya no son tema solo de grandes empresas: leen la web de cualquier negocio que responda a una pregunta. Saber si ya te visitan es el primer paso; decidir qué pueden hacer, el segundo. Si quieres ver cómo se ve todo esto junto, mira la ficha de WordNext Guardian: firewall agéntico y web legible por asistentes, sin promesas mágicas.