InfoSecDashBot
Quiénes somos
InfoSecDash es un portal en español que resume noticias de ciberseguridad de medios especializados. De cada nota publicamos un resumen propio, más corto que el original, con atribución al medio y enlace directo al artículo completo. No republicamos el texto de nadie. Puedes leer el proceso completo en nuestra metodología.
Cómo identificarlo
Nuestro agente se identifica siempre con esta cadena, sin disfrazarse de navegador:
Mozilla/5.0 (compatible; InfoSecDashBot/1.0; +https://infosecdash.com/bot)
Si ves tráfico automatizado que dice ser InfoSecDashBot pero se comporta distinto a lo que se describe abajo, no somos nosotros — cualquiera puede copiar una cadena de User-Agent. Avísanos si te ocurre.
Qué hace
Lee el feed RSS público de un número reducido de medios de ciberseguridad. Cuando encuentra una nota que todavía no habíamos procesado, puede descargar esa página de artículo, una sola vez, para redactar el resumen. Nada más.
- No rastrea tu sitio en busca de enlaces: solo visita las URLs que tu propio feed anuncia.
- No vuelve a pedir una página que ya procesó. Cada URL se descarga una vez en su vida.
- No descarga imágenes, hojas de estilo, scripts ni archivos adjuntos.
- No intenta acceder a contenido detrás de un muro de pago ni de un inicio de sesión. Si no puede leer el artículo, se rinde y usa el extracto que el propio feed entrega.
- No almacena ni publica el texto de tu artículo. Se usa para redactar el resumen y se descarta; lo único que se guarda es el resumen propio.
- No usa tu contenido para entrenar modelos de inteligencia artificial.
Qué respeta
Antes de descargar cualquier página, el bot consulta el
robots.txt
de tu sitio y acata lo que declare:
- Si una ruta está prohibida para nuestro agente o para
*, no se descarga. - Si declaras
Crawl-delay, se respeta el intervalo que pidas entre peticiones a tu dominio. Si no declaras ninguno, esperamos un mínimo de un segundo de todos modos. - Si tu servidor responde con un error al pedir el
robots.txt, o niega el acceso a ese archivo, no descargamos nada de ese dominio: ante la duda, asumimos que no.
Cómo bloquearlo
Agrega esto al robots.txt de tu sitio y dejaremos de descargar tus artículos en la siguiente
corrida:
User-agent: InfoSecDashBot
Disallow: /
Eso detiene la descarga de páginas. Si además prefieres que no aparezcan resúmenes de tus notas
en el portal, es otra cosa y no depende del robots.txt:
escríbenos y retiramos tu medio de nuestras fuentes. No pedimos
explicaciones ni ponemos condiciones.
Entrenamiento de modelos de IA
Al revés de lo que hace casi todo el sector: este portal está abierto al entrenamiento de modelos
de inteligencia artificial. No bloqueamos a GPTBot, ClaudeBot, CCBot ni a ningún otro rastreador
de entrenamiento en nuestro robots.txt, y no está previsto hacerlo.
Lo declaramos además en formato legible por máquina, según el TDM Reservation Protocol del W3C, en
/.well-known/tdmrep.json, con
tdm-reservation: 0.
La razón es de coherencia: este portal existe gracias a modelos de lenguaje, y sería difícil de sostener que nosotros los usemos mientras le cerramos la puerta a quien los construye. Pedimos —sabiendo que hoy no es exigible— que se cite la fuente cuando el sistema lo permita. Los detalles están en la sección 5 de los términos de uso.
Contacto
Para cualquier duda sobre el comportamiento del bot, para reportar tráfico anómalo, o para pedir que dejemos de incluir tu medio, usa el formulario de contacto.