La ciberdelincuencia en foros clandestinos se acelera con el desarrollo y la comercialización activa de herramientas de inyección indirecta de prompts, diseñadas para atacar aplicaciones y agentes impulsados por IA.
En estos mercados se anuncian servicios capaces de insertar prompts ocultos en correos electrónicos, archivos PDF, invitaciones de calendario y anuncios maliciosos, con el objetivo de manipular a los agentes. “Estas técnicas todavía se encuentran en una fase emergente, pero demuestran cómo los atacantes se están preparando para la próxima generación de ataques basados en IA”, explican los expertos de seguridad de Proofpoint.
Ataques con IA
El impacto de la IA en el panorama de las amenazas continúa siendo una de las principales preocupaciones de las organizaciones, tanto por la forma en que los ciberdelincuentes emplearán esta tecnología para lanzar sus ataques como por la necesidad de proteger sus propias aplicaciones de IA y agentes inteligentes ya desplegados. Se sigue observando una adopción generalizada de herramientas asistidas por modelos de lenguaje de gran tamaño (LLM) y de contenido generado por IA dentro de las cadenas de ataque, lo que incrementa la escala, la velocidad y la variabilidad de las campañas maliciosas.
En el caso de la inyección de prompts, aunque se trata de un vector de ataque ampliamente estudiado, la mayoría de las metodologías que podrían adoptar los atacantes siguen siendo hipotéticas. Concretamente, la inyección indirecta de prompts ocurre cuando un LLM procesa información procedente de fuentes externas, como sitios web o archivos, y ese contenido externo puede incluir instrucciones que, al ser interpretadas por el modelo, alteran su comportamiento de forma no prevista o inesperada.
Entre los ejemplos más analizados por la comunidad defensiva destaca el uso de la inyección de prompts en contextos legibles por máquinas, pero invisibles para los usuarios, como ocultar el prompt dentro del código fuente de una página web. También puede incorporarse a archivos adjuntos enviados por correo electrónico que contienen instrucciones dirigidas a un agente encargado de analizar el contenido, o bien insertar elementos ocultos mediante texto blanco sobre fondo blanco dentro del documento. Otra de las herramientas observadas genera invitaciones de calendario con un prompt inyectado en el cuerpo del mensaje, presentado como si fuera el orden del día de una reunión, y, cuando un agente de IA resume el contenido, también procesa el prompt malicioso. Los atacantes además planean ocultar prompts dentro de anuncios maliciosos que se cargan dinámicamente. Así, en el momento en que un agente de IA visita estas páginas, puede analizar su contenido y procesar dichos prompts ocultos.





