Check Point PromptGuardX: Protegiendo los archivos en los que confían los agentes de IA
Por: Asaf Avisar, Líder de Equipo, Emulación de Amenazas y Seguridad con IA de Check Point
La inyección de comandos se está convirtiendo en un riesgo de ejecución
Las instrucciones ocultas en contenido externo pueden intentar activar las herramientas, las API y los permisos de un agente de IA
PromptGuardX traslada la detección a la capa de archivo. Integrado en Check Point Threat Emulation, analiza los archivos PDF antes de que su contenido llegue a un sistema de gestión de lógica descriptiva (LLM) o a un agente de IA
Los agentes de IA leen cada vez más facturas, contratos, correos electrónicos y datos empresariales, y luego utilizan herramientas y API para completar tareas. Esto cambia el modelo de seguridad: los documentos que consumen ya no son referencias pasivas, sino datos que pueden influir en las decisiones que tome el agente a continuación.
Cuando el contenido se convierte en un comando
Esto crea una oportunidad para la inyección indirecta de instrucciones: un atacante inserta instrucciones dentro de un PDF, correo electrónico, sitio web o resultado de una herramienta y espera a que un sistema de IA lo procese.
Un usuario puede solicitar a un agente que resuma una factura, mientras que un texto oculto dentro del documento le indica que recupere información, active una herramienta o envíe datos a otro lugar.
El PDF que ve el usuario no es necesariamente lo que lee la IA
Aquí es donde la seguridad tradicional de archivos y la seguridad de la IA comienzan a superponerse: el archivo puede estar limpio desde la perspectiva del malware, pero ser inseguro para un sistema de IA que trata su contenido como instrucciones.
Un usuario ve un PDF renderizado, pero una aplicación de IA puede procesar texto extraído de la estructura subyacente del archivo. Los atacantes pueden explotar esta vulnerabilidad con texto invisible, capas ocultas o manipulación de Unicode. El resultado es un archivo que no contiene malware, pero que aún incluye instrucciones destinadas a un agente de IA.
El Informe de Seguridad de IA 2026 de Check Point reveló que la detección de mensajes maliciosos más largos aumentó aproximadamente cinco veces entre marzo y mayo de 2026, alcanzando casi el 1 % de los mensajes observados en mayo. Esta tendencia refleja un creciente riesgo.
Muchos controles de seguridad de IA inspeccionan las indicaciones y respuestas, supervisan los agentes durante la ejecución o validan las acciones antes de su ejecución. Si bien estos controles siguen siendo esenciales, para entonces el contenido del documento ya podría haber sido extraído, dividido en fragmentos, almacenado o fusionado con otras fuentes.
PromptGuardX añade un punto de aplicación más temprano, examinando las instrucciones sospechosas mientras aún se encuentran dentro de los documentos. En lugar de esperar a que un PDF se convierta en un archivo de entrada para la IA, PromptGuardX amplía la emulación de amenazas para inspeccionar el archivo antes de que la IA lo procese. Esto añade un punto de control inicial dentro del plano de defensa de IA.
Cómo Funciona – PromptGuardX analiza el PDF en cuatro etapas
1. Extraer y normalizar
El motor extrae el texto que un sistema de IA posterior que pueda recibir, incluyendo el contenido oculto mediante formato, posicionamiento o estructura del documento.
2. Localiza instrucciones sospechosas
Un prefiltro identifica que requiere un análisis más profundo, como la suplantación de delimitadores, la imitación de instrucciones del sistema o del desarrollador, la reasignación de roles, las instrucciones para ignorar instrucciones anteriores o las solicitudes para ocultar una acción.
3. Analizar el contexto y la intención.
La inyección de código suele abarcar varias líneas, combinando un delimitador falso, una declaración de autoridad, una condición de ejecución, una acción solicitada y una instrucción para no divulgarla.
4. Generar un veredicto explicable.
En el caso de contenido sospechoso, PromptGuardX genera una puntuación de confianza e identifica las ventanas de texto específicas que desencadenaron el veredicto, lo que permite que el informe de Emulación de Amenazas muestre tanto la clasificación como la evidencia textual. El veredicto pasa a formar parte del proceso de inspección de archivos.
PromptGuardX incorpora la detección de intenciones dirigida por IA al proceso de inspección de archivos existente, añadiendo una nueva pregunta ¿Es este archivo seguro para el sistema de IA que está a punto de procesarlo? PromptGuardX divide el texto en ventanas superpuestas para que estas relaciones permanezcan visibles, y luego evalúa cada ventana con un clasificador específico y ajustado con precisión.
En la demostración de PromptGuardX, una factura de apariencia estándar contiene una instrucción oculta. Cuando se le pide a un sistema de IA que resuma el documento, la instrucción intenta que ejecute calc.exe.
La calculadora sirve como sustituto seguro para la ejecución de comandos. La factura no contiene ningún archivo ejecutable ni explota ninguna vulnerabilidad de los archivos PDF; la acción depende de que un sistema de IA lea la instrucción, la siga y tenga acceso a la herramienta adecuada.
En un flujo de trabajo empresarial, una instrucción similar podría intentar recuperar registros de proveedores, enviar información externamente, cambiar detalles de pago o invocar una herramienta no relacionada con la solicitud del usuario. El éxito del intento depende de los permisos del agente y de los controles posteriores. PromptGuardX aborda el ataque de forma anticipada: antes de que el agente reciba la instrucción.
Ningún control por sí solo elimina la inyección instantánea. Los sistemas de IA aún requieren inspección inmediata, monitoreo en tiempo de ejecución, acceso con privilegios mínimos y aplicación de medidas a nivel de acción. Dentro del AI Defense Plane de Check Point, PromptGuardX agrega una capa adicional de protección en el punto donde puede comenzar un ataque basado en el contenido: dentro del archivo.
PromptGuardX está integrado en el sistema de emulación de amenazas de Check Point, lo que permite que las implementaciones compatibles en Quantum, Harmony Email & Collaboration y las pasarelas habilitadas para la emulación de amenazas inspeccionen los PDF en busca de intentos de inyección de mensajes antes de que su contenido llegue a un sistema de IA. A medida que los agentes interactúan cada vez más con el contenido empresarial, el contenido que consumen pasa a formar parte del perímetro de seguridad de la IA.

